神探伽利略
开源,浙产大模型向世界敞开大门_我的网站

一 | 连续多周包揽全球开源模型调用量排名前两席8月13日凌晨,杭州深度求索人工智能基础技术研究有限公司(DeepSeek),又悄悄搞了个大动作——DeepSeek V4 Pro正式版发布。
在众多由前 Google DeepMind 员工创办的初创公司中,Inherent 此前获得的关注相对较少。不过,与那些资金更加充裕、却还没有拿出太多实际成果的竞争对手相比,这家总部位于伦敦的团队如今已经开始展示自己的研发成果。此前,DeepSeek V4的另一个版本Flash正式版已于7月底发布。从官方测评数据看,Pro版本能力大幅提升,多项指标已接近Anthropic Fable 5等国外顶尖闭源模型。
二 | 这家英国初创公司仅在以 5,000 万美元(IT之家注:现汇率约合 3.37 亿元人民币)种子轮融资走出隐身模式几周后,就宣布推出新的 AI 智能体 Faraday。该公司表示,在一项特定任务中,Faraday 击败了规模更大、知名度更高的 AI 模型:在事先不知道答案的情况下,自主复现已发表科学论文中的研究结果。而在十天前,另一家浙江公司阿里巴巴发布旗舰模型Qwen3.8-Max,首次亮相即进入权威评测平台LMArena综合榜Top 5。

三 | 全球开源模型调用量排名中,两个浙产大模型DeepSeek与千问已连续多周包揽前两席。人工智能正成为创新浙江最鲜明的标识、最核心的支撑。如果考虑到 Inherent 更宏大的目标 —— 打造能够发现全新科学知识,而不仅仅是验证已有研究成果的 AI,那么复现论文的能力听起来似乎只是一个“小把戏”。

四 | 但 Inherent 联合创始人兼首席科学家 Edward Hughes 表示,论文复现本身也是人类科学家的标准训练方式。而选择“开源”来加速技术迭代、构建产业生态,成为浙产大模型企业一条坚定而清晰的路径。这是企业对技术路径和商业模式的选择,也是浙江发展人工智能的战略共识。正如中国工程院院士、之江实验室主任王坚反复提及的观点:人工智能开源,正从开放源代码即“Open Source”,转为开放资源即“Open Resource”。“很多博士生实际上都是从这件事开始的。中国开放AI模型,本质上意味着把背后的资源和机遇开放给全世界。

五 | 性能做强,门槛降低“便宜的没它强,强的没它好用。”Hughes 告诉 TechCrunch,击败其他 AI 系统并不是重点,真正重要的是 Inherent 如何做到这一点。

六 | ”8月13日,杭州嗡嗡科技有限公司负责人刘杲劼试用了DeepSeek V4 Pro版本。他告诉记者,此前公司刚从国外模型切换到了7月底发布的DeepSeek V4 Flash版本,它在编程等工作上表现不错,费用降低了不少。他说:“对我们来说,最有意思的并不是击败那些前沿智能体的结果 —— 当然,我们对此也很高兴,而是我们构建这个系统的方式。

七 | ”真正值得投资者关注的是,Faraday 在与 Anthropic 的 Claude Opus 4.8 和 OpenAI 的 GPT-5.5 进行比较时,所依赖的却是一个规模小得多的模型 Qwen 3.6,仅拥有 270 亿参数。这两个对手都是规模庞大的前沿 AI 系统。这是DeepSeek和千问广受欢迎的原因:够便宜,够好用。便宜到什么程度?DeepSeek V4 Flash最近采用了分时定价机制,在空闲时段,每百万输出Token仅需4.5元人民币,即便在高峰时段,价格也仅为9元/百万输出Token。

八 | 简单来说,“参数”可以作为衡量模型规模的一个指标,通常也与模型的训练成本有关。此外,Inherent 对 Faraday 的成功标准也并不只是准确率。除了复现科学研究结果之外,公司还希望 Faraday 展现出所谓的“研究品味”,也就是能够判断哪些实验值得进行,以及应该如何合理设计这些实验的能力。教会 AI 掌握这种难以量化的“品味”并不容易,这也是强化学习发挥作用的地方。相比顶尖的国外模型,价格优势依然显著,两者在代码编写能力相差不大,官方测试数据显示仅差几个百分点。好用到什么程度?DeepSeek V4 Pro总参数1.6万亿、每次激活约490亿参数,V4 Flash总参数2840亿、激活130亿参数,两者全系开源,均支持百万Token超长上下文。Qwen3.8-Max同样如此:总参数量达2.4万亿,单次推理激活950亿参数,采用稀疏混合专家架构,支持最大1M Token的上下文窗口。这意味着开发者更方便在其上自由搭建、改造,并商业化落地。杭州电子科技大学计算机学院副院长余宙告诉记者,国内的开源大模型集中精力做了两件事——把模型性能做强,把使用门槛降低。

九 | 强化学习是一种训练 AI 的方法,它并不是把一套明确的规则直接告诉 AI,而是根据最终结果对 AI 的行为进行奖励,从而让系统逐渐学会采取更有效的行动。相比主要通过学习科学研究本身的流程来训练智能体,Inherent 更依赖这种基于奖励的训练方式。“中小企业很难从0到1训练一个大模型。

十 | 公司希望这种方法能够更好地泛化到长期目标,即让 AI 智能体具备参与多个科学领域研究工作的能力。”浙江古珀医疗科技有限公司是杭州一家专注医疗大数据领域的科技企业,创始人张强说,对开发者而言,这两大开源模型提供了成本更低、性价比更高的选择,拉低了人工智能现实落地的门槛。

十一 | Hughes 表示:“我们始终以打造 AI 科学家智能体、赋予智能体研究品味这一北极星目标为指导。古珀就利用开源模型Qwen3.6-35B-A3B和Qwen3.6-27B,打造了一个面向C端的医疗智能体,具有“医生分身+智能随访+慢病风险评估智能体+健康管理”等功能。”这一理念也影响了 Inherent 决定不开发哪些产品。

十二 | 例如,公司没有选择自行开发编程工具,而是让 Faraday 使用 OpenAI 的 GPT-5.5 Codex。截至目前,浙江累计已完成90款生成式人工智能服务备案。其中,有一些模型,就是利用千问、DeepSeek等基础大模型进行二次开发和参数调整获得的。融入全球,改写规则两个“顶流”大模型的背后,是浙江在战略层面锚定的路线。这与人类科学家的工作方式类似 —— 科学家通常会利用现成的软件工具,而不是把所有工具都从头开发一遍。Inherent 还试图避免打造那些只会迎合用户、告诉用户想听什么的 AI 智能体。Hughes 表示,公司希望打造的智能体更像他最喜欢的那类队友:他们会回来告诉你:“我对这个问题产生了兴趣,于是自己去做了这些实验。浙江省“十五五”规划纲要中六次提及“开源”,频次之高、着墨之重,前所未有。你觉得这些结果怎么样?”这种协作理念同样体现在 Inherent 的公司运营方式上。2026年省政府工作报告提出,“积极抢占人工智能发展制高点,着力营造最优开源开放生态”,将开源列为全省AI布局的核心抓手之一。目前公司约有 12 名员工,全部在伦敦国王十字区的一间办公室里线下办公。7月16日,浙江省委十五届九次全会在杭州举行。全会期间进行了人工智能专题辅导授课,组织考察了国家人工智能应用中试基地(具身智能)、“魔搭社区”(杭州)开发者中心、杭州城西科创大走廊未来科技城展馆。国王十字区曾经是一个较为破败的伦敦街区,但随着 Google DeepMind 在当地的发展,如今已经成为全球最重要的 AI 创新中心之一。其中,“魔搭社区”是国内最大的人工智能开源社区。Hughes 表示:“我们相信,伦敦就是最适合发展的地方。”Hughes 对伦敦高度密集的 AI 人才资源非常看好,但与此同时,他也加入了要求英国取消“竞业休假”(garden leave)制度的呼声。所谓“竞业休假”,是英国职场中较为常见的一种做法。魔搭社区以“模型即服务”的模式,线上汇聚全球超2900万人工智能开发者、超20万个模型,极大降低了人工智能应用创新的门槛。浙江大学人工智能学院教授、本科生院院长吴飞解释了开源的底层逻辑:“开源是开放知识与创造能力。AI技术具有先行者引领的溢出效应,需要去主动构建开源生态。”“极致性价比+开放生态”的浙产大模型,正在重写全球AI竞争的游戏规则。7月24日,AI硬件巨头英伟达创始人黄仁勋,发布了一封公开信呼吁开放模型权重。

十三 | 员工离职后,公司可以要求他们在数个月内不得加入竞争对手或创办竞争企业。该信件将开放模型比作1980年代开源软件运动——开放权重扩大了参与AI经济的途径。初创企业、成熟企业、高校及公共机构无需从零开始训练模型,也不必为每一项任务都支付高昂的尖端模型使用费,而是可以直接基于现有的先进模型进行开发。美国研究人员通常不会受到类似限制,这也让美国初创公司在招聘那些刚刚离开上一份工作的 AI 人才时拥有一定的先发优势。Hughes 告诉 TechCrunch:“这是我个人的看法,并不代表公司的立场,但我确实受到过竞业休假的影响。

十四 | 日前,联合国人工智能问题独立国际科学小组发布报告《对人工智能带来的机遇、风险和影响的询证评估》。

十五 | 该报告将Qwen及DeepSeek作为全球开源AI生态代表性案例单独列出。”最终,Hughes 找到了绕开这一限制的方法,并与另外两名前 DeepMind 员工以及第四位联合创始人共同创办了 Inherent。而这家初创公司目前也没有放缓发展的迹象。

十六 | Inherent 计划在今年年底前将员工人数扩大至“大约 20 至 25 人”。考虑到公司同样在布局世界模型,再加上 Demis Hassabis 出任新职后,一些 DeepMind 员工的未来去向出现不确定性,Inherent 正在进行的大规模招聘,或许会让它成为考虑离开 DeepMind 的员工颇具吸引力的新去处。
Current article:http://mvnd.qiuergejiaolaiaozhuangshi.buzz/6zv/xa7ukt2.html
Published on:22:00:12
