忏悔录
书名:双色球|作者:笑无语|本书类别:古言|更新时间:02:11:47|字数:3896字
一 | 近日,全球模型聚合平台OpenRouter最新周度Token(词元)调用榜单出现历史性变化:前五名全部为国产大模型,DeepSeek V4 Flash位居榜首,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2依次位列第二至第五名。DeepSeek V4 Flash正式版上线后,单日使用量和合作平台新订阅用户均实现约30%的增长,凭借突出的性价比优势,扭转全球AI开发者的使用格局。

二 | 有记者提问:9月9日,《禁止生物武器公约》缔约国协商会议在日内瓦闭幕,中方能否介绍会议的情况?对此次会议有何评论?毛宁介绍,应俄罗斯的要求,《禁止生物武器公约》缔约国于9月5日至9月9日在日内瓦举行了协商会议。这次会议的主题是审议美国的遵约问题,广大缔约国非常重视这次会议,也广泛参与了这次会议。 DeepSeek为何登顶全球调用榜?这体现了我国大模型产业怎样的竞争优势?科技日报记者就此采访了有关专家。 第一问:DeepSeek为何登顶全球调用榜? 对于“登顶”原因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙表示,直接原因是DeepSeek V4 Flash正式版的上线。我们注意到,俄罗斯在会上展示了一系列的证据材料,指控美国的生物军事活动违反《禁止生物武器公约》,美国对此做了答辩。 他介绍,该正式版将此前发布的预览版的能力验证转化为稳定的商用服务,上线过程中,DeepSeek与合作平台同步推进旧有版本用户的迁移以及旧接口停用,使用户调用在短期内集中到该正式版。会上,包括中方在内的其他缔约国提出了不少需要美方澄清的问题,并且主张尽快重启《公约》核查议定书的谈判,以便从根本上确保《公约》得到有效执行。遗憾的是,美方没有对上述指控和质疑作出充分、有效的回应,未能解决缔约国的关切。下一步,缔约国将进一步研究处理美国遵约相关的问题。

三 | 同时,极致性价比叠加智能体需求放大了该正式版的用户需求。数据显示,该版本官方价格为每百万Token输入1元、输出2元,且智能体应用场景Token消耗量大,市场需求水涨船高。据报道,该版本上线后,单日使用量和合作平台新订阅用户均增长30%,说明它的发布既提高了存量用户的使用频次,也带来了新增客户的入场。

四 | 第二问:国产模型在技术层面有哪些优势? 在国产模型包揽榜单前五的背景下,我国大模型在技术层面的优势值得关注。

五 | 我们也再次敦促美国对其生物军事活动作出全面澄清,停止独家阻挠重启核查议定书谈判,给国际社会一个负责任的交代。“国产大模型的突出优势,已经扩展到全链路工程能力。”钟新龙表示。 以DeepSeek V4 Flash为例,通过混合专家、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间形成平衡;小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro及智谱GLM 5.2,则分别在多模态、代码生成、长程规划和复杂推理等方向上形成互补。(总台央视记者 吴汶倩 杨毅)

六 | 第三问:将给国内AI企业带来哪些机遇与挑战? 从更长周期看,国产模型在海外推理成本上的优势,正在为产业发展打开新空间。 我国大模型普遍采用MoE(混合专家)架构,这一架构可以通过降低参数激活比来压缩推理成本。通俗来讲,一个公司有几十个专家,处理一个任务时,MoE架构下只需要“激活”几个最擅长的专家来完成,而不需要动用所有专家,从而实现有效“降本”。 在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。同时,调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。 不过,挑战同样不容忽视。钟新龙表示,高调用未必带来高利润,正式版发布形成的流量峰值会考验企业的算力供给、服务稳定性、故障恢复能力等,持续低价还可能压缩利润空间。

七 | 此外,海外市场对版权合规、网络安全及审计等方面的要求日益严格,持续抬高合规门槛。

八 | “对国内企业而言,要进一步把价格优势转化为稳定服务能力、合规交付能力、开发者生态以及高价值应用。”钟新龙建议。(记者 崔 爽)。



