第 100 期,撞上一个分水岭时刻:DeepSeek 把国产开源推上国家超算互联网主战场,中国模型在 OpenRouter 全球前六里占满席位;另一边,Anthropic 用四成降幅硬刚开源冲击,闭源/开源的定价天平正在被改写。
8 月 14 日,国家超算互联网正式上线 DeepSeek V4 Pro 正式版与智能体框架 DeepSeek Harness,依托全国首个十万卡级超智融合算力资源池,为科研院所、科创企业及开发者提供大模型全生命周期算力支撑。
国产旗舰首次接入国家级算力底座,等于把竞争从「卷模型」抬到「卷基础设施」。
OpenRouter 7 月全球月榜前六依次为小米 Mi-Mo-V2.5、DeepSeek V4 Flash、腾讯 Hy3、MiniMax M3、智谱 GLM-5.2、DeepSeek V4 Pro,全部来自中国厂商;中国开源模型全球下载量占比已达 41%,首次超过美国。
一年前还只是个位数席位,现在包圆前六——这不是追赶,是换岗。
Kimi K3 同步开源 2.8 万亿参数模型与 Swarm 智能体集群、Goal 并行执行模式,本轮融资 35 亿美元、估值 500 亿美元,并正在筹备港股上市。
开源最大模型 + 港股 IPO 筹备,钱和注意力一把抓,节奏比对手激进一倍。
Claude Sonnet 5 发布后 BFCL v3 准确率 89.7%、SWE-Bench Verified 62.4%,但最响的动作是 API 降价——部分场景降幅超过 40%。估值层面,公司距万亿美元俱乐部仅一步之遥。
闭源王者主动降价,是被开源打到不得不防守的信号。
Seedance 2.5 可一次性生成单段连续 30 秒原生 4K 视频,最多 50 个多模态参考,并在同次推理中协同生成同步音频;该业务年化 ARR 已接近 20 亿美元,是国内首个大规模正向盈利的 AI 业务。Sora 已于 2026 年 3 月关停。
视频生成不再是技术 demo,是年化 20 亿的真金白银,赛道重心彻底东移。
DeepMind 于 2026 年 8 月公开试点首个 AI 双盲评估机制,模型在评测过程中既看不到题目来源、也看不到对方模型身份,用以消除品牌效应与提示词博弈对排名的扭曲。
排行榜打假的下一步:把「名牌光环」从评测变量里剔除。
DeepMind 首席 AGI 研究员 Shane Legg 在最新访谈中系统提出 AGI 分级框架,将 AGI 从「最小可用」到「完整」划为多层,并给出每层大致的时间预期,主张以「根节点问题」(聚变能源、材料科学)作为衡量锚点。
把 AGI 从营销词拽回工程语言——这才是巨头该干的脏活。
8 月初 xAI 连续发布 Grok 4.6(2 万亿参数)与 Grok 4.7(2.1 万亿参数),并开源 Grok Build 工具链——上线仅 9 天就在 GitHub 收获超 2 万 star,沿用早期 OpenAI 的高频迭代 + 开源社区打法。
马斯克的算盘:先用开源工具链锁住开发者,再用模型把人潮收进来。