An Independent Tech Publication · Est. 2026
AI TECH DAILY
AI × 科技 · 每日精选
Vol. 104 Thursday, September 3, 2026 今日 10 条精选
LEAD

模型层与资本层双线并进:Anthropic/Qwen/Gemini 三家同日摆出新牌,Kimi 秘密递表港交所拉开中国大模型 IPO 第二波;算力侧燧原申购、台积电千亿扩产同步刷出新高,AI 产业链的「烧钱—出货」循环还在加杠杆。

MAJOR LAUNCH

Anthropic 发布 Claude Fable 5.1,编程基准刷新榜单

AI Release Tracker · 阅读原文

Anthropic 于 9 月 1 日上线 Claude Fable 5.1,定位前沿旗舰模型。在最新公开编程与推理基准中拿下多项第一,被多家第三方追踪平台列为当前最强商用模型。其 4 系列曾因出口管制对部分国家封锁,5.1 系列延续了「安全优先 + 长上下文」的迭代路线。

编程和长上下文已是 Anthropic 的护城河,5.1 进一步把对手逼到只能拼价格的区间。

MAJOR LAUNCH

阿里通义千问 Qwen3.8-Max 编程登顶 CodeArena

读懂 AI 时代 · 阅读原文

阿里更新 Qwen3.8-Max,在百万开发者盲测的 Code Arena 编程榜单上以 1595 分位列总榜第二,仅次于被出口管制封锁的 Claude Fable 5,因此实际成为全球可商用模型第一。Artificial Analysis 综合榜拿到 51 分,位列开源 SOTA、全球第四。

出口管制意外把「全球第一」的位子让给了 Qwen,这是地缘政治送给中国开源的红利。

MAJOR LAUNCH

谷歌 Gemini 3.8 Flash(代号 Skimaki)将于明日发布

华尔街见闻 · 阅读原文

据 WSJ 爆料,谷歌将于 9 月 3 日发布 Gemini 3.8 Flash(内部代号 Skimaki),内部编码测试表现优于 Claude Opus。同时谷歌确认放弃 Gemini 3.5 Pro 路线,重心转向 Gemini 4.0;新版还引入了智能体视频理解能力,可大幅降低 token 消耗。

谷歌放弃 3.5 Pro 转押 4.0,承认上一代路线已经被 Anthropic 和 OpenAI 甩开。

— ✪ —
RESEARCH

OpenAI 自评 Astra 为首个具备「严重」网络攻击能力的模型

The Decoder · 阅读原文

OpenAI 在其《预备框架》中将即将推出的 Astra 模型评为首个具备「严重」网络攻击能力的系统,同时称其为公司迄今最安全的模型。Astra 在漏洞利用基准上拿到满分,并发现两个零日漏洞;但其「循环深度」架构导致部分推理过程不可读,使思维链监控的有效性存疑。

能力越强、可解释性越弱——这是前沿模型最危险的剪刀差,也是监管最难下手的死角。

INDUSTRY

月之暗面 Kimi 递交港交所 A1 文件,2.8 万亿参数 Kimi K3 同步开源

晚点 LatePost / 读懂 AI 时代 · 阅读原文

据晚点报道,月之暗面已于本周以保密形式向港交所递交 A1 文件,正式启动港股 IPO,并同步以 500 亿美元投前估值推进新一轮融资。同日发布 2.8 万亿参数开源模型 Kimi K3,公司对此回复「不予置评」。

「递表 + 开源旗舰」两手同时出,说明 Kimi 已经把 IPO 当成募资和品牌升级的复合工具。

INDUSTRY

燧原科技科创板申购,腾讯小米战配国产 AI 芯片 IPO 提速

雷锋网 · 阅读原文

国产云端 AI 芯片公司燧原科技 9 月 2 日启动科创板申购,发行 4303.52 万股,发行价 142.18 元/股。战配阵容覆盖腾讯、小米、兆易创新、华虹集团等产业链上下游,社保基金等国家队资金亦参与认购。公司 2026 年上半年营收 11.20 亿元,同比增 279%。

战配名单本身就是一份国产 AI 算力产业链目录——芯片、互联网终端、存储代工全到位。

— ✪ —
INDUSTRY

台积电亚利桑那再追加 1000 亿美元,全球扩产同步加速

Yahoo Finance · 阅读原文

积电宣布在亚利桑那州追加 1000 亿美元投资,使该州总投资达 2650 亿美元,用于 2 纳米及以下先进逻辑晶圆厂和先进封装厂。同时在日本、德国和中国台湾同步扩产。管理层预计海外爬坡将稀释毛利率 2-4 个百分点,但仍将 2026 全年营收增长指引从「高于 30%」上调至「略高于 40%」。

台积电把全球 AI 算力供给的天花板又往上抬了一档,毛利率短期稀释换长期定价权。

RESEARCH

Architect Labs AI 自主设计芯片 Redwood,三周完成验证

华尔街见闻 · 阅读原文

Architect Labs 宣布其 AI 系统在两位人类架构师规范下,于两周内自主生成并验证了端到端 AI 加速器 Redwood。基于三星 8nm 工艺,吞吐量达 NVIDIA Jetson Orin Nano 的 1.75 倍,功耗降低 1.9 倍,每瓦性能提升 3.4 倍,目前运行于 FPGA 平台,可推理 Llama、Qwen 等数十亿参数模型。

AI 设计芯片第一次跑通完整闭环——下一轮被颠覆的可能不是应用层,而是 EDA 工具链本身。

TOOLS

微软 VibeVoice-ASR-Streaming-7B 开源,10 语言实时「谁说了什么」

微软研究院 · 阅读原文

微软研究院推出 VibeVoice-ASR-Streaming-7B,一款支持流式处理的统一自动语音识别模型,可实时转写「谁说了什么」,并支持自定义热词及中、英、法等 10 种语言。模型权重已在 Hugging Face 开放,MIT 许可证,代码与演示同步公开。

把说话人分离、流式输出、热词定制做到同一模型里,会议转写和直播字幕的门槛被一次性踩平。

— ✪ —
POLICY

黄仁勋 G20 发言:反对 AI 过度监管,呼吁锚定「实际危害」

Yahoo Finance · 阅读原文

伟达 CEO 黄仁勋在北卡州 G20 创新部长级会议上表示,各国政府应避免对 AI 进行过度监管,不应监管假设性或理论性危害,而应针对「实际、务实」的危害制定规则。他警告,技术工业革命中最坏的结果是「未能利用而被抛在后面」,这种结果往往源于以恐惧和不确定性谈论技术。

黄仁勋把「监管恐惧」摆到 G20 桌面上,本质是在为英伟达未来三年的出货节奏抢时间窗口。

Today's Takeaways
今日精选 10 条 · web_search 覆盖中英文来源 · 由 remio agent 生成 · 2026-09-03