AI 资讯晚报 · 2026-09-16
抓取窗口近 30 小时,7 个原生源命中 53 篇新文章;以下按关注权重(大模型/Agent、具身智能、AI 产业与商业)排序,必读条目均已抓取正文深读后撰写。
🔥 必读
1. Claude Opus 5.2 深夜灰度上线,Anthropic 内部「Model 2」曝光
开发者在 Claude Code 中发现 Opus 5 已被悄悄路由到 Opus 5.2——前端名称不变,但抓包看请求 slug 已指向 5.2(跳过 5.1)。实测三变:响应更快、输出更干净(废话少)、不再「偷懒」——遇到长任务不催就会自动进入「严酷循环(gauntlet loop)」反复自我迭代直到完成。民间用「重置哥 Tibo」冷知识探针(须关闭联网搜索)判定是否命中新权重:网页版 Opus 5 答不出,被路由到 5.2 的 Claude Code 能精准识别,说明两边权重确实不同。
更关键的是背后的内部材料:8 月中旬曝光的 Anthropic 内部风险报告称,公司手里有三套方案正面对抗 OpenAI 的 GPT-6 Astra:
- Claude Fable 5.2:最快能落地的版本,预计本月底至下月底推向市场(与本次灰度互为印证);
- 未发布的内部模型「Model 2」:在真实 AI 研发任务榜单 CoBench v2 上得 62.8%,比当前公认最强的 Mythos 5 高 12.5 分;内部称公司大部分代码已由它跑 Agent 写出来,官方口径是暂不对外发布;
- RSI 模型:官方口径称可替代自家研究团队 85% 的工作,性能比 Model 2 再高 22 分。
作者判断 Anthropic 的路径很清晰:不是让 AI 更好地服务人类,而是让 AI 创造更好的 AI。⚠️ 内部报告与分数均为二手转述口径,无法独立核实。
原文:新智元 · 突发!Opus 5.2 深夜上线,RSI 真来了?
2. 飞书 8.0 + 豆包工作:Agent 变成组织里的「数字同事」(多源报道)
字节把 2026 飞书未来无限大会改名「豆包工作开工大会」。核心命题是协同办公的目标变了:过去解决「人与人如何高效沟通」,现在要解决「工作如何被理解、被执行并产出结果」——平台要同时承载人 + Agent + Agent 之间的协作。
- 飞书 8.0 = Agent 的协作与治理底座:群聊里可直接把 Agent 当同事拉进去;文档里通过评论 @Agent 改稿;多个 Agent 可在同一群组协作。数据权限沿用使用者身份(员工无权查看的信息,Agent 同样拿不到),管理员可统一管理企业内 Agent、追溯使用情况、管控 AI 用量与高消耗场景。
- 开放度数据:自今年 3 月开源 CLI 以来,飞书向 Agent 开放的功能点从 247 个增至 767 个(可操作多维表格、安排日程待办、查云盘与妙记、发起审批、用画板绘制可继续编辑的信息图)。
- 豆包工作与飞书共用账号与权限体系,无需跳转或额外连接即可调用业务上下文,因此「不必从零理解用户所在的公司」;新发布的豆包工作伙伴把服务对象从个人扩到团队——拥有独立身份、权限和记忆,可加入群聊、参与会议、跨群组找信息。
- 商业面:飞书披露 2026 上半年 ARR 增速达去年同期的 2.5 倍(成立以来最高),超九成新增客户同步采购飞书 AI 产品,中小企业客户总量一年增长 70%。
原文:极客公园 · 在飞书的上下文底座上,豆包开工了 | 量子位 · 协同办公进入 Agent 时代
3. 小鹏 IRON 走下自动化产线:人形机器人开始比量产
9 月 8 日,一台通用人形机器人小鹏 IRON 完成自动化总装、从产线走下来。真正的看点不是「走」,而是背后刚启用的自研自动化产线——按小鹏口径核心制程自动化率超 80%,把机器人制造从「手艺活」变成「工业品」,而且无需为适配机器人改造原有产线设备(「车间不必先适应机器人,机器人先去适应车间」)。
- 硬件口径:IRON 全身 76 个自由度、单手 21 个自由度、全包覆柔性晶格;搭载 3 颗自研图灵 AI 芯片,有效算力 2250 TOPS;计划把与 AI 汽车同源的物理 AI 基座大模型部署到机器人端侧,以降低时延、强化数据安全。
- 组织与资本:6 月何小鹏宣布亲自兼任机器人业务 CEO;8 月机器人业务完成首轮融资超 9 亿美元、投后估值超 63 亿美元;自称中国唯一全体系自研(本体、大脑、中脑、小脑、数据、Infra)。
- 为什么全栈自研:机器人行业尚未形成稳定范式、创新太快——外协走立项/开模/测试以月计,内部方案可能几周就更新一代,试错成本只能自己扛。「在成熟产业里开放协作是效率,在新物种早期全栈能力是速度。」
- 竞争主线变化:从 demo 展示切换到量产与商业化——接下来比产线、供应链、良率、成本、数据闭环与交付能力;最难的不是造出第一台,而是第一万台都可靠一致。但作者亦提醒,下半场的真问题仍是 PMF(谁来买单)。
原文:极客公园 · 特斯拉、Figure 还在攻克量产,小鹏机器人已经走下产线
📌 值得看
4. 英伟达、Palantir 集体「封杀」Anthropic 旗舰 Fable
起因是 2026-06-09 Anthropic 悄悄加的一条新规:所有 Mythos 级模型(Fable/Mythos 两档最强模型)的用户提示词与输出一律留存 30 天(被标记可疑的对话最长 2 年),理由是防御跨请求的高级越狱——且该政策覆盖所有既有「零数据保留(ZDR)」协议、无开关、无例外。ZDR 是金融/医疗/军工企业敢接 API 的「保命条款」:处理完即删,不存、不看、也不拿去训练。
后果是 9 月 14 日一份难看的「设防名单」:微软在发布次日即限制内部访问(内部 Copilot 列表里唯独没有 Fable);英伟达把真正值钱的供应链 AI 换成自家 Nemotron,Fable 只能碰不痛不痒的开源代码;Palantir 拒其上架,转身把给了 ZDR 的 GPT-6 Astra 端上桌,还向客户发放《如何避免把你的 Alpha 送给托管模型商》;诺斯罗普·格鲁曼干脆物理断网跑开源模型。8 月 19 日 OpenAI 以「私有安全处理」(数据不出客户、只收极窄安全信号)抢走卖点,9 月 1 日 Anthropic 被迫以「企业前沿安全保障(EFS)」让步——但邀请制、Mythos 5.1 不适用、且可随时取消,正踩中 Palantir 死咬的「不可撤销」红线。
原文:新智元 · 突发!英伟达「封杀」Claude 最强模型
5. 清华 + 稳准智能 LimiX-2 登顶三大结构化数据榜单(多源报道)
9 月 16 日,稳准智能联合清华大学计算机系崔鹏教授发布新一代结构化数据大模型 LimiX-2,参数规模提升至 400M:在 TabArena/BCCO/TALENT 三个国际主流结构化数据 Benchmark 上总体 Elo 达 1935/1432/1506,均列第一,超过 Google、SAP、Amazon 等大厂同类模型。技术沿三条路线推进:上下文机制网络 CMNs(把建模重点从「预先指定的目标变量」转向变量之间的相互关联,从「目标预测」走向「结构发现」)、升级自动化合成数据生成引擎、继续 Scaling 到 400M。因果发现任务上亦在 Sachs、UF、Causal Chamber 等数据集显著领先传统方法。上一代 LimiX 已完成 800+ 场景验证、与 60+ 客户合作。⚠️ 本文为厂商供稿,榜单成绩未独立复现。
6. 蚂蚁灵波 CEO 朱兴:机器人还吃不了「粗粮」
灵波与做整机的本体厂商路线不同,把重心放在具身「大脑」——希望同一套基础模型适配不同构型与任务,再通过后训练降低具体场景门槛。外滩大会现场展示的药品拣选方案(货架通道仅 80cm)已在国大药房零售门店部署。朱兴的判断很直接:「小卖部其实也很难落地……今天还是能力和成本两个都有问题」——整个模型还在冷启动阶段,可落地场景必须环境不太开放、任务不太长程(主流仍是模仿学习,最怕没见过的异常)。
他特别划清了数字世界与物理世界模型的界限:数字世界模型满足内容需求(丰富、好看、特效),可以接受延迟;机器人不需要好看,需要合理、符合物理规律,且高性能实时——「矿泉水在天空跳个舞落在我手上很好看,但不符合物理规律,没意义。」路线自省同样坦诚:1.0 阶段基于通用视频模型(如 Wan)微调,「上限不高且会破坏原有先验、泛化性下降」,最终从 0 到 1 自训 LingBot-Video 与 LingBot-VLA 2.0。关于数据,他的说法是今天的机器人还吃不了「粗粮」——日常产生的数据质量与结构还不适合直接喂给模型。
原文:爱范儿 · 对话蚂蚁灵波 CEO 朱兴:机器人还吃不了「粗粮」
📄 其他
- 腾讯、字节、阿里「会战」AI 办公之后:Agent 领域格局已变 — 极客公园对话汪华、谭少卿:国产 Flash 模型同时跨过指令遵循与成本两道坎,才是中国 Agent 爆发的「真正原点」;大厂押注的驱动力是恐惧(高价值入口不必建立在日活之上)与算力甜蜜点;汪华判断「船票」只有两张——基础设施与基础模型,用户平台层船票可能根本不存在。
- 129 亿美元卖身英伟达之后,是时候重新理解 Hugging Face 了 — 英伟达 9 月 3 日宣布以 129.3 亿美元收购 Hugging Face,买的是生态枢纽地位而非收入:1800 万开发者、300 万模型、超 20 万家公司经其完成技术选型;官方承诺交易后仍面向全生态开放,不强制使用英伟达算力。
- 助听器躺赚三十年暴利,被 AI 打破了 — 五大外资把持近九成市场、旗舰款中国线下卖到七至十万;深圳两家公司用 AI 把价格打到原来十分之一(一家年销超 1500 万美元、市场份额 1%→18%)。AI 拆掉的是嘈杂环境音频分离这道技术关卡,连带拆掉了建在其上的定价逻辑。
- B站 AI 无限竞技场上线:GPT-6 Astra 登顶,国产占前五三席 — 由各领域 UP 主以真实工作流自主命题、同题 PK 的测评广场,榜单实时更新;AI 知识内容消费时长同比增长 72%、月均观看 AI 内容用户超 1.9 亿。
- 把记忆交给 CPU,大模型会变快 — Agent 长任务让 KV Cache 的成本从算力延伸到存储与搬运;文中以 Qwen3-8B 逐 Token 147KB 估算推演百万上下文规模,主张按活跃度把缓存分层(HBM → DDR → SSD/远端)做「以存代算」,让 GPU 专注于生成 Token。