AI 资讯早报 · 10-10
🤖 AI 资讯早报 · 10-10
🔥 必读
1️⃣ 中科大系「白泽通境」把会「倒推」的世界模型塞进机器人,成立三月融资数千万
合肥初创白泽通境(成立不到半年的中科大团队公司,创始人白寅岐)推出「溯因式世界模型」AWM(Abductive World Model),核心思路是「先预测,再溯因」:不只预测下一秒画面,还反追问「是什么导致了这种变化」,把答案拆成三类结构——谁在场(Entity)/ 怎么动(Dynamic)/ 会碰到谁(Relation)。它可直接从无标注视频学习(无需逐帧人工标注)。在 Push-T 操作任务上,达到 75% 成功率仅需 2,000 条轨迹,约为对比方法 Causal-JEPA(14,728 条)的 1/7;数据加到同等量时成功率约 92%。论文《Abductive World Modeling via Causal Representation Learning》已开源(arXiv 2609.36985,代码 github.com/baiz-tech/AWM):相较 V-JEPA 2,动作理解 Top-1 准确率提升 68%;遮挡画面中关键物体时模型判断的变化是遮挡无关物体的 3.9 倍(说明预测真的建立在「认出」的物体上,而非在蒙)。配套端侧推理引擎 BAIZ-RUN 把模型压到 2-bit 权重 / 4-bit 激活,在 AMD Radeon 边缘显卡 + SSV2 上内存降 2.56 倍、推理频率提升 94.6%、精度损失 <1%,并同时适配 NVIDIA / AMD / 华为昇腾。团队已拿下数千万融资。⚠️ 为厂商 / 论文自测口径,尚无第三方评测。
原文:机器之心 · 中科大团队把会「倒推」的世界模型塞进了机器人,成立三个月拿下数千万融资!
2️⃣ 鲲为科技攻克超声穿颅读脑,4 亿元新融资,要做脑科学的「英伟达」
深圳鲲为科技完成 4 亿元新一轮融资,新增股东 XVC、红杉中国,老股东夏尔巴、腾讯进一步加仓;创始人刘家家(西安交大生物医学工程出身)。技术路线「反常识」:放弃靠不断提升频率换清晰度的行业惯性,转向低频,把算力与 AI 引入声场——用深度神经网络处理每秒高达 10GB 的超声回波数据流,重建三维「声学空间感知」,实现穿透颅骨的实时高分辨率成像(中脑核团、侧脑室乃至微细血流毫秒级捕捉),声称与海外顶级彩超形成「代差」。走五层全栈自研(压电材料 → 探头 → 整机 → 基础软件平台 kOS → 应用)。目标不止做颅脑超声设备,而是脑科学与 AGI 的底层 Infra——「像英伟达提供显卡 + CUDA」一样,向脑机接口 Lab 与 NeuroAI 公司提供观测大脑的硬件与 kOS API。已实现数千万订单、团队 200+ 人。⚠️ 为厂商自述 / 演示口径,尚无第三方评测。(36氪 快讯同日亦报《鲲为科技完成4亿元新一轮融资》,为同一事件,本条取信息最全的极客公园稿。)
原文:极客公园 · 攻克超声穿颅读脑,拿下 4 亿元新融资,他们要做脑科学的「英伟达」
3️⃣ 苹果官宣 10-13「欢迎回家」发布会:首推带屏家居中控 HomePad
苹果全球营销高级副总裁 Greg Joswiak 10-09 在 X 发布预热视频,官宣将于北京时间 10-13 21:00在纽约翠贝卡举行主题为「欢迎回家」的特别活动。据彭博社 Gurman 等爆料,预计推出多款智能家居新品:全新带屏家庭中枢(暂称 HomePad,约 6 英寸方形屏、桌面/壁挂两版、可识别不同家庭成员、支持家居控制 / FaceTime / 音乐 / 照片 / 日历,需持续接电)、HomePod mini 2、Apple TV 4K(第四代),三款均有望支持新版 Siri AI;这是新任 CEO John Ternus 上任后智能家居产品线的首次重要动作。另据报苹果正与 LG 共同开发视频门铃、智能门锁、恒温器、摄像头等配件(LG 品牌,上市或需数月)。10-27 前后还可能推出 OLED 版 iPad mini、首款 OLED 触控屏 MacBook Pro 与 M6 芯片 Mac。⚠️ 活动已官方确认,但具体产品均为爆料口径(Gurman / MacRumors / 9to5Mac)。
原文:智东西 · 苹果官宣智能家居发布会:首次推出「带屏中控」,Siri 接管全家
📌 值得看
4️⃣ Claude 打通谷歌办公三件套:文档 / 表格 / PPT 直接改
Anthropic 10-06 宣布 Claude 接入 Google Docs / Sheets / Slides,向全部付费计划(Pro / Max / Team / Enterprise)开放公开 Beta。安装插件并授权后,可在三件套侧边栏内直接让 Claude 改稿、修公式、补页面,修改直接落在当前文件;也可从 Claude 聊天窗口贴入文件链接或让它新建文档。官方演示三类场景:Docs 里精简摘要 / 统一标题样式 / 把下一步事项整理成表格;Sheets 里对照预算与实际支出、按团队生成工作表并标出超预算项、编写修正公式、构建数据透视表与图表(复杂清洗可交 Python 处理后写回原表);Slides 里结合 Salesforce 客户资料与 Drive 沟通记录生成季度汇报、按现有主题补页、检查元素重叠 / 文字溢出。⚠️ 官方提示公式、汇总口径、异常项仍需人工核对。与 10-09 早报推过的「谷歌云 Gemini Agent」同属「AI 办公」主线,但属不同事件。
原文:新智元 · Claude 打通谷歌办公三件套!文档表格 PPT 直接改
5️⃣ openJiuwen 发布并开源企业级 AgentOS
由华为 2012 实验室、华为云、计算、终端、算力先遣队等团队联合高校与开发者构建的开源 AI Agent 平台 openJiuwen,发布并开源企业级 AgentOS,把多智能体协同、自演进、算力亲和与企业级安全可靠能力融入统一底座,并以插件化架构 + 开放生态连接上层应用与底层模型 / 算力。三大要点:① 多智能体原生——蜂群协同与工作流编排支持任务拆解、角色分工、并行执行,人在关键环节参与判断;② 自演进原生——依托执行轨迹、用户反馈与记忆机制优化技能;③ 企业级运行底座——多租户隔离、安全沙箱、权限管理与安全护栏、故障恢复。北向生态含技能 / 连接器 / 插件 / 专家 / 专家团五类资产,经 Agentic Hub 发布共享。已在华为全联接大会 2026(HC2026)发布基于 AgentOS 的一体机开源 Agent 加速平台(小时级私有化部署,内置 WorkSwarm 办公 / 编程统一工作台)。项目已开源(GitHub openJiuwen-ai/agentos-enterprise)。⚠️ 华为系发布稿口径;与 10-02 留档的「openJiuwen WorkSwarm」同家族、非同一产物。
原文:量子位 · openJiuwen 发布并开源企业级 AgentOS,加速智能体规模落地企业
6️⃣ Amazon Bedrock AgentCore 在中国北京 / 宁夏区域上线
亚马逊云科技宣布,全托管 AI Agent 部署与运维平台 Amazon Bedrock AgentCore 已在由光环新网运营的中国(北京)区域与由西云数据运营的中国(宁夏)区域正式可用。上线即提供六项核心能力:Runtime(Serverless、基于 microVM 的硬件级隔离运行时,秒级冷启动、最长 8 小时,仅按实际 CPU / 内存秒级付费)、Gateway(把 API / Lambda / MCP Server 统一转为 Agent 工具入口,支持按用户设请求数 / Token / 连接速率)、Identity(对接 OIDC、托管下游凭证,Agent 可代表用户或以自身身份访问)、Browser Tools(云端浏览器运行时)、Code Interpreter(代码沙箱)、Observability(基于 CloudWatch 的全链路追踪)。Signal65 对比测试称:端到端开发速度达自建方案的 2.1 倍、云端部署速度 5.2 倍、基础设施配置与集成时间减少 75%。⚠️ 性能数字来自第三方分析机构(Signal65)的方案对比,非独立评测。与 10-07 早报「智谱 GLM-5.3 上架 Amazon Bedrock」为不同事件(上架模型 vs Agent 平台区域上线)。
原文:智东西 · 亚马逊云科技 Amazon Bedrock AgentCore 在中国区域上线
📄 其他
7️⃣ 全球竞逐 RSI,这支华人团队(Novix)已跑通规模化闭环
华人团队 Novix(成立半年)称已把 RSI 带入规模化运行:通过口碑服务 20 万名专家、覆盖 40 多个国家 / 地区、500 多所高校及科研机构。核心机制「Co-Evolutionary RSI(协同进化式 RSI)」:AI 主动提出方向、展开解空间、执行并验证;专家持续反馈「什么是重要问题、什么证据算成立、用什么评价标准(rubrics)」,每次采用 / 否决 / 纠偏都成为下一轮的新目标与新标准。已在水坝生态泄洪调度、钢材地震循环响应、空气质量网络跨站校准、金融高频流动性建模、AI 后训练等真实任务展开。核心成员来自 Google / 微软 / Meta / 智谱 / Kimi(曾参与 Microsoft Copilot、Kimi K2、AgentOS、AutoAgent)。⚠️ 厂商自述口径。
原文:机器之心 · 全球竞逐 RSI,这支华人团队已跑通规模化闭环
8️⃣ 视频生成也能查资料、做模拟:8B 智能体(VideoGen-Agent)学会自主调用工具
VideoGen-Agent:以 Qwen3-VL-8B-Instruct 为基础的可训练多模态智能体,在多轮交互中自主调用检索、生成与验证工具——先查动作知识 / 找视觉参考 / 跑物理模拟,再交给视频生成器;生成后用目标检测 + 深度估计检查空间结构,多镜头任务用上一段末帧作下一段条件。先监督微调建立工具使用能力,再经多任务强化学习优化决策。在 VABench(600 条提示、六类能力)上,Toolset 1 配置得 75.6 分(基础生成器 56.5),换成更强生成工具后达 86.1 分;人类比较中评估者在 84.3% 的判断里更偏好其升级配置的结果。论文 arXiv 2609.24997。
原文:机器之心 · 视频生成也能查资料、做模拟:8B 智能体学会自主调用工具
9️⃣ 数据不出药企,AI 却学会了更多:蛋白质模型迎来一次重要升级
《Nature》2026-09-14 发表多家药企合作研究:利用 5 家药企(AbbVie / Astex / BMS / J&J / Takeda)20,167 份专有蛋白质-小分子结构数据,以联邦训练方式改进 OpenFold3——原始数据不出企业。结果:在 1056 个留出结构上,AISB 模型高精度预测了超过一半,而公开 OpenFold3 仅三分之一、竞品开源模型 Boltz-2 约 40%;两关键指标分别提升约 +10% / +11%,并超过公开模型与仅在单个药企数据上微调的模型。背景:PDB 中蛋白-小分子复合物样本仅约 1 万个,是下一代模型瓶颈;药企「隐藏库存」规模或超 PDB 总量。
原文:机器之心 · 数据不出药企,AI 却学会了更多:蛋白质模型迎来一次重要升级
🔟 《柳叶刀》:Google AMIE 研究显示 AI 有望改善医患关系
Google 与贝斯以色列女执事医疗中心(BIDMC)主导的研究首次登上《柳叶刀》主刊:在 BIDMC 门诊初级保健诊所的真实临床研究中,98 名患者在急诊就诊前使用了 Google 研究级诊断 AI 聊天机器人 AMIE,监督医生实时监控全部交互,按预设安全标准无一轮对话需被中断;临床医生反馈 75% 的场景下 AI 摘要帮助提前准备接诊、超过半数案例中 AI 输出改变了诊疗思路;AMIE 鉴别诊断与医生最终确诊吻合度 90%。团队称仍需更大规模试验,但初步表明 AI 有改善医患关系、缓解医护压力的潜力。
原文:量子位 · 《柳叶刀》研究表明:AI 有望改善医患关系
1️⃣1️⃣ 特斯拉弃用「自动驾驶」命名,以争取欧洲监管批准
特斯拉正淡化 Full Self-Driving(全自动辅助驾驶) 的命名,以争取其驾驶辅助系统在欧洲获批、并与长期被批评「具误导性」的名称拉开距离:近日已开始在欧洲网站改用「Tesla Assisted Driving(特斯拉辅助驾驶)」,而其美国网站仍称「Full Self-Driving(Supervised)」。(财联社)