// 新闻
有啥新鲜事?
宇树发布 UnifoLM-X2-1.0,实时世界模型驱动的全自主人形机器人
宇树科技发布 UnifoLM-X2-1.0,号称首个由实时世界模型驱动的全自主人形机器人——通过预测物体和力的变化实时规划动作,而不是依赖预先编排的动作脚本或遥操作,发布时用两台机器人自主对打的演示来展示这项能力。
2026-09-03OpenAI 发布 GPT-6 Astra,首个触及「关键」风险等级的模型
OpenAI 开始推送 GPT-6 Astra,并披露这是公司内部首个触及「关键」级网络安全风险阈值的模型——能在没有人工逐步引导的情况下,自主在高强度防护系统中发现并利用未知漏洞。默认不开放访问,企业管理员需要手动开启,参与网络安全项目的合作伙伴优先获得权限。
2026-09-01Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1
Anthropic 发布了 Fable 5.1(全量开放)和 Mythos 5.1(限制访问,同一个模型但针对网络安全、生命科学场景配了不同的安全防护),缓存读取价格降了 75%,在智能体科研和编程类基准测试上相比 Fable 5 有大幅提升。
2026-08-27现代考虑引入外部资本,助推波士顿动力 Atlas 走向量产
波士顿动力的控股股东现代汽车集团,正考虑引入外部资本,以推动全电动人形机器人 Atlas 走向量产,首批产能已经承诺交付给现代自己的机器人超级工厂和 Google DeepMind。
2026-08-26阿里 Qwen 团队发布 Qwen3.8-Flash-Next,预览 Qwen4 架构
阿里巴巴开源了 Qwen3.8-Flash-Next,一个 1250 亿参数的多模态 MoE 模型,每个 token 只激活 60 亿参数,原生支持 26.2 万 token 上下文(可扩展到 100 万),提前发布是为了让社区在完整的 Qwen4 系列之前先了解这套架构改动。
2026-08-25人形机器人「天工Ultra」在北京跑进百米世界纪录,超越博尔特
由北京人形机器人创新中心研发的「天工Ultra」,在世界人形机器人运动会上以 8.86 秒跑完百米,比博尔特 9.58 秒的人类世界纪录还快——此前在同一场比赛中它已经刷新过一次自己的机器人纪录。
2026-08-24小鹏机器人业务完成 9 亿美元融资,估值 63 亿美元,加码 IRON 人形机器人
小鹏汽车旗下机器人业务完成首轮融资,金额超过 9 亿美元,估值超过 63 亿美元——是目前中国具身智能领域最大的一笔私募融资,由 IDG 资本领投,腾讯和阿里巴巴参投,资金将用于推动 76 自由度的 IRON 人形机器人在 2026 年底前实现量产。
2026-08-19宇树科技上海挂牌首日暴涨最高 629%,估值冲到 660 亿美元
宇树科技在完成 9.04 亿美元 IPO 后于上海科创板挂牌首日,股价一度暴涨最高 629%,市值冲到约 660 亿美元,超过百度和京东,成为中国大陆首家上市的人形机器人企业。
2026-08-12xAI 发布 Grok 4.6,主打长时程智能体任务
xAI 发布 Grok 4.6,在与 Grok 4.5 相同的 50 万 token 上下文规模上做了升级,主要面向长时程智能体任务、编程以及交互式/视觉类工作,价格跟上一代保持一致。
2026-08-07OpenAI 暂停 Astra 模型部分研发,因触及网络安全风险红线
OpenAI 表示已经暂停了未发布模型 Astra 的部分内部研发,原因是安全评估无法排除它已经达到「关键」级别的网络安全能力——能在无人干预下自主发现并利用高强度防护系统里的零日漏洞;目前正在加强隔离测试、权限管控和实时监控,之后才会恢复相关工作。
2026-08-06宇树科技上海 IPO 定价对应 90 亿美元估值,成为中国首家上市人形机器人企业
宇树科技在上海科创板的 IPO 定价为每股150.8元,对应约90亿美元估值,成为中国首家上市的人形机器人企业;DeepSeek 是本次发行的战略投资者之一,散户认购倍数超过2700倍。
2026-08-05谷歌 DeepMind 高层大换血:哈萨比斯退居二线,Jeff Dean 离职 27 年后创业
谷歌 DeepMind CEO 哈萨比斯(Demis Hassabis)卸任 CEO,转任董事长兼 Alphabet 首席科学家,日常运营交给 CTO Koray Kavukcuoglu;同一天,Alphabet 首席科学家 Jeff Dean 宣布在谷歌工作 27 年后离职,创立专注于自动化科学发现的新公司 Discovery Loop。
2026-08-04中国大模型调用量连续十四周领跑全球,人工智能主题指数强势涨超4%
中国大模型调用量已连续十四周全球领跑,同期人工智能主题指数也大幅上涨超过4%。
2026-08-01DeepSeek 正式发布 V4-Flash 模型,中国大模型竞争持续升温
DeepSeek 正式发布 V4-Flash 模型,自主智能体能力增强、API 成本进一步降低,报道称在编程类测试上已经逼近 Claude Opus 的水平。
2026-07-31华为openPangu-2.0-Pro模型及技术报告正式开源上线
华为开源了 openPangu-2.0-Pro,一个基于昇腾 NPU 训练、总参数量约 5050 亿的 MoE 大模型,权重、推理代码和技术报告一起公开。
2026-07-30字节跳动调整AI业务组织,对豆包、飞书与火山引擎进行重组整合
字节跳动把飞书、豆包和火山引擎三个团队整合进同一套 AI 业务架构,豆包成为核心产品,火山引擎负责算力和商业化。
2026-07-30比亚迪确认将于8月发布人形机器人「小迪」,对标特斯拉 Optimus
比亚迪确认首款人形机器人「小迪」将于8月在 Di Space 展厅亮相——身高1.61米、体重58.5公斤的功能性原型机,用于接待顾客和演示车辆,计划每家门店部署两到三台,正式加入对标特斯拉 Optimus 的人形机器人赛道。
2026-07-24Anthropic 发布新模型 Claude Opus 5
Anthropic 发布 Claude Opus 5,目标是以大约一半的价格逼近旗舰模型的表现,还新增了一个可调节的「努力程度」开关来平衡成本和能力。
2026-07-23Figure AI 第 1000 台 Figure 03 人形机器人下线
Figure AI 在其 BotQ 工厂下线了第 1000 台 Figure 03 人形机器人,相比4月底约350台的产量大幅提升,证明了此前实现的「每小时一台」产能可以持续维持。
2026-07-21宇树最新 omni 模型:让人形机器人能思考、能行动、能协助人类
报道了宇树科技最新的 omni 模型(UnifoLM 具身智能系列的一部分),让人形机器人在被打断后也能继续完成任务。
2026-07-08OpenAI 公开发布 GPT-5.6,推出新一代对话式 AI 模型
OpenAI 在通过美国政府的额外审查流程后,向公众开放 GPT-5.6 系列(Sol、Terra、Luna)三个模型。
2026-07-08xAI 发布 Grok 4.5,马斯克称其为「Opus 级别模型」
xAI 发布 Grok 4.5,定价明显低于 Claude Opus,同时宣称编程和智能体能力已经接近同级水平。
2026-06-15预训练学会想象,微调学会行动:世界动作模型的崛起
英伟达官方技术博客,解释了行业为什么正在从只会被动反应的 VLA 策略,转向先「想象」结果再行动的世界动作模型。
2026-06-03智元开源行业首个专属于世界模型的具身数据集
智元机器人开源了行业首个专为世界模型训练打造的具身数据集,特意保留了失败、混乱的真实交互过程,而不只是成功的示范案例。
2026-05-31英伟达 Vera Rubin 平台全面量产,支撑全球「智能体 AI 工厂」
英伟达下一代 Vera Rubin NVL72 平台进入全面量产,将从今年秋季开始向 OpenAI、CoreWeave、谷歌云、微软 Azure、Meta 和戴尔陆续交付。
2026-05-20阿里云通义千问大模型详解:Qwen3.7系列核心能力
阿里云在云峰会上发布通义千问 Qwen3.7 旗舰系列,主打「全领域思考」模式,把文本、图像、代码的推理能力统一到同一条思维链里。
2026-04-24DeepSeek 新模型为什么重要:三个理由
MIT 科技评论对 DeepSeek V4 预览版发布的分析,解读它的开源权重策略如何持续改变大模型行业的成本结构。
2026-04-22谷歌云发布两款自研 AI 芯片,正面对抗英伟达
谷歌云在 Cloud Next 大会上发布 TPU 8t(训练)和 TPU 8i(推理)两款自研芯片,宣称训练速度最高提升 3 倍,单集群可连接超百万颗芯片。
2026-04-16π0.7:一个具备涌现能力的可引导机器人模型
Physical Intelligence 发布的可引导式机器人基础模型,相比之前的 pi 系列,在跨任务、跨机型泛化能力上有明显跃升。
// 论文
值得一读
τ₀-VLA:一个由世界模型引导测试时计算的分层机器人基础模型
一篇 39 位作者合著的论文,提出了 τ₀-VLA——用带记忆的高层规划器做世界模型引导的测试时搜索,配合通用的底层执行策略;基于 4 万多小时真实机器人数据训练,在长时序操作任务上达到 45% 的成功率,而不分层的基线模型只有 27.5%。
2026-07DSWAM:面向精细机械臂操作的双系统世界动作基础模型
提出一种「快反应+慢思考」双系统架构的世界动作模型,专门针对既要快又要精细的机械臂操作任务。
2026-07从世界模型到世界动作模型:一篇机器人方向的简明教程
一篇教程性质的论文,梳理了从纯粹的世界模型到能生成动作的世界动作模型的技术脉络,面向刚入门这个方向的机器人研究者。
2026-06Kairos:面向物理世界 AI 的「后悔感知」原生世界动作模型技术栈
提出一套具备「后悔感知」能力的世界动作模型技术栈,让机器人在真正执行动作前先权衡犯错的代价。
2026-05Dexora:面向高自由度双臂灵巧操作的开源 VLA 模型
首个面向双臂双手、最多 36 自由度灵巧操作的开源 VLA(视觉-语言-动作)系统,用外骨骼采集手臂动作、Apple Vision Pro 做无标记手部动作追踪的混合遥操作方案,配合大规模仿真加真机数据构建训练语料。
2026-05世界动作模型:具身智能的下一个前沿
一篇被广泛引用的综述,将世界动作模型(World Action Model,WAM)系统化定义为 VLA 模型的继任范式,把「预测世界状态」和「生成动作」统一到同一个模型里。
2026-04面向机器人学习的世界模型:一篇综述
系统梳理世界模型在机器人学习中的应用现状,覆盖模型架构、训练数据和评估方法三个维度。