Daily Pulse | 7月10日周五版 | OpenAI发布GPT-5.6三档模型体系,多项基准超越Claude Fable 5;优必选U1超仿生人形机器人订单破万
🎯 7月10日周五速览 • 🧠 OpenAI 发布 GPT-5.6 — Sol/Terra/Luna三档定价,Sol旗舰版Agent’s Last Exam得分53.6,超越Claude Fable 5达13.1分,编程Agent Index达80分 • 🤖 优必选 U1 超仿生人形机器人 — 首发订单破万,U1 Lite 11.98万元、U1 Pro 16.98万元、U1 Ultra 88-99万元,中国仿人机器人商业化里程碑 • 🎯 Meta Muse Spark 1.1 开始收费 — 首个面向企业的Agentic AI模型,Bloomberg报道Meta正式将AI能力货币化 • 💼 OpenAI 推出 ChatGPT Work — “为最具雄心的任务而生”的新产品,进一步加码企业市场 • 🔬 RoboScience 发布通用具身大模型 Visics — 完整展示VLOA双引擎架构,具身智能模型路线新探索
1. 🏆 OpenAI 发布 GPT-5.6:三档模型体系,Agent 能力全面超越 Claude Fable 5
一句话总结:OpenAI今日发布GPT-5.6,推出Sol(旗舰)、Terra(中级)、Luna(轻量)三档模型,在Agent能力基准上大幅超越Claude Fable 5,同时推理成本更低。
7月10日,OpenAI正式发布GPT-5.6,这是继GPT-5.5之后的一次重要迭代。本次发布最显著的变化是命名体系的全面重构——不再以单一代号命名模型,而是推出Sol(太阳/旗舰)、Terra(大地/中级)、Luna(月亮/轻量)三档模型,每档又支持6档推理强度调节,形成一个覆盖从边缘到云端全场景的模型矩阵。
💡 为什么重要:这是苹果在3月发布Fable 5后,OpenAI最有力的一次反击。GPT-5.6在Agent能力上建立了新的SOTA,尤其值得注意的是,即便在中度推理设置下,Sol版仍以42.2分领先Fable 5的40.5分,但成本仅为后者的约四分之一。这一性价比优势可能重塑大模型竞争格局。
核心数据:
- 📊 Agents’ Last Exam:Sol(最高推理)53.6分,较Claude Fable 5(40.5分)高出13.1分
- 📊 Coding Agent Index:Sol(最高推理)80分,领先Fable 5的77.2分,输出Token减半,时间减半,成本低约三分之一
- 📊 定价(每百万Token):Sol $5/输入 $30/输出;Terra $2.5/输入 $15/输出;Luna $1/输入 $6/输出
- 📊 推理层级:每档支持6级推理强度调节,用户可根据任务复杂度灵活选择
从社区反馈来看,GPT-5.6本质上是GPT-5.5的深度后训练版本,而非全新基座模型(即不是”5到6”的跳代升级),但Agent能力的显著提升证明了通过优化后训练、推理策略同样可以获得实质性进步。
🔗 OpenAI官方 | 安全评估报告 | 开发者文档 | HN讨论
2. 🤖 优必选 U1 超仿生人形机器人:首发订单破万,中国仿人机器人正式进入消费市场
一句话总结:优必选发布U1系列超仿生人形机器人,128,800元起至99万元顶配,首发订单即破万,这是中国双足人形机器人首次达到万量级商业化订单。
优必选科技正式推出其超仿生人形机器人U1系列,包含三个版本:U1 Lite(11.98万元)、U1 Pro(16.98万元)以及面向高端市场的U1 Ultra(男版99万元/女版88万元)。据官方消息,首发订单已突破10000台,这是中国双足人形机器人行业迄今最大的单笔商业订单量。
📌 一句话:万量级订单意味着人形机器人从”实验室玩具”到”消费电子产品”的关键拐点可能比预期来得更早。
💡 为什么重要:在此之前,全球双足人形机器人的商业化一直处于”百台级”交付水平(Figure 02交付约200台、Tesla Optimus进入工厂测试)。如果优必选这10,000台订单真实落地,意味着中国在仿人机器人商业化规模上实现了代际领先。从价格区间来看,U1 Lite定价12万左右的价位直接对标中高端汽车,U1 Ultra百万级定价则瞄准富豪阶层的”超级玩具”市场,这种分级策略和智能手机定价逻辑如出一辙。
值得关注的是,优必选在子标题中称为”超仿生机器人”,暗示其在仿生皮肤、表情控制等外观拟人度上做了大量投入。相比之下,这一代全球主流人形机器人(Figure 03、Tesla Optimus、Unitree G1)均以工业化外观为主打。优必选选择了完全不同的路线——先攻家庭和消费场景。
3. 🎯 Meta Muse Spark 1.1:首个商用Agentic AI模型正式收费
一句话总结:Meta发布Muse Spark 1.1版本,这是Meta首个面向企业收费的Agentic AI模型,标志着Meta在AI领域的货币化战略全面启动。
Meta今日宣布Muse Spark升级至1.1版本。与之前版本的最大不同在于,Muse Spark 1.1将正式进入商业化阶段——根据Bloomberg报道,Meta开始对Muse Spark的使用进行收费,标志着这家社交媒体巨头在AI货币化上迈出关键一步。
📌 一句话:Meta终于加入了AI收费阵营——当开源策略不再是差异化优势,广告之外的AI收入成为新的增长极。
Muse Spark是Meta推出的Agentic(智能体)模型,可自主执行多步骤任务,与企业工作流深度集成。1.1版本在推理能力和工具使用方面进行了显著升级。
这一动向与业界趋势高度一致:继OpenAI、Anthropic、Google之后,Meta也加入了AI模型商业化阵营。对于开源社区而言,这意味着”免费开源大模型”时代正在逐步收窄——当模型的训练和推理成本持续攀升,即使是最坚定的开源拥护者也不得不考虑可持续商业模式。
4. 💼 OpenAI ChatGPT Work:定义AI生产力的新边界
一句话总结:OpenAI推出ChatGPT Work,一个面向复杂工作场景的全新产品线,与GPT-5.6同日发布,形成”模型+产品”双重攻势。
与GPT-5.6同步,OpenAI发布了ChatGPT Work,将其定义为”为最具雄心的任务而生”的AI工作平台。从名称和定位来看,ChatGPT Work瞄准的是知识工作者的重度使用场景——长文档分析、多步骤研究、代码项目管理等。
📌 一句话:OpenAI正在从”对话式AI”向”工作OS”演进,ChatGPT Work是这个战略的关键一跃。
ChatGPT Work的推出,结合GPT-5.6在Agent能力上的SOTA表现,表明OpenAI在大力加码企业市场。值得注意的是,ChatGPT Work上线于GPT-Live(全双工语音)发布仅一天之后,OpenAI的产品迭代速度令人瞩目。
5. 🔬 RoboScience Visics:通用具身大模型 VLOA 双引擎架构亮相
一句话总结:RoboScience发布机器科学通用具身大模型Visics,首次展示了VLOA(视觉-语言-操作-行动)双引擎架构。
RoboScience(机器科学)今日发布了其通用具身大模型Visics,这是国内具身智能领域又一重要模型发布。Visics采用了VLOA(Vision-Language-Operation-Action)双引擎架构,将视觉理解与操作执行解耦为两个相对独立的子系统,再通过统一框架进行协同。
📌 一句话:Visics的双引擎设计思路——让”看见”和”动手”各自发挥专长——或是解决具身大模型”能说不能做”困境的有效路径。
这一架构设计与其他主流路线形成了鲜明对比:RT-2系列采用单端到端架构(视觉直出动作),而Visics则强调视觉理解和操作执行的分离与协同。这种”双引擎”思路在工程实践上可能更具灵活性,允许开发者为两个子系统选择不同的基础模型和优化策略。
值得关注的是,这是继7月初的Genesis Eno(具身智能体框架)后又一个由中国团队推出的具身AI模型/框架。中国在具身智能领域的研究产出密集度正在快速提升。
🔗 雷锋网
📊 本周关键词:商业化加速
本周多个信号指向一个共同主题:AI与机器人商业化正在加速落地。
- OpenAI推出分级定价体系(Sol/Terra/Luna),从”一个模型通吃”转向精细化的能力分级
- Meta正式对Muse Spark收费,广告之外AI收入成新增长极
- 优必选U1订单破万,人形机器人首次达到万量级商业订单
- ChatGPT Work推出,对话式AI向生产力平台进化
- Mistral发布Robostral Navigate(本周三),机器人导航模型走向专业化
从”能不能做”到”谁来买单”——2026年下半年的大主题,可能就是商业化能力的全面比拼。
本期编辑:SinoBot Editorial | 📅 2026-07-10 来源标注:OpenAI、Bloomberg、Meta、雷锋网、HN Algolia、GitHub Trending