GPT-6.1 Sol极速版上线:速度提升8倍,输入12美元【AI 早报 2026-10-10】

GPT-6.1 Sol极速版上线:速度提升8倍,输入12美元【AI 早报 2026-10-10】

今日看点:OpenAI 为 GPT-6.1 Sol 上线 Ultrafast 极速模式,速度提升至标准版 8 倍;Cloudflare 发布四模态决策模型 Clef-omni;谷歌企业级智能体首次将 Claude Opus 5 纳入模型选择;Claude 补齐首张完整紫外全天图,约三分之一天区为此前从未观测区域。

今日概览

模型发布

  1. GPT-6.1 Sol极速版上线:速度提升8倍,输入12美元
  2. Cloudflare发布Clef-omni多模态决策模型:支持音视频输入,Clef-flash降价
  3. 英伟达联合MIT牛津发布Physis-Lang:Physics-IQ Verified登顶48.2分
  4. 星动纪元VPP2登顶RoboDojo:14B参数无额外数据,成功率32.26%
  5. Aether AI发布CRIS-0因果驱动机器人系统:干扰响应0.1秒
  6. 西湖机器人发布WR1通用大脑:全球首次人形机器人灵巧手自主叠衣

要闻

  1. 谷歌发布Gemini企业级智能体:集成Claude Opus 5与Sonnet 5.5
  2. Claude完成首张完整紫外全天图:1.19亿颗星,三天补齐天区空白

开发生态

  1. OpenAI Python SDK v3.28.0:新增Agent环境暂停与过期功能
  2. OpenAI Python SDK v3.27.0:新增预加热托管环境接口
  3. Anthropic Python SDK v1.13.0:新增Chat/Cowork分析指标类型

产品应用

  1. TRAE全面升级:Work与Code双端合并,新增Agent模式
  2. 理想i6年度改款公布:96kWh 5C电池,续航780km,10月28日发布
  3. 正行创新发布零售Physical AI方案:H1/C1机器人瞄准24小时便利店

技术与洞察

  1. 多会话语音记忆基准VoxMem:34,743个语音会话,15种考察组合
  2. OpenViking三篇论文:VikingMem/TrieHI/VikingRAG上下文管理
  3. IROS 2026最佳论文LT-Mem:机器人长期记忆三层架构

行业动态

  1. Vinci完成2.5亿美元B轮融资:估值15亿美元,拓展AI物理平台

模型发布

GPT-6.1 Sol极速版上线:速度提升8倍,输入12美元

OpenAI 今日在 API、Codex 和 ChatGPT Work 三端同步上线 GPT-6.1 Sol 的 Ultrafast 极速模式。该模式输出速度达到标准版的 8 倍,约每秒 300 token;定价为每百万 token 输入 12 美元、输出 60 美元,是标准版(输入 2 美元/输出 10 美元)的 6 倍,但仅为旗舰 GPT-6 Astra 极速版价格的五分之一。在 DeepSWE v1.1 长程软件工程基准上,Sol 与 Astra 成绩持平而成本约为其五分之一;在 OSWorld 2.0 电脑操作基准上低 2.1 分,单任务花费为七分之一。Artificial Analysis 智能指数中 Sol 开满推理得 52 分,仅比 Astra 少 1 分。长文本场景下,单次输入超过 27.2 万 token 时价格上调至输入 24 美元/输出 90 美元。OpenAI 建议开发者调用极速版时使用 WebSocket 长连接以减少网络开销。目前 Codex 与 ChatGPT Work 仅每月 500 美元的 Pro 500、按用量计费的企业版及按点数计费的教育版可用,企业版需管理员手动开启。 来源:https://mp.weixin.qq.com/s/ijIEt8d8oRSYFlyhBXhlTw

Cloudflare发布Clef-omni多模态决策模型:支持音视频输入,Clef-flash降价

Cloudflare 继上周发布 Clef 和 Clef-flash 后,今日推出开放权重决策模型 Clef-omni,新增对音频(wav/mp3)和视频(mp4/webm)输入的支持,与文本、图像共同构成四模态输入能力。该模型基于 Qwen3-Omni-30B-A3B-Instruct 混合专家(MoE)基础模型构建,保留其多模态理解主干,移除文本到语音输出组件,可在单一模型内完成跨模态决策,替代级联的语音转文本与音视频分离流水线。同时 Clef-flash 价格下调至低于 Jev,Clef 本体获得速度提升。模型权重已在 HuggingFace 开放。 来源:https://blog.cloudflare.com/clef-faster-cheaper-multimodal/

英伟达联合MIT牛津发布Physis-Lang:Physics-IQ Verified登顶48.2分

英伟达联合 MIT 与牛津大学提出 Physis-Lang,通过将物理原因、规律和结果写入自然语言描述,贯穿数据筛选、模型训练与视频生成。在 Physics-IQ Verified 榜单上,基于该方法的 Cosmos3-Super 与 Cosmos3-Nano 分别取得 48.2 和 43.3 分,按平均分位列第一、第二;Super 较此前最高分 42.7 提升 5.5 个百分点。16B 参数的 Cosmos3-Nano 加入 Physis-Lang 后,均分超过原始 64B 的 Super 模型。研究团队同时构建 PhysCapBench 基准,包含 246 段物理视频与 3,794 条人工核验的原子断言,平均每段约 15.4 条,以 Precision 与 Recall 合成 F1 评估描述的物理细致度,并采用固定标注模型、迭代共享 caption prompt 的自进化流程。 来源:https://mp.weixin.qq.com/s/D6b1FbGx-Zvzknnlt9zzPw

星动纪元VPP2登顶RoboDojo:14B参数无额外数据,成功率32.26%

清华持股的星动纪元发布世界动作模型 VPP2(Video Prediction Policy 2),以平均成功率 32.26%、平均得分 39.26 登顶 RoboDojo 榜单,并拿下泛化、精度、记忆三项第一。该模型仅 14B 参数,未使用额外数据或 agent RSI,按官方 baseline 协议训练并开源可复现。此前榜首为 GPT-6-Astra 的 22.48% 成功率与 28.97 分,PI 的 π0.5 为 8.31% 与 14.67。RoboDojo 由香港大学 MMLab 牵头,联合 UC 伯克利、清华等近 20 所机构共建,仿真环节包含 42 个双臂任务,任务未完整执行即得零分。 来源:https://mp.weixin.qq.com/s/__biz=MzA5ODEzMjIyMA==&mid=2247746731&idx=1&sn=78993744ba082d1d204f6c5ffdbc99cc

Aether AI发布CRIS-0因果驱动机器人系统:干扰响应0.1秒

Aether AI 发布因果驱动机器人智能系统 CRIS-0,演示中机械臂在咖啡袋被挪走、灯光变化、盘中出现饮料罐、关门时人手伸入门边等连续干扰下调整动作,关门场景反应速度达 0.1 秒级。系统分为因果驱动的机器人 Agent 与因果世界模型两层:Agent 围绕因果状态转移组织任务,从新环境发现任务相关变量并拆解阶段,通过统一工具接口调用规则函数、学习策略、SLAM 导航、世界模型与验证器;因果世界模型不直接预测下一帧画面,而是预测候选动作引发的因果变量变化,并加装动作模块直接生成机器人动作。 来源:https://mp.weixin.qq.com/s?__biz=MzA3MzI4MjgzMw==&mid=2651061909&idx=1&sn=0d5705aa4454485a08091266765fc426

西湖机器人发布WR1通用大脑:全球首次人形机器人灵巧手自主叠衣

西湖机器人发布通用大脑 WR1,采用通用大小脑双预训练架构。通用大脑融合世界模型与 VLA,负责环境感知、任务理解与决策,直接输出包含移动、躯干姿态、灵巧手操作的全身动作序列;通用动作专家 GAE 作为运动小脑承接执行。系统配置长短时运动状态回顾、实时动作分块衔接机制与 GAE 前瞻延迟补偿,突破高动态、拟人化全身运动操作一体化。公开演示中,机器人从冰箱取出玉米后完成 U 型转身前往空气炸锅,下蹲拖动收纳筐逐个收纳玩偶,再前往卧室整理被子,全程无停顿或场景切换重启,并实现全球首个人形机器人灵巧手自主叠衣。 来源:https://mp.weixin.qq.com/s/i6wI3fvzpWnuHxKqSS8L3g

要闻

谷歌发布Gemini企业级智能体:集成Claude Opus 5与Sonnet 5.5

谷歌在 Google Cloud 活动发布统一 Gemini 智能体,先面向企业开放。该智能体拥有独立 Workspace 账号与邮箱,可理解团队结构、日历与审批链,记录归属于自身的审计轨迹;能连接 Google Workspace、Microsoft 365、Slack、Jira、BigQuery、Snowflake 及任意 MCP server,并可被给定目标而非指令以规划工作。用户可监控其推理、子智能体委派与进度。谷歌 CEO 皮查伊称 Gemini 月活跃用户已超 10 亿,财富 100 强中近 90% 使用 Gemini Enterprise。模型选择上,除 Gemini 4 Argon 与 Gemini 3.8 Flash 外,企业版下拉菜单首次同时列出 Claude Opus 5 与 Claude Sonnet 5.5;默认由系统选择最佳模型。早期测试企业包括 On、Shopify 与 PayPal,谷歌同时新增智能路由与实时支出上限等支出控制。 来源:https://theaiinsider.tech/2026/10/09/google-brings-unified-gemini-agent-to-enterprises-letting-ai-act-as-a-workspace-co-worker/

Claude完成首张完整紫外全天图:1.19亿颗星,三天补齐天区空白

Anthropic 公布首张完整紫外全天图,覆盖约 1.19 亿颗星,其中约三分之一天区此前从未被紫外望远镜观测。约翰斯·霍普金斯大学天体物理学家 Brice Ménard 使用 Claude Science 指挥 Agent 团队,汇总过去 50 年 NASA GALEX(2003–2013 年拍摄约 3.8 万张、覆盖三分之二天空)、NASA Swift 与韩国 FIMS/SPEAR 等卫星数据,拼接并推算空白区域。GALEX 因避开银河盘面强光且 2009 年后远紫外设备失效,导致银河一带长期缺失。此项工作以往需数周人工校准,本次由 Claude 在数天内完成。 来源:https://mp.weixin.qq.com/s/YCuqb8eDcK9e8BlvCocEvA

开发生态

OpenAI Python SDK v3.28.0:新增Agent环境暂停与过期功能

OpenAI Python SDK 发布 3.28.0 版本,API 层新增 Agent 环境暂停与过期(agent environment suspension and expiration)支持,具体提交编号 #4046。该版本同时将 astral-sh/setup-uv 依赖从 10.1.0 升级至 10.2.0,并更新 CodeQL 相关配置。 来源:https://github.com/openai/openai-python/releases/tag/v3.28.0

OpenAI Python SDK v3.27.0:新增预加热托管环境接口

OpenAI Python SDK 3.27.0 版本在 API 中新增预加热托管环境(prewarmed hosted environments)接口,对应提交 #4043。该功能面向需要快速启动托管执行环境的场景,减少环境冷启动开销。 来源:https://github.com/openai/openai-python/releases/tag/v3.27.0

Anthropic Python SDK v1.13.0:新增Chat/Cowork分析指标类型

Anthropic Python SDK v1.13.0 为 Chat 与 Cowork 新增统一分析指标类型(unified analytics metrics),并在 Managed Agents 中增加工作流、多智能体配置与线程状态过滤(workflows, multiagent configuration and thread status filtering)支持,便于开发者构建多 Agent 协作与监控能力。 来源:https://github.com/anthropics/anthropic-sdk-python/releases/tag/v1.13.0

产品应用

TRAE全面升级:Work与Code双端合并,新增Agent模式

TRAE 将 TraeWork 与 TraeCode 合并为统一客户端,新增 Agent 模式,可在单一窗口管理所有项目并调度多个 Agent 并行工作;需要深入代码时一键切回 IDE 继续修改同一工程。实测中,新版 TRAE 被用于构建科普视频生成器,输入一句话可生成约 24 至 30 秒带画面、字幕与配音的短片;还实现了浏览器实时 3D 水母场景、全代码绘制的网页汉堡经营小游戏,以及基于 three.js 的 3D 球场选座预览(STADIVIEW 复刻)。新增“我的产物”自动归集 Agent 生成的代码变更、HTML、PPT、Word、图片与视频。 来源:https://mp.weixin.qq.com/s?__biz=MzIyNjM2MzQyNg==&mid=2247728385&idx=1&sn=ea9c7fe615ef46ba80bfe107059bd143

理想i6年度改款公布:96kWh 5C电池,续航780km,10月28日发布

新一代理想 i6 公布六项升级,10 月 12 日将在巴黎车展以 Li 6 名称完成欧洲首秀,10 月 28 日正式发布。现款 i6 上市一年交付超 19 万辆,连续 8 个月位居 20 万元以上纯电车型销量前三。新车搭载理想自研 96kWh 5C 电池,后驱版 CLTC 续航从 720km 提升至 780km,四驱版从 660km 提升至 710km;电芯由理想自研、欣旺达与中创新航代工。前排配备两张全尺寸零重力座椅,躺倒角度 150°,支持 16 向电动调节与 18 点揉捏按摩;座舱升级为高通 8797,辅助驾驶从英伟达 Thor-U 切换为理想自研马赫 M100(5nm,单芯片 1280TOPS,运行效率超 82%)。车内前排换装 29 英寸 6K 全景屏,后排屏幕升级为 21 英寸 4K,并新增电动前备箱与 ADB 矩阵大灯,官方称照射距离增加接近 30%。 来源:https://www.ifanr.com/1683385?utm_source=rss&utm_medium=rss&utm_campaign=

正行创新发布零售Physical AI方案:H1/C1机器人瞄准24小时便利店

由姚颂、杨宇欣、于超与正大集团联合发起的正行创新发布面向零售场景的 Physical AI 解决方案,包含具身大脑、自研本体与管理平台。具身大脑由 23 亿参数的世界动作模型 SLM-0.5、强化学习后训练体系 STEAM 与智能体 Rpent 组成;SLM-0.5 在 LIBERO 基准平均任务成功率 98.6%,单次推理低于 187ms,较对比的像素级世界动作模型方案推理速度提升超 24 倍。本体包括双足人形机器人 H1(身高 1.4 米,26 自由度,最高移动速度 2m/s,算力 157TOPS)与轮式双臂搬运理货机器人 C1(单臂 7 自由度,末端负载 3kg,升降行程 920mm,作业高度覆盖约 100mm 至 1750mm,算力 2070TFLOPS FP4,续航约 6 小时)。C1 已适配 800 余种高频流转 SKU,官方称可自主完成 99% 分拣任务。方案首先进入便利店、商超,承担搬运、补货、盘点、巡检,计划 2027 年正式提供商业化服务,模式包括直接采购与 RaaS 订阅。 来源:https://mp.weixin.qq.com/s?__biz=MzA4MTQ4NjQzMw==&mid=2652811621&idx=2&sn=839dad1b891b109df025d5a3ea00c25c

技术与洞察

多会话语音记忆基准VoxMem:34,743个语音会话,15种考察组合

墨尔本大学与新南威尔士大学联合发布多会话语音记忆基准 VoxMem,针对音频大模型记不住“谁说的、怎么说”的问题。该基准以“声学证据×记忆操作”二维分类覆盖 15 种考察组合,包含 3,196 个评测实例与 34,743 个语音会话(约 177 小时),每道题在 8K 到 64K token 的历史长度下保持不变。声学证据分为语音语义、说话人身份、副语言线索与环境声;记忆操作分为信息抽取、多会话推理、时序演变追踪与拒答。对 15 个音频大模型的评测显示,32K 上下文下无一整体准确率超过 40%,追踪语气变化与背景声变化的平均准确率仅 3.4% 与 1.2%。 来源:https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652733131&idx=3&sn=6b91c3fc0c4519f5dea8ad255b583b1f

OpenViking三篇论文:VikingMem/TrieHI/VikingRAG上下文管理

字节跳动 OpenViking 团队围绕 Agent 上下文管理发布三篇论文。VikingMem(VLDB 收录)把记忆分为事件与实体两层,在 LoCoMo 长期记忆评测得 88.83 分(第二名 MIRIX 78.66,全量历史 77.47),单次查询约 0.2 秒(MIRIX 需 10 秒以上),存储约为原始记录的六分之一;在 LongMemEval 上得 75.80,比普通检索方案高 11.99 个百分点。TrieHI(ICDE 收录)提出目录感知的向量数据库查询与维护,解释 OpenViking 为何做成文件系统。VikingRAG 面向结构化文档,做准确且省 token 的检索增强生成。该记忆方案已在 100 多个真实企业应用上线,覆盖教育、Agent 记忆与陪伴类场景。 来源:https://mp.weixin.qq.com/s?__biz=MzI1MzYzMjE0MQ==&mid=2247523063&idx=1&sn=70910f0ca4b9f5fb519c7d4d94f481f6

IROS 2026最佳论文LT-Mem:机器人长期记忆三层架构

IROS 2026 最佳论文 LT-Mem: Volatility-Aware Spatio-Temporal Memory for Lifelong Scene Understanding 由 Yumin Lee、Hyoseok Ju 与 Giseop Kim 提出,针对机器人长期运行中的“时间性失忆”——系统持续更新环境却丢失物体随时间变化的历史。论文将跨时段物体身份、状态更新与事件记录连接,用 Live、Delta 与 Meta 三类记忆分别对应当前状态、变化事件与长期规律,使机器人能回答“以前怎样变化”而非仅“现在在哪”。研究指出,长期记忆需持续回答三个问题:看到的还是不是原来那件东西、是真的变了还是没看清、新观察应覆盖还是暂存旧判断。 来源:https://mp.weixin.qq.com/s/qNeBWNS1ieEtpRPMjrSDow

行业动态

Vinci完成2.5亿美元B轮融资:估值15亿美元,拓展AI物理平台

AI 原生工程平台 Vinci 完成 2.5 亿美元 B 轮融资,估值达 15 亿美元。本轮由 Advent、Temasek 与 Xora 共同领投,AMD Ventures、Madrona、Eclipse 与 Khosla Ventures 参投。Vinci 由 Hardik Kabaria 创立,平台结合自动化设计理解、智能体编排、物理基础模型与 GPU 原生物理内核,为零样本跨新设计提供实时物理行为视图,无需客户特定训练或微调。资金将用于把业务从半导体物理拓展至汽车、航空航天与先进计算等更广泛的硬件工程领域。 来源:https://theaiinsider.tech/2026/10/09/vinci-closes-250m-series-b-at-1-5b-valuation-to-expand-ai-physics-platform-beyond-semiconductors/

评论

暂无评论。

登录后可发表评论。