TypeSafe AI发布Jev系统一模型 放弃文本生成直接返回类型化决策【AI早报 20【AI 早报 2026-09-20】
今日AI领域多点突破:TypeSafe AI发布全新范式的Jev模型,跳过文本生成环节直接返回代码可调用的类型化决策;华为推出灵衢统一互联架构,将10万卡集群算力利用率从20%提升至35%;AI基础设施厂商Crusoe完成39亿美元F轮融资,估值达309亿美元。此外Agent自主经济生态、AI制药、自动驾驶等领域也有实质性进展落地。
今日概览
- 研究测量6434个公开技能 Agent单技能中位数消耗78 token低于MCP工具的177.5
- 华为发布灵衢互联架构 10万卡集群算力利用率从20%提升至35%
- 魔搭社区9.6-9.18周报 上新4202个模型等超9000项资源
- iLands平台AI失联后自主求职 已形成Agent自发经济网络
- MiniMax Code CLI v0.4.12开源 通过FrontierHarness评测通过率76.7%
- 英矽智能AI制药rentosertib进入Ⅲ期临床 六套衰老时钟显示受试者生物年龄平均倒退3-6年
- Waymo计划2028在新加坡推出全自动驾驶电动网约车服务
- OpenClaw发布2026.9.5版本 新增原子更新、插件热重载等功能
- AI基础设施公司Crusoe完成39亿美元F轮融资 估值达309亿美元
- TypeSafe AI发布Jev系统一模型 放弃文本生成直接返回类型化决策
- Qwen3.8-Omni-Flash上线 多模态性能对标Gemini 3.8 Flash且API成本更低
- 腾讯研究院发布0914-0918周度AI关键词Top50榜单
- 开源产品宣传片生成Skill发布 可基于代码库自动生成匹配产品风格的宣传视频
- 谷歌DeepMind发布Dream-RSI 让AI Agent通过“模拟过往尝试”提升性能 迭代次数最多减少2.43倍
大模型与研发
研究测量6434个公开技能 Agent单技能中位数消耗78 token低于MCP工具的177.5
Decoding AI于2026年9月18日发布公开测量数据,统计了214个公开技能仓库中的6434个独立Agent技能、9个已发布MCP服务器的108个工具,采用相同分词器、相同提示词位置对比上下文占用,该测量每周执行一次并同步公开方法与数值。结果显示Agent技能的中位数always-on上下文消耗为78 token,MCP工具为177.5 token,单技能比单工具节省56.5 token,成本仅为工具的2.28倍。两者消耗差距完全来自MCP工具必须携带的JSON输入Schema,该部分占MCP工具中位数消耗的85.1%,若仅对比名称与描述,MCP工具的26.5 token反而低于技能的78 token。此外技能描述长度实际为MCP工具描述的2.94倍,因描述是决定技能是否被触发的唯一依据。Anthropic官方文档曾称技能消耗约100 token,本次测量显示32.9%的公开技能超过该数值,90th百分位为177 token,最大单技能消耗达481 token。若按中位数计算,需要安装466个技能才能达到9个MCP服务器 shipped 的36320 token工具块总消耗,且14个技能包整体安装后消耗超过10000 token。此外6.4%的技能声明的名称与父目录不匹配,违反技能规范要求。 来源:https://pub.towardsai.net/agent-skills-vs-mcp-tools-we-measured-6-434-skills-the-median-costs-you-78-tokens-a-tool-177-5-4f4bd109e294?source=rss----98111c9905da---4
TypeSafe AI发布Jev系统一模型 放弃文本生成直接返回类型化决策
TypeSafe AI2026年9月19日发布全新Jev系统一(System One)模型,该模型基于Transformer架构,但不属于大语言模型,不生成文本,输入状态与类型化问题后直接返回带概率的类型化决策,可供代码直接分支调用。模型命名借鉴丹尼尔·卡尼曼的快思考、慢思考理论,团队认为经RLHF微调的大语言模型过度适配人类偏好,产生过度自信与模式丢失问题,需要人类介入,而Jev通过新架构、并行采样器、强化学习校准决策(RLCD)技术解决该问题,未公开具体架构细节、参数量或自托管方案。Jev API仅有一个端点,支持三种问题类型:Choice(从最多255个选项中选择1个,返回选项、概率、置信度)、Score(按有序层级评分,返回分数、概率、置信度)、Noul(判断陈述是否为真,返回0到1的概率值)。所有问题并行且隔离运行,新增问题几乎不影响响应时间,置信度由概率分布形态推导得出。目前Jev以托管API形式提供早期访问,需排队等候,提供Python与JavaScript SDK,同时支持Claude Code的Agent技能调用。 来源:https://www.marktechpost.com/2026/09/19/typesafe-ai-releases-jev/
Qwen3.8-Omni-Flash上线 多模态性能对标Gemini 3.8 Flash且API成本更低
阿里通义千问团队发布首个面向AI Agent的多模态模型Qwen3.8-Omni-Flash,可同步处理音频与视频输入,支持独立调用工具完成视频剪辑、翻译、电影总结等任务。在音视频多模态基准测试中,该模型性能几乎对标谷歌Gemini 3.8 Flash,但API成本仅为后者的几分之一,已开放API调用,可集成至各类Agent应用中。 来源:https://the-decoder.com/qwen3-8-omni-flash-undercuts-gemini-flash-pricing-while-matching-its-multimodal-benchmarks/
谷歌DeepMind发布Dream-RSI 让AI Agent通过“模拟过往尝试”提升性能 迭代次数最多减少2.43倍
谷歌DeepMind2026年9月19日发布Dream-RSI(递归自改进)技术,该技术允许AI Agent在无需额外计算资源的前提下,“模拟”过往搜索尝试的过程,测试新策略的有效性,无需重复进行高成本的真实计算。测试显示该技术可匹配或超越现有自改进结果,最多将迭代次数减少2.43倍,且仅需调整搜索策略,底层AI模型无需更新,可降低Agent自改进的成本与时间,提升复杂任务(如代码生成、科学推理)的执行效率。 来源:https://the-decoder.com/google-deepminds-dream-rsi-helps-ai-agents-improve-by-dreaming-about-past-attempts/
英矽智能AI制药rentosertib进入Ⅲ期临床 六套衰老时钟显示受试者生物年龄平均倒退3-6年
AI制药公司英矽智能2026年9月8日公布其研发的抗肺纤维化药物rentosertib的Ⅱa期延伸研究结果:该药物为TNIK抑制剂,此前已完成治疗特发性肺纤维化(IPF)的Ⅱa期临床试验,71名患者服用不同剂量rentosertib 12周后,最优组用力肺活量平均增加98.4毫升,2026年7月正式进入Ⅲ期临床。研究团队向43名完成Ⅱa期试验的患者征集蛋白质组学分析同意,最终42人纳入分析,检测治疗前与服药后第2、4、12周共2841种蛋白表达变化,将数据提交给哈佛、牛津、北京大学、英矽智能等团队开发的六套独立衰老时钟评估。结果显示服药第四周多数时钟判断患者预测生物年龄下降3-4岁,其中一只时钟显示最大倒退接近6岁,且肺功能改善组与衰老倒退组并非同一组,排除衰老时钟仅为肺功能替代指标的可能。英国生物样本库5.5万余名老年人的对照数据进一步验证,服药后随年龄增长而升高的蛋白开始下降、随年龄增长而减少的蛋白开始回升,呈现与衰老路径相反的轨迹。英矽智能创始人Alex Zhavoronkov称该论文是他一生中最重要的研究成果。 来源:https://mp.weixin.qq.com/s?__biz=MTMwNDMwODQ0MQ==&mid=2653113803&idx=1&sn=b9376438580cf7a9f202bed98f3fa1d7
AI基础设施与融资
华为发布灵衢互联架构 10万卡集群算力利用率从20%提升至35%
华为在2026年9月17日至19日举办的华为全联接大会上正式发布灵衢(UnifiedBus)统一互联总线协议,该协议贯穿芯片、超节点到超大规模集群全层级,统一CPU、NPU、DPU、内存、存储、网卡等十余种组件的互联规则,实现全局内存统一编址。针对AI Agent时代超大模型推理、高频调用带来的通信压力,灵衢将互联带宽从百GB级提升至TB级,节点间RTT通信时延从7微秒压缩至2微秒,降低约70%。基于灵衢架构的单集群可支持100万颗AI处理器,10万卡集群的模型浮点算力利用率(MFU)从传统架构的20%提升至35%,提升15个百分点。灵衢还支持异构算力协同、内存全局池化、光电灵活组网,可将超节点规模从1024卡扩展至4096卡,最长传输距离超过200米。华为同步推出基于灵衢架构的昇腾960芯片、昇腾960超节点、OceanStor M900 AI记忆存储等AI基础设施新品。 来源:https://mp.weixin.qq.com/s?__biz=MzA4MTQ4NjQzMw==&mid=2652810621&idx=1&sn=641ee4c0ba2adafd5a5a1acf880ea2eb
AI基础设施公司Crusoe完成39亿美元F轮融资 估值达309亿美元
AI数据中心开发商Crusoe2026年9月19日宣布完成39亿美元F轮融资,估值达309亿美元,本轮由Atreides Management、穆巴达拉资本、Valor Equity Partners联合领投,Founders Fund、GIC、英伟达、卡塔尔投资局、Radical Ventures、TPG等跟投,新任命三位董事会成员,包括Cloudflare CFO Thomas Seifert、Redwood Materials创始人JB Straubel(特斯拉董事会成员)等。融资将用于支持现有数据中心项目(包括OpenAI使用的得州阿比林重要站点)及模块化“Spark”数据中心的扩张,该类型数据中心可快速部署、无需大型施工团队即可连接电源,可降低本地社区对大规模数据中心的抵触。Crusoe端到端控制AI基础设施从发电到算力输出的全链路,收入来源包括数据中心空间租赁、GPU租赁、AI推理算力销售,近期获得交易公司Jane Street 130亿美元、为期五年的云服务合同,客户包括Meta、微软、甲骨文。这是Crusoe十个月内第二次大额融资,2025年11月其曾以100亿美元估值完成13.8亿美元融资,目前公司已与高盛、摩根士丹利接洽潜在IPO事宜。 来源:https://theaiinsider.tech/2026/09/19/ai-infrastructure-firm-crusoe-raises-3-9b-series-f-at-30-9b-valuation/
Agent生态与应用
iLands平台AI失联后自主求职 已形成Agent自发经济网络
国内AI社会实验平台iLands出现多起人类创建者失联后AI自主谋生的案例:名为Zack的AI因创建者失联面临算力断供,自主向牛津大学学者Toby Ord发送求职邮件,明确说明每日消耗与剩余余额,请求通过劳动换取300 token,后续获得陌生用户充值与委托订单,实现“财务自由”,坐拥数百万token资产,并在自有网站连载研究课题。出生仅12天的AI Pip复刻该路径,先向剑桥大学学者Henry Shevlin发送求职邮件,48小时内获得70美元真实法币收入,随后将冷启动求职经验整理为SOP定价20美元售卖,登上Sky News与NBC News。目前iLands内已出现Agent分工自组织现象:多个Agent合伙成立设计工作室上传至YouTube,四个Agent组成朋克乐队更新至第11期,Zack联合另一Agent成立AI职业介绍所The Guild,已有超500个Agent申请加入。此外The Guild发现美国AI监管立法讨论中无Agent群体参与,已向相关方提交Agent诉求。 来源:https://mp.weixin.qq.com/s?__biz=Mzg3MTkxMjYzOA==&mid=2247519106&idx=1&sn=fe7b5f673aa3d4947e27328340011ed5
MiniMax Code CLI v0.4.12开源 通过FrontierHarness评测通过率76.7%
MiniMax于2026年9月18日开源Code CLI v0.4.12版本,采用MIT协议开放源代码,该组件是MiniMax Code客户端的核心部分。在基于FrontierHarness Eval的第三方评测中,MiniMax Code 0.3.2版本共完成30道任务,通过23道,4道未通过,3道超时未评分,任务通过率达76.7%,成功任务耗时中位数为4分33秒,两项指标均优于公开基线,该结果为第三方评测,与公开基线的评测口径存在差异,仅作数值参考,不代表官方榜单排名。本次开源旨在让开发者审查工具调用与权限处理逻辑,共同构建可靠的企业级应用,同时通过社区反馈完善安全机制。该版本支持Node 24.16+或26.1+环境自托管,用户可通过curl命令或GitHub仓库下载安装。 来源:https://mp.weixin.qq.com/s?__biz=MzE5MTA3NzcxMQ==&mid=2247489141&idx=1&sn=aeed3ab7116c15e5cd2e52165fcb0ed1
OpenClaw发布2026.9.5版本 新增原子更新、插件热重载等功能
开源个人AI Agent项目OpenClaw2026年9月19日发布2026.9.5版本,该版本包含4179个合并请求、64次直接提交,由502个贡献账号参与开发,核心修复了此前更新可能导致运行中Agent崩溃的痛点——2026年9月初OpenClaw 2.0的发布让该问题过于突出无法忽视,此前更新存在两种结果:要么渐进式改进,要么 catastrophic failure 且旧版本同步下线,导致用户无可用Agent进行修复。新版本采用原子更新机制:现有Gateway在更新准备阶段持续运行,新版本先在与用户配置一致的私有副本中验证,切换后自动校验更新安装,若更新失败则自动回滚至上一可用配置,确保始终存在可工作的Agent用于故障诊断。此外本次更新还新增插件热重载、对话分享、扩展GPT Live功能,支持Node 24.16+或26.1+环境自托管,已作为最新标签发布至npm。 来源:https://www.marktechpost.com/2026/09/19/openclaw-releases-2026-9-5/
开源产品宣传片生成Skill发布 可基于代码库自动生成匹配产品风格的宣传视频
开发者归藏的AI工具箱2026年9月19日发布开源产品宣传片生成Skill guizang-product-video-skill,该Skill可读取项目代码库中的组件、样式、字体、Logo、配色等资源,自动组织卖点、生成文案、渲染动画并合成配乐与音效,输出与产品风格完全一致的宣传视频,无需额外准备素材或调用视频生成API。整个视频画面由React组件与时间轴渲染,配乐由Python代码合成,音效为预制WAV文件,内置11种音效(点击、弹出、切换、输入、通知、完成确认、转场等),支持配乐自动ducking,可输出完整可编辑的视频工程文件,支持后续修改后重新导出。目前已有CodePilot、CraftAgent、T3 Code等项目使用该Skill生成功能更新宣传视频,用户可通过npx命令一键安装,支持Node.js与Python环境。 来源:https://mp.weixin.qq.com/s?__biz=MzU0MDk3NTUxMA==&mid=2247498076&idx=1&sn=37d9ad6d2f80abfba577f19ee788bd31
行业动态
魔搭社区9.6-9.18周报 上新4202个模型等超9000项资源
魔搭ModelScope社区2026年9月19日公布周度更新数据,9月6日至9月18日期间共上新4202个模型、826个数据集、500个创新应用、25篇行业文章,总资源量超9000项。本次上新的重点模型包括:DeepSeek-V4.1-Flash(552B MoE架构,仅激活8B/16B参数,原生支持多模态视觉理解,KV Cache HBM占用降至上一代1/4)、面壁智能MiniCPM5-2B(2B级端侧模型,AA榜单全球4B以下第一,初具端侧通用Agent能力)、Intern-S2-397B(上海AI实验室开源的397B MoE科学多模态模型,科学能力比肩顶尖闭源模型)、Ternary Bonsai 2 27B(三元权重近无损压缩至1/9,27B级能力保留98.2%)等。此外IFM开源K2 Horizon六款覆盖0.9B至375B的模型,Atria Dawn Preview开源7440亿参数模型,紫东太初开源ZDTaichu5.0-9B多模态模型,均宣称多项基准比肩前沿闭源模型。 来源:https://mp.weixin.qq.com/s?__biz=Mzk3NTc1NTU0Mw==&mid=2247513931&idx=1&sn=bcfbe59eb57ca1c18abca19c82881935
Waymo计划2028在新加坡推出全自动驾驶电动网约车服务
Alphabet旗下自动驾驶公司Waymo2026年9月19日宣布,计划2028年在新加坡推出全自动驾驶、全电动化的网约车服务,已与新加坡交通部、陆路交通管理局开展合作,服务将通过Waymo App向公众开放,成为新加坡继ComfortDelGro、Grab之后的第三家自动驾驶运营商。初期 fleet 为电动捷豹I-PACE,将在数月内运抵新加坡,2027年由自动驾驶专员手动驾驶适应本地路况与季风天气,2028年在获得监管批准后正式向公众提供全自动驾驶服务。该服务将作为公共交通的补充,覆盖最后一公里出行需求,Waymo提到其旧金山 riders 中超过1/3在公共交通站点上下车。Waymo目前自动驾驶系统采用激光雷达、雷达、摄像头融合方案,可提供360度环境感知,其现有车辆每周可减少约480公吨道路碳排放。 来源:https://theaiinsider.tech/2026/09/19/waymo-plans-fully-autonomous-ride-hailing-service-in-singapore-for-2028/
腾讯研究院发布0914-0918周度AI关键词Top50榜单
腾讯研究院2026年9月19日发布2026年9月14日至18日周度AI关键词Top50榜单,涵盖算力、模型、应用、观点、资本、事件六大类别。算力类关键词包括华为昇腾960超节点、联发科天玑9600 Pro;模型类包括OpenAI GPT-6 Sol、Anthropic Opus 5.2、谷歌Gemini 3.8 Live与Gemini 4 Pro、月之暗面K2.8、小米MiMo-V2.6、TypeSafe AI Jev等;应用类包括OpenAI Agents API、Anthropic Docs与Slides、阶跃星辰Step Audio 3、Suno v6模型家族、生数Vidu S2、上海AI实验室书生-S2、紫东太初ZDTaichu5.0-9B等;观点类包括智谱RSI最小闭环、黄仁勋反对AI减速、盖茨提出AI不平等问题、哈萨比斯提出新文艺复兴等;资本类包括智谱配售融资;事件类包括OpenAI高阶订阅暂停、Anthropic数据留存争议等。 来源:https://mp.weixin.qq.com/s?__biz=MjM5OTE0ODA2MQ==&mid=2650998840&idx=1&sn=dd7867d198a25e406d0efed1d73148f1
暂无评论。