AMD 82亿美元收购李飞飞World Labs【AI 早报 2026-09-29】
今日,AMD宣布以约82亿美元全股票收购李飞飞创办的World Labs,交易完成后李飞飞将出任AMD执行副总裁兼首席科学家;Manus 2.0推出个人助手Cue与云电脑,代季峰团队开源首款由AI参与研发的309B模型,庞加莱猜想证明则首次被机器用约470万行Lean代码完整验证。
今日概览
- AMD 82亿美元收购李飞飞World Labs
- Manus 2.0发布:个人助手Cue、云电脑、远程控制
- 代季峰团队Naive AI开源首款模型:309B参数,AI参与研发
- 丘成桐弟子带AI写470万行代码,庞加莱猜想证明被机器完整验证
- Richard Socher新公司Recursive融资6.5亿美元,押注“AI研究AI”
- 英伟达发布开放智能体安全平台,OpenAI缺席核心合作名单
- Claude Sonnet 5.5上线AWS Bedrock,单任务成本更低
- Grok 4.7上线Amazon Bedrock,支持500K上下文与四档推理
- 可灵4.0发布:10-bit HDR与4K输出,单次生成最长30秒
- JetBrains推出Air Teams:让团队共享Agent工作流与云环境
- Cloudflare推出cf CLI:用Agent管理全部Cloudflare API
- Cloudflare Kitesurf浏览器更新:新增WebMCP支持
- 北大清华阿里提出SparkDiffusion:视频生成18秒出片提速265倍
- GitHub用开源AI安全Agent发现24个Android漏洞
- SceneMosaic:一张图生成可仿真3D场景,支持结构化重排
商业与行业动态
AMD 82亿美元收购李飞飞World Labs
AMD正式宣布收购李飞飞于2024年初创办的World Labs,交易以全股票方式进行,作价约82亿美元,双方已签署最终协议,预计2026年底前完成,但仍须监管批准。World Labs目前约70人,研究方向为“空间智能”,即根据文本、图像和视频输入生成、重建并模拟可交互三维环境;其近期发布的Atlas模型从头训练,结合生成式模型与多视图几何,可根据有限输入图像预测新观察视角,并在“稀疏重建”问题上取得进展。交易完成后,李飞飞将出任AMD执行副总裁兼首席科学家,直接向CEO苏姿丰汇报,联合创始人Justin Johnson和Ben Mildenhall将继续带领团队。AMD在公告中说明,随着AI进入推理、机器人、仿真和物理AI领域,计算需求正变得更多样,World Labs的模型研究经验可帮助AMD观察负载变化并影响未来硬件路线。此前苏姿丰已是World Labs早期投资者,过去一年双方围绕AMD GPU开展了模型训练与推理优化。
来源:https://www.ifanr.com/1682291?utm_source=rss&utm_medium=rss&utm_campaign=
Manus 2.0发布:个人助手Cue、云电脑、远程控制
Manus公布2.0版本更新,涵盖新Agent框架与运行环境、桌面端升级的Manus Studio以及独立应用Cue。其自研Cascade Agent框架使任务Token消耗减少23.2%,任务完成时间缩短28.2%,运行成本降低32%。运行环境方面,Manus新增“云电脑”购买选项,为多人联机游戏和全天候自动化流程提供专属运行环境;自动化功能从定时任务升级为事件触发,可监听邮件、Slack、Notion页面更新等已连接服务。Manus Studio覆盖文档、表格、PDF、幻灯片及网站、代码、游戏、视频创作,其中视频编辑器支持30到60秒产品短广告并含Alchemy模式,游戏开发环境在Max Ultra模式下同时调用视频、图像和编程三类模型,并支持发布网站与多人联机。全新个人Agent应用Cue支持手机和桌面端,与Manus共享基础设施;官方同时表示正组建团队开发面向国内市场的产品。
代季峰团队Naive AI开源首款模型:309B参数,AI参与研发
代季峰2026年2月创立的Naive AI发布首款模型Naive-N0.5-Flash,总参数量309B,激活参数量15.5B,原生支持百万token上下文,面向编程与AI研发。该团队从首日即让AI承担写代码、跑实验、监控流程、分析结果等研发工作,人类研究员只负责提出目标、设定约束与评价标准及最终决策。技术报告显示,AI已参与注意力架构探索及训练、推理、部署系统优化;在NaiveRT推理运行时优化中,研究员与AI用六天推进151轮实验,将同一系统一轮完整投机解码耗时从12.3毫秒降至3.4毫秒。另一项世界模型任务经过累计400小时、15轮主要实验,持续调整数据、训练方案与推理策略,最终得到AutoWM并跻身WorldArena第一梯队。实习生Shiqian Su分享的示例显示,由Naive-N0.5-Flash自行推进环境与数据准备、模型选择、训练评估纠错的多模态类Jev模型,在俄罗斯方块与贪吃蛇两个小游戏上均优于Jev及开源Laya。
来源:https://mp.weixin.qq.com/s/yaoSou6iHhA9eM9uQyBmkw
丘成桐弟子带AI写470万行代码,庞加勒猜想证明被机器完整验证
一个四人团队用证明助手Lean把Hamilton和佩雷尔曼的庞加莱猜想证明从头写到尾,共约470万行代码,其中约270万行是最后两周在ChatGPT、Claude等AI帮助下完成,全部通过Lean内核检查且无一处sorry。顺着最终定理追溯,实际用到14197个代码文件、约402万行,最长引用链串起353个文件;佩雷尔曼三篇论文对应代码约66万行,仅占六分之一,而典范邻域定理一项就用到272万行,占整条依赖链三分之二。论文省略的基础数学占据其余大部分,其中分析学约109万行、微分几何约77万行;仅短时存在性定理背后的Sobolev空间、谱理论等工具就要从零写起,用到89万行。
来源:https://mp.weixin.qq.com/s/6LBYm8pOPkgNDLLTCggTRw
Richard Socher新公司Recursive融资6.5亿美元,押注“AI研究AI”
Richard Socher今年5月发布新公司Recursive Superintelligence,一亮相即获6.5亿美元融资,GV和Greycroft领投,英伟达、AMD Ventures等参投;两个月后与亚马逊云科技签下价值4.1亿美元的多年算力协议。八位联合创始人包括前Google DeepMind开放式研究负责人Tim Rocktäschel、Jeff Clune、Vision Transformer共同作者Alexey Dosovitskiy、前Meta FAIR研究负责人田渊栋等。公司目标是构建能实现RSI(递归自我改进)的超级智能,让知识发现自动化,Socher把最终系统称为“Eureka Machine”(尤里卡机器)。目前公开系统仍属于“自动研究(Auto Research)”,即AI能自动提出想法、转化成代码修改、运行实验并检查奖励漏洞,被Socher称为通往RSI的“里程碑”或尤里卡机器的0.1版本。
英伟达发布开放智能体安全平台,OpenAI缺席核心合作名单
英伟达于9月28日推出免费的“英伟达开放智能体安全平台”(NVIDIA Open Agent Safety Platform),将安全控制下沉至基础设施层。平台核心由NVIDIA OpenShell与NVIDIA Sentry构成:OpenShell是开源安全运行环境,在CPU侧为智能体划定活动范围,已进入通用阶段,兼容Vera CPU及Arm、英特尔平台;Sentry是安装在BlueField-4 DPU上的独立硬件监控机制,可在毫秒级时间内隔离并关停越权智能体,基于DOCA软件提供可信遥测与细粒度零信任访问策略。采用相关技术开展合作的机构已超100家,Anthropic将Claude Managed Agents与OpenShell及BlueField集成,SpaceXAI接入Cursor编程智能体与Grok模型,Salesforce将OpenShell集成至Slack,Figure、Gecko Robotics和Skild AI等机器人公司将其延伸至物理世界。OpenAI虽曾参与OpenShell前期工作,但未出现在本次核心合作伙伴名单中。同日,英伟达宣布将股票回购授权规模增加1500亿美元,总额达2350亿美元。
大模型与AI产品
Claude Sonnet 5.5上线AWS Bedrock,单任务成本更低
Claude Sonnet 5.5已在Amazon Bedrock和Claude Platform on AWS可用,官方定位为更适合聚焦编程和知识工作的更智能、更高效模型,在大多数工作上单任务成本更低、速度更快。相比Sonnet 5,它能完成明确规格的功能或缺陷修复并对照需求自查,产出的单页文档、架构图和摘要幻灯片也更精致。适合持续或大规模运行的负载,包括工程警报首响、Agent常驻监控、SQL生成、UI/UX测试以及带固定支出上限的IDE快速编程Agent。AWS侧保留数据驻留,并整合IAM、CloudTrail、CloudWatch及Bedrock Guardrails。官方建议将Sonnet 5.5与Opus 5.5配对:Opus负责需要仔细判断的发布调试、多PR功能栈、大型PR安全审查和代码迁移,Sonnet负责路径清晰、只需快速执行的任务。
来源:https://aws.amazon.com/blogs/machine-learning/introducing-claude-sonnet-5-5-on-aws/
Grok 4.7上线Amazon Bedrock,支持500K上下文与四档推理
xAI的Grok 4.7已在Amazon Bedrock上线,提供500K token上下文窗口,并支持low、medium、high、xhigh四档可配置推理努力。该模型通过bedrock-runtime端点、跨Region推理配置文件提供服务,支持Responses、Chat Completions和Converse API。xAI称其为最强大的编程和知识工作模型,主题是“耐力”而非原始速度:能在困难任务上工作更久,并在继续前更仔细验证自身输出。训练上采用新的更大基模,进行更长强化学习运行,任务混合偏向需要数小时才能解决的问题;同时原生理解Grok Bot harness。xAI报告其在CursorBench、DeepSWE、Terminal-Bench、AA Briefcase、EEBench、Harvey Legal Agent Benchmark和HealthBench Professional等评测中均有提升。
来源:https://aws.amazon.com/blogs/machine-learning/grok-4-7-is-now-available-on-amazon-bedrock/
可灵4.0发布:10-bit HDR与4K输出,单次生成最长30秒
可灵AI发布Kling 4.0大版本,将于10月正式推出,Kling 4.0 Flash已于9月28日开放小范围体验。Kling 4.0主打真实、可控、专业,输出规格达到10-bit HDR与4K/1080P,每通道1024级灰阶,色彩信息比8-bit多4倍,可直接导入DaVinci Resolve或Premiere Pro满足流媒体交付标准。单次原生生成最长可达30秒,支持长镜头与连续叙事;单任务最多支持15项参考素材,包括10张图片、5段视频、7个主体及3个视频主体,并支持最多10张关键帧输入和21:9超宽画幅。语言能力覆盖中文、英语、日语、韩语、西班牙语等9种语言,以及北京口音、粤语、四川方言、美式英语、印度英语等多种口音。此外新增视频编辑器与Alchemy模式,游戏开发环境在Max Ultra模式下同时调用视频、图像和编程三类模型,并支持发布网站与多人联机。
来源:https://www.ifanr.com/1682361?utm_source=rss&utm_medium=rss&utm_campaign=
JetBrains推出Air Teams:让团队共享Agent工作流与云环境
JetBrains发布Air Teams,定位为Agent开发的团队层,为人类与Agent提供跨完整开发生命周期的共享上下文、环境、工具和指令。产品包含四部分:Automations可自行处理代码审查、issue修复和依赖更新等重复性工作,由事件或计划触发;共享云环境让团队一次配置、全员复用Agent构建和测试代码所需的工具、依赖与凭证;云任务在这些环境中并行运行,不占用个人笔记本,可从IDE或浏览器启动和跟踪;Projects则统一共享额度、明确角色,并让Automations不依赖任何单一个体。Air Teams目前已向JetBrains商业客户开放,计划后续向个人客户扩展。
来源:https://blog.jetbrains.com/air/2026/09/introducing-air-teams/
Cloudflare推出cf CLI:用Agent管理全部Cloudflare API
Cloudflare发布新CLI工具cf,面向Agent优先的下一代软件开发。背景数据显示,今年3月Agent占Wrangler使用量的25%,上周已达48%;Agent每天使用的不同命令数几乎是人类两倍,使用6个以上命令的可能性近四倍。由于Wrangler仅提供约280个操作而Cloudflare有数千产品,cf将JSON作为默认接口,为人类美化输出、为Agent压缩输出以节省上下文;引入cloudflare.config.ts作为全Cloudflare的新配置格式,并默认集成Vite本地开发服务器。cf目前以公开beta形式全球可用,官方示例包括cf init、cf dev、cf deploy及cf d1 list等命令,并建议开发者将使用指引加入全局Agent指令文件。
来源:https://blog.cloudflare.com/cloudflare-cf-cli-launch/
Cloudflare Kitesurf浏览器更新:新增WebMCP支持
Cloudflare更新其运行在Workers上的Agentic浏览器Kitesurf,新增WebMCP支持。WebMCP允许开发者将网站功能直接暴露给Agent,使其能调用searchFlights()等函数,而非模拟点击像素。Cloudflare自早期即支持WebMCP,几周前宣布网站所有者可用一个开关启用,Kitesurf现已支持该协议;在公开playground的Cloudflare Radar中,Application标签页的DevTools面板已暴露navigate-to、set-location等WebMCP工具供客户端程序化交互。此外,Kitesurf的API列表持续扩充,新增CSS Layout、CSS Object Model(CSSOM)、CSS Typed OM、Custom elements,并加入URL-based模块解析、JSON模块和import map处理,同时使用Cloudflare Workers新模块注册表支持相关功能。
来源:https://blog.cloudflare.com/kitesurf-update/
研究前沿
北大清华阿里提出SparkDiffusion:视频生成18秒出片提速265倍
北京大学、清华大学、阿里巴巴等机构提出SparkDiffusion,首个将稀疏注意力、少步蒸馏与低精度量化整合到统一框架的视频生成加速系统,附带开源权重和完整训练代码。传统方法生成一段5秒720P视频需超过1小时,而SparkDiffusion可18秒出片,提速265倍。研究团队发现“高稀疏陷阱”:当稀疏率从90%推到97%(计算量从10%降至3%),训练损失持续下降,生成视频却出现人物破碎、背景扭曲和时序混乱;通过Oracle干预实验定位到误差累积在高噪声阶段,仅修正最高噪声5步即可移除大部分终点误差。据此提出三阶段流程,包括为极高稀疏率保留全局信息的RoLA(Rotary-Positioned Low-Rank Linear Attention)、CrossDistill终端对齐蒸馏及FP8量化,推动DiT视频生成从分散优化单个组件转向端到端系统化加速。
来源:https://mp.weixin.qq.com/s/JJ3FYpfzEyCp65hvXg55ig
GitHub用开源AI安全Agent发现24个Android漏洞
GitHub安全实验室团队使用其开源的Security Lab Taskflow Agent,创建了针对Android应用的审计任务流(taskflows),已报告超过20个漏洞。运行方式为进入seclab-taskflows仓库启动codespace,执行./scripts/audit/run_mobile.sh,在中型仓库上约需一到两小时,结果存入SQLite的audit_results表。该流程需GitHub Copilot许可并消耗高级模型请求,可能产生大量工具调用和token消耗。为适配移动应用,作者新增gather_mobile_entry_point_info.yaml来区分移动入口点与非移动入口点,使AI能在包含移动应用、Web服务器、桌面应用的混合仓库中理解正确攻击面,并编辑classify_application_local.yaml引导模型关注Android特有漏洞类别。
SceneMosaic:一张图生成可仿真3D场景,支持结构化重排
香港大学等机构针对机器人仿真环境需求提出SceneMosaic,解决现有两条路线的问题:智能体文生3D质量高但慢(SAGE单场景耗时7.56小时),参数化图生3D快(十几分钟)但物理不准(碰撞率20%~26%)。SceneMosaic将场景视为由可独立替换的“局部拼片”拼成,流程分三阶段:先用感知智能体完成实例级登记,经SAM3分割、SAM3D独立重建物体网格与位姿,再通过DAG调度推断房间边界与attach/contain依赖,组织成层级化场景树;随后先做容纳修正与重力仿真消除悬空,再进入Critic-Actor循环,由Critic输出不含坐标的定性建议,Actor转成符号化位姿表达式由沙箱求值;最后沿场景树对局部单元变体取笛卡尔积,结合新颖性距离和动态Max-Min贪心搜索筛出紧凑多样的代表场景,使一次演化即可组合出海量候选,且变体比基础场景更便宜。
暂无评论。