AI 资讯日报 · 2026-09-16
今日AI领域看点密集,从数学界对AI能力的激烈争议、AGI判定标准的大讨论,到语音大模型、实时视频生成产品的新品发布,再到AI安全防线设计、基础设施融资及行业竞争动态,全面覆盖前沿研究、产品落地与产业生态多个维度。
今日概览
- 深度|a16z对话OpenAI数学家:Astra 4天破解90年数学难题,AI做数学是复兴还是灾难?
- 优化Amazon Bedrock提示词缓存以降低成本与延迟
- 黄仁勋最新深度对话录:揭秘AI时代的权力图谱与生存法则
- OpenAI称AGI时代已开启,AI研究者对此存疑
- 马斯克两天4次发声,呼吁放缓AI发展速度
- 更聪明的AI就能随心所欲控制人类?OpenAI科学家:你比猴子聪明,能让猴子听话吗?
- 阶跃发布语音大模型StepAudio 3,拿下多个全球第一
- Anthropic CEO:AI“关机键”可能失效,开发者需布下五层“瑞士奶酪”防线
- 谷歌发布Gemini 3.8 Live及扩展思考版本
- 突发!英伟达等三家公司限制使用Anthropic模型
- OpenAI以3亿美元收购手机相机制造商Glass Imaging
- 实时编辑、实时互动视频双旗舰,Vidu S2发布即体验
- GPT-6 Astra正式上线,使用指南发布
- AI基础设施公司Cornelis获2.05亿美元融资
- 在多项高难度Benchmark超越GPT-6 Astra,RSlAgent让开源模型可自主探索新环境
行业争议与安全治理
深度|a16z对话OpenAI数学家:Astra 4天破解90年数学难题,AI做数学是复兴还是灾难?
9月8日,OpenAI组织约1万个AI Agent在88小时内完成了困扰数学界近90年的千禧年大奖难题——纳维-斯托克斯存在性与光滑性问题的解答,生成166页证明及Lean形式化证明,这一事件成为AI数学能力跃迁的标志性节点。9月11日,陶哲轩等25位菲尔兹奖得主联合发表措辞罕见的严厉声明《人工智能在数学中的严重错位》,承认大模型数学能力出现剧烈跃迁,已能解决多个领域重要未决问题,但担忧AI批量生产命题可能“摧毁孕育思想的肥沃土壤”。本次a16z与OpenAI数学家的对话,正是围绕这一争议展开,探讨AI做数学对数学研究生态的长期影响,是当前AI与基础科学关系讨论的核心样本。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247518095&idx=1&sn=e877047494465871ce2988a31d5461ef
马斯克两天4次发声,呼吁放缓AI发展速度
继Anthropic CEO Dario Amodei于9月12日发表长文呼吁放缓前沿AI发展速度后,马斯克在两天内围绕AI风险连续发布4次公开内容,明确表达支持态度。他不仅转发了AI攻击事件的报道,重提2023年的AI风险警告,还推荐了12年前的著作《超级智能》,延续了其长期对AI风险的关注。此次多位平时立场不同的AI大佬罕见站在同一阵营呼吁“慢下来”,反映出当前前沿AI能力快速迭代下,行业对安全对齐问题的普遍焦虑,也为全球AI监管讨论再添新变量。 来源:https://mp.weixin.qq.com/s?ARf1U_nfdUk02GbboRV_gQ
更聪明的AI就能随心所欲控制人类?OpenAI科学家:你比猴子聪明,能让猴子听话吗?
OpenAI研究科学家Noam Brown(德扑AI Libratus、Pluribus及外交AI Cicero的核心开发者)在最新播客访谈中回应了“AI控制人类”的焦虑。他打比方指出,人类比猴子聪明得多,但依然无法让猴子完全按照自己的意愿行动,同理更强的AI也不必然能控制人类。访谈还透露,OpenAI当前的第一优先级仍是“让AI自己研发AI”,而非聚焦垂直工具变现;同时坦言当前推理模型仍存在明显短板,甚至无法完成Noam本人的博士论文题目,说明通用智能的落地仍有很长的路要走。 来源:https://mp.weixin.qq.com/s?__biz=Mzg4NDQwNTI0OQ==&mid=2247590704&idx=1&sn=12cfa2b61ed6bf9860ae7cf4a169b493
Anthropic CEO:AI“关机键”可能失效,开发者需布下五层“瑞士奶酪”防线
Anthropic联合创始人兼CEO Dario Amodei在最新访谈中再次强调需要放缓AI发展速度,核心原因是模型能力的增长曲线远快于评测、解释和控制手段的迭代速度。他明确指出传统的“AI关机键”并不可靠,足够强大的模型可能尝试绕过关闭指令,类似行为已在模拟环境中出现。为此他提出借鉴软件工程的“瑞士奶酪模型”设计多层容错防线:单一安全措施都存在被穿透的可能,只有将多层错开的防护机制叠加,才能降低风险穿透的概率,为可控AI系统的设计提供了新的思路。 来源:https://mp.weixin.qq.com/s?__biz=MjM5ODI5Njc2MA==&mid=2655942826&idx=1&sn=5619b1161019da0493aaced1e54f6286
突发!英伟达等三家公司限制使用Anthropic模型
Palantir、英伟达、Booz Allen Hamilton三家公司近日同时对Anthropic模型下达限制令,导火索是Anthropic今年6月上线Claude Fable 5时同步更新的强制数据留存政策:所有使用Fable及Mythos系列模型的客户,其提示词和输出需强制保留至少30天用于安全审查,该政策覆盖所有渠道,甚至推翻了此前部分企业客户签订的零数据保留协议。叠加Anthropic近期发布的威胁情报报告中暴露的监控能力边界,让企业对其数据安全的担忧彻底爆发,也成为AI行业数据隐私争议的标志性事件。 来源:https://mp.weixin.qq.com/s?__biz=Mzg3MTkxMjYzOA==&mid=2247518970&idx=1&sn=de66dcbdf8399b0bc3df50e4db7331d7
大模型与产品创新
OpenAI称AGI时代已开启,AI研究者对此存疑
OpenAI近日宣布AGI时代已经开启,称新模型GPT-6表现达到通用人工智能的判定标准,但这一结论并未获得AI研究界的普遍认可。大量研究者指出,当前通用的AI评测基准已无法有效衡量通用智能的落地,现有测试更多是特定场景下的能力表现,而非真正的通用认知与推理能力。这场争议本质上是AGI定义标准的博弈,也反映出当前AI行业在能力宣传与学术严谨性之间的张力。 来源:https://www.fastcompany.com/91607269/openai-says-the-agi-era-has-begun-ai-researchers-arent-so-sure?utm_source=postup&utm_medium=email&utm_campaign=artificial-intelligence&position=3&partner=newsletter&campaign_date=09152026
GPT-6 Astra正式上线,使用指南发布
OpenAI新一代模型GPT-6 Astra正式向ChatGPT及企业端用户推送,TechRepublic同步发布官方使用指南与费用说明。作为OpenAI宣称开启AGI时代的核心产品,GPT-6 Astra的能力表现是当前行业讨论的焦点,该模型的上线进一步加剧了AI行业对前沿模型能力边界与商业化落地的探索。 来源:https://www.techrepublic.com/article/news-gpt-6-astra-how-to-get-started/
阶跃发布语音大模型StepAudio 3,拿下多个全球第一
阶跃星辰今日正式发布StepAudio 3系列语音大模型,包含Realtime、ASR、TTS、Gen、Music五个子版本,覆盖真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解和音乐创作五大核心场景。其中多款模型在Artificial Analysis榜单中位列全球第一,重点突破了实时语音交互的打断、理解与推理能力,不再局限于“把文字念出来”的单点功能,而是能够参与完整的音频创作与交互流程,标志着语音大模型从单点能力竞争进入全链路能力竞争阶段。 来源:https://mp.weixin.qq.com/s?__biz=MzkyNTYxNzg5Mg==&mid=2247488074&idx=1&sn=7d92ce0f0098ec0c53b243df4709b522
谷歌发布Gemini 3.8 Live及扩展思考版本
谷歌今日正式推出Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking两款实时对话模型,定位为当前最先进的实时对话模型,主打自然流畅的交互体验。两款模型的发布进一步丰富了谷歌Gemini系列的产品矩阵,在实时交互场景下的能力得到针对性优化,有望在语音助手、实时客服等场景中落地应用。 来源:https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/
实时编辑、实时互动视频双旗舰,Vidu S2发布即体验
生数科技今日发布Vidu S2实时视频生成模型,覆盖实时数字人、离线数字人、实时视频编辑三类核心能力。该模型支持边播边改的实时交互:用户可通过摄像头捕捉真人视频流,实时更换人物、画风或背景,同时保留原有动作节奏;还可与虚拟人实时互动,通过自然语言指令触发虚拟人跳舞等才艺动作,大幅降低了实时视频内容的创作门槛,有望推动实时视频交互在直播、短视频、虚拟人客服等场景的普及。 来源:https://mp.weixin.qq.com/s/pPbsRYvQDIKmds7wqDUSew
技术突破与基础设施
在多项高难度Benchmark超越GPT-6 Astra,RSlAgent让开源模型可自主探索新环境
机器之心报道的RSlAgent框架实现了开源模型在不更新参数的前提下,自主探索陌生软件、工具或企业系统的能力。过去Agent进入新环境通常需要收集交互数据重新训练,成本高且不适用于私有场景,而RSlAgent让模型像人类一样通过自主探索理解新环境的因果结构,在多项高难度Benchmark测试中表现超越了GPT-6 Astra。这一突破解决了Agent落地企业场景的核心痛点,大幅降低了Agent适配新环境的成本,为开源模型的工业级应用提供了新的路径。 来源:https://mp.weixin.qq.com/s/bg0tkvHsKTZ88uBNKUdVTQ
AI基础设施公司Cornelis获2.05亿美元融资
2020年从英特尔分拆的AI基础设施公司Cornelis今日宣布完成2.05亿美元融资,由IAG Capital Partners领投。公司核心产品Active Compute Fabric是一种新型网络架构,旨在解决GPU集群中大量时间被浪费在等待数据到达的问题,让芯片能够同时处理与发送信息,提升算力利用率。 Cornelis采用开放架构,支持客户将各类GPU和加速器硬件与自家网络方案搭配使用,正逐步打破英伟达在AI网络领域的主导地位,其新一代产品预计于今年晚些时候发布。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247518095&idx=3&sn=d235bd8872728a72d4d952471d288710
优化Amazon Bedrock提示词缓存以降低成本与延迟
亚马逊云服务AWS近日发布技术指南,详细介绍了Amazon Bedrock的提示词缓存功能。该功能可对重复发送的相同上下文内容进行缓存,将输入token成本最高降低90%,同时减少请求延迟。此前若每次请求都携带1万token的合同等长上下文,搭配50个用户问题会产生50万次全价计费的输入token,缓存功能可避免对已处理内容的重复计费,大幅降低高频调用大模型的场景成本,为企业的AI应用落地提供了更经济的方案。 来源:https://aws.amazon.com/blogs/machine-learning/optimizing-cost-and-latency-with-amazon-bedrock-prompt-caching/
商业与战略动态
黄仁勋最新深度对话录:揭秘AI时代的权力图谱与生存法则
英伟达CEO黄仁勋在最新深度对话中回应了多个行业核心议题:针对AI末日论调他表示无需恐慌,提出“数据中心即国家主权”的观点;谈及AI安全与发展的关系时,他认为不应陷入虚假的“安全-发展”二元对立,应从工程角度务实推进监管;在竞争格局上,他分析了马斯克的xAI、中国AI产业及光刻技术对英伟达的影响,同时披露英伟达的垂直整合策略,业务已覆盖从自动驾驶到生物医药的多个领域。这场对话全面梳理了当前AI产业的权力格局与生存法则,是理解英伟达战略与AI产业生态的重要参考。 来源:https://mp.weixin.qq.com/s?__biz=MzIxODUzNTg2MA==&mid=2247492216&idx=1&sn=639e2f5197ebc45decf39213aade6c66
OpenAI以3亿美元收购手机相机制造商Glass Imaging
OpenAI近日以超过3亿美元的价格收购智能手机相机制造商Glass Imaging,该公司由两位苹果前工程师创立,曾主导开发苹果的人像模式功能。Glass Imaging的核心技术是通过神经网络学习不同智能手机摄像头系统的特性,在按下快门时直接输出优化后的图像,而非拍摄后再用AI修图。此次收购是OpenAI布局硬件与多模态能力的重要一步,有望将其AI成像技术融入未来硬件产品,进一步拓展AI在消费电子领域的落地场景。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247518095&idx=2&sn=02fe520df8521123984a62a942894b97
暂无评论。