AI 资讯日报 · 2026-09-09
今日AI领域重磅消息不断,既有OpenAI、字节跳动等头部玩家的技术突破与产品落地,也有Mistral、Cognition等企业创纪录的融资进展,同时中国AI团队在教育、端侧模型等方向取得新突破,以下是今日重点资讯汇总。
今日概览
- OpenAI发布纳维-斯托克斯方程千禧年大奖难题AI解法
- OpenAI发布GPT-6 Astra模型
- OpenAI正式公测ChatGPT Sites自然语言生成网站功能
- OpenAI推出托管Agent服务
- Google TPU推理能力迎来新升级
- Anthropic计划投入5170亿美元布局算力
- 面壁智能开源MiniCPM5-2B端侧模型,4B以下参数综合排名第一
- 三星领投Mistral AI完成30亿欧元融资,估值超210亿欧元
- AI编程公司Cognition完成20亿美元E轮融资,估值达480亿美元
- AI算力调度公司Gimlet Labs完成3亿美元融资,估值达30亿美元
- Google投资130亿欧元建设芬兰AI基础设施
- 张一鸣亲自协调字节跳动开发实时空间视频生成世界模型
- 首个中国教育Agent OpenMAIC亮相联合国教科文组织活动
- DeepSeek开放150个工程岗位,聚焦工程落地与算力优化
- Perplexity基于阿里千问Qwen3.8打造本地Agent
- 《大规模LLM推理技术 deep dive》技术分享上线
大模型与研发
OpenAI发布纳维-斯托克斯方程千禧年大奖难题AI解法
纳维-斯托克斯方程千禧年大奖难题是数学界七大千禧年难题之一,悬赏百万美元求解其光滑解的存在性与唯一性,困扰学界已超20年。OpenAI今日公开了由其AI生成的该难题完整解法,配套包含详细推导过程的说明文档,以及用形式化证明语言Lean编写的严格证明。这是AI首次在顶级纯数学难题上取得突破性进展,不仅验证了大模型在复杂逻辑推理领域的潜力,也为形式化证明与AI结合的研究方向提供了全新样本,有望推动数学研究与AI技术的双向融合。 来源:https://openai.com/index/navier-stokes-solution
OpenAI发布GPT-6 Astra模型
OpenAI最新旗舰模型GPT-6 Astra正式上线,被官方定位为当前能力最强、同时也是争议最大的模型。该模型在3D重建、游戏生成、图纸复原建筑等场景表现突出,支持用户输入自然语言需求或草图,即可快速生成对应3D内容与可运行游戏。有测评者指出,Astra的“操作电脑”能力已超过普通人类,能自主操作各类专业软件完成复杂任务,但其在部分特定编程场景仍会出现错误。该模型的发布再次引发业界对AI能力边界的讨论,同时也为端侧AI应用、虚拟环境构建等领域带来了新的可能性。 来源:https://juejin.cn/post/7682601317680889856
面壁智能开源MiniCPM5-2B端侧模型,4B以下参数综合排名第一
面壁智能联合OpenBMB今日正式开源MiniCPM5-2B端侧大模型,该模型仅包含20亿参数,采用高密度架构设计,支持工具调用、深度搜索、代码生成等任务,可运行于手机、PC、车机、机器人等各类端侧设备,初步具备通用Agent能力。根据Artificial Analysis最新评测,MiniCPM5-2B在4B参数以下开源基座模型中综合排名第一,Agentic Index得分达20分。本次开源同步开放了训练Recipe、数据集、强化学习框架及训练策略,为端侧AI开发者提供了高性价比的基座模型选择,有望推动端侧AI应用的规模化落地。 来源:https://mp.weixin.qq.com/s?__biz=Mzk3NTc1NTU0Mw==&mid=2247512955&idx=1&sn=f0254c373f933ac3b4f72da675762f1c
OpenAI推出托管Agent服务
OpenAI正式推出托管Agent服务,用户无需自行部署与管理Agent基础设施,即可直接使用OpenAI提供的标准化Agent能力完成各类复杂任务,大幅降低了企业使用AI Agent的门槛,有望推动Agent技术的规模化落地。 来源:https://tldr.tech/ai/2026-09-08
Google TPU推理能力迎来新升级
Google今日对其TPU推理能力进行升级,针对大模型推理场景的延迟、成本问题进行了针对性优化,可支持更大上下文窗口模型的高速推理,将进一步提升云端AI服务的响应效率与性价比,利好依赖Google算力的AI开发者与企业。 来源:https://tldr.tech/ai/2026-09-08
Anthropic计划投入5170亿美元布局算力
AI实验室Anthropic今日公布其未来算力扩张规划,预计将投入5170亿美元用于算力基础设施建设与采购,以支撑下一代大模型的训练与推理需求。这一投入规模刷新了AI行业单家企业的算力投资纪录,反映出Anthropic对大模型技术长期迭代的坚定押注,也将进一步加剧全球AI算力资源的竞争态势。 来源:https://tldr.tech/ai/2026-09-08
Perplexity基于阿里千问Qwen3.8打造本地Agent
硅谷AI独角兽Perplexity今日宣布,其最新本地Agent服务将基于阿里巴巴的开源大模型千问Qwen3.8进行构建,无需依赖云端即可实现本地化的知识检索、任务处理与交互能力。这一合作意味着中国开源大模型的技术能力已获得国际头部AI企业的认可,也为全球开发者提供了更多元的大模型选择,有望推动本地化AI Agent的普及与应用场景拓展。 来源:https://mp.weixin.qq.com/s?__biz=MjM5OTAzMjc4MA==&mid=2650889897&idx=3&sn=e24294c47e6363b84df2b9d4efaa5e49
《大规模LLM推理技术 deep dive》技术分享上线
来自Audible的技术专家Harshul Jain与独立AI研究者Tanmay Sah联合推出的大规模LLM推理技术深度分享内容正式上线,内容深入剖析了大模型推理阶段的KV缓存优化、多芯片算力调度等核心技术难点。分享中提到,仅Mistral 7B模型的单个Token KV缓存就占用131KB,在16000Token上下文、80并发用户的场景下,仅缓存就需要42GB显存,该分享为AI工程师优化大模型推理性能提供了极具参考价值的技术思路。 来源:https://www.youtube.com/watch?v=y2W4FNAuPEA
行业融资
三星领投Mistral AI完成30亿欧元融资,估值超210亿欧元
法国AI实验室Mistral AI今日宣布完成30亿欧元(约合35.8亿美元)的Series D轮融资,由三星电子牵头投资,EQT管理的Scaleup Europe Fund与现有投资者PSG Equity联合领投,参投方包括a16z、英伟达、Salesforce Ventures、Advent、BlackRock以及新投资者卢森堡投资机构。本轮融资后Mistral估值超过210亿欧元(约合243.9亿美元),创下欧洲科技公司股权融资规模纪录,估值较一年前上一轮融资的117亿欧元近乎翻倍。Mistral表示,资金将用于扩大算力容量、基础设施建设与国际化布局,进一步巩固其作为欧洲主权AI替代方案的市场定位。 来源:https://theaiinsider.tech/2026/09/08/mistral-ai-secures-e3b-in-record-european-funding-round-positioning-itself-as-sovereign-ai-alternative/
AI编程公司Cognition完成20亿美元E轮融资,估值达480亿美元
AI编程工具厂商Cognition今日宣布按480亿美元估值完成20亿美元E轮融资,由Andreessen Horowitz与Accel继续领投,Founders Fund、General Catalyst、Avenir、Benchmark等知名投资机构参投。这是Cognition四个月内的第二笔大额融资,上轮融资估值仅为260亿美元,估值涨幅近84%。据透露,Cognition今年的年化营收(ARR)已从5月的4.92亿美元增长至9亿美元,客户包括梅赛德斯-奔驰、NASA、高盛、花旗等头部企业。该轮融资再次证明资本对AI编程赛道的长期看好,也反映出Cognition在AI编程领域的商业化进展远超预期。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247517986&idx=2&sn=8c64b3fd024456c8840c772bf0c217ef
AI算力调度公司Gimlet Labs完成3亿美元融资,估值达30亿美元
AI算力调度初创公司Gimlet Labs今日宣布完成3亿美元融资,由Andreessen Horowitz领投,新投资方包括Arm Holdings与微软风险投资基金M12,Sapphire Ventures也参与其中。本轮融资距离Gimlet上次筹集8000万美元仅过去六个月,估值达30亿美元。Gimlet最初专注于开发异构算力调度软件,将AI任务拆分后分发到不同类型的芯片上执行,后续在服务客户的过程中发现多数企业缺乏异构数据中心的搭建能力,因此业务延伸至数据中心搭建与自建数据中心领域,此次融资将用于技术研发与数据中心业务的进一步扩张。 来源:https://mp.weixin.qq.com/s?__biz=MzI4NTgxMDk1NA==&mid=2247517958&idx=3&sn=25cdde74699d20874bf1a50c11712f86
产品与落地
OpenAI正式公测ChatGPT Sites自然语言生成网站功能
OpenAI今日正式开启ChatGPT Sites公测,用户无需任何代码基础,仅需输入自然语言提示或上传设计草图,即可在十余分钟内生成功能完善、交互复杂的专业网站。该功能将网站开发的门槛降至普通用户可触达的水平,有望对传统SaaS建站市场形成冲击,同时为中小商家、个人创作者提供了低成本的数字化解决方案,标志着AI在低代码/无代码开发领域的应用进入新阶段。 来源:https://mp.weixin.qq.com/s/8rHoP7bekjysCvvYeY-M7g
张一鸣亲自协调字节跳动开发实时空间视频生成世界模型
据彭博社报道,字节跳动正在基于Seedance开发实时空间视频生成世界模型,张一鸣亲自协调跨部门团队与算力资源,最快将于10月推出。该模型可生成随用户声音、动作实时变化的虚拟环境,应用场景覆盖直播、短剧、游戏,并将适配Pico头显设备。这是字节首次尝试将视频内容从“被动观看”升级为“可交互的虚拟世界”,若落地成功将重构视频内容消费的形态,同时也标志着字节在AI生成内容领域的布局从2D视频向3D空间体验延伸。 来源:https://mp.weixin.qq.com/s?__biz=MjM5OTgyNTA0MQ==&mid=2650539706&idx=1&sn=a5d82afff407bcc937af3112e256665e
首个中国教育Agent OpenMAIC亮相联合国教科文组织活动
9月8日,清华大学团队研发的教育Agent OpenMAIC在联合国教科文组织总部举办的Digital Learning Week 2026活动中正式亮相,团队用90分钟向全球教师、教育管理者展示了该Agent在课程设计、教案生成、互动教学等场景的应用能力,现场参与者还可通过Agent快速生成自定义课程。这是首个登上联合国舞台的中国教育Agent,标志着中国团队在AI教育领域的落地能力获得国际权威认可,也为全球AI教育应用提供了可复制的“知识组织+课程设计”方法论。 来源:https://www.ifanr.com/1678673?utm_source=rss&utm_medium=rss&utm_campaign=
行业动态
DeepSeek开放150个工程岗位,聚焦工程落地与算力优化
9月7日,DeepSeek Harness团队负责人崔添翼公开了最新招聘信息,团队新开放约150个岗位,全部面向有2-10年工作经验的资深工程师,方向为服务端开发与Agent弹性计算研发,无AI研究员岗位。崔添翼解释称,随着AI系统规模急剧扩张,数据量、算力规模、训练任务量、Agent环境规模、用户请求量等都在快速增长,工程复杂度呈指数级上升,因此团队当前重点招募工程人才以支撑业务落地。这一招聘方向也反映出国内AI行业正从模型研发向工程化落地阶段过渡,对工程人才的需求持续提升。 来源:https://mp.weixin.qq.com/s?__biz=MjM5OTAzMjc4MA==&mid=2650889897&idx=3&sn=e24294c47e6363b84df2b9d4efaa5e49
Google投资130亿欧元建设芬兰AI基础设施
Google今日宣布将投入130亿欧元(约合155亿美元)在芬兰扩建AI基础设施,重点布局算力集群、清洁能源供应与绿色数据中心建设,同时计划创造大量本地就业岗位,支持当地环保项目。芬兰优越的低温气候与清洁能源结构非常适合高能耗数据中心的运营,此次投资将进一步强化Google在欧洲的AI算力布局,为欧洲地区的AI开发者与企业提供更稳定的云端算力支持,同时也助力Google实现其2030年全球运营无碳化的目标。 来源:https://blog.google/innovation-and-ai/infrastructure-and-cloud/global-network/google-ai-commitment-to-finland/
暂无评论。