OpenAI 宣布分享 Navier-Stokes 千年难题的一个解答,称证明由一组 Agent 使用显著强于 GPT-6 Astra 的下一代模型生成。问题涉及三维光滑流体运动是否会出现失去光滑性的情形;本条记录其解答声明,不代表证明已获独立确认。
X 日报个人阅读
2026 年 9 月 9 日 · 周三
2026-09-08 08:00 至 2026-09-09 08:00(北京时间)
关注账号覆盖
条入选
个主题
晨间播报
开车或走路时直接听;会记住播放速度和上次听到的位置。下载 MP3
编辑导言
本期最强的信号,也是最需要放慢判断的信号,来自 OpenAI 对 Navier-Stokes 千年难题的解答声明。约一万个 Agent、88 小时、解析证明与 Lean 形式化,这些是发布方给出的关键细节;但证明是否成立、数学贡献如何评价、与其他研究者工作的关系,不能靠转发量裁定。本报把能力声明与引用、数据使用和发布协调争议分开呈现。这里只依据现有帖文编稿,没有核验论文或证明。
另一条更具体的路线,是把模型能力变成可供人使用的资源和工具。AlphaGenome Atlas 将 DNA 变异影响预测放进浏览器可检索的数据库;ChatGPT Images 2.5 把多轮编辑一致性、草图输入和模板推到台前;Muse、Gemini 的桌面入口及 Google 与 Accenture 的合作,则分别指向个人上下文、屏幕协作和企业交付。
对日常使用 AI Coding 的人,值得保留的是发布热度之外的反差:Astra 已扩大可用范围,但有人用它重做网站后给出好评,也有人反馈完整构建仍需额外追问和复查。前沿解题能力与日常工作流可靠性,是两张不同的成绩单。
01万名 Agent 的数学声明
OpenAI 公布解题过程与证明形式,但发布方声明不等于数学界已完成独立审查。
OpenAI 补充称,内部模型组动用了约一万个协作 Agent,用 88 小时得到解答;模型仍在训练,并在多项基准上实现跃升。团队表示全过程采用了前沿评估中的监控和隔离措施。
团队称已产出解析证明及 Lean 形式化,结论是 Navier-Stokes 动力学下的流体可在有限时间形成奇点。帖文用不断向内旋转、拉长的涡旋解释其构造;这里未对证明和形式化内容作核验。
02证明之外的学术问责
数据来源、引用与发布协调必须分别审视,不能用解题宣传替代学术责任的说明。
OpenAI 向 Levent Alpöge 和 Tristan Buckmaster 致意,并称研究人员及 Agent 在两人公开成果前未见过其工作,也未为解题访问特定用户数据。同时保留一项限定:无法排除来自两人产品使用的去标识化数据曾帮助改进模型。公司称双方证明差异显著,Euler 情形的结论还涉及有外力与无外力之别。
Altman 从 OpenAI 一方叙述发布协调过程:起初以为另一团队也解决了同一问题,曾希望联合发布;后判断对方解决的是 Euler 而非 Navier-Stokes,提出让对方先发及署名安排。他否认抄袭指控,并承认尝试解题受到网上有关 Anthropic 模型的传闻启发。这是当事方陈述,不能作为争议已解决的依据。
Chollet 表示,候选证明究竟富有数学洞见还是偏机械推演,应等待数学家的评价;他明确承认自己目前不知道。这条回应把判断权留给专业审查,而非先随发布热度定性。
Gebru 表示需要时间消化事件,关注关键参考文献是否遗漏、相似工作是否被不当使用等指控,并提醒宣传版本可能与事后分析不同。帖文表达的是待查疑点与谨慎立场,不是对相关指控的事实认定。
Emad 借 Perelman 的态度强调,解决千年难题后最重要的是公开证明,正确的证明本身比额外认可更重要。它为这轮围绕突破与声誉的争论提供了一个评价标准,而非新增的证明证据。
03基因预测成为可查资源
AlphaGenome Atlas 的价值不仅在预测规模,还在于把变异影响及机制线索交给研究者检索。
Google DeepMind 发布 AlphaGenome Atlas,称这一 AI 驱动的可搜索数据库覆盖全部 90 亿种可能的单字母 DNA 变化的预测影响。这里的影响是模型预测,不应等同于逐项实验确认。
DeepMind 称 Atlas 数据集达 1 PB,规模超过 AlphaFold Database 的 30 倍。其界面将相互关联的资源整合起来,帮助研究者把遗传变异与可能受影响的分子机制联系起来。
Atlas 引入 AlphaGenome Variant Impact(AVI)评分,结合 AlphaGenome、AlphaMissense 及其他特征,对突变影响进行排序,并提供基因调控开关、RNA 剪接指令等可能受损机制的线索。
Pichai 强调 AlphaGenome Atlas 的使用门槛:普通浏览器即可访问,无需编程,并向学术研究者免费提供。相较模型发布,这条补充说明了研究者如何实际使用它。
04图像生成走向连续编辑
速度之外,多轮细节一致性和局部表达方式更直接决定图像工具能否进入实际创作。
OpenAI 发布 ChatGPT Images 2.5,主打更快生成、更高保真度、多轮编辑中的细节一致性,以及通过评论只修改指定内容。发布重点从单张图效果延伸到持续修改的可控性。
ChatGPT 新增 Sketch 入口,用户输入“@ Sketch”后可直接画出想法,用草图补充难以用文字准确描述的视觉需求。
OpenAI 介绍图像模板功能:从海报、周边商品等常见格式起步,再加入文案、设计元素或风格,减少从空白开始构思的成本。
Manus 推介 GPT-Image-2.5,并在帖中称其评估里的 Flare 生成高质量图像的速度达到 GPT-Image-2 的两到四倍,透明背景生成也有改善,适合品牌素材、演示文稿及网站创作。速度数字来自 Manus 自述,帖文未提供完整评测条件。
05Agent 进入个人与企业现场
个人记忆、桌面上下文、会话沙箱和现场工程团队,分别回答 Agent 如何安全且有效地做事。
Meta 推出个人 Agent Muse,由 Muse Spark 1.3 驱动,定位是替用户执行任务,并发布介绍其构建方式及能力的材料。原帖没有展开具体任务范围,不据此扩写功能清单。
Meta 另文讨论 Muse 的安全设计:长期了解用户的 Agent 必然持有大量个人上下文,这既是实用性的来源,也是安全与隐私设计的理由。帖文提供设计说明入口,但不构成独立安全验证。
Gemini 宣布 macOS 应用中的 Gemini 3.5 Transcribe 可结合语音与屏幕上下文,支持本地文件摘要、规划、研究和图像创作,让自然语言入口更贴近日常桌面任务。
Google 扩大与 Accenture 的合作,成立 Accenture Gemini Enterprise Business Group,由一千人的 forward deployed engineer 队伍支持,提供专用加速方案与行业解决方案,帮助企业扩大 Gemini Enterprise 和 agentic AI 的实际应用。
Steinberger 在关于 Docker 与 OpenClaw 的讨论中澄清,其倡导的是由 OpenClaw 管理会话沙箱,并认为 Docker Sandbox 适合这一层。虽是回复式内容,但给出了具体的沙箱管理边界。
06Astra 上线后的两种体验
扩大可用范围只是起点,完整构建与额外复查成本仍需用自己的任务衡量。
OpenAI 表示,Astra 已在 Codex 和 ChatGPT Work 中向 Plus、Pro、Business、Enterprise 用户全面推出,并提供现场演示入口。
Reddy 的个人体验偏负面:她认为 Astra 不如 Fable 5.1 善于预见后续问题,完整构建仍不可靠,需要增加对话轮次并重复检查结果。这是使用反馈,而非受控基准测试。
Korman 表示正在用 Astra 重做个人网站,并给出积极评价。原帖没有说明构建流程或验收结果,因此保留为具体场景下的正面体验,不外推为全面能力结论。
低信号与抓取缺口
第一类:窗口内零发帖。依据审计中 status=ok 且 window_post_count=0,以下 31 个账号在本次审计口径下窗口内无更新:@Red_Xiao_、@OfficialLoganK、@AnthropicAI、@tydsh、@hugo_larochelle、@soumithchintala、@OriolVinyalsML、@StanfordAILab、@goodfellow_ian、@ShunyuYao12、@NotebookLM、@berkeley_ai、@KrugerSays、@wadefoster、@ilyasut、@seb_ruder、@kaifulee、@ylecun、@karpathy、@lexfridman、@JeffDean、@elicollins、@BaiduResearch、@Metamind、@IntelAI、@Tesla_AI、@IBMResearch、@rowancheung、@ID_AA_Carmack、@geoffreyhinton、@AndrewYNg。 第二类:有发帖但未选入主报告。以下 7 个账号发了但未入选,不能视为无更新:@drfeifei(1 条,仅简短表示 Atlas 实时运行,缺少可辨认的具体上下文);@srush_nlp(1 条,征集 ML Discord 社群建议);@demishassabis(1 条,AlphaGenome Atlas 的覆盖范围及学术免费信息已由同主题条目呈现);@gdb(6 条,主要是已收录发布的再介绍、演示引介和团队感想,新增可摘要信息有限);@MSFTResearch(1 条,本科研究实习招聘);@GoogleAI(1 条,仅有短链接,没有可摘要的正文);@Yoshua_Bengio(2 条,同一活动预告的英法文版本,未展开研究进展)。其余 14 个有发帖账号各有内容入选。 第三类:抓取失败。无,52 个账号的 status 均为 ok。 本次主报告仅收录北京时间 2026-09-08 08:00 至 2026-09-09 08:00 内的关注帖,从现有 62 条 raw 帖中选入 24 条;未重新抓取,也未修改 raw/audit。审计中的 selected_post_count=0 是上游抓取阶段记录,成报条数以本文件 meta.post_count 为准。零发帖分类遵循给定审计,并不额外声称分页覆盖已经复核;多数账号的 first_page_covers_window_start 为 false。buildernews 候选料已阅读,本期未选入,不参与关注账号统计。仅有短链接、缺失引用上下文、重复宣传和推测性强但缺少依据的帖子不补写内容;数学成果与争议均按发帖方陈述呈现。