这一期的主旋律不是单点发布,而是 AI 进入经营层面的日常化:Codex 在做额度和邀请机制,开发者在讨论 appshots、成本效率和小模型分工,Manus 把教育机构的运营杠杆讲成了一个可复制样本。AI 不再只是模型能力榜上的新闻,它正在变成工作流、组织效率和产品体验里的具体零件。
另一条线是权力和资本的重新分配。Kimi、Gemini、GPT 的成本叙事继续拉扯,SpaceX、OpenAI、Anthropic、Cursor 被放进同一个估值想象里;与此同时,Zack Korman 和 Yoshua Bengio 都在提醒:真正值得担心的不是敌人有没有强 AI,而是谁控制访问权、欧洲有没有自主路径、安全能不能成为主权能力的一部分。
低层技术也有声音:GPU kernel 自动优化、机器人加速器、生物神经元能力、恶意样本逆向,都在说明前沿并没有只停留在聊天产品。今天的窗口像一张横截面:上层是资本与平台权力,中层是 agent 和开发工具,下层是算力、机器人、安全与科学问题。
Codex 相关机制、开发者工具和交互方式开始从模型能力转向日常开发体验。
OpenAI 推出 Codex rate limit reset 的 banked reset 机制,用户可以把额度重置留到更需要的时候使用,首批覆盖 Go、Plus、Pro 和 Business 用户。
Greg Brockman 跟进 Codex 邀请活动:未来两周邀请朋友试用 Codex,可以获得额外 banked reset。
Peter Steinberger 发现 appshots 后感叹,自己之前还在把截图拖进 Codex Live,说明视觉上下文正在成为 AI coding 的高频输入方式。
Greg Brockman 称赞一种网站导航方式更强、更酷,让网页感觉更互动、更直觉化,指向 AI 时代浏览与操作界面的体验变化。
Peter 贴出用 codex 指定项目目录和 gpt-5.5-cyber 模型的命令截图,展示 Codex 已经嵌入具体项目和模型选择的日常工作流。
Gemini、Kimi、GPT 的讨论重点集中到发布节奏、开源能力和单位成本。
Bindu Reddy 认为 Gemini 3.5 六月将发布,但市场声量不足;她判断 Google 内部使用反馈积极,并可能成为最便宜的 SOTA 模型。
Google AI 汇总本周发布:Gemini 3.5 Live Translate、NotebookLM agentic 能力升级、更强推理和多种输出格式,以及 Project Genie 相关进展。
Bindu Reddy 称 Kimi 2.7 将冲击开源排行榜,声称能力接近 Opus 4.8 和 GPT 5.5,同时价格比 SOTA 模型低 20 倍。
她进一步把 Kimi 2.7 Code 定位为高性价比开源 coding model:约有 Claude Fable 和 GPT 5.5 任务准确率的 80%,成本低 12 倍,适合简单 coding 任务。
Peter 认为 GPT 在相近结果下有 10 到 20 倍 token 和成本效率,这个维度被低估,但未来会更重要。
机器人、GPU kernel、生物神经元和自动研究提示,AI 前沿仍在底层能力上推进。
Yuandong Tian 介绍团队在 GPU kernel optimization 上取得 NV SOL-ExecBench 总体 SOTA,并在 4 个子类全部领先,超过人类专家设计和其他 AI 系统生成方案。
Google DeepMind 启动 Robotics Accelerator,选择 15 家欧洲 startup,提供 AI stack、Gemini Robotics models 和团队支持,推进 physical AI。
Emad 用 Unitree 去年只出货 5500 台作对比,判断机器人市场会扩大数千倍,甚至可能超过整个人类劳动力市场。
Jeff Dean 推荐关于真实生物神经元能力的线程,强调它们比经典 perceptron 里的人工神经元更复杂、更强。
Yuandong Tian 指向队友对首批自动研究结果的详细解释,和前面 kernel optimization、autoresearch 线索形成呼应。
从 AI 集中控制、欧洲主权到 agent sandbox 和恶意样本识别,安全问题变成平台问题。
Zack Korman 认为与其担心敌人拿到超级黑客 AI,不如假设他们已经拥有并据此规划;他更担心 AI 被少数万亿美元公司控制访问权和用途。
Yoshua Bengio 讨论欧洲在 AI 竞赛中的风险,认为中等力量主权受威胁可能带来不安全结果,欧洲需要投资能跨越前沿或提供安全可靠组件的 AI initiative。
Bengio 补充说,建立安全的 frontier alternative 对欧洲自主性很关键,并指向他在 FT 的相关文章。
Zack 预告 ContinuumCon workshop,主题是 escaping AI agent sandboxes,并调侃自己的产品会对这些研究行为报警。
Microsoft Research 介绍 Project Ire 对一个及时 malware sample 做逆向分析,识别出 LOTUSLITE 特征,而多数主流 EDR 工具未能检测。
AI agents 被放进教育机构运营,管理话题则回到同理心与标准如何同时成立。
Manus 讲述 Heicoders Academy 用不到 20 名员工每年教 12000 名学生,而竞争对手需要 200 多人,核心是用 AI agents 自动化运营。
Manus 引用 Yu Ning 的说法:没有 AI agents 不可能做到这种规模,因为他们把一切都尽可能自动化,让核心团队回到课程质量和战略合作。
Manus 总结 Heicoders 的第二个赌注:小团队只要工具合适,就能在运营上超过十倍规模的公司。
Alex Kruger 用一次绩效沟通说明:同理心不是降低标准,坦诚也不是忽略人的处境,真正的管理能力是把两者放在同一句话里。
Logan Kilpatrick 用一句话提醒公司失败的常见原因:忘了创造真正好的产品。
SpaceX、OpenAI、Anthropic、Cursor 被放进同一张未来资产叙事里。
Karpathy 表达对 SpaceX 过去、现在和未来故事的震撼,称可以从十多个角度反复思考并持续被刷新认知。
Bindu Reddy 把 SpaceX 称为 AI 黄金时代的启动器,并把 Twitter 收购重新解释为一个 AI-native stock 叙事里的关键动作。
Emad 认为如果觉得 AI 估值已经疯狂,那要等 SpaceX、OpenAI、Anthropic 都具备流动性后再看;他希望这些财富能投向疯狂但有影响力的想法。
Emad 调侃 SpaceX 可能用其市值的 2.5% 以 15 倍收入收购 Cursor,把航天巨头、AI coding 工具和高估值并到同一个想象里。