今天的主旋律很清楚:agent 不再只是模型能力展示,而是在进入真实组织、真实工作流和真实工程边界。OpenAI 把 Codex 的内部使用讲成跨部门工作方式,Google DeepMind 把 computer use 变成 Gemini 3.5 Flash 的原生工具,Manus 接入 Semrush,François Chollet 则从反面提醒:agentic coding 会逼团队把接口、契约和文档写清楚,因为 agent 读不到团队脑内共享的默契。
另一条线是 AI 产业的权力结构正在显影。Anthropic 选择以劳动力转型联盟的方式进入公共政策叙事,Zack Korman 直接把监管俘获和模型封禁拉到台前,Emad 则把蒸馏、专家样本和中国训练数据供给放在同一张桌子上看。技术信号和制度信号已经缠在一起,这期值得看的不是单个发布,而是这些发布背后正在重新分配的执行权、数据权和解释权。
agentic tools 正在从 demo 进入公司流程、开发接口和业务数据入口,工程组织的契约化程度会被迫提高。
OpenAI 称公司内部各部门正在被 agents 改造,Codex 被用于更复杂、更长周期、更跨职能的工作,并把这种内部使用视为 agentic tools 重塑工作的早期样本。
Greg Brockman 转述 OpenAI 内部 agent 采用速度很快,强调 agents 已经在加速工作,而不只是外部产品宣传。
Chollet 指出 agentic coding 会迫使团队设计干净接口并写好文档,因为 agent 只能读取 API contracts 和 docstrings,读不到工程团队默认共享的隐性模型。
Chollet 进一步把执行成本下降后的价值迁移说清楚:当微观执行变便宜,taste、strategy 和 architectural vision 的价值会上升。
他提醒软件工程师的真正能力不是写聪明代码,而是保护代码库免受不必要的 cleverness 侵蚀,这与 agent 时代的架构判断形成同一条线。
Manus 宣布接入 Semrush,把关键词研究、竞品差距、外链画像、流量情报和自动报告直接接进 prompt 工作流,信号是 agent 正在吞下垂直 SaaS 数据入口。
Google DeepMind 称 Gemini 3.5 Flash 已支持原生 computer use,开发者可以构建能看见并操作 browser、mobile 和 desktop 界面的 custom agents。
Greg Brockman 分享用 DigitalOcean 跑 Codex remote session 的实践入口,说明 agentic coding 的运行环境也在从本地会话走向远程可持续执行。
Google 系列更新把学习、NotebookLM、on-device 和 hybrid inference 串成一条线,个人 AI 使用场景正在从聊天走向长期学习空间。
Gemini 推出 study notebooks,强调可基于课程材料和 quiz 表现生成个性化课程,把 Gemini 变成互动式、适应性学习空间。
Gemini 说明 study notebooks 的使用路径:新建 notebook、选择 Study、设定学习目标、上传课堂材料、先做诊断 quiz,再生成小块互动课程和进度面板。
Gemini 表示 study notebooks 会与 NotebookLM 同步上传来源和历史聊天,用户可以继续围绕课程材料提问,并生成 flashcards、infographics 等学习材料。
Logan Kilpatrick 预告 Gemma 4,关键词是 on-device intelligence,强调把模型能力放到每个人的设备上。
Stanford AI Lab 祝贺 OpenJarvisAI,并把未来 LM inference 概括为 local by default、hybrid by design,和 on-device 模型趋势形成呼应。
从 agentic dataset 到专家样本、蒸馏和神经科学解释,模型竞争正在从参数规模延伸到数据构造和验证机制。
Stanford AI Lab 发布 OpenThoughts-Agent-v2 信号:多数 open agentic datasets 面向单一 benchmark,而该数据集在受控算力比较中覆盖不同训练规模,并能泛化到七个 agentic benchmarks。
Emad 把 distilling Mythos、付费专家生成训练样本,以及中国版数据供应商放在一起比较,认为理解这些差异才能理解 frontier AI 接下来的竞争动态。
Microsoft Research 介绍 generative causal testing:把黑盒模型转译为清晰假设,并在 scanner 中验证,进而识别语言刺激对应的大脑区域响应。
BAIR 转发 Michael I. Jordan 在 Berkeley CDSS 毕业典礼上关于“互联网技术时代的人类连接”的演讲,给技术进展之外的人与社会关系留了一个慢变量入口。
AI 公司、政策联盟、监管争议和公共政治同时出现,说明 frontier AI 的竞争已经不只是模型能力竞争。
Anthropic 宣布成为 RAISE US 创始合作伙伴,该非营利联盟聚焦 employer-led action、AI-enabled training 和政策创新,用来支持美国劳动力向 transformative AI 过渡。
Zack Korman 明确反对帮助 Anthropic 实现 regulatory capture 的政客,并把解除 Fable 禁令的理由描述为让中国实验室能够 distill,表达的是对监管、开放和竞争格局的强烈立场。
Timnit Gebru 评论民主党建制派对 Mamdani 的态度,认为他们像是在把他当成主要反对对象。虽然不是 AI 技术帖,但在关注列表里构成公共政治与权力反应的高互动信号。