Challen · X Following Dispatch No. 20260626

THE FOLLOWING

关注列表·北京时间24小时声音
2026-06-26 ★ 20 条 · 4 个主题 · 51 个账号 ★ COBALT GRID
编辑导言 FROM THE EDITOR

今天的主旋律很清楚:agent 不再只是模型能力展示,而是在进入真实组织、真实工作流和真实工程边界。OpenAI 把 Codex 的内部使用讲成跨部门工作方式,Google DeepMind 把 computer use 变成 Gemini 3.5 Flash 的原生工具,Manus 接入 Semrush,François Chollet 则从反面提醒:agentic coding 会逼团队把接口、契约和文档写清楚,因为 agent 读不到团队脑内共享的默契。

另一条线是 AI 产业的权力结构正在显影。Anthropic 选择以劳动力转型联盟的方式进入公共政策叙事,Zack Korman 直接把监管俘获和模型封禁拉到台前,Emad 则把蒸馏、专家样本和中国训练数据供给放在同一张桌子上看。技术信号和制度信号已经缠在一起,这期值得看的不是单个发布,而是这些发布背后正在重新分配的执行权、数据权和解释权。

覆盖 51/52 个关注账号 · 20 条入选 · 聚为 4 个主题 · 由 AI 实时归纳,仅供参考
§ 第 Ⅰ 章 §
◆

Agent 进入真实工作流

共 8 条

agentic tools 正在从 demo 进入公司流程、开发接口和业务数据入口,工程组织的契约化程度会被迫提高。

OpenAI @OpenAI

OpenAI 称公司内部各部门正在被 agents 改造,Codex 被用于更复杂、更长周期、更跨职能的工作,并把这种内部使用视为 agentic tools 重塑工作的早期样本。

♥ 3.4k⇄ 264✎ 274原帖 ↗
Greg Brockman @gdb

Greg Brockman 转述 OpenAI 内部 agent 采用速度很快,强调 agents 已经在加速工作,而不只是外部产品宣传。

♥ 1.1k⇄ 86✎ 94原帖 ↗
François Chollet @fchollet

Chollet 指出 agentic coding 会迫使团队设计干净接口并写好文档,因为 agent 只能读取 API contracts 和 docstrings,读不到工程团队默认共享的隐性模型。

♥ 657⇄ 59✎ 45原帖 ↗
François Chollet @fchollet

Chollet 进一步把执行成本下降后的价值迁移说清楚:当微观执行变便宜,taste、strategy 和 architectural vision 的价值会上升。

♥ 818⇄ 84✎ 66原帖 ↗
François Chollet @fchollet

他提醒软件工程师的真正能力不是写聪明代码,而是保护代码库免受不必要的 cleverness 侵蚀,这与 agent 时代的架构判断形成同一条线。

♥ 435⇄ 32✎ 34原帖 ↗
Manus @ManusAI

Manus 宣布接入 Semrush,把关键词研究、竞品差距、外链画像、流量情报和自动报告直接接进 prompt 工作流,信号是 agent 正在吞下垂直 SaaS 数据入口。

♥ 149⇄ 8✎ 11原帖 ↗
Google DeepMind @GoogleDeepMind

Google DeepMind 称 Gemini 3.5 Flash 已支持原生 computer use,开发者可以构建能看见并操作 browser、mobile 和 desktop 界面的 custom agents。

♥ 450⇄ 47✎ 28原帖 ↗
Greg Brockman @gdb

Greg Brockman 分享用 DigitalOcean 跑 Codex remote session 的实践入口,说明 agentic coding 的运行环境也在从本地会话走向远程可持续执行。

♥ 195⇄ 4✎ 19原帖 ↗
§ 第 Ⅱ 章 §
◆

学习产品与本地智能

共 5 条

Google 系列更新把学习、NotebookLM、on-device 和 hybrid inference 串成一条线,个人 AI 使用场景正在从聊天走向长期学习空间。

Google Gemini @GeminiApp

Gemini 推出 study notebooks,强调可基于课程材料和 quiz 表现生成个性化课程,把 Gemini 变成互动式、适应性学习空间。

♥ 680⇄ 83✎ 41原帖 ↗
Google Gemini @GeminiApp

Gemini 说明 study notebooks 的使用路径:新建 notebook、选择 Study、设定学习目标、上传课堂材料、先做诊断 quiz,再生成小块互动课程和进度面板。

♥ 37⇄ 4✎ 3原帖 ↗
Google Gemini @GeminiApp

Gemini 表示 study notebooks 会与 NotebookLM 同步上传来源和历史聊天,用户可以继续围绕课程材料提问,并生成 flashcards、infographics 等学习材料。

♥ 32⇄ 2✎ 2原帖 ↗
Logan Kilpatrick @OfficialLoganK

Logan Kilpatrick 预告 Gemma 4,关键词是 on-device intelligence,强调把模型能力放到每个人的设备上。

♥ 2.6k⇄ 123✎ 102原帖 ↗
Stanford AI Lab @StanfordAILab

Stanford AI Lab 祝贺 OpenJarvisAI,并把未来 LM inference 概括为 local by default、hybrid by design,和 on-device 模型趋势形成呼应。

♥ 10⇄ 3✎ 0原帖 ↗
§ 第 Ⅲ 章 §
◆

训练数据、评测与解释

共 4 条

从 agentic dataset 到专家样本、蒸馏和神经科学解释,模型竞争正在从参数规模延伸到数据构造和验证机制。

Stanford AI Lab @StanfordAILab

Stanford AI Lab 发布 OpenThoughts-Agent-v2 信号:多数 open agentic datasets 面向单一 benchmark,而该数据集在受控算力比较中覆盖不同训练规模,并能泛化到七个 agentic benchmarks。

♥ 52⇄ 7✎ 5原帖 ↗
Emad @EMostaque

Emad 把 distilling Mythos、付费专家生成训练样本,以及中国版数据供应商放在一起比较,认为理解这些差异才能理解 frontier AI 接下来的竞争动态。

♥ 35⇄ 2✎ 4原帖 ↗
Microsoft Research @MSFTResearch

Microsoft Research 介绍 generative causal testing:把黑盒模型转译为清晰假设,并在 scanner 中验证,进而识别语言刺激对应的大脑区域响应。

♥ 13⇄ 3✎ 0原帖 ↗
Berkeley AI Research @berkeley_ai

BAIR 转发 Michael I. Jordan 在 Berkeley CDSS 毕业典礼上关于“互联网技术时代的人类连接”的演讲,给技术进展之外的人与社会关系留了一个慢变量入口。

♥ 8⇄ 1✎ 2原帖 ↗
§ 第 Ⅳ 章 §
◆

产业权力与公共治理

共 3 条

AI 公司、政策联盟、监管争议和公共政治同时出现,说明 frontier AI 的竞争已经不只是模型能力竞争。

Anthropic @AnthropicAI

Anthropic 宣布成为 RAISE US 创始合作伙伴,该非营利联盟聚焦 employer-led action、AI-enabled training 和政策创新,用来支持美国劳动力向 transformative AI 过渡。

♥ 2.2k⇄ 149✎ 196原帖 ↗
Zack Korman @ZackKorman

Zack Korman 明确反对帮助 Anthropic 实现 regulatory capture 的政客,并把解除 Fable 禁令的理由描述为让中国实验室能够 distill,表达的是对监管、开放和竞争格局的强烈立场。

♥ 246⇄ 13✎ 29原帖 ↗
@timnitGebru (@dair-community.social/bsky.social) @timnitGebru

Timnit Gebru 评论民主党建制派对 Mamdani 的态度,认为他们像是在把他当成主要反对对象。虽然不是 AI 技术帖,但在关注列表里构成公共政治与权力反应的高互动信号。

♥ 2.2k⇄ 216✎ 63原帖 ↗
低信号与缺口
窗口内零发帖的账号:steipete、Red_Xiao_、tydsh、hugo_larochelle、drfeifei、soumithchintala、OriolVinyalsML、goodfellow_ian、ShunyuYao12、NotebookLM、AIatMeta、wadefoster、ilyasut、seb_ruder、sundarpichai、kaifulee、ThomasOrTK、karpathy、demishassabis、lexfridman、JeffDean、elicollins、BaiduResearch、Metamind、IntelAI、Tesla_AI、IBMResearch、GoogleAI、rowancheung、ID_AA_Carmack、Yoshua_Bengio、geoffreyhinton、AndrewYNg、sama。 有发帖但未选入主报告的账号:ylecun 发了 1 条回复,内容是对 JEPA 的简短回应,信号较窄;KrugerSays 发了 1 条 B2B nearshore sales 案例,和本期 AI/agent 主线关系较弱;bindureddy 发了 1 条 frontier model 发布时间传闻,信息未经展开且更偏市场传闻,因此未纳入主报告。ZackKorman 另有 2 条回复未选入,GeminiApp 的多条同主题说明已作为产品线程处理。 抓取失败的账号:srush_nlp。 本次窗口 raw 帖 25 条,低于审计里的动态阈值提示,属于低信号日;主报告只保留能与本期主题形成互证的确定帖子,没有用低互动回复或零散传闻硬凑主题。