X 日报个人阅读

2026 年 6 月 26 日 · 周五

2026-06-25 08:00 至 2026-06-26 08:00(北京时间)

51/52

关注账号覆盖

20

条入选

4

个主题

晨间播报

开车或走路时直接听;会记住播放速度和上次听到的位置。下载 MP3

编辑导言

今天的主旋律很清楚:agent 不再只是模型能力展示,而是在进入真实组织、真实工作流和真实工程边界。OpenAI 把 Codex 的内部使用讲成跨部门工作方式,Google DeepMind 把 computer use 变成 Gemini 3.5 Flash 的原生工具,Manus 接入 Semrush,François Chollet 则从反面提醒:agentic coding 会逼团队把接口、契约和文档写清楚,因为 agent 读不到团队脑内共享的默契。

另一条线是 AI 产业的权力结构正在显影。Anthropic 选择以劳动力转型联盟的方式进入公共政策叙事,Zack Korman 直接把监管俘获和模型封禁拉到台前,Emad 则把蒸馏、专家样本和中国训练数据供给放在同一张桌子上看。技术信号和制度信号已经缠在一起,这期值得看的不是单个发布,而是这些发布背后正在重新分配的执行权、数据权和解释权。

01Agent 进入真实工作流

agentic tools 正在从 demo 进入公司流程、开发接口和业务数据入口,工程组织的契约化程度会被迫提高。

OpenAI@OpenAI

OpenAI 称公司内部各部门正在被 agents 改造,Codex 被用于更复杂、更长周期、更跨职能的工作,并把这种内部使用视为 agentic tools 重塑工作的早期样本。

赞 3.4k转 264评 274原帖 ↗
Greg Brockman@gdb

Greg Brockman 转述 OpenAI 内部 agent 采用速度很快,强调 agents 已经在加速工作,而不只是外部产品宣传。

赞 1.1k转 86评 94原帖 ↗
François Chollet@fchollet

Chollet 指出 agentic coding 会迫使团队设计干净接口并写好文档,因为 agent 只能读取 API contracts 和 docstrings,读不到工程团队默认共享的隐性模型。

赞 657转 59评 45原帖 ↗
François Chollet@fchollet

Chollet 进一步把执行成本下降后的价值迁移说清楚:当微观执行变便宜,taste、strategy 和 architectural vision 的价值会上升。

赞 818转 84评 66原帖 ↗
François Chollet@fchollet

他提醒软件工程师的真正能力不是写聪明代码,而是保护代码库免受不必要的 cleverness 侵蚀,这与 agent 时代的架构判断形成同一条线。

赞 435转 32评 34原帖 ↗
Manus@ManusAI

Manus 宣布接入 Semrush,把关键词研究、竞品差距、外链画像、流量情报和自动报告直接接进 prompt 工作流,信号是 agent 正在吞下垂直 SaaS 数据入口。

赞 149转 8评 11原帖 ↗
Google DeepMind@GoogleDeepMind

Google DeepMind 称 Gemini 3.5 Flash 已支持原生 computer use,开发者可以构建能看见并操作 browser、mobile 和 desktop 界面的 custom agents。

赞 450转 47评 28原帖 ↗
Greg Brockman@gdb

Greg Brockman 分享用 DigitalOcean 跑 Codex remote session 的实践入口,说明 agentic coding 的运行环境也在从本地会话走向远程可持续执行。

赞 195转 4评 19原帖 ↗

02学习产品与本地智能

Google 系列更新把学习、NotebookLM、on-device 和 hybrid inference 串成一条线,个人 AI 使用场景正在从聊天走向长期学习空间。

Google Gemini@GeminiApp

Gemini 推出 study notebooks,强调可基于课程材料和 quiz 表现生成个性化课程,把 Gemini 变成互动式、适应性学习空间。

赞 680转 83评 41原帖 ↗
Google Gemini@GeminiApp

Gemini 说明 study notebooks 的使用路径:新建 notebook、选择 Study、设定学习目标、上传课堂材料、先做诊断 quiz,再生成小块互动课程和进度面板。

赞 37转 4评 3原帖 ↗
Google Gemini@GeminiApp

Gemini 表示 study notebooks 会与 NotebookLM 同步上传来源和历史聊天,用户可以继续围绕课程材料提问,并生成 flashcards、infographics 等学习材料。

赞 32转 2评 2原帖 ↗
Logan Kilpatrick@OfficialLoganK

Logan Kilpatrick 预告 Gemma 4,关键词是 on-device intelligence,强调把模型能力放到每个人的设备上。

赞 2.6k转 123评 102原帖 ↗
Stanford AI Lab@StanfordAILab

Stanford AI Lab 祝贺 OpenJarvisAI,并把未来 LM inference 概括为 local by default、hybrid by design,和 on-device 模型趋势形成呼应。

赞 10转 3评 0原帖 ↗

03训练数据、评测与解释

从 agentic dataset 到专家样本、蒸馏和神经科学解释,模型竞争正在从参数规模延伸到数据构造和验证机制。

Stanford AI Lab@StanfordAILab

Stanford AI Lab 发布 OpenThoughts-Agent-v2 信号:多数 open agentic datasets 面向单一 benchmark,而该数据集在受控算力比较中覆盖不同训练规模,并能泛化到七个 agentic benchmarks。

赞 52转 7评 5原帖 ↗
Emad@EMostaque

Emad 把 distilling Mythos、付费专家生成训练样本,以及中国版数据供应商放在一起比较,认为理解这些差异才能理解 frontier AI 接下来的竞争动态。

赞 35转 2评 4原帖 ↗
Microsoft Research@MSFTResearch

Microsoft Research 介绍 generative causal testing:把黑盒模型转译为清晰假设,并在 scanner 中验证,进而识别语言刺激对应的大脑区域响应。

赞 13转 3评 0原帖 ↗
Berkeley AI Research@berkeley_ai

BAIR 转发 Michael I. Jordan 在 Berkeley CDSS 毕业典礼上关于“互联网技术时代的人类连接”的演讲,给技术进展之外的人与社会关系留了一个慢变量入口。

赞 8转 1评 2原帖 ↗

04产业权力与公共治理

AI 公司、政策联盟、监管争议和公共政治同时出现,说明 frontier AI 的竞争已经不只是模型能力竞争。

Anthropic@AnthropicAI

Anthropic 宣布成为 RAISE US 创始合作伙伴,该非营利联盟聚焦 employer-led action、AI-enabled training 和政策创新,用来支持美国劳动力向 transformative AI 过渡。

赞 2.2k转 149评 196原帖 ↗
Zack Korman@ZackKorman

Zack Korman 明确反对帮助 Anthropic 实现 regulatory capture 的政客,并把解除 Fable 禁令的理由描述为让中国实验室能够 distill,表达的是对监管、开放和竞争格局的强烈立场。

赞 246转 13评 29原帖 ↗
@timnitGebru (@dair-community.social/bsky.social)@timnitGebru

Timnit Gebru 评论民主党建制派对 Mamdani 的态度,认为他们像是在把他当成主要反对对象。虽然不是 AI 技术帖,但在关注列表里构成公共政治与权力反应的高互动信号。

赞 2.2k转 216评 63原帖 ↗
低信号与抓取缺口

窗口内零发帖的账号:steipete、Red_Xiao_、tydsh、hugo_larochelle、drfeifei、soumithchintala、OriolVinyalsML、goodfellow_ian、ShunyuYao12、NotebookLM、AIatMeta、wadefoster、ilyasut、seb_ruder、sundarpichai、kaifulee、ThomasOrTK、karpathy、demishassabis、lexfridman、JeffDean、elicollins、BaiduResearch、Metamind、IntelAI、Tesla_AI、IBMResearch、GoogleAI、rowancheung、ID_AA_Carmack、Yoshua_Bengio、geoffreyhinton、AndrewYNg、sama。 有发帖但未选入主报告的账号:ylecun 发了 1 条回复,内容是对 JEPA 的简短回应,信号较窄;KrugerSays 发了 1 条 B2B nearshore sales 案例,和本期 AI/agent 主线关系较弱;bindureddy 发了 1 条 frontier model 发布时间传闻,信息未经展开且更偏市场传闻,因此未纳入主报告。ZackKorman 另有 2 条回复未选入,GeminiApp 的多条同主题说明已作为产品线程处理。 抓取失败的账号:srush_nlp。 本次窗口 raw 帖 25 条,低于审计里的动态阈值提示,属于低信号日;主报告只保留能与本期主题形成互证的确定帖子,没有用低互动回复或零散传闻硬凑主题。