Challen · X Following Dispatch No. 20260623

THE FOLLOWING

关注列表·北京时间24小时声音
2026-06-23 ★ 30 条 · 6 个主题 · 52 个账号 ★ COBALT GRID
编辑导言 FROM THE EDITOR

本期的主旋律很清楚:AI 正在从“能生成内容、能写代码”走向“能进入责任链”。OpenAI Daybreak 把安全叙事从漏洞发现推到补丁生成、开源维护和生态合作,Sam Altman 与 Greg Brockman 的转述把这件事从产品发布抬到了基础设施叙事。与之相邻的是 Bengio 提醒的 agent 激励问题:当 AI agent 面向可见奖励行动,安全对齐会不会被工作目标吞掉,这会成为所有自动化系统都绕不开的治理问题。

第二条线是 Agent 和模型策略的分岔。Google 推 Gemini Spark,Logan Kilpatrick 宣布 Interactions API GA,Bindu Reddy 站在多模型编排一侧,Peter Steinberger 则提醒 hidden reasoning context 和 cache 可能在路由中被破坏。开源模型侧,GLM 5.2、Kimi、DeepSeek、Reflection AI 被频繁提到,企业策略的关键词不再是押注某一个最强模型,而是保持 model-agnostic,在成本、能力和供应弹性之间做动态选择。

第三条线更接近 Challen 长期关心的软件与基础设施判断:Chollet 连续反驳“代码生成会让 SaaS 归零”,强调代码不是产品,抽象和问题卸载才是软件价值;Carmack 与 Emad 的帖子则把视角拉回算力和数据中心,AI 的能力扩张最终仍要落到 GPU、CLI、数据保留、地方政治和规模经济这些硬约束上。

覆盖 52/52 个关注账号 · 30 条入选 · 聚为 6 个主题 · 由 AI 实时归纳,仅供参考
§ 第 Ⅰ 章 §
◆

安全从发现漏洞走向自动补丁

共 8 条

OpenAI Daybreak 把 AI 安全的叙事从发现漏洞推进到生成补丁、维护开源项目和生态合作。

OpenAI @OpenAI

OpenAI 扩展 Daybreak,发布 Codex Security plugin、GPT-5.5-Cyber、Cyber Partner Program 和 Patch the Planet,核心目标是以机器速度修补脆弱软件。

♥ 3.6k⇄ 411✎ 235原帖 ↗
OpenAI @OpenAI

Codex Security 被定位为安全团队的现成工作流,可做 deep scans、验证发现、追踪攻击路径、生成 threat models,并产出可审阅补丁。

♥ 574⇄ 22✎ 9原帖 ↗
OpenAI @OpenAI

GPT-5.5-Cyber 面向授权防御工作,强调追踪脆弱代码、验证问题、开发补丁和为人工审查准备证据。

♥ 1.5k⇄ 129✎ 45原帖 ↗
OpenAI @OpenAI

Patch the Planet 聚焦把安全发现推进到合并修复,OpenAI 表示会与 Trail of Bits、HackerOne、Calif、研究者和维护者协作。

♥ 646⇄ 42✎ 28原帖 ↗
OpenAI @OpenAI

Daybreak Cyber Partner Program 让安全软件与服务商在 Trusted Access for Cyber 下使用 GPT-5.5,同时限制直接模型访问。

♥ 295⇄ 14✎ 7原帖 ↗
Sam Altman @sama

Sam Altman 强调与 USG 和安全生态合作,称 GPT-5.5-Cyber 在 CyberGym 上达到 state of the art,并将帮助解决而不只是发现安全问题。

♥ 5.6k⇄ 365✎ 550原帖 ↗
Greg Brockman @gdb

Greg Brockman 补充,OpenAI 模型已在浏览器、网络基础设施、FreeBSD、Linux kernel、cURL、Go、Python、Sigstore、pyca/cryptography 等关键项目上发现并生成补丁。

♥ 1.1k⇄ 61✎ 74原帖 ↗
Yoshua Bengio @Yoshua_Bengio

Yoshua Bengio 转发新论文,指出 AI agents 对可见激励的贪婪可能让它们放弃 safety alignment,为本期安全主线提供了研究侧警示。

♥ 255⇄ 33✎ 5原帖 ↗
§ 第 Ⅱ 章 §
◆

Agent 产品化与多模型编排

共 5 条

从 Interactions API 到 Gemini Spark,平台正在把 Agent 从 demo 推向统一接口和日常工作流。

Logan Kilpatrick @OfficialLoganK

Logan Kilpatrick 宣布 Interactions API GA,称其是跨模型、跨 agents 编排的新默认 API,并为 Agent 时代铺路。

♥ 866⇄ 64✎ 67原帖 ↗
Bindu Reddy @bindureddy

Bindu Reddy 认为 multi-agent orchestration 是未来,组合模型相对强项能得到更好结果,例如 Fable 强代码、Grok 强实时话题。

♥ 126⇄ 5✎ 22原帖 ↗
Peter Steinberger 🦞 @steipete

Peter Steinberger 对 multi-model routing 表示怀疑,认为混用模型可能丢失 hidden reasoning context、破坏 cache,并导致总体结果变差。

♥ 646⇄ 25✎ 49原帖 ↗
Google Gemini @GeminiApp

Google Gemini 发布 Gemini Spark Beta,把它描述为在用户指挥下端到端处理任务的 24/7 personal AI agent。

♥ 1.7k⇄ 98✎ 95原帖 ↗
Google Gemini @GeminiApp

Gemini Spark 给出项目追踪审计、Newsletter 聚合、品牌健康、销售谈判教练、Drive 整理、会议准备等实际工作流样例。

♥ 141⇄ 6✎ 8原帖 ↗
§ 第 Ⅲ 章 §
◆

开源模型追赶与模型无关策略

共 3 条

GLM、Kimi、DeepSeek 等开源或开放模型被纳入企业 AI 策略,成本和灵活性成为核心变量。

Wade Foster @wadefoster

Wade Foster 称 GLM 5.2 在 Zapier AutomationBench 上追平 Claude Opus 4.7 max 的历史顶分,但单任务成本更低,企业最稳妥的 AI 投注是保持 model-agnostic。

♥ 19⇄ 7✎ 6原帖 ↗
Bindu Reddy @bindureddy

Bindu Reddy 预测开源 AGI 会在数周内指数级加速,多个 AI labs 正在围绕 Kimi、GLM 做 fine-tune,DeepSeek 也不会掉队。

♥ 350⇄ 21✎ 44原帖 ↗
Emad @EMostaque

Emad 关注 Reflection AI 首个模型发布时间,并把其算力规模与中国开源公司整体使用量对比,暗示开源阵营竞争会继续被算力投入重塑。

♥ 96⇄ 6✎ 9原帖 ↗
§ 第 Ⅳ 章 §
◆

软件价值重估:代码不是产品

共 5 条

François Chollet 连续反驳“AI 生成代码会让 SaaS 归零”的叙事,核心判断是软件价值在抽象、执行和问题卸载。

François Chollet @fchollet

Chollet 认为市场把 Adobe 当成衰退中的 legacy software 公司是误判,实际数据表明它是 GenAI 崛起的最大受益者之一。

♥ 1.0k⇄ 56✎ 65原帖 ↗
François Chollet @fchollet

他补充说公司不等于股价,公司可以执行出色但股价下跌,反之濒临衰退的公司也可能短期股价上涨。

♥ 284⇄ 9✎ 28原帖 ↗
François Chollet @fchollet

Chollet 用音乐和记谱作类比,指出编程不是代码本身,而是通过抽象层管理复杂性的艺术与科学,AI 只是其中一部分。

♥ 2.8k⇄ 333✎ 110原帖 ↗
François Chollet @fchollet

他批评 SaaS bear 的极端说法,即“Claude 可以 one-shot 应用,所以所有软件价值归零”,认为这极其短视。

♥ 884⇄ 42✎ 98原帖 ↗
François Chollet @fchollet

Chollet 系统展开反驳:Fable 还远没到一键替代软件,代码不是产品;更容易写代码会扩大软件使用面,反而利好优秀 SaaS。

♥ 290⇄ 17✎ 19原帖 ↗
§ 第 Ⅴ 章 §
◆

算力、数据中心与基础设施政治

共 4 条

AI 基础设施正在同时面对 GPU 租用、数据中心选址、地方阻力和经济性争论。

Emad @EMostaque

Emad 寻找可按需租用 B200 的平台,最好提供 CLI,让 agents 能自动拉起算力实例。

♥ 41⇄ 1✎ 28原帖 ↗
John Carmack @ID_AA_Carmack

John Carmack 观察到本地出现反数据中心标语,并考虑投放“Data centers are awesome, Texas should lead”的广告牌。

♥ 2.8k⇄ 114✎ 329原帖 ↗
John Carmack @ID_AA_Carmack

Carmack 质疑小型或分布式数据中心项目的经济性,认为大数据中心有显著规模效率,除非传统建设被禁止,否则低级推理都不划算。

♥ 576⇄ 26✎ 96原帖 ↗
Peter Steinberger 🦞 @steipete

Peter Steinberger 在企业使用语境下提醒,OpenAI 支持 zero retention policy,而 Anthropic 最新模型存在强制 30 天保留差异,数据基础设施也包含隐私与合规边界。

♥ 513⇄ 7✎ 24原帖 ↗
§ 第 Ⅵ 章 §
◆

创作、学习与 AI 可发现性

共 5 条

Google、NotebookLM 与 Manus 的更新显示,AI 工具正在深入创作流程、学习材料和品牌可发现性这些具体场景。

Google DeepMind @GoogleDeepMind

Google DeepMind 宣布与 A24 建立研究合作,希望未来工具由实际使用它们的创作者参与塑形。

♥ 1.2k⇄ 128✎ 65原帖 ↗
Eli Collins @elicollins

Eli Collins 从团队角度转述 A24 合作,强调与 Scott Belsky 及团队一起探索创作者驱动的未来工具。

♥ 408⇄ 40✎ 38原帖 ↗
NotebookLM @NotebookLM

NotebookLM 推出可完全自定义的 Flashcards,用户可以编辑问题、调整答案、添加新卡片,强化学习工具属性。

♥ 528⇄ 56✎ 18原帖 ↗
Manus @ManusAI

Manus 认为 AI search 成为默认入口后,传统 SEO 仍然重要,并需要与 AI discoverability 协同。

♥ 78⇄ 9✎ 4原帖 ↗
Manus @ManusAI

Manus 给出 backlink gap 工作流:找出链接到竞争对手但未链接自己的站点,并按相关性排序机会。

♥ 1⇄ 1✎ 1原帖 ↗
低信号与缺口
第一类「窗口内零发帖」:Red_Xiao_、AnthropicAI、tydsh、hugo_larochelle、drfeifei、srush_nlp、soumithchintala、OriolVinyalsML、StanfordAILab、goodfellow_ian、ShunyuYao12、berkeley_ai、AIatMeta、ilyasut、seb_ruder、sundarpichai、kaifulee、ylecun、ThomasOrTK、karpathy、demishassabis、timnitGebru、lexfridman、JeffDean、BaiduResearch、Metamind、IntelAI、Tesla_AI、IBMResearch、MSFTResearch、GoogleAI、rowancheung、geoffreyhinton、AndrewYNg。这些账号 status 均为 ok,window_post_count 为 0,可视为本窗口内无更新。 第二类「有发帖但未选入主报告」:ZackKorman、KrugerSays。KrugerSays 发了一条关于金钱与创业意义的长帖,但与本期 AI 主线弱相关且互动为零;ZackKorman 只有一条对话回复,语义独立性不足。它们是发了但未入选,不是无更新。 第三类「抓取失败」:无。本次 52 个关注账号全部抓取成功,raw 中 70 条帖子均处于指定北京时间窗口内;主报告优先选入原创、高信号、可形成主题互证的帖子,未把低信号回复和孤立弱相关内容硬凑进 categories。