Challen · X Following Dispatch No. 20260914

THE FOLLOWING

关注列表·北京时间24小时声音
2026-09-14 ★ 12 条 · 4 个主题 · 52 个账号 ★ COBALT GRID
编辑导言 FROM THE EDITOR

本期关注内容的重心,是围绕前沿 AI 发展节奏的争论。值得拆开看的不是支持还是反对减速,而是各方究竟担心什么:模型执行目标时缺乏常识、能力集中在少数公司手里,还是监管与审计本身不够独立。这些问题不能用同一个安全标签代替,更不能把作者的风险判断当成已经验证的结论。

另一条更具体的线索来自 Agent 工程实践。Peter Steinberger 分享了 Codex 修复 Linux 摄像头故障的经历,以及多会话性能和 worktree 克隆优化。与宏观争论相比,这些案例给建设者留下了可检验的问题:任务有没有真正完成,并行规模上去后是否稳定,隔离工作区的时间和磁盘成本能否降下来。开放模型的能力预期同样值得跟踪,但本期关于任务覆盖率和追平时间的说法都只是作者判断,不是基准测试结果。

覆盖 52/52 个关注账号 · 12 条入选 · 聚为 4 个主题 · 由 AI 实时归纳,仅供参考
§ 第 Ⅰ 章 §
◆

Agent 的工程细账

共 3 条

从设备排障到多会话与工作区克隆,Agent 的实用价值需要由任务结果和运行成本来检验。

Peter Steinberger 🦞 @steipete

分享一次 Linux 排障经历:Dell XPS 的摄像头无法使用,交给 Codex 处理并重启后恢复正常。他据此建议借助 Agent 重新尝试 Linux;这是个人案例,不代表所有系统问题都能靠提示词解决。

♥ 3.4k⇄ 109✎ 250原帖 ↗
Peter Steinberger 🦞 @steipete

表示为适应团队使用,修复了许多单用户时不明显的性能问题;他称 OC 当时承载约 80 个会话仍运行轻松。原帖未提供测试环境或性能测量,适合作为并行规模的实践线索。

♥ 415⇄ 15✎ 57原帖 ↗
Peter Steinberger 🦞 @steipete

预告下一版本或开发通道利用文件系统的目录克隆能力,让 worktree 操作快约 80%,同时节省磁盘空间。这是作者披露的优化效果,不能视为所有环境下的性能保证。

♥ 465⇄ 13✎ 38原帖 ↗
§ 第 Ⅱ 章 §
◆

安全不是单一风险

共 3 条

常识不足、物理行动与长期失控是不同风险,讨论安全需要先说清对象和时间尺度。

François Chollet @fchollet

提出仅适用于近期的判断:更强的模型可能更安全,因为当前模型常把目标理解得过于字面化,或走不合常理的捷径。他将这类失败更多归为智能与常识不足,而非单纯的对齐问题,并以自己对 Astra 和 Sol 的代码库使用感受作例子,明确不把结论外推到长期。

♥ 1.5k⇄ 176✎ 162原帖 ↗
Zack Korman @ZackKorman

反对让 AI 接管与人类灭绝叙事垄断安全讨论:风险有多种,每一种治理方案也都有取舍,没有谁能独占对安全的定义。

♥ 126⇄ 18✎ 21原帖 ↗
Bindu Reddy @bindureddy

认为纯数字 AI 毁灭人类的概率接近零,反而更担心机器人接近大众市场普及时的风险。这是她对数字系统与实体机器人的风险排序,原帖未给出概率估计依据。

♥ 269⇄ 13✎ 91原帖 ↗
§ 第 Ⅲ 章 §
◆

开放模型与权力分散

共 4 条

开放模型既涉及日常任务的供给,也涉及前沿能力是否会被少数机构控制。

François Chollet @fchollet

把极端权力集中列为前沿 AI 最值得担忧的风险之一,主张维持多个相互独立的前沿模型提供者,并确保其中包含开源选项。

♥ 782⇄ 102✎ 41原帖 ↗
Zack Korman @ZackKorman

提出一个对称性要求:如果某种 AI 危险到不能开放权重,也不能因此认定让私人公司独占控制就是安全的。原帖引用对象未展开,这里仅保留其明确表达的原则。

♥ 2.5k⇄ 189✎ 97原帖 ↗
Emad @EMostaque

认为模型已能胜任九成以上任务,开放模型将主导日常 AI 使用;同时提醒群体化运行存在风险,主张从构建之初嵌入价值约束,并把模型作为社会公共资源提供。任务覆盖比例是作者估计,原帖没有附评测口径。

♥ 208⇄ 18✎ 48原帖 ↗
Bindu Reddy @bindureddy

判断开源 AI 仍在加速,正在缩小与前沿模型的差距;她预测若 Anthropic 和 OpenAI 放慢进展,差距可能在 12 月完全消失。这是带有明确前提的预测,不是已发生的能力追平。

♥ 54⇄ 5✎ 12原帖 ↗
§ 第 Ⅳ 章 §
◆

谁来监督前沿实验室

共 2 条

治理争论不仅关乎是否减速,也关乎监管能力与审计独立性是否可信。

@timnitGebru (@dair-community.social/bsky.social) @timnitGebru

质疑由 Stanford 担任 Anthropic 与 OpenAI 独立审计者的可信度,并引用学界与产业关系过于紧密的描述作为理由。这是对利益关联和审计独立性的批评,所引材料未在本期另行核验。

♥ 250⇄ 56✎ 8原帖 ↗
Bindu Reddy @bindureddy

接受 Anthropic 和 OpenAI 自行选择放慢 AI 进展,但反对把政府引入行业监督。她担心技术理解不足叠加政治与腐败风险,认为政府监管超级智能可能带来新的危险;这是其政策立场。

♥ 272⇄ 29✎ 54原帖 ↗
低信号与缺口
第一类,窗口内零发帖:依据审计中 status=ok 且 window_post_count=0 的口径,共 46 个账号,分别为 @Red_Xiao_、@ManusAI、@OfficialLoganK、@AnthropicAI、@tydsh、@hugo_larochelle、@drfeifei、@GeminiApp、@srush_nlp、@soumithchintala、@OriolVinyalsML、@StanfordAILab、@goodfellow_ian、@ShunyuYao12、@NotebookLM、@berkeley_ai、@KrugerSays、@AIatMeta、@wadefoster、@ilyasut、@seb_ruder、@sundarpichai、@kaifulee、@ylecun、@ThomasOrTK、@karpathy、@demishassabis、@lexfridman、@JeffDean、@elicollins、@gdb、@BaiduResearch、@Metamind、@IntelAI、@Tesla_AI、@IBMResearch、@MSFTResearch、@GoogleDeepMind、@GoogleAI、@rowancheung、@ID_AA_Carmack、@Yoshua_Bengio、@geoffreyhinton、@AndrewYNg、@OpenAI、@sama。这里的零发帖分类沿用已有审计,不代表另做过完整性核查;部分账号的 first_page_covers_window_start=false,完整窗口覆盖仍有证据局限。 第二类,有发帖但未选入主报告:无整账号落选。审计中窗口内有发帖的 @steipete、@ZackKorman、@bindureddy、@EMostaque、@timnitGebru、@fchollet 均至少入选一条;其余未选帖子包括转推、简短互动、重复观点及依赖未展开引用或图片的内容,不能把这些账号写成无更新。 第三类,抓取失败:无,52 个账号的 status 均为 ok。 本次主报告仅使用 2026-09-13 08:00 至 2026-09-14 08:00(北京时间)内的关注帖,从已有 35 条 raw 帖中选入 12 条,未纳入转推。buildernews 候选料已阅读,本期未选用,以保持所有主条目均来自关注列表精确窗口;窗口外外部信号不计作关注账号缺失。