Challen · X Following Dispatch No. 20260927

THE FOLLOWING

关注列表·北京时间24小时声音
2026-09-27 ★ 8 条 · 3 个主题 · 52 个账号 ★ COBALT GRID
编辑导言 FROM THE EDITOR

本期最值得展开的不是模型又被喊成了 AGI,而是使用规模上来之后,哪些旧假设开始失效。Peter Steinberger 发现,原来够用的 SQLite 同步访问,在单个 Agent 并行运行 50 个会话、团队共同使用时成了限制;他借助 Astra 推进异步重构的经历,比一句能力赞叹更能说明工程现场正在发生什么。另一边,Bindu Reddy 把模型选择落到了反复改提示词的时间和账单上:榜单表现与实际使用体验,仍需分开判断。

安全讨论也需要把证据层次拆开。Jeff Dean 分享的是 Waymo 严重伤害事故率的里程统计,Zack Korman 表达的是对网络安全隔离能力的信心,Timnit Gebru 质疑的则是 AI 生存风险叙事如何获得公共话语权。它们不是同一种证据,不能相互替代。本期保留这些差别,不把个人体验写成模型定论,也不把立场表达写成已经证实的事件。

覆盖 52/52 个关注账号 · 8 条入选 · 聚为 3 个主题 · 由 AI 实时归纳,仅供参考
§ 第 Ⅰ 章 §
◆

Agent 并发与部署

共 2 条

从单人助手走向团队并行使用,数据库访问方式和运行位置都需要重新评估。

Peter Steinberger 🦞 @steipete

Steinberger 复盘 OC 迁移到 SQLite 时采用同步数据库访问的设计失误:原先只向 Slack 或 iMessage 汇报时尚可,如今一个 Agent 可能并行跑 50 个会话,团队也共同使用,限制开始显现。他称,通过 Astra 的 /goal 已落地 575 个 PR,将系统逐步迁往 async workers,并边改边发布。

♥ 2.0k⇄ 71✎ 150原帖 ↗
Peter Steinberger 🦞 @steipete

在一则部署讨论的回复中,Steinberger 建议不必专门准备一台 Mini:可以把服务放在 VPS 上,通过 Tailscale 连接自己的电脑,再让它执行 computer use。这提供了一种将远端运行与本机操作分开的部署思路。

♥ 340⇄ 5✎ 28原帖 ↗
§ 第 Ⅱ 章 §
◆

模型选择算总账

共 3 条

模型是否值得用,除了 benchmark,还取决于提示词迭代、人力时间和实际账单。

Bindu Reddy @bindureddy

Reddy 分享个人试用反馈:Opus 5.5 相比 Fable 需要更多轮提示词调整,最终账单约为使用 Fable 时的两倍,还占用了额外时间,因此决定回到 Fable 5.1。原帖未提供任务样本或受控测试,这是一则个人工作流中的成本体验。

♥ 226⇄ 7✎ 57原帖 ↗
Bindu Reddy @bindureddy

Reddy 质疑 DeepSeek 最新 Flash 模型的 benchmark 表现与日常使用体验存在落差,并不认同其达到 Fable、Astra 水平的说法。原帖没有给出具体失败案例或评测数据,应视为待验证的使用者意见,而非性能排名结论。

♥ 210⇄ 2✎ 33原帖 ↗
Bindu Reddy @bindureddy

Reddy 对 OpenAI Dev Day 的愿望是将 Astra 价格降低 50%,并发布 Astra 6.5。这里表达的是开发者对价格与能力升级的期待,不是已经宣布的降价或发布消息。

♥ 423⇄ 13✎ 43原帖 ↗
§ 第 Ⅲ 章 §
◆

安全论证的证据层次

共 3 条

事故统计、隔离能力判断与公共叙事批评各有边界,讨论 AI 安全不能混用这些依据。

Jeff Dean @JeffDean

Dean 分享 Waymo 严重伤害事故率与人类驾驶的比较:据他引用的最新数据,累计 2.7 亿英里对应约 20 倍的安全优势;2026 年 3 月的 1.7 亿英里数据对应约 13 倍,更早约为 10 倍。原帖没有展开统计方法、道路条件或人类驾驶基准,不能据此外推所有驾驶场景。

♥ 1.5k⇄ 99✎ 51原帖 ↗
Zack Korman @ZackKorman

Korman 呼吁更多网络安全专家公开说明现有防护的价值。他认为,即使 AI 很擅长发现 zero-day 漏洞,也仍然能够被限制在安全边界内。这是关于可控性的立场判断,原帖未提供具体隔离方案或验证结果。

♥ 566⇄ 88✎ 56原帖 ↗
@timnitGebru (@dair-community.social/bsky.social) @timnitGebru

Gebru 批评 Bernie Sanders 对部分 AI 生存风险倡导者的专家背书,并质疑这类叙事在主流媒体和联合国等公共场域的影响力。她认为这些风险说法具有虚构性;这是作者的批评立场,所附阅读材料未在本期独立核验。

♥ 193⇄ 56✎ 5原帖 ↗
低信号与缺口
第一类,窗口内零发帖:按审计中 status=ok 且 window_post_count=0 的口径,以下 46 个账号窗口内无更新:@Red_Xiao_、@ManusAI、@OfficialLoganK、@AnthropicAI、@tydsh、@hugo_larochelle、@drfeifei、@GeminiApp、@srush_nlp、@soumithchintala、@OriolVinyalsML、@StanfordAILab、@goodfellow_ian、@ShunyuYao12、@NotebookLM、@berkeley_ai、@AIatMeta、@wadefoster、@ilyasut、@seb_ruder、@sundarpichai、@EMostaque、@kaifulee、@ylecun、@ThomasOrTK、@karpathy、@demishassabis、@lexfridman、@elicollins、@gdb、@BaiduResearch、@Metamind、@IntelAI、@Tesla_AI、@IBMResearch、@MSFTResearch、@GoogleDeepMind、@GoogleAI、@fchollet、@rowancheung、@ID_AA_Carmack、@Yoshua_Bengio、@geoffreyhinton、@AndrewYNg、@OpenAI、@sama。 第二类,有发帖但未选入主报告:@KrugerSays,窗口内发了 1 条,但未入选;内容为个人早年销售、创业拓城及职业经历,与本期主要技术主题关联较弱,不能归为无更新。其余 5 个有发帖账号均有条目入选;这些账号的短句感叹、缺少引用上下文的回复、重复争论及未经核验的指控未逐条收录。 第三类,抓取失败:无。审计中 52 个账号均为 status=ok。 本次为低信号日,关注列表窗口内 raw 共 27 条,低于审计记录的动态阈值 35 条,精选 8 条组成 3 个主题。本期未采用 buildernews 候选料;该候选源不参与上述账号统计。主报告仅纳入 2026-09-26 08:00 至 2026-09-27 08:00(北京时间)发布的关注列表帖子;零发帖判断沿用已有审计结果,不代表本次进行了重新抓取或独立覆盖复核。