Challen · X Following Dispatch No. 20261006

THE FOLLOWING

关注列表·北京时间24小时声音
2026-10-06 ★ 16 条 · 6 个主题 · 52 个账号 ★ COBALT GRID
编辑导言 FROM THE EDITOR

本期最值得先看的不是模型榜单,而是能力进入产品后遇到的边界。OpenAI 宣布为欧盟的 ChatGPT 与 Codex 部分文本引入水印,同时明确它只能辅助判断生成来源,不能证明作者身份或所有权。Bengio 与 Zack Korman 则从不同方向追问系统安全:前者反对把 Agent 风险简化为沙箱漏洞,后者主张即使模型不对齐,公众依赖的系统也必须安全。这些不是同一种主张,但都把问题推向了模型之外的责任安排。

应用侧更具体。Zapier 把 MCP 连接器送进 Muse,Manus 把视频生成扩展成素材筛选、代码制作和剪辑的连续流程,企业实施者则拿报价耗时讨论收益。读这些帖子,值得区分三件事:产品方宣布了什么,使用者觉得什么好用,以及真实业务到底改善了多少。连接器数量不等于任务成功率,单个报价案例也不是普遍回报承诺。能否把一项工作完整交付,比入口是不是聊天框更值得追问。

覆盖 52/52 个关注账号 · 16 条入选 · 聚为 6 个主题 · 由 AI 实时归纳,仅供参考
§ 第 Ⅰ 章 §
◆

文本水印的边界

共 2 条

生成来源识别开始进入产品合规,但水印不能替代身份认证和版权判断。

OpenAI @OpenAI

OpenAI 宣布为应对 EU AI Act,未来几周将在欧盟为 ChatGPT 和 Codex 符合条件的文本加入水印;全球 API 客户当天即可为部分模型开启文本水印。官方同时强调,当前文本水印技术存在显著局限。

♥ 5.2k⇄ 325✎ 606原帖 ↗
OpenAI @OpenAI

水印是在生成时嵌入文本的不可见统计信号,用来辅助判断内容是否可能来自 OpenAI 模型,不添加可见标记或特殊字符,也不识别个人、账号、对话、提示词或内容所有权。OpenAI 称内部测试未发现它影响模型能力、速度或阅读体验。

♥ 525⇄ 29✎ 47原帖 ↗
§ 第 Ⅱ 章 §
◆

Agent 接入工作流

共 3 条

聊天入口背后的应用连接和模型分工,决定 Agent 能把任务推进多远。

Wade Foster @wadefoster

Wade Foster 称,上周把 Zapier MCP 接入 Muse 的人数超过接入 ChatGPT 的人数。Muse 自带 39 个连接器,Zapier 可再提供超过 9,000 个应用入口,并允许用户控制已有连接的开放范围;示例包括报销登记、销售线索整理,以及先供人工审核再发送的催款邮件草稿。

♥ 48⇄ 4✎ 9原帖 ↗
Bindu Reddy @bindureddy

Bindu Reddy 观察到,曾坚持 IDE 和 CLI 的技术用户也在通过聊天框向 Agent 下达任务。她以此调侃对 vibe coding 的早期轻视;这是对交互方式变化的个人判断,并非所有开发者都已放弃 IDE。

♥ 140⇄ 8✎ 41原帖 ↗
Bindu Reddy @bindureddy

她对模型分工给出使用评价:Sol 6.1 擅长 browser use,Opus 5.5 擅长直接写代码,组合使用更适合软件开发。原帖未提供对比测试或量化结果,应视为个人经验而非性能排名。

♥ 208⇄ 6✎ 24原帖 ↗
§ 第 Ⅲ 章 §
◆

视频交付不止生成

共 2 条

Manus 的视频案例把重点从生成片段转向素材组织和多工具协作。

Manus @ManusAI

Manus 展示旅行剪辑案例:输入 125 段、总长接近两小时的素材,一次提示后得到按旅程组织的 12 分 48 秒初剪。官方称最终 vlog 包含字幕、音乐和特效;原帖只把初剪明确归于这次提示,没有说明成片后续人工处理量。

♥ 228⇄ 13✎ 18原帖 ↗
Manus @ManusAI

Manus 解释推出 Video Editor 的思路:做好视频不只是生成画面,还需要上网研究流行内容、写代码制作动态图形与布局及地图路线,并为各步骤选择模型和工具。其产品定位是让通用 Agent 组织视频制作流程。

♥ 2⇄ 0✎ 1原帖 ↗
§ 第 Ⅳ 章 §
◆

落地先问业务价值

共 4 条

企业改造与教育试点提供了具体场景,但组织判断、效率案例和扩张目标需要分开看。

Kai-Fu Lee @kaifulee

李开复称,过去一年与超过 100 位 CEO 讨论 AI 转型后,最常见的思维误区是把它视为经历过的技术变革。他认为 AI 需要不同的公司组织方式,而非照搬过去的转型经验;帖文未展开具体改造步骤。

♥ 25⇄ 2✎ 1原帖 ↗
Alex Kruger @KrugerSays

Alex Kruger 分享一次招聘经历:AI 工程师持续提出可实现的项目,但多数缺乏业务价值。他据此主张,不能由 AI 工程师单方面决定公司该做什么,技术可行性不是需求成立的证明。

♥ 2⇄ 0✎ 1原帖 ↗
Alex Kruger @KrugerSays

他认为,管理者知道 Claude、Cursor 和 Agent,并不意味着知道如何在公司内落地。其服务推介举例称,一家 B2B 实验室设备分销商将每份客户报价的制作时间从 4 至 6 小时降至 10 分钟,建议优先寻找重复且耗时的工作;这是服务方自述案例,非独立验证结果。

♥ 2⇄ 0✎ 1原帖 ↗
Kai-Fu Lee @kaifulee

李开复称与哈萨克斯坦总统托卡耶夫讨论了中学 AI 试点:项目从 9 月的 10 所学校起步,目标是次年 1 月覆盖 60 所、2027 年 4 月覆盖 500 所。他将教育可及性和 AI 主权作为重点;后两项学校数量是计划目标,不是已完成覆盖。

♥ 3⇄ 0✎ 2原帖 ↗
§ 第 Ⅴ 章 §
◆

安全责任落在哪里

共 3 条

围绕发展速度、模型对齐和系统防护的分歧,正在转化为公共治理问题。

Yoshua Bengio @Yoshua_Bengio

Bengio 引述 Quinnipiac 的美国全国民调:86% 支持要求 AI 公司达到独立安全标准,即使拖慢开发;77% 支持在安全性得到评估前放慢或停止强大 AI 系统开发。他据此批评重大 AI 决策缺少有意义的民主参与。百分比来自帖文转述,本报未核验民调方法。

♥ 194⇄ 45✎ 18原帖 ↗
Yoshua Bengio @Yoshua_Bengio

Bengio 介绍其 Financial Times 评论,反对把近期 AI Agent 黑客事件仅视为网络安全问题,或认为修补训练沙箱就足够。他认为这种解释过窄,会让类似风险继续存在;原帖未展开其替代方案细节。

♥ 257⇄ 66✎ 23原帖 ↗
Zack Korman @ZackKorman

Zack Korman 主张,政治决策不应围绕 AI alignment 本身,而应确保公众依赖的系统即使面对严重不对齐的模型仍然安全。他以 GPT-7/8/9 作假设示例,强调的是系统防护责任,并非披露这些模型的实际行为。

♥ 19⇄ 1✎ 1原帖 ↗
§ 第 Ⅵ 章 §
◆

审视 AI 公共叙事

共 2 条

Timnit Gebru 的批评提醒读者区分体验、论证与媒体叙事背后的关系。

@timnitGebru (@dair-community.social/bsky.social) @timnitGebru

Timnit Gebru 质疑部分媒体对有效利他主义(EA)的报道独立性,举例称一位曾撰写 TIME 相关正面报道的作者,现任 EA 资助机构 Coefficient Giving 的传播负责人。这里保留其对人员关系和报道倾向的指称,不将其直接当作已证实的利益输送。

♥ 36⇄ 4✎ 1原帖 ↗
@timnitGebru (@dair-community.social/bsky.social) @timnitGebru

Gebru 以反讽批评一种论证:仅凭与 Claude 聊天,就认定它不只是统计生成系统,甚至把它描绘成需要解放的受苦灵魂。她质疑媒体重复这类拟人化说法;帖文不是她认可模型具有灵魂或痛苦体验的声明。

♥ 185⇄ 22✎ 18原帖 ↗
低信号与缺口
第一类「窗口内零发帖」:按审计中 status=ok 且 window_post_count=0 的口径,共 38 个账号窗口内无更新:@Red_Xiao_、@AnthropicAI、@tydsh、@hugo_larochelle、@drfeifei、@GeminiApp、@srush_nlp、@soumithchintala、@OriolVinyalsML、@StanfordAILab、@goodfellow_ian、@ShunyuYao12、@NotebookLM、@berkeley_ai、@AIatMeta、@ilyasut、@seb_ruder、@sundarpichai、@EMostaque、@ylecun、@ThomasOrTK、@karpathy、@demishassabis、@lexfridman、@elicollins、@gdb、@BaiduResearch、@Metamind、@IntelAI、@Tesla_AI、@IBMResearch、@MSFTResearch、@GoogleDeepMind、@fchollet、@rowancheung、@geoffreyhinton、@AndrewYNg、@sama。 第二类「有发帖但未选入主报告」:共 5 个账号,均发了但未入选,不能视为无更新。@steipete 为缺少问题上下文的排查及 PR 指令;@OfficialLoganK 为简短提及 Google AI Studio;@JeffDean 为祝贺交流;@GoogleAI 只有短链接,没有足够正文支持摘要;@ID_AA_Carmack 主要请求 Waymo 邀请码,附带简短 Zoox 体验,未形成足够展开的主题。其余 9 个有发帖账号均有内容入选,重复观点、短链接和宣传性续帖作了删选。 第三类「抓取失败」:无,审计中 52 个账号 status 均为 ok。 本期仅依据冻结的 raw/audit 编辑,从 38 条关注帖选入 16 条,未采用外部 buildernews 候选料。主报告发帖时间均在北京时间 2026-10-05 08:00 至 2026-10-06 08:00 之间。零发帖分类沿用提供的审计结果;审计各账号的 first_page_covers_window_start 均为 false,因此抓取成功不单独证明分页完整覆盖,本轮未重新抓取或补证。