她认为选模型不应先站队开放或封闭,而应按任务匹配能力。帖中分别为高难度编程、3D、个人 Agent、图像、研究、视频和浏览器操作推荐不同模型,并把 GLM、Deepseek 列为低预算选项。这是个人选型清单,帖文没有提供横向评测依据。
X 日报个人阅读
2026 年 9 月 21 日 · 周一
2026-09-20 08:00 至 2026-09-21 08:00(北京时间)
关注账号覆盖
条入选
个主题
晨间播报
开车或走路时直接听;会记住播放速度和上次听到的位置。下载 MP3
编辑导言
这一期值得读的不是新模型发布,而是两组关于 AI 落地的判断。Bindu Reddy 主张按任务选模型,Emad 则把付费体验的重点放在快速响应、路由和定时任务上。两者共同提醒产品团队:不必把所有问题都做成 AGI 问题。不过,廉价模型半年后覆盖几乎所有任务的说法仍是个人预测,不能当成容量规划或采购决策的依据。
另一组讨论更尖锐:Zack Korman 与 Timnit Gebru 质疑,宏大的 AI safety 叙事是否挤掉了具体的安全工程与经验研究;Gebru 又把批评延伸到企业宣传、媒体和立法者之间的信息传递。这些帖子呈现的是批评者的立场,不是已经核实的行业结论。本期是低信号日,内容集中在少数账号,因此保留可独立理解的观点,舍去缺少附件上下文的高互动短帖,不把声量当作新事实。
01按任务选模型
模型选择与产品编排应服务具体任务,但覆盖率预测还不能替代实际评测。
对用户愿意付费的产品,他主张不要试图把所有功能都做成 AGI:快速响应、任务路由和 cron jobs 就能带来更好的使用体验。重点是完成具体工作,而非追求通用智能的产品包装。
她估计,开源和极低价模型目前能处理约 60% 的任务,并预测六个月后可达到 99%,届时前沿模型主要用于顶尖研究与极难问题。帖文未说明任务范围或测量方法,这些比例应作为作者的判断与预测阅读,而非已验证指标。
02安全工程与对齐之争
争论的焦点是能否把安全问题交给 alignment 叙事,而不落实具体工程与实证研究。
他批评 EA 安全与 AI 末日论阵营把 security 描述成不可能完成的任务,进而宣称只有 alignment 能解决问题;他认为这种立场缺乏安全专业知识,反而危险。这是对相关论述的批评,帖文本身未提供技术验证。
她欢迎安全从业者加入争论,并批评某些 AI safety 倡导者用这一术语与从事实证研究的人划界,把注意力转向假想的超强智能。她强调的分歧,是可观察、可研究的风险与高度推演式叙事之间的距离。
03谁在塑造风险叙事
Gebru 从政策、商业激励和媒体三个角度追问 AI 风险话语的来源,这是一位作者的连续批评而非多方共识。
她批评部分立法者反复照搬企业宣传,即使研究者通过文章、电视和逐步解释提出异议,也没有认真听取。帖文没有点明具体法案或议员,因此这里只保留她对政策讨论方式的质疑。
她质疑潜在 IPO 收益会如何影响企业高管的 AI 叙事,并批评把既有安全实践上的失误包装成系统异常强大的证据。这是作者对商业激励与宣传方式的指责,不能据此认定某家公司的具体安全事件。
她进一步批评媒体把企业新闻稿当报道、评论人士与立法顾问缺乏科学素养等现象。核心担忧是企业营销在公共讨论中被反复转述,却没有得到足够审视;所附链接内容不在本次原始材料中,未作展开。
低信号与抓取缺口
第一类「窗口内零发帖」:按审计中 status=ok 且 window_post_count=0 的口径,共 45 个账号窗口内无更新:@Red_Xiao_、@ManusAI、@OfficialLoganK、@AnthropicAI、@tydsh、@hugo_larochelle、@drfeifei、@GeminiApp、@srush_nlp、@soumithchintala、@OriolVinyalsML、@StanfordAILab、@goodfellow_ian、@ShunyuYao12、@NotebookLM、@berkeley_ai、@KrugerSays、@AIatMeta、@wadefoster、@ilyasut、@seb_ruder、@sundarpichai、@kaifulee、@ThomasOrTK、@karpathy、@demishassabis、@lexfridman、@JeffDean、@elicollins、@gdb、@BaiduResearch、@Metamind、@IntelAI、@Tesla_AI、@IBMResearch、@MSFTResearch、@GoogleDeepMind、@GoogleAI、@rowancheung、@ID_AA_Carmack、@Yoshua_Bengio、@geoffreyhinton、@AndrewYNg、@OpenAI、@sama。 第二类「有发帖但未选入主报告」:共 3 个账号,均是发了但未入选,不是无更新。@steipete 发了 3 条,包含社交互动和仅称有新 benchmark、缺少附件正文的短帖;@ylecun 发了 2 条,正文为依赖上文的定向讨论,缺少足够上下文;@fchollet 发了 1 条,属于依赖配图的短句。另有 @bindureddy、@EMostaque、@ZackKorman、@timnitGebru 共 4 个账号进入主报告,不代表其全部帖子均入选。 第三类「抓取失败」:无,52 个账号的 status 均为 ok。 本次为低信号日:原始材料共 25 条,低于上游审计的动态阈值 35 条,精选 8 条组成 3 个主题。仅依据冻结的 raw/audit 编辑,未重新抓取或核实外链;账号零发帖分类沿用审计字段,不另作全量分页覆盖保证。本期未采用 buildernews 候选料,外部账号不参与上述统计。主报告所有入选帖子均发布于 2026-09-20 08:00 至 2026-09-21 08:00(北京时间)。