Reddy 判断,开放模型只有约 8 至 12 周的关键窗口,需要显著提升并进入自我改进循环,否则可能落后;她认为前沿实验室已进入这一阶段,并预期近期会有重要开放模型消息。这是她的判断,帖文未提供验证依据。
X 日报个人阅读
2026 年 10 月 5 日 · 周一
2026-10-04 08:00 至 2026-10-05 08:00(北京时间)
关注账号覆盖
条入选
个主题
晨间播报
开车或走路时直接听;会记住播放速度和上次听到的位置。下载 MP3
编辑导言
本期值得看的不是新模型发布,而是几种关于 AI 下一步的判断在交锋。Bindu Reddy 担心开放模型错过自我改进的窗口,Yann LeCun 则从训练与蒸馏的成本差出发,看好免费、开放的基础模型。两者讨论的分别是能力追赶和经济激励,不能当成谁已经证明了谁。有关新模型即将登场的说法,本期仍按预期和转述处理。
另一条线更贴近实际工作:模型能力变强以后,什么才算可靠的进展?Chollet 要求机器意识的主张拿出科学证据,LeCun 希望借 AI 工具检验认知架构;Zack Korman 把安全讨论拉回采购成本与具体防御问题。外部 builder 候选料则补上了应用侧的细节:Agent 要进入日常工作,不仅要少一些设置,还要接通数据、重建责任机制。相比笼统宣称效率提升,批量核验邮件、分类和辅助回复这样的过程更值得展开看。
01开放模型的追赶与成本
能力追赶的紧迫感与蒸馏降本的经济逻辑并存,但尚不能据此断言开放模型的竞争结果。
LeCun 从成本结构解释对开放模型的看好:训练前沿模型昂贵,蒸馏则便宜得多。他认为,这种市场力量会推动前沿基础模型走向免费、开放;这是经济趋势判断,并非具体模型的开放公告。
Reddy 转述一则媒体说法:多家美国隐身基础模型创业公司可能即将推出 open-weight 模型,并声称经过调整后可超越前沿模型。她对此持怀疑但期待的态度;帖文没有列出模型名称、评测或确定发布日期。
02认知能力需要什么证据
把能力表现、认知架构与意识分开讨论,才能把宏大主张变成可检验的问题。
Chollet 反对从“意识依赖计算”直接推导出“AI 模型可能有意识”:共同的底层材料不意味着共同的性质。他强调信息整合、内感受、时间绑定和具身性等问题,认为机器意识的主张需要意识科学的证据支持,而不是把复杂计算本身当作证明。
LeCun 认为 AI 进展让系统神经科学更值得探索,而非使它过时。当前 AI 在物理直觉、常识、世界模型、规划推理、动机和情绪等方面仍有不足,但研究者可能已经拥有实现并检验认知架构的工具。
03安全业务的现实阻力
安全防御既受采购经济性约束,也需要避免让每次事故都变成否定整个行业的论据。
Korman 回顾面向 SMB 的安全公司 CTO 经历:小企业常由单人 IT 管理者兼管安全,预算有限,采购沟通却很重。他举例,一笔每年 4,000 美元的合同可能需要开四次会,令安全厂商觉得服务这类客户不划算。
Korman 批评一种讨论方式:把每个漏洞或安全事故都当作“网络安全不起作用”的证据。他认为,这类带政治叙事的概括妨碍了对 AI 如何改变攻击与防御的具体理解和应对。
04让 Agent 真正进入工作
外部 builder 信号:降低使用复杂度只是起点,Agent 还需要具体任务流程和责任机制。
Levie 观察到 Agent 采用高度分化:编程及相邻任务已起量,其他知识工作仍在早期;即使在编程中,并行后台 Agent 与一对一协作也并存。他认为,更广泛的采用需要重建工作流、连接数据,并重新安排决策责任、治理合规和安全,而不只是部署聊天工具。
Sottiaux 表示,接下来只聚焦产品简化、提高效率以支持更多使用、突破性功能或新模型。他承认用户反馈明确要求更简单的体验,表示会据此调整工作重点;帖文没有给出具体功能或交付时间。
Sottiaux 分享一次邮件处理过程:对无需保留的邮件按类别批量核验后删除,识别工作类型并打标签,再逐封处理待回复邮件,同时在后台搜索相关上下文。他表示,这也帮助自己消化了直接发到邮箱的反馈与请求。
低信号与抓取缺口
第一类,窗口内零发帖:依据审计中 status=ok 且 window_post_count=0 的记录,以下 44 个关注账号窗口内无更新:@Red_Xiao_、@ManusAI、@OfficialLoganK、@AnthropicAI、@tydsh、@hugo_larochelle、@drfeifei、@GeminiApp、@srush_nlp、@soumithchintala、@OriolVinyalsML、@StanfordAILab、@goodfellow_ian、@ShunyuYao12、@NotebookLM、@berkeley_ai、@KrugerSays、@AIatMeta、@wadefoster、@ilyasut、@seb_ruder、@sundarpichai、@kaifulee、@ThomasOrTK、@karpathy、@lexfridman、@JeffDean、@elicollins、@gdb、@BaiduResearch、@Metamind、@IntelAI、@Tesla_AI、@IBMResearch、@MSFTResearch、@GoogleDeepMind、@GoogleAI、@rowancheung、@ID_AA_Carmack、@Yoshua_Bengio、@geoffreyhinton、@AndrewYNg、@OpenAI、@sama。 第二类,有发帖但未选入主报告:4 个关注账号发了但未入选,并非无更新。@steipete(2 条)为未说明对象的修复短讯和缺少案例的二进制分析评价;@EMostaque(1 条)为税收与 UBI 判断,未展开数据口径;@demishassabis(1 条)为 AI 科学与医学工作的一般性表态,未提供具体新进展;@timnitGebru(9 条)主要是依赖外链或对话上下文的评论及严重指控,现有素材不足以核实,不作事实新闻收录。其余 4 个有发帖的关注账号各有内容入选,但并非全部帖子入选。 第三类,抓取失败:无。52 个关注账号的审计状态均为 ok。 本次为低信号日:关注列表窗口内 raw 共 24 条,低于上游动态阈值 35 条,选入 7 条;另选入 3 条 buildernews,合计 10 条。关注内容严格使用北京时间 2026-10-04 08:00 至 2026-10-05 08:00 的窗口。buildernews 为独立的近一日外部信号,feed 生成于 2026-10-04T08:22:04.655Z,逐条标注 source,不参与上述关注账号统计,也不承担整个关注窗口的覆盖承诺;本期入选的 3 条按各自 created_at 核对,恰好也位于该窗口内。以上只基于已有 raw/audit 和候选料编辑,未重新抓取或扩展外链核验。