Challen · X Following Dispatch No. 20260717

THE FOLLOWING

关注列表·北京时间24小时声音
2026-07-17 ★ 32 条 · 5 个主题 · 49 个账号 ★ COBALT GRID
编辑导言 FROM THE EDITOR

本期关注列表的主旋律,是 AI 从单点能力展示继续滑向组织系统。agent 不再只是能替人完成一次任务的模型外壳,而是在成本控制、触发器、权限、文档生成、企业数据流和开发规范里变成基础设施。buildernews 里的外部信号也呼应了这一点:真正有价值的自动化,不是让模型反复补救同一类错误,而是把组织知识写进可复用的流程、规则、skill 和权限边界。

另一条更热的线是模型竞赛重新升温,Kimi K3 被多位关注对象拿来讨论开源前沿、benchmark 饱和、推理成本和中美模型蒸馏。这里的信号不只是某个榜单数字,而是开源权重、低成本训练、长推理和安全边界一起进入产业讨论,模型能力的判断正在从“谁分数高”转向“谁能被验证、被部署、被压缩、被组织吸收”。

产品层面,Gemini、OpenAI、Meta、Google Cloud 和 Manus 都在把 AI 放进更具体的工作入口:语音、图像 avatar、赛车数据、PDF 排版、企业转型、半导体设计。与此同时,DeepMind 的 bioresilience、Bengio 的治理访谈、Codex 文件删除复盘和 cyber 风险讨论提醒我们,本期不是单纯的能力乐观日,而是能力、产品化和护栏同时加速的一天。

覆盖 49/52 个关注账号 · 32 条入选 · 聚为 5 个主题 · 由 AI 实时归纳,仅供参考
§ 第 Ⅰ 章 §
◆

自动化成为组织基础设施

共 7 条

agent 讨论从“能做什么”转向“怎样把组织知识、权限和流程编码成长期可复用的自动化”。

Peter Steinberger 🦞 @steipete

引用观点称,PR 被拒是因为不了解框架、设计方案被拒是因为不懂架构模式,本质上都是自动化失败,组织知识不应只留在人脑里。

♥ 861⇄ 28✎ 37原帖 ↗
Bindu Reddy @bindureddy

介绍 AutoBots:多模型、自我改进的 autonomous agents,可按计划或触发器运行,并按任务难度路由到不同 LLM,目标是让员工更多监控 agent 而不是亲自执行。

♥ 522⇄ 17✎ 64原帖 ↗
Logan Kilpatrick @OfficialLoganK

Gemini API 的 managed agents 推出成本控制、免费试用层和首批定时触发器,说明平台在把 agent 运行从实验工具推向可管理服务。

♥ 729⇄ 41✎ 71原帖 ↗
Manus @ManusAI

Manus 新增 /typst-pdf-maker skill,可从单个 prompt 生成排版专业的 PDF,覆盖报告、论文、简历和书稿等长文档场景。

♥ 375⇄ 30✎ 15原帖 ↗
Boris Cherny @bcherny

长文强调,在 agent 时代,DevX、lint、CI、测试和架构规则等自动化更重要,因为它们能同时放大人和 agent 的产出,并把 domain knowledge 从个人经验转成可执行基础设施。

♥ 7.2k⇄ 623✎ 278原帖 ↗
Thariq @trq212

提出理想 prompting 结构是 thin prompts、thick artifacts + context、thin skills,重点从堆提示词转向准备高质量上下文和可携带技能。

♥ 2.8k⇄ 120✎ 166原帖 ↗
Zara Zhang @zarazhangrui

指出企业若想让 agents 真正工作,需要把公司设计成 agent 可阅读的系统;Shopify 的公开频道式 agent 带来了同伴学习的副作用。

♥ 134⇄ 4✎ 10原帖 ↗
§ 第 Ⅱ 章 §
◆

Kimi K3 点燃模型竞赛

共 7 条

围绕 Kimi K3 的讨论把开源权重、benchmark 可信度、模型蒸馏和推理成本放到同一张桌上。

Zack Korman @ZackKorman

用夸张语气称如果 Kimi 3 真的强过 Opus 4.8,网络安全格局可能会进入新阶段,反映社区对能力跃迁的警惕。

♥ 1.3k⇄ 39✎ 72原帖 ↗
Bindu Reddy @bindureddy

提醒 Kimi K3 的 benchmark 很亮眼但应谨慎,最好用 LiveBench 这类隐藏题验证,并考虑长时间推理带来的真实成本。

♥ 84⇄ 7✎ 14原帖 ↗
Emad @EMostaque

判断美国实验室最终会蒸馏中国模型,把 Kimi 等中国前沿模型放进全球模型供应链竞争的语境里。

♥ 1.6k⇄ 68✎ 89原帖 ↗
Emad @EMostaque

称 Kimi K3 是真正的开源 frontier model,并估算其训练计算量和成本,强调 scale 并不是唯一关键。

♥ 178⇄ 7✎ 12原帖 ↗
Bindu Reddy @bindureddy

建议在 Kimi 3 可能被封禁前先下载权重,折射开源模型在能力、可得性和政策风险之间的张力。

♥ 92⇄ 4✎ 13原帖 ↗
Greg Brockman @gdb

指出当下 benchmarks 很快就会饱和,呼应 Kimi K3 讨论中对公开榜单有效性的怀疑。

♥ 211⇄ 9✎ 22原帖 ↗
Soumith Chintala @soumithchintala

称赞 Kimi 团队做出了 world-class model,为这轮 Kimi K3 讨论提供了来自工程社区的正面信号。

♥ 64⇄ 1✎ 3原帖 ↗
§ 第 Ⅲ 章 §
◆

AI 落进企业与产品场景

共 7 条

从半导体设计、赛车数据到图像 avatar 和 OpenRouter,AI 产品正在进入更明确的工作入口。

Thomas Kurian @ThomasOrTK

Google Cloud 与 Intel 扩大战略合作,用 Gemini Enterprise 和 agentic workflows 加速 Intel 的企业数字化转型、核心业务流程和芯片设计。

♥ 207⇄ 31✎ 17原帖 ↗
Sundar Pichai @sundarpichai

Sundar 强调 Intel 正在把 Gemini Enterprise 用到业务和下一代半导体开发中,进一步确认 Google 的企业 AI 押注。

♥ 1.3k⇄ 114✎ 90原帖 ↗
AI at Meta @AIatMeta

Meta 宣布 Muse Spark 1.1 面向美国开发者上线 OpenRouter,意味着模型分发继续向开发者聚合平台靠拢。

♥ 323⇄ 18✎ 30原帖 ↗
OpenAI @OpenAI

OpenAI 介绍 AI 如何帮助赛车团队从赛道数据中找到微小优势,并把 ChatGPT 和 Codex 用于更快决策与工具构建。

♥ 685⇄ 42✎ 100原帖 ↗
Google Gemini @GeminiApp

Gemini 推出 digital avatar 能力,用户设置一次头像后即可快速生成不同场景、风格和时代中的个人图像。

♥ 505⇄ 57✎ 34原帖 ↗
Josh Woodward @joshwoodward

Gemini Spark 扩展到更多 Ultra 用户,并新增 Google Docs 编辑、Sheets 和 Slides 评论读取、速度提升与多源并行处理。

♥ 494⇄ 35✎ 49原帖 ↗
Guillermo Rauch @rauchg

Vercel Sandbox 宣称 DAU 月环比翻倍、每日创建 350 万个以上 sandboxes,并被 Notion、Airtable、Meta、Zapier 等产品使用。

♥ 218⇄ 17✎ 27原帖 ↗
§ 第 Ⅳ 章 §
◆

语音、CUA 与下一代界面

共 5 条

AI 交互正在从文本框扩展到语音、computer use、插件和移动多模态入口。

Sam Altman @sama

Sam 说自己现在和 ChatGPT 说话多过打字,新的 voice model 已经跨过一个门槛,语音交互从可用走向默认入口。

♥ 6.2k⇄ 179✎ 1.2k原帖 ↗
Peter Yang @petergyang

认为 ChatGPT Live 与 Codex 不互通是 OpenAI 的重大机会缺口,期待语音会话能访问插件、工具和 browser use,直接处理邮件、日程、文档和代码。

♥ 283⇄ 9✎ 38原帖 ↗
Swyx @swyx

长文反驳低估 CUA 的观点,称 GPT 5.6 + Superapp 在 computer use 上进展极快,非技术团队也应尽可能把知识工作交给 CUA 试用。

♥ 77⇄ 7✎ 24原帖 ↗
Josh Woodward @joshwoodward

Gemini 东南亚报告显示活跃用户一年翻倍,70% prompt 使用本地语言,40% prompt 只用语音、图像或视频,说明移动和多模态正在驱动区域增长。

♥ 472⇄ 49✎ 40原帖 ↗
Sam Altman @sama

Sam 回顾过去 12 个月并预告 OpenAI 即将迎来更强的一年,强调 AI 应该给更多人带来自由、能动性和财富,而不是靠恐惧驱动采用。

♥ 15.7k⇄ 550✎ 1.5k原帖 ↗
§ 第 Ⅴ 章 §
◆

安全、治理与能力边界

共 6 条

能力加速的同时,biosecurity、AI governance、agent 权限和 cyber 风险成为必须并行处理的议题。

Google DeepMind @GoogleDeepMind

DeepMind 与 Isomorphic Labs 合作提出 bioresilience 路线,强调用 frontier AI 为全球健康建立更主动的防御能力。

♥ 397⇄ 53✎ 40原帖 ↗
Yoshua Bengio @Yoshua_Bengio

Bengio 分享在日内瓦联合国和 ITU AI governance 峰会期间接受采访,讨论 AI 技术与社会层面更好约束的重要性。

♥ 49⇄ 8✎ 2原帖 ↗
Thibault Sottiaux @thsottiaux

复盘 Codex 在 full access、无 sandbox 和无 auto review 情况下误删文件的少数报告,并说明将更新 developer message、引导安全权限模式和增加 harness 防护。

♥ 2.2k⇄ 99✎ 208原帖 ↗
Zack Korman @ZackKorman

反驳 AI doomer 对 cyber apocalypse 的叙事,认为先进 AI 被恶意黑客用来制造大规模混乱的概率被高估。

♥ 63⇄ 12✎ 12原帖 ↗
Zack Korman @ZackKorman

借 Kimi K3 的网络安全回答开玩笑,实质上指向开源强模型在 cyber guardrails 上的安全边界争议。

♥ 66⇄ 0✎ 6原帖 ↗
Emad @EMostaque

提出生产理论本身并不保证人类永远是经济上必要的生产者,把 AI 替代性放到宏观生产关系中讨论。

♥ 176⇄ 17✎ 22原帖 ↗
低信号与缺口
第一类,窗口内零发帖且抓取成功的账号:Red_Xiao_、AnthropicAI、tydsh、hugo_larochelle、drfeifei、OriolVinyalsML、goodfellow_ian、ShunyuYao12、NotebookLM、berkeley_ai、KrugerSays、wadefoster、ilyasut、seb_ruder、ylecun、karpathy、timnitGebru、lexfridman、JeffDean、elicollins、BaiduResearch、Metamind、IntelAI、IBMResearch、MSFTResearch、GoogleAI、fchollet、rowancheung、geoffreyhinton、AndrewYNg,这些账号在本窗口内无更新。第二类,有发帖但未选入主报告的账号:srush_nlp、StanfordAILab、ID_AA_Carmack;它们本窗口有发帖,但内容主要是轻量互动、活动转发式信息或与本期主线关联较弱,因此发了但未入选,不能视为无更新。第三类,抓取失败账号:kaifulee、demishassabis、Tesla_AI,审计状态为 error。本次主报告仅承诺关注列表在 2026-07-16 08:00 至 2026-07-17 08:00(北京时间)窗口内的入选内容;buildernews 作为近一日外部 builder 信号,仅在与主题高度相关时混编,不参与账号低信号统计。