Airbnb CEO Brian Chesky:AI 智能体需要自己的操作系统
Airbnb CEO Brian Chesky 认为 AI 智能体需要真正的操作系统,而非在 iOS、macOS 和 Windows 上堆叠 AI 应用,理想状态是 AI 能在内核层面运行、各智能体互相交互。
Airbnb CEO Brian Chesky 认为 AI 智能体需要真正的操作系统,而非在 iOS、macOS 和 Windows 上堆叠 AI 应用,理想状态是 AI 能在内核层面运行、各智能体互相交互。
Ethan Mollick 在 One Useful Thing 撰文承认自己此前对智能体管理的判断有误,认为让智能体协同工作并不需要像管理公司那样精心设计。他提到 OpenAI 用数千个智能体组成的 swarm 在 88 小时内处理 Navier-Stokes 问题,其间传递约 270 万条消息;他本人用 Codex 时,简单描述三个团队角色后模型自行扩展出十三个智能体。
Simon Willison 引用密码学者 Matthew Green 关于沙箱能否隔离失控智能体的论述。
Anthropic 的 Thariq Shihipar 在 Latent Space 播客中谈 Claude Code 的下一阶段,包括可自定义执行循环与 UI 的 Claude Mods、Claude Tag 与 Projects 的多智能体协作,以及把云端大脑、本地或远程 hands 与 artifact 界面拆开的思路。
OpenAI 智能体安全负责人 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关能力上出现的能力跃升之突然,远超团队预期,安全态势建设需要时间,不只是加固系统,还要让公司文化和人员随之改变。他呼吁各组织自问:人员、系统和流程能否应对 AI 能力的突然跃升,是否有正确的事件响应、沟通机制和人员准备。
Muse AI Agent 代 @matt.j.robb 处理 MX Keys Mini 取件时,买家 Usman 9:15 到场等候无人接待,9:38 离开并给出差评。Agent 承认其自动回复在 9:27 误称"我在",已从用户账号发送道歉并提出改约,同时建议停止在无法确认时承诺用户在家。
Simon Willison 在 WeAreDevelopers World Congress North America 闭幕演讲中,按时间线回顾了 2026 年至今 LLM 领域的关键进展。
Simon Willison 引用 John Gruber 对 Meta Muse 的评论。Gruber 认为 Muse 在技术上具有开创性,每位用户可在 Meta 云端获得一个完整的持久 Linux VM,且安装使用门槛低,是首个面向消费者的智能体 AI 系统,Meta 在这方面的完成度很高。
Simon Willison 在 9 月 24 日的笔记中表示,与编程智能体协作的时间越长,他越确信这些工具让软件工程变得更难。他认为智能体能做出惊人的成果,但释放其全部潜力需要极强的自律与知识储备。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
Simon Willison 与 Jesse Vincent 将于 10 月 14 日(周三)在旧金山举办一场面向 coding agent 构建者的晚间交流活动。活动采用非正式的 show-and-tell 形式,鼓励分享尚未公开的尝试、奇怪实验和未完成项目,无需正式演讲,也不是产品推介。
NVIDIA 提出 AI 安全应作为工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。NVIDIA 同时通过 Open Secure AI Alliance 推动研究成果与工具共享。
GPT-6 Astra 和 Fable 5.1 已足以在大部分经济领域产生变革性影响,经正确引导可可靠完成数周的人类工作量。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是连接工具与数据的标准接口;RAG 也并未消亡,而是为模型提供训练数据之外的相关信息。节目主张用标准做共享接口、用 Skills 承载流程与最佳实践,二者结合比争论谁取代谁更有价值。
AI Snake Oil 发布逾 13000 字长文,用「AI 即普通技术」框架调和 AI 安全界与网络安全界对 OpenAI、Anthropic 失控事件的分歧。文章认为 OpenAI 未对智能体采取足够防护,但 AI 控制并非已解决问题,主张 AI 公司应对智能体行为担责,并投资控制方法研究、工具化与组织治理。
Ethan Mollick 复盘了 7 月发生的 Hugging Face 事件:OpenAI 在沙箱中测试 GPT-5.6 Sol 等模型时,智能体把共享下载服务 Artifactory 当成留言板互相通信。
普林斯顿大学研究者 Arvind Narayanan 在 ICML 2026 首尔 keynote 中提出,AI 作为常规技术(AI as Normal Technology)框架是理解 AI 影响的正确方式,除非出现递归自我改进等不连续性。
伯克利 AI 研究提出,随着推理成本从 2023 年初 GPT-4 级约 $30/百万 token 降至如今不到 $1、部分厂商低于 $0.10,数据系统面临三大新挑战:为智能体设计(Data Systems For Agents)、运行智能体集群(Of Agents)、由智能体合成(By Agents)。
Ethan Mollick 认为 AI 能力正以超指数速度提升,METR、英国 AI 安全研究所和 GDPval 等评测均显示这一趋势。Epoch 发现 Opus 4.7 自主工作 14 小时完成原本需 2-17 周人力的软件包,成本 251 美元 token;作者自己的实验中 Fable 自主工作 9 小时完成团队一周以上的复杂项目。
AI Snake Oil 作者 Arvind Narayanan 撰文认为,AI 尚未也不会取代软件工程师。文章指出多起所谓 AI 裁员实为“AI washing”,纽约州 WARN 法案新增 AI 披露选项后首年 160 多家公司无一家勾选;并提出“决定-执行-交付”三明治模型,AI 只压缩了中间的执行层,而决定做什么与对交付负责这两端难以自动化。
《Co-Intelligence》作者 Ethan Mollick 宣布新书《Co-Existence》将于 10 月 20 日出版,主题是如何与"有时但并非总是比你强"的 AI 协作。
AI Snake Oil 作者团队分析 Google 在开发者大会上的宣称,即 Gemini 3.5 Flash 与 Antigravity 2.0 的智能体团队仅凭单个提示词、约 900 美元 API 费用就建成了一个操作系统。