跳到正文
10月2日 · 周五

最新精选

今天10月2日周五
  1. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为其五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点,且推理投入更低。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的能力与成本对比,读者可据此判断智能体编码任务的性价比变化。

9月30日周三
  1. Google DeepMind60

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。

    推荐理由:SynthID 水印首次延伸到合成生物学,读者可了解其在蛋白质序列与结构上的实现方式及生物安全用途。

  2. Latent Space80

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol、Ultrafast 与 Decisions API

    OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API、ChatGPT Spaces 与 Marketplace,并称 ChatGPT 周活达 12 亿。

    推荐理由:汇总 OpenAI DevDay 2026 的发布清单与第三方评测数据,可快速对照各家模型的价格与能力差异。

9月29日周二
  1. Simon Willison82

    OpenAI DevDay 2026 现场实录:Dots、GPT-6.1 Sol 与 Ultrafast 发布

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体产品,由 Astra 模型驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出 ChatGPT Space 供团队协作。

    推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际落地情况。

  2. OpenAI News78

    OpenAI 回顾 DevDay 2026 的 20 多项发布

    OpenAI 发布 DevDay 2026 回顾,汇总了 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。

  3. OpenAI News62

    OpenAI 发布主动型助手 dots

    OpenAI 发布 dots,将其定位为可跨复杂项目和日常任务持续工作的主动型助手。官方说明 dots 在推进工作的同时让用户保持控制,目前公开信息仅有这一摘要。

    推荐理由:OpenAI 官方发布 dots 这一主动型助手,读者可了解它在复杂项目与日常任务中的持续工作方式。

  4. AWS Machine Learning Blog60

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置文件提供服务,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:梳理 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,便于评估长任务智能体的成本取舍。

9月17日周四
  1. GitHub Blog · AI & ML75

    GitHub 用 Copilot 将 Copilot 运行时迁移到 Rust

    GitHub 用 Copilot 应用和 CLI 将 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,代码主要由 AI 智能体编写,跨 128 个 PR 增量合入 main,性能提升数个数量级。

    推荐理由:GitHub 工程师复盘用 Copilot 把运行时迁到 Rust 的全过程,含并发会话协作与提示缓存等可迁移经验。

9月10日周四
  1. OpenAI News62

    OpenAI 发布 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。

    推荐理由:OpenAI 官方发布托管式 Agents API,读者可了解其基于 Codex harness 的编排与长会话能力。

  2. OpenAI News62

    OpenAI 在 API 中推出 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,支持自然的全双工语音对话,并带来更强的指令遵循、自定义音色和电话(telephony)支持。

    推荐理由:OpenAI 在 API 中上线全双工语音模型,读者可据此判断语音应用的接入方式与能力边界。

9月8日周二
  1. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,更贴近用户原本的构想。

    推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解图像生成在个性化与成图质量上的新变化。

9月5日周六
  1. GitHub Blog · AI & ML60

    GitHub 推出 Project HydraFusion 多模型编排研究预览

    GitHub 发布 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型间选择执行方案,用户可在 GitHub Copilot CLI 中通过 /experimental 启用,按各模型标准费率计费。

    推荐理由:GitHub 官方给出多模型编排的三种执行模式与三项基准的成本质量对比,可据此判断编排式编码智能体的取舍。

9月3日周四
  1. Google DeepMind62

    Google DeepMind 推出 Fairwind Program,向政府与企业开放 Gemini 3.8 Flash Cyber

    Google DeepMind 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全伙伴提供受限访问,首批开放 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具链,用于自主发现、验证并修复漏洞。

    推荐理由:原文给出受限访问计划的能力组合与准入条件,读者可据此判断前沿网络防御能力的开放节奏。

9月2日周三
  1. Google DeepMind71

    Google DeepMind 在 Gemini 3.7 Flash 等模型推出智能体视频理解

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,官方称视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。

    推荐理由:官方给出 token 与成本降幅及可用入口,读者可据此判断长视频分析的成本结构变化。

6月25日周四
  1. Google DeepMind71

    Google DeepMind 将 computer use 内置到 Gemini 3.5 Flash

    Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前它只作为独立的 Gemini 2.5 computer use 模型提供。

    推荐理由:原文给出 computer use 从独立模型并入 Gemini 3.5 Flash 的变化,读者可据此判断智能体跨平台自动化的可用性。

5月18日周一
  1. Google DeepMind62

    Google DeepMind 为 Project Genie 加入 Street View 真实场景能力

    Google DeepMind 在实验性原型 Project Genie 中上线 Street View 场景锚定能力,可基于美国真实地点生成可交互世界,并支持 Ocean World、Desert Sands、Stone Age、B&W film 等风格。

    推荐理由:Google 把 Genie 的世界模型与 Street View 真实影像打通,读者可了解智能体训练环境如何从纯生成走向现实锚定。

5月17日周日
  1. Google DeepMind62

    Google DeepMind 发布 Gemini for Science 科研工具与实验

    Google DeepMind 推出 Gemini for Science,包含 Google Labs 上三个实验性工具:基于 Co-Scientist 的 Hypothesis Generation。

    推荐理由:Google 把 Co-Scientist、AlphaEvolve 等能力打包成科研工具并开放申请,可观察通用智能体进入科研流程的路径。

5月16日周六
  1. Google DeepMind66

    WeatherNext 如何帮助美国国家飓风中心预测飓风 Melissa 登陆牙买加

    Google DeepMind 与 Google Research 开发的 AI 天气模型 WeatherNext 帮助美国国家飓风中心提前五天预测飓风 Melissa 将以五级强度登陆牙买加,置信度达 80%,三天前升至接近 100%。

    推荐理由:原文给出 WeatherNext 在飓风路径与强度预测上的实测表现,读者可了解 AI 天气模型如何辅助官方预警决策。

5月12日周二
  1. Google DeepMind66

    Google DeepMind 发布 Co-Scientist 多智能体科研系统

    Google DeepMind 在 Nature 发表 Co-Scientist 研究,这是一个基于 Gemini 构建的多智能体 AI 系统,通过生成、辩论和演化假设来辅助科研。

    推荐理由:原文给出多智能体假设生成系统的架构与多个实验室验证案例,可了解 AI 参与科研推理的具体路径。