跳到正文
10月2日 · 周五

最新精选

今天10月2日周五
  1. AWS Machine Learning Blog62

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。据 OpenAI 称,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,单任务成本约为其五分之一,并比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点,且推理投入更低。

    推荐理由:原文给出 GPT-6.1 Sol 在 Bedrock 上的能力与成本对比,读者可据此判断智能体编码任务的性价比变化。

10月1日周四
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展至开发者、企业和消费者。

    推荐理由:官方给出 Argon 在编码、企业知识与网络安全上的基准表现和分阶段开放路径,可据此判断前沿模型的能力边界与落地节奏。

9月30日周三
  1. Google DeepMind60

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,把不可感知的签名直接嵌入生物代码,使水印不仅能在数字模型上验证,也能在合成出的实体蛋白质上验证,同时保持其生物功能。

    推荐理由:SynthID 水印首次延伸到合成生物学,读者可了解其在蛋白质序列与结构上的实现方式及生物安全用途。

9月29日周二
  1. OpenAI News78

    OpenAI 回顾 DevDay 2026 的 20 多项发布

    OpenAI 发布 DevDay 2026 回顾,汇总了 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。

  2. OpenAI News78

    OpenAI 发布 GPT-6.1 Sol

    OpenAI 发布 GPT-6.1 Sol,官方称其面向编码、电脑操作和专业工作,具备接近 Astra 的智能水平。该模型标准 API 的输入与输出 token 价格均为 Astra 的五分之一。

    推荐理由:OpenAI 公布 GPT-6.1 Sol 的定位与定价,读者可据此判断它在编码和电脑操作上的性价比。

  3. OpenAI News62

    OpenAI 发布主动型助手 dots

    OpenAI 发布 dots,将其定位为可跨复杂项目和日常任务持续工作的主动型助手。官方说明 dots 在推进工作的同时让用户保持控制,目前公开信息仅有这一摘要。

    推荐理由:OpenAI 官方发布 dots 这一主动型助手,读者可了解它在复杂项目与日常任务中的持续工作方式。

  4. AWS Machine Learning Blog60

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置文件提供服务,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:梳理 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,便于评估长任务智能体的成本取舍。

  5. AWS Machine Learning Blog62

    Claude Sonnet 5.5 上线 Amazon Bedrock 与 AWS 上的 Claude Platform

    AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 AWS 上的 Claude Platform 开放使用,定位为面向编码与知识工作的更高效 Sonnet 模型,多数任务单任务成本更低、速度更快。

    推荐理由:AWS 官方给出 Sonnet 5.5 在 Bedrock 上的能力定位与调用方式,可据此判断它和 Opus 5.5 的分工。

9月23日周三
  1. OpenAI News67

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型

    OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,将前沿智能带入日常工作。两款模型在能力与成本之间提供不同的平衡组合。

    推荐理由:OpenAI 一次推出两款 GPT-6 模型,读者可据此了解其在能力与成本上的不同取舍。

9月17日周四
  1. GitHub Blog · AI & ML75

    GitHub 用 Copilot 将 Copilot 运行时迁移到 Rust

    GitHub 用 Copilot 应用和 CLI 将 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,代码主要由 AI 智能体编写,跨 128 个 PR 增量合入 main,性能提升数个数量级。

    推荐理由:GitHub 工程师复盘用 Copilot 把运行时迁到 Rust 的全过程,含并发会话协作与提示缓存等可迁移经验。

9月16日周三
9月10日周四
  1. OpenAI News62

    OpenAI 发布 Agents API

    OpenAI 发布 Agents API,这是一个由 Codex harness 驱动的托管服务,用于构建和上线云端智能体。该服务支持编排、长时间运行的会话以及工具调用。

    推荐理由:OpenAI 官方发布托管式 Agents API,读者可了解其基于 Codex harness 的编排与长会话能力。

  2. OpenAI News62

    OpenAI 在 API 中推出 GPT-Live-1 语音模型

    OpenAI 在 API 中推出 GPT-Live-1,支持自然的全双工语音对话,并带来更强的指令遵循、自定义音色和电话(telephony)支持。

    推荐理由:OpenAI 在 API 中上线全双工语音模型,读者可据此判断语音应用的接入方式与能力边界。

9月9日周三
  1. OpenAI News78

    OpenAI 发布 GPT-6 Astra,面向企业工作场景

    OpenAI 发布 GPT-6 Astra,称其为面向企业的最强模型,具备更强的推理、计算机操作能力以及写作与设计判断力。

    推荐理由:OpenAI 官方发布面向企业的新一代模型,可了解其在推理与计算机操作上的能力定位。

9月8日周二
  1. Google DeepMind62

    Google DeepMind 发布 AlphaGenome Atlas,覆盖人类基因组 90 亿个单字母变异预测

    Google DeepMind 推出 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 倍以上,今日起通过网站门户、AlphaGenome API 和 Google Antigravity 中的 skill 向学术研究免费开放。

    推荐理由:原文给出 9 亿单核苷酸变异预测的规模与免费入口,读者可据此判断基因组变异解读的门槛变化。

  2. OpenAI News62

    OpenAI 发布 ChatGPT Images 2.5

    OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,更贴近用户原本的构想。

    推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解图像生成在个性化与成图质量上的新变化。

9月5日周六
  1. GitHub Blog · AI & ML60

    GitHub 推出 Project HydraFusion 多模型编排研究预览

    GitHub 发布 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型间选择执行方案,用户可在 GitHub Copilot CLI 中通过 /experimental 启用,按各模型标准费率计费。

    推荐理由:GitHub 官方给出多模型编排的三种执行模式与三项基准的成本质量对比,可据此判断编排式编码智能体的取舍。

9月3日周四
  1. Google DeepMind62

    Google DeepMind 推出 Fairwind Program,向政府与企业开放 Gemini 3.8 Flash Cyber

    Google DeepMind 推出 Fairwind Program,面向 Google Cloud 客户、政府机构和网络安全伙伴提供受限访问,首批开放 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具链,用于自主发现、验证并修复漏洞。

    推荐理由:原文给出受限访问计划的能力组合与准入条件,读者可据此判断前沿网络防御能力的开放节奏。

  2. Google DeepMind77

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,前者面向长周期编码与自主智能体,后者面向漏洞发现与自动修复。

    推荐理由:Gemini 3.8 Flash 在编码与智能体任务上逼近更贵的前沿模型,同时保持 3.7 Flash 的价格。

9月2日周三
  1. Google DeepMind71

    Google DeepMind 在 Gemini 3.7 Flash 等模型推出智能体视频理解

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 上推出智能体视频理解功能,官方称视频分析 token 消耗最多降低 88%、成本最多降低 66%、准确率最多提升 7%。

    推荐理由:官方给出 token 与成本降幅及可用入口,读者可据此判断长视频分析的成本结构变化。