跳到正文

全部动态

今日 10 条
9月2日周三
8月28日周五
  1. Google DeepMind66

    Google DeepMind 发布 Gemini Omni 1.1 Flash

    Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者带来更可控的生成视频能力,通过 Gemini API 在 Google AI Studio 提供。

    推荐理由:原文列出场景延长、首尾帧插值与 4K 放大等具体能力变化,可据此判断生成视频工作流的可控程度。

8月27日周四
8月21日周五
8月14日周五
8月12日周三
  1. Google DeepMind74

    Google DeepMind 发布 SL2T 手语转文本模型,率先落地 Pixel 11 的 Gboard 与 Live Transcribe

    Google DeepMind 发布多语言手语转文本模型 SL2T,可将手语直接翻译为流式文本,首批支持美国手语(ASL)转英文,并已接入 Pixel 11 的 Gboard 与 Live Transcribe,后续将扩展更多设备与语言。

    推荐理由:官方披露 SL2T 的训练数据规模、手语到文本的翻译路径与隐私处理方式,可了解手语 AI 落地的技术取舍。

8月6日周四
  1. Google DeepMind78

    Google DeepMind 开源 WeatherNext 气旋预测模型

    Google DeepMind 发布 WeatherNext AI 模型,在气旋路径、强度和风场结构预测上达到 SOTA,平均多出一天预警时间,三天预报精度相当于此前模型的两天水平。

    推荐理由:原文给出模型在气旋路径与强度预测上的精度提升幅度,并说明代码与权重已开源,读者可据此判断气象预报的可用性变化。

8月4日周二
  1. Microsoft Research62

    微软研究院开源 Orchard:面向可扩展智能体 AI 的开放框架

    微软研究院发布开源框架 Orchard,核心是 Kubernetes 环境服务 Orchard Env,可跨任务复用同一套环境、数据管线与评测流程,并支持在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中直接训练智能体。

    推荐理由:微软研究院开源 Orchard 框架,公开环境服务、训练流程与数据,可复用其方法搭建智能体训练环境。

7月30日周四
  1. Google DeepMind62

    Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型

    Google DeepMind 发布面向机器人具身推理的 Gemini Robotics ER 2,作为高层大脑负责理解物理世界、规划多步任务,并把动作执行交给底层 VLA 模型,同时原生支持调用 Google Search 等工具。

    推荐理由:官方给出进度分类、时刻定位与多机协作的具体指标,可据此判断机器人高层推理的当前水位。

  2. Google DeepMind58

    Google DeepMind 在 Flow Music 发布音乐生成模型 Lyria 3.5

    Google DeepMind 发布新一代音乐生成模型 Lyria 3.5,并已在 Google Flow Music 中上线。官方称其在音乐性、歌词、人声和创作控制四方面均有提升,包括更丰富自然的旋律结构、提示词遵循度和结构感知更好的歌词、更具情感表达和发音改进的人声,以及对输出节奏和时长的更易控制。

7月29日周三
7月28日周二
7月26日周日
  1. Berkeley AI Research22

    Berkeley AI Research 提出 ABBEL:用信念状态监督让 LLM 高效完成长程交互

    Berkeley AI Research 提出 ABBEL 框架,将 LLM 的摘要隔离为自然语言"信念状态"并对其内容进行监督评分,以替代完整交互历史作为智能体的工作上下文。在协作编程基准 CollabBench 上,采用基于重构的信念评分后,ABBEL 将相对全上下文模型的性能差距缩小约 50%,训练步数从 100 步降至 50 步,峰值上下文 token 长度也显著低于全上下文设置。

7月21日周二
7月17日周五
  1. Google DeepMind71

    Google DeepMind 发布 Gemini 3.5 Flash Cyber 安全模型

    Google DeepMind 发布 Gemini 3.5 Flash Cyber,这是基于 3.5 Flash 微调的轻量网络安全模型,用于快速发现、验证和修补漏洞,在 CyberGym 等基准上以多次调用取得接近更大模型的表现。

    推荐理由:原文给出轻量安全模型的基准对比与限量开放方式,读者可据此判断其成本与部署路径。

7月16日周四
  1. Google DeepMind40

    Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案

    Google DeepMind 与 Isomorphic Labs 公布联合生物韧性方案,从预防、检测、响应三方面防止模型被滥用,并推动 AI 用于应对疫情。过去 12 个月,双方已与政府机构、生物安全组织和研究团体推进超过 15 项合作。方案包括将 SynthID 水印技术适配生物学、用 AlphaEvolve 优化宏基因组测序算法,并向可信研究者开放模型以加速疫苗设计。

7月13日周一
7月7日周二
7月3日周五
  1. Google DeepMind45

    Google DeepMind 与 A24 宣布首个此类研究合作

    Google DeepMind 与 A24 宣布达成首个此类研究合作,将顶尖研究实验室与电影制作公司配对,帮助艺术家开发新工作流与技术。合作将跨越多个项目,让 A24 及其电影人直接参与塑造新技术,同时为 Google DeepMind 提供艺术家反馈。Google 还对 A24 进行了投资,具体目标与技术产出将随时间演进。

7月1日周三
  1. Berkeley AI Research22

    2026 届 BAIR 博士毕业生展示:从机器人到 LLM 推理的研究全景

    伯克利人工智能研究实验室(BAIR)展示 2026 届博士毕业生,研究方向覆盖机器人、具身智能、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for science 与医疗。毕业生去向包括 OpenAI、Mistral AI、Physical Intelligence、Amazon 等机构,以及 UCLA、普林斯顿 CITP 和芝加哥大学等学术岗位。

6月25日周四
6月17日周三
  1. Google DeepMind60

    Google DeepMind 与英国政府共建 AI 规划原型,目标将审批时间减半

    Google DeepMind 与英国政府、Google Cloud、Faculty 及 Barnet、Camden、Dorset 地方规划部门合作,开发一款基于 Gemini 的 AI 规划原型,目标是帮助审批人员将住户规划申请的决定时间缩短 50%。

    推荐理由:原文给出英国政府与 Google DeepMind 共建规划原型的目标、试点范围与上线时间,可据此判断 AI 进入公共审批流程的落地方式。

6月16日周二
  1. Google DeepMind38

    Google DeepMind 发布 AI Control Roadmap,为 AI 智能体构建纵深防御

    Google DeepMind 发布 AI Control Roadmap,用纵深防御思路保障内部部署的 AI 智能体安全,在模型对齐之外增加系统级防护。该框架借鉴 MITRE ATT&CK 建立 AI 威胁建模,将不受信智能体视为内部威胁,并用可信 AI 作为监督者审查其推理与行动。团队已分析 100 万个编码智能体任务,并据此为 Gemini Spark 智能体搭建实时监控。

6月11日周四
  1. Google DeepMind66

    Google DeepMind 发布 DiffusionGemma:文本生成最高提速 4 倍

    Google DeepMind 发布实验性开源模型 DiffusionGemma,采用文本扩散方式一次性生成整块文本,在专用 GPU 上推理速度最高提升 4 倍,单张 NVIDIA H100 上超过 1000 tokens/秒,RTX 5090 上超过 700 tokens/秒。

    推荐理由:官方给出 26B MoE 文本扩散模型的速度、显存占用与质量取舍,便于判断本地低并发场景是否适用。

6月10日周三
6月9日周二
  1. Google DeepMind74

    Google DeepMind 发布 Gemma 4 12B:统一的无编码器多模态模型

    Google DeepMind 发布 Gemma 4 12B,一款面向笔记本本地运行的多模态模型,采用无编码器统一架构,视觉和音频输入直接进入 LLM 主干。官方称其基准表现接近 26B MoE 模型,内存占用不到后者一半,可在 16GB VRAM 或统一内存上运行,也是该系列首个支持原生音频输入的中等规模模型。

    推荐理由:Gemma 4 12B 用无编码器架构把多模态能力压到 16GB 显存,可对照其与 26B MoE 的取舍。

6月8日周一
  1. Google DeepMind66

    Google DeepMind 在塞拉利昂测量 AI 学习效果

    Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于八周内取得 1.2 至 1.7 年的常规学习进展。

    推荐理由:塞拉利昂预注册随机对照试验给出了 Guided Learning 的量化增益与师生互动数据,可了解 AI 辅助教学的实证路径。

5月22日周五
  1. Google DeepMind22

    Google DeepMind 在亚太推出“AI for the Planet”加速器计划,应对环境风险

    Google DeepMind 在亚太地区启动首届加速器计划,聚焦“AI for the Planet”,面向该地区初创公司、研究团队和非营利组织,为期三个月。入选机构将获得专家指导,以及 Google AI 专家协助将前沿 AI 和科学 AI 模型集成到其项目或产品中,覆盖自然、气候、农业、能源等领域。计划以在新加坡举办的线下训练营启动,现已开放注册意向。

5月19日周二
  1. Google DeepMind62

    Google DeepMind 用 Co-Scientist 加速逆转细胞衰老的基因线索发现

    Google DeepMind 介绍生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 使用 Co-Scientist 加速衰老研究。Co-Scientist 扫描数万篇论文后提出 20 多个新的候选基因因子,实验室测试验证了其中几个假设,成功让细胞进入更年轻状态并改善整体功能。它还能将原本需要长达六个月的筛选数据分析缩短到几天。

    推荐理由:原文给出 Co-Scientist 在衰老研究中的具体产出与验证结果,可了解 AI 辅助科研的实际落地方式。

5月18日周一
  1. Google DeepMind62

    Google DeepMind 为 Project Genie 加入 Street View 真实场景能力

    Google DeepMind 在实验性原型 Project Genie 中上线 Street View 场景锚定能力,可基于美国真实地点生成可交互世界,并支持 Ocean World、Desert Sands、Stone Age、B&W film 等风格。

    推荐理由:Google 把 Genie 的世界模型与 Street View 真实影像打通,读者可了解智能体训练环境如何从纯生成走向现实锚定。

5月17日周日
5月16日周六
  1. Google DeepMind38

    Google DeepMind 与新加坡达成国家 AI 合作,落地医疗、教育与科研项目

    Google DeepMind 与新加坡政府达成国家 AI 合作,在医疗、教育、科研等领域推出新项目。合作探索 AI 辅助临床的"三方照护"模式,并用 AlphaFold、Google Earth 等工具推进东南亚传染病研究与疫情防控。Google 还向新加坡中小学至初级学院全体教育者提供 Gemini for Education,并在亚太启动"AI for the Planet"加速器。

  2. Google DeepMind40

    剑桥大学教授用 Google Co-Scientist 寻找跨物种传染病的分子开关

    剑桥大学 Clare Bryant 教授使用 Google Co-Scientist 研究流感等病原体跨物种传播时引发败血症等重症的分子开关,该工具生成并排序了一批候选假说,其中一个她此前未关注的蛋白与多个她感兴趣的信号通路相关。她随后加入未发表数据反复迭代,将假说从候选蛋白细化到具体氨基酸。Bryant 表示,原本需两到三年的氨基酸定位实验工作,其团队目前有望在六个月内完成。