Graphite 研究:Opus 5.5 爱说 this matters,各模型写作习惯各有特征
营销公司 Graphite 发布研究,分析前沿模型的写作习惯,找出 13000 个在 AI 内容中出现频率至少为人类内容两倍的短语。
营销公司 Graphite 发布研究,分析前沿模型的写作习惯,找出 13000 个在 AI 内容中出现频率至少为人类内容两倍的短语。
研究团队开发的 Ataraxos 在 Stratego 对局中以 85% 的有效胜率击败史上最强选手 Niemeijer,此前 DeepMind 的 DeepNash 未能突破顶尖人类水平。
Google 研发出一种可为 AI 设计蛋白质添加水印的方法,旨在服务生物安全,并可与一款流行的 AI 蛋白质设计工具配合使用。
Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于八周内取得 1.2 至 1.7 年的常规学习进展。
推荐理由:塞拉利昂预注册随机对照试验给出了 Guided Learning 的量化增益与师生互动数据,可了解 AI 辅助教学的实证路径。
Google DeepMind 介绍生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 使用 Co-Scientist 加速衰老研究。Co-Scientist 扫描数万篇论文后提出 20 多个新的候选基因因子,实验室测试验证了其中几个假设,成功让细胞进入更年轻状态并改善整体功能。它还能将原本需要长达六个月的筛选数据分析缩短到几天。
推荐理由:原文给出 Co-Scientist 在衰老研究中的具体产出与验证结果,可了解 AI 辅助科研的实际落地方式。
剑桥大学 Clare Bryant 教授使用 Google Co-Scientist 研究流感等病原体跨物种传播时引发败血症等重症的分子开关,该工具生成并排序了一批候选假说,其中一个她此前未关注的蛋白与多个她感兴趣的信号通路相关。她随后加入未发表数据反复迭代,将假说从候选蛋白细化到具体氨基酸。Bryant 表示,原本需两到三年的氨基酸定位实验工作,其团队目前有望在六个月内完成。
Calico Life Sciences 的 Matt Onsum 与 Katherine Labbé 正使用 Google 的 Co-Scientist 整合衰老生物学中零散的研究发现并生成可验证假设。在整合应激反应(ISR)研究中,该工具提出了代谢调控 ISR 的新假设,团队据此优化实验设计并持续输入新结果,实验已产生对 ISR 在健康与疾病中作用有重要意义的新发现,团队计划发表这些结果。
爱丁堡大学团队用 Google Co-Scientist 研究 MASH 肝病,系统提出 NLRP3 炎症小体是连接炎症与代谢的分子桥梁,该假设随后经实验验证。面对潜在药物组合数量爆炸的问题,Co-Scientist 综合肝生物学与药理学证据,筛选出值得关注的机制和候选联合疗法。它还被用于解释已获批药物 resmetirom 为何仅对少数符合条件的 MASH 患者有效。
Google DeepMind 的 Co-Scientist 帮助 MIT 的 Ritu Raman 快速梳理 ALS 相关文献,将想法转化为可检验假设并按可行性排序。
斯坦福大学医学院遗传学家 Gary Peltz 团队在《Advanced Science》发表研究,用 Google DeepMind 的 Co-Scientist 从现有药物文献中寻找可重用于治疗肝纤维化的候选药。
Google DeepMind 宣布 AI co-clinician 研究计划,探索 AI 智能体在医生监督下协助患者诊疗的“三方照护”模式。在 98 个真实初级保健查询的盲评中,该系统 97 例无关键错误,优于医生常用的两款 AI 系统;在 140 项问诊技能评估中,AI 在 68 项达到或超过初级保健医生水平,但专家医生在识别危险信号和指导关键体格检查上整体更优。
推荐理由:Google DeepMind 公开医疗 AI 智能体的多模态评测结果,读者可了解 AI 在临床场景中的能力边界与协作定位。
Google DeepMind 发布 Decoupled DiLoCo 分布式训练架构,将训练任务拆分为异步通信的"计算孤岛",在硬件故障下仍能持续训练并自动恢复。该架构用 Gemma 4 模型验证,ML 性能与传统方法持平,并在美国四个区域以 2-5 Gbps 网络训练了 120 亿参数模型,速度比传统同步方法快 20 倍以上,还支持 TPU v6e 与 TPU v5p 混合训练。