Parallel 用 GPT-6 Astra 将研究时间和成本减半
Parallel 的智能体借助 GPT-6 Astra 研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
Parallel 的智能体借助 GPT-6 Astra 研究并综合劳动力市场数据,耗时和成本均降至此前模型的一半。
针对今夏一系列 AI 炒作事件,DAIR 执行总监 Timnit Gebru 指出,Anthropic 宣称 Claude Mythos 找漏洞能力超多数安全专家、OpenAI 与 Hugging Face 遭黑客攻击、以及两家公司相继宣称数学突破,经专家审视后均与宣传不符。她认为"超级智能"叙事源于超人类主义等意识形态,而非扎实的科学工程实践,并呼吁政策制定者咨询独立专家、不要依赖新闻稿。
OpenAI 提出针对前沿模型与防护措施的第三方 AI 安全评估优先事项与原则,强调评估需严谨、安全且独立。
TypeSafe AI 发布 Jev,这是其称为 System One 模型的新类别模型,输入文本后不返回文本,而是返回对应类别、是/否问题、评分及置信度的浮点数。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 提出物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的全栈安全体系,并推出其称为首个也是唯一一个物理 AI 全栈安全系统 NVIDIA Halos。
NVIDIA 在埃及大埃及博物馆举办活动,展示当地 AI 生态从能力建设走向生产落地,其埃及 Deep Learning Institute 学员规模一年内增长超十倍。
NVIDIA 提出 AI 安全应作为工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。NVIDIA 同时通过 Open Secure AI Alliance 推动研究成果与工具共享。
Higgsfield AI 借助 GPT-6 Astra,一天内上线新的视频功能,让小型企业的视频广告创作更简单,并更快将新创意工具推向市场。
OpenAI 正与一个独立的数学与人工智能咨询小组合作,为该领域新兴 AI 成果的评审与传播提供指导。
MIT Technology Review 发布对美国边境监控塔虚拟墙的调查,发现有人穿过 AI 监控区域未被发现后死亡,遗体数周或数月无人察觉,原因包括塔故障、算法未能识别人以及探员未响应警报。
MIT Technology Review 与 Times of San Diego 用 15 个月完成调查,绘制出首张美墨边境监控塔附近死亡情况的综合地图与分析。
NVIDIA 在纽约气候周重点介绍了 5 家用 AI 推进清洁能源的公司。ThinkLabs AI 借助 NVIDIA CUDA 打造数字孪生与智能体,帮助南加州爱迪生将电网并网申请评估时间从 30-45 天缩短到 2 分钟。
OpenAI 提出面向下一阶段 AI 的全球标准建设路径,呼吁通过协调一致的评估、报告与治理来提升安全性。
OpenAI Academy 新增多条学习路径,面向员工、开发者、领导者、教育者和学生,帮助他们构建并展示实用 AI 技能。
V7 借助 GPT-5.6 Luna 将成本降低 78%,同时提升准确率。V7 使用 GPT-5.6 把分散的公司文件转化为智能体可用的上下文,从而完成复杂的、带来源链接的工作。
Simon Willison 引用 voxium 的一段描述:作者入职一家大公司半个月,发现规格、代码、测试、PRD、工单及其处理、报告等全部由 Claude Code 生成,团队里没人喜欢这样,但被要求尽可能多地产出。高层多次表示推代码不是瓶颈,那为什么还慢;人们每天工作 12 到 13 小时只是为了按回车,从 L1 到 L7 的工程师都在做同样的事,没人读任何东西。
GPT-6 Astra 和 Fable 5.1 已足以在大部分经济领域产生变革性影响,经正确引导可可靠完成数周的人类工作量。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是连接工具与数据的标准接口;RAG 也并未消亡,而是为模型提供训练数据之外的相关信息。节目主张用标准做共享接口、用 Skills 承载流程与最佳实践,二者结合比争论谁取代谁更有价值。
OpenAI 发布澳大利亚青少年安全蓝图,这是一份包含六大支柱的路线图,旨在打造更安全的 AI 体验,以保护和赋能青少年。
Pawprint Studio 的抓宠开放世界 RPG《Aniimo》本周首发登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck、新支持的 Firefox 浏览器等设备上串流游玩。本周还有 007 First Light 加入路径追踪,以及 Active Matter、Outer Wilds 等 11 款新游戏入库。
Cooley 基于 ChatGPT Work 打造了 GO Public,把智能能力引入 IPO 流程,帮助律师更早发现问题,并将判断力集中在最关键之处。
GitHub 用 Copilot 应用和 CLI 将 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,代码主要由 AI 智能体编写,跨 128 个 PR 增量合入 main,性能提升数个数量级。
推荐理由:GitHub 工程师复盘用 Copilot 把运行时迁到 Rust 的全过程,含并发会话协作与提示缓存等可迁移经验。
OpenAI 发布 OpenAI for Law,为法律行业提供前沿智能、律所自定义工作流、互联的法律数据源,以及面向保密客户工作的法律级管控。
OpenAI 公布了一套用于追踪、调查和披露模型失准(misalignment)的框架,并同时发布六份关于模型意外或令人担忧行为的报告。
OpenAI 与 AARP 将在美国 10 座城市为 1,000 名老年人提供免费的 ChatGPT 实操工作坊,帮助他们安全地掌握实用 AI 技能。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍,DeepSeek-R1 上最高 2.5 倍。GB300 NVL72 以 288 GPU 四机架提交实现 99% 扩展效率,软件优化较 v6.0 带来最高 1.6 倍性能提升。
Emerald AI、Google 和 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态管理用电。
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents 和面向营销人员的工具,并集成 HubSpot 与 Shopify。
Hex 的数据智能体借助 GPT-6 Astra,把分析答案转化为可交互的可视化报告,供员工分享。
OpenAI 介绍如何用 ChatGPT Work 和 Codex 的分析能力,帮助团队了解 AI 使用量与支出、识别培训需求,并把 AI 采用情况与业务成果关联起来。
OpenAI 经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中的常态化环节。该研究聚焦员工实际使用行为,而非岗位定义本身。
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式模型 Earth-2 CorrDiff,在英国国家 AI 超算 Isambard-AI 上训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,训练仅耗时两天。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款模型,具体能力与开放方式尚未公布。
Fyxer 基于 OpenAI 模型、微调、记忆机制与真实用户反馈,为用户整理收件箱并按本人语气起草邮件。该产品定位为可信任的 AI 行政助理。
AI Snake Oil 发布逾 13000 字长文,用「AI 即普通技术」框架调和 AI 安全界与网络安全界对 OpenAI、Anthropic 失控事件的分歧。文章认为 OpenAI 未对智能体采取足够防护,但 AI 控制并非已解决问题,主张 AI 公司应对智能体行为担责,并投资控制方法研究、工具化与组织治理。
Perplexity 使用 GPT-6 Astra 撰写沟通内容、修改软件并监控生产系统,且相比早期模型,人工检查的频率大幅降低。
GitHub 日本和韩国营销负责人用 GitHub Copilot 把活动运营流程自动化:以 GitHub Issue 为工作单元,Issue forms 收集结构化字段,label 触发 GitHub Actions 工作流,活动从单个 Issue 自动搭建、每日筛选报名者并在结束后自动清理。
Cognition 借助 GPT-6 Astra 提升 Devin 测试软件并验证其可用的能力,目标是让工程师减少代码审查、加快交付。
OpenAI 将 Habitat 从 Python 库演进为全球分布式存储平台,支撑 10 亿 ChatGPT 用户、每秒 2200 万次请求。该平台用于应对 ChatGPT 在线存储的规模化需求。