在 Amazon Bedrock AgentCore 上用智能体 AI 扩展云迁移
AWS Professional Services 用四个 AI 智能体在 Amazon Bedrock AgentCore 上构建云迁移方案,将每应用 IaC 开发时间从 3 到 4 周缩短至分钟级,该方案覆盖 300+ 应用。
AWS Professional Services 用四个 AI 智能体在 Amazon Bedrock AgentCore 上构建云迁移方案,将每应用 IaC 开发时间从 3 到 4 周缩短至分钟级,该方案覆盖 300+ 应用。
Amazon Payments 在 Amazon SageMaker AI 上用多目标上下文多臂老虎机(LinUCB)为产品获客漏斗做个性化内容选择,七周线上 A/B 测试中,一个人群组的最终漏斗转化率取得高个位数相对提升,另一人群组则未见改善。
NVIDIA NeMo Agent Toolkit(NAT)可通过自定义 memory provider 接入 Amazon S3 Vectors,作为多智能体系统的持久记忆层,并部署在 Amazon EKS 上。
Amazon Bedrock AgentCore 支持构建"环境智能体"(ambient agent):由 Amazon S3 事件通知、EventBridge 规则、Lambda 触发器等事件流直接触发,而非等待用户发起对话,可并行处理多个事件。
AWS 发布 Claude Platform on AWS(CPonAWS)多环境访问实施指南,采用专用 AI Services 账户承载订阅与工作区,通过三种方式接入推理:AWS 工作负载账户用跨账户 SigV4 签名调用、开发者笔记本用工作区级 API key、外部环境用 OIDC 联合获取短期凭证。
uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词层面的输出优化,使其适配自身零售审核策略。
NVIDIA 提出 AI 工厂投资回报由三大要素决定:每兆瓦产出能力、硬件使用寿命和 token 需求。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 分之一。
Amazon Bedrock Knowledge Bases 新增 AgenticRetrieveStream API,可将多段式理赔问题拆成子查询并多轮检索,在证据充分后生成带引用的回答。
Amazon Bedrock AgentCore 新增 Runtime Instances 计算选项,基于 AWS 托管的 EC2 基础设施,支持最长 14 天会话、GPU、持久卷,并可在单实例上以 1:N 方式共置多个智能体。
MIT Transit Lab 获 Google.org 210 万美元资助,用于开发公共交通智能中枢 PTIQ,将公交机构的实时监控、运营控制与乘客沟通系统整合为统一的 AI 编排平台。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网正式可用,Cognition 的 Devin 成为首个在生产环境运行该平台、并跑出 SWE-2 推理 token 吞吐量较 GB200 NVL72 最高提升 4.8 倍的客户。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让请求仅在 ap-south-1 与 ap-south-2 之间路由,数据留在印度境内。
Amazon Bedrock 现已在首尔和新加坡支持 Anthropic Claude 模型的区域内推理:首尔支持 Claude Opus 5 和 Claude Sonnet 5,新加坡支持 Claude Sonnet 5,均通过 bedrock-runtime 端点调用。
基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台在 AWS 上构建,用 AI 智能体从合同 PDF 中抽取八个关键字段并交叉验证,解决 RAG 语义搜索无法跨数百份合同做聚合统计的问题。
Condé Nast 与 AWS 生成式 AI 创新中心(GenAIIC)合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,并选用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 AWS 上的 Claude Platform 开放使用,定位为面向编码与知识工作的更高效 Sonnet 模型,多数任务单任务成本更低、速度更快。
推荐理由:AWS 官方给出 Sonnet 5.5 在 Bedrock 上的能力定位与调用方式,可据此判断它和 Opus 5.5 的分工。
AWS 发布教程,演示如何用 vLLM-Omni DLC 在 Amazon SageMaker AI 上部署 Qwen3-TTS,通过 SageMaker 双向流式连接实现文本流入、24 kHz PCM 音频分块流出,并配 Gradio 应用试用。
AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点跑 FLUX.2-klein-4B 生成图像,异步端点跑 Wan2.1-VACE-1.3B 做图像条件视频生成。文本提示词先生成 PNG,再连同运动提示词送入视频端点,生成的 MP4 存入 Amazon S3,示例还提供命令行流程和可选的 Streamlit 界面。
AWS 博客介绍用 Amazon Nova Act 结合 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,以自然语言动作替代 Selenium、Playwright 的 DOM 选择器脚本。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
GitHub Copilot 应用重建了 pull request 视图,以应对包含 2,200 个文件、超百万行改动和 400 多条行内评论的超大 PR。其做法是把文档高度拆成确定性的代码几何与动态评论块两套体系:代码行高提前精确计算,评论高度则惰性测量并锚定到文件、行与侧,使修正幅度小且不打断用户滚动。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新的诊断工具、显式断点以及可降低延迟与成本的控制项。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04。新版本提供 Isaac 技能与面向 AI 智能体的文档,FoundationPose 推理库让物体位姿感知与跟踪最高提速 5.5x,pick and place 成为独立技能。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 提出物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的全栈安全体系,并推出其称为首个也是唯一一个物理 AI 全栈安全系统 NVIDIA Halos。
NVIDIA 在埃及大埃及博物馆举办活动,展示当地 AI 生态从能力建设走向生产落地,其埃及 Deep Learning Institute 学员规模一年内增长超十倍。
NVIDIA 提出 AI 安全应作为工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。NVIDIA 同时通过 Open Secure AI Alliance 推动研究成果与工具共享。
NVIDIA 在纽约气候周重点介绍了 5 家用 AI 推进清洁能源的公司。ThinkLabs AI 借助 NVIDIA CUDA 打造数字孪生与智能体,帮助南加州爱迪生将电网并网申请评估时间从 30-45 天缩短到 2 分钟。
Pawprint Studio 的抓宠开放世界 RPG《Aniimo》本周首发登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck、新支持的 Firefox 浏览器等设备上串流游玩。本周还有 007 First Light 加入路径追踪,以及 Active Matter、Outer Wilds 等 11 款新游戏入库。
GitHub 用 Copilot 应用和 CLI 将 Copilot agent runtime 从 TypeScript 完全重写为超过 80 万行生产级 Rust,代码主要由 AI 智能体编写,跨 128 个 PR 增量合入 main,性能提升数个数量级。
推荐理由:GitHub 工程师复盘用 Copilot 把运行时迁到 Rust 的全过程,含并发会话协作与提示缓存等可迁移经验。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次预览提交中,Qwen3-VL 吞吐量最高达 GB300 NVL72 的 3.7 倍,DeepSeek-R1 上最高 2.5 倍。GB300 NVL72 以 288 GPU 四机架提交实现 99% 扩展效率,软件优化较 v6.0 带来最高 1.6 倍性能提升。
Emerald AI、Google 和 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),推动数据中心根据电网状况动态管理用电。
OpenAI 介绍如何用 ChatGPT Work 和 Codex 的分析能力,帮助团队了解 AI 使用量与支出、识别培训需求,并把 AI 采用情况与业务成果关联起来。
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式模型 Earth-2 CorrDiff,在英国国家 AI 超算 Isambard-AI 上训练出覆盖全英、分辨率 2-3 平方公里的空气污染模型,训练仅耗时两天。
GitHub 日本和韩国营销负责人用 GitHub Copilot 把活动运营流程自动化:以 GitHub Issue 为工作单元,Issue forms 收集结构化字段,label 触发 GitHub Actions 工作流,活动从单个 Issue 自动搭建、每日筛选报名者并在结束后自动清理。
OpenAI 将 Habitat 从 Python 库演进为全球分布式存储平台,支撑 10 亿 ChatGPT 用户、每秒 2200 万次请求。该平台用于应对 ChatGPT 在线存储的规模化需求。
GitHub 发布 Project HydraFusion 研究预览,通过运行时编排在多个提供商的模型间选择执行方案,用户可在 GitHub Copilot CLI 中通过 /experimental 启用,按各模型标准费率计费。
推荐理由:GitHub 官方给出多模型编排的三种执行模式与三项基准的成本质量对比,可据此判断编排式编码智能体的取舍。
Berkeley Sky Lab 将进化式 kernel 搜索框架 K-Search 扩展出 MLX 后端,通过结构化 CUDA-to-MLX 翻译层把已有 CUDA kernel 作为知识库迁移到 Apple Silicon。