Amazon Payments 如何用 Amazon SageMaker AI 上的上下文多臂老虎机提升获客漏斗转化率
Amazon Payments 在 Amazon SageMaker AI 上用多目标上下文多臂老虎机(LinUCB)为产品获客漏斗做个性化内容选择,七周线上 A/B 测试中,一个人群组的最终漏斗转化率取得高个位数相对提升,另一人群组则未见改善。
Amazon Payments 在 Amazon SageMaker AI 上用多目标上下文多臂老虎机(LinUCB)为产品获客漏斗做个性化内容选择,七周线上 A/B 测试中,一个人群组的最终漏斗转化率取得高个位数相对提升,另一人群组则未见改善。
NVIDIA NeMo Agent Toolkit(NAT)可通过自定义 memory provider 接入 Amazon S3 Vectors,作为多智能体系统的持久记忆层,并部署在 Amazon EKS 上。
柏林初创公司 Restate 完成 2000 万美元 A 轮融资,由 Singular 领投,Redpoint Ventures 和 Capital One Ventures 参投。Restate 提供持久化工作流执行引擎,自建存储、复制与冗余层,客户包括 Replit 及财富 500 强金融企业。新资金将用于组建市场团队、扩充工程师并扩展旧金山湾区办公室。
Cerebras Systems CEO 兼联合创始人 Andrew Feldman 将在 TechCrunch Disrupt 2026 登台,探讨 AI 能否持续扩展。
Destro 结束隐身模式并获得 800 万美元种子轮融资,其 AI 智能层让机器人在物流场景中作业,同时指挥人类工人配合。Destro 基于开放权重视觉-语言-动作模型的 Vision 操作系统和 Mothership 操作系统,已在 Yusen Logistics 一处设施试点 3 台 Miva Robotics 搬运机器人,现扩展至 26 台,并在南加州启动 17 台机器人的新试点。
Amazon Bedrock AgentCore 支持构建"环境智能体"(ambient agent):由 Amazon S3 事件通知、EventBridge 规则、Lambda 触发器等事件流直接触发,而非等待用户发起对话,可并行处理多个事件。
AWS 发布 Claude Platform on AWS(CPonAWS)多环境访问实施指南,采用专用 AI Services 账户承载订阅与工作区,通过三种方式接入推理:AWS 工作负载账户用跨账户 SigV4 签名调用、开发者笔记本用工作区级 API key、外部环境用 OIDC 联合获取短期凭证。
uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词层面的输出优化,使其适配自身零售审核策略。
NVIDIA 提出 AI 工厂投资回报由三大要素决定:每兆瓦产出能力、硬件使用寿命和 token 需求。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百万 token 成本低至 45 分之一。
前 Google 云业务、SpaceX Starlink 工程师 Rama Afullo 创办的 Satlyt 完成 800 万美元种子轮,由休斯顿 Non Sibi Ventures 领投,用于为卫星打造可在轨运行 AI 模型的软件。
Latent Space 在 OpenAI DevDay 后采访了负责 Computer Use 产品与工程的 Ari Weinstein 和 API 产品负责人 Nikunj Handa。
硬件设计 AI 工具公司 Flow Engineering 完成 5000 万美元 B 轮融资,估值达 7.5 亿美元,由 Valor Equity Partners 的 Antonio Gracias 与 Atreides Management 的 Gavin Baker 联合领投,红杉资本参投。
OpenAI 与 Synopsys 签署多年战略合作,将打造名为 GPT-Synopsys 的专用芯片设计 AI 模型,把 OpenAI 的 AI 技术与 Synopsys 的 EDA 工具结合,OpenAI 为此授权使用 Synopsys 的 EDA 工具。
Amazon Bedrock Knowledge Bases 新增 AgenticRetrieveStream API,可将多段式理赔问题拆成子查询并多轮检索,在证据充分后生成带引用的回答。
Amazon Bedrock AgentCore 新增 Runtime Instances 计算选项,基于 AWS 托管的 EC2 基础设施,支持最长 14 天会话、GPU、持久卷,并可在单实例上以 1:N 方式共置多个智能体。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统搭配 Spectrum-X 102.4T 以太网正式可用,Cognition 的 Devin 成为首个在生产环境运行该平台、并跑出 SWE-2 推理 token 吞吐量较 GB200 NVL72 最高提升 4.8 倍的客户。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让请求仅在 ap-south-1 与 ap-south-2 之间路由,数据留在印度境内。
Amazon Bedrock 现已在首尔和新加坡支持 Anthropic Claude 模型的区域内推理:首尔支持 Claude Opus 5 和 Claude Sonnet 5,新加坡支持 Claude Sonnet 5,均通过 bedrock-runtime 端点调用。
基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台在 AWS 上构建,用 AI 智能体从合同 PDF 中抽取八个关键字段并交叉验证,解决 RAG 语义搜索无法跨数百份合同做聚合统计的问题。
Condé Nast 与 AWS 生成式 AI 创新中心(GenAIIC)合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,并选用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体产品,由 Astra 模型驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出 ChatGPT Space 供团队协作。
推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际落地情况。
HPE 提出,当 AI 从试验走向客服、IT、研究等常驻生产负载,按 token 消费的模式会让支出变成难以预测的月度变动项,企业需按负载判断是否转向自有算力。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 AWS 上的 Claude Platform 开放使用,定位为面向编码与知识工作的更高效 Sonnet 模型,多数任务单任务成本更低、速度更快。
推荐理由:AWS 官方给出 Sonnet 5.5 在 Bedrock 上的能力定位与调用方式,可据此判断它和 Opus 5.5 的分工。
AWS 发布教程,演示如何用 vLLM-Omni DLC 在 Amazon SageMaker AI 上部署 Qwen3-TTS,通过 SageMaker 双向流式连接实现文本流入、24 kHz PCM 音频分块流出,并配 Gradio 应用试用。
AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点跑 FLUX.2-klein-4B 生成图像,异步端点跑 Wan2.1-VACE-1.3B 做图像条件视频生成。文本提示词先生成 PNG,再连同运动提示词送入视频端点,生成的 MP4 存入 Amazon S3,示例还提供命令行流程和可选的 Streamlit 界面。
AWS 博客介绍用 Amazon Nova Act 结合 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,以自然语言动作替代 Selenium、Playwright 的 DOM 选择器脚本。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
Remedy Entertainment 的 CONTROL Resonant 已在发售当日上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能串流,支持 DLSS 4、光线追踪、NVIDIA Reflex 和最高 5K HDR,无需 100GB 本地安装。
GitHub Copilot 应用重建了 pull request 视图,以应对包含 2,200 个文件、超百万行改动和 400 多条行内评论的超大 PR。其做法是把文档高度拆成确定性的代码几何与动态评论块两套体系:代码行高提前精确计算,评论高度则惰性测量并锚定到文件、行与侧,使修正幅度小且不打断用户滚动。
Airbnb 正在扩大 GPT-6 Astra 及 OpenAI 前沿模型的使用范围,帮助工程团队排查 bug、设计系统并加快交付。
GPT-6 改进了提示词缓存,带来更高的缓存命中率、新的诊断工具、显式断点以及可降低延迟与成本的控制项。
Simon Willison 发布 llm 0.36。该版本于 2026 年 9 月 22 日发布,具体更新内容原文未披露。
NVIDIA 在 ROSCon 发布 Isaac ROS 5.0,新增智能体工作流与平台支持,支持 ROS Lyrical 和 Ubuntu 24.04。新版本提供 Isaac 技能与面向 AI 智能体的文档,FoundationPose 推理库让物体位姿感知与跟踪最高提速 5.5x,pick and place 成为独立技能。
TypeSafe AI 发布 Jev,这是其称为 System One 模型的新类别模型,输入文本后不返回文本,而是返回对应类别、是/否问题、评分及置信度的浮点数。
NVIDIA 推出 DSX Ready 认证计划,用于审核合作伙伴产品是否符合 NVIDIA DSX AI 工厂参考设计要求,首批覆盖电池储能系统(BESS)和冷却分配单元(CDU)两类。
NVIDIA 提出物理 AI 规模化部署需要覆盖硬件、软件、AI 行为与运行环境的全栈安全体系,并推出其称为首个也是唯一一个物理 AI 全栈安全系统 NVIDIA Halos。
NVIDIA 在埃及大埃及博物馆举办活动,展示当地 AI 生态从能力建设走向生产落地,其埃及 Deep Learning Institute 学员规模一年内增长超十倍。
NVIDIA 提出 AI 安全应作为工程问题处理,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。NVIDIA 同时通过 Open Secure AI Alliance 推动研究成果与工具共享。
NVIDIA 在纽约气候周重点介绍了 5 家用 AI 推进清洁能源的公司。ThinkLabs AI 借助 NVIDIA CUDA 打造数字孪生与智能体,帮助南加州爱迪生将电网并网申请评估时间从 30-45 天缩短到 2 分钟。
Pawprint Studio 的抓宠开放世界 RPG《Aniimo》本周首发登陆 GeForce NOW,玩家无需等待 45GB 下载即可在 Steam Deck、新支持的 Firefox 浏览器等设备上串流游玩。本周还有 007 First Light 加入路径追踪,以及 Active Matter、Outer Wilds 等 11 款新游戏入库。