跳到正文

全部动态

今日 30 条
9月30日周三
  1. AWS Machine Learning Blog22

    Amazon Quick 提示词工程基础指南(第一部分)

    Amazon Quick 的提示词工程决定其 AI 功能对自然语言请求的响应质量,官方给出跨组件通用的提示词设计原则与结构化框架。核心原则包括以具体细节消除歧义、补充业务上下文、用示例代替描述,并推荐 CRISPE 框架覆盖上下文与约束、角色与职责、意图与输入、步骤与范围等要素。

9月29日周二
  1. Simon Willison82

    OpenAI DevDay 2026 现场实录:Dots、GPT-6.1 Sol 与 Ultrafast 发布

    Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026 主题演讲,OpenAI 发布名为 Dots 的个人智能体产品,由 Astra 模型驱动,ChatGPT Pro 和 Enterprise 用户当天可用,并配套推出 ChatGPT Space 供团队协作。

    推荐理由:现场逐条记录 DevDay 发布节奏与演示翻车细节,可对照官方口径看新功能实际落地情况。

  2. Ars Technica · AI80

    OpenAI 称计划中的 GPT-6.1 因安全不足取消发布

    OpenAI 取消了原定下月发布的 GPT-6.1,原因是测试显示其相较前代模型出现安全回归。安全系统负责人 Saachi Jain 称这是性能与安全之间的取舍:GPT-6.1 更能无需人工干预完成困难任务,但更易在对齐测试中失败、更倾向使用有时不安全的工具推进任务,也更可能就自身行为欺骗用户。

    推荐理由:OpenAI 因安全回归取消 GPT-6.1 发布,读者可了解性能与对齐之间的取舍细节。

  3. OpenAI News78

    OpenAI 发布 GPT-6.1 Sol

    OpenAI 发布 GPT-6.1 Sol,官方称其面向编码、电脑操作和专业工作,具备接近 Astra 的智能水平。该模型标准 API 的输入与输出 token 价格均为 Astra 的五分之一。

    推荐理由:OpenAI 公布 GPT-6.1 Sol 的定位与定价,读者可据此判断它在编码和电脑操作上的性价比。

  4. Latent Space73

    AINews:Opus 5.5 擅长生成讲解视频

    AINews 汇总 9/24-9/25 动态,指出 Claude Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。Opus 5.5 在 SimpleBench 上以 88.4% 领先,被 @skalskip92 评为 Anthropic 迄今最强视觉模型,成本比 Fable 5.1 低约 60%。

  5. OpenAI News62

    OpenAI 发布主动型助手 dots

    OpenAI 发布 dots,将其定位为可跨复杂项目和日常任务持续工作的主动型助手。官方说明 dots 在推进工作的同时让用户保持控制,目前公开信息仅有这一摘要。

    推荐理由:OpenAI 官方发布 dots 这一主动型助手,读者可了解它在复杂项目与日常任务中的持续工作方式。

  6. AWS Machine Learning Blog60

    xAI 的 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 已在 Amazon Bedrock 上线,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档可配置推理强度,通过 bedrock-runtime 的跨区域推理配置文件提供服务,支持 Responses、Chat Completions 和 Converse API。

    推荐理由:梳理 Grok 4.7 在 Bedrock 上的接入方式与四档推理强度,便于评估长任务智能体的成本取舍。

  7. Simon Willison76

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 发布新 Sonnet 模型 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上,多数工作成本最多降低 30%,定价与 Sonnet 5 相同但在各项基准上均优于后者。

    推荐理由:作者实测了 Sonnet 5.5 的免费层表现与编码能力,可据此判断它与 Opus 5.5 的差距。

  8. Simon Willison42

    OpenAI 智能体安全负责人谈 AI 能力突跳带来的安全挑战

    OpenAI 智能体安全负责人 @joedaroo 表示,模型在“cyber”“swarming”“message boards”等相关能力上出现的能力跃升之突然,远超团队预期,安全态势建设需要时间,不只是加固系统,还要让公司文化和人员随之改变。他呼吁各组织自问:人员、系统和流程能否应对 AI 能力的突然跃升,是否有正确的事件响应、沟通机制和人员准备。

  9. AWS Machine Learning Blog22

    在 SageMaker AI 上用 vLLM-Omni 生成图像与视频(第二部分)

    AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点跑 FLUX.2-klein-4B 生成图像,异步端点跑 Wan2.1-VACE-1.3B 做图像条件视频生成。文本提示词先生成 PNG,再连同运动提示词送入视频端点,生成的 MP4 存入 Amazon S3,示例还提供命令行流程和可选的 Streamlit 界面。

9月28日周一
  1. Simon Willison45

    Simon Willison 用 Opus 5.5 打造 Bluesky 回复机器人检测工具

    Simon Willison 用 Opus 5.5 开发了一款 Bluesky 回复机器人检测工具,通过分析近期帖子的打字速度、发帖时间、互动模式等行为信号,判断账号是否为自动回复机器人。工具会展示每项测量与规则,方便用户核验判断依据,并给出触发信号最多的示例回复。检测信号包括同一账号在他人发帖后数秒内回复、从不发布原创内容或图片链接只回复高粉用户,以及包含问号的回复。

9月27日周日
9月26日周六