Ideogram 发布 Ideogram 4.5,称可局部编辑图像而不影响其余部分
Ideogram 发布新模型 Ideogram 4.5,称其只修改用户指定的区域,其余部分保持不变,可减少多次编辑后的画面瑕疵。该模型提供四档质量档位,单张价格从 0.8 美分到 22 美分,均为原生 2K 分辨率,目标场景包括产品摄影、室内设计、照片修复和图像内文字编辑。
Ideogram 发布新模型 Ideogram 4.5,称其只修改用户指定的区域,其余部分保持不变,可减少多次编辑后的画面瑕疵。该模型提供四档质量档位,单张价格从 0.8 美分到 22 美分,均为原生 2K 分辨率,目标场景包括产品摄影、室内设计、照片修复和图像内文字编辑。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理,同时清除照片元数据。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全部在本地运行。
AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点跑 FLUX.2-klein-4B 生成图像,异步端点跑 Wan2.1-VACE-1.3B 做图像条件视频生成。文本提示词先生成 PNG,再连同运动提示词送入视频端点,生成的 MP4 存入 Amazon S3,示例还提供命令行流程和可选的 Streamlit 界面。
OpenAI 发布 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致的图像,更贴近用户原本的构想。
推荐理由:OpenAI 官方发布 ChatGPT Images 2.5,读者可了解图像生成在个性化与成图质量上的新变化。
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型,前者是 Nano Banana 系列中速度最快、成本最低的图像模型,后者支持高质量视频生成与对话式编辑。
推荐理由:两款新模型同时开放开发者入口,并给出延迟、价格与能力边界,便于评估多模态工作流成本。