助听技术初创公司 Legato 推出 AI 助听眼镜 Legato Frames
助听技术初创公司 Legato 宣布其 AI 助听眼镜 Legato Frames 正式开售,起售价 999 美元,面向轻中度听力损失的成年人。该眼镜把助听技术集成在镜腿中,用 AI 区分人声与背景噪声并放大前者,双扬声器系统将声音导向佩戴者,耳外几英寸处声音可降低 99%。
助听技术初创公司 Legato 宣布其 AI 助听眼镜 Legato Frames 正式开售,起售价 999 美元,面向轻中度听力损失的成年人。该眼镜把助听技术集成在镜腿中,用 AI 区分人声与背景噪声并放大前者,双扬声器系统将声音导向佩戴者,耳外几英寸处声音可降低 99%。
Simon Willison 用 GPT-6 Astra 构建了实验性工具 Photo Scrubber,可自动识别人脸并模糊处理,同时清除照片元数据。该工具基于 Google 的 MediaPipe C++ 库,通过 @mediapipe/tasks-vision 编译为 WebAssembly,并使用 BlazeFace 人脸检测模型,全部在本地运行。
Google DeepMind 发布多语言手语转文本模型 SL2T,可将手语直接翻译为流式文本,首批支持美国手语(ASL)转英文,并已接入 Pixel 11 的 Gboard 与 Live Transcribe,后续将扩展更多设备与语言。
推荐理由:官方披露 SL2T 的训练数据规模、手语到文本的翻译路径与隐私处理方式,可了解手语 AI 落地的技术取舍。
Berkeley Sky Lab 将进化式 kernel 搜索框架 K-Search 扩展出 MLX 后端,通过结构化 CUDA-to-MLX 翻译层把已有 CUDA kernel 作为知识库迁移到 Apple Silicon。
Google DeepMind 发布 Gemma 4 12B,一款面向笔记本本地运行的多模态模型,采用无编码器统一架构,视觉和音频输入直接进入 LLM 主干。官方称其基准表现接近 26B MoE 模型,内存占用不到后者一半,可在 16GB VRAM 或统一内存上运行,也是该系列首个支持原生音频输入的中等规模模型。
推荐理由:Gemma 4 12B 用无编码器架构把多模态能力压到 16GB 显存,可对照其与 26B MoE 的取舍。