Natura 发布 99 美元智能戒指 Interface,主打 AI 智能体语音交互
Natura 推出售价 99 美元的智能戒指 Interface,主打通过手指按键向 AI 智能体发出来完成任务的指令,并可连接 Claude、ChatGPT、Grokbot 等多种智能体与应用。戒指同时具备心率、HRV、睡眠等健康追踪功能,续航 6 至 12 天,100 分钟可充满电。预购将于下月开启,预计十二月或一月发货,三至六个月免费试用后计划收取 9 美元月订阅费。
Natura 推出售价 99 美元的智能戒指 Interface,主打通过手指按键向 AI 智能体发出来完成任务的指令,并可连接 Claude、ChatGPT、Grokbot 等多种智能体与应用。戒指同时具备心率、HRV、睡眠等健康追踪功能,续航 6 至 12 天,100 分钟可充满电。预购将于下月开启,预计十二月或一月发货,三至六个月免费试用后计划收取 9 美元月订阅费。
Google 发布实验性 AI 笔记应用 Google AI Edge Foresight,可在 macOS 上完全离线转录会议和录音,底层使用端侧 EmbeddingGemma 2 模型。
Falcon-ASR 是一款由阿联酋 Technology Innovation Institute 推出的 1.6B 参数语音识别模型,主打阿拉伯语及阿联酋方言,并共用同一组权重支持英语、法语、西班牙语和葡萄牙语。
AWS 在博客中演示如何在 Amazon Bedrock AgentCore 上搭建航司语音旅行管家,核心是用 Amazon Nova 2.5 Sonic 做实时语音交互,通过 Strands Agents 框架和 AgentCore Gateway 以 MCP 协议连接后端服务,支持改座位、查航班、改餐食、答政策问题并可转接人工坐席。
Google 开放 SynthID Detector,公众可检测由 Google 及其合作伙伴生成的图像、视频和音频是否带有 SynthID 水印。该工具支持 JPG、PNG、MP4 和 MP3,可识别 Gemini、Veo、Lyria 等模型内容,但无法检测未嵌入 SynthID 水印的 AI 内容。
Hugging Face 推出 Open TTS Leaderboard,采用客观指标对开源及多语言 TTS 模型进行可扩展评测,覆盖英文、中文等多语种 Seed TTS Eval 与 CV3 Eval 数据集,并加入声音克隆(voice cloning)维度的说话人相似度对比。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将近实时视频生成与语音对话原生结合,为企业用户带来带视觉形象、唇形同步和自然表情的多模态对话体验。
Google DeepMind 发布两款文本转语音模型 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS,分别面向深度创意角色设计与高吞吐低成本场景。
推荐理由:两款 TTS 模型在多角色台词导演、长音频一致性和音色克隆安全机制上做了系统级说明,读者可对照自身配音与多语种本地化场景评估。
Google DeepMind 推出两款实时语音对话模型 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,面向语音 Agent 与对话场景,强调并行推理与低延迟。
推荐理由:同一篇官方文章同时给出实时语音模型的评测名次、上线渠道与多语言能力,便于读者对照自身场景选择发布能力。