返回本期 · Back to 2026-08-22 博客文章 · Blog Posts2026-08-22 · Saturday, August 22, 2026 How we made a text-to-speech model respond in sub-50 ms nari-labs.com原文 ↗ Nari Labs 围绕 Qwen3-TTS 优化交互式合成,把第一段可播放音频的响应时间压到 50ms 以内,并同时讨论速度与单位成本。 –浏览 –点赞 复制链接 评论 · Comments
评论 · Comments