Generative AI
dots.tts — โมเดล TTS แบบ Fully Continuous Autoregressive จาก Xiaohongshu ร่วมกับ Shanghai Jiao Tong
dots.tts คือโมเดลสังเคราะห์เสียงพูด 2 พันล้านพารามิเตอร์ ที่สร้างเสียง 48kHz ได้โดยตรงใน continuous latent space ไม่ต้องแปลงเสียงเป็น discrete token เหมือนวิธีเดิม คว้า SOTA บน Seed-TTS-Eval รองรับการ clone เสียงด้วยคลิปอ้างอิง 3–10 วินาที 24 ภาษา ฟังดูเจ๋งไหม มาดูกันว่าทำไมมันถึงต่างจาก CosyVoice / Seed-TTS