Tagged articles

zero-shot voice cloning

2 articles · Page 1 of 1
Machine Heart
Machine Heart
Aug 20, 2026 · Artificial Intelligence

FireRedTTS3: Zero‑Shot Multilingual Voice Cloning, Design, and Editing in One Model

FireRedTTS3 unifies 24‑language, 21‑dialect zero‑shot voice cloning, natural‑language voice design, and precise local editing in a single model by injecting semantic information into a continuous speech representation (RedAE) and leveraging a lightweight LLM‑DiT generation framework, achieving state‑of‑the‑art results on four public benchmarks.

LLM-DiTMultilingual TTSRedAE
0 likes · 13 min read
FireRedTTS3: Zero‑Shot Multilingual Voice Cloning, Design, and Editing in One Model
Xiaohongshu Tech REDtech
Xiaohongshu Tech REDtech
Aug 13, 2026 · Artificial Intelligence

dots.tts: Open‑Source Continuous Autoregressive TTS Model for Sustainable, Scalable Voice Synthesis

dots.tts is a 2‑billion‑parameter, fully continuous, end‑to‑end autoregressive TTS model released by the Xiaohongshu dots team, offering state‑of‑the‑art zero‑shot voice cloning, low‑step inference, 1‑to‑1 audio‑text streaming, and an extensible training pipeline for research and deployment.

Speech SynthesisTTSaudio-text streaming
0 likes · 22 min read
dots.tts: Open‑Source Continuous Autoregressive TTS Model for Sustainable, Scalable Voice Synthesis