Machine Heart
Sep 7, 2026 · Artificial Intelligence
LLaDA-Image: Full Diffusion Model Leads Open-Source Text-to-Image via Image-Only Pretraining
LLaDA-Image is a 6B diffusion transformer that learns visual priors from images alone — 90% of its 220M training samples use image-only supervision — then aligns language in later fine-tuning, achieving top open-source scores on Qwen-Image-Bench, supporting both text-to-image and instruction-based editing, and distilling to 2–4 steps via TwinFlow.
Diffusion TransformerImage EditingImage-Only Pretraining
0 likes · 21 min read
