Tagged articles

LLaDA-Image

1 articles · Page 1 of 1
Machine Heart
Machine Heart
Sep 7, 2026 · Artificial Intelligence

LLaDA-Image: Full Diffusion Model Leads Open-Source Text-to-Image via Image-Only Pretraining

LLaDA-Image is a 6B diffusion transformer that learns visual priors from images alone — 90% of its 220M training samples use image-only supervision — then aligns language in later fine-tuning, achieving top open-source scores on Qwen-Image-Bench, supporting both text-to-image and instruction-based editing, and distilling to 2–4 steps via TwinFlow.

Diffusion TransformerImage EditingImage-Only Pretraining
0 likes · 21 min read
LLaDA-Image: Full Diffusion Model Leads Open-Source Text-to-Image via Image-Only Pretraining