Post by Philipp Schmid on X
Philipp Schmid@_philschmid
XGemma goes diffusion! DiffusionGemma with up to 1000+ tokens per second! 🌬️
- Built on Gemma 4 as a 26B MoE model.
- 3.8B parameters during inference.
- Generates text in 256-token blocks in parallel.
- Fits within 18 GB VRAM limits when quantized.
- Apache 2.0
533 likes19 repliesPosted Jun 10, 2026