importantSYS.SOURCE: arXiv• 2026-08-20T13:24:32Z
DiffusionGemma: High-Speed Text Generation Using Discrete Diffusion Models
DiffusionGemma introduces a high-speed text generation model using discrete diffusion to parallelize token refinement, achieving 1,500 output tokens per second on a single H100 GPU. It combines two-stage training with supervised fine-tuning and reinforcement learning to improve generation quality and inference efficiency.
*** END OF TRANSMISSION ***