Post by Lisan al Gaib on X
Lisan al Gaib@scaling01
XNvidia released Nemotron 3 Super
- a 120B-A12B hybrid Mamba model with LatentMoE and MTP
- pre-trained on 25T tokens in NVFP4
- context up to 1M
- 2.2X faster inference than GPT-OSS-120B
- 7.5X faster inference than Qwen3.5-122B
t.co

200 likes9 repliesPosted Mar 11, 2026