Post by AI at Meta on X
AI at Meta@AIatMeta
XWe used two different techniques for quantizing these models.
Quantization-Aware Training with LoRA adaptorsprioritizing accuracy.
SpinQuant, a post-training quantization method which prioritizes portability.
Both versions are available for download as part of this release.

180 likes6 repliesPosted Oct 24, 2024