AI AIモデルの容量を量子化で66GBから22GBに、蒸留で精度低下を回復 言語モデルNemotron 3.5 Lightningの重みを量子化し、元のモデルから蒸留することで、精度低下を回復しながらチェックポイント容量… 2026.08.20