Mallit
Uudet Qwen3-pohjaiset FP4-kvantisoidut mallit ja Quillan Ronin -malli julkaistu
Nvidia Model Optimizer on tuonut FP4-kvantisoinnin Qwen3-8B-malliin. Lisäksi Quillan Ronin -malli on saatavilla 3 miljardin parametrin pohjalta [1, 2].
Nvidia Model Optimizer on julkaissut FP4-kvantisoinnin hyödyntävän Qwen3-8B-pohjaisen mallin [1]. Malli on lisenssoitu Apache-2.0-lisenssillä [1].
Quillan Ronin -malli on julkaistu 29.8.2026 [2]. Se perustuu 1bitLLM/bitnet_b1_58-3B -pohjamalliin [2].
Quillan Ronin -malli on 3 miljardin parametrin kokoinen [2]. Sen lisenssi on Apache-2.0 [2].
Qwen3-8B-pohjainen malli on hyödyntänyt FP4-kvantisointia [1]. Se on tyypiltään tekstin generointiin tarkoitettu malli [1].
Molemmat julkaistut mallit on tarkoitettu tekstin generointiin [1, 2]. Niiden latausmäärät ovat 2104 ja 6926 [1, 2].
Lukijan kannattaa testata FP4-kvantisointia, jos haluaa hyödyntää Nvidian optimointia Qwen3-sarjan kanssa [1].