Paikallisen tekoälyn päivälehti — avoimen painon mallit, työkalut ja rauta

Tiistai 25. elokuuta 2026Aamupainos · klo 7Nro 18

← Takaisin numeroon 18

Mallit

Qwen3-8B-pohjainen FP4-kvantisointi ja GAUTAMAI-malli julkaistu

Uusi Model Optimizer -työkalu mahdollistaa Qwen3-8B-mallin ajamisen FP4-tarkkuudella. Lisäksi GAUTAMAI-malli on saatavilla Apache-2.0-lisenssillä [1, 2].

Qwen3-8B-pohjainen FP4-kvantisointi ja GAUTAMAI-malli julkaistu 2045 kpl Qwen3-8B-FP4 2052 kpl GAUTAMAI Malli Lataukset

Qwen3-8B-pohjainen malli on julkaistu FP4-kvantisoinnilla [1]. Malli on tyypiltään text-generation ja se on optimoitu NVIDIA-laitteistolle [1].

GAUTAMAI-malli on julkaistu 25.8.2026 [2]. Se on Apache-2.0-lisenssillä varustettu causal-lm-malli [2].

Qwen3-8B-pohjainen malli käyttää safetensors-muotoa ja se on pakattu compressed-tensors-menetelmällä [1]. Lisenssi on apache-2.0 [1].

GAUTAMAI-malli tukee devanagari-hindi- ja englannin kieliä [2]. Se on tyypiltään conversational ja se hyödyntää LoRA-tekniikkaa [2].

Molemmat mallit on julkaistu 25.8.2026 [1, 2]. Niiden latausmäärät ovat 2045 ja 2052 [1, 2].

Suosittelemme testaamaan FP4-kvantisointia, jos käytössäsi on NVIDIA-laitteisto. GAUTAMAI-malli on hyvä vaihtoehto monikieliseen kehitykseen [1, 2].

Lähteet