Mallit
Ling-3.0-Flash-CIRU-int4-Strix-native on julkaistu vLLM-päättelyä varten
Uusi Ling-3.0-Flash-CIRU-int4-Strix-native -malli on julkaistu 11.8.2026. Malli on optimoitu käyttämään w4a16-kvantisointia [1].
Ling-3.0-Flash-CIRU-int4-Strix-native on julkaistu 11.8.2026 [1]. Malli on tyypiltään text-generation ja se on suunniteltu käytettäväksi vLLM-kirjastolla [1].
Malli käyttää w4a16-kvantisointia ja se on julkaistu safetensors-muodossa [1]. Lisenssi on MIT [1].
Taustalla on inclusionAI/Ling-3.0-flash-int4 -perusmalli [1]. Malli on tarkoitettu keskusteluun ja se tukee speculative-decoding-tekniikkaa [1].
Malli on yhteensopiva AMD:n laitteiston kanssa, erityisesti gfx1151-arkkitehtuurin kanssa [1]. Se tukee myös ROCm-ympäristöä [1].
Päättelyyn voidaan käyttää Windows- tai WSL-ympäristöä [1]. Malli on osa bailing_hybrid-kategoriaa [1].
Käyttäjän kannattaa hyödyntää vLLM-päättelyä, mikäli käytössä on AMD-pohjainen laitteisto [1]. Tarkista yhteensopivuus gfx1151-piirisarjan kanssa [1].