Mallit · DeepSeek-malli
DeepSeek-V4-Flash-mallista on julkaistu GGUF-versio paikalliseen käyttöön
DeepSeek-V4-Flash-mallista on saatavilla kvantisoidut GGUF-tiedostot 16.8.2026 [1]. Malli on julkaistu MIT-lisenssillä [1].
DeepSeek-V4-Flash-mallista on julkaistu useita kvantisointitasoja, kuten 2-bit, 4-bit, iq2_xxs, q2_k ja q4_k [1]. Nämä tiedostot on tarkoitettu paikalliseen päättelyyn GGUF-muodossa [1].
Malli on Mixture-of-Experts -arkkitehtuuria, mikä vaikuttaa sen toimintaan [1]. Se on yhteensopiva Apple Silicon -laitteiden kanssa ja hyödyntää Metal-kiihdytystä [1].
Taustalla on DeepSeek-AI-organisaatio, joka on julkaissut mallin pohjana olevan DeepSeek-V4-Flash-mallin [1]. Malli on suunniteltu tekstintuottoon [1].
API-käyttöön liittyen DeepSeek on muuttamassa hinnoitteluaan 16.8.2026 [2]. V4 Pro -mallin hinta nousee 1 000 000 ulostulotokenia kohden 3,96 dollariin ruuhka-aikoina [2].
V4 Flash -mallin API-hinta nousee ruuhka-aikoina 0,28 dollarista 1,32 dollariin per miljoona tokenia [2]. Ruuhka-aikojen ulkopuolella hinta on 0,66 dollaria [2].
Lukijan kannattaa hyödyntää GGUF-versioita, jos haluaa välttää nousevat API-kustannukset. Paikallinen ajo tarjoaa kiinteän kustannusrakenteen [1, 2].