Paikallisen tekoälyn päivälehti — avoimen painon mallit, työkalut ja rauta

Sunnuntai 16. elokuuta 2026Aamupainos · klo 7Nro 10

← Takaisin numeroon 10

Mallit · DeepSeek-malli

DeepSeek-V4-Flash-mallista on julkaistu GGUF-versio paikalliseen käyttöön

DeepSeek-V4-Flash-mallista on saatavilla kvantisoidut GGUF-tiedostot 16.8.2026 [1]. Malli on julkaistu MIT-lisenssillä [1].

DeepSeek-V4-Flash-mallista on julkaistu GGUF-versio paikalliseen käyttöön V4 Pro ruuhka-aika 3.96 dollaria/1M tokenia V4 Flash ruuhka-aika 1.32 dollaria/1M tokenia Hintavertailu: dollaria/1M tokenia

DeepSeek-V4-Flash-mallista on julkaistu useita kvantisointitasoja, kuten 2-bit, 4-bit, iq2_xxs, q2_k ja q4_k [1]. Nämä tiedostot on tarkoitettu paikalliseen päättelyyn GGUF-muodossa [1].

Malli on Mixture-of-Experts -arkkitehtuuria, mikä vaikuttaa sen toimintaan [1]. Se on yhteensopiva Apple Silicon -laitteiden kanssa ja hyödyntää Metal-kiihdytystä [1].

Taustalla on DeepSeek-AI-organisaatio, joka on julkaissut mallin pohjana olevan DeepSeek-V4-Flash-mallin [1]. Malli on suunniteltu tekstintuottoon [1].

API-käyttöön liittyen DeepSeek on muuttamassa hinnoitteluaan 16.8.2026 [2]. V4 Pro -mallin hinta nousee 1 000 000 ulostulotokenia kohden 3,96 dollariin ruuhka-aikoina [2].

V4 Flash -mallin API-hinta nousee ruuhka-aikoina 0,28 dollarista 1,32 dollariin per miljoona tokenia [2]. Ruuhka-aikojen ulkopuolella hinta on 0,66 dollaria [2].

Lukijan kannattaa hyödyntää GGUF-versioita, jos haluaa välttää nousevat API-kustannukset. Paikallinen ajo tarjoaa kiinteän kustannusrakenteen [1, 2].

Lähteet