Paikallisen tekoälyn päivälehti — avoimen painon mallit, työkalut ja rauta

Perjantai 21. elokuuta 2026Aamupainos · klo 7Nro 14

vLLM-kirjaston uusi versio 0.27.1 on päivän tärkein uutinen, sillä se optimoi suurten kielimallien päättelyä ja muistinkäyttöä. Tehokas päättelyympäristö on kriittinen tekijä tekoälysovellusten skaalautuvuuden kannalta. Tämä päivitys tuo konkreettista hyötyä laskentatehon hallintaan.

Yön aikana on tapahtunut useita päivityksiä työkaluissa: Llama.cpp tuo muutoksia Metal-kvantisointiin, Ollama puolittaa ensimmäisen tokenin viiveen ja Unsloth esittelee kokeellisen automaattisen tiivistämisen. Lisäksi Whisper.cpp, Tokenizers, PEFT ja AutoGPTQ ovat saaneet uudet versionsa, kun taas AutoAWQ on siirtynyt vLLM-projektin vastuulle.

Haku tuotti 473 tuoretta osumaa, mutta Mini-PC-aiheinen palsta jäi pois, koska lepomeluun liittyviä laitteita ei löytynyt. Runkojuttu vei käytettävissä olevan slotin. Suljetut-osio jäi pois, koska kynnysarvon ylittävä laadukasta aineistoa ei löytynyt.

Koodi · Python-kirjasto

vLLM tarjoaa tehokkaan ja muistitehokkaan päättelymoottorin suuria kielimalleja varten

vLLM-kirjaston versio 0.27.1 on julkaistu 11.8.2026. Se on suunniteltu tarjoamaan nopea ja edullinen päättelyympäristö suurille kielimalleille [1].

vLLM tarjoaa tehokkaan ja muistitehokkaan päättelymoottorin suuria kielimalleja varten vLLM-projektin kehityskaari 2000 henkilöä Kehittäjien määrä

Lue juttu →

Koodi · Python-kirjasto

PEFT-kirjasto mahdollistaa suurten kielimallien tehokkaan hienosäädön pienellä muistimäärällä

PEFT-kirjaston versio 0.20.0 on julkaistu 28.7.2026 [1]. Menetelmä mahdollistaa mallien mukauttamisen ilman kaikkien parametrien muuttamista [1].

PEFT-kirjasto mahdollistaa suurten kielimallien tehokkaan hienosäädön pienellä muistimäärällä Perinteinen PEFT 0% Hienosäädettävien parametrien osuus Parametrien määrän ero perinteisessä hienosäädössä

Lue juttu →