Tekoälyn päivälehti — mallit, työkalut ja hardware
Maanantai · 10. elokuuta 2026Iltapainos · klo 21Nro 37
Viikonloppu oli uutisrintamalla hiljainen, mutta työkalupenkki lauloi. Unsloth kytki DSpark-spekulatiivisen dekoodauksen oletukseksi ja lupaa jopa kaksinkertaisen päättelynopeuden, ja sen työpöytäsovelluksen beta korjasi samalla reiän, jossa käynnistyspyyntöjä lähetettiin varmistamattomaan porttiin. llama.cpp siivosi AMD-buildinsa yhdestä lipusta ja korjasi RISC-V-taustaosastaan puuttuvan kvanttimuodon. vLLM julkaisi kaksi julkaisukandidaattia kolmessa päivässä — iso versionumero on ovella. Ja eilen sunnuntaina OpenAI:n Atlas-selain lakkasi toimimasta lopullisesti.
Viikon odotetuin asia ei ehtinyt tähän numeroon: Alibaba lupasi Qwen3.8-Maxin ja 27B-mallin painot tälle viikolle, ja vielä maanantain vastaisena yönä kumpaakaan ei ollut Hugging Facessa eikä ModelScopessa — kiinalaiset mallikortit kirjaavat yhä, ettei painoja ole avattu. Kun ne tulevat, ne ovat seuraavan numeron pääuutinen. Mini-PC-palstalla on tänään harvinainen asetelma: saman valmistajan AMD- ja Intel-koneet vastakkain, ja ero kuuluu ennen kuin se näkyy.
Viikonlopun kaksi julkaisua lupaavat jopa kaksinkertaisen päättelynopeuden DSpark-algoritmilla ja tuovat työpöydälle rinnakkaiset keskustelujonot, paikallisen sanelun ja yhden korjatun tietoturva-aukon.
SpaceMiT-piirien taustaosa ei osannut lähettää Q5_0-kvantisoituja painoja omille ytimilleen. Korjaus on pieni; merkitys on siinä, että vika ylipäätään löytyi.
Vakaa versio on yhä heinäkuun 0.26.0. Torstaina tuli 0.27.0rc1, sunnuntaina rc2 — ja tahti kertoo, että julkaisu on lähellä ja viimeisiä vikoja ajetaan ulos.
Viikon kaksi LocalAI-versiota lisäävät NeMo-Speech.cpp-taustaosan puheentunnistukseen ja opettavat mallikirjaston selviämään, kun ensisijainen lähde ei vastaa.
Lokakuussa 2025 julkaistu agenttiselain lakkasi toimimasta sunnuntaina 9. elokuuta. Agenttiominaisuudet muuttavat ChatGPT:hen, Codexiin ja Chrome-laajennukseen — ja kirjanmerkit piti viedä itse ulos.
Esimerkkien järjestys ei ole makuasia. Pieni malli matkii lähintä, joten lähimmäksi kannattaa asettaa se esimerkki, joka muistuttaa käsillä olevaa tapausta eniten.
Upotusmallien vakiokirjasto uudisti gradienttivälimuistin, sai torch.compilen vihdoin nopeuttamaan päättelyä ja varoittaa: int8-upotukset eivät enää ole bitilleen entisensä.
Sama valmistaja, sama 64 gigatavun muisti, kaksi täysin eri filosofiaa: Strix Halon leveä muistiväylä vastaan Panther Laken hiljainen tehokkuus. Ero kuuluu ja näkyy — kirjaimellisesti.
Päivitä Unsloth, kurkista vLLM:n tulevaan versioon ja tarkista upotuskirjastosi
Kolme komentoa tälle illalle: Unslothin asennus tai päivitys virallisella asentimella, vLLM:n 0.27-julkaisukandidaatin kokeilu erillisessä ympäristössä ja sentence-transformersin uusi versio, jossa on rikkovia muutoksia — lue kolmas huomautus ennen kuin päivität tuotantokoneen.
Toinen komento asentaa julkaisukandidaatin (0.27.0rc2) omaan virtuaaliympäristöönsä — älä asenna sitä ympäristöön, jossa tuotantoajosi pyörii. Kolmas päivittää sentence-transformersin versioon 5.7.0, jonka int8-kvantisointi ei enää tuota bitilleen samoja upotuksia kuin aiemmat versiot; jos vektorikantasi on rakennettu int8-upotuksilla, lue julkaisumuistio ennen päivitystä.