MallitPäivän tärkeimmät
Google julkaisi Gemini 3.7 Flash -mallin halvemmalla hinnalla
Google julkaisi Gemini 3.7 Flash -tekoälymallin kolme viikkoa edellisen version jälkeen. Malli ei ole uusi pohjaversio, vaan paranneltu versio 3.6 Flashista, ja se on erityisesti kehittynyt koodauksessa ja asiakirjojen käsittelyssä. Hinta on toistaiseksi 0,75 dollaria miljoonaa syötettyä tokenia kohti, eli noin kolmannes kilpailijoiden Claude Sonnet 5:n tai GPT-5.6 Terran hinnasta.
Miksi merkittävää
Hinta on tässä se tärkein asia. Tekoälyagentteja paljon ajavat tiimit saavat nyt selvästi halvemman vaihtoehdon isoille kilpailijoille, ainakin vuoden 2026 loppuun asti, jonka jälkeen hinta kaksinkertaistuu.
Lähde: MarkTechPost
MallitPäivän tärkeimmät
Google julkaisi Gemini 3.7 Flash -mallin, hinta puolittui kolmessa viikossa
Google julkaisi Gemini 3.7 Flash -mallin vain kolme viikkoa edellisen Flash-version jälkeen. Uusi malli on parantunut erityisesti koodauksessa ja tekoälyagenteissa, ja sen hinta on 50 prosenttia halvempi kuin edeltäjänsä julkaisuhinta. Googlen omien mittausten mukaan malli päihittää Anthropicin Claude Sonnet 5:n ja OpenAI:n GPT-5.6 Terran.
Miksi merkittävää
Tekoälymallien hinnat laskevat nyt nopeasti, ja tässä tapauksessa puolittuminen tapahtui kolmessa viikossa. Tämä kertoo, että API-pohjaisten tekoälypalveluiden käyttökulut voivat pudota selvästi lyhyessäkin ajassa.
Lähde: The Decoder
Mallit
OpenAI julkaisi Ultrafast-tilan: GPT-5.6 Sol toimii nyt 14 kertaa nopeammin
OpenAI julkaisi esikatseluversion uudesta Ultrafast-tilasta, joka nopeuttaa uusimman GPT-5.6 Sol -mallin toimintaa 14-kertaiseksi normaaliin verrattuna. Nopeus on 750 tekstipätkää sekunnissa, mikä OpenAIn mukaan sopii erityisesti yritysasiakkaiden tarpeisiin kuten asiakaspalveluun ja häiriönhallintaan. Tila toimii Cerebras-siruyhtiön laitteistolla, ja se on toistaiseksi vain pienelle testiryhmälle.
Miksi merkittävää
Nopeus on ollut yksi isojen tekoälymallien heikkous, ja tämä askel voi tehdä reaaliaikaisista tekoälysovelluksista käytännöllisempiä erityisesti yrityskäytössä. Tavalliselle käyttäjälle muutos on toistaiseksi kaukainen, koska ominaisuus on vasta suljetussa esikatselussa.
Lähde: TechCrunch AI
Mallit
Liquid AI julkaisi pienen näyttöjä ymmärtävän tekoälymallin, joka pyörii puhelimella
Liquid AI julkaisi LFM2.5-VL-3B-mallin, joka osaa lukea kuvakaappauksia, tunnistaa objektien sijainnin kuvissa ja kutsua työkaluja suoraan laitteella ilman pilveä. Malli vie vain noin 3 gigatavua muistia ja toimii nopeasti esimerkiksi Apple M5 Max -koneella. Lisenssi sallii ilmaisen kaupallisen käytön alle 10 miljoonan dollarin liikevaihtoon asti, minkä jälkeen tarvitaan maksullinen sopimus.
Miksi merkittävää
Pienikokoinen malli, joka ymmärtää sekä tekstiä että kuvia ja toimii suoraan laitteella, on käytännöllinen rakennuspalikka sovelluksiin, joissa data ei saa lähteä pilvipalveluun. Alle 10 miljoonan euron yrityksille käyttö on ilmaista, mikä madaltaa kokeilukynnystä.
Lähde: MarkTechPost
Mallit
Needle 2 on 14 megatavun tekoälymalli, joka pyörii älypuhelimessa ilman nettiä
Cactus Compute julkaisi Needle 2 -mallin, joka on kooltaan vain 14 megatavua ja käyttää muistia noin 28 megatavua istunnon aikana. Malli on suunniteltu tunnistamaan komentoja ja kutsumaan ohjelmistotoimintoja ilman internet-yhteyttä, ja se toimii esimerkiksi Raspberry Pi:llä ja halvemmilla Android-puhelimilla. Malli on avoimen lähdekoodin projekti ja se tukee useita käyttöjärjestelmiä kuten iOS, Android, Linux ja Windows.
Miksi merkittävää
Tämä on teknisesti kiinnostava erikoismalli sellaisille kehittäjille, jotka rakentavat sovelluksia laitteille, joissa ei ole verkkoyhteyttä tai tehokasta prosessoria. Tavalliselle käyttäjälle tai useimmille yrityksille tämä ei vielä näy arjessa.
Lähde: MarkTechPost
Mallit
Deepseek nostaa API-hintoja ja julkaisee agenttiohjelmiston avoimena lähdekoodina
Deepseek on siirtänyt V4-Pro-mallинsa testivaiheesta tuotantoon ja julkaissut agenttiohjelmistonsa Harness v0.1:n MIT-lisenssillä. Samalla API-hinnat nousevat 16. elokuuta: V4-Pro:n output-hinta lähes kolminkertaistuu ja välimuistiosumien hinta hyppää jopa kuusinkertaiseksi. Eurooppalaisille käyttäjille hinnoittelu on suotuisampaa iltapäivisin, koska ne osuvat Kiinan ruuhka-ajan ulkopuolelle.
Miksi merkittävää
Deepseek on ollut suosittu edullinen vaihtoehto Anthropicin ja OpenAI:n malleille, joten hinnankorotus koskettaa kehittäjiä ja yrityksiä, jotka ovat rakentaneet työnkulkuja Deepseek-APIn päälle. Harness-julkaisu puolestaan antaa kehittäjille ilmaisen lähtökohdan agenttiprojekteihin.
Lähde: The Decoder