MallitPäivän tärkeimmät
Google julkaisi Gemini 3.7 Flash -mallin, hinta puolittui kolmessa viikossa
Google julkaisi Gemini 3.7 Flash -mallin vain kolme viikkoa edellisen Flash-version jälkeen. Uusi malli on parantunut erityisesti koodauksessa ja tekoälyagenteissa, ja sen hinta on 50 prosenttia halvempi kuin edeltäjänsä julkaisuhinta. Googlen omien mittausten mukaan malli päihittää Anthropicin Claude Sonnet 5:n ja OpenAI:n GPT-5.6 Terran.
Miksi merkittävää
Jos käytät Googlen Gemini-APIa esimerkiksi asiakaspalvelussa tai koodausautomaatiossa, kannattaa tarkistaa hinnoittelu nyt, sillä sama suorituskyky maksaa puolet vähemmän kuin muutama viikko sitten.
Lähde: The Decoder
MallitPäivän tärkeimmät
Google julkaisi Gemini 3.7 Flash -mallin halvemmalla hinnalla
Google julkaisi Gemini 3.7 Flash -tekoälymallin kolme viikkoa edellisen version jälkeen. Malli ei ole uusi pohjaversio, vaan paranneltu versio 3.6 Flashista, ja se on erityisesti kehittynyt koodauksessa ja asiakirjojen käsittelyssä. Hinta on toistaiseksi 0,75 dollaria miljoonaa syötettyä tokenia kohti, eli noin kolmannes kilpailijoiden Claude Sonnet 5:n tai GPT-5.6 Terran hinnasta.
Miksi merkittävää
Jos käytät tai harkitset tekoälyagentteja tai automaatiota liiketoiminnassasi, kannattaa vertailla: tämän mallin kokeiluhinta on nyt selvästi halvempi kuin vastaavat kilpailijat, mutta muista, että hinta nousee tammikuussa 2027.
Lähde: MarkTechPost
Mallit
Needle 2 on 14 megatavun tekoälymalli, joka pyörii älypuhelimessa ilman nettiä
Cactus Compute julkaisi Needle 2 -mallin, joka on kooltaan vain 14 megatavua ja käyttää muistia noin 28 megatavua istunnon aikana. Malli on suunniteltu tunnistamaan komentoja ja kutsumaan ohjelmistotoimintoja ilman internet-yhteyttä, ja se toimii esimerkiksi Raspberry Pi:llä ja halvemmilla Android-puhelimilla. Malli on avoimen lähdekoodin projekti ja se tukee useita käyttöjärjestelmiä kuten iOS, Android, Linux ja Windows.
Miksi merkittävää
Jos kehität tai teettät sovelluksia IoT-laitteille, kioskeille tai muille verkkoyhteydetöntä tekoälyä tarvitseville tuotteille, Needle 2 kannattaa katsoa: se vähentää pilvipalvelukustannuksia ja toimii myös offline-tilassa.
Lähde: MarkTechPost
Mallit
Liquid AI julkaisi pienen näyttöjä ymmärtävän tekoälymallin, joka pyörii puhelimella
Liquid AI julkaisi LFM2.5-VL-3B-mallin, joka osaa lukea kuvakaappauksia, tunnistaa objektien sijainnin kuvissa ja kutsua työkaluja suoraan laitteella ilman pilveä. Malli vie vain noin 3 gigatavua muistia ja toimii nopeasti esimerkiksi Apple M5 Max -koneella. Lisenssi sallii ilmaisen kaupallisen käytön alle 10 miljoonan dollarin liikevaihtoon asti, minkä jälkeen tarvitaan maksullinen sopimus.
Miksi merkittävää
Jos alle 10 miljoonan liikevaihdon yritys haluaa automatisoida esimerkiksi kuittien tai laskujen käsittelyä tai GUI-testausta, tämä malli on nyt ilmaiseksi käytettävissä kaupallisestikin.
Lähde: MarkTechPost
Mallit
OpenAI julkaisi Ultrafast-tilan: GPT-5.6 Sol toimii nyt 14 kertaa nopeammin
OpenAI julkaisi esikatseluversion uudesta Ultrafast-tilasta, joka nopeuttaa uusimman GPT-5.6 Sol -mallin toimintaa 14-kertaiseksi normaaliin verrattuna. Nopeus on 750 tekstipätkää sekunnissa, mikä OpenAIn mukaan sopii erityisesti yritysasiakkaiden tarpeisiin kuten asiakaspalveluun ja häiriönhallintaan. Tila toimii Cerebras-siruyhtiön laitteistolla, ja se on toistaiseksi vain pienelle testiryhmälle.
Miksi merkittävää
Jos yrityksesi käyttää OpenAI:n API-rajapintaa esimerkiksi asiakaspalvelubotissa tai tilausjärjestelmässä, kannattaa seurata Ultrafast-pääsyn laajentumista, sillä nopeampi malli voi parantaa asiakaskokemusta ilman mallivaihtoa.
Lähde: TechCrunch AI
Mallit
Deepseek nostaa API-hintoja ja julkaisee agenttiohjelmiston avoimena lähdekoodina
Deepseek on siirtänyt V4-Pro-mallинsa testivaiheesta tuotantoon ja julkaissut agenttiohjelmistonsa Harness v0.1:n MIT-lisenssillä. Samalla API-hinnat nousevat 16. elokuuta: V4-Pro:n output-hinta lähes kolminkertaistuu ja välimuistiosumien hinta hyppää jopa kuusinkertaiseksi. Eurooppalaisille käyttäjille hinnoittelu on suotuisampaa iltapäivisin, koska ne osuvat Kiinan ruuhka-ajan ulkopuolelle.
Miksi merkittävää
Jos yrityksesi käyttää Deepseek-APIa automatisoituihin työnkulkuihin, jotka lukevat samoja tiedostoja toistuvasti, välimuistiosumien hinnan kuusinkertaistuminen voi kasvattaa kuukausikuluja merkittävästi ja budjetti kannattaa tarkistaa ennen 16. elokuuta.
Lähde: The Decoder