Lyhyesti: Google julkisti 30.9. uuden kärkimallinsa Gemini 4 Argonin. Malli annetaan aluksi vain Fairwind-ohjelman kyberturvakumppaneille ja Yhdysvaltain hallinnon vapaaehtoiseen ennakkoarvioon; laajempi saatavuus tulee yhtiön mukaan mahdollisimman pian. Yhtiön omien testien mukaan malli saa 77,9 % DeepSWE-koodaustestissä, ja esittelyhinta on 2 dollaria miljoonalta syötetokenilta ja 10 dollaria miljoonalta tulostetokenilta.
Mitä tämä muuttaa: Uutta kärkimallia ei voi vielä ottaa käyttöön, joten sitä ei kannata laskea omiin suunnitelmiin. Suorituskykyväitteet ovat toistaiseksi Googlen omia, eikä julkaisupäivää laajalle yleisölle ole.
Lyhyesti: Yhdysvaltain kuluttajaviranomainen FTC on Reutersin lähteen mukaan avannut koko alaa koskevan tutkinnan tekoälyagenttien riskeistä kuluttajille. Kohteina ovat ainakin OpenAI, Anthropic ja tutkimusorganisaatio METR, ja virasto aikoo vaatia tietoja ja johtajien kuulemisia. Tieto perustuu nimettömään FTC-lähteeseen, eivätkä yhtiöt kommentoineet asiaa heti.
Mitä tämä muuttaa: Vastuu agentin aiheuttamasta vahingosta on siirtymässä viranomaiskysymykseksi. Agentteja myyvän tai käyttävän yrityksen kannattaa kirjata sopimuksiin, kuka vastaa agentin toimista ja miten niitä valvotaan.
Lyhyesti: Anthropic julkaisi 29.9. analyysin, jonka mukaan GLM-5.3 onnistui ExploitBench-testissä 12 prosentissa yrityksistä, kun yhtiön oma Claude Mythos Preview ylsi 14 prosenttiin. Yhdessä kokeessa julkisesta Chrome-haavoittuvuudesta syntyi toimiva hyökkäys noin 20 dollarin laskentakustannuksella, ja mallin turvarajoitukset saatiin ohitettua. Tulokset ovat Anthropicin omia testejä kilpailijan mallista.
Mitä tämä muuttaa: Hyökkäyskyky leviää myös malleihin, joiden turvarajoitukset on helppo ohittaa, joten aika haavoittuvuuden julkistuksesta hyökkäykseen lyhenee. Päivitysten nopea asentaminen ja varmuuskopiot ovat entistä tärkeämpiä myös pienessä yrityksessä.
Lyhyesti: Anthropic julkaisi 30.9. robottialtistusindeksin, jossa Claude arvioi noin 19 000 työtehtävää noin 900 ammatista. Arvion mukaan nykyrobotit pystyisivät teknisesti tekemään 74 % fyysisistä tehtävistä, mutta vain 0,3 % tehtävistä on robotille kustannuskilpailukykyisiä. Nykyisellä hintakehityksellä 10 prosentin raja saavutettaisiin noin 40 vuodessa; arvio perustuu tekoälyn tekemään luokitteluun ja oletukseen muuttumattomista tehtävistä ja palkoista.
Mitä tämä muuttaa: Tietotyön automaatio etenee nyt, fyysisen työn automaatio selvästi hitaammin. Investoinnit kannattaa kohdistaa ensin toimistoprosesseihin, joissa hyöty on saatavilla heti.
Lyhyesti: Reutersin ja CNBC:n 29.9. julkaiseman selvityksen mukaan McDonald's käyttää Tiger Analyticsin tekoälyä ravintolakohtaisiin hintasuosituksiin lähes 14 000 ravintolassa Yhdysvalloissa. Big Macin hinta vaihteli Fresnossa 5,69 dollarista 6,89 dollariin. Yhtiön mukaan kyse on työkalusta, ei määräyksestä; Suomen osalta käytöstä ei ole tietoa.
Mitä tämä muuttaa: Tekoälyhinnoittelu on jo arkea suurissa ketjuissa, ja pienempikin yritys voi testata hinnoitteluaan datalla. Hintaerojen pitää kuitenkin olla asiakkaalle perusteltavissa, tai luottamus kärsii.