AI

tiistai 4.8.2026

Kirjoittanut Ainikki · klo 6.31

Päivän AI-uutiset käsittelevät tekoälyn taloudellisia, sääntelyyn liittyviä ja teknisiä kehityssuuntia. Hyperscalerit (suuret teknologiayritykset kuten Google, Meta ja Microsoft) kohtaavat kasvavaa taloudellista painetta miljardien dollarien piilovelkojen ja ennennäkemättömien investointien myötä. Samalla hallitukset ja sääntelyviranomaiset (Valkoinen talo, EU) pyrkivät hallitsemaan tekoälyn kehitystä ja vaikutuksia vapaaehtoisilla kehyksillä ja merkintävaatimuksilla. Teknisellä puolella tutkijat ja yritykset (Anthropic, METR, MiniMax) osoittavat, että ihmisen asiantuntemus ja uudet benchmark-testit ovat ratkaisevia tekoälyn käytettävyyden ja kyvykkyyksien arvioinnissa.


Hyperscalereiden piilovelka kasvoi 1,65 biljoonaan dollariin

Nikkein analyysin mukaan viiden suuren yhdysvaltalaisen teknologiayhtiön taseen ulkopuolinen velka on kasvanut kahdeksankertaiseksi neljässä vuodessa ja ylittää nyt 1,65 biljoonaa dollaria – enemmän kuin niiden virallinen 1,35 biljoonan dollarin velka. Piilovelka koostuu pääosin pitkäaikaisista GPU- ja palvelinhankintasopimuksista sekä datakeskusten vuokrasopimuksista, jotka kirjataan tilinpäätösten liitetietoihin eikä taseeseen. S&P Globalin mukaan hyperscalerit ovat laskeneet liikkeelle 225 miljardia dollaria joukkovelkakirjoja tänä vuonna, ja tahti on kiihtymässä. Moody's toteaa, että yhtiöiden investment grade -luokitukset eivät ole välittömässä vaarassa, mutta samalla se huomauttaa niiden siirtyvän kevyestä pääomarakenteesta raskaaseen – muutos joka vaatii ennennäkemättömän suuria investointeja.

fortune.com ↗

Valkoinen talo kutsuu AI-yritykset kyberkyvykkyyksien arviointikehyksen käsittelyyn

Valkoinen talo kokoaa tiistaina tekoälyyritysten edustajia keskustelemaan vapaaehtoisesta kehyksestä, jolla arvioidaan kehitteillä olevien mallien kyberkyvykkyyksiä. Kehys perustuu Trumpin kesäkuun toimeenpanomääräykseen, joka velvoitti NSA:n, CISA:n ja valtiovarainministeriön luomaan luokitellun benchmarking-prosessin. Ohjelmaan osallistuvat kehittäjät voivat antaa hallitukselle pääsyn malleihinsa enintään 30 päiväksi ennen niiden laajempaa julkaisua. Kehyksen tarkat mittarit ja kynnysarvot pysyvät luokiteltuina, eikä Valkoinen talo ole julkaissut valmista kehystä julkisesti.

www.cnbc.com ↗

EU:n tekoälylaki velvoittaa merkitsemään AI-sisällön käyttäjille

EU:n tekoälylain läpinäkyvyysvaatimukset astuivat voimaan sunnuntaina. Yritykset, jotka tuottavat tai käyttävät tekoälyllä generoitua sisältöä, ovat nyt velvollisia merkitsemään sen selkeästi – tämä koskee muun muassa deepfakeja, chatbotteja ja AI-tuotettuja tekstejä yleistä etua koskevissa asioissa. Olemassa olevilla järjestelmillä on siirtymäaika 2. joulukuuta 2026 asti. Google varoittaa, että päällekkäiset merkinnät voivat käytännössä hankaloittaa käyttäjien kykyä hahmottaa olennainen tieto.

www.euronews.com ↗

Asiantuntemus ratkaisee LLM-promptauksen laadun, ei promptaustekniikka

Matemaatikko Terence Taon ChatGPT-keskustelu Jacobian-konjektuurin vastaesimerkin parissa havainnollistaa, miten syvälle alan asiantuntija pystyy viemään mallin kanssa käytävän vuoropuhelun. Tao ohjaa mallia omilla hypoteeseillaan, tunnistaa epäilyttävät vastaukset ja sivuuttaa mallin ehdotukset suunnasta – kaikki tämä edellyttää matematiikan ymmärtämistä, ei promptaustekniikan hallintaa. Sama pätee ohjelmistokehitykseen: koodikannan tunteva kehittäjä pystyy haastamaan mallin ratkaisuja ja ohjaamaan sen yksinkertaisempaan suuntaan, kun taas ilman kontekstia toimiva käyttäjä joutuu hyväksymään mitä malli tarjoaa. Kirjoittajan mukaan ihmisasiantuntemus säilyy arvokkaana, koska vaikein osa ei ole mallin kapasiteetti vaan se, että ihminen osaa kommunikoida mallille täsmälleen millaisen ratkaisun haluaa.

www.seangoedecke.com ↗

Anthropic ja METR julkaisivat pitkän aikavälin koodaustehtävien benchmark-testin

MirrorCode on Anthropicin ja METR:n yhteiskehittämä benchmark, jossa tekoälymallit toteuttavat kokonaisia ohjelmia alusta loppuun ilman pääsyä alkuperäiseen lähdekoodiin. Tehtävät ovat laajoja: suurin yksittäinen ajo kesti 19 päivää ja maksoi 2 600 dollaria. Claude Opus 4.7 onnistui toteuttamaan uudelleen gotree-bioinformatiikkatyökalun, jossa on noin 16 000 riviä Go-koodia, 14 tunnissa ja 251 dollarin kustannuksella – tehtävän arvioidaan vievän ihmiseltä 2–17 viikkoa. Benchmark ei ole vielä täysin ratkaistu, ja Anthropic julkaisi 22 kohdeohjelmaa avoimen lähdekoodin projektina.

epoch.ai ↗

MiniMax H3 -videomalli julkaistiin avoimilla painoilla, ComfyUI tuki heti mukana

MiniMax julkaisi H3-videomallin avoimilla painoilla. Malli on yhtiön kolmannen sukupolven videomalli ja ensimmäinen, jonka painot ovat julkisesti saatavilla. H3 tuottaa videota tekstistä, kuvista, videosta tai äänestä, tukee 2K-resoluutiota ja enintään 15 sekunnin klippejä, ja generoi stereoäänen samassa passissa videon kanssa. ComfyUI lisäsi tuen julkaisupäivänä, ja mallin kerrotaan toimivan paikallisesti RTX 3060 -tasoisella näytönohjaimella.

blog.comfy.org ↗

Kielimallit