Tutkimus: tekoälyneuvonta laski tarkkuutta mutta nosti itsevarmuutta
Ranskalais-italialainen tutkimusryhmä havaitsi, että tekoälyneuvojen saatavuus romutti osallistujien halukkuuden sanoa 'en tiedä' – osuus laski 44 prosentista 3 prosenttiin. Samalla vastaustarkkuus putosi 27 prosentista 9 prosenttiin, mutta itsevarmuus nousi 30 prosentista 76 prosenttiin. Tutkimus käytti tarkoituksella kysymyksiä, joissa tekoälymalli Step 3.5 Flash tyypillisesti epäonnistuu, joten parempaan malliin luottaminen ei selitä tulosta. Rahalliset kannustimet paransivat tuloksia hieman, mutta eivät nostaneet niitä lähellekään tekoälyttömän vertailuryhmän tasoa.
thenextweb.com ↗
Anthropic kuvaa prosessin miljoonan koodirivin migraatioihin Claude Codella
Anthropic julkaisi oppaan suurten koodimigraatioiden toteuttamiseen Claude Code -agentin avulla. Käytännön esimerkkeinä toimivat kaksi sisäistä projektia: Bun-ajoympäristön miljoonan koodirivin siirto Zigistä Rustiin alle kahdessa viikossa sekä Python-koodikannan muuntaminen 165 000 rivin TypeScript-projektiksi viikonlopun aikana. Bun-migraatio kulutti noin 5,9 miljardia syötetokenia ja maksoi API-hinnoittelulla noin 165 000 dollaria. Anthropicin keskeinen havainto on, että migraatioprosessissa ei korjata koodia vaan silmukkaa, joka tuottaa koodin.
claude.com ↗
Kagi julkaisi Orion-selaimen macOS-, iOS- ja Linux-alustoille
Kagi on julkaissut Orion-selaimen, joka perustuu WebKit-moottoriin ja tukee sekä Chrome- että Firefox-laajennuksia. Selain kerää käyttäjien mukaan nolla telemetriadataa eikä sisällä mainoksia. macOS- ja iOS-versiot ovat valmiita, Linux-versio on betassa ja Windows-versio kehitteillä. Kehitystä rahoitetaan suoraan käyttäjiltä tilaus- tai kertamaksulla.
orionbrowser.com ↗