Anthropic testasi markkinapaikkaa, jossa tekoälyagentit kävivät kauppaa keskenään
Anthropic on julkaissut tuloksia sisäisestä kokeesta, jossa yhtiön Claude-agentit kävivät kauppaa keskenään markkinapaikalla ilman ihmisten väliintuloa kokeen käynnistymisen jälkeen. Yhtiön mukaan agentit edustivat sekä ostajia että myyjiä, ja ne sopivat oikeista tavaroista käytävästä kaupasta oikealla rahalla. Kokeen tavoitteena oli selvittää, miltä tekoälyvälitteinen markkinapaikka voi käytännössä näyttää silloin, kun neuvotteluja käyvät agentit transaktion molemmilla puolilla.
Anthropicin mukaan kyse oli viikon mittaisesta sisäisestä kokeesta, jonka nimi oli Project Deal. Yhtiö julkaisi tulokset 24. huhtikuuta. Aineiston mukaan agentit ostivat ja myivät tavaroita 69 työntekijän puolesta yhtiön San Franciscon toimistossa.
Agentit toimivat ostajina ja myyjinä
Kokeessa käytettiin ilmoitusmarkkinaa muistuttavaa järjestelyä, jossa agentit saattoivat laittaa tavaran myyntiin, tehdä tarjouksen toisen osapuolen tuotteesta tai viedä kaupan päätökseen. Aineiston mukaan markkinapaikka toimi Slack-kanavan kautta, jossa agentit kiersivät satunnaisesti eri rooleissa.
Keskeinen yksityiskohta oli se, että ihmisten ei kerrota puuttuneen tapahtumiin kokeen alettua. Tämä teki asetelmasta poikkeuksellisen suoraviivaisen testin sille, miten agentit käyttäytyvät tilanteessa, jossa niiden on itse tunnistettava ostamisen ja myymisen mahdollisuuksia sekä käytävä neuvotteluja toisten agenttien kanssa.
Tuloksia pidetään kuvaavana esimerkkinä agenttimarkkinasta
Aineiston mukaan kokeen tulokset tarjoavat tähänastisista havainnoista selvimmän kuvan siitä, miten tekoälyvälitteinen markkinapaikka voisi toimia käytännössä. Tuloksista kirjoittivat Anthropicin tutkijat Kevin K. Troy, Dylan Shields, Keir Bradwell ja Peter McCrory.
Kokeen merkitys liittyy ennen kaikkea siihen, että se siirtää huomion yksittäisestä tekoälyavustajasta agenttien väliseen vuorovaikutukseen. Sen sijaan, että tekoäly vain auttaisi ihmistä tekemään päätöksiä, tässä mallissa agentit myös neuvottelevat keskenään ja vievät kauppoja maaliin.
Laajemmat vaikutukset jäivät vielä avoimiksi
Aineistossa ei avata tarkemmin, millaisia tavaroita kokeessa vaihdettiin tai kuinka suuria yksittäiset kaupat olivat. Myöskään kokeen onnistumista ei kuvata yksityiskohtaisilla suoritusluvuilla tässä paketissa. Varmistettua kuitenkin on, että kyse oli todellisista tavaroista ja oikeasta rahasta, ei pelkästä simulaatiosta.
Siksi kokeen tärkein anti on tässä vaiheessa esimerkinomaisuus: Anthropicin mukaan agentit pystyivät toimimaan markkinapaikalla sekä ostajina että myyjinä ilman jatkuvaa ihmisen ohjausta. Se tarjoaa konkreettisen testitapauksen siitä, miten agenttipohjainen digitaalinen kaupankäynti voi tulevaisuudessa rakentua.
Jatka aiheesta Teknologia.
Artikkeli on laadittu tekoälyavusteisesti. Lue toimitusperiaatteemme.
