Anthropic tuo Mythos-luokan Claude Fable 5 -mallin laajemmin saataville
Anthropic julkaisee Claude Fable 5:n, joka on yhtiön ensimmäinen laajasti saataville tuleva versio sen Mythos-luokan tekoälymalleista. Fable 5 käyttää samaa perustana olevaa mallia kuin Mythos 5, mutta se tuodaan julkiseen käyttöön suojauksilla, joiden tarkoitus on estää vastauksia tietyissä korkean riskin aiheissa.
Suojaukset rajaavat riskialttiita pyyntöjä
Anthropic kertoo, että Claude Fable 5:n suojaukset estävät monia käyttäjien kysymyksiä, jotka liittyvät kyberturvallisuuteen, biologiaan ja kemiaan. Kun pyyntö osuu näihin rajattuihin aiheisiin, järjestelmä ohjaa sen Claude Opus 4.8 -mallille. Sama uudelleenohjaus koskee tilanteita, joissa yhtiö epäilee käyttäjän yrittävän mallin tislaukseen liittyvää toimintaa eli pienemmän tekoälymallin kouluttamista suuremman mallin vastausten perusteella.
Ratkaisu kertoo siitä, miten tekoäly-yhtiöt yrittävät tasapainottaa tehokkaampien mallien julkaisua ja väärinkäytön riskejä. Anthropic on aiemmin kuvannut Mythos-malliperheen olevan niin kyvykäs erityisesti kyberturvallisuustehtävissä, ettei sitä voitu julkaista avoimesti ilman lisärajoituksia. Fable 5:n julkaisu on yhtiön mukaan mahdollistunut uusien suojausten ansiosta.
Mythos on ollut rajatun joukon käytössä
Mythos on tähän asti ollut käytössä rajatummin Project Glasswing -hankkeessa ja sen kumppaneilla. Mukana on ollut useita suuria teknologiayhtiöitä ja organisaatioita, kuten Amazon Web Services, Apple, Google, Microsoft, Nvidia, Cisco, CrowdStrike, Linux Foundation ja Palo Alto Networks.
Anthropic julkaisee myös Claude Mythos 5:n käyttäjille, joilla on pääsy Mythos Preview -versioon. Yhtiö on kertonut aikovansa laajentaa pääsyä ajan myötä järjestelmällisemmän luotetun pääsyn ohjelman kautta. Julkisuudessa ei kuitenkaan ole annettu merkittäviä yksityiskohtia siitä, miten Mythos Preview ja Mythos 5 eroavat toisistaan, paitsi että uudempi versio näyttää olevan esikatseluvaiheen jälkeinen julkaisu.
Fable 5:n merkitys on siinä, että se tuo osan Mythos-luokan kyvykkyyksistä laajempaan käyttöön, mutta ei täysin avoimena versiona. Anthropic näyttää rakentavan julkaisumallia, jossa tehokkaampi tekoäly voidaan avata käyttäjille vain, jos riskialttiiden aihealueiden käsittelyä rajoitetaan erillisillä turvamekanismeilla.
Jatka aiheesta Teknologia.
Artikkeli on laadittu tekoälyavusteisesti. Lue toimitusperiaatteemme. Ilmoita virheestä ja liitä mukaan jutun osoite.
