Anthropic met izaicinājumu konkurentiem – Claude Opus 5 ir klāt

Mākslīgā intelekta sacensība arvien retāk tiek izšķirta ar jautājumu “kurš modelis ir gudrākais” – arvien biežāk izšķirošais faktors kļūst cits: cik izdevīgi šo intelektu var izmantot ik dienu. 

Tieši šo pavērsienu apliecina Anthropic pagājušajā piektdienā, 24. jūlijā, atklātais Claude Opus 5 – modelis, kas pēc uzņēmuma paša teiktā tuvojas spēcīgākā, dārgākā modeļa Claude Fable 5 sniegumam, vienlaikus maksājot uz pusi lētāk. 

Kāpēc šis modelis ir īpašs?

Opus 5 aizstāj iepriekšējo Opus 4.8 versiju, kas tirgū bija vien nedaudz vairāk kā divus mēnešus – tā parādījās 28. maijā. Interesanti, ka jaunais modelis vairākos kodēšanas un zināšanu darba testos pārspēj pat lielāko un dārgāko Fable 5. Šis modelis kopā ar Mythos 5 un Sonnet 5 tirgū nonāca jūnijā.

Kodēšanas testos jaunais modelis uzrāda krietni labāku sniegumu nekā priekšgājējs. Vienā no tiem tas apsteidz gan iepriekšējo Opus versiju, gan pat spēcīgāko Fable 5. Citā līdzīgā testā Opus 5 no Fable 5 atpaliek tikai pavisam nedaudz. Taču izmaksā uz pusi lētāk par katru izpildīto uzdevumu. Iespaidīgs sniegums vērojams arī uzdevumos, kur modelim jāstrādā ar datoru pašam. Kā arī testos, kas pārbauda spēju risināt pilnīgi jaunas, iepriekš nesastaptas problēmas, kur Opus 5 rezultāts esot ievērojami augstāks nekā jebkuram citam modelim.

Uzlabojumi vērojami arī zinātniskā pētniecībā. Salīdzinājumā ar priekšgājēju Opus 4.8, jaunais modelis ievērojami labāk tiek galā ar sarežģītiem uzdevumiem ķīmijā un bioloģijā. Piemēram, nosakot vielu struktūru pēc mērījumu datiem vai paredzot, kā izmaiņas proteīnos ietekmē to darbību.

Drošība un ierobežojumi

Anthropic apgalvo, ka iekšējā uzvedības pārbaudē Opus 5 izrādījies vismazāk pakļauts maldinošai vai riskantai rīcībai starp visiem uzņēmuma jaunākajiem modeļiem, iegūstot zemāko rādītāju – 2,3 punktus – nesaskaņotas uzvedības skalā. Tajā pašā laikā kiberdrošības un bioloģijas jomās Opus 5 apzināti netiek virzīts uz pašu tehnoloģiju priekšgalu. Šeit stiprāks paliek ierobežotās piekļuves modelis Mythos 5.

Praktiskā izteiksmē tas nozīmē, ka Opus 5 spēj atrast ievainojamības pirmkodā. Taču tam liegts skenēt ievainojamības binārajos failos, veikt ielaušanās testēšanu vai ģenerēt reālus uzbrukuma rīkus. Uzņēmums lēš, ka šie drošības filtri Opus 5 gadījumā iejauksies aptuveni par 85% retāk nekā tas notiek ar piesardzīgāko Fable 5. Ieviesta arī jauna funkcija, kas automātiski novirza bloķētos pieprasījumus uz citu modeli, nevis vienkārši atgriež kļūdu.

Cena un pieejamība

Opus 5 jau šobrīd pieejams visās Anthropic platformās un ir kļuvis par jauno noklusējuma modeli abonementā Claude Max, kā arī spēcīgāko pieejamo modeli Claude Pro lietotājiem.

Atšķirībā no Fable 5 un Mythos 5, uz Opus 5 neattiecas 30 dienu datu glabāšanas prasība, kas daļai privātumu augstu vērtējošu lietotāju bijusi diskusiju objekts.

Ko tas nozīmē tirgum?

Anthropic lēmums saglabāt Opus līmeņa cenu nemainīgu, vienlaikus piedāvājot sniegumu, kas tuvojas dārgākajam modelim, tiek lasīts kā skaidra zīme. Uzņēmumi arvien vairāk sacenšas nevis par absolūto jaudu, bet par to, cik izdevīgi MI var izmantot ikdienas darbā. Tas nozīmē arī spiedienu uz konkurentiem, tostarp lētākiem modeļiem no Ķīnas, kas jau piedāvā līdzīgu kodēšanas sniegumu par vēl zemāku cenu. Vienlaikus vērts atcerēties, ka publicētie testu rezultāti balstās uz skaidri norobežotiem uzdevumiem. Šis sniegums izpaudīsies sarežģītākā, ikdienišķākā darbā, vēl jānoskaidro praksē.

Avoti: TechCrunch, Anthropic

Vai tev patika šis raksts? Novērtē un dalies ar to!

Atbildēt

Jaunākie apskati
Tev varētu interesēt