Anthropic paziņojis par Opus 5.5 — jaunāko savas plaši izmantotās darba zirga modeļu līnijas versiju, kas paredzēta programmēšanai un citiem sarežģītiem zināšanu darba uzdevumiem. Savukārt OpenAI izlaidis GPT-6 Sol un GPT-6 Luna, kas orientēti uz efektivitāti un ātrumu.
Abi jaunie izlaidumi nav veidoti kā mēģinājums demonstrēt būtiski jaunas iespējas. To galvenais mērķis ir samazināt izmaksas. Anthropic un OpenAI sacenšas par uzņēmumu klientiem laikā, kad organizācijas arvien biežāk apsver lētāku alternatīvu izmantošanu un modeļu maršrutētājus, lai retāk izmantotu dārgākos tā sauktos frontes modeļus.
Zemāka cena kļūst par galveno sacensības lauku
Abi uzņēmumi apgalvo, ka jaunie modeļi, lai arī galvenokārt mēreni, virza uz priekšu progresīvāko modeļu iespējas un vienlaikus būtiski samazina lietošanas izmaksas. Opus 5.5 atrodas starp dārgākajiem šajā reizē paziņotajiem modeļiem, taču plašākā kontekstā Anthropic cenšas atgūt pozīcijas sacensībā ar OpenAI.
OpenAI šā mēneša sākumā izlaida GPT-6 Astra, kas dažos veiktspējas testos un lietotāju vērtējumos reizēm nedaudz pārspējis Opus 5. Pēc cenas un iespējām Astra konkurē gan ar Anthropic Opus, gan Fable. Tikmēr Anthropic un tā partneru veiktie testi liecina, ka Opus 5.5 dažos programmēšanas un zināšanu darba uzdevumos darbojas labāk nekā GPT-6 Astra, lai gan pārsvars esot neliels.
Opus 5.5 galvenais jaunums ir cena. Anthropic norāda, ka miljons ievades tokenu maksā četrus, bet miljons izvades tokenu — 20 dolārus, kas ir par 20% mazāk nekā Opus 5 gadījumā. Kešatmiņas nolasījumi, kas veido lielāko daļu aģentiskas darbības un programmēšanas izmaksu, maksā 0,20 dolārus par miljonu tokenu jeb par 60% mazāk nekā iepriekš. Uzņēmums arī apgalvo, ka Opus 5.5 ģenerē izvadi par vairāk nekā 30% ātrāk.
Anthropic lēš, ka tipiskās slodzes gadījumā ar noklusējuma iestatījumiem kopējais ietaupījums salīdzinājumā ar Opus 5 tuvojas 40%. To nodrošinot ne tikai zemākas tokenu cenas, bet arī fakts, ka Opus 5.5 uzdevumu izpildei izmanto mazāk tokenu.
Opus 5.5 tiek raksturots kā īpaši spējīgs tā dēvētajās “augsta riska jomās”, tostarp kiberdrošībā un bioloģijā. Tāpēc uz to attieksies tās pašas aizsardzības, kas tika piemērotas Fable 5.1. Ja lietotāja pieprasījums tiks atzīts par saistītu ar aizsargātu jomu, tas var tikt automātiski un caurskatāmi novirzīts uz vecāku modeli.
OpenAI modeļu hierarhija un cenas
GPT-6 Sol un Luna ir pakāpenisks turpinājums OpenAI modeļu attīstībai. Iepriekš uzņēmums savai GPT-5.6 modeļu saimei ieviesa Sol, Terra un Luna nosaukumu sistēmu, bet šomēnes izlaida GPT-6 Astra — līdz šim jaudīgāko un attīstītāko modeli.

Astra ir visjaudīgākā un dārgākā izvēle, kas paredzēta intensīvai programmēšanai, pētniecībai un līdzīgiem uzdevumiem. Sol ir spējīga, bet efektīvāka un pieejamāka alternatīva, kas iecerēta kā ikdienas darba modelis. Terra paredzēts līdzsvarotai, vispārīgai lietošanai, savukārt Luna ir ātrākā un lētākā iespēja.
Aptuveni Astra varētu salīdzināt ar Anthropic Fable, Sol — ar Opus, Terra — ar Sonnet, bet Luna — ar Haiku. Tomēr šī atbilstība nav precīza, īpaši attiecībā uz augstākās klases modeļiem.
OpenAI norāda, ka GPT-6 Sol un Luna apmācīti, izmantojot metodes, kas līdzīgas GPT-6 Astra apmācībā lietotajām. Atkarībā no testa tie dažos uzdevumos ir par dažiem procentpunktiem spējīgāki nekā iepriekšējās versijas, taču to izmantošana maksā uz pusi mazāk.
GPT-6 Sol API cena ir divi dolāri par miljonu ievades tokenu un desmit dolāri par miljonu izvades tokenu. Luna gadījumā šīs cenas ir attiecīgi 0,10 un 0,50 dolāri.
No spēju sacensības līdz praktiskai ieviešanai
Diskusijas par progresīvākajiem AI modeļiem kļuvušas haotiskas. Sociālajos tīklos tiek apgalvots, ka ar tādiem modeļiem kā GPT-6 Astra iespējams ar vienu mēģinājumu izveidot sarežģītas trīsdimensiju videospēles. Vienlaikus izskan ziņas par drošības pārkāpumiem un citām atbilstības problēmām, kā arī aicinājumi palēnināt attīstību un ieviest stingrāku regulējumu.
Daļa šo jautājumu ir pelnījusi nopietnu uzmanību, taču daļa ir troksnis. Atsevišķi apgalvojumi var būt nopietni, bet vienlaikus tikt pārspīlēti vai pasniegti kā komerciālas pozicionēšanas instruments.
Arvien vairāk tiek atzīts, ka paši modeļi — neatkarīgi no tā, vai tos izstrādā Anthropic, OpenAI, Alibaba vai cits liels spēlētājs — nav vienīgie progresa un praktisko rezultātu dzinēji. Tikpat svarīgas, iespējams, ir sistēmas, kas šos modeļus koordinē, kā arī izpildes ietvari un rīki, kuros tie tiek izmantoti.
Progresīvāko modeļu robeža joprojām tiek virzīta uz priekšu, un jaunākie modeļi, šķiet, ir spējīgāki un labāk pielāgoti nekā tie, kas bija pieejami pirms dažiem mēnešiem. Tomēr daļa izstrādātāju un uzņēmumu mazāk koncentrējas uz absolūti labākajiem rezultātiem un vairāk — uz to, kā šīs sistēmas praktiski ieviest un uzturēt izmaksu ziņā efektīvas.
Tāpēc AI nozares līderu aicinājumiem palēnināt attīstību drošības apsvērumu dēļ pievienojas praktiska un ekonomiska realitāte. Pašreizējie modeļi jau ir pietiekami labi, lai paveiktu daudz noderīga, taču to izmantošanai nepieciešama cilvēku izstrādāta kontekstualizācija un darbības organizēšana — gan izpildes rīkos, gan uzņēmumu procesos.
Līdz ar to klienti varētu arvien mazāk pieprasīt maksimāli augstu veiktspēju un vairāk meklēt prognozējamu ieviešanu, stabilu darbību un galvenokārt saprātīgas izmaksas. Tas pats par sevi var izraisīt dabisku attīstības palēnināšanos, un jaunie Anthropic un OpenAI modeļi tiek pozicionēti tieši šādai praktiskai, ikdienas realitātei.
Tehnoloģijas
Tehnoloģijas
Tehnoloģijas