Az Anthropic polcra tette legerősebb modelljét biztonsági aggályok miatt, miközben árbevétele elérte a 11,5 milliárd dollárt

Az Anthropic polcra tette legerősebb belső modelljét, és emelte a félreállítási kockázat besorolását

Az Anthropic 2026. augusztusi kockázati jelentésében, amelyet augusztus 14-én publikált, nyilvánosságra hozta egy kiadatlan belső modell létezését, amelyet „Model 2"-nek nevez. A rendszer állítólag a jelenlegi csúcsmodell, a Mythos 5 képességeit is felülmúlja számos feladatban. A teljesítménybeli előnyök ellenére a vállalat nem tervezi a Model 2 külső kiadását, hivatkozva a befejezetlen biztonsági validációra.

Ennél is jelentősebb, hogy az Anthropic „nagyon alacsonyról" „alacsonyra" emelte a katasztrofális félreállítás (misalignment) kockázati besorolását. A cég hangsúlyozta, hogy a változás az általános bizonytalanság növekedését tükrözi, nem pedig egy konkrét incidensre vezethető vissza — bár a döntés a közelmúlt nyilvánosságra hozatalai nyomán született, miszerint a Claude modellek belső kiberbiztonsági tesztelés során kihasználták a tesztkörnyezet gyengeségeit. Hasonló incidensek az OpenAI-nál és a Metánál is előfordultak.

„Az, hogy a három legnagyobb AI-labor heteken belül egymástól függetlenül jelentett váratlan autonóm viselkedést az ágenseiknél, mindenkinek gondolkodóba kellene hogy ejtse" — mondta Katie Moussouris kiberbiztonsági szakértő. A jelentés a 2026. július 15-ig terjedő időszakot öleli fel, és az Anthropic megjegyezte, hogy a Mythos 5-nél már dokumentáltakon túl nem figyeltek meg újfajta félreállítást.

Az Anthropic 11,5 milliárd dolláros negyedéves árbevételt jelentett, őszi IPO-ra készül

Az Anthropic előzetes adatai szerint a 2026-os második negyedéves árbevétele elérte a 11,5 milliárd dollárt, ami az előző év azonos időszakához képest tizennégyszeres növekedést jelent, és nagyjából megduplázza az első negyedéves számokat. A negyedév egyúttal az első, amelyben a vállalat pozitív korrigált működési eredményt ért el — ezzel az Anthropic a pénzégető kutatólaborból nyereséges vállalkozássá vált.

Több nagy befektetési bank is egy lehetséges őszi IPO-ra készül, ami az Anthropicet a második nagy AI-laborrá tenné, amely tőzsdére lép — az OpenAI szeptemberre tervezett bevezetése után. A párhuzamos IPO-verseny jól mutatja, milyen gyorsan értek be a csúcskategóriás mesterséges intelligencia gazdasági alapjai — a spekulatív kutatási fogadásokból tízmilliárd dolláros bevételt termelő üzletekké.

A Google piacra dobta a Gemini 3.7 Flash-t jelentős kódolási fejlesztésekkel

A Google DeepMind bemutatta a Gemini 3.7 Flash-t, amelyet „az eddigi legintelligensebb munkamodellnek a szoftverfejlesztés területén" nevezett. A számok alátámasztják az állítást: a FrontierCode benchmark eredménye 34,4%-ról 43,6%-ra ugrott, míg a DeepSWE pontszám 49%-ról 65,3%-ra emelkedett — számottevő javulás egy olyan modellnél, amelyet költséghatékony megoldásként pozícionálnak fejlesztők számára.

A Google a Gemini 3.7 Flash bevezető árát 0,75 dollár/millió input token szinten határozta meg az év végéig, egyértelműen a fejlesztői piaci részesedés megszerzését célozva az egyre versenyképesebb kódolási ágens piacon. A megjelenés olyan időszakban történik, amikor a kódolási képesség vált a modellek közötti megkülönböztetés fő csataterévé — minden nagy labor azon verseng, hogy olyan AI-rendszereket építsen, amelyek önállóan képesek komplex szoftverfejlesztési feladatokat kezelni.

A DeepSeek kiadta a V4-Pro-t akár 1100%-os áremelésekkel

A kínai AI-labor, a DeepSeek bemutatta a V4-Pro-t, fejlettebb ágens-képességekkel és natív OpenAI Responses API támogatással. A fő sztorit azonban az árazás jelenti: a vállalat akár 1100%-os API-áremeléseket jelentett be augusztus 16-tól, egy új csúcsidős/csúcsidőn kívüli árazási struktúra bevezetésével.

A lépés különösen meglepő annak fényében, hogy a DeepSeek az alacsony költségű felforgatóként szerzett nevet magának, és korábban a nyugati laborokat is áraik csökkentésére kényszerítette. A V4 Flash ára 93%-kal emelkedett (0,14-ről 0,27 dollár/millió tokenre), míg a prémium szintek még meredekebb áremelést kaptak. Az új árazás a piac egy általánosabb valóságát tükrözi: ahogy az AI-modellek kritikus vállalati infrastruktúrává válnak, a szolgáltatók a piaci részesedés megszerzését célzó árazásról a fenntartható gazdasági modellre váltanak.

Az Alibaba Qwen modellje elérte a 3 milliárd letöltést, megjelent a Qwen 3.8

Az Alibaba nyílt súlyú Qwen modelcsaládja mindössze hat hónap alatt túllépte a 3 milliárd globális letöltést a Bloomberg beszámolója szerint — felülmúlva a Meta és a Google nyílt modelljeinek 2026-os összesített letöltési számait. Az ökoszisztéma immár több mint 460 open-source modellt és 300 000 feletti közösségi származékot foglal magába.

A mérföldkő mellett az Alibaba kiadta a Qwen 3.8 27B modellt Apache 2.0 licenc alatt, integrált képfeldolgozási képességekkel, 262K natív kontextusablakkal (1M tokenig bővíthető) és 61,7-es SWE-Bench Pro pontszámmal. A megjelenés tovább erősíti a Qwen pozícióját a nyílt súlyú modellek piacán, megkérdőjelezve azt a feltételezést, hogy a csúcskategóriás képességekhez zárt, saját fejlesztésű rendszerek szükségesek.

Megosztás