Claude Fable 5: Mit jelent, ha az AI erősebb, mint amire készült?
Az Anthropic kiadta a Fable 5-öt, a valaha nyilvánosságra hozott legerősebb AI modelljét. De a történet nem a benchmark-számokról szól, hanem arról, hogy az AI-t először kellett visszafogni, mielőtt kiengedték.
Az Anthropic tegnap kiadott egy AI modellt, aminek a létezéséről fél éve suttogtak a szakmában. A neve: Claude Fable 5.
De nem ez az igazi hír. Az igazi hír az, amit nem adtak ki.
A Mythos, amit nem kapsz meg
A Fable 5 mögött egy másik modell áll: a Claude Mythos 5. Az Anthropic ezt tartja az eddigi legerősebb rendszerének. Annyira erős, hogy a kiberbiztonság területén emberfeletti szinten talál sebezhetőségeket, a biológiai kutatásban pedig olyan hipotéziseket állít fel, amelyeket később független laborok igazolnak.
A Mythos-t az Anthropic nem adja ki a nyilvánosságnak. Csak egy szűk kör, a Glasswing program partnerei kapják meg, akik kibervédelmi és orvosi kutatási célokra használják.
A Fable 5 ugyanaz a modell, de biztonsági korlátokkal. Amikor a rendszer kiberbiztonsági, biológiai vagy kémiai területen érzékel kérést, automatikusan visszavált egy gyengébb, de biztonságos modellre. A session-ök 95%-ában ez nem történik meg, tehát a legtöbb felhasználó lényegében Mythos-szintű AI-t kap.
Először fordul elő, hogy egy AI-cég saját tesztjei visszatartsanak egy erősebb verziót.
A számok, amik számítanak
Nem szoktam benchmark-listákat idézni, mert általában nem mondanak sokat a valós használatról. De itt a különbségek olyan nagyok, hogy érdemes ránézni:
A Stripe, az egyik legnagyobb online fizetési rendszer, 50 millió soros kódbázist migrált a Fable 5-tel. Egy nap alatt. Ez a munka manuálisan két hónapig tartott volna.
A szoftverfejlesztési benchmark-okon (SWE-bench Pro) a Fable 5 80%-ot ér el. Az OpenAI GPT-5.5 59%-ot. A Cognition FrontierCode tesztjén, ami valós, produkciós szintű programozási feladatokat mér, a Fable 29%, a GPT-5.5 6%.
A tudományos kutatásban a Mythos verzió molekuláris biológiai hipotéziseit az esetek 80%-ában előnyben részesítették az eddigi legerősebb modellekéivel szemben. Egy fehérjével kapcsolatos hipotézisét később egy másik labor igazolta.
Fizikai kutatásban 36 óra alatt ért el olyan eredményeket, amihez a GPT-5.5-nek négy nap kellett.
Amit ez a gyakorlatban jelent
Nem az a lényeg, hogy egy AI jobb lett egy teszten. Az, hogy az AI-nak adható feladatok szintje ugrott meg.
Eddig az AI jó volt rövid, egyszerű feladatokra. Írj egy emailt. Foglald össze ezt a dokumentumot. Keress rá erre.
A Fable 5 ott erős, ahol a feladat hosszú, összetett, és kontextust kell tartani. Több millió token szövegen keresztül fókuszban marad. Saját jegyzeteket készít a munkája közben. Nem felejt el dolgokat a feladat közepén.
Ha valaki rendszert épít AI-val, nem pedig egyszeri kérdéseket tesz fel, ez a különbség meghatározó.
Az ár, ami meglepő
10 dollár egy millió bemeneti tokenre, 50 dollár egy millió kimeneti tokenre. Ez kevesebb, mint a fele annak, amit a Mythos Preview-ért kértek.
Június 22-ig a Pro, Max, Team és Enterprise csomagokban ingyenesen elérhető. Utána credit-alapú.
Aki most próbálja ki, ingyen hozzáfér ahhoz, ami jelenleg a piac legerősebb nyilvánosan elérhető AI modellje.
Amit ebből gondolok
Két dolog fog meg ebben.
Az első: az AI fejlődése nem lineáris. A Fable nem 10%-kal jobb az elődjénél. Vannak területek, ahol két-háromszoros a különbség. Ez nem lépés, ez ugrás.
A második: az Anthropic elismerte, hogy van egy AI-juk, amit nem adnak ki. Nem azért, mert nem akarnak pénzt keresni vele, hanem mert túl erős. Ez új fejezet az AI-ipar történetében. Eddig mindenki mindent ki akart adni, minél előbb. Most valaki azt mondta: ez még nem biztonságos.
Hogy ez jó-e vagy rossz, azt mindenki döntse el maga. De azt érdemes tudomásul venni, hogy az AI-fejlődés gyorsasága már az AI-cégeket is meglepte.
Angyal Roland, cégépítő, márkaépítő, AI-rendszerépítő. 20+ éve építek cégeket és márkákat. Most azon dolgozom, hogy az AI ne csak eszköz legyen, hanem az üzlet része.