Sari la conținutul principal

Sakana Fugu vs. Claude Fable 5: benchmarkuri, prețuri și altele

Claude Fable 5 câștigă la benchmarkuri, dar este în prezent suspendat. Sakana Fugu este disponibil acum și costă la jumătate.
Actualizat 31 aug. 2026  · 6 min. citire

Explorează cu AI

ChatGPTClaudePerplexity

Sakana promovează Fugu ca fiind la nivelul lui Fable 5, dar exclude Fable 5 din propriul tabel de benchmarkuri. Așa că vom compara cele două modele cot la cot, atât cât e posibil în mod realist.

Iată contextul. Guvernul SUA a suspendat accesul public la Claude Fable 5 la abia trei zile după ce Anthropic l-a lansat. Iar Fable 5 era prezentat drept cel mai capabil model al său. Acum, două săptămâni mai târziu, Sakana AI din Tokyo a lansat Fugu cu niște afirmații mari. Una dintre ele a circulat mult: Sakana AI spune că Fugu Ultra „stă umăr la umăr cu modele de top precum Fable 5 și Mythos Preview” pe cele mai dificile benchmarkuri din industrie pentru inginerie, știință și raționament, și fără riscul de control al exporturilor. CEO-ul David Ha a spus pe X că Fugu demonstrează că un grup interschimbabil de agenți orchestrați poate egala modelele de frontieră restricționate precum Fable.

Afirmațiile sunt ceva mai greu de verificat pentru că Fable 5 nu apare deloc în tabelul de benchmarkuri al lui Fugu. Sakana îl exclude pe motiv că nu este accesibil publicului. Facem ce putem: verificăm puținele benchmarkuri care apar în tabelele publicate de ambele laboratoare, cu repere de bază care se potrivesc. Iar la final vom discuta despre prețuri și situația de acces

Dacă vrei context despre fiecare sistem în parte, avem articole pe blog: citește acoperirea noastră despre Claude Fable 5 și analiza Sakana Fugu.

Ce este Sakana Fugu?

Sakana Fugu nu este un singur model antrenat în sensul obișnuit. Este un orchestrator: un model care îți primește cererea, decide dacă răspunde direct sau deleagă către modele specializate dintr-un grup, gestionează verificarea și sinteza și îți returnează un singur răspuns printr-un API compatibil cu OpenAI. Din exterior apelezi un singur endpoint; în interior, un set coordonat de modele de vârf face treaba.

Există în două variante. Fugu echilibrează calitatea cu latența redusă și este poziționat ca opțiunea implicită, de zi cu zi, pentru codare, revizuire și servicii interactive. Fugu Ultra coordonează un grup mai amplu de agenți experți și este reglat pentru calitatea maximă a răspunsului la probleme dificile, în mai mulți pași — reproducerea de articole, analiză de securitate cibernetică, data science în stil Kaggle, investigații de brevete.

Ideea este, de fapt, dublă.

  • Mai întâi, o orchestrare învățată: coordonatorul este antrenat să decidă când să delege și cum să combine rezultatele, în loc să ruleze un flux definit manual.
  • Apoi, un grup de agenți interșanjabili: când un nou model de frontieră devine disponibil public, Sakana estimează aproximativ două săptămâni pentru integrare. (Important pentru restul articolului: Fable 5 nu se află în acest grup deoarece nu este accesibil publicului.

Ce este Claude Fable 5?

Claude Fable 5 este un model din clasa Mythos, un nivel pe care Anthropic îl poziționează deasupra clasei Opus, făcut sigur pentru uz general printr-un set de clasificatoare. Este același model de bază ca Claude Mythos 5; diferența este că Fable 5 rulează (rula) cu clasificatoarele de siguranță active, în timp ce Mythos 5 are unele dintre ele ridicate și este restricționat la partenerii Project Glasswing și la anumiți cercetători în biologie.

Anthropic susținea că Fable 5 era de ultimă generație pe aproape fiecare benchmark urmărit de companie, cu un avans care crește pe sarcini mai lungi și mai complexe. Detaliul practic esențial: când o interogare atinge securitatea cibernetică, biologia/chimia sau distilarea de modele, un clasificator în două etape redirecționează răspunsul către Claude Opus 4.8 și îi spune utilizatorului că a făcut asta. 

Sakana Fugu vs. Claude Fable 5: benchmarkuri

Tabelul comparativ publicat de Sakana îl exclude pe Fable 5 și pe Mythos Preview, pe motiv că nu sunt accesibile publicului și, prin urmare, nu pot fi în grupul lui Fugu. Așadar, valorile oficiale ale lui Fugu sunt măsurate în raport cu Opus 4.8, GPT-5.5 și Gemini 3.1 Pro, toate vizibile în tabelul de mai jos. Îl poți vedea câștigând la 10 din 11 benchmarkuri. 

Benchmark Fugu Fugu Ultra Opus 4.8 † Gemini 3.1 Pro † GPT-5.5 †
SWE-Bench Pro * 59.0 73.7 69.2 54.2 58.6
TerminalBench 2.1 80.2 82.1 74.6 70.3 78.2
LiveCodeBench 92.9 93.2 87.8 88.5 85.3
LiveCodeBench Pro 87.8 90.8 84.8 82.9 88.4
Humanity's Last Exam 47.2 50.0 49.8 44.4 41.4
CharXiv Reasoning 85.1 86.6 84.2 83.3 84.1
GPQA-D 95.5 95.5 92.0 94.3 93.6
SciCode 60.1 58.7 53.5 58.9 56.1
τ³ Banking 21.7 20.6 20.6 8.4 20.6
Long Context Reasoning 74.7 73.3 67.7 72.7 74.3
MRCRv2 86.6 93.6 87.9 84.9 94.8

* scaffolding mini-swe-agent. † repere raportate de furnizori. Toate scorurile Fugu sunt raportate de Sakana și nu au fost încă reproduse independent.

Pentru a-l include pe Fable 5 în ecuație, am verificat încrucișat benchmarkurile care apar atât în tabelele Anthropic, cât și în cele ale Sakana, și am verificat că reperele comune se aliniază. La SWE-Bench Pro și Humanity's Last Exam (fără unelte), valorile pentru Opus 4.8, GPT-5.5 și Gemini 3.1 Pro sunt identice în ambele surse — deci acele două comparații sunt curate. Redus la doar cele două sisteme, duelul direct arată astfel:

Benchmark Sakana Fugu Sakana Fugu Ultra Claude Fable 5 Lider
SWE-Bench Pro 59.0 73.7 80.3 Fable 5 (+6.6)
Humanity's Last Exam (fără unelte) 47.2 50.0 59.0 Fable 5 (+9.0)
Terminal-Bench 2.1 ‡ 80.2 82.1 88.0 Fable 5 (+5.9)

‡ Cele două laboratoare raportează repere diferite și folosesc scaffolding diferit pentru TerminalBench, deci condițiile nu sunt identice.

Acestea sunt singurele benchmarkuri pe care le-am găsit cu rezultate publicate direct comparabile. Fable 5 conduce în toate trei.

Așadar, la fiecare benchmark unde comparația directă este măcar posibilă, Fable 5 iese înaintea lui Fugu Ultra cu aproximativ 6–9 puncte. Asta se potrivește cu locul unde Fable 5 este construit să câștige: sarcini pe termen lung, evaluate la final, unde un singur model mai puternic acumulează mai puține erori compuse.

Pe scurt:

  1. Toate valorile Fugu sunt auto-raportate și încă nu au apărut pe clasamente terțe.
  2. Sakana prezintă Fugu ca „umăr la umăr” cu Fable 5 și Mythos Preview. Având în vedere diferențele de mai sus, este o interpretare defensabilă, dar generoasă. „Aproape, dar rămâne în urmă” este mai exact.
  3. Seturile de comparație se suprapun doar parțial. Fable 5 conduce la viziune (poate reconstrui sursa unei aplicații web din capturi de ecran), aspect pe care Fugu nu îl evidențiază deloc; Fugu publică benchmarkuri de context lung și banking pe care tabelul Anthropic nu le acoperă. Deci sunt optimizate pentru forme de lucru oarecum diferite.

Sakana Fugu vs. Claude Fable 5: disponibilitate și acces

Claude Fable 5 este în prezent suspendat. Anthropic a retras accesul la Fable 5 și Mythos 5 pe 12 iunie în urma unei directive guvernamentale SUA privind controlul exporturilor și spune că lucrează pentru a restabili accesul cât mai repede. Celelalte modele Anthropic, ca Opus 4.8, sunt încă disponibile.

Sakana Fugu este disponibil acum prin console.sakana.ai cu un API compatibil OpenAI — cu excepția UE și SEE, unde Sakana a întrerupt temporar disponibilitatea în timp ce rezolvă conformitatea cu GDPR. Nu am putut obține un orizont exact.

Acum, o echipă din Europa s-ar putea să nu poată folosi niciunul dintre modele.

Gânduri finale

Pe hârtie, este o competiție strânsă și reală între două filozofii.

Anthropic se gândește la scară — un singur model din clasa Mythos atât de capabil încât are nevoie de un sistem paralel de clasificare.

Sakana pariază pe coordonare — că un orchestrator antrenat peste un grup interșanjabil poate rămâne la mică distanță de orice model individual de frontieră, fiind în același timp mai ieftin, mai rezilient și agnostic față de furnizor.

Luate ca atare, benchmarkurile spun că pariul Anthropic produce artefactul mai puternic pe testele comparabile, în timp ce pariul Sakana produce varianta mai disponibilă și mai ieftină.

Întrebări frecvente: Sakana Fugu vs. Claude Fable

Este Sakana Fugu mai bun decât Claude Fable 5?

La benchmarkurile unde comparația directă este posibilă (SWE-Bench Pro, Humanity's Last Exam, Terminal-Bench), Fable 5 conduce în fața lui Fugu Ultra cu aproximativ 6–9 puncte. 

De ce nu este Fable 5 în tabelul de benchmarkuri al lui Fugu?

Sakana îi exclude pe Fable 5 și Mythos Preview deoarece nu sunt accesibile publicului și, prin urmare, nu pot face parte din grupul de agenți al lui Fugu. Comparația oficială este cu Opus 4.8, GPT-5.5 și Gemini 3.1 Pro, pe care Fugu Ultra le depășește la 10 din 11 benchmarkuri.

Care este mai ieftin?

Fugu Ultra, la 5 $/M input și 30 $/M output, costă aproximativ jumătate față de Fable 5, care are 10 $/M input și 50 $/M output. Ambele oferă abonamente lunare de 20/100/200 $.

Va reveni Fable 5?

Anthropic spune că lucrează pentru a restabili accesul la Fable 5 și Mythos 5 cât mai repede posibil, dar nu a publicat un calendar. Între timp, celelalte modele ale sale, inclusiv Opus 4.8, rămân disponibile.

Chiar ocolește Fugu suspendarea lui Fable 5?

Nu direct — Fable 5 nu a fost niciodată în grupul lui Fugu, așa că Fugu nu îi poate recupera capabilitățile specifice.

Subiecte
Inteligență artificială

Învață AI cu DataCamp

track

AI pentru ingineria software

7 oră
Scrie cod și construiește aplicații software mai rapid ca niciodată cu cele mai noi instrumente AI pentru dezvoltatori, inclusiv GitHub Copilot, Windsurf și Replit.
Vezi detaliiRight Arrow
Începeți Cursul
Vezi mai multRight Arrow