Models
Sakana presenta Fugu Max i Fugu Ultra v2, dues versions del seu orquestrador multimodel
L'11 de setembre del 2026, Sakana AI va presentar dues configuracions noves del seu sistema Fugu. La primera, Fugu Max, abarateix el cost per token sense baixar del nivell dels millors models; la segona, Fugu Ultra v2, esprem el rendiment en tasques complexes. Totes dues comparteixen la mateixa arquitectura d'orquestració i, segons l'empresa, empenyen la frontera de Pareto en direccions oposades: una cap al preu baix i l'altra cap a la capacitat màxima. Totes les xifres surten de l'anunci oficial; cap no prové d'avaluacions independents.
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
En resum
- Sakana AI llança Fugu Max i Fugu Ultra v2: dues variants d'una mateixa arquitectura d'orquestració multimodel.
- Fugu Max envia cada tasca al model més lleuger que la pugui resoldre i hi suma un nombre inèdit de models de pesos oberts i especialitzats, entre els quals la família NVIDIA Nemotron.
- Preu anunciat de Fugu Max: 2 dòlars per milió de tokens d'entrada i 6 per milió de tokens de sortida. L'empresa manté que la seva tarifa de sortida queda entre un 40% i un 60% per sota de les de Sonnet 5, GPT 5.6 Terra i Kimi K3.
- Fugu Ultra v2 puntua 48,3 a Chartography, davant del 27,3 d'Opus 5 i el 29,5 de Fable 5, i 74,3 a DeepSWE, segons dades de Sakana.
- Fugu Ultra v2 aconsegueix aquests resultats sense Fable 5, Fable 5.1 ni GPT-6-Astra al seu conjunt d'agents; l'entrenament es talla el 28 d'agost del 2026.
- Els dos models ja funcionen a l'API compatible amb OpenAI de l'empresa; qui faci servir Fugu només ha de canviar un paràmetre per passar-s'hi.
Dos objectius, una sola arquitectura
L'anunci de Sakana AI comença amb una crítica a l'únic eix en què competeix la indústria: durant una dècada, el sector ha corregut cap a models fundacionals cada cop més grans i cars. L'empresa defensa que la frontera que compta en la feina real té dues dimensions —capacitat d'una banda, cost de l'altra— i que utilitzar un model de diversos bilions de paràmetres per respondre una simple consulta de dades no és potència, és un balafiament.
Per això Fugu Max i Fugu Ultra v2 no arriben com dos productes diferents, sinó com el mateix nucli d'orquestració afinat per a dos encàrrecs. Fugu Max respon a una pregunta: quin és el millor resultat possible al mínim cost possible? Fugu Ultra v2 en respon una altra: fins on es pot arribar en tasques complexes de diversos passos?
De la beta d'abril al llançament de setembre
A l'anunci, Sakana AI repassa el camí fet en pocs mesos. A l'abril va obrir la beta, amb la qual diu que ha demostrat que l'orquestració multiagent es comporta com un model fundacional unificat. Al juny van arribar la disponibilitat general i Fugu Ultra v1, amb una tesi al darrere: una capa d'orquestració pot plantar cara als models frontera tancats als benchmarks més durs.
Al juliol l'empresa va presentar Fugu-Cyber i una interfície per a Claude Code, dues peces pensades per especialitzar l'orquestració en fluxos de treball concrets com la ciberseguretat i la programació. A l'agost van aparèixer Sakana Chat, que ensenyava com escalar el sistema a l'ús quotidià del gran públic, i els primers passos per integrar els models oberts NVIDIA Nemotron dins del seu acord amb NVIDIA. La fita de setembre és la d'avui: Fugu Max i Fugu Ultra v2.
L'empresa llegeix aquesta seqüència com la confirmació del que va prometre al principi: que l'orquestració guanya de manera sistemàtica als models aïllats i que un conjunt d'agents intercanviables blinda per disseny la cadena de subministrament.
Fugu Max: més models i menys despesa
Fugu Max eixampla el catàleg de models que Sakana Fugu pot orquestrar i hi afegeix, segons l'empresa, un nombre sense precedents de models open-weights (de pesos oberts: aquells dels quals es publiquen els paràmetres entrenats, de manera que qualsevol els pot descarregar i executar) i especialitzats, inclosa la família NVIDIA Nemotron que arriba del seu acord amb NVIDIA.
El mecanisme que descriu l'empresa és l'encaminament dinàmic: cada tasca va al model més lleuger que la pugui resoldre, per donar resultats de primer nivell gastant una fracció dels tokens. Sakana assegura que Fugu Max ocupa un punt de la frontera de Pareto on no arriba cap proveïdor d'un sol model, amb un rendiment proper al dels sistemes d'elit a un cost de dues a sis vegades menor, i remarca que, com que és una arquitectura i no un model tancat, aquest punt es pot ajustar i portar a qualsevol domini.
A les dades concretes de l'anunci, Fugu Max signa la millor puntuació global en sis proves: Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench i SWEFish, aquesta última un banc de proves intern construït amb els reptes i els casos d'ús de programació de la mateixa Sakana AI. El preu queda en 2 dòlars per milió de tokens d'entrada i 6 per milió de tokens de sortida, i l'empresa manté que la seva tarifa de sortida se situa entre un 40% i un 60% per sota de les de Sonnet 5, GPT 5.6 Terra i Kimi K3. En eficiència, afirma que ha ampliat la frontera de cost-rendiment en set de deu benchmarks.
Convé recordar dues coses: SWEFish és un banc de proves de la mateixa empresa i tots aquests resultats venen de la seva comunicació corporativa, sense verificació externa.
Fugu Ultra v2, la carta del rendiment màxim
La segona variant tira en sentit contrari dins del pla cost-capacitat. Per a raonament complex de diversos passos, recerca autònoma i desenvolupament de programari de cap a cap, Sakana situa Fugu Ultra v2 com la seva nova referència interna de qualitat bruta.
L'empresa diu que marca diferències en les tasques que exigeixen raonar de manera sostinguda sobre dades visuals i estructures complexes. A Chartography, que mesura raonament visual i interpretació de dades, declara 48,3 punts davant del 27,3 d'Opus 5 i el 29,5 de Fable 5. A DeepSWE, un banc de proves d'enginyeria de programari real, declara 74,3, per davant de models que —segons ella— costen entre tres i cinc vegades més per token. També assegura que va primera a SWEFish.
El balanç que presenta Sakana: millor puntuació o empat al primer lloc en cinc de vuit benchmarks (GDP.pdf, Chartography, SWEFish, DeepSWE i Toolathon) i presència entre els dos primers en set de vuit. L'entrenament de Fugu Ultra v2 es talla el 28 d'agost del 2026, i ni Fable 5 ni Fable 5.1 ni GPT-6-Astra no figuren al seu conjunt de models.
Sense dependre de cap model frontera
El que l'empresa subratlla és justament aquesta absència: Fugu Ultra v2 arribaria a aquestes xifres sense comptar amb Fable 5, Fable 5.1 ni GPT-6-Astra entre els seus agents. La seva lectura és que el sistema no necessita cap model frontera propietari concret per donar resultats de nivell frontera.
En orquestrar un conjunt intercanviable de models oberts i especialitzats, sosté l'empresa, el sistema supera els ecosistemes tancats i protegeix l'usuari del vendor lock-in, de les revocacions d'API, dels sotracs geopolítics i dels talls de servei sobtats. Amb la seva pròpia imatge: Fugu Max estira la frontera cap al nord-oest i Fugu Ultra v2 l'empeny cap amunt; entre tots dos, diu, demostren que orquestrar no obliga a triar entre cost i capacitat.
Disponibilitat i migració
Els dos models funcionen des d'avui a l'API compatible amb OpenAI de Sakana AI. Qui ja faci servir Fugu, assenyala l'empresa, passa a Max o a Ultra v2 canviant un sol paràmetre, sense cap procés de migració: arquitectura nova, mateixa API.
L'accés es fa per la pàgina de producte i per la consola de l'empresa, que a més ha publicat un informe tècnic del llançament.
Conclusió
Amb Fugu Max i Fugu Ultra v2, Sakana AI redobla l'aposta per l'orquestració com a arquitectura davant del model monolític: una variant empeny el preu cap avall i l'altra el rendiment cap amunt, totes dues sobre el mateix nucli i sobre un conjunt d'agents intercanviables que l'empresa associa a la resiliència i a la sobirania tecnològica. Ara bé, les xifres de benchmarks, els preus i les comparacions amb models rivals que sostenen aquest relat surten íntegrament de la comunicació de l'empresa —una de les proves és seva— i continuen sense contrast de tercers independents.
Fonts primàries
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
Comentarios