Models

Nemotron: el model petit afinat que bat un de 18 vegades més gran

Fastino Labs, la parella Nvidia-Palantir i Salesforce han fet el mateix en cinc setmanes: agafar Nemotron, la família de models oberts de Nvidia, i convertir-la en un model propi per a una sola tasca. En el cas més ben documentat, la versió petita afinada encerta el 86,7 % i deixa 31,2 punts enrere la germana gegant. Totes les xifres són de part.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

Il·lustració d'un robot en pose de vencedor, amb el logotip i la paraula NEMOTRON al pit, dret damunt d'un armari de servidor abatut: tombat de costat, amb el frontal de vidre rebentat en teranyina, el panell bonyegut, la porta penjant de la frontissa i els pilots apagats, cables escampats per terra i fum. El robot és l'única cosa encesa de l'escena.
📷 Imatge generada amb IA

En resum

  • L'11 d'agost de 2026, Fastino Labs va publicar dos models de finances i sanitat sobre Nemotron 3.5 Lightning, amb els pesos oberts sota Apache 2.0.
  • El 10 de setembre, Nvidia i Palantir van presentar un Nemotron afinat per repartir components escassos entre les fàbriques de Nvidia.
  • El 15 de setembre, a Dreamforce, Salesforce va presentar Koa, un model de raonament per a la gestió de clients construït sobre Nemotron 3 Super.
  • El 16 de setembre, Amazon SageMaker AI va afegir l'afinat sense servidor de Nemotron 3.5 Lightning en quatre regions.

El mateix model obert sota tres productes diferents

En cinc setmanes, tres organitzacions diferents han arribat al mateix lloc pel seu compte. L'11 d'agost de 2026, Fastino Labs va publicar dos models especialitzats, un de finances i un altre de sanitat. El 10 de setembre, Nvidia i Palantir van ensenyar a l'AIPCon un model que reparteix components escassos entre les fàbriques de Nvidia. El 15 de setembre, Salesforce va presentar Koa, el motor de raonament dels seus agents.

Palantir és l'empresa nord-americana de programari d'anàlisi de dades per a governs i grans companyies, i aquí Nvidia hi figura com a client. Salesforce és la nord-americana de programari de gestió de clients, i va anunciar Koa a Dreamforce, el seu congrés anual. De Fastino Labs només consta el que publica.

Nvidia publica el model demanant que el modifiquin

Tres casos verificats de models fets sobre Nemotron
Qui Quan Què va fer amb Nemotron Base i mida Pesos oberts?
Fastino Labs 11-08-2026 Dos models especialitzats en finances i sanitat, post-entrenats per un agent autònom en menys de 10 hores Nemotron 3.5 Lightning, 30.000 M / 3.000 M actius Sí, Apache 2.0
NVIDIA i Palantir 10-09-2026 Repartiment de components escassos entre les fàbriques de NVIDIA Nemotron 3.5 Lightning, 30.000 M / 3.000 M actius No ho diu
Salesforce 15-09-2026 Koa, model de raonament per a la gestió de clients Nemotron 3 Super, 120.000 M / 12.000 M actius No
Les xifres de rendiment dels tres casos les publiquen les mateixes empreses i cap no està auditada per un tercer.

La fitxa oficial de Nemotron 3.5 Lightning descriu els seus pesos com «els pesos de referència del model, pensats principalment com a punt de partida per a la personalització: post-entrenament —SFT, aprenentatge per reforç, destil·lació— i adaptació a un domini». Nvidia no publica un producte acabat, sinó un material de construcció.

El permís ve de sèrie: la Nvidia Nemotron Open Model License deixa fer servir, modificar i desplegar comercialment els models i els seus derivats; és perpètua, gratuïta i irrevocable, i Nvidia no es reserva la propietat del que generin. Només demana incloure un avís en redistribuir. Què hi guanya, no ho explica.

Un model de 30.000 milions encerta més que un de 550.000

Encerts en les decisions de repartiment de components
Lightning afinat (30.000 M): 86,7% Lightning afinat (30.000 M) 86,7% Ultra generalista (550.000 M): 55,5% Ultra generalista (550.000 M) 55,5% Lightning sense afinar (30.000 M): 17,5% Lightning sense afinar (30.000 M) 17,5%
Ver los datos en tabla
Lightning afinat (30.000 M)Ultra generalista (550.000 M)Lightning sense afinar (30.000 M)
Encerts 86,7%55,5%17,5%
Prova retrospectiva de NVIDIA i Palantir sobre la seva pròpia cadena de subministrament; no està auditada per un tercer i no es diu sobre quants casos es va mesurar.

El cas de Nvidia i Palantir porta l'única comparació neta. La tasca és repartir les peces que escassegen —CPU Grace, GPU Blackwell i memòria HBM3e— entre les plantes de muntatge, amb un rack Vera Rubin d'1,3 milions de peces i una disponibilitat que canvia cada setmana. El model avalua el risc, recomana un rang i explica el seu raonament.

Compte amb l'autoria: no és un model de Palantir. És el model obert de Nvidia, post-entrenat per les dues empreses juntes sobre Palantir Foundry, la plataforma de dades de Palantir, i qui se'n beneficia és la cadena de subministrament de Nvidia. No té nom propi, i si en publicaran els pesos, tampoc no es diu.

Els números són d'una prova retrospectiva pròpia, sense auditoria externa: el Lightning afinat encerta el 86,7 %, davant del 55,5 % de l'Ultra generalista de 550.000 milions i del 17,5 % del Lightning sense afinar. Sobre quants casos es va mesurar, no ho diuen.

Salesforce ha ficat gairebé trenta anys de desplegaments dins del model

Koa no és un agent: és el model que raona per sota d'ells, fet «per ajudar els agents a raonar en fluxos de treball complexos i de diversos passos». Es va construir post-entrenant Nemotron 3 Super amb dades sintètiques pròpies, modelades sobre gairebé tres dècades d'implantacions. Quants paràmetres té, no ho diu.

La seva xifra demana pinces: Salesforce diu que Koa «iguala o supera el rendiment dels models capdavanters en accions de CRM amb tres vegades menys errors», però la mesura és seva, sobre un banc de proves propi, sense auditoria externa i sense dir contra qui competeix. Hi ha pilots des d'octubre a Agentforce i disponibilitat general prevista per a l'hivern de 2026 als Estats Units. Els pesos no es publiquen.

Només un dels tres ha obert el que va construir

Fastino Labs tanca el patró per l'extrem contrari: els seus dos models són a Hugging Face amb els pesos oberts sota Apache 2.0, i tot el post-entrenament el va executar un agent autònom en menys de deu hores. Les seves xifres, també pròpies, van del 15,86 % al 59,23 % a FinQA, preguntes sobre informes financers, i arriben al 64,98 % a MEDEC, errors en textos clínics.

El cop final el va posar Amazon el 16 de setembre: SageMaker AI va afegir l'afinat sense servidor de Nemotron 3.5 Lightning. No és una quarta empresa amb el seu model, és un proveïdor que industrialitza el procés: el que exigia un equip capaç de post-entrenar passa a ser un formulari.

Conclusió

Nvidia no col·loca Nemotron com un producte que competeixi amb els models tancats, sinó com el punt de partida que cada empresa modifica. El 86,7 % explica per què compensa: per a una tasca acotada, un model petit i ben afinat bat un de divuit vegades més gran que no coneix l'ofici. La part incòmoda és la mateixa en els tres: les xifres són de part, ningú de fora no les ha revisat i dos dels tres derivats no es poden examinar. Amb l'afinat ja a un clic, aquesta asimetria apunta a norma.

Fonts primàries

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog