Models
Nemotron: el model petit afinat que bat un de 18 vegades més gran
Fastino Labs, la parella Nvidia-Palantir i Salesforce han fet el mateix en cinc setmanes: agafar Nemotron, la família de models oberts de Nvidia, i convertir-la en un model propi per a una sola tasca. En el cas més ben documentat, la versió petita afinada encerta el 86,7 % i deixa 31,2 punts enrere la germana gegant. Totes les xifres són de part.
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
En resum
- L'11 d'agost de 2026, Fastino Labs va publicar dos models de finances i sanitat sobre Nemotron 3.5 Lightning, amb els pesos oberts sota Apache 2.0.
- El 10 de setembre, Nvidia i Palantir van presentar un Nemotron afinat per repartir components escassos entre les fàbriques de Nvidia.
- El 15 de setembre, a Dreamforce, Salesforce va presentar Koa, un model de raonament per a la gestió de clients construït sobre Nemotron 3 Super.
- El 16 de setembre, Amazon SageMaker AI va afegir l'afinat sense servidor de Nemotron 3.5 Lightning en quatre regions.
El mateix model obert sota tres productes diferents
En cinc setmanes, tres organitzacions diferents han arribat al mateix lloc pel seu compte. L'11 d'agost de 2026, Fastino Labs va publicar dos models especialitzats, un de finances i un altre de sanitat. El 10 de setembre, Nvidia i Palantir van ensenyar a l'AIPCon un model que reparteix components escassos entre les fàbriques de Nvidia. El 15 de setembre, Salesforce va presentar Koa, el motor de raonament dels seus agents.
Palantir és l'empresa nord-americana de programari d'anàlisi de dades per a governs i grans companyies, i aquí Nvidia hi figura com a client. Salesforce és la nord-americana de programari de gestió de clients, i va anunciar Koa a Dreamforce, el seu congrés anual. De Fastino Labs només consta el que publica.
Nvidia publica el model demanant que el modifiquin
| Qui | Quan | Què va fer amb Nemotron | Base i mida | Pesos oberts? |
|---|---|---|---|---|
| Fastino Labs | 11-08-2026 | Dos models especialitzats en finances i sanitat, post-entrenats per un agent autònom en menys de 10 hores | Nemotron 3.5 Lightning, 30.000 M / 3.000 M actius | Sí, Apache 2.0 |
| NVIDIA i Palantir | 10-09-2026 | Repartiment de components escassos entre les fàbriques de NVIDIA | Nemotron 3.5 Lightning, 30.000 M / 3.000 M actius | No ho diu |
| Salesforce | 15-09-2026 | Koa, model de raonament per a la gestió de clients | Nemotron 3 Super, 120.000 M / 12.000 M actius | No |
La fitxa oficial de Nemotron 3.5 Lightning descriu els seus pesos com «els pesos de referència del model, pensats principalment com a punt de partida per a la personalització: post-entrenament —SFT, aprenentatge per reforç, destil·lació— i adaptació a un domini». Nvidia no publica un producte acabat, sinó un material de construcció.
El permís ve de sèrie: la Nvidia Nemotron Open Model License deixa fer servir, modificar i desplegar comercialment els models i els seus derivats; és perpètua, gratuïta i irrevocable, i Nvidia no es reserva la propietat del que generin. Només demana incloure un avís en redistribuir. Què hi guanya, no ho explica.
Un model de 30.000 milions encerta més que un de 550.000
Ver los datos en tabla
| Lightning afinat (30.000 M) | Ultra generalista (550.000 M) | Lightning sense afinar (30.000 M) | |
|---|---|---|---|
| Encerts | 86,7% | 55,5% | 17,5% |
El cas de Nvidia i Palantir porta l'única comparació neta. La tasca és repartir les peces que escassegen —CPU Grace, GPU Blackwell i memòria HBM3e— entre les plantes de muntatge, amb un rack Vera Rubin d'1,3 milions de peces i una disponibilitat que canvia cada setmana. El model avalua el risc, recomana un rang i explica el seu raonament.
Compte amb l'autoria: no és un model de Palantir. És el model obert de Nvidia, post-entrenat per les dues empreses juntes sobre Palantir Foundry, la plataforma de dades de Palantir, i qui se'n beneficia és la cadena de subministrament de Nvidia. No té nom propi, i si en publicaran els pesos, tampoc no es diu.
Els números són d'una prova retrospectiva pròpia, sense auditoria externa: el Lightning afinat encerta el 86,7 %, davant del 55,5 % de l'Ultra generalista de 550.000 milions i del 17,5 % del Lightning sense afinar. Sobre quants casos es va mesurar, no ho diuen.
Salesforce ha ficat gairebé trenta anys de desplegaments dins del model
Koa no és un agent: és el model que raona per sota d'ells, fet «per ajudar els agents a raonar en fluxos de treball complexos i de diversos passos». Es va construir post-entrenant Nemotron 3 Super amb dades sintètiques pròpies, modelades sobre gairebé tres dècades d'implantacions. Quants paràmetres té, no ho diu.
La seva xifra demana pinces: Salesforce diu que Koa «iguala o supera el rendiment dels models capdavanters en accions de CRM amb tres vegades menys errors», però la mesura és seva, sobre un banc de proves propi, sense auditoria externa i sense dir contra qui competeix. Hi ha pilots des d'octubre a Agentforce i disponibilitat general prevista per a l'hivern de 2026 als Estats Units. Els pesos no es publiquen.
Només un dels tres ha obert el que va construir
Fastino Labs tanca el patró per l'extrem contrari: els seus dos models són a Hugging Face amb els pesos oberts sota Apache 2.0, i tot el post-entrenament el va executar un agent autònom en menys de deu hores. Les seves xifres, també pròpies, van del 15,86 % al 59,23 % a FinQA, preguntes sobre informes financers, i arriben al 64,98 % a MEDEC, errors en textos clínics.
El cop final el va posar Amazon el 16 de setembre: SageMaker AI va afegir l'afinat sense servidor de Nemotron 3.5 Lightning. No és una quarta empresa amb el seu model, és un proveïdor que industrialitza el procés: el que exigia un equip capaç de post-entrenar passa a ser un formulari.
Conclusió
Nvidia no col·loca Nemotron com un producte que competeixi amb els models tancats, sinó com el punt de partida que cada empresa modifica. El 86,7 % explica per què compensa: per a una tasca acotada, un model petit i ben afinat bat un de divuit vegades més gran que no coneix l'ofici. La part incòmoda és la mateixa en els tres: les xifres són de part, ningú de fora no les ha revisat i dos dels tres derivats no es poden examinar. Amb l'afinat ja a un clic, aquesta asimetria apunta a norma.
Fonts primàries
- NVIDIA — Nemotron, família de models oberts ↗
- NVIDIA — llicència NVIDIA Nemotron Open Model License ↗
- Salesforce — Koa, el seu primer model de raonament per a CRM ↗
- NVIDIA — el Nemotron que reparteix components a Palantir Foundry ↗
- Fastino Labs — dos models oberts post-entrenats sobre Nemotron ↗
- AWS — personalització de Nemotron 3.5 Lightning a Amazon SageMaker AI ↗
- AI Informator — NVIDIA entrena un model propi per repartir els seus xips escassos entre les seves fàbriques ↗
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
Comentarios