Models
Altres notícies
La jornada del 9 de setembre deixa un servidor d'inferència en Rust per a models de difusió de text, una tanda d'arXiv centrada en dades sintètiques i un assaig que qüestiona com trobem coses noves quan produir contingut ja no costa res. En el terreny industrial, Google Cloud i Accenture desplegen mil enginyers, ASML col·loca les seves màquines més avançades a TSMC i Samsung, i ChatGPT torna a batre el seu rècord d'usuaris. Onze històries breus que, juntes, dibuixen el pols del dia.
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
En resum
- Minnow, un servidor d'inferència en Rust, accelera els models de difusió de text LLaDA2.2, que generen refinant la seqüència completa en paral·lel en lloc de token a token.
- Google Cloud i Accenture creen una unitat conjunta amb 1.000 enginyers desplegats al client per a portar Gemini Enterprise del pilot a producció, i DeepSeek obre una contractació sense precedents.
- Similarweb estima que ChatGPT va arribar a 1.060 milions d'usuaris actius mensuals l'agost del 2026, el seu quart rècord consecutiu, tot i que es tracta d'un mesurament de tercers.
Minnow accelera els models de difusió LLaDA2.2 des de Rust
El desenvolupador coder543 ha publicat a GitHub com a codi obert Minnow, un servidor d'inferència escrit en Rust i orientat a servir els models de difusió de text LLaDA2.2. A diferència de la generació autoregressiva clàssica, que produeix el text token a token, els models de difusió aplicats al llenguatge refinen en paral·lel tota la seqüència, cosa que obre marge d'acceleració. La família LLaDA va néixer en el paper arXiv 2502.09992 i la seva implementació de referència viu al repositori ML-GSAI/LLaDA.
Vuit papers marquen el pols del renderitzat i la síntesi de dades generativa
La tanda d'arXiv del dia concentra vuit treballs sobre generació d'imatge, renderitzat neuronal i dades sintètiques, entre ells un model de difusió per a generar trajectòries d'eye-gaze (mirada), publicat com a arXiv 2609.05522. El conjunt revela un desplaçament de l'àrea: els models generatius deixen d'utilitzar-se només per a crear el contingut final i passen a fabricar les dades d'entrenament i les escenes intermèdies que alimenten altres sistemes.
Llegir-ne més: arXiv — Diffusion models for eye-gaze trajectory generation ↗
El problema del descobriment: la IA generativa canvia com trobem coses noves
L'assaig The Discovery Problem, signat per M. H. Acevedo, sosté que la IA generativa està trencant els mecanismes amb què descobríem obres, productes i idees. Quan el cost de produir contingut cau a gairebé zero, l'escassetat es desplaça de la creació al filtratge, i els sistemes de recomanació i cerca construïts sobre la suposició contrària deixen de funcionar. Convé llegir-lo com el que és: una anàlisi d'opinió, no un anunci de producte.
Ling-3.0-flash-Fin: un model obert de finances amb 5,1B de paràmetres actius
Ling-3.0-flash-Fin és un model obert especialitzat en finances amb 124.000 milions de paràmetres totals, dels quals només 5.100 milions s'activen per token gràcies a la seva arquitectura de mixture of experts (mescla d'experts). Està afinat per a tasques de recerca, anàlisi d'informes reguladors, fulls de valoració i informes amb citacions, i ja està disponible a OpenRouter. La recepta importa: capacitat d'un model gran amb el cost de còmput d'un de petit.
Antioch capta 32 milions per a substituir dades reals de robòtica per simulació
La startup Antioch ha aixecat una ronda de sèrie A de 32 milions de dòlars liderada per Greylock. La seva aposta és que la simulació d'alta fidelitat a escala de núvol redueix la quantitat de dades reals —cares i lentes de recollir— que necessiten els equips de robòtica, i deixa el món físic per a corregir els casos poc freqüents. La seva plataforma apunta a sistemes aeris, de magatzem, seguretat, fabricació i humanoides; la companyia afirma que equips com Amazon Ring ja fan servir aquest enfocament.
Google Cloud i Accenture creen una unitat conjunta amb 1.000 enginyers desplegats
Google Cloud i Accenture han llançat una unitat conjunta amb 1.000 enginyers forward-deployed (desplegats al client) que treballaran directament amb les empreses per a portar els projectes de Gemini Enterprise de la fase pilot a producció. El moviment reconeix quin és el coll d'ampolla real de l'adopció empresarial de la IA: no la capacitat del model, sinó la integració amb els sistemes i processos que ja existeixen en cada companyia.
DeepSeek obre una contractació massiva per a sostenir la seva demanda
Segons el South China Morning Post, DeepSeek ha llançat una campanya de contractació sense precedents a la companyia: el creixement del nombre d'usuaris i la creixent complexitat dels seus sistemes de backend (la capa interna que sosté el servei) l'obliguen a reforçar el talent d'infraestructura. L'empresa és a més una de les sis assenyalades aquell mateix dia per la NSA, la CISA i l'FBI en el seu avís sobre destil·lació de models estatunidencs.
TSMC i Samsung adopten les màquines High-NA EUV d'ASML
CNBC informa que TSMC i Samsung estan adoptant les eines High-NA EUV (litografia ultraviolada extrema d'alta obertura numèrica) d'ASML per a fabricar xips més avançats. Samsung ha detallat la seva col·laboració, mentre que TSMC i ASML van anunciar un moviment cap a fotomàscares de mida més gran per a aquesta mateixa generació de fabricació. És la capa física, poc visible però decisiva, sobre la qual descansa tota la cursa de la IA.
El connectoma de la mosca es converteix en programari executable
El connectoma —el mapa complet de connexions neuronals— del sistema nerviós del mascle de la mosca de la fruita, amb unes 166.000 neurones reconstruïdes, ja es pot executar com a programari. Un experiment va cablejar 499 neurones, 15.865 arestes i uns 867.000 contactes sinàptics a un classificador d'emoció en veu; en desordenar el cablejat original el rendiment amb prou feines es va moure (16,88% enfront de 16,84% de precisió mitjana), senyal que el circuit real no era l'ingredient secret. Un altre projecte és un joc en WebAssembly les mosques no jugadores del qual executen les 166.000 neurones completes.
vLLM integra HiSparse híbrid per a les peticions molt llargues de GLM 5.3
El motor d'inferència vLLM ha integrat Hybrid HiSparse per a GLM 5.3, de manera que una petició molt llarga pugui continuar descodificant encara que la seva memòria cau clau-valor —la memòria de treball on el model desa els tokens anteriors— ja no càpiga a la memòria d'alta amplada de banda de la GPU. HiSparse aconsegueix que l'atenció Sparse MLA només atengui els tokens més rellevants en lloc de la seqüència sencera.
ChatGPT assoleix 1.060 milions d'usuaris actius mensuals
Similarweb calcula que ChatGPT va assolir 1.060 milions d'usuaris actius mensuals l'agost del 2026, el seu quart rècord mensual consecutiu. Convé llegir la xifra amb la cautela que mereix: prové d'una estimació de tercers basada en mesurament de trànsit, no d'una dada publicada per OpenAI. Tot i així, la tendència sostinguda durant quatre mesos seguits diu alguna cosa sobre el ritme al qual l'eina continua guanyant terreny.
Conclusió
El dia no deixa un titular únic que el domini, sinó una fotografia de conjunt bastant nítida: per sota, la infraestructura s'optimitza a marxes forçades —Rust per a la difusió de text, atenció dispersa en vLLM, litografia High-NA a les fàbriques—; per damunt, el problema ja no és la capacitat del model sinó integrar-lo, poblar-lo de dades i fer que algú trobi el que produeix. Entremig, la recerca comença a fer servir els models generatius per a fabricar les seves pròpies dades, i un connectoma de mosca recorda que copiar un circuit biològic no garanteix heretar-ne la intel·ligència.
Fonts primàries
- Minnow — repositori oficial en GitHub ↗
- arXiv — Diffusion models for eye-gaze trajectory generation ↗
- M. H. Acevedo — The Discovery Problem ↗
- OpenRouter — Ling-3.0-flash-Fin ↗
- Antioch — web oficial ↗
- Google Cloud — Newsroom ↗
- South China Morning Post — DeepSeek ↗
- ASML — Newsroom ↗
- FlyWire — connectoma de Drosophila ↗
- vLLM — repositori oficial ↗
- Similarweb ↗
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
Comentarios