Models

Altres notícies

La jornada del 9 de setembre deixa un servidor d'inferència en Rust per a models de difusió de text, una tanda d'arXiv centrada en dades sintètiques i un assaig que qüestiona com trobem coses noves quan produir contingut ja no costa res. En el terreny industrial, Google Cloud i Accenture desplegen mil enginyers, ASML col·loca les seves màquines més avançades a TSMC i Samsung, i ChatGPT torna a batre el seu rècord d'usuaris. Onze històries breus que, juntes, dibuixen el pols del dia.

Rep el resum diari d'IA

Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

Freqüència:

En resum

  • Minnow, un servidor d'inferència en Rust, accelera els models de difusió de text LLaDA2.2, que generen refinant la seqüència completa en paral·lel en lloc de token a token.
  • Google Cloud i Accenture creen una unitat conjunta amb 1.000 enginyers desplegats al client per a portar Gemini Enterprise del pilot a producció, i DeepSeek obre una contractació sense precedents.
  • Similarweb estima que ChatGPT va arribar a 1.060 milions d'usuaris actius mensuals l'agost del 2026, el seu quart rècord consecutiu, tot i que es tracta d'un mesurament de tercers.

Minnow accelera els models de difusió LLaDA2.2 des de Rust

Minnow acelera los modelos de difusión LLaDA2.2 desde Rust
📷 Ilustración propia · InformAtor · fuente

El desenvolupador coder543 ha publicat a GitHub com a codi obert Minnow, un servidor d'inferència escrit en Rust i orientat a servir els models de difusió de text LLaDA2.2. A diferència de la generació autoregressiva clàssica, que produeix el text token a token, els models de difusió aplicats al llenguatge refinen en paral·lel tota la seqüència, cosa que obre marge d'acceleració. La família LLaDA va néixer en el paper arXiv 2502.09992 i la seva implementació de referència viu al repositori ML-GSAI/LLaDA.

Llegir-ne més: Minnow — repositori oficial en GitHub ↗

Vuit papers marquen el pols del renderitzat i la síntesi de dades generativa

Ocho papers marcan el pulso del renderizado y la síntesis de datos generativa
📷 Ilustración propia · InformAtor · fuente

La tanda d'arXiv del dia concentra vuit treballs sobre generació d'imatge, renderitzat neuronal i dades sintètiques, entre ells un model de difusió per a generar trajectòries d'eye-gaze (mirada), publicat com a arXiv 2609.05522. El conjunt revela un desplaçament de l'àrea: els models generatius deixen d'utilitzar-se només per a crear el contingut final i passen a fabricar les dades d'entrenament i les escenes intermèdies que alimenten altres sistemes.

Llegir-ne més: arXiv — Diffusion models for eye-gaze trajectory generation ↗

El problema del descobriment: la IA generativa canvia com trobem coses noves

El problema del descubrimiento: la IA generativa cambia cómo encontramos cosas nuevas
📷 M. H. Acevedo — The Discovery Problem · fuente

L'assaig The Discovery Problem, signat per M. H. Acevedo, sosté que la IA generativa està trencant els mecanismes amb què descobríem obres, productes i idees. Quan el cost de produir contingut cau a gairebé zero, l'escassetat es desplaça de la creació al filtratge, i els sistemes de recomanació i cerca construïts sobre la suposició contrària deixen de funcionar. Convé llegir-lo com el que és: una anàlisi d'opinió, no un anunci de producte.

Llegir-ne més: M. H. Acevedo — The Discovery Problem ↗

Ling-3.0-flash-Fin: un model obert de finances amb 5,1B de paràmetres actius

Ling-3.0-flash-Fin: un modelo abierto de finanzas con 5,1B de parámetros activos
📷 Ilustración propia · InformAtor · fuente

Ling-3.0-flash-Fin és un model obert especialitzat en finances amb 124.000 milions de paràmetres totals, dels quals només 5.100 milions s'activen per token gràcies a la seva arquitectura de mixture of experts (mescla d'experts). Està afinat per a tasques de recerca, anàlisi d'informes reguladors, fulls de valoració i informes amb citacions, i ja està disponible a OpenRouter. La recepta importa: capacitat d'un model gran amb el cost de còmput d'un de petit.

Llegir-ne més: OpenRouter — Ling-3.0-flash-Fin ↗

Antioch capta 32 milions per a substituir dades reals de robòtica per simulació

Antioch capta 32 millones para sustituir datos reales de robótica por simulación
📷 Crypto Briefing — Antioch raises $32M Series A · fuente

La startup Antioch ha aixecat una ronda de sèrie A de 32 milions de dòlars liderada per Greylock. La seva aposta és que la simulació d'alta fidelitat a escala de núvol redueix la quantitat de dades reals —cares i lentes de recollir— que necessiten els equips de robòtica, i deixa el món físic per a corregir els casos poc freqüents. La seva plataforma apunta a sistemes aeris, de magatzem, seguretat, fabricació i humanoides; la companyia afirma que equips com Amazon Ring ja fan servir aquest enfocament.

Llegir-ne més: Antioch — web oficial ↗

Google Cloud i Accenture creen una unitat conjunta amb 1.000 enginyers desplegats

Google Cloud y Accenture crean una unidad conjunta con 1.000 ingenieros desplegados
📷 Ilustración propia · InformAtor · fuente

Google Cloud i Accenture han llançat una unitat conjunta amb 1.000 enginyers forward-deployed (desplegats al client) que treballaran directament amb les empreses per a portar els projectes de Gemini Enterprise de la fase pilot a producció. El moviment reconeix quin és el coll d'ampolla real de l'adopció empresarial de la IA: no la capacitat del model, sinó la integració amb els sistemes i processos que ja existeixen en cada companyia.

Llegir-ne més: Google Cloud — Newsroom ↗

DeepSeek obre una contractació massiva per a sostenir la seva demanda

DeepSeek abre una contratación masiva para sostener su demanda
📷 Ilustración propia · InformAtor · fuente

Segons el South China Morning Post, DeepSeek ha llançat una campanya de contractació sense precedents a la companyia: el creixement del nombre d'usuaris i la creixent complexitat dels seus sistemes de backend (la capa interna que sosté el servei) l'obliguen a reforçar el talent d'infraestructura. L'empresa és a més una de les sis assenyalades aquell mateix dia per la NSA, la CISA i l'FBI en el seu avís sobre destil·lació de models estatunidencs.

Llegir-ne més: South China Morning Post — DeepSeek ↗

TSMC i Samsung adopten les màquines High-NA EUV d'ASML

TSMC y Samsung adoptan las máquinas High-NA EUV de ASML
📷 CNBC · fuente

CNBC informa que TSMC i Samsung estan adoptant les eines High-NA EUV (litografia ultraviolada extrema d'alta obertura numèrica) d'ASML per a fabricar xips més avançats. Samsung ha detallat la seva col·laboració, mentre que TSMC i ASML van anunciar un moviment cap a fotomàscares de mida més gran per a aquesta mateixa generació de fabricació. És la capa física, poc visible però decisiva, sobre la qual descansa tota la cursa de la IA.

Llegir-ne més: ASML — Newsroom ↗

El connectoma de la mosca es converteix en programari executable

El conectoma de la mosca se convierte en software ejecutable
📷 Ilustración propia · InformAtor · fuente

El connectoma —el mapa complet de connexions neuronals— del sistema nerviós del mascle de la mosca de la fruita, amb unes 166.000 neurones reconstruïdes, ja es pot executar com a programari. Un experiment va cablejar 499 neurones, 15.865 arestes i uns 867.000 contactes sinàptics a un classificador d'emoció en veu; en desordenar el cablejat original el rendiment amb prou feines es va moure (16,88% enfront de 16,84% de precisió mitjana), senyal que el circuit real no era l'ingredient secret. Un altre projecte és un joc en WebAssembly les mosques no jugadores del qual executen les 166.000 neurones completes.

Llegir-ne més: FlyWire — connectoma de Drosophila ↗

vLLM integra HiSparse híbrid per a les peticions molt llargues de GLM 5.3

vLLM integra HiSparse híbrido para las peticiones muy largas de GLM 5.3
📷 Ilustración propia · InformAtor · fuente

El motor d'inferència vLLM ha integrat Hybrid HiSparse per a GLM 5.3, de manera que una petició molt llarga pugui continuar descodificant encara que la seva memòria cau clau-valor —la memòria de treball on el model desa els tokens anteriors— ja no càpiga a la memòria d'alta amplada de banda de la GPU. HiSparse aconsegueix que l'atenció Sparse MLA només atengui els tokens més rellevants en lloc de la seqüència sencera.

Llegir-ne més: vLLM — repositori oficial ↗

ChatGPT assoleix 1.060 milions d'usuaris actius mensuals

ChatGPT alcanza 1.060 millones de usuarios activos mensuales
📷 Ilustración propia · InformAtor · fuente

Similarweb calcula que ChatGPT va assolir 1.060 milions d'usuaris actius mensuals l'agost del 2026, el seu quart rècord mensual consecutiu. Convé llegir la xifra amb la cautela que mereix: prové d'una estimació de tercers basada en mesurament de trànsit, no d'una dada publicada per OpenAI. Tot i així, la tendència sostinguda durant quatre mesos seguits diu alguna cosa sobre el ritme al qual l'eina continua guanyant terreny.

Llegir-ne més: Similarweb ↗

Conclusió

El dia no deixa un titular únic que el domini, sinó una fotografia de conjunt bastant nítida: per sota, la infraestructura s'optimitza a marxes forçades —Rust per a la difusió de text, atenció dispersa en vLLM, litografia High-NA a les fàbriques—; per damunt, el problema ja no és la capacitat del model sinó integrar-lo, poblar-lo de dades i fer que algú trobi el que produeix. Entremig, la recerca comença a fer servir els models generatius per a fabricar les seves pròpies dades, i un connectoma de mosca recorda que copiar un circuit biològic no garanteix heretar-ne la intel·ligència.

Fonts primàries

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Rep el resum diari d'IA

    Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.

    Freqüència:

    ← Torna al blog