Altres notícies
Altres notícies d'IA: models on-device, la PyTorch Foundation a la Xina i la primera GPU AI-native d'Arm
Un model compacte que s'executa en el mateix dispositiu, l'entrada dels gegants xinesos en la governança de PyTorch, la primera GPU mòbil d'Arm dissenyada per a IA i un préstec multimilionari de ByteDance per a infraestructura. Quatre notícies secundàries del dia que apunten en la mateixa direcció: la IA s'acosta al maquinari.
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
En resum
- OpenBMB llança MiniCPM5-2B, un model dens de 2.516 milions de paràmetres amb llicència Apache 2.0 que fa una mitjana de 53,9 en 34 benchmarks i s'executa en el mateix dispositiu.
- Alibaba Cloud i Cambricon entren com a membres Platinum en la PyTorch Foundation, i Ant Group també s'hi suma, segons es va anunciar en la PyTorch Conference China de Xangai.
- Arm presenta la Mali G2-Ultra NX, la seva primera GPU mòbil dissenyada de manera nativa per a IA, amb gràfics de classe escriptori i ray tracing en el mòbil.
- ByteDance capta un préstec proper als 29.600 milions de dòlars, el més gran de la seva història, per ampliar la seva infraestructura d'IA.
OpenBMB llança MiniCPM5-2B, un model de 2.500 milions de paràmetres per executar en el dispositiu
OpenBMB ha publicat MiniCPM5-2B, un model de llenguatge dense (dens, és a dir, que activa tots els seus paràmetres en cada consulta, davant de les arquitectures d'experts) amb 2.516 milions de paràmetres i una finestra de context nativa de 131.072 tokens. Segons la seva fitxa tècnica, fa una mitjana de 53,9 punts en 34 benchmarks (proves estandarditzades de rendiment), per davant de Qwen3.5-4B (51,1), amb una fortalesa especial en ús d'eines, agents de codi i recuperació de context llarg. Els pesos es distribueixen sota llicència Apache 2.0 i hi ha builds GGUF des d'1,56 GB que carreguen en vLLM, SGLang, llama.cpp, Ollama i MLX sense necessitat de bifurcar (fork) el codi. La lectura important és que un model competitiu ja cap en un portàtil o un mòbil i funciona on-device (en el mateix dispositiu), sense enviar dades al núvol.
Alibaba Cloud, Ant Group, Cambricon i Huawei reforcen l'stack d'IA obert en la PyTorch Conference China
Durant la PyTorch Conference China, celebrada a Xangai, es va anunciar la incorporació d'Alibaba Cloud i Cambricon a la PyTorch Foundation com a membres Platinum, el nivell més alt de membresia, juntament amb l'entrada d'Ant Group en la fundació. PyTorch és el framework (entorn de desenvolupament) de codi obert sobre el qual s'entrena i es desplega bona part dels models d'IA actuals, de manera que la seva governança determina quin maquinari i quines necessitats s'atenen primer. Que els grans proveïdors xinesos de núvol i de xips seguin en aquesta taula significa que l'stack (pila de programari) obert de referència haurà de donar suport a un ecosistema d'acceleradors cada vegada més divers.
Arm presenta la Mali G2-Ultra NX, la seva primera GPU mòbil dissenyada de manera nativa per a IA
Arm ha presentat la Mali G2-Ultra NX, que la companyia descriu com la seva primera GPU (unitat de processament gràfic) mòbil concebuda de manera nativa per a càrregues de treball d'intel·ligència artificial. A més de l'enfocament en IA, el disseny incorpora millores gràfiques de classe escriptori i ray tracing (traçat de raigs, la tècnica d'il·luminació realista corrent en consoles i PC) en dispositius mòbils. La seva rellevància va més enllà de l'apartat gràfic: acostar l'acceleració d'IA al mateix telèfon permet executar inferència local en la vora (edge), és a dir, resoldre les peticions en el dispositiu en lloc d'enviar-les a un centre de dades.
ByteDance capta un préstec proper als 29.600 milions de dòlars per a infraestructura d'IA
ByteDance, matriu de TikTok, ha tancat un préstec d'uns 29.600 milions de dòlars, el més gran de la seva història, segons una persona amb coneixement del finançament citada per The Information. L'operació arriba en un moment en què la companyia accelera el seu capex (capital expenditure, despesa de capital en actius com centres de dades i xips) per ampliar la seva infraestructura d'intel·ligència artificial. La xifra serveix de termòmetre del pols inversor actual: els gegants tecnològics estan recorrent a deute a gran escala per assegurar-se capacitat de còmput, un recurs que avui marca el ritme de la competència en IA.
Conclusió
Les quatre notícies comparteixen un mateix fil: la IA està baixant al maquinari. Models que caben en un mòbil, una GPU pensada des del principi per a inferència local, fabricants de xips entrant en la governança del framework obert dominant i milers de milions en deute per a aixecar centres de dades. El programari continua avançant, però la partida que es juga ara és on i sobre quin silici s'executen els models.
Fonts primàries
Rep el resum diari d'IA
Cada matí, l'essencial de la intel·ligència artificial al teu correu, sense fum. Al dia amb la IA.
En subscriure-t'hi acceptes rebre el butlletí d'AI Informator. Pots donar-te de baixa quan vulguis.
Comentarios