Otras noticias

Otras noticias de IA: modelos on-device, la PyTorch Foundation en China y la primera GPU AI-native de Arm

Un modelo compacto que corre en el propio dispositivo, la entrada de los gigantes chinos en la gobernanza de PyTorch, la primera GPU móvil de Arm diseñada para IA y un préstamo multimillonario de ByteDance para infraestructura. Cuatro noticias secundarias del día que apuntan en la misma dirección: la IA se acerca al hardware.

Recibe el resumen diario de IA

Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

Frecuencia:

Otras noticias de IA: modelos on-device, la PyTorch Foundation en China y la primera GPU AI-native de Arm
📷 Ilustración editorial — AI Informator

En resumen

  • OpenBMB lanza MiniCPM5-2B, un modelo denso de 2.516 millones de parámetros con licencia Apache 2.0 que promedia 53,9 en 34 benchmarks y se ejecuta en el propio dispositivo.
  • Alibaba Cloud y Cambricon entran como miembros Platinum en la PyTorch Foundation, y Ant Group también se suma, según se anunció en la PyTorch Conference China de Shanghái.
  • Arm presenta la Mali G2-Ultra NX, su primera GPU móvil diseñada de forma nativa para IA, con gráficos de clase escritorio y ray tracing en el móvil.
  • ByteDance capta un préstamo cercano a 29.600 millones de dólares, el mayor de su historia, para ampliar su infraestructura de IA.

OpenBMB lanza MiniCPM5-2B, un modelo de 2.500 millones de parámetros para ejecutar en el dispositivo

OpenBMB lanza MiniCPM5-2B, un modelo de 2.500 millones de parámetros para ejecutar en el dispositivo
📷 MarkTechPost — cobertura de MiniCPM5-2B · fuente

OpenBMB ha publicado MiniCPM5-2B, un modelo de lenguaje denso (dense, es decir, que activa todos sus parámetros en cada consulta, frente a las arquitecturas de expertos) con 2.516 millones de parámetros y una ventana de contexto nativa de 131.072 tokens. Según su ficha técnica, promedia 53,9 puntos en 34 benchmarks (pruebas estandarizadas de rendimiento), por delante de Qwen3.5-4B (51,1), con especial fortaleza en uso de herramientas, agentes de código y recuperación de contexto largo. Los pesos se distribuyen bajo licencia Apache 2.0 y hay builds GGUF desde 1,56 GB que cargan en vLLM, SGLang, llama.cpp, Ollama y MLX sin necesidad de bifurcar (fork) el código. La lectura importante es que un modelo competitivo cabe ya en un portátil o un móvil y funciona on-device (en el propio dispositivo), sin enviar datos a la nube.

Alibaba Cloud, Ant Group, Cambricon y Huawei refuerzan el stack de IA abierto en la PyTorch Conference China

Alibaba Cloud, Ant Group, Cambricon y Huawei refuerzan el stack de IA abierto en la PyTorch Conference China
📷 Ilustración editorial — AI Informator

Durante la PyTorch Conference China, celebrada en Shanghái, se anunció la incorporación de Alibaba Cloud y Cambricon a la PyTorch Foundation como miembros Platinum, el nivel más alto de membresía, junto a la entrada de Ant Group en la fundación. PyTorch es el framework (entorno de desarrollo) de código abierto sobre el que se entrena y despliega buena parte de los modelos de IA actuales, por lo que su gobernanza determina qué hardware y qué necesidades se atienden primero. Que los grandes proveedores chinos de nube y de chips se sienten en esa mesa significa que el stack (pila de software) abierto de referencia deberá dar soporte a un ecosistema de aceleradores cada vez más diverso.

Arm presenta la Mali G2-Ultra NX, su primera GPU móvil diseñada de forma nativa para IA

Arm presenta la Mali G2-Ultra NX, su primera GPU móvil diseñada de forma nativa para IA
📷 Arm Newsroom · fuente

Arm ha presentado la Mali G2-Ultra NX, que la compañía describe como su primera GPU (unidad de procesamiento gráfico) móvil concebida de forma nativa para cargas de trabajo de inteligencia artificial. Además del enfoque en IA, el diseño incorpora mejoras gráficas de clase escritorio y ray tracing (trazado de rayos, la técnica de iluminación realista habitual en consolas y PC) en dispositivos móviles. Su relevancia va más allá del apartado gráfico: acercar la aceleración de IA al propio teléfono permite ejecutar inferencia local en el borde (edge), es decir, resolver las peticiones en el dispositivo en lugar de enviarlas a un centro de datos.

ByteDance capta un préstamo cercano a 29.600 millones de dólares para infraestructura de IA

ByteDance capta un préstamo cercano a 29.600 millones de dólares para infraestructura de IA
📷 The Tech Capital · fuente

ByteDance, matriz de TikTok, ha cerrado un préstamo de alrededor de 29.600 millones de dólares, el mayor de su historia, según una persona con conocimiento de la financiación citada por The Information. La operación llega en un momento en que la compañía acelera su capex (capital expenditure, gasto de capital en activos como centros de datos y chips) para ampliar su infraestructura de inteligencia artificial. La cifra sirve de termómetro del pulso inversor actual: los gigantes tecnológicos están recurriendo a deuda de gran escala para asegurarse capacidad de cómputo, un recurso que hoy marca el ritmo de la competencia en IA.

Conclusión

Las cuatro noticias comparten un mismo hilo: la IA está bajando al hardware. Modelos que caben en un móvil, una GPU pensada desde el principio para inferencia local, fabricantes de chips entrando en la gobernanza del framework abierto dominante y miles de millones en deuda para levantar centros de datos. El software sigue avanzando, pero la partida que se juega ahora es dónde y sobre qué silicio se ejecutan los modelos.

Fuentes primarias

Comentarios

Sé respetuoso. Los comentarios se moderan.

    Recibe el resumen diario de IA

    Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.

    Frecuencia:

    ← Volver al blog