Robótica
AXIS lleva la recogida de datos de robótica al navegador: 207 tareas y 50.129 trayectorias
La escasez de datos es el cuello de botella real de la robótica moderna: los modelos crecen mucho más rápido que los conjuntos de demostraciones con los que se entrenan. AXIS propone romper esa dependencia del hardware de laboratorio trasladando la teleoperación a un navegador web y dejando el cómputo pesado en GPU de servidor. El resultado es un motor de datos con 207 tareas de manipulación y 50.129 trayectorias verificadas.
Recibe el resumen diario de IA
Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.
Al suscribirte aceptas recibir el newsletter de AI Informator. Puedes darte de baja cuando quieras.
En resumen
- AXIS reúne 207 tareas de manipulación robótica y 50.129 trayectorias verificadas con el brazo Franka.
- La recogida de demostraciones se hace desde un navegador web, sin necesidad de acceso físico a un robot.
- El preentrenamiento continuado con estos datos eleva al modelo pi0.5 de 83,9 a 88,8 puntos en LIBERO-Plus.
- Un control con el mismo volumen de datos procedentes de RoboCasa365 se queda en 57,5 puntos, lo que sugiere que la calidad importa más que el tamaño bruto.
El cuello de botella de la robótica no son los modelos, son los datos
En visión y lenguaje, el escalado se resolvió con corpus masivos extraídos de internet. En manipulación robótica no existe ese atajo: cada trayectoria exige un brazo real, un operador humano y tiempo de laboratorio. Esa restricción física explica por qué los conjuntos de datos de robótica siguen midiéndose en decenas de miles de episodios cuando los modelos de lenguaje se entrenan con billones de tokens (unidades mínimas de texto).
El enfoque de AXIS consiste en desacoplar al operador del hardware. La interfaz de teleoperación vive en el navegador y todo el trabajo costoso (simulación, renderizado, verificación) se ejecuta en GPU de backend. Cualquier persona con conexión puede aportar demostraciones, lo que convierte la recogida de datos en un problema de escala web y no de logística de laboratorio.
Las cifras apuntan a que la composición del conjunto pesa más que su tamaño
El dato más interesante no es el volumen, sino la comparación controlada. Al aplicar continual pretraining (preentrenamiento continuado) sobre pi0.5, un modelo de tipo VLA (Vision-Language-Action, visión-lenguaje-acción), la puntuación en el benchmark (prueba de rendimiento) LIBERO-Plus sube de 83,9 a 88,8. Un experimento de control con el mismo volumen de datos tomados de RoboCasa365 alcanza solo 57,5.
Esa brecha es el argumento central: si dos conjuntos del mismo tamaño producen resultados tan dispares, la variable determinante es la diversidad de tareas y la verificación de las trayectorias, no la cantidad. LIBERO-Plus es una variante endurecida del banco de pruebas LIBERO, diseñada precisamente para castigar a los modelos que memorizan escenas en lugar de generalizar.
El modelo de datos abiertos empieza a llegar a la manipulación
La robótica lleva años intentando replicar el efecto ImageNet con iniciativas como Open X-Embodiment o DROID, que agregan datos de múltiples laboratorios. La aportación diferencial de un motor basado en navegador es que no depende de que existan laboratorios con robots disponibles: amplía el embudo de contribuyentes potenciales de cientos a millones.
Queda la pregunta incómoda de siempre en simulación: cuánto de lo aprendido sobrevive al salto sim-to-real (de la simulación al mundo real). Las mejoras reportadas se miden en entornos simulados, y la transferencia a un brazo Franka físico en una cocina real sigue siendo el examen que ningún conjunto de datos ha aprobado todavía con holgura.
Conclusión
Si el patrón se confirma, AXIS señala un cambio de mentalidad: dejar de tratar los datos de robótica como un subproducto artesanal del laboratorio y empezar a diseñarlos como infraestructura, con criterios explícitos de diversidad y verificación. La diferencia de 31 puntos frente a un conjunto de volumen equivalente es un recordatorio de que en manipulación no gana quien acumula más episodios, sino quien acumula los episodios adecuados. El siguiente hito, y el único que importa de verdad, será ver esas ganancias replicadas sobre hardware físico y no solo en el simulador.
Fuentes primarias
Recibe el resumen diario de IA
Cada mañana, lo esencial de la inteligencia artificial en tu correo, sin humo. Al día con la IA.
Al suscribirte aceptas recibir el newsletter de AI Informator. Puedes darte de baja cuando quieras.
Comentarios