H Humanoid World
← Wiki

Figure Helix

El modelo Vision-Language-Action propio de Figure AI con arquitectura «System 1 / System 2».

Helix es el modelo Vision-Language-Action propietario que Figure AI presentó en febrero de 2025 para los robots humanoides de la empresa. Controla la parte superior del cuerpo con unos 35 grados de libertad (torso, cabeza, muñecas, dedos).

«System 1 / System 2»

Helix combina dos velocidades, inspirándose en el pensamiento rápido y lento:

  • System 2 (S2): un modelo Vision-Language preentrenado con datos de internet (~7 mil millones de parámetros) que «comprende» la escena y la orden verbal a baja frecuencia (7–9 Hz).
  • System 1 (S1): una política visuomotora rápida y reactiva (~80 millones de parámetros) que controla los motores a 200 Hz.

Así, el modelo une la comprensión semántica con un movimiento fluido y reactivo. Con él, Figure demostró tareas domésticas y comportamiento colaborativo entre varios robots. Helix está estrechamente optimizado para el hardware propio de Figure, a diferencia de los enfoques abiertos de NVIDIA GR00T o Hugging Face. Para contextualizar: panorama de los foundation models.

Stand: 26/6/2026