Figure Helix
Das hauseigene Vision-Language-Action-Modell von Figure AI mit „System 1 / System 2"-Architektur.
Helix ist das von Figure AI im Februar 2025 vorgestellte, proprietäre Vision-Language-Action-Modell für die humanoiden Roboter des Unternehmens. Es steuert den Oberkörper mit rund 35 Freiheitsgraden (Torso, Kopf, Handgelenke, Finger).
„System 1 / System 2”
Helix kombiniert zwei Geschwindigkeiten — angelehnt an schnelles und langsames Denken:
- System 2 (S2) — ein internet-vortrainiertes Vision-Language-Modell (~7 Mrd. Parameter), das mit niedriger Frequenz (7–9 Hz) Szene und Sprachbefehl „versteht”.
- System 1 (S1) — eine schnelle, reaktive Visuomotor-Policy (~80 Mio. Parameter), die mit 200 Hz die Motoren steuert.
So verbindet das Modell semantisches Verständnis mit flüssiger, reaktiver Bewegung. Figure demonstrierte damit Haushaltsaufgaben und kollaboratives Verhalten mehrerer Roboter. Helix ist eng auf Figures eigene Hardware optimiert — anders als die offenen Ansätze von NVIDIA GR00T oder Hugging Face. Einordnung: Foundation-Model-Landschaft.
Verwandte Themen
Hierher verlinkt
Quellen
Stand: 26.6.2026