Réponses

Qu'est-ce qu'un modèle VLA (vision-langage-action) ?

Le changement qu'il apporte est économique autant que technique. Avec la robotique classique, chaque nouvelle tâche coûtait des mois de programmation experte ; avec un VLA, la nouvelle tâche s'enseigne avec des démonstrations et des données, et le même modèle généralise à des objets jamais vus. C'est pourquoi l'avantage compétitif s'est déplacé du corps vers le cerveau et les données d'entraînement : qui possède des heures de travail réel enregistrées (usines, entrepôts) entraîne de meilleurs modèles que qui n'a qu'un laboratoire. Le pile et le face se sont vus en 2026 : le face, des robots triant des colis presque 40 heures en direct ; le pile, qu'un modèle qui apprend des données se dégrade aussi quand les données changent, et sur un robot physique cela se gère avec encore plus de soin.

L'exemple le plus documenté dans cette maison est Helix de Figure, et la carte de qui utilise quel cerveau est dans quelle IA utilisent les robots humanoïdes. Pour distinguer quand un robot à VLA est vraiment autonome et quand il y a une personne derrière, notre guide téléopéré vs autonome.

Le contexte complet, dans l'histoire complète.

Sources