
PUMA : un modèle de terrain à base de perception pour l'agilité augmentée du parkour quadrupède
Le PUMA (Perception-driven Unified Foothold Prior for Mobility Augmented Parkour) est un nouveau cadre d'apprentissage de bout en bout destine aux robots quadrupèdes pratiquant le parkour, décrit dans une version révisée d'un article arXiv (2601.15995v2). Contrairement aux approches classiques qui séparent perception et contrôle via des contrôleurs hiérarchiques suivant des appuis precalcules, PUMA fusionne perception visuelle et estimation des appuis au sein d'un seul processus d'entrainement. Le système exploite les caractéristiques du terrain pour estimer des "priors" de pose du pied en coordonnées polaires égocentriques, c'est a dire la distance relative et le cap par rapport a l'obstacle, ce qui guide en temps réel l'adaptation posturale du robot. Les auteurs rapportent des expériences menées a la fois en simulation et sur robot réel, sur une variété de terrains discrets et complexes (marches, gaps, obstacles disperses), avec des résultats d'agilité et de robustesse supérieurs aux méthodes de référence dans ces scenarios difficiles.
L'enjeu pour l'industrie robotique tient a la limite structurelle des pipelines hiérarchiques encore dominants sur les quadrupèdes commerciaux: un module de perception estime la carte du terrain, un planificateur choisit des points d'appui, puis un contrôleur bas niveau exécuté la trajectoire. Cette chaine rigidifie la réactivité du robot face a des changements de terrain imprévus et brise le lien direct entre ce que le robot voit et ce qu'il fait, ce qui restreint aussi la capacité de l'apprentissage par renforcement a explorer des stratégies motrices originales. En fusionnant perception et priors d'appui dans un entrainement unique, PUMA s'inscrit dans une tendance plus large vers des politiques visuomotrices intégrées, déjà explorées pour la manipulation avec les architectures VLA, et applique cette logique a la locomotion agile. Si les résultats se confirment hors du cadre de publication, cela renforcerait l'hypothèse que l'apprentissage end-to-end peut remplacer des pipelines modulaires plus lourds a maintenir pour les intégrateurs.
Le parkour quadrupède s'est impose ces dernières années comme un benchmark standard pour évaluer l'agilité des robots a pattes, dans la lignée de travaux comme Extreme Parkour ou les démonstrations sur plateformes de type ANYmal et Unitree Go. PUMA se positionne dans cette compétition académique en ciblant spécifiquement le problème du foothold sélection, souvent traite séparément de la politique de locomotion. L'article reste a ce stade une contribution de recherche publiée sur arXiv, sans plateforme matérielle commerciale nommée ni annonce de déploiement industriel; les prochaines étapes attendues seraient une validation sur des quadrupèdes du commerce et une comparaison plus directe avec les pipelines hiérarchiques encore utilises en production.
Dans nos dossiers




