Aller au contenu principal
CN-CBF : fonction de barrière de contrôle neuronale composite pour la navigation robotique en environnements dynamiques
RecherchearXiv cs.RO 

CN-CBF : fonction de barrière de contrôle neuronale composite pour la navigation robotique en environnements dynamiques

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs proposent une nouvelle méthode de conception de fonctions de barrière de contrôle neuronales, baptisée CN-CBF (Composite Neural Control Barrier Function), pour sécuriser la navigation de robots autonomes dans des environnements dynamiques et incertains. L'approche combine plusieurs CBF neuronales individuelles en une seule fonction composite : chacune est entraînée hors ligne à partir de données générées par le cadre de calculabilité Hamilton-Jacobi, afin d'approximer l'ensemble de sécurité optimal face à un obstacle mobile unique. Une architecture neuronale résiduelle garantit que l'ensemble de sécurité estimé ne recoupe jamais l'ensemble d'échec correspondant. La méthode a été testée en simulation sur un robot terrestre et un quadricoptère, puis validée par des expériences matérielles sur les deux plateformes. Comparée aux meilleures méthodes de référence existantes, elle améliore le taux de réussite de la navigation jusqu'à 18%, tout en conservant des longueurs de trajectoire et des temps de déplacement comparables, voire inférieurs.

Ce résultat s'attaque à un problème central pour l'industrie robotique : les filtres de sécurité basés sur les CBF sont simples à déployer mais notoirement difficiles à concevoir manuellement, en particulier quand l'environnement change en temps réel. En automatisant et en fiabilisant cette conception via l'apprentissage, CN-CBF pourrait faciliter le déploiement de robots autonomes, mobiles ou volants, dans des environnements partagés avec des obstacles mobiles, humains compris, sans sacrifier l'efficacité des trajectoires. Le passage du simulateur au matériel réel, sur deux morphologies distinctes, robot au sol et drone, est un signal encourageant pour les intégrateurs et les équipes de R&D qui cherchent des garanties de sécurité formelles plutôt que des heuristiques ad hoc, un enjeu clé pour la certification et l'adoption en environnements industriels ou logistiques.

Les fonctions de barrière de contrôle sont un outil classique de la théorie du contrôle pour garantir la sécurité formelle des systèmes dynamiques, mais leur conception manuelle devient vite intraitable dès que la dimension ou la complexité de l'environnement augmente. Les approches existantes, qu'elles soient purement basées sur des modèles ou purement apprises, souffrent chacune de limites que les auteurs cherchent explicitement à corriger en combinant apprentissage neuronal et cadre théorique Hamilton-Jacobi. Publié sur arXiv en version révisée, ce travail s'inscrit dans une littérature croissante sur les CBF neuronales pour la robotique mobile et aérienne. Les auteurs mentionnent des évaluations étendues en simulation face à plusieurs méthodes concurrentes ; une extension naturelle consisterait à traiter des scénarios multi-obstacles ou multi-robots, au-delà du cas de l'obstacle mobile unique étudié ici.

Dans nos dossiers

À lire aussi

CoCoNav : un contrôle conforme pour une navigation robotique sûre en milieu de foule
1arXiv cs.RO 

CoCoNav : un contrôle conforme pour une navigation robotique sûre en milieu de foule

Un article déposé sur arXiv en août 2026 (arXiv:2608.07751) présente CoCoNav, un framework de navigation pour robots évoluant en foule, conçu pour anticiper les mouvements imprévisibles des piétons. Le système combine une calibration conforme en ligne et une planification certifiée en temps réel. Son composant central, un contrôleur conforme proportionnel-intégral spécifique à l'horizon temporel, ajuste dynamiquement les marges d'erreur de trajectoire pour maintenir un taux de couverture empirique stable face à des erreurs de prédiction qui évoluent au fil du temps. Un second module, baptisé "relax-then-verify" (détendre puis vérifier), génère d'abord des trajectoires nominales via un contrôle prédictif par modèle (MPC) à contraintes souples, avant de certifier séparément ces trajectoires, ainsi que des manœuvres de secours, par rapport aux bornes calibrées, juste avant leur exécution. Les auteurs ont validé l'approche à la fois en simulation et lors d'expériences avec un robot quadrupède, mesurant l'évitement de collision, le taux de réussite de tâche et l'efficacité de navigation par rapport à plusieurs méthodes de référence. Ce travail s'attaque à un point de friction connu dans le déploiement de robots mobiles en environnement humain: les méthodes réactives classiques produisent des comportements oscillants dès que la densité de piétons augmente, tandis que les planificateurs prédictifs supposent souvent des trajectoires piétonnes exactes ou s'appuient sur des modèles d'erreur trop rigides pour rester fiables en conditions réelles. Imposer des marges d'incertitude conservatrices comme contraintes strictes rend par ailleurs le MPC souvent infaisable en pratique, un problème qui limite l'usage de ces techniques dans des AMR (robots mobiles autonomes) commerciaux, des robots de livraison ou des plateformes de service. En séparant génération de trajectoire et certification, et en calibrant les marges d'erreur en continu plutôt qu'a priori, CoCoNav propose une piste concrète pour rendre les garanties de sécurité compatibles avec la réactivité nécessaire en environnement dense, un compromis que peu d'approches publiées atteignent simultanément selon les auteurs. La navigation sociale en robotique reste un domaine actif de recherche depuis plusieurs années, tiraillé entre approches purement réactives, rapides mais instables, et planificateurs prédictifs, plus robustes mais coûteux en calcul ou trop optimistes sur la qualité des prévisions de mouvement humain. La prédiction conforme, technique statistique permettant de quantifier l'incertitude d'un modèle sans hypothèse forte sur sa distribution d'erreur, gagne du terrain dans la robotique de perception et de planification comme alternative aux bornes d'erreur fixes. CoCoNav s'inscrit dans cette tendance en l'appliquant spécifiquement à l'horizon de prédiction du MPC. À ce stade, les résultats se limitent à des simulations et à des essais sur un robot quadrupède en conditions contrôlées, sans déploiement en foule réelle ni partenariat industriel annoncé; les auteurs ne précisent pas de calendrier pour un transfert vers des plateformes commerciales de type AMR ou robots de service.

RecherchePaper
1 source
Apprentissage de dynamiques neuronales ODE adaptées au contexte pour le contrôle robotique adaptatif
2arXiv cs.RO 

Apprentissage de dynamiques neuronales ODE adaptées au contexte pour le contrôle robotique adaptatif

Des chercheurs ont proposé un modèle de dynamique contextuel fondé sur les équations différentielles ordinaires neuronales (Neural ODE) pour améliorer le contrôle de robots opérant dans des environnements incertains et variables. Le travail, déposé en juin 2026 sur arXiv (référence 2606.15469), cible les perturbations que les contrôleurs classiques peinent à absorber: variations des conditions de contact, effets aérodynamiques et perturbations externes imprévues. La méthode repose sur une procédure d'entraînement en deux phases: le modèle inspecte l'historique des états et des actions du robot pour inférer les facteurs environnementaux courants, sans capteurs dédiés supplémentaires. La compatibilité avec le MPC (Model Predictive Control) est intégrée dès la conception. Les validations portent sur trois plateformes distinctes: un drone quadrirotor en simulation, un robot sphérique Sphero BOLT et un bras manipulateur industriel Fanuc, ces deux derniers testés en conditions réelles. L'enjeu central est la dérive de modèle lors du déploiement: un robot calibré en laboratoire voit ses performances se dégrader dès que l'environnement change, que ce soit un sol différent, une charge variable ou des turbulences. Par rapport aux approches récurrentes classiques (LSTM, GRU), les Neural ODE présentent un avantage structurel: elles modélisent la dynamique en temps continu, ce qui améliore la cohérence physique et simplifie l'interface avec les solveurs MPC. L'inférence du contexte depuis le seul historique actions-états, sans instrumentation additionnelle, réduit la barrière d'intégration pour les industriels. Le test sur un Fanuc, bras omniprésent en production manufacturière, ancre les résultats dans une réalité opérationnelle tangible. Point de réserve: l'article est un preprint et l'abstract ne publie aucune métrique chiffrée de performance, ce qui rend l'évaluation indépendante difficile à ce stade. Les Neural ODE ont été introduites en 2018 par Chen et al. (NeurIPS) comme alternative aux réseaux récurrents pour modéliser des systèmes dynamiques continus. Leur application au contrôle robotique adaptatif répond à un obstacle persistant du secteur: le sim-to-real gap, qui fragilise la fiabilité des systèmes autonomes hors conditions contrôlées. Les approches concurrentes comprennent les processus gaussiens (GP) pour l'adaptation en ligne, les algorithmes méta-apprenants (MAML, PEARL) et l'identification de systèmes en temps réel. Ce travail se distingue par l'inférence contextuelle implicite, couplée nativement au MPC plutôt qu'ajoutée en couche. Le code source est ouvert sur GitHub et des démonstrations vidéo sont accessibles. La prochaine étape logique serait une validation sur des tâches de manipulation à charge variable ou un déploiement en environnement industriel non contrôlé.

RecherchePaper
1 source
Planification heuristique à base de LLM pour la navigation robotique dans des environnements dynamiques, intégrant la conscience sémantique du risque
3arXiv cs.RO 

Planification heuristique à base de LLM pour la navigation robotique dans des environnements dynamiques, intégrant la conscience sémantique du risque

Des chercheurs ont publié début mai 2026, via un preprint arXiv (2605.02862), un planificateur de navigation robotique baptisé SRAH (Semantic Risk-Aware Heuristic), conçu pour intégrer des principes de raisonnement issus des grands modèles de langage (LLM) dans le cadre classique de recherche de chemin A. L'algorithme encode des fonctions de coût sémantiques qui pénalisent les zones géométriquement encombrées ou identifiées comme à risque élevé, et déclenche un replanification en boucle fermée dès qu'un obstacle dynamique est détecté. Les auteurs l'ont évalué sur 200 essais randomisés dans un environnement grille 15x15 cases, avec 20% de densité d'obstacles statiques et des obstacles dynamiques stochastiques. SRAH atteint un taux de succès de 62,0%, contre 56,5% pour BFS avec replanification (soit +9,7% d'amélioration relative) et 4,0% pour une heuristique Greedy sans replanification. Une étude d'ablation sur la densité d'obstacles confirme que le façonnage sémantique des coûts améliore la navigation sur des environnements de difficulté variable. Ce travail s'inscrit dans un courant de recherche qui cherche à exploiter la capacité des LLM à encoder du raisonnement contextuel sans les déployer en inférence temps réel, ce qui réduirait la latence et les coûts de calcul embarqués. L'idée centrale, injecter une représentation sémantique du risque dans la fonction heuristique d'A, est pertinente pour les développeurs d'AMR (robots mobiles autonomes) industriels confrontés à des environnements semi-structurés changeants. Cela dit, les résultats doivent être nuancés : un taux de succès de 62% dans une grille 15x15 reste modeste pour une tâche de navigation, et la comparaison avec un Greedy sans replanification est méthodologiquement inégale. La valeur démontrée reste celle de principe, pas de déploiement à l'échelle. La navigation en environnement dynamique est un problème central depuis les travaux fondateurs sur A (Hart, Nilsson, Raphael, 1968) et les variantes D et D*-Lite des années 1990-2000. L'émergence des LLM a relancé l'intérêt pour des heuristiques fondées sur la sémantique plutôt que sur la pure géométrie, une piste explorée par des équipes comme celles de Stanford (SayCan, 2022) ou de Google DeepMind avec RT-2. Sur le segment de la navigation mobile, des acteurs comme Boston Dynamics, MiR ou Exotec (France) intègrent déjà des couches de replanification dynamique dans leurs flottes d'AMR industriels. Ce preprint n'annonce pas de produit ni de déploiement : c'est une contribution algorithmique à valider sur des benchmarks plus réalistes (ROS 2, Gazebo, environnements 3D) avant tout transfert industriel.

UECe preprint pourrait à terme informer les développeurs d'AMR industriels européens sur les heuristiques sémantiques LLM, mais les résultats restent trop préliminaires et le benchmark trop limité (grille 15x15) pour un transfert industriel immédiat.

RecherchePaper
1 source
Système d'exploitation de tubes spatiotemporels sous contraintes d'entrée pour la navigation sûre de systèmes Euler-Lagrange inconnus en environnements dynamiques
4arXiv cs.RO 

Système d'exploitation de tubes spatiotemporels sous contraintes d'entrée pour la navigation sûre de systèmes Euler-Lagrange inconnus en environnements dynamiques

Une équipe de chercheurs propose un nouveau cadre de contrôle en temps réel permettant à des robots dont la dynamique est inconnue de naviguer en sécurité dans des environnements changeants, tout en respectant les limites physiques de leurs actionneurs. Publiés sur arXiv (2607.08189v1), ces travaux étendent le cadre des « spatiotemporal tubes » (STT), une technique qui définit des corridors de trajectoires garantissant qu'un système atteint une zone cible, évite les obstacles et s'y maintient dans un temps fini, propriété désignée par les auteurs sous l'acronyme FT-RAS (finite-time reach-avoid-stay). La nouveauté consiste à intégrer explicitement les contraintes d'entrée, c'est-à-dire la puissance ou le couple maximal disponible sur les actionneurs, directement dans la conception du contrôleur, avec des conditions de faisabilité vérifiables hors ligne. L'approche a été validée par simulation sur trois types de systèmes Euler-Lagrange, un robot mobile, un quadrotor et un engin spatial, ainsi que par des expériences matérielles sur un robot mobile réel. L'enjeu dépasse la démonstration académique. La plupart des méthodes de navigation sûre reposent soit sur un modèle dynamique précis du robot, rarement disponible en conditions réelles, soit sur une optimisation résolue en continu pendant le mouvement, coûteuse en calcul et difficile à certifier en temps réel. En s'affranchissant de ces deux contraintes, ce cadre dit « approximation-free » vise les cas concrets où les robots opèrent dans des environnements dynamiques avec une puissance d'actionnement limitée, un enjeu direct pour les intégrateurs déployant des AMR ou des drones en entrepôt, où sous-estimer les limites moteur peut compromettre les garanties de sécurité formulées en amont. Le papier se positionne comme une extension du cadre STT existant, en réponse à une limite connue des méthodes de contrôle sûr comparables, comme les fonctions barrières de contrôle ou la commande prédictive, qui exigent généralement soit un modèle fiable soit une résolution d'optimisation embarquée. Il s'agit ici d'un résultat de recherche théorique et expérimentale à petite échelle, sans annonce de déploiement industriel ni de partenaire commercial identifié à ce stade.

RecherchePaper
1 source