Aller au contenu principal
ScheduleStream : planification temporelle avec échantillonneurs pour l'ordonnancement et la planification de tâches et mouvements multi-bras accélérée par GPU
RecherchearXiv cs.RO 

ScheduleStream : planification temporelle avec échantillonneurs pour l'ordonnancement et la planification de tâches et mouvements multi-bras accélérée par GPU

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Une équipe de chercheurs présente ScheduleStream (arXiv:2511.04758v2), un cadre généraliste de planification et d'ordonnancement pour robots bi-manuels et humanoïdes, conçu pour coordonner plusieurs bras en parallèle. Contrairement aux algorithmes TAMP (Task and Motion Planning) classiques, qui produisent des plans séquentiels où un seul bras se déplace à la fois, ScheduleStream modélise la dynamique temporelle via des hybrid durative actions, des actions pouvant démarrer de façon asynchrone et persister pendant une durée fonction de leurs paramètres. Cette architecture permet d'orchestrer des mouvements simultanés sur plusieurs membres, réduisant le temps de cycle global. Le système intègre une accélération GPU au sein même des échantillonneurs de trajectoires (samplers), et repose sur des algorithmes indépendants du domaine d'application. Les auteurs le valident en simulation ainsi que sur plusieurs tâches bi-manuelles réelles, dont les démonstrations sont accessibles sur schedulestream.github.io. Aucun chiffre précis de gain de temps ni de configuration matérielle (DOF, payload) n'est fourni dans l'abstract : des éléments à vérifier dans le papier complet.

Le verrou adressé est structurel : l'espace d'action hybride discret-continu d'un robot multi-bras croît de façon combinatoire, rendant la planification computationnellement prohibitive dès qu'on autorise le parallélisme. En produisant des schedules plutôt que de simples séquences, ScheduleStream ouvre la voie à des cellules robotiques capables d'exécuter des sous-tâches simultanément, saisie d'un côté et assemblage de l'autre, ce qui est précisément le cas d'usage clé pour les intégrateurs cherchant à justifier un humanoïde bi-manuel (Figure 03, Optimus Gen 3, Atlas) en environnement industriel. L'accélération GPU dans le sampler est notable dans un domaine historiquement dominé par des planificateurs CPU-bound, et suggère une voie vers des temps de planification compatibles avec des cadences réelles.

Le champ TAMP multi-bras s'est structuré autour de travaux comme PDDLStream (Garrett et al., MIT CSAIL), qui a introduit l'échantillonnage continu dans TAMP, mais sans gestion native du parallélisme temporel. ScheduleStream prolonge cette lignée en ajoutant la dimension asynchrone, un problème traité par ailleurs dans la communauté PDDL+ via des planificateurs temporels comme OPTIC ou POPF. Sur le terrain applicatif, les approches concurrentes incluent les politiques d'imitation comme ACT ou Diffusion Policy, qui contournent la planification symbolique au prix d'une moindre généralisabilité, et des frameworks comme MoveIt Task Constructor sous ROS2. La prochaine étape naturelle serait une validation sur des cellules de production réelles avec des métriques de cycle time documentées, ainsi qu'une publication du code source, non encore disponible à la date d'annonce.

À lire aussi

VAMP-MR : planification et exécution de mouvements accélérée par vecteurs pour bras robotiques multiples
1arXiv cs.RO 

VAMP-MR : planification et exécution de mouvements accélérée par vecteurs pour bras robotiques multiples

Un nouveau papier arXiv (2607.13478v1) présente VAMP-MR, une suite de planificateurs de mouvement pour bras robotiques multiples destines aux taches industrielles comme la fabrication. Le problème cible est la planification de trajectoires sans collision pour plusieurs manipulateurs opérant dans le même espace, un calcul traditionnellement couteux avec les solveurs bases sur la recherche ou l'échantillonnage. L'équipe combine des algorithmes de planification classiques avec des techniques de vérification de collision vectorisées de dernière génération, exploitant les instructions SIMD des processeurs CPU. Le goulot d'étranglement principal de ce type de planification, le contrôle de collision entre les bras, en bénéficie directement : les auteurs annoncent un gain de vitesse pouvant atteindre deux ordres de grandeur, soit jusqu'a environ 100 fois plus rapide, aussi bien pour la planification de trajectoire que pour le post-traitement de l'exécution sur des taches de manipulation multi-bras. Le code est mis a disposition publiquement sur vamp-mr.github.io/vamp-mr. Cette accélération change la donne pour le déploiement de cellules industrielles a bras multiples, un scenario de plus en plus courant en fabrication ou plusieurs manipulateurs doivent coopérer dans un espace de travail partage sans se percuter. Jusqu'ici, générer des mouvements de qualité, sans collision et exploitables en conditions réelles, demandait un temps de calcul important, ce qui limitait la réactivité des systèmes et compliquait la replanification en cas de changement de scene. Un planificateur quasi temps réel ouvre la voie a des cellules multi-bras plus flexibles, capables de s'adapter dynamiquement plutôt que de suivre des trajectoires figées calculées hors ligne. Pour les intégrateurs et les équipes de R&D en robotique, la libération du code source abaisse significativement la barrière d'entrée pour expérimenter avec la planification multi-bras, un domaine jusqu'ici réserve a des équipes disposant de solveurs propriétaires ou de ressources de calcul importantes. Le problème de la planification multi-bras s'inscrit dans la lignée des travaux sur les planificateurs bases sur la recherche (comme les variantes de RRT ou de PRM) et sur l'échantillonnage, qui restent les approches dominantes mais souffrent d'un cout de calcul croissant avec le nombre de bras et la complexité de l'environnement. VAMP-MR ne cherche pas a remplacer ces algorithmes classiques mais a en accélérer radicalement le maillon le plus couteux, la vérification de collision, en s'appuyant sur le parallélisme vectoriel déjà présent dans les CPU modernes plutôt que sur du matériel spécialisé type GPU. Cette approche logicielle, portable sur du matériel standard, distingue le projet des solutions nécessitant une infrastructure de calcul dédiée. La publication du code s'accompagne d'une invitation explicite de l'équipe a la communauté de recherche pour étendre et tester ces planificateurs sur d'autres problèmes de manipulation multi-robot, sans qu'un calendrier de déploiement industriel ou de pilotes concrets ne soit pour l'instant annonce.

RecherchePaper
1 source
G-MAPP : planification et perception multi-agents accélérées par GPU pour la génération de mouvement réactif
2arXiv cs.RO 

G-MAPP : planification et perception multi-agents accélérées par GPU pour la génération de mouvement réactif

G-MAPP (GPU-accelerated Multi-Agent Planning and Perception) est un framework de génération de mouvement réactif présenté dans un preprint arXiv (2606.12579) publié en juin 2026. Le système cible un problème persistant en robotique manipulatrice : produire des trajectoires sans collision en temps réel dans des environnements non structurés et dynamiques. L'architecture repose sur deux composants GPU : un moteur de modélisation du monde alimenté par des capteurs de profondeur grand public, et un planificateur par champs vectoriels permettant une exploration parallèle quasi-globale des états. Validé sur un bras Franka Emika 7 axes (7-DoF), le système affiche un gain de vitesse mesuré jusqu'à 5x par rapport à la version CPU équivalente, avec des évitements de collision réussis dans des configurations physiques simples et complexes. Le point dur que G-MAPP tente de résoudre est double : la charge de calcul pour planifier sur des représentations haute fidélité du monde, et le délai d'intégration entre la perception et le planificateur. Historiquement, les architectures existantes choisissaient entre planification globale (précise mais lente, réservée aux environnements statiques) et planification locale conservative (rapide mais myope). En fusionnant les deux boucles sur GPU, G-MAPP vise à éliminer ce compromis. Pour un intégrateur industriel ou un COO de ligne d'assemblage, cela ouvre la voie à des cellules robotiques reconfigurables sans reprogrammation manuelle, avec des bras capables de coexister avec des opérateurs humains en mouvement, à condition que les performances tiennent sur des géométries de charge plus représentatives. La génération de mouvement réactif mobilise depuis plusieurs années des approches concurrentes : planificateurs neuronaux (MPINETS, MotionBenchMaker), champs de potentiel riemanniens (RMP-Flow, STORM), et méthodes MPC sur horizon glissant. G-MAPP se positionne dans la lignée des planificateurs par champs vectoriels accélérés, avec la particularité de traiter la perception et la planification dans le même pipeline GPU. Le Franka Emika reste une plateforme académique standard, et aucun partenariat industriel ni roadmap de commercialisation n'est mentionné dans le preprint : il s'agit d'une contribution de recherche à confirmer sur des bras à charge utile plus élevée, des vitesses d'obstacles plus importantes, et des environnements multi-agents. Les prolongements naturels incluent les architectures multi-bras et l'intégration avec des pipelines de perception sémantique.

RecherchePaper
1 source
GASP : planificateur sûr accéléré par GPU pour une génération de mouvement en temps réel consciente des collisions, avec échantillonnage de trajectoires latentes
3arXiv cs.RO 

GASP : planificateur sûr accéléré par GPU pour une génération de mouvement en temps réel consciente des collisions, avec échantillonnage de trajectoires latentes

Des chercheurs présentent GASP (GPU-Accelerated Safe Planner), un planificateur temps réel de trajectoires dans l'espace articulaire, conscient des collisions, pour environnements connus. L'architecture combine une paramétrisation par B-spline clampée avec un réseau convolutif résiduel qui prédit les points de contrôle intérieurs, complétés par des points de contrôle aux limites insérés analytiquement pour respecter les contraintes de dérivée initiale et finale. Un autoencodeur variationnel conditionnel échantillonne plusieurs trajectoires candidates, décodées et validées en parallèle sur GPU, pour un temps d'inférence proche de la milliseconde. GASP atteint des taux de réussite comparables aux méthodes analytiques tout en réduisant nettement le temps de calcul face à l'optimisation de trajectoire classique sur GPU. Déployé comme planificateur de réinitialisation dans un pipeline d'apprentissage par renforcement appliqué au tennis de table robotique compétitif, il égale le taux de retour de balle de la méthode de référence tout en réduisant d'environ moitié les collisions survenues pendant l'entraînement. Pour l'industrie robotique, l'enjeu est de lever un goulot d'étranglement classique : la planification de trajectoire évitant les collisions reste souvent trop lente pour un contrôle temps réel à haute fréquence, surtout pour des bras à plusieurs degrés de liberté couplés. En ramenant l'inférence à l'échelle de la milliseconde via l'échantillonnage parallèle sur GPU plutôt que la résolution d'une optimisation à chaque pas, GASP illustre une tendance de fond : remplacer l'optimisation itérative par des réseaux entraînés à en approximer la sortie. L'intérêt dépasse la vitesse : moins de collisions pendant l'entraînement réduit aussi le coût et la durée de l'apprentissage de politiques par renforcement. Le domaine s'appuie historiquement sur des méthodes d'optimisation comme CHOMP ou TrajOpt, ou des planificateurs par échantillonnage type RRT, coûteux en calcul dès que la dimension du problème augmente ; les versions récentes accélérées par GPU réduisent ce coût sans l'éliminer, d'où la comparaison directe faite dans l'article. En s'appuyant sur un CVAE plutôt qu'un réseau de prédiction unique, GASP mise sur la diversité de candidats plutôt qu'une trajectoire unique, une stratégie proche de travaux récents de diffusion de trajectoires. Publié sur arXiv sans relecture par les pairs ni mention de code source ouvert ou de partenaire industriel, l'article ne donne aucun calendrier de transfert vers une plateforme robotique commerciale ; la validation reste circonscrite aux tests articulaires décrits et à la tâche de tennis de table présentée.

RecherchePaper
1 source
Une étude systématique des grands modèles de langage pour la planification tâche-mouvement avec PDDLStream
4arXiv cs.RO 

Une étude systématique des grands modèles de langage pour la planification tâche-mouvement avec PDDLStream

Une équipe de recherche a mené une étude systématique sur l'usage des grands modèles de langage (LLM) pour la planification tâche-mouvement (TAMP) en robotique, en s'appuyant sur le framework PDDLStream. Les auteurs ont conçu 16 algorithmes différents substituant des composants clés de TAMP par des LLM, puis les ont évalués en zero-shot sur 13750 essais répartis sur trois domaines robotiques distincts. Le code et les résultats complets sont disponibles publiquement sur GitHub (jorge-a-mendez/llm-pddlstream). L'article, référencé arXiv:2510.00182, constitue une version révisée (replace) d'une publication antérieure. Les résultats tempèrent nettement l'enthousiasme autour des LLM comme solution universelle de planification robotique. Les planificateurs basés sur des LLM affichent des taux de réussite inférieurs et des temps de calcul supérieurs comparés aux systèmes d'ingénierie classiques, spécialisés pour la tâche. Autre constat contre-intuitif: fournir des détails géométriques supplémentaires aux LLM augmente le nombre d'erreurs de planification par rapport à des descriptions PDDL pures, suggérant que l'ajout de contexte ne se traduit pas automatiquement par de meilleures décisions. Les variantes LLM "directes", plus rapides, surpassent dans la majorité des cas les variantes à raisonnement explicite, plus lentes, ce qui interroge la valeur ajoutée du chain-of-thought pour ce type de tâche. Pour les intégrateurs et chercheurs en robotique, ce travail rappelle que malgré les progrès des LLM sur le raisonnement sémantique, le couplage avec la planification formelle et géométrique reste un défi ouvert, loin d'être résolu par la simple taille des modèles. TAMP combine depuis des années la planification symbolique de tâches et la planification continue de mouvements, un problème historiquement traité par des solveurs spécialisés comme PDDLStream. L'essor des LLM a multiplié les propositions visant à exploiter leurs connaissances sémantiques pour remplacer certains de ces composants formels, souvent via des démonstrations isolées et peu comparables entre elles. Cette étude se distingue en proposant une évaluation empirique large et contrôlée plutôt qu'un nouveau système ponctuel, offrant une base de comparaison utile pour orienter les futurs travaux hybrides associant raisonnement neuronal et garanties formelles.

RecherchePaper
1 source