Aller au contenu principal
DemoBridge : une boîte à outils de simulation en boucle pour le retargeting de démonstrations humaines en vue unique
FR/EU ecosystemearXiv cs.RO 

DemoBridge : une boîte à outils de simulation en boucle pour le retargeting de démonstrations humaines en vue unique

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Une équipe de l'université KU Leuven (Belgique) publie DemoBridge, un outil qui transforme un enregistrement vidéo unique, en stéréo RGB, d'une démonstration manuelle humaine en une trajectoire de bras robotique exécutable et validée par simulation physique. Décrit dans un preprint arXiv daté du 13 juillet 2026 (arXiv:2607.09519), le système repose sur un planificateur unique conscient des collisions qui optimise la trajectoire articulaire complète en une seule passe, en tenant compte simultanément des poses de préhension alternatives, des collisions du bras et de l'objet saisi, et de la fidélité au geste démontré. Un simulateur physique tourne en boucle pendant la génération, valide chaque phase et revient en arrière en cas d'échec plutôt que d'abandonner la démonstration : le geste est replanifié, pas jeté. Le timing de la prise est déduit automatiquement, et les modules de perception, le modèle de robot et les étapes du pipeline sont interchangeables par configuration. L'équipe a testé l'ensemble du pipeline sur trois tâches réelles et évalué le planificateur seul sur un benchmark synthétique contrôlé. Le code est disponible sur le GitLab de KU Leuven.

L'enjeu visé est le fossé d'incarnation ("embodiment gap") : un bras robotique, avec ses longs segments articulés, occupe bien plus de volume de collision qu'une main humaine, si bien que la cinématique inverse appliquée telle quelle à une pose de préhension démontrée n'a souvent aucune solution sans collision. Ce verrou freine l'apprentissage par démonstration à bas coût, où une simple vidéo caméra unique remplacerait la téléopération coûteuse utilisée pour collecter des données d'entraînement de modèles vision-langage-action comme Pi-0 ou GR00T N2. En doublant chaque démonstration retargetée d'un rollout de simulation exploitable pour l'apprentissage de politiques, DemoBridge s'inscrit directement dans la course à des données de manipulation moins chères à générer.

Il s'agit d'un travail académique préliminaire, non d'un produit commercialisé : l'évaluation reste limitée à trois tâches réelles et un benchmark synthétique, sans déploiement industriel annoncé. Le choix d'une vue unique plutôt qu'un rig multi-caméras vise justement l'accessibilité, un axe que suivent aussi des laboratoires concurrents cherchant à réduire le coût de collecte de données d'imitation face aux approches par téléopération dominantes chez les acteurs américains du secteur.

Impact France/UE

Une équipe universitaire belge (KU Leuven) publie en open-source un outil de retargeting de démonstrations, réduisant potentiellement le coût de collecte de données d'apprentissage par imitation pour les laboratoires robotiques européens.

À lire aussi

Hugging Face lance une boîte à outils à base d'agents pour Reachy Mini
1The Robot Report 

Hugging Face lance une boîte à outils à base d'agents pour Reachy Mini

Hugging Face a lancé cette semaine un kit de développement agentique permettant de créer des applications pour Reachy Mini, son robot de bureau open source, sans écrire une seule ligne de code. Le principe : l'utilisateur décrit en langage naturel le comportement souhaité, et un agent IA rédige, teste et déploie automatiquement le code sur le robot. Reachy Mini mesure 27,9 cm de hauteur pour 16 cm de largeur, pèse 1,5 kg et se pilote intégralement depuis une interface web. Plus de 200 applications sont déjà disponibles dans un App Store hébergé sur le Hugging Face Hub, installables en un clic, forkables et modifiables à la demande. Un simulateur navigateur permet également de tester les applications sans posséder le matériel. Parmi les exemples publiés : un tuteur d'accent linguistique, un assistant de cuisine pas-à-pas, un commentateur de Formule 1 en temps réel, ou un jeu inspiré de Squid Game. L'un des cas d'usage mis en avant est celui de Joel Cohen, retraité de 78 ans sans formation technique, qui a construit un co-facilitateur vocal IA pour les groupes de dirigeants qu'il anime sur Zoom : le système dispose de quatre modes de facilitation, d'une banque de plus de 60 questions et reconnaît par son nom chacun de ses 29 participants. Ce lancement illustre un changement de paradigme potentiel dans l'accès au développement robotique. Jusqu'ici, déployer un comportement sur un robot impliquait la maîtrise d'un SDK, la connaissance d'API de bas niveau et un temps d'intégration significatif. Ici, la barrière technique est explicitement remplacée par un agent LLM, ce qui déplace la contrainte vers la qualité du prompt plutôt que vers la compétence en programmation. Pour les intégrateurs et les décideurs B2B, le modèle Hub-plus-simulator offre une logique de validation à coût quasi nul avant achat du matériel physique. Reste à mesurer la robustesse réelle du code généré dans des conditions d'usage prolongé : les 200 applications recensées sont des contributions communautaires récentes, pas des déploiements industriels validés. La distinction entre démo accessible et produit robuste en production reste entière. Hugging Face, souvent décrit comme le "GitHub de l'IA" avec plusieurs millions de développeurs et des dizaines de milliers d'entreprises utilisatrices, a acquis Pollen Robotics en 2024. Cette startup française de Bordeaux est le fabricant de la gamme Reachy, des robots open source à vocation éducative et de recherche. L'intégration de la plateforme Hub à l'écosystème robot concrétise donc une stratégie annoncée lors de l'acquisition : faire de Hugging Face le point d'entrée unique pour le développement robotique grand public. Sur le segment des robots de bureau open source, Reachy Mini se positionne face à des plateformes comme LeRobot (également porté par Hugging Face) ou les kits SO-100/SO-101 de The Robot Company, avec un avantage différenciant sur la fluidité du parcours développeur et l'effet réseau du Hub existant. Aucune timeline de déploiement commercial à grande échelle n'a été communiquée.

UEPollen Robotics, startup française de Bordeaux désormais intégrée à Hugging Face, voit son robot Reachy Mini devenir une plateforme de développement robotique grand public, consolidant le positionnement de la France dans la robotique open source mondiale.

FR/EU ecosystemeOpinion
1 source
DuoBench : un benchmark reproductible pour la manipulation bimanuelles en simulation et dans le monde réel
2arXiv cs.RO 

DuoBench : un benchmark reproductible pour la manipulation bimanuelles en simulation et dans le monde réel

Une équipe de chercheurs a publié en juin 2026 DuoBench, un cadre de benchmarking dédié à la manipulation bimanuelle, conçu pour la plateforme FR3 Duo de Franka Robotics. Le benchmark comprend onze tâches réparties en quatre catégories de coordination, implémentées en simulation et partiellement reproduites en environnement réel grâce à des protocoles reproductibles incluant des composants imprimables en 3D. Les auteurs ont constitué des jeux de données de télé-opération humaine pour l'ensemble des onze tâches, et proposent un schéma d'évaluation par étapes (stage-based evaluation) permettant une analyse sémantique fine des modes d'échec, au-delà du simple critère binaire succès/échec. Plusieurs politiques d'apprentissage par imitation à deux bras ainsi que des politiques VLA (vision-language-action) ont été évaluées en simulation et sur matériel réel. Les résultats sont sans ambiguïté : les politiques actuelles, y compris les approches VLA considérées comme l'état de l'art, restent insuffisantes pour la manipulation bimanuelle. Les échecs se concentrent sur trois axes : les phases d'interaction initiale, l'exécution parallèle des deux bras, et le transfert simulation-réel (sim-to-real). Ce dernier point est particulièrement significatif : malgré les progrès récents sur le gap sim-to-real pour la manipulation à un bras, DuoBench révèle que la coordination bimanuelle pose des défis supplémentaires non résolus. Pour les équipes R&D et les intégrateurs industriels, ce benchmark fournit un outil diagnostique structuré pour identifier précisément où les politiques échouent, une lacune que les frameworks existants comme RLBench ou LIBERO, conçus pour les systèmes à un seul bras, ne comblaient pas. La manipulation bimanuelle est un prérequis pour de nombreuses tâches complexes en industrie (assemblage, conditionnement, manipulation d'objets déformables), ce qui explique l'intérêt croissant du secteur pour les plateformes à deux bras. Le FR3 Duo de Franka Robotics est l'une des rares plateformes de recherche standardisées pour ce segment. Dans la course aux capacités bimanuelles, des acteurs comme Physical Intelligence avec Pi-0, NVIDIA avec GR00T N2, ou Figure AI avec ses robots humanoïdes ont annoncé des performances prometteuses, mais les benchmarks publics rigoureux permettant de les comparer restent rares. DuoBench, dont le code, les jeux de données et les vidéos sont disponibles sur duobench.github.io, ambitionne de combler ce manque avec un protocole reproductible que tout laboratoire peut répliquer à faible coût grâce aux assets imprimables en 3D.

UEFranka Robotics (Allemagne) est la plateforme centrale de DuoBench, offrant aux laboratoires et équipes R&D européens un benchmark standardisé et reproductible pour évaluer leurs politiques bimanuelle, y compris les approches VLA, sans disposer de ressources matérielles coûteuses.

FR/EU ecosystemePaper
1 source
Apprentissage de compétences avant/arrière à partir d'une seule démonstration inachevée pour tâches de manipulation contraintes
3arXiv cs.RO 

Apprentissage de compétences avant/arrière à partir d'une seule démonstration inachevée pour tâches de manipulation contraintes

Chercheurs de l'Automation and Control Institute (ACIN) de la TU Wien publient un nouveau framework d'apprentissage par démonstration (LfD) pour les tâches de manipulation en contact, dans un article arXiv daté du 16 juillet 2026 (arXiv:2607.13882v1). Contrairement aux méthodes existantes qui exigent plusieurs démonstrations complètes, leur système apprend à la fois l'exécution avant et arrière d'une compétence à partir d'une seule démonstration, potentiellement inachevée. La méthode découpe chaque démonstration en phases sans contact et en phases de contact : les premières sont encodées via des primitives de mouvement dynamiques (DMP), les secondes représentées comme une séquence de primitives de mouvement vissé (screw motion primitives), segmentées grâce à un algorithme de segmentation par direction de torsion géométrique conçu par les auteurs. À l'exécution, ces primitives sont enchaînées sous correction de pose et régulation de vitesse pilotées par admittance, ce qui permet au robot d'aller au-delà de la trajectoire démontrée et de rejouer la tâche à l'envers sans données supplémentaires. Les tests portent sur quatre tâches : insertion de tige (peg insertion), insertion de batterie, ouverture de serrure et vissage. L'enjeu est la réduction drastique du coût d'apprentissage pour les tâches contraintes géométriquement, un point faible connu du LfD classique, qui peine sur les interactions riches en contact et en force. En ne nécessitant qu'une démonstration, même incomplète, la méthode limite le travail de téléopération ou de capture de données habituellement requis pour entraîner un robot industriel à des gestes d'assemblage précis. La capacité d'exécution inverse sans réapprentissage est particulièrement utile pour les cycles assemblage/désassemblage, un besoin fréquent en ligne de production. Les auteurs rapportent des taux de succès et une robustesse supérieurs aux baselines de segmentation et d'apprentissage de trajectoire en un coup, ce qui positionne l'approche comme une alternative crédible pour les intégrateurs cherchant à automatiser des tâches de préhension fine sans multiplier les démonstrations. Le travail s'inscrit dans la lignée des recherches sur les primitives de mouvement (DMP) et la modélisation par torseurs cinématiques pour la robotique de contact, un champ actif face aux limites des approches purement basées trajectoire. Le site du projet (tuwien-asl.github.io/LfD-Screw) propose des démonstrations vidéo ; aucune date de publication de code ni de partenariat industriel n'est mentionnée à ce stade.

UELa recherche émane d'une université autrichienne (TU Wien, ACIN), renforçant l'écosystème européen de R&D en robotique de manipulation, sans partenariat industriel européen annonce a ce stade.

FR/EU ecosystemePaper
1 source
Coherence Guard : Palm Garden AI développe une couche décisionnelle relationnelle pour les robots interagissant avec les humains
4The Robot Report 

Coherence Guard : Palm Garden AI développe une couche décisionnelle relationnelle pour les robots interagissant avec les humains

Palm Garden AI, entreprise basée en Allemagne et en Thaïlande, développe Coherence Guard, une couche logicielle décrite comme « agnostique de plateforme » destinée aux robots en interaction directe avec des humains. Selon Joachim Scheuerer, PDG de l'entreprise, ce module ne remplace ni la perception, ni la planification de mouvement, ni l'apprentissage par renforcement, ni les piles de contrôle robotique existantes. Il s'insère plutôt comme une couche d'évaluation pré-action : avant qu'un robot exécute un geste, Coherence Guard évalue si l'action est « relationnellement cohérente » dans un environnement humain réel, en tenant compte du timing, de la proximité, des demandes de limites, du ton émotionnel, de la préservation de la confiance et du retrait respectueux. Le système s'appuie sur l'infrastructure comportementale ANATTA 9 de Palm Garden, bâtie sur le système d'exploitation cloud Transwarp (TCOS), et se positionne au-dessus ou à côté des piles de contrôle robotique classiques (SDK/API, ROS 2, planification, modèles du monde). Baptisé Relational Infrastructure Framework (RIF), ce cadre ajoute une compréhension des rôles, intentions, vulnérabilités et conséquences futures possibles, là où les modèles du monde physique se limitent aux objets, à l'espace et au mouvement. Le RIF est disponible sur demande auprès de Palm Garden AI. À mesure que les robots humanoïdes et robots de service se dirigent vers l'hospitalité, les soins, le commerce de détail, l'éducation, le guidage et le domicile, la gestion des interactions sociales devient un enjeu aussi critique que la mobilité ou la manipulation. Palm Garden AI parie que cette couche relationnelle deviendra une catégorie d'infrastructure nécessaire, au même titre que la perception ou la planification de trajectoire. Pour les intégrateurs et décideurs B2B, l'annonce pointe un angle mort du secteur : la plupart des piles robotiques actuelles savent naviguer, parler et exécuter des tâches, mais ne savent pas juger si un geste techniquement possible est socialement approprié, par exemple continuer une tâche alors qu'une personne exprime un malaise. Ce type de défaillance, plus subtil qu'une panne technique, peut pourtant déterminer l'acceptabilité sociale d'un robot en environnement réel et donc sa commercialisation effective. Reste que Coherence Guard, comme beaucoup d'annonces du secteur, en est au stade du cadre logiciel disponible sur demande plutôt que du produit déployé à grande échelle : aucun chiffre de déploiement, aucun partenaire robotique nommé, aucun benchmark quantitatif indépendant n'accompagne l'annonce, ce qui invite à la prudence sur la portée réelle de la technologie à ce stade. Le concept trouve son origine dans l'expérience de Palm Garden Retreat, un établissement en Thaïlande où l'équipe a observé pendant trois ans des situations d'interaction humaine structurées : arrivée, orientation, silence, vulnérabilité, construction de confiance, malentendu et retrait respectueux. Scheuerer cite comme « benchmark » simple le retrait respectueux : si une personne montre un signe d'inconfort ou demande de l'espace, le robot doit interrompre sa tâche, reconnaître le signal, augmenter la distance si nécessaire, réduire son intensité expressive et revenir à un état neutre. Ces comportements de base couvrent aussi l'accueil et l'orientation, la présence de soutien, l'assistance non intrusive, l'escalade en cas d'incertitude élevée et l'explication préservant la cohérence. Palm Garden AI se positionne ainsi sur un segment encore peu occupé, distinct des efforts des grands acteurs de la robotique humanoïde (Figure, Tesla avec Optimus, ou les modèles VLA comme Pi-0 de Physical Intelligence, GR00T N2 de Nvidia ou Helix de Figure), qui se concentrent d'abord sur la manipulation et la mobilité générale. Aucun calendrier de déploiement pilote ni partenaire intégrateur n'a été communiqué à ce stade ; l'entreprise indique seulement que le RIF est accessible sur demande.

UEPalm Garden AI, entreprise basée en Allemagne, développe cette couche logicielle relationnelle, renforçant l'écosystème européen sur un segment encore peu occupé de l'interaction homme-robot.

FR/EU ecosystemeActu
1 source