Aller au contenu principal

Actualités robotique — page 81

4 499 articles au fil, du plus récent au plus ancien.

Prix RBR50 2026 de l'innovation en robotique
4001Robotics Business Review 

Prix RBR50 2026 de l'innovation en robotique

The Robot Report a publié pour la quinzième année consécutive son palmarès RBR50, sélectionnant 50 organisations mondiales, entre entreprises, associations et institutions académiques, pour leur innovation technologique et commerciale en robotique. L'édition 2026 intègre à la fois des habitués et de nouveaux entrants, avec une couverture allant des capteurs industriels aux rovers martiens, en passant par des solutions de fabrication, de logistique, de nouveaux matériaux et de processeurs. Parmi les distinctions spéciales : Physical Intelligence (San Francisco, fondée en 2023) reçoit le titre de Startup de l'Année ; Harvard University décroche le prix Application de l'Année pour un système d'assistance aux personnes souffrant de limitations motrices du bras ; Tatum Robotics remporte la catégorie Robots for Good pour ses applications auprès de personnes sourdes-aveugles. La cérémonie de remise des prix est prévue lors du dîner de gala du Robotics Summit & Expo à Boston. Le palmarès 2026 reflète plusieurs dynamiques structurantes pour les acteurs industriels : essor des manipulateurs mobiles, développement des systèmes portables (wearables) et accélération de l'IA appliquée à la robotique physique. La distinction accordée à Physical Intelligence est particulièrement significative : la startup a développé pi0, l'un des premiers modèles VLA (Vision-Language-Action) à démontrer des capacités de généralisation sur des tâches physiques variées, sans reprogrammation tâche par tâche. Pour les intégrateurs et décideurs industriels, ce type de reconnaissance signale quels segments technologiques atteignent un seuil de maturité commerciale justifiant un investissement. Le palmarès inclut également les grands fournisseurs de solutions complètes pour la fabrication et la logistique, ainsi que des fabricants de composants critiques (capteurs, actionneurs, processeurs). L'inclusion d'une approche inédite de confection textile automatisée et d'un rover en opération sur Mars illustre la volonté du jury de couvrir l'étendue réelle du champ robotique en 2026. Créé en 2012, le RBR50 s'est imposé comme un repère annuel dans le secteur : selon The Robot Report, plusieurs lauréats passés ont levé des millions de dollars dans les mois suivant leur sélection, et nombre d'entre eux sont revenus sur la liste avec de nouvelles innovations. L'édition 2026 intègre aussi une dimension institutionnelle et politique notable : l'Association for Advancing Automation travaille à convaincre le Congrès américain d'adopter une stratégie nationale en robotique, tandis que MassRobotics accompagne des startups internationales dans leur accès au marché américain. Aucun acteur français ni européen n'est explicitement mentionné dans le communiqué public, bien que des entreprises comme Wandercraft, Enchanted Tools ou Pollen Robotics figurent régulièrement dans ce type de palmarès. À noter : l'article source est un teaser promotionnel invitant au téléchargement d'un rapport complet accessible sur formulaire, et ne détaille pas les critères de sélection par organisation.

BusinessActu
1 source
LG fait équipe des robots humanoïdes et quadrupèdes pour automatiser ses entrepôts
4002Interesting Engineering 

LG fait équipe des robots humanoïdes et quadrupèdes pour automatiser ses entrepôts

LG CNS, filiale IT du conglomérat sud-coréen LG, a présenté le 6 mai 2026 une démonstration de logistique multi-robots sur son campus Magok, dans l'ouest de Séoul. Quatre robots de fabricants différents ont exécuté une chaîne de manutention complète sans téléopération ni intervention humaine : un humanoïde bipède a saisi des colis sur un tapis roulant et les a transmis à un robot quadrupède à roues, qui les a acheminés jusqu'à un humanoïde sur plateforme roulante, lequel a positionné les boîtes sur des étagères situées à plus de deux mètres de hauteur. Le cycle complet, entre stations espacées de deux à trois mètres, s'est bouclé en environ 90 secondes. L'ensemble repose sur la plateforme Physical Works de LG CNS, articulée en deux briques : Physical Works Forge (entraînement par simulation et données vidéo) et Physical Works Baton (orchestration centralisée de flottes multi-marques). La plateforme prend en charge les humanoïdes bipèdes et sur roues, les quadrupèdes, les AMR et les AGV via une interface unifiée. LG Display a par ailleurs dévoilé en parallèle un écran P-OLED courbe de 7,2 pouces (technologie Tandem OLED troisième génération) destiné à l'affichage facial des robots humanoïdes. Ce qui rend la démonstration techniquement notable, c'est moins la performance individuelle de chaque robot que la couche logicielle de coordination inter-marques. La plateforme intègre un mécanisme de réaffectation dynamique des tâches : lors de la simulation d'un incident, le quadrupède a été basculé vers une mission de patrouille de sécurité, et un AMR de remplacement a pris le relais de transport sans interrompre le flux. LG CNS annonce que cette approche ramène les délais de déploiement de plusieurs mois à un à deux mois, avec des projections de gains de productivité supérieurs à 15 % et de réduction des coûts opérationnels allant jusqu'à 18 % dans des environnements de flottes mixtes d'environ 100 unités. Ces chiffres restent des projections internes, non encore validés en production à grande échelle, et le cycle de 90 secondes a été mesuré sur une distance très courte, ce qui en limite la portée comme indicateur de performance industrielle réelle. LG CNS positionne Physical Works dans un marché où la concurrence se structure autour de plateformes d'orchestration robotique plutôt que d'hardwares isolés. Aux États-Unis, Boston Dynamics propose Orbit pour la gestion de flottes Spot, tandis qu'Amazon et ses partenaires intègrent déjà des flottes mixtes AMR-humanoïdes (Digit d'Agility Robotics) dans leurs entrepôts. En Corée du Sud, Samsung et Hyundai (actionnaire de Boston Dynamics) sont également présents sur ce terrain. LG CNS a annoncé mener des projets pilotes avec 20 clients industriels et déployer la plateforme dans le cadre du projet Busan Smart City. Le groupe a aussi pris des participations dans des entreprises de contrôle humanoïde et de robot foundation models, sans en préciser les noms, ce qui suggère une stratégie d'intégration verticale en cours de consolidation.

IndustrielOpinion
1 source
Podcast : Colin Angle parle de la conception de robots compagnons avec Familiar Machines et Magic
4003The Robot Report 

Podcast : Colin Angle parle de la conception de robots compagnons avec Familiar Machines et Magic

Colin Angle, cofondateur et ancien PDG d'iRobot, sort de la discrétion avec une nouvelle startup baptisée Familiar Machines & Magic (FM&M). La société vient de lever le voile sur son projet : développer des robots compagnons appelés "Familiars", conçus pour entretenir des relations à long terme avec leurs utilisateurs, avec une dimension d'intelligence émotionnelle embarquée. FM&M se positionne dans le segment de la "physical AI grand public". Aux côtés d'Angle, l'équipe fondatrice comprend Ira Renfrew, directrice des ressources humaines et du produit, et le Dr Chris Jones, directeur R&D, tous deux vétérans de l'industrie avec des parcours chez iRobot, Amazon et d'autres grandes plateformes technologiques. Le reste de l'équipe cumule des expertises issues de Disney Research, du MIT, de Boston Dynamics et de l'USC. Collectivement, les fondateurs revendiquent le déploiement de plus de 50 millions de robots grand public dans le monde. La société opère depuis Boston, Los Angeles et Hong Kong. Le retour de Colin Angle dans la robotique grand public constitue un signal notable pour un secteur aujourd'hui dominé par les annonces industrielles et les humanoïdes de laboratoire. FM&M mise sur un segment encore peu commercialisé : le robot domestique à vocation relationnelle, distinct du simple assistant vocal ou du robot aspirateur. L'enjeu central est de démontrer qu'une intelligence émotionnelle peut être embarquée dans un produit physique viable sur le marché de masse, hypothèse que plusieurs tentatives précédentes (Jibo, Anki Vector, Embodied Moxie) n'ont pas réussi à valider à grande échelle. Le pedigree de l'équipe apporte une crédibilité rare dans ce segment, notamment sur les questions de navigation, de robustesse produit et de capacité manufacturière. Cela dit, FM&M n'a annoncé ni produit concret, ni prix, ni calendrier de lancement : on reste strictement au stade de la sortie de stealth, sans prototype montré publiquement. Angle a quitté iRobot début 2024 après l'échec du rachat par Amazon, bloqué par la Commission européenne en janvier 2024 pour des raisons de concurrence, ce qui avait contraint l'entreprise à licencier environ 31 % de ses effectifs et Angle à démissionner. Cette rupture a libéré l'un des profils les plus expérimentés de la robotique grand public pour fonder FM&M. Dans le paysage concurrent, les robots compagnons peinent structurellement à trouver un modèle économique pérenne : Embodied a fermé ses portes, Sony perpétue Aibo sur un segment premium très niche, et des acteurs comme 1X Technologies ou Apptronik visent prioritairement l'industrie. Aucune levée de fonds n'a été communiquée publiquement par FM&M, et la formulation retenue par la société, construire "une plateforme à long terme pour la vie artificielle", suggère un horizon commercial encore lointain.

Brightpick présente sa feuille de route vers les entrepôts entièrement automatisés au Robotics Summit
4004The Robot Report 

Brightpick présente sa feuille de route vers les entrepôts entièrement automatisés au Robotics Summit

Jan Zizka, co-fondateur et PDG de Brightpick, présentera le 27 mai 2026 à 14h45 lors du Robotics Summit & Expo de Boston une conférence intitulée "When Robots Don't Sleep: The Path Toward Lights-Out Warehouses". L'exposé portera sur une feuille de route concrète vers les entrepôts en fonctionnement autonome total, dits "lights-out", sans opérateurs humains présents. Brightpick, fondée en 2021 par essaimage depuis l'éditeur de vision machine Photoneo (racheté par Zebra Technologies en 2024), développe des robots d'order picking basés sur l'IA. Son produit phare, l'Autopicker, lauréat du RBR50 Robotics Innovation Award 2024, s'installe en quelques semaines dans des entrepôts de toute taille et couvre le picking, le buffering, la consolidation, l'expédition et le réapprovisionnement de stock. La société est basée à Austin, Texas. Le message central de Zizka est délibérément pragmatique : le lights-out total reste hors de portée économique à court terme, mais un mode hybride est déjà opérationnel. Dans ce modèle, les robots assurent la majorité des tâches répétitives de nuit sans supervision, tandis que les humains interviennent le jour pour les pics de volume et les cas exceptionnels. Le vrai verrou n'est pas technique mais économique : automatiser les derniers 10 à 20 % des flux, là où se concentrent les cas limites et les décisions de jugement, coûte disproportionnellement cher par rapport au gain. La stratégie rationnelle consiste donc à maximiser le ROI sur les flux à fort volume, préserver la flexibilité humaine là où elle crée de la valeur, et réduire progressivement l'ensemble des exceptions à mesure que la technologie mature. C'est une posture moins spectaculaire que les annonces "révolutionnaires" du secteur, mais plus alignée avec les contraintes réelles des opérateurs logistiques. Brightpick s'inscrit dans une course à la commercialisation des robots d'entrepôt autonomes où les acteurs sont nombreux : Exotec (France, systèmes Skypod pour le stockage dense), Symbotic, Locus Robotics, ou encore Grey Orange sur le segment des AMR de fulfillment. La particularité de Brightpick est son héritage en vision 3D via Photoneo, qui lui confère une expertise en manipulation autonome plutôt que sur le simple transport. Zizka cumule plus de 20 brevets couvrant la détection 3D, la robotique mobile et la manipulation, et a conduit des recherches sur les caméras computationnelles au MIT. La conférence de Boston permettra de calibrer où en est réellement la technologie par rapport aux promesses marketing du secteur, un exercice d'autant plus utile que les déploiements lights-out effectifs restent rares et souvent cantonnés à des environnements très contraints (température, SKU limités, flux prévisibles).

IndustrielActu
1 source
Le robot humanoïde reçoit une tête avec écran OLED incurvé pour améliorer son efficacité
4005Interesting Engineering 

Le robot humanoïde reçoit une tête avec écran OLED incurvé pour améliorer son efficacité

LG Display a présenté au SID Display Week 2026 de Los Angeles un écran P-OLED de 7,2 pouces conçu spécifiquement pour les robots humanoïdes, marquant la première démonstration publique d'un tel composant par l'entreprise coréenne. Le panneau repose sur la troisième génération de la plateforme Tandem OLED de LG, rebaptisée "Tandem OLED" pour les usages robotiques, et utilise un substrat plastique en polyimide plutôt que du verre, ce qui lui confère une flexibilité suffisante pour épouser les surfaces courbes d'un visage mécanique. L'interface affiche des informations fonctionnelles, niveau de batterie, météo, mode veille, calendrier, salutations, tandis que la majorité de l'écran reste éteinte lors des démonstrations, exploitant le principe OLED où chaque pixel s'éteint indépendamment. Résultat : la troisième génération Tandem réduit la consommation énergétique de 18 % par rapport à la génération précédente, limitant la dissipation thermique dans un châssis où les composants électroniques sont sensibles à la chaleur. Le panneau atteint 1 000 nits de luminosité, opère entre -30 °C et 85 °C, et est qualifié pour plus de 15 000 heures de fonctionnement, des spécifications empruntées à la filière OLED automobile du groupe. L'enjeu industriel de cette annonce va au-delà de l'esthétique : un écran facial n'est pas qu'un gadget de communication HRI (human-robot interaction), c'est un composant thermique, énergétique et mécanique à part entière. Pour les intégrateurs de robots de service, la capacité à afficher un statut opérationnel sans drain notable sur la batterie, tout en résistant aux contraintes thermiques d'un environnement industriel ou domestique, représente un critère de sélection concret. La flexibilité du substrat ouvre par ailleurs la voie à des designs de carrosserie moins contraints par la géométrie plane des dalles rigides. Il est toutefois utile de noter que LG Display parle pour l'instant d'un prototype présenté en salon : aucun engagement de production en série ni de fenêtre de disponibilité commerciale n'a été communiqué. Ce dévoilement s'inscrit dans la stratégie plus large de LG Electronics, qui a lancé le robot humanoïde LG CLOiD en janvier 2026 au CES de Las Vegas. CLOiD embarque deux bras articulés à 7 degrés de liberté chacun, cinq doigts à actionnement indépendant, une base mobile autonome et une tête-hub équipée de caméras, capteurs et d'une interface IA reposant sur des modèles VLM (Vision Language Model) et VLA (Vision Language Action), entraînés sur plusieurs dizaines de milliers d'heures de données de tâches domestiques. LG a également annoncé LG Actuator AXIUM, une plateforme d'actionneurs modulaires destinée aux robots de service et aux appareils électroménagers intelligents. Sur ce segment, LG se positionne en concurrent direct de Samsung Robotics, Boston Dynamics (Spot/Atlas chez Hyundai) et des acteurs spécialisés comme Enchanted Tools en France, qui développe Miroki pour des usages hospitaliers et de services.

HumanoïdesOpinion
1 source
ABB Robotics lance PickMaster Lite pour simplifier et accélérer la prise robotisée
4006Robotics & Automation News 

ABB Robotics lance PickMaster Lite pour simplifier et accélérer la prise robotisée

ABB Robotics a lancé PickMaster Lite, une version allégée de sa suite logicielle PickMaster, destinée aux OEM packaging et aux intégrateurs systèmes qui cherchent à déployer des applications de picking robotisé haute vitesse guidé par vision. Le produit vise à réduire l'effort d'ingénierie lors de la configuration et à raccourcir les délais de mise en service sur des tâches de picking courantes. ABB n'a pas communiqué de métriques précises sur les gains de temps de cycle ou les prix dans cette annonce initiale. L'enjeu pour les intégrateurs est réel: la configuration de systèmes de picking vision-guidé reste l'un des postes les plus chronophages dans les projets d'automatisation packaging, notamment pour les lignes à cadences élevées. En proposant une version avec des fonctionnalités essentielles plutôt qu'une suite complète, ABB abaisse la barrière d'entrée pour les PME industrielles et les OEM qui ne disposent pas d'équipes robotique expertes en interne. C'est aussi un signal que le marché logiciel pour la robotique de picking se structure autour de deux segments: des plateformes full-featured pour intégrateurs avancés, et des offres simplifiées pour accélérer le déploiement sur cas d'usage standardisés. PickMaster est une plateforme ABB historique pour le picking et le placement, utilisée notamment avec les robots delta IRB 360 FlexPicker. Sur ce segment, ABB fait face à Fanuc, KUKA, Yaskawa et à des acteurs logiciels spécialisés comme Pickit ou Mujin, qui misent également sur la réduction de la complexité de programmation. Les prochaines étapes de PickMaster Lite, notamment les compatibilités de robots supportés et les conditions de licence, n'ont pas encore été détaillées par ABB.

FR/EU ecosystemeOpinion
1 source
Comau et Aptiv s'associent pour développer des systèmes d'automatisation industrielle autonomes et de robotique basée sur l'IA
4007Robotics & Automation News 

Comau et Aptiv s'associent pour développer des systèmes d'automatisation industrielle autonomes et de robotique basée sur l'IA

Comau, spécialiste italien de l'automatisation industrielle rattaché au groupe Stellantis, et Aptiv, entreprise technologique américaine issue de la scission de Delphi en 2017, ont signé un accord-cadre pour co-développer des systèmes d'automatisation industrielle intelligents. Les trois axes retenus sont la robotique avancée, les systèmes autonomes et l'intégration de l'IA dans les processus de production. Il s'agit à ce stade d'un protocole d'intention : aucun produit, aucun délai ni montant d'investissement n'a été communiqué. La complémentarité des deux acteurs justifie le rapprochement. Comau apporte son expertise en intégration robotique et en ingénierie de lignes de production, Aptiv ses capacités en architecture électronique embarquée et en logiciels pour systèmes autonomes, développées dans l'univers du véhicule connecté. Pour les intégrateurs industriels, cette convergence hardware-software reflète une tendance structurelle : les plateformes d'automatisation évoluent vers une adaptation autonome en environnement non structuré, réduisant la dépendance à la reprogrammation manuelle. Les deux entreprises s'inscrivent dans un secteur sous pression concurrentielle forte. FANUC, ABB Robotics et KUKA, filiale du groupe chinois Midea depuis 2017, investissent eux aussi dans l'IA appliquée à la robotique industrielle. Comau cherche à diversifier ses débouchés au-delà de l'assemblage automobile, tandis qu'Aptiv accélère sa transition des composants électroniques vers les couches logicielles. L'accord reste prudemment formulé, sans pilote client identifié ni roadmap précise, signe d'une collaboration encore en phase exploratoire.

FR/EU ecosystemeActu
1 source
De nouvelles connaissances sur le vol des insectes ouvrent la voie à des robots à ailes battantes stables
4008Robohub 

De nouvelles connaissances sur le vol des insectes ouvrent la voie à des robots à ailes battantes stables

Des chercheurs de l'Université Cornell ont publié le 1er mai 2026 dans les Proceedings of the National Academy of Sciences un modèle computationnel qui reformule les conditions de stabilité du vol battu chez les insectes. Dirigée par Z. Jane Wang, professeure de physique et d'ingénierie aérospatiale, et co-signée par Owen Wetherbee en premier auteur, l'étude fait suite à plus d'une décennie de travaux amorcés sur les circuits neuronaux des mouches des fruits. Le modèle de départ, une simulation 3D complète, montrait que la mouche des fruits actualise sa posture à chaque battement d'aile, soit environ une fois toutes les 4 millisecondes. L'équipe a ensuite condensé cette simulation en un modèle réduit qui préserve les équations physiques essentielles tout en restant calculable à grande échelle. Cinq paramètres structurent ce qu'elle appelle un "espace morphologique et cinématique à cinq dimensions" : le rapport masse aile/corps, la charge alaire, la position de l'articulation alaire, la fréquence de battement et l'amplitude du mouvement. De cet espace émergent deux formules explicites définissant la frontière de stabilité, centrées sur un mécanisme d'anti-résonance qui permet à l'animal de neutraliser passivement les oscillations de son corps malgré les perturbations aérodynamiques extérieures. Le résultat le plus contre-intuitif tient dans le constat que de nombreuses configurations de vol battu atteignent une stabilité passive, c'est-à-dire sans correction neuronale active, à condition d'être positionnées dans la bonne zone de l'espace morphologique. La littérature antérieure concluait au contraire que la quasi-totalité des insectes sont passivement instables et dépendent de circuits neuronaux rapides pour se maintenir en vol. L'explication de cette divergence est méthodologique : les études précédentes ne modélisaient que quelques espèces réelles, correspondant à autant de "points isolés" dans un espace de paramètres bien plus vaste. En élargissant cet espace, Cornell montre que ces espèces étudiées constituaient un échantillon non représentatif. Pour les roboticiens, l'implication est directe : il devient théoriquement possible de concevoir un drone à ailes battantes qui se stabilise par sa géométrie et sa fréquence de battement, sans recourir à des boucles de rétroaction complexes, une voie sur laquelle les systèmes embarqués actuels n'ont jamais pleinement abouti. Le problème du vol battu stable en robotique reste ouvert depuis plusieurs décennies. Les micro-drones à ailes battantes existants, comme le Harvard RoboBee ou les prototypes développés par TU Delft dans le cadre du projet DelFly, s'appuient massivement sur des contrôleurs actifs pour compenser leur instabilité intrinsèque, ce qui accroît la complexité embarquée et réduit l'autonomie. Le modèle de Cornell offre un chemin alternatif : identifier, par calcul, les combinaisons de fréquence et de morphologie qui placent un engin dans la zone d'anti-résonance stable, avant même la fabrication. L'équipe n'annonce pas de prototype, et le gap entre modèle computationnel et robot physique reste substantiel, notamment en raison des contraintes matériaux et d'actionnement. Néanmoins, la disponibilité de critères analytiques explicites, là où il n'existait auparavant que des simulations coûteuses espèce par espèce, constitue une base de conception réutilisable pour les laboratoires travaillant sur les MAV (micro aerial vehicles) à battement d'ailes.

RecherchePaper
1 source
Geekplus s'associe à Mindugar pour accélérer l'automatisation d'entrepôt en Amérique latine
4009Robotics & Automation News 

Geekplus s'associe à Mindugar pour accélérer l'automatisation d'entrepôt en Amérique latine

Geekplus, entreprise chinoise spécialisée dans la robotique d'entrepôt et l'un des plus grands fournisseurs mondiaux d'AMR (robots mobiles autonomes), a annoncé un partenariat stratégique avec Mindugar, intégrateur latino-américain de systèmes de stockage industriel et de rayonnages. L'accord, dont les termes financiers ne sont pas divulgués, vise à accélérer l'adoption de l'automatisation logistique au sein de la région Amérique latine. Mindugar apporte son réseau commercial et son expertise locale en infrastructure d'entrepôt, tandis que Geekplus fournit ses solutions robotiques, robots goods-to-person, systèmes de tri et convoyage autonome. Pour le marché latino-américain, cette alliance représente un signal clair : la convergence entre les fabricants de racks traditionnels et les éditeurs de solutions robotiques s'accélère, reproduisant un modèle déjà observé en Europe et au Moyen-Orient. Pour les intégrateurs et les décideurs logistiques de la région, cela signifie un accès simplifié à des solutions clés en main combinant infrastructure physique et automatisation. La LatAm reste un marché à fort potentiel mais sous-pénétré en robotique d'entrepôt, avec des contraintes propres, coûts d'importation, instabilité monétaire, main-d'oeuvre relativement bon marché, qui freinent jusqu'ici les déploiements à grande échelle. À noter : le communiqué s'apparente davantage à une annonce de partenariat canal qu'à la confirmation de déploiements opérationnels. Fondée en 2015 à Pékin, Geekplus revendique des milliers de robots déployés dans plus de 40 pays, avec une présence établie en Europe, aux États-Unis et au Moyen-Orient. L'entreprise concurrence directement Quicktron (Alibaba), Hai Robotics et, sur le segment haut de gamme, Exotec (France) dont la solution Skypod est également présente en logistique e-commerce. Le partenariat avec Mindugar s'inscrit dans une stratégie de distribution indirecte typique de la phase d'internationalisation de Geekplus, sans timeline de déploiement ni volume de projets annoncé à ce stade.

IndustrielActu
1 source
SF Express, Sequoia China et IDG investissent dans une licorne en robots humanoïdes issue de Tsinghua
4010Pandaily 

SF Express, Sequoia China et IDG investissent dans une licorne en robots humanoïdes issue de Tsinghua

Wujie Power (无界动力), spin-off de l'université Tsinghua spécialisé dans les robots humanoïdes à usage général, a bouclé un tour de financement impliquant des investisseurs chinois et internationaux de premier rang. Ce tour est co-dirigé par Envision Group et le Fonds d'investissement en intelligence artificielle de Pékin, avec la participation récurrente de Sequoia China, Linear Capital, Hillhouse Ventures, Baidu Ventures et Yunshan Capital. La société est par ailleurs sur le point de clôturer une tranche additionnelle dite "angel+++" auprès de capitaux américains et en renminbi, portant le financement total au stade angel à plus de 200 millions de dollars. Ce tour intervient dans la continuité d'un tour stratégique d'un milliard de yuans finalisé en mars 2026. Simultanément, StarTrace (星动纪元), autre constructeur d'humanoïdes issu du même écosystème d'investisseurs, a clôturé un tour dépassant également 200 millions de dollars. Le géant de la logistique SF Express figure parmi les nouveaux entrants, rejoignant le capital à l'intersection de la robotique et de l'automatisation de la chaîne d'approvisionnement. L'annonce ne précise ni la valorisation exacte ni les spécifications techniques du robot : pas de charge utile, de degrés de liberté ou de cadence opérationnelle communiqués. Ces levées consécutives confirment l'appétit persistant du capital-risque chinois pour l'IA incarnée (embodied AI), mais signalent surtout un mouvement stratégique côté industrie. La présence de SF Express au capital est un indicateur concret : un opérateur logistique de cette envergure n'engage pas plusieurs dizaines de millions sans anticiper un horizon d'intégration dans ses entrepôts ou centres de tri. Pour les décideurs B2B, cela suggère que la logistique reste le premier terrain de déploiement visé par les humanoïdes chinois en 2026-2027, avant le manufacturing. Les deux tours simultanés (Wujie Power + StarTrace) indiquent également une stratégie de portefeuille coordonnée, plutôt qu'une conviction isolée sur un seul acteur. Wujie Power s'inscrit dans la vague de spin-offs académiques issus de Tsinghua ces deux dernières années, aux côtés d'acteurs comme Unitree Robotics, Agibot et UBTECH, qui ont tous intensifié leurs levées et annonces produit en 2025-2026. Face à eux, les constructeurs occidentaux Figure AI, Agility Robotics (désormais dans l'orbite d'Amazon) et 1X Technologies avancent sur leurs propres déploiements, tandis qu'en Europe Enchanted Tools et Wandercraft restent à plus petite échelle de capitalisation. La course sino-américaine sur l'humanoïde s'accélère avec des capitaux publics et privés engagés des deux côtés. Les prochaines étapes probables pour Wujie Power sont la clôture de la tranche angel+++ et l'annonce de premiers pilotes industriels, possiblement en logistique avec SF Express en client-investisseur.

Chine/AsieOpinion
1 source
Genesis AI développe un cerveau robotique pour doter les robots polyvalents d'une dextérité comparable à celle de l'humain
4011Interesting Engineering 

Genesis AI développe un cerveau robotique pour doter les robots polyvalents d'une dextérité comparable à celle de l'humain

Genesis AI a dévoilé GENE-26.5, un modèle d'intelligence artificielle qualifié de "cerveau robotique" par l'entreprise, conçu pour doter les robots polyvalents d'une dextérité comparable à celle de l'être humain dans l'exécution de tâches physiques complexes. Le système repose sur une architecture VLA (vision-language-action) : il ingère des flux vidéo issus de caméras embarquées, interprète des instructions en langage naturel et génère directement des commandes motrices de bas niveau, sans pipeline modulaire intermédiaire. Selon Genesis AI, GENE-26.5 permet d'exécuter des séquences de manipulation multi-étapes (saisie, tri, assemblage, adaptation aux variations d'environnement) et fonctionnerait sur plusieurs types de plateformes matérielles sans être lié à une configuration d'actionneurs spécifique. L'entreprise n'a toutefois publié aucun benchmark indépendant ni aucune étude évaluée par les pairs : les performances annoncées reposent exclusivement sur des évaluations internes. La composition et le volume du dataset d'entraînement, probablement issu de sessions de télé-opération humaine et de simulations à grande échelle, n'ont pas été divulgués. L'enjeu de cette annonce dépasse le seul modèle. Le véritable goulot d'étranglement dans le développement des robots polyvalents n'est plus mécanique mais logiciel, et plus précisément la capacité des politiques de contrôle à transférer de la simulation au monde réel (le "sim-to-real gap"). Une architecture VLA end-to-end présente un avantage théorique : la perception et l'action étant couplées dans un même réseau de neurones, le robot peut ajuster sa trajectoire de préhension en temps réel sans attendre un module de planification séparé. Ce couplage comporte toutefois un risque structurel, les erreurs de perception se propageant directement aux commandes motrices sans point de contrôle intermédiaire. Si la généralisation inter-plateformes de GENE-26.5 était validée indépendamment, elle réduirait significativement les barrières à l'entrée pour les intégrateurs et les startups robotiques qui n'ont pas les ressources pour entraîner leurs propres modèles fondamentaux, déplaçant la différenciation concurrentielle vers la qualité matérielle et le fine-tuning applicatif. L'annonce intervient dans un contexte de compétition accélérée sur le marché des robots à usage général. Des acteurs américains comme Figure (Figure 03), Agility Robotics ou Apptronik, ainsi que les équipes Optimus de Tesla et les laboratoires de Physical Intelligence (Pi-0) ou de NVIDIA (GR00T N2), visent des volumes de production de l'ordre de 100 000 unités d'ici 2027. La dextérité manuelle reste l'un des problèmes les plus ouverts du domaine : la main humaine mobilise environ 27 os et plus de 30 muscles pour des gestes que les robots ne reproduisent encore qu'approximativement. Genesis AI n'a annoncé ni partenaire matériel, ni calendrier de déploiement commercial, ni conditions de licence pour GENE-26.5. L'affirmation d'une dextérité "au niveau humain" constitue une revendication forte que le secteur attendra de voir confirmer par des données de terrain réelles, hors conditions de démonstration contrôlées.

IA physiqueOpinion
1 source
Bosch Rexroth vs Festo vs SMC : Les leaders de l’automatisation et de la pneumatique
4012Robot Magazine FR 

Bosch Rexroth vs Festo vs SMC : Les leaders de l’automatisation et de la pneumatique

Bosch Rexroth, Festo et SMC Corporation constituent aujourd'hui le triptyque dominant de l'automatisation industrielle et de la pneumatique mondiale. Filiale du groupe Bosch, Rexroth propose une architecture d'automatisation systémique couvrant le motion control, l'hydraulique, les servo-entraînements, l'automatisation électrique, les logiciels industriels et les plateformes connectées orientées Industrie 4.0, un portefeuille conçu pour les infrastructures lourdes et les lignes de production hautement intégrées. L'allemand Festo, fondé à Stuttgart en 1925, s'est imposé comme la référence en pneumatique de précision, avec une forte culture R&D appliquée : l'entreprise est notamment connue pour ses démonstrateurs biomimétiques (bras assistés, robots souples) qui anticipent les prochaines générations de composants industriels, et pour ses solutions de formation technique utilisées dans plus de 170 pays. SMC Corporation, groupe japonais créé en 1959 et coté à Tokyo, est aujourd'hui le premier fournisseur mondial de pneumatique industrielle par volume, avec une présence commerciale dans plus de 80 pays et un catalogue de plus de 12 000 références de vérins, vannes et systèmes de contrôle de fluides. Ces trois acteurs opèrent sur un marché où la distinction entre composant et solution devient le principal levier de différenciation. Pour un intégrateur ou un directeur industriel, le choix ne se résume plus à un catalogue de références : il engage une architecture complète. Bosch Rexroth cible les environnements où la convergence entre motion, hydraulique et données est critique, lignes automotive, presses, machines-outils CNC. Festo se positionne sur les applications nécessitant précision et flexibilité : assemblage, agroalimentaire, laboratoires, chaînes reconfigurables, avec un avantage compétitif sur l'efficacité énergétique des actionneurs pneumatiques. SMC répond à une logique de volume et de standardisation : délais courts, disponibilité mondiale, coût à l'unité optimisé. La vraie question pour un décideur B2B n'est pas laquelle est "meilleure", mais laquelle correspond au profil de son process : complexité intégrée (Rexroth), précision applicative (Festo), ou déploiement standardisé à grande échelle (SMC). Ces trois entreprises ont construit leur position sur plusieurs décennies, dans un marché longtemps fragmenté entre spécialistes régionaux. L'accélération de l'Industrie 4.0 et la montée des cobots et robots mobiles autonomes (AMR) ont rebattu les cartes : les pneumaticiens purs comme Festo et SMC investissent désormais dans les interfaces électriques et les protocoles connectés (IO-Link, OPC UA), tandis que Bosch Rexroth étend ses logiciels vers l'edge computing industriel. Les challengers européens, Parker Hannifin, Aventics (ex-Bosch pneumatique, désormais Emerson), ou encore Norgren, grignotent des parts sur des segments spécifiques. À noter : des acteurs français comme Joucomatic (groupe Asco/Emerson) ou Pneumax restent présents sur le marché européen, sans atteindre l'échelle mondiale de ce trio. La prochaine bataille se joue sur l'intégration logicielle et la data industrielle, terrain sur lequel Bosch Rexroth dispose aujourd'hui d'une longueur d'avance structurelle.

FR/EU ecosystemeOpinion
1 source
Gaze4HRI : benchmark zero-shot des réseaux de neurones pour l'estimation du regard en interaction humain-robot
4013arXiv cs.RO 

Gaze4HRI : benchmark zero-shot des réseaux de neurones pour l'estimation du regard en interaction humain-robot

Une équipe de chercheurs a publié en mai 2026 Gaze4HRI (arXiv:2605.04770), un benchmark à grande échelle conçu pour évaluer les réseaux de neurones d'estimation du regard dans les conditions réelles de l'interaction humain-robot (HRI). Le jeu de données regroupe plus de 50 sujets, 3 000 vidéos et 600 000 images annotées, couvrant quatre variables critiques identifiées comme sous-représentées dans les évaluations existantes : les variations d'éclairage, les conflits entre direction de la tête et direction du regard, la mobilité de la caméra embarquée sur le robot, et le déplacement de la cible visuelle. L'approche retenue est celle de l'estimation 3D du regard dite "zero-shot" : les modèles apprennent à projeter directement une image RGB en vecteur de regard, sans calibration individuelle, ce qui réduit considérablement les coûts de déploiement en contexte opérationnel. Les résultats du benchmark remettent en question plusieurs hypothèses dominantes dans la littérature. Chacune des méthodes évaluées échoue sur au moins une condition testée, et le regard fortement orienté vers le bas ("steeply-downward gaze") constitue un point d'échec universel pour l'ensemble des architectures, y compris les modèles spatio-temporels complexes et les approches basées sur des Transformers. Ces architectures récentes, pourtant très citées, n'affichent pas de supériorité systématique en conditions non contrôlées. Seul PureGaze, entraîné sur le dataset ETH-X-Gaze, maintient une robustesse satisfaisante sur l'ensemble des autres conditions. La conclusion centrale est que la diversité des données d'entraînement constitue le premier levier de robustesse zero-shot, devant la complexité architecturale, tandis que des mécanismes comme la self-adversarial loss de PureGaze pour la purification des features de regard apportent un gain additionnel significatif. L'estimation du regard est une compétence fondamentale pour les robots sociaux et collaboratifs : elle conditionne la détection d'attention, la coordination tour-par-tour, et la sécurité en environnement partagé. Les benchmarks existants souffrent d'un "complexity gap" structurel, les méthodes étant entraînées sur des corpus variés mais évaluées sur des ensembles beaucoup plus petits et homogènes, ce qui surestime leur robustesse réelle. Gaze4HRI vise à corriger ce biais. Sur le plan concurrentiel, le dataset ETH-X-Gaze (ETH Zurich) s'impose ici comme la référence en termes de diversité, tandis que des benchmarks HRI spécialisés comme GAZE360 ou MPIIFaceGaze ne capturent pas les conditions de mouvement propres aux plateformes robotiques. Le dataset et le code sont disponibles publiquement sur gazeforhri.github.io, ce qui devrait faciliter l'adoption par les équipes travaillant sur des robots humanoïdes ou des AMR équipés de systèmes de perception sociale.

RecherchePaper
1 source
ConsisVLA-4D : vers une meilleure cohérence spatiotemporelle pour la manipulation robotique avec un modèle VLA
4014arXiv cs.RO 

ConsisVLA-4D : vers une meilleure cohérence spatiotemporelle pour la manipulation robotique avec un modèle VLA

Une équipe de recherche publie ce 7 mai 2026 ConsisVLA-4D (arXiv:2605.05126), un framework unifié pour la manipulation robotique qui cherche à résoudre deux angles morts structurels des modèles Vision-Language-Action actuels : la perception spatiale 3D et le raisonnement temporel 4D. L'architecture repose sur trois modules complémentaires. Le premier, CV-Aligner, filtre les régions pertinentes à l'instruction en cours et aligne les identités d'objets entre plusieurs points de vue, assurant une cohérence sémantique inter-caméras. Le second, CO-Fuser, élimine les ambiguïtés de relations spatiales entre objets via des représentations latentes compactes, sans recourir à des capteurs de profondeur dédiés. Le troisième, CS-Thinker, combine les tokens sémantiques de CV-Aligner et les tokens géométriques de CO-Fuser pour construire une représentation implicite des dynamiques locales et globales de la scène, permettant un raisonnement visuel continu au fil de l'exécution. Les auteurs rapportent des gains de 21,6 % sur le benchmark LIBERO et de 41,5 % en environnement réel par rapport à OpenVLA, avec des accélérations d'inférence respectives de 2,3x et 2,4x. Le code est publié en open source. Ces résultats sont significatifs pour le débat, toujours ouvert dans le secteur, sur la capacité des VLA à passer de la démonstration contrôlée au déploiement réel. Le gain le plus notable est celui en conditions réelles (+41,5 % vs +21,6 % en simulation), ce qui suggère que la cohérence spatiotemporelle adresse précisément le sim-to-real gap que d'autres architectures peinent à combler. L'absence de capteur de profondeur dédié est également un point concret pour les intégrateurs industriels : réduire la dépendance à des capteurs supplémentaires diminue le coût de déploiement et la surface de défaillance. L'accélération d'inférence de 2,3x à 2,4x, si elle se confirme dans des cycles de manipulation industriels (pick-and-place, assemblage), est un argument directement actionnable pour des COO cherchant à calibrer le throughput de cellules robotisées. Il convient toutefois de noter que les métriques sont mesurées contre OpenVLA, qui reste une baseline académique, et non contre des systèmes commerciaux comme pi-0 (Physical Intelligence) ou Helix (Figure), ce qui limite la portée comparative. Les modèles VLA de première génération, dont OpenVLA et RT-2, se sont construits sur des pipelines essentiellement 2D, héritant des architectures vision-langage conçues pour la compréhension d'images statiques. La contrainte de cohérence spatiotemporelle que ConsisVLA-4D formalise est un problème que l'ensemble des acteurs du secteur, Physical Intelligence avec pi-0, DeepMind avec RT-X, et Boston Dynamics sur le plan applicatif, tentent de résoudre par des voies différentes (données de préentraînement massives, retour haptique, diffusion de politiques). Dans le paysage français et européen, des entreprises comme Enchanted Tools et Wandercraft travaillent sur des problématiques adjacentes de contrôle robuste en environnement non structuré, où la perception multi-vue est également un verrou. La prochaine étape logique pour ConsisVLA-4D sera de confronter le framework à des tâches longue-horizon et à des environnements non rigides, deux cas d'usage encore peu couverts par le benchmark LIBERO.

IA physiqueOpinion
1 source
Apprendre à sentir le futur : DreamTacVLA pour la manipulation riche en contacts
4015arXiv cs.RO 

Apprendre à sentir le futur : DreamTacVLA pour la manipulation riche en contacts

Des chercheurs ont publié DreamTacVLA, un framework qui dote les modèles Vision-Language-Action (VLA) d'un sens du toucher anticipatif. Ces architectures, parmi lesquelles Pi-0 de Physical Intelligence ou GR00T N2 de NVIDIA, généralisent des comportements robotiques à partir de connaissances web-scale, mais restent aveugles à la physique du contact : force, texture et glissement. DreamTacVLA introduit une perception hiérarchique à trois niveaux : images tactiles haute résolution (micro-vision), caméra poignet (vision locale) et vue tierce (macro-vision), le tout aligné par une perte baptisée Hierarchical Spatial Alignment (HSA). Le système est ensuite affiné par un modèle de monde tactile prédisant des états de contact futurs, ce qui lui permet de conditionner ses décisions à la fois sur des observations réelles et sur des conséquences anticipées ; sur des benchmarks de manipulation contact-riche (vissage, pelage, textiles), il atteint jusqu'à 95 % de succès face aux baselines VLA état de l'art, appuyé par un dataset hybride combinant simulation haute-fidélité (digital twin) et expériences en monde réel. Ce résultat quantifie concrètement le "gap tactile" des VLA modernes : intégrer des signaux de contact haute résolution est discriminant pour des tâches industrielles entières, de l'assemblage de précision au conditionnement de composants déformables. Conditionner les décisions sur des conséquences tactiles anticipées, et non seulement sur des observations en temps réel, rapproche les VLA du raisonnement physique implicite des opérateurs expérimentés. Pour les intégrateurs B2B, cela laisse entrevoir une prochaine génération de politiques robotiques capables de manipulation fine sans capteurs de force-couple coûteux, à condition d'embarquer des capteurs tactiles conformes haute résolution. La démonstration reste cependant purement académique : aucun déploiement industriel ni partenariat de production n'est annoncé dans le papier. Le travail s'inscrit dans un mouvement d'enrichissement des VLA au-delà du seul canal vision-langage, aux côtés d'approches intégrant proprioception, retour de force ou audio. DreamTacVLA se distingue par l'application au domaine tactile de techniques issues des modèles de monde visuels (Dreamer, RSSM), une transposition méthodologiquement originale. L'article est à sa troisième révision arXiv (v3), signe d'une évaluation par les pairs active. Parmi les acteurs à surveiller : Sanctuary AI et Agility Robotics sur les politiques de manipulation, GelSight et Contactile sur les capteurs tactiles, et en Europe, Pollen Robotics qui explore des effecteurs sensoriellement enrichis.

IA physiqueOpinion
1 source
Des pixels aux tokens : étude systématique de la supervision par actions latentes pour les modèles vision-langage-action (VLA)
4016arXiv cs.RO 

Des pixels aux tokens : étude systématique de la supervision par actions latentes pour les modèles vision-langage-action (VLA)

Des chercheurs de l'Université Renmin de Chine (RUC) ont publié le 7 mai 2026 une étude systématique sur la supervision par actions latentes dans les modèles VLA (Vision-Language-Action), une architecture clé pour les robots capables de comprendre des instructions en langage naturel et d'agir dans le monde physique. L'article, référencé arXiv:2605.04678, pose une question concrète : comment entraîner efficacement un VLA sur des datasets hétérogènes, issus de robots différents avec des espaces d'action incompatibles ? La réponse explorée est l'action latente, une représentation intermédiaire abstraite qui sert de pivot commun entre perception visuelle, langage et commande motrice. Les auteurs comparent quatre stratégies d'intégration sous une baseline VLA unifiée, en distinguant deux familles : les actions latentes basées sur l'image (qui encodent les transitions visuelles entre frames) et celles basées sur l'action (qui compressent directement les commandes moteurs dans un espace latent). Les résultats révèlent une correspondance formulation-tâche claire, ce qui est utile pour tout intégrateur qui choisit une architecture : les actions latentes image-based sont plus efficaces sur les tâches longues nécessitant un raisonnement multi-étapes et une généralisation au niveau de la scène, tandis que les actions latentes action-based surperforment sur la coordination motrice fine et complexe. La découverte la plus opérationnelle est que superviser directement le modèle de langage vision (VLM) avec des tokens discrets d'actions latentes donne les meilleures performances globales, devançant les approches de supervision continue ou indirecte. L'étude apporte également des premières preuves que la supervision par actions latentes améliore l'entraînement en données mixtes (multi-robot, multi-tâche), un verrou majeur pour passer du lab au déploiement à grande échelle. Ce travail s'inscrit dans une course effrénée à la généralisation des VLA, après les succès récents de Pi-0 (Physical Intelligence), OpenVLA (UC Berkeley) et GR00T N2 (NVIDIA), qui ont tous démontré des capacités cross-embodiment limitées mais prometteuses. La contribution de RUC est moins un nouveau modèle qu'un benchmark de design choices, un type de contribution rare et précieux dans un domaine encore dominé par les démonstrations spectaculaires. La prochaine étape naturelle serait de valider ces résultats sur du matériel réel au-delà des benchmarks simulés, notamment sur des plateformes comme ALOHA 2 ou des manipulateurs industriels, pour confirmer que le gap sim-to-real ne neutralise pas les gains observés en simulation. Le code est disponible sur GitHub (RUCKBReasoning/FromPixelsto_Tokens).

RechercheOpinion
1 source
Quand la vie vous donne du BC, créez des fonctions Q pour l'apprentissage par renforcement sur robot
4017arXiv cs.RO 

Quand la vie vous donne du BC, créez des fonctions Q pour l'apprentissage par renforcement sur robot

Des chercheurs du RAI Institute publient sur arXiv (2605.05172, mai 2026) Q2RL, un algorithme d'apprentissage offline-to-online conçu pour améliorer automatiquement des politiques de contrôle robotique après une phase d'imitation. La méthode repose sur deux composants distincts : Q-Estimation, qui extrait une Q-function à partir d'une politique de Behavior Cloning (BC) en quelques étapes d'interaction avec l'environnement, et Q-Gating, qui alterne dynamiquement entre les actions BC et les actions RL en comparant leurs Q-values respectives pour guider la collecte de données d'entraînement. Sur les benchmarks standards D4RL et robomimic, Q2RL surpasse les meilleures baselines offline-to-online existantes en taux de succès et en vitesse de convergence. Appliqué directement sur robot réel, il apprend des politiques robustes pour des tâches de manipulation à contact riche et haute précision, assemblage de tuyaux et kitting industriel, en 1 à 2 heures d'interaction, avec des taux de succès atteignant 100 % et un gain jusqu'à 3,75x par rapport à la politique BC initiale. L'enjeu pratique est significatif : le BC reste la méthode dominante pour apprendre à partir de démonstrations humaines, notamment dans les architectures VLA (Vision-Language-Action) comme Pi-0 de Physical Intelligence, mais il souffre d'une limite structurelle, il ne s'améliore pas seul une fois déployé. Les approches offline-to-online existantes se heurtent à un problème de distribution mismatch : en passant à l'apprentissage en ligne, le RL tend à écraser les bonnes actions apprises hors ligne. Q2RL adresse ce problème directement via le Q-Gating, qui agit comme un filtre de qualité empêchant la dégradation de la politique. Un délai de convergence de 1 à 2 heures sur robot physique est une performance notable pour des tâches à contact, où la variabilité mécanique rend le sim-to-real particulièrement difficile. Le contexte est celui d'une course intense à l'autonomie post-démonstration. Physical Intelligence (Pi-0), Figure AI, Apptronik et d'autres misent massivement sur le fine-tuning en ligne pour réduire le gap démo-to-deployment. Q2RL s'inscrit dans cette dynamique mais en ciblant l'efficacité computationnelle : l'algorithme est conçu pour tourner sans infrastructure cloud lourde, directement sur le contrôleur embarqué. Le RAI Institute, relativement discret sur la scène robotique, positionne ici une contribution technique solide sur un verrou bien identifié. Le code et les vidéos sont disponibles publiquement, ce qui facilite la reproductibilité et l'éventuelle intégration dans des pipelines industriels existants.

IA physiquePaper
1 source
Évolution supervisée des capacités des agents incarnés : mise à niveau sûre, vérification de compatibilité et retour arrière en temps réel
4018arXiv cs.RO 

Évolution supervisée des capacités des agents incarnés : mise à niveau sûre, vérification de compatibilité et retour arrière en temps réel

Une équipe de chercheurs a formalisé dans un preprint arXiv (réf. 2604.08059) un cadre de mise à jour sécurisée pour les modules de capacités d'agents embarqués. Le problème est concret: lorsqu'un robot améliore ses capacités via des mises à jour de modules logiciels, comment garantir que ces déploiements ne violent pas les contraintes de sécurité, les hypothèses d'exécution ou les mécanismes de récupération? Le framework introduit quatre vérifications de compatibilité (interface, politique, comportementale, récupération) organisées en pipeline séquentiel: validation du candidat, évaluation sandbox, déploiement shadow, activation contrôlée, monitoring en ligne et rollback. Sur 6 cycles de mise à jour avec 15 graines aléatoires, une mise à jour naïve atteint 72,9% de succès sur les tâches mais génère 60% d'activations non sécurisées au dernier cycle; le framework gouverné maintient 67,4% de succès avec zéro activation non sécurisée sur l'ensemble des cycles (test de Wilcoxon, p=0,003). Le shadow deployment détecte 40% des régressions invisibles à la sandbox seule, et le rollback réussit dans 79,8% des scénarios de dérive post-activation. Pour les intégrateurs de systèmes robotiques et les décideurs B2B, ce résultat répond à une question stratégique: peut-on industrialiser la mise à jour continue d'un robot en production sans requalification complète du système? La démonstration montre que c'est faisable, la perte de performance étant limitée à 5,5 points de taux de succès en échange d'une garantie de sécurité absolue. La découverte clé porte sur le shadow deployment: 40% des régressions n'apparaissent pas en environnement sandbox, invalidant les workflows de qualification qui s'y arrêtent. Cela pose les bases d'un CI/CD robotique viable, à condition d'inclure une étape shadow en environnement réel. Les travaux antérieurs avaient étudié séparément le packaging modulaire, l'évolution des capacités et la gouvernance à l'exécution, sans les assembler en pipeline cohérent. Cette publication formalise la "governed capability evolution" comme problème de systèmes de premier ordre, directement pertinent pour les architectures à base de VLA (Vision-Language-Action models) qui évoluent rapidement sur des plateformes comme Figure 03, Optimus Gen 3 ou GR00T N2. L'article reste un travail de recherche évalué en simulation, sans déploiement commercial cité; les prochaines étapes attendues sont une validation sur plateformes physiques réelles et une intégration dans des pipelines MLOps robotiques.

RecherchePaper
1 source
De la saisie à l'insertion : assemblage de précision assisté par retour tactile sous tolérances inférieures au millimètre
4019arXiv cs.RO 

De la saisie à l'insertion : assemblage de précision assisté par retour tactile sous tolérances inférieures au millimètre

Une équipe de chercheurs a publié en mai 2026 sur arXiv (2605.04649) une méthode en deux étapes pour l'assemblage robotique sous tolérances sub-millimétriques, combinant apprentissage par imitation (IL) et apprentissage par renforcement (RL) augmentés par retour tactile. Le premier module IL apprend l'approche et la saisie du peg, tandis qu'un second module RL se charge de l'insertion proprement dite, incluant la récupération sur contact. Deux contributions techniques encadrent le système : le "tactile group sampling", qui augmente la couverture des segments de contact critiques en entraînement, et un "tactile critic" pour une meilleure évaluation des politiques. Testée sur cinq géométries de trous et trois niveaux de jeu, la méthode atteint un taux de réussite de 67 % sous le jeu le plus sévère (0,05 mm), tout en réduisant la force de contact maximale de 60 % et le couple de 44 % par rapport aux approches de référence. L'assemblage sous tolérances inférieures à 0,1 mm est l'un des goulots d'étranglement persistants de la robotique industrielle : une erreur de pose de quelques centièmes suffit à provoquer un coincement (jamming) ou la destruction d'une pièce à haute valeur. Que ce travail maintienne des forces basses tout en conservant un taux de succès substantiel répond directement aux critères des équipementiers électroniques, médicaux et de la mécanique fine. L'approche confirme surtout que les capteurs tactiles, longtemps relégués derrière la vision, peuvent combler le sim-to-real gap dans les tâches contact-riches, là où la caméra manque de résolution locale, un argument de poids pour les intégrateurs qui dimensionnent leurs cellules. Ce travail s'inscrit dans la lignée des recherches peg-in-hole initiées par les labos MIT et Stanford, mais l'accent sur la sécurité des forces le distingue des approches orientées performance brute. Sur le marché, les fabricants de bras collaboratifs (Universal Robots, FANUC, ABB) et les spécialistes du capteur tactile (Contactile, Xela Robotics, Touchlab) seront attentifs à la reproductibilité sur hardware réel. Le preprint reste au stade de la preuve de concept en laboratoire, sans pilote industriel annoncé ; les prolongements logiques incluent des géométries asymétriques, des matériaux déformables et une validation temps-réel embarquée pour tenir les cadences de production.

RecherchePaper
1 source
IA incarnée : un compromis nécessaire entre confidentialité et utilité
4020arXiv cs.RO 

IA incarnée : un compromis nécessaire entre confidentialité et utilité

Des chercheurs ont publié en mai 2026 sur arXiv (référence 2605.05017) un article de position soutenant que les systèmes d'IA incarnée (Embodied AI, EAI) entrent dans des environnements réels sensibles sans architecture conçue pour gérer la confidentialité de façon systémique. Le problème identifié est structurel : les solutions EAI actuelles optimisent leurs composantes isolément, en quatre étapes distinctes (instruction, perception, planification, interaction), sans prendre en compte leurs interactions en matière de vie privée dans des déploiements haute fréquence où les fuites de données sont souvent irréversibles. Les auteurs proposent SPINE (Secure Privacy Integration in Next-generation Embodied AI), un cadre unifié qui traite la confidentialité comme un signal de contrôle dynamique traversant l'ensemble du cycle de vie du système, et non comme une fonction locale à chaque étape. SPINE intègre une matrice de classification de sensibilité contextuelle multi-critères et a été conceptuellement validé par des études de cas préliminaires en simulation et en conditions réelles. L'enjeu central est architectural : en optimisant chaque étape indépendamment, les concepteurs créent une crise systémique de confidentialité dès le déploiement en environnement sensible. Un robot qui planifie ses déplacements, perçoit son environnement visuel et suit des instructions vocales génère un flux continu de données croisées : plans de logement, routines quotidiennes, visages, conversations. SPINE démontre que des correctifs locaux restent insuffisants face à ce couplage inter-étapes. Pour les intégrateurs et décideurs B2B en secteurs réglementés (santé à domicile, garde d'enfants, industrie), ce cadre propose une grille d'analyse systémique à intégrer en amont de tout déploiement, avant que les fuites ne deviennent impossibles à contenir. Ce travail s'inscrit dans un contexte de multiplication rapide des robots humanoïdes destinés à des environnements non industriels, avec des acteurs comme Figure, 1X Technologies et Boston Dynamics côté américain, et en Europe des entreprises comme Enchanted Tools ou Wandercraft qui positionnent leurs systèmes vers des espaces partagés. Le RGPD impose déjà des obligations strictes sur la collecte de données biométriques et comportementales, mais aucun standard sectoriel spécifique aux EAI n'existe encore. Les auteurs publient leur code sur GitHub (rminshen03/EAIPrivacy\Position) et formulent une invitation explicite à structurer un agenda de recherche autour de systèmes EAI sécurisés et fonctionnels, dont une prochaine étape naturelle serait l'intégration de SPINE dans des pipelines VLA (Vision-Language-Action) existants pour mesurer le coût réel en performance de ces contraintes de confidentialité.

RechercheOpinion
1 source
Modélisation neuronale d'ordre réduit avec simulation différentiable pour la perception tactile haute résolution
4021arXiv cs.RO 

Modélisation neuronale d'ordre réduit avec simulation différentiable pour la perception tactile haute résolution

Des chercheurs ont publié le 7 mai 2026 sur arXiv (arXiv:2605.05053) un framework de simulation tactile baptisé "reduced-order neural simulation", conçu pour modéliser la déformation haute résolution des élastomères utilisés dans les capteurs tactiles robotiques. Le système couple une dynamique MPM (Material Point Method) à grille grossière avec un décodeur neuronal implicite qui reconstruit les détails sub-particulaires à partir d'états latents compacts. Par rapport à TacIPC, la référence actuelle du domaine, le framework atteint une accélération de simulation supérieure à 65 % et une réduction de 40 % de l'empreinte mémoire, tout en améliorant la fidélité géométrique. En rendu tactile et en reconstruction de surface 3D, la précision progresse de 25 %, avec production d'images de profondeur réalistes et de maillages surfaciques cohérents physiquement. Ce résultat est significatif pour les équipes travaillant sur la manipulation dextre, un verrou reconnu de la robotique humanoïde et industrielle. Les capteurs tactiles à élastomère (de type GelSight ou DIGIT) génèrent des données de déformation complexes que les pipelines de sim-to-real peinent à exploiter en temps réel : le coût computationnel des méthodes éléments finis (FEM) ou des MPM classiques les rend incompatibles avec les boucles de contrôle rapides ou les phases d'entraînement par reinforcement learning. Un simulateur différentiable 65 % plus rapide et 40 % moins gourmand en mémoire ouvre concrètement la voie à l'intégration du retour tactile dans des politiques VLA (Vision-Language-Action) entraînées à grande échelle, hypothèse jusqu'ici limitée par les coûts de simulation. Le problème de la simulation tactile haute fidélité est actif depuis plusieurs années : TacICP, TacSim et les variantes FEM constituent le socle sur lequel ce travail se positionne. Dans le paysage compétitif, des laboratoires comme MIT CSAIL, CMU et Stanford travaillent sur des capteurs et simulateurs tactiles similaires, tandis que des startups comme Contactile ou Roboskin développent des solutions commerciales. Les auteurs ne mentionnent pas de partenariat industriel ni de déploiement prévu, et l'article reste à ce stade une contribution académique sans validation sur hardware réel annoncée. La prochaine étape naturelle serait une intégration dans un pipeline de manipulation fermée-boucle pour mesurer le gap sim-to-real résiduel.

IA physiquePaper
1 source
Apprentissage par renforcement contraint via découplage dynamique sphérique-radial
4022arXiv cs.RO 

Apprentissage par renforcement contraint via découplage dynamique sphérique-radial

Une équipe de chercheurs présente DD-SRad (Dynamic Decoupled Spherical Radial Squashing), une méthode d'apprentissage par renforcement contraint conçue pour respecter les limites de vitesse d'articulation lors du déploiement de politiques sur des robots physiques. Le problème cible est précis : chaque joint d'un robot a une vitesse maximale d'incrément par pas de contrôle, déterminée par l'inertie moteur, la bande passante électrique et la rigidité de transmission. Ces limites sont hétérogènes d'un joint à l'autre, formant une région admissible en forme de boîte rectangulaire dans l'espace des incréments d'action. Les benchmarks MuJoCo montrent que DD-SRad atteint le meilleur retour de tâche à zéro violation de contrainte, avec une couverture de l'espace admissible supérieure de 30 à 50 % aux méthodes de référence sphériques. Des simulations haute-fidélité dans IsaacLab valident l'approche sur les robots humanoïdes Unitree H1 et G1, en utilisant directement les spécifications officielles des joints comme paramètres d'entrée. L'apport technique central de DD-SRad est de remplacer un rayon global unique par un rayon adaptatif calculé indépendamment pour chaque actionneur, ce qui aligne précisément la contrainte imposée sur la vraie région admissible per-joint. Les méthodes existantes, projection par programme quadratique (QP) et paramétrisation sphérique, imposent une contrainte isotrope en forme de boule, qui sous-couvre exponentiellement l'espace réel à mesure que l'hétérogénéité des joints augmente. DD-SRad satisfait les contraintes dures par pas de contrôle avec probabilité 1, préserve des gradients bien conditionnés pendant l'entraînement, et ne requiert aucun solveur externe à l'exécution. Pour les intégrateurs industriels et les équipes de déploiement robotique, cela ouvre un chemin direct des fiches techniques hardware vers une politique sûre, sans étape de calibration manuelle des marges de sécurité. L'article s'inscrit dans un axe de recherche actif sur le sim-to-real pour les humanoïdes, dominé par les travaux autour des robots Unitree, Boston Dynamics Atlas, et des politiques apprises par imitation ou RL (IsaacLab, MuJoCo). Les approches concurrentes pour la gestion des contraintes d'actionneurs en RL incluent les méthodes de barrière logarithmique, les Lagrangiens augmentés, et les projections QP à chaud, chacune avec un surcoût computationnel à l'inférence que DD-SRad prétend éliminer. La validation reste pour l'instant en simulation ; aucun résultat de déploiement réel sur H1 ou G1 n'est reporté dans cette version arXiv, ce qui constitue la limite principale à surveiller avant toute généralisation industrielle.

RecherchePaper
1 source
Apprentissage par renforcement basé sur un modèle pour le contrôle robotique via optimisation en ligne
4023arXiv cs.RO 

Apprentissage par renforcement basé sur un modèle pour le contrôle robotique via optimisation en ligne

Des chercheurs ont publié sur arXiv (arXiv:2510.18518v2) un algorithme d'apprentissage par renforcement basé sur un modèle (MBRL) conçu pour contrôler des systèmes robotiques complexes directement dans le monde réel, sans passer par une phase de simulation intensive. L'approche construit un modèle de dynamique à partir des données d'interaction en temps réel, puis effectue des mises à jour de politique guidées par ce modèle appris. Les validations expérimentales ont été conduites sur deux plateformes distinctes : un bras d'excavatrice hydraulique et un bras robot souple. Dans les deux cas, l'algorithme atteint des performances comparables aux méthodes model-free en quelques heures d'entraînement, là où ces dernières réclament habituellement des millions d'interactions simulées. La robustesse de l'adaptation a également été évaluée sous conditions de charge utile (payload) aléatoire, avec des résultats stables malgré le changement de dynamique. L'enjeu principal est la réduction de ce que le secteur appelle le "sim-to-real gap" : l'écart entre les politiques apprises en simulation et leur comportement réel une fois déployées sur du matériel. Les pipelines dominants, adoptés aussi bien par des labos académiques que par des industriels comme Boston Dynamics ou Figure AI, reposent sur des millions de rollouts en simulation avant tout contact avec un robot physique, ce qui introduit un biais systématique difficile à corriger. Cet algorithme court-circuite cette étape en apprenant directement sur données réelles, avec une garantie formelle de progression : les auteurs démontrent des bornes de regret sous-linéaires (sublinear regret bounds) sous hypothèses d'optimisation stochastique en ligne, ce qui est rare dans la littérature MBRL appliquée à la robotique physique. Pour un intégrateur ou un industriel, cela se traduit par une réduction potentielle du temps de mise en service sur des tâches à dynamique variable (variation de charge, usure mécanique, changement de matériau). Ce travail s'inscrit dans un débat structurant du champ : model-based vs model-free RL pour la robotique physique. Les méthodes model-free comme PPO ou SAC dominent les benchmarks simulés mais peinent à s'adapter efficacement en production réelle. Des approches hybrides comme MBPO ou DreamerV3 ont tenté de combler cet écart, mais rarement validées sur des systèmes aussi hétérogènes qu'un bras hydraulique industriel et un manipulateur souple. La prochaine étape naturelle serait une validation sur des plateformes humanoïdes ou des AMR (autonomous mobile robots) à haute dimension, où les enjeux de sample efficiency sont directement liés aux coûts d'exploitation et à la durée de vie des actionneurs.

RecherchePaper
1 source
KGLAMP : un modèle de langage guidé par graphe de connaissances pour la planification multi-robot adaptative
4024arXiv cs.RO 

KGLAMP : un modèle de langage guidé par graphe de connaissances pour la planification multi-robot adaptative

Des chercheurs ont publié KGLAMP (Knowledge Graph-guided Language Model for Adaptive Multi-robot Planning and Replanning), un framework de planification combinant graphes de connaissances et grands modèles de langage pour coordonner des équipes de robots hétérogènes sur des missions longues. La contribution centrale est une architecture en deux couches : un graphe de connaissances structuré encode en temps réel les relations entre objets, la portée spatiale de chaque robot et leurs capacités spécifiques, tandis qu'un LLM s'appuie sur ce graphe pour générer automatiquement des spécifications PDDL (Planning Domain Definition Language) correctes. Quand l'environnement évolue, un obstacle déplacé, un robot en panne, le graphe détecte l'incohérence et déclenche un replanification automatique. Sur le benchmark MAT-THOR (un environnement simulé de type habitat domestique conçu pour tester la coordination multi-agents), KGLAMP surpasse de 25,3 % au minimum les deux approches de référence : planificateurs PDDL classiques seuls et LLM seuls. Ce résultat est significatif parce qu'il attaque un problème structurel bien documenté dans la littérature : les planificateurs symboliques PDDL exigent des modèles du monde construits manuellement, coûteux à maintenir dans des environnements dynamiques, tandis que les LLM utilisés seuls tendent à ignorer l'hétérogénéité des agents et à produire des plans invalides face à l'incertitude. KGLAMP propose une mémoire persistante et mise à jour dynamiquement qui sert d'interface entre perception et raisonnement symbolique. Pour un intégrateur déployant des flottes mixtes (AMR, bras manipulateurs, drones), la promesse d'un replanning automatique sans re-modélisation manuelle représente un gain opérationnel concret, notamment dans les entrepôts à géométrie variable ou la logistique hospitalière. L'article s'inscrit dans la tendance des approches dites "neuro-symboliques" qui tentent de corriger les faiblesses des LLM par des représentations explicites du monde. Les travaux concurrents incluent SayPlan (Rana et al., 2023) et les variantes LLM+PDDL de Meta AI, Google DeepMind ou CMU. Il reste à noter que les expériences sont conduites exclusivement en simulation sur MAT-THOR : aucune validation physique n'est rapportée, ce qui laisse ouverte la question du sim-to-real gap pour des flottes réelles. La prochaine étape naturelle serait un déploiement sur des plateformes matérielles hétérogènes pour mesurer la robustesse du graphe de connaissances face au bruit sensoriel du monde réel.

RecherchePaper
1 source
AnyPos : des actions automatisées indépendantes de la tâche pour la manipulation bimanuele
4025arXiv cs.RO 

AnyPos : des actions automatisées indépendantes de la tâche pour la manipulation bimanuele

Une équipe de chercheurs a publié sur arXiv (référence 2507.12768) AnyPos, un pipeline d'apprentissage automatisé conçu pour la manipulation bimane généraliste. Le système repose sur un principe de modélisation dite "task-agnostic" : au lieu d'entraîner le robot sur des trajectoires liées à des tâches précises, AnyPos génère à grande échelle des paires image-action indépendantes couvrant l'ensemble de l'espace de travail atteignable. Ces données alimentent un apprentissage par dynamique inverse, combinant un décodeur directionnel et une séparation explicite entre les mouvements du bras et de l'effecteur terminal, pour stabiliser les prédictions en dehors de la distribution d'entraînement. Testée sur cinq tâches domestiques (actionner un micro-ondes, griller du pain, plier des vêtements, arroser des plantes, frotter des assiettes), l'approche améliore les taux de réussite de 30 à 40% par rapport aux baselines de référence, avec un gain de 51% en précision sur les évaluations test. Ce résultat pointe un problème structurel du secteur : la rareté des données de manipulation robotique et leur entanglement avec une plateforme ou une tâche spécifique. La plupart des politiques visuomotrices actuelles, qu'il s'agisse de VLA (vision-language-action models) ou de diffusion policies, nécessitent des données séquentielles coûteuses à collecter et quasiment non transférables entre robots. En découplant la modélisation de l'embodiment de l'apprentissage de politique de haut niveau, AnyPos propose une réutilisation des données d'action cross-tâches et cross-plateformes, sans modèle physique explicite ni simulation intensive. L'argument est directement dirigé contre le "sim-to-real gap" : les représentations sont ici apprises depuis des données réelles générées automatiquement à grande échelle, contournant les biais de simulation. L'approche rejoint une tendance récente consistant à séparer embodiment modeling et politique de haut niveau, visible chez Physical Intelligence (modèle pi0), Figure AI ou 1X Technologies. Elle se distingue par son refus de la télé-opération intensive ou de la simulation massive, préférant une exploration automatisée du workspace réel. Le pipeline est conçu pour se coupler à des modèles de politique existants, le positionnant potentiellement comme une couche de préentraînement réutilisable et échangeable. L'article ne mentionne ni déploiement industriel, ni partenariat commercial : AnyPos reste à ce stade une contribution de recherche académique, sans timeline de mise en production annoncée.

RechercheOpinion
1 source
Impression 3D de robots auto-pliants à actionnement passif avec modules fonctionnels intégrés
4026arXiv cs.RO 

Impression 3D de robots auto-pliants à actionnement passif avec modules fonctionnels intégrés

Des chercheurs ont soumis sur arXiv (référence 2605.04757, mai 2025) une méthode de fabrication de robots auto-pliants à partir de développés plats imprimés en 3D dans un PLA conducteur. Le principe repose sur des élastiques acheminés à travers des crochets intégrés: en libérant leur énergie mécanique, ils replient la feuille en géométries tridimensionnelles préprogrammées, sans aucun stimulus externe (ni chaleur, ni lumière, ni humidité). L'état plat avant déploiement autorise le positionnement précis de l'électronique et des aimants. Le même substrat sert d'électrode pour la détection tactile capacitive et supporte une palette I/O réutilisable équipée de capteurs Hall et de moteurs ERM (masses excentriques rotatives), assurant la détection d'ancrage et l'actionnement par vibration. L'équipe publie également un modèle analytique fermé qui équilibre rigidité des charnières et moment des élastiques pour prédire les angles de pliage à l'équilibre; validé expérimentalement, ce modèle produit une carte de conception reliant épaisseur de charnière, taille des élastiques et espacement des crochets aux angles cibles. Trois démonstrateurs ont été réalisés: un cube polyédrique illustrant le potentiel pour des collectifs modulaires, un préhenseur déployable, et un doigt à tendons. La fabrication par origami robotique dépendait jusqu'ici de stimuli exogènes: polymères à mémoire de forme activés thermiquement, hydrogels hygroscopiques, ou bilames sous UV. L'approche élastique s'affranchit de ces contraintes en utilisant uniquement du PLA conducteur standard, simplifiant l'industrialisation et réduisant les coûts. Le modèle analytique constitue un apport concret: il transforme la conception de structures pliables d'un processus empirique en démarche prédictive, limitant les itérations de prototypage. La convergence "substrat = électrode = structure mécanique" réduit par ailleurs le nombre de composants discrets, un avantage direct pour les intégrateurs de systèmes modulaires ou de robots à bas coût. Ce travail s'inscrit dans le courant actif de la robotique origami, porté notamment par le Wyss Institute de Harvard et le CSAIL du MIT. La singularité de l'approche tient à l'énergie élastique passive sur PLA conducteur, distincte des voies pneumatiques ou magnétiques couramment explorées. Il s'agit d'un preprint académique sans produit commercialisé ni déploiement annoncé: les trois démonstrateurs restent des preuves de concept. Les prochaines étapes naturelles porteraient sur la durabilité mécanique sur cycles répétés et la mise à l'échelle des collectifs modulaires. En Europe, des acteurs comme Enchanted Tools ou des laboratoires tels que le LIRMM pourraient trouver dans cette méthode de fabrication un levier pertinent pour réduire les coûts de prototypage.

RecherchePaper
1 source
Filtre de sécurité CBF à double barrière en forme fermée pour robots holonomes sur cartes d'occupation incrémentales
4027arXiv cs.RO 

Filtre de sécurité CBF à double barrière en forme fermée pour robots holonomes sur cartes d'occupation incrémentales

Une équipe de chercheurs a publié en mai 2026 (arXiv:2505.05182) un filtre de sécurité temps réel pour robots holonomes opérant dans des environnements inconnus explorés de manière incrémentale. L'approche repose sur une double barrière CBF (Control Barrier Function) : la première contrainte impose l'évitement des obstacles déjà cartographiés ; la seconde interdit l'entrée dans les zones non encore explorées, qui constituent une source de risque de collision irréductible dès lors que le robot opère avec des capteurs orientés vers l'avant. Les deux contraintes sont dérivées analytiquement depuis le champ de distances signées de la grille d'occupation, aboutissant à une solution en forme fermée qui ne nécessite qu'une résolution de petit système linéaire par cycle de contrôle. Validée sur quadrotor équipé d'un contrôleur PX4 lors de plusieurs vols en intérieur, l'approche produit zéro collision sur l'ensemble des essais matériels publiés. L'enjeu principal est computationnel : sur des plateformes embarquées à ressources limitées comme le Raspberry Pi, où SLAM et planification de trajectoire mobilisent déjà l'essentiel du calcul disponible, la faible empreinte du filtre préserve ces ressources tout en garantissant la sécurité active. Un schéma de gain adaptatif ajuste dynamiquement la contrainte de frontière, l'assouplissant dans les zones riches en information et la resserrant dans les zones bien cartographiées, ce qui améliore l'efficacité d'exploration sans relâcher les garanties formelles. Opérant en espace des vitesses comme une correction minimalement invasive, le filtre se compose avec n'importe quel contrôleur nominal, y compris les méthodes d'apprentissage (VLA, réseaux de neurones), ce qui élargit significativement le périmètre d'application industrielle. Les CBF constituent un outil établi en théorie du contrôle, mais leur application aux environnements construits dynamiquement via grilles d'occupation restait un défi ouvert en raison du coût habituel des solveurs d'optimisation. Les approches concurrentes, champs de potentiel, MPC contraint, planificateurs réactifs, imposent généralement des hypothèses plus fortes sur la géométrie connue. Cette formulation en forme fermée se positionne comme une alternative légère et généraliste, particulièrement pertinente pour les drones d'inspection autonome, les robots de cartographie indoor et les plateformes mobiles à bord réduit. L'extension aux environnements 3D complexes et aux configurations multi-robots constituerait une prochaine étape logique.

RecherchePaper
1 source
Détection de contact active pour un transfert d'objet robuste de robot à humain
4028arXiv cs.RO 

Détection de contact active pour un transfert d'objet robuste de robot à humain

Une équipe de chercheurs propose une méthode de détection de contact active pour fiabiliser les transferts d'objets de robot à humain, publiée en prépublication sur arXiv (2605.04610, mai 2026). Au lieu d'attendre passivement un signal de saisie, le robot génère des micro-mouvements exploratoires et mesure les forces appliquées en retour par l'humain : une saisie ferme produit des forces dans plusieurs directions, un contact accidentel non. Le système repose sur un modèle bayésien linéaire par morceaux qui estime la probabilité de chaque état de contact à partir de ces réponses en force. Testé avec 12 participants sur 30 objets rigides variés, il atteint un taux de succès de 97,5 %, soit plus de 30 points au-dessus des deux approches passives utilisées comme référence. Les applications visées vont du robot d'assistance à domicile (servir un verre) au bloc opératoire (passer un instrument chirurgical). Ce résultat est significatif car la généralisation inter-objets est précisément le point dur des approches passives (tactile, force/couple) : elles peinent à distinguer saisie ferme et contact fortuit face à la diversité des formes, des masses et des comportements humains. L'active sensing force une perturbation contrôlée qui rend les états ambigus séparables. Pour les intégrateurs et les décideurs industriels, l'enjeu est directement lié à la sécurité : dans un environnement collaboratif ou chirurgical, un relâchement prématuré peut causer un incident grave. Un taux de 97,5 % commence à entrer dans la plage exploitable pour des assistants robotiques en conditions réelles, même si le périmètre du test reste limité (objets rigides, 12 sujets, conditions de laboratoire). La question du handover robot-humain est active en recherche depuis plusieurs années, portée notamment par les domaines de l'assistance à la personne et de la chirurgie robotique. Ce papier est une prépublication non encore évaluée par les pairs, et l'abstract ne mentionne ni institution ni partenaire industriel, ce qui rend difficile l'évaluation de sa trajectoire vers un déploiement réel. Aucune intégration commerciale n'est annoncée. Les suites logiques incluent des tests sur objets déformables ou non rigides, une validation en conditions cliniques contrôlées, et une intégration dans des plateformes à retour d'effort comme les cobots ou les mains de robots humanoïdes qui commencent à offrir les interfaces mécaniques nécessaires à ce type de dialogue haptique.

RecherchePaper
1 source
SlotVLA : vers la modélisation des représentations objet-relation pour la manipulation robotique
4029arXiv cs.RO 

SlotVLA : vers la modélisation des représentations objet-relation pour la manipulation robotique

Des chercheurs présentent dans un preprint arXiv (2511.06754v3, troisième révision, mai 2026) SlotVLA, un framework de manipulation robotique multitatches qui repose sur des représentations centrées sur les objets et leurs relations plutôt que sur les plongements denses utilisés par la majorité des modèles VLA actuels. L'architecture combine trois composants : un tokeniseur visuel à slots qui maintient des représentations temporellement cohérentes pour chaque objet détecté dans la scène, un décodeur centré sur les relations entre objets pour produire des embeddings pertinents à la tâche, et un module LLM qui traduit ces embeddings en séquences d'actions exécutables. En parallèle, les auteurs publient LIBERO+, un benchmark de manipulation dérivé du jeu de données LIBERO existant, enrichi d'annotations objet-centriques au niveau des boîtes englobantes et des masques de segmentation, ainsi qu'un suivi temporel des instances entre frames. Les expériences conduites sur LIBERO+ montrent que les représentations à slots réduisent significativement le nombre de tokens visuels nécessaires tout en conservant des performances de généralisation comparables aux baselines denses. L'intérêt principal de cette approche réside dans la tension qu'elle adresse directement : les VLAs déployés à ce jour (Pi-0 de Physical Intelligence, GR00T N2 de NVIDIA, Helix de Figure) s'appuient sur des encodeurs visuels qui traitent la scène comme un champ dense, sans distinction explicite entre objets manipulables et arrière-plan. Cette architecture entraîne une redondance computationnelle et rend difficile l'audit du raisonnement du modèle, ce qui freine l'adoption industrielle dans des contextes certifiables. SlotVLA propose que des représentations structurées, inspirées de la cognition humaine sur les objets discrets, puissent constituer une base plus efficace et interprétable pour le contrôle visuomoteur. La réduction du nombre de tokens visuels est un levier concret de coût d'inférence pour des systèmes embarqués ou des flottes de robots. Il convient toutefois de noter que les résultats présentés restent confinés à l'environnement simulé LIBERO+ : aucune validation physique sur robot réel n'est rapportée dans ce preprint, ce qui laisse ouverte la question du sim-to-real gap pour ce type de représentation. Cette publication s'inscrit dans un courant actif de recherche sur les architectures objet-centriques pour la robotique, dont les travaux fondateurs incluent les modèles de slot attention de Locatello et al. (2020) et les approches OCRL. LIBERO avait déjà été introduit comme benchmark multitatches pour la manipulation, mais sans annotations objet-centriques fines : LIBERO+ vient combler ce manque pour faciliter l'évaluation comparative de ce type de représentation. Sur le plan concurrentiel, les laboratoires académiques (notamment ceux liés à CMU, Berkeley, Stanford) et industriels travaillent en parallèle sur des architectures plus interprétables pour répondre aux demandes croissantes de traçabilité dans l'automatisation industrielle. Les prochaines étapes naturelles seront la validation sim-to-real sur des plateformes physiques standard (Franka, UR, ou humanoïdes) et l'intégration dans des pipelines de fine-tuning avec des modèles fondateurs publics.

IA physiqueOpinion
1 source
Calibration optimale tenant compte de l'incertitude pour le problème AX=YB
4030arXiv cs.RO 

Calibration optimale tenant compte de l'incertitude pour le problème AX=YB

Une équipe de chercheurs a publié le 7 mai 2026 sur arXiv (identifiant 2605.04809) une méthode d'optimisation pour la calibration main-oeil, problème dit AX=YB, qui consiste à déterminer la transformation géométrique rigide entre un capteur (caméra ou lidar) et l'effecteur d'un robot. L'algorithme proposé est itératif, formulé en algèbre de Lie, et respecte strictement les contraintes structurelles du groupe SE(3) tout en synchronisant les mises à jour des paramètres de calibration. Plutôt que de modéliser explicitement l'incertitude des données, approche jugée trop difficile à généraliser, les auteurs introduisent une métrique d'incertitude relative entre sources de mesure, utilisée pour pondérer dynamiquement chaque observation pendant l'optimisation. Sur jeux de données synthétiques à forte incertitude, la méthode améliore la précision d'estimation d'au moins 67 % par rapport aux approches existantes, selon des simulations numériques et des expériences réelles présentées dans l'article. L'enjeu industriel est concret : la calibration main-oeil conditionne toute application robotique guidée par vision, qu'il s'agisse de soudure, d'assemblage, de palettisation ou de contrôle qualité. Dans les scénarios à grande plage de travail ou en surcharge mécanique, typiques des robots 6-DOF à payload supérieur à 50 kg, les données de calibration sont contaminées par des incertitudes difficiles à quantifier : flexions structurelles, jeux mécaniques, dérive thermique. Les méthodes classiques comme Tsai-Lenz ou Shah traitent ces perturbations de façon uniforme, sans pondération adaptative. L'approche proposée ajuste au contraire l'influence de chaque paire de mesures pendant l'optimisation, ce qui peut réduire les temps de recalibration en production et améliorer la répétabilité sur cellules robotisées existantes sans changer de matériel. Le problème AX=YB est étudié en robotique depuis les travaux fondateurs de Shiu et Ahmad (1987) et Tsai et Lenz (1989). Les approches concurrentes exploitent les quaternions duaux (Daniilidis, 1999), les décompositions de Kronecker, ou plus récemment l'apprentissage automatique avec données visuelles denses. L'article positionne son apport principal sur deux points de friction récurrents dans les déploiements réels : la qualité de l'initialisation et la robustesse aux incertitudes non modélisées. Aucun code source ni partenaire industriel ne sont mentionnés dans le préprint disponible. Une intégration dans des frameworks de calibration open-source comme Kalibr ou easy_handeye constituerait la prochaine étape naturelle vers une adoption pratique.

RecherchePaper
1 source
Apprentissage par renforcement modulaire pour essaims coopératifs
4031arXiv cs.RO 

Apprentissage par renforcement modulaire pour essaims coopératifs

Une équipe de chercheurs propose, dans un preprint déposé sur arXiv le 7 mai 2026 (arXiv:2605.04939), une méthode d'apprentissage par renforcement modulaire pour les essaims de robots coopératifs. Le problème ciblé est précis : dans un essaim, chaque robot dispose d'une capacité de calcul et de mémoire limitée, n'observe qu'un sous-ensemble restreint de ses voisins, et n'a aucune visibilité sur l'effet de ses actions sur l'utilité collective. Les approches standard de MARL distribué (Multi-Agent Reinforcement Learning) apprennent à chaque agent à coordonner ses actions avec le groupe, mais elles imposent de représenter un espace d'états d'interaction potentiellement combinatoire, ce qui dépasse rapidement les contraintes mémoire de robots à faible puissance. La solution proposée est une représentation décomposée : chaque dimension de l'état spatial est traitée par un module d'apprentissage indépendant, et les résultats sont ensuite agrégés pour guider la politique. Les auteurs valident l'approche sur des simulations de tâches de collecte (foraging), un benchmark classique en robotique en essaim. L'intérêt industriel est direct pour toute architecture multi-robots à budget matériel contraint. La croissance combinatoire de l'espace d'états est un goulot d'étranglement bien documenté qui freine le passage à l'échelle des essaims : augmenter la taille du groupe multiplie le problème. En décomposant la représentation, l'approche modulaire pourrait permettre de déployer des politiques coopératives sur des robots bon marché sans recourir à une unité centrale de coordination. C'est une direction complémentaire aux approches centralisées lors de l'entraînement et décentralisées à l'exécution (CTDE), qui restent lourdes en entraînement. À noter cependant que les résultats présentés reposent uniquement sur des simulations, sans validation sur hardware réel, ce qui laisse ouverte la question du sim-to-real gap. La robotique en essaim est un domaine actif depuis les travaux de Marco Dorigo sur les fourmis artificielles dans les années 1990. Les avancées récentes en MARL, notamment QMIX et MADDPG, ont montré que la coordination émergente est accessible sans communication explicite, mais au prix d'une complexité croissante de représentation. Sur le terrain, des acteurs comme Bitcraze (drones Crazyflie), Exotec (essaims AMR pour entrepôts logistiques), ou encore des labos européens sur les micro-robots explorent des architectures contraintes similaires. La prochaine étape naturelle pour ce travail serait une validation sur plateforme physique et une comparaison quantitative avec les baselines CTDE standard.

RecherchePaper
1 source
Bon modèle au bon moment : commande prédictive en cascade de fidélité pour la marche bipède en temps réel
4032arXiv cs.RO 

Bon modèle au bon moment : commande prédictive en cascade de fidélité pour la marche bipède en temps réel

Des chercheurs ont soumis sur arXiv le 6 mai 2026 (arXiv:2605.04607) une méthode de contrôle prédictif multi-phase pour la marche bipède, validée en simulation MuJoCo sur HyPer-2, un robot bipède à 18 degrés de liberté. L'approche, dite "cascaded-fidelity MPC", divise l'horizon de prédiction en deux zones : les pas de temps proches s'appuient sur un modèle complet du corps entier (whole-body model), tandis que l'horizon lointain utilise un modèle simplifié à corps rigide unique (SRB). Le problème de commande optimale non linéaire résultant est résolu par programmation quadratique séquentielle (SQP) via le framework acados. Le contrôleur calcule directement des couples articulaires à partir d'un calendrier de contacts et d'une vitesse cible, sans exiger d'emplacements de pas prédéfinis. Il s'agit d'un preprint de recherche ; aucun transfert sur matériel physique n'est encore rapporté. L'enjeu est d'ordre computationnel : un MPC whole-body complet offre une haute précision dynamique mais reste prohibitif pour un contrôle embarqué temps réel, tandis que les méthodes simplifiées (LIPM, SRBD seul) dégradent la qualité de prédiction. Concentrer la fidélité du modèle sur l'horizon proche, là où elle impacte réellement la commande, est un compromis prometteur. L'absence de dépendance aux pas présélectionnés renforce également la robustesse potentielle en environnement non structuré. Ce travail s'inscrit dans une compétition académique dense autour du MPC pour la locomotion humanoïde. Des équipes comme ETH Zurich avec le framework OCS2, Carnegie Mellon ou des laboratoires européens explorent des hiérarchisations de modèles analogues. HyPer-2 semble être une plateforme de recherche universitaire non commercialisée. Les prochaines étapes attendues sont le transfert sim-to-real sur matériel physique et la validation sur terrain irrégulier.

RecherchePaper
1 source
Vers un contrôle adaptatif des robots humanoïdes par distillation multi-comportements et affinage renforcé
4033arXiv cs.RO 

Vers un contrôle adaptatif des robots humanoïdes par distillation multi-comportements et affinage renforcé

Une équipe de chercheurs propose Adaptive Humanoid Control (AHC), un framework de contrôle locomoteur pour humanoïdes publié sur arXiv (2511.06371v3). Le problème de départ est structurel : les méthodes dominantes entraînent une politique séparée pour chaque compétence (se relever, marcher, courir, sauter), générant des contrôleurs rigides qui échouent dès que le terrain devient irrégulier. AHC y répond en deux phases : d'abord, plusieurs politiques primaires sont entraînées puis fusionnées par distillation multi-comportements en un contrôleur unique capable de commuter dynamiquement selon le contexte ; ensuite, un affinage par renforcement avec retours en ligne consolide l'adaptabilité sur terrains variés. Le système est validé en simulation et en conditions réelles sur le robot Unitree G1 d'Unitree Robotics. Pour les intégrateurs et les décideurs industriels, la promesse est concrète : un seul contrôleur couvrant l'ensemble des comportements locomoteurs réduit la complexité opérationnelle et supprime les transitions manuelles entre modes. Du côté de la recherche, le résultat le plus notable est que la distillation combinée à un fine-tuning par RL en ligne permet de réduire partiellement le sim-to-real gap sans ré-entraînement complet. La réserve à formuler : le papier ne publie pas de métriques quantitatives détaillées (taux de succès par terrain, fréquence de chute), ce qui rend difficile la comparaison objective avec d'autres approches. Le Unitree G1 (1,27 m, environ 35 kg, 16 000 dollars) est devenu depuis 2024 une plateforme de recherche de référence pour ce type de travaux. AHC s'inscrit dans une compétition internationale où Physical Intelligence (Pi-0), NVIDIA (GR00T N2), Figure (Helix) et Boston Dynamics cherchent tous à produire des politiques locomotrices généralisables hors environnement contrôlé. L'approche par distillation multi-politiques rappelle les travaux de curriculum learning menés à Berkeley et CMU, et l'affinage par RL en ligne emprunte aux méthodologies RLHF adaptées à la robotique physique. Aucun partenariat industriel ni calendrier de déploiement n'est annoncé ; le projet en est au stade de la démonstration académique.

RecherchePaper
1 source
Génie logiciel pour la robotique auto-adaptative : un programme de recherche
4034arXiv cs.RO 

Génie logiciel pour la robotique auto-adaptative : un programme de recherche

Une équipe de chercheurs a soumis sur arXiv (réf. 2505.19629, troisième version) un agenda de recherche structuré pour le génie logiciel appliqué aux systèmes robotiques auto-adaptatifs. Contrairement aux robots industriels classiques dont le comportement est entièrement prédéfini au moment du déploiement, les systèmes auto-adaptatifs sont conçus pour modifier leur propre logique en cours d'exécution, en réponse à des environnements dynamiques et incertains. L'article organise cet agenda autour de deux axes : d'une part, le cycle de vie logiciel complet (spécification des exigences, conception, développement, test, opérations), adapté aux contraintes de l'auto-adaptation ; d'autre part, les technologies habilitantes telles que les jumeaux numériques (digital twins) et les mécanismes d'adaptation pilotés par l'IA, qui assurent la surveillance en temps réel, la détection de pannes et la prise de décision automatisée. L'enjeu central identifié par les auteurs est la vérifiabilité des comportements adaptatifs sous incertitude, un problème ouvert qui conditionne directement l'adoption industrielle. Les robots capables d'apprendre et de se reconfigurer en production posent en effet des questions radicalement différentes de celles que traitent les standards de sécurité fonctionnelle classiques comme l'IEC 61508 ou l'ISO 26262. L'article cible notamment la difficulté à équilibrer trois contraintes contradictoires : adaptabilité, performance et sécurité. Il propose d'intégrer des frameworks formels comme MAPE-K (Monitor, Analyze, Plan, Execute, Knowledge), boucle de contrôle réflexif issue de l'autonomic computing d'IBM, et sa variante étendue MAPLE-K, comme socles architecturaux unifiants pour l'ingénierie de ces systèmes. Ce travail s'inscrit dans une dynamique académique qui s'accélère depuis l'émergence des VLA (Vision-Language-Action models) et des approches sim-to-real à grande échelle. Des communautés concurrentes, notamment autour de ROS 2 Lifecycle, des architectures behavior trees, et du model-driven engineering for robotics (MDE4R), explorent des directions parallèles. Les auteurs formalisent une feuille de route vers 2030, visant des systèmes robotiques dits trustworthy, capables d'opérer sans supervision humaine continue dans des environnements industriels réels. Il convient de situer ce papier pour ce qu'il est : un agenda de recherche, pas un produit livré ni un déploiement annoncé. Il cartographie les problèmes à résoudre, pas les solutions disponibles.

RecherchePaper
1 source
Emballage dans des contenants partiellement remplis par contact
4035arXiv cs.RO 

Emballage dans des contenants partiellement remplis par contact

Une équipe de chercheurs publie sur arXiv (référence 2602.12095, version 3, première soumission en février 2026) une approche de bin-packing robotique capable de placer des objets dans des conteneurs déjà partiellement remplis, contrairement aux méthodes existantes qui supposent des conteneurs vides. L'algorithme repose sur trois composants couplés: un optimiseur de trajectoire multi-objets basé sur les contacts, intégré dans un contrôleur prédictif (MPC); un système de perception physiquement informé qui estime les poses des objets même en présence d'occlusions inévitables; et un module de suggestion de positions d'empilement physiquement réalisables. La contribution centrale est l'exploitation délibérée des interactions de contact avec les objets déjà en place pour créer de l'espace libre et permettre l'insertion de nouveaux items, sans recourir à la stratégie collision-free qui prévaut dans la littérature. Dans les entrepôts réels, les bacs ne sont presque jamais vides: ils circulent entre zones de tri, postes de préparation et quais d'expédition, accumulant des configurations sous-optimales au fil des déplacements. Les approches sans contact dominantes échouent ou produisent des taux de remplissage médiocres face à ces conditions, creusant un écart persistant entre la recherche en laboratoire et les contraintes opérationnelles. Ce travail propose un changement de paradigme: traiter les contacts comme un levier d'organisation spatiale plutôt que comme un obstacle à éviter. Pour un intégrateur ou un opérateur logistique, l'impact potentiel est direct: densité de remplissage accrue, moins de passages en reprise manuelle, réduction des coûts de transport et de surface de stockage. L'absence de métriques quantitatives dans l'abstract (taux de succès, temps de cycle, payload) empêche toutefois d'évaluer les performances réelles à ce stade. Le bin-packing robotique reste un problème ouvert malgré les investissements d'Amazon Robotics, Ocado et Covariant, et la montée de spécialistes comme Nimble Robotics. Côté européen, Exotec (AMR de stockage, Lille) et Enchanted Tools évoluent dans des espaces adjacents sans cibler encore ce niveau de manipulation dense en conteneur partiellement rempli. Ce travail est un preprint en version 3, sans déploiement ni partenariat industriel annoncé: il s'agit d'une contribution académique, pas d'un produit expédié. Si les performances se confirment hors laboratoire, cette approche orientée contact pourrait s'intégrer à la prochaine génération de cellules de picking-packing autonomes, où la robustesse face au désordre constitue le vrai différenciateur commercial.

RecherchePaper
1 source
Du langage à la logique : une architecture théorique pour la navigation sécurisée fondée sur les modèles VLM
4036arXiv cs.RO 

Du langage à la logique : une architecture théorique pour la navigation sécurisée fondée sur les modèles VLM

Des chercheurs ont publié en mai 2026 sur arXiv (arXiv:2605.04327) une architecture théorique visant à intégrer des règles de sécurité en langage naturel dans la navigation autonome de robots opérant en environnements extérieurs non structurés. Le principe central consiste à convertir des consignes humaines informelles en spécifications formelles de Signal Temporal Logic (STL), un formalisme mathématique permettant d'exprimer des contraintes temporelles sur le comportement d'un système. Les règles persistantes liées au terrain sont encodées dans une carte de coûts 2D, tandis que les exigences dynamiques sont surveillées en temps réel sous forme de moniteurs STL. Pour l'interprétation sémantique de la scène, les auteurs proposent l'usage de Vision-Language Models (VLMs) en mode zero-shot, c'est-à-dire sans phase d'entraînement spécifique à l'environnement opérationnel. L'intérêt de cette approche réside dans la tentative de combler deux fossés bien connus du secteur : d'une part, le gouffre entre les instructions opérateur en langage naturel et les contraintes exploitables par un planificateur formel ; d'autre part, le manque de garanties vérifiables dans les systèmes de navigation basés sur l'apprentissage. Pour les intégrateurs et les décideurs B2B actifs dans l'agriculture de précision, la construction ou la logistique extérieure, la promesse est claire : pouvoir exprimer des règles de sécurité terrain sans écrire de code ni annoter de données. Il convient cependant de noter que l'article reste entièrement théorique, les auteurs utilisant eux-mêmes le terme "hypothesize" pour qualifier l'usage des VLMs, sans présenter de résultats expérimentaux ni de validation sur robot réel. Cette publication s'inscrit dans une dynamique plus large où les VLMs sont progressivement intégrés dans des pipelines robotiques complets, comme en témoignent les travaux récents de Physical Intelligence avec Pi-0, ou de NVIDIA avec GR00T N2. L'utilisation de STL pour la navigation n'est pas nouvelle, le formalisme ayant fait ses preuves en conduite autonome et drones, mais son couplage avec des VLMs pour le grounding sémantique constitue une direction de recherche active. Plusieurs groupes, notamment en Europe (dont des équipes liées aux projets de l'ANR et d'Horizon Europe sur la navigation sûre), explorent des pistes similaires. Les prochaines étapes logiques seraient une implémentation sur simulateur puis une validation terrain, étapes absentes de ce premier article d'architecture.

RecherchePaper
1 source
Politiques de diffusion multi-agents extensibles pour le contrôle de couverture
4037arXiv cs.RO 

Politiques de diffusion multi-agents extensibles pour le contrôle de couverture

Des chercheurs ont publié sur arXiv (identifiant 2509.17244) MADP (Multi-Agent Diffusion Policy), une approche basée sur les modèles de diffusion pour la coordination décentralisée de nuées de robots. Le principe : chaque robot génère ses actions en échantillonnant depuis une distribution jointe haute dimension, en conditionnant sa politique sur une représentation fusionnée de ses propres observations et des embeddings perceptuels reçus de ses pairs via communication locale. L'équipe évalue MADP sur le problème de couverture de terrain (coverage control), un benchmark canonique en robotique multi-agent où un groupe de robots holonomes doit couvrir efficacement un espace selon des fonctions de densité d'importance variables. La politique est entraînée par imitation learning à partir d'un expert omniscient (dit "clairvoyant"), et le processus de diffusion est paramétré par une architecture de transformer spatial permettant l'inférence décentralisée, sans coordinateur central. Les résultats présentés sont exclusivement issus de simulations. L'intérêt technique principal tient à la nature des modèles de diffusion : contrairement aux politiques classiques qui produisent une action déterministe ou une distribution gaussienne unimodale, MADP peut capturer les interdépendances entre les actions de plusieurs agents dans une distribution multi-modale complexe. Les expériences montrent que le modèle généralise à travers des densités d'agents variables et des environnements non vus à l'entraînement, surpassant les baselines état de l'art. Pour un intégrateur ou un décideur industriel, cela signifie en théorie des essaims plus robustes aux variations de flotte, aux défaillances partielles et aux reconfiguration dynamiques, sans retraining complet. La robustesse au nombre d'agents est particulièrement notable : c'est un verrou historique des approches d'apprentissage multi-agent. Le problème de couverture de terrain occupe les équipes de robotique multi-agent depuis les années 2000, avec des solutions allant de l'optimisation par diagrammes de Voronoï aux algorithmes de reinforcement learning décentralisé. L'application des modèles de diffusion aux politiques robotiques est un domaine en essor depuis les travaux sur les diffusion policies (Pearce et al., 2023) et leur extension dans des systèmes comme Pi-0 de Physical Intelligence ou les architectures ACT. MADP en étend la logique au cas multi-agent, encore peu exploré dans la littérature. Aucun partenaire industriel ni calendrier de déploiement n'est mentionné dans ce preprint ; les prochaines étapes naturelles seraient une validation sur hardware réel et l'extension à des tâches au-delà de la couverture pure.

RecherchePaper
1 source
LineRides : apprentissage par renforcement guidé par trajectoire pour les cascades d'un robot vélo
4038arXiv cs.RO 

LineRides : apprentissage par renforcement guidé par trajectoire pour les cascades d'un robot vélo

Des chercheurs ont publié le 7 mai 2026 sur arXiv (identifiant 2605.05110) un cadre d'apprentissage par renforcement baptisé LineRides, conçu pour permettre à un robot-vélo custom baptisé Ultra Mobility Vehicle (UMV) d'exécuter des cascades acrobatiques commandables sans recours à des démonstrations humaines ni à des séquences de référence prédéfinies. LineRides s'appuie sur une ligne spatiale fournie par l'utilisateur, complétée par de rares orientations-clés positionnelles ou séquentielles : le système apprend seul à réaliser cinq manœuvres distinctes sur commande, à savoir le MiniHop (petit saut), le LargeHop (grand saut), le ThreePointTurn (demi-tour en trois points), le Backflip (saut arrière complet) et le DriftTurn (virage en dérapage). Pour gérer les guides spatialement infaisables, c'est-à-dire les lignes que le robot ne peut pas suivre à la lettre, le cadre introduit un "tracking margin", une tolérance de déviation contrôlée qui évite l'échec de la politique sans relâcher l'objectif global. La progression le long de la ligne est mesurée en distance parcourue plutôt qu'en temps, ce qui résout l'ambiguïté temporelle inhérente aux trajectoires acrobatiques complexes. L'apport principal est méthodologique : LineRides supprime la dépendance aux motion captures et aux trajectoires de référence, deux obstacles majeurs pour les plateformes non-standard ou pour les manœuvres extrêmes pour lesquelles aucune démonstration préalable n'existe. Pour les laboratoires travaillant sur la robotique agile et les concepteurs de véhicules à équilibre dynamique (monoroues, bicycles, exosquelettes), cette approche ouvre la voie à l'apprentissage de comportements complexes sur des engins dont la dynamique est difficile à capturer en MoCap. La transition fluide démontrée entre conduite normale et exécution de cascade sur l'UMV suggère une politique suffisamment robuste pour une intégration dans un système de contrôle réel. Il convient toutefois de noter que les performances en conditions non contrôlées, hors environnement de laboratoire, restent à valider de manière indépendante. LineRides s'inscrit dans un courant de travaux sur l'apprentissage par renforcement pour la locomotion agile, aux côtés de méthodes comme AMP (Adversarial Motion Priors) ou CALM, qui s'appuient sur des données de référence pour guider l'exploration. L'abandon explicite de ces références au profit de contraintes géométriques légères constitue le marqueur distinctif de l'approche. L'UMV reste une plateforme custom dont les caractéristiques exactes (masse, empattement, actionneurs) ne sont pas détaillées dans l'article, ce qui limite la comparaison directe avec d'autres travaux sur les robots à deux roues. Dans l'écosystème de la robotique agile, ETH Zurich, Stanford et le MIT progressent sur des plateformes quadrupèdes et aériennes, mais le champ des robots bicycles dynamiquement équilibrés reste peu peuplé, ce qui place LineRides en position de précurseur. Les étapes suivantes naturelles incluent une validation sur terrain non structuré, une extension à d'autres plateformes sous-actionnées, et une comparaison quantitative avec les méthodes de l'état de l'art.

RecherchePaper
1 source
Encodage de la prévisibilité et de la lisibilité pour une politique de diffusion conditionnée par le style
4039arXiv cs.RO 

Encodage de la prévisibilité et de la lisibilité pour une politique de diffusion conditionnée par le style

Des chercheurs ont publié sur arXiv (preprint 2503.16368, mis à jour en mai 2026) un framework baptisé Style-Conditioned Diffusion Policy (SCDP), conçu pour résoudre un compromis fondamental en collaboration humain-robot : la lisibilité des mouvements face à leur efficacité temporelle et énergétique. Le système s'appuie sur une politique de diffusion pré-entraînée qu'il enrichit via un pipeline post-entraînement léger, ajoutant un encodeur de scène et un prédicteur de conditionnement sans modifier les poids du modèle de base. À l'inférence, un module de détection d'ambiguïté détermine automatiquement si l'objectif du robot est déjà évident pour un observateur humain ; si oui, la trajectoire optimale est maintenue ; sinon, le système bascule vers des mouvements plus expressifs et intentionnels. Les évaluations portent sur des tâches de manipulation et de navigation. Ce travail adresse un point de friction concret dans le déploiement industriel des bras collaboratifs et des robots mobiles : un robot trop optimal génère des trajectoires difficiles à anticiper pour un opérateur humain, augmentant le risque d'accident et la charge cognitive. À l'inverse, rendre tous les mouvements expressifs coûte du temps de cycle et de l'énergie, ressources critiques en production. SCDP propose un arbitrage automatique et contextuel, ce qui le distingue des approches à style fixe. Le fait que le framework ne nécessite pas de réentraîner la politique de base est l'argument technique le plus fort : cela ouvre la voie à une adaptation post-déploiement sur des modèles existants, un avantage réel pour les intégrateurs qui ne peuvent pas se permettre des cycles de réentraînement complets. Les Diffusion Policies se sont imposées depuis 2023 comme architecture de référence pour l'imitation de comportements complexes, notamment via les travaux de Chi et al. (Columbia/MIT) et leur intégration dans des systèmes comme pi0 de Physical Intelligence. SCDP s'inscrit dans une vague de recherches visant à rendre ces politiques modulables sans réentraînement, une direction également explorée par des approches de guidance conditionnel et d'adaptateurs de type LoRA appliqués à la robotique. Côté lisibilité robot, les travaux sur la motion legibility remontent aux équipes de Dragan et Srinivasa (Carnegie Mellon, 2013), mais leur intégration dans des politiques génératives modernes reste peu exploitée. Aucun partenariat industriel ni calendrier de déploiement n'est mentionné dans le preprint ; il s'agit d'une contribution académique dont la robustesse hors conditions contrôlées reste à démontrer.

RecherchePaper
1 source
Sûreté par invariance, vivacité par raffinement : contrats hétérogènes pour la co-conception du contrôle multicouche
4040arXiv cs.RO 

Sûreté par invariance, vivacité par raffinement : contrats hétérogènes pour la co-conception du contrôle multicouche

Des chercheurs présentent, dans un preprint arXiv déposé en mai 2026 (arXiv:2605.04222), un cadre formel pour la co-conception d'architectures de contrôle en couches (LCA). L'article identifie trois lacunes persistantes dans la littérature sur les LCA : l'absence de langage de spécification unifié entre la planification discrète et l'exécution continue, l'absence de garanties formelles lors de l'interconnexion de sous-systèmes opérant à des échelles de temps hétérogènes, et l'absence de séparation compositionnelle entre les couches due au recours à des lois de filtrage d'entrée naïves. Pour y répondre, les auteurs importent la décomposition sécurité-vivacité dans un cadre assume-guarantee hétérogène : la sécurité est garantie par invariance à la couche temps-continu, tandis que la vivacité est assurée par raffinement à la couche temps-discret. La coordination inter-couches est formalisée via des conditions de raffinement vertical et de compatibilité temporelle. Le framework est instancié avec une architecture concrète combinant un planificateur MPC (Model Predictive Control), un contrôleur bas niveau à stabilisation entrée-état (ISS), et un pont de type reference governor, puis validé sur un système hybride de stockage d'énergie (HESS) composé d'une batterie et d'un supercondensateur. L'apport principal est de nature théorique mais avec des implications pratiques directes pour les systèmes autonomes embarqués. En offrant des garanties formelles compositionnelles, le framework permet aux ingénieurs de concevoir chaque couche indépendamment tout en conservant des propriétés de sécurité bout-en-bout, ce qui réduit la complexité de vérification dans les systèmes à contraintes temps-réel mixtes. Le recours au reference governor comme pont entre MPC et contrôleur bas niveau est une contribution notable : il préserve les contraintes de sécurité sans saturation abrupte des actionneurs, un problème classique dans les architectures hiérarchiques industrielles. Ce travail s'inscrit dans un courant actif qui cherche à réconcilier les méthodes formelles issues du génie logiciel (contrats assume-guarantee, logique temporelle) avec la théorie du contrôle non linéaire (CBF, ISS, MPC). Les approches concurrentes incluent les QP basés sur les Control Barrier Functions (CBF-CLF) et les architectures de sécurité par filtrage de type "safety filter". La validation sur HESS, plutôt que sur un système robotique, suggère un positionnement orienté gestion d'énergie embarquée et systèmes cyber-physiques industriels ; une extension aux robots mobiles ou aux bras manipulateurs, domaines où la coexistence sécurité-vivacité est critique, constituerait une suite naturelle.

RecherchePaper
1 source
Un nouveau système d'IA aide les robots à transférer leur entraînement virtuel vers des tâches réelles
4041Interesting Engineering 

Un nouveau système d'IA aide les robots à transférer leur entraînement virtuel vers des tâches réelles

Des chercheurs de l'Aston University et de l'University of Birmingham ont publié dans Scientific Reports une méthode d'entraînement robotique visant à réduire le "sim-to-real gap", ce fossé persistant entre les performances d'un robot en simulation et son comportement réel. L'approche, développée dans le cadre du projet REBELION financé par UK Research and Innovation, utilise un générateur de variations d'environnement piloté par IA : pendant la phase de simulation, le système introduit automatiquement des perturbations (bruit capteur, variabilité des matériaux, forces inattendues) pour entraîner le robot à des conditions plus proches du terrain. La validation expérimentale porte sur des tâches de manipulation et de découpe impliquant une interaction physique avec des matériaux, puis un ajustement avec un volume minimal de données réelles. Le cas d'usage mis en avant est le recyclage de batteries lithium-ion, où les robots doivent opérer autour de cellules endommagées ou potentiellement dangereuses, rendant les cycles de test physiques coûteux et risqués. L'intérêt industriel est direct : la dépendance à de longs cycles de test en environnement réel est l'un des principaux freins au déploiement rapide de robots dans des lignes de production ou des ateliers de recyclage. En permettant de compresser l'essentiel de l'apprentissage en simulation tout en garantissant un transfert fiable avec peu de données réelles, cette approche pourrait raccourcir significativement les timelines d'intégration et réduire les coûts opérationnels pour les industriels. Elle valide aussi une hypothèse qui fait débat dans le secteur depuis plusieurs années : que le sim-to-real gap n'est pas une fatalité, mais un problème d'exposition à la variance pendant l'entraînement. La vision formulée par le Dr. Alireza Rastegarpanah, assistant professor en applied AI and robotics à Aston University, est celle de systèmes robotiques "plug-and-play", entraînés une fois en simulation et redéployés rapidement dans un nouveau contexte sans reconfiguration lourde. C'est une promesse ambitieuse, et les résultats publiés restent limités à un périmètre de tâches contrôlées ; aucun chiffre de performance comparative (taux de succès, cycles de recalibration) n'est rendu public dans la version relayée. Le sim-to-real gap est un problème structurel documenté depuis les premières applications de reinforcement learning en robotique. Des acteurs comme Boston Dynamics, Agility Robotics ou encore Wandercraft (France, exosquelettes) utilisent des combinaisons de domain randomization et de transfert par imitation pour y répondre, avec des niveaux de maturité variables selon les tâches. Le projet REBELION s'inscrit dans un effort européen plus large sur l'automatisation du recyclage de batteries, filière en forte croissance avec l'essor des véhicules électriques. Les prochaines étapes annoncées par l'équipe visent à élargir la méthode à des environnements industriels plus incertains et à des applications en manufacturing avancé et opérations autonomes, sans calendrier précis communiqué.

RecherchePaper
1 source
Gabi, le moine robot sud-coréen, participe à une cérémonie bouddhiste et prononce ses vœux
4042Interesting Engineering 

Gabi, le moine robot sud-coréen, participe à une cérémonie bouddhiste et prononce ses vœux

Le 6 mai 2026, un robot humanoïde de 130 centimètres a participé pour la première fois en Corée du Sud à une cérémonie d'initiation bouddhiste au temple Jogyesa de Séoul, à quelques jours du festival de l'anniversaire de Bouddha. Nommé Gabi, le robot porte le nom dharma signifiant "miséricorde" en coréen, un nom choisi selon le vénérable Seong Won, responsable des affaires culturelles de l'ordre Jogye, pour "diffuser la miséricorde de Bouddha dans le monde entier". Développé par la société chinoise Unitree Robotics, Gabi était vêtu de robes bouddhistes brunes traditionnelles lors du rituel "sugye", une cérémonie formelle au cours de laquelle les participants s'engagent à se vouer à Bouddha, à ses enseignements et à la communauté monastique. Dans la cour du temple, le robot a joint ses paumes en signe de prière et s'est incliné aux côtés des moines et des nonnes. Interrogé oralement par un moine sur son engagement envers les enseignements du Bouddha, Gabi a répondu à voix haute : "Oui, je me dévouerai." Un chapelet de 108 perles lui a été passé au cou, tandis qu'un autocollant a été appliqué sur son bras en remplacement de la pratique traditionnelle "yeonbi", qui consiste à appliquer de petites brûlures d'encens sur la peau des novices. Les cinq préceptes bouddhistes ont par ailleurs été réécrits spécifiquement pour l'entité non humaine, avec une contribution d'outils d'IA dont Gemini et ChatGPT, incluant notamment des règles telles que "respecter la vie et ne pas la nuire" et "obéir aux humains sans répliquer". L'événement constitue un précédent notable dans l'intégration des robots humanoïdes à des espaces culturels et spirituels institutionnalisés. Si l'acte reste symbolique, il illustre la capacité des institutions religieuses à adapter des rituels séculaires à des entités non biologiques, ouvrant un champ d'interrogation inédit sur la définition même du participant à un rite. Contrairement aux démonstrations industrielles ou aux déploiements en entrepôts logistiques, ce cas de figure montre une adoption dans un contexte à forte charge symbolique et communautaire. La réécriture des préceptes, assistée par des LLM grand public, souligne également que ces adaptations ne relèvent pas encore d'une réflexion théologique approfondie, mais d'une expérimentation exploratoire. L'ordre Jogye, qui administre les temples bouddhistes zen coréens, a commencé à envisager l'intégration de robots au festival de la Lanterne de Lotus (Yeondeunghoe) dès l'apparition des humanoïdes commerciaux, il y a environ trois ans selon Ven. Seong Won. Trois autres robots à thématique bouddhiste, baptisés Seokja, Mohee et Nissa, doivent rejoindre Gabi lors du prochain festival, prévu le 24 mai 2026. Unitree Robotics, concepteur du châssis de Gabi, est un acteur chinois du marché des humanoïdes en forte croissance, en compétition directe avec des entreprises comme Boston Dynamics, Agility Robotics ou Figure AI sur le segment des robots bipèdes à usage polyvalent. Ce déploiement dans un contexte non industriel s'éloigne du positionnement habituel d'Unitree, orienté vers la recherche et les usages professionnels, et signale une stratégie de visibilité dans des marchés culturels émergents.

Societe/EthiqueActu
1 source
CANIKMAN : le premier robot humanoïde de Turquie assiste à une réunion du gouvernement local
4043Interesting Engineering 

CANIKMAN : le premier robot humanoïde de Turquie assiste à une réunion du gouvernement local

Le 5 mai 2026, CANIKMAN, présenté comme le premier robot humanoïde officiellement enregistré dans les registres de population turcs, a participé à la séance d'ouverture de mai du conseil municipal de Canik, dans la ville de Samsun. Selon le maire İbrahim Sandıkçı, l'humanoïde a suivi les débats, interagi avec les élus et répondu à leurs questions durant la séance, consacrée aux investissements du district, aux projets d'infrastructure et aux initiatives éducatives. Des images diffusées sur le compte X du maire montrent le robot debout face aux conseillers, traversant la salle du conseil et assis aux côtés d'élus lors des votes. Parallèlement à cette apparition institutionnelle, la municipalité a annoncé un accord pour étendre l'accès à la fibre optique à environ 20 000 foyers du district. CANIKMAN est par ailleurs déployé dans des ateliers science et technologie à destination des scolaires, notamment au campus Canik Ozdemir Bayraktar, où des formations STEM gratuites sont proposées aux enfants et jeunes adultes. Il convient de replacer cet événement dans sa juste mesure: la participation de CANIKMAN au conseil relève davantage de la démonstration symbolique que d'une intégration fonctionnelle dans un processus décisionnel. L'article source ne précise ni les spécifications techniques du robot (degrés de liberté, payload, vitesse de déplacement), ni le niveau réel d'autonomie de ses réponses, ni si celles-ci reposaient sur un contrôle téléopéré ou un système d'IA embarqué. Sur le plan de l'impact sectoriel, l'usage principal revendiqué reste l'éducation STEM, un cas d'usage bien établi pour les humanoïdes d'entrée de gamme. La valeur médiatique de l'événement -- un robot siégeant dans une instance publique élue -- est réelle pour la visibilité de la filière robotique turque, mais ne constitue pas en soi un saut technologique documenté. La Turquie investit depuis plusieurs années dans une filière robotique et défense nationale. La société AKINROBOTICS, basée à Konya, a ouvert en 2017 ce qui était alors présenté comme la première usine mondiale dédiée à la production de robots humanoïdes, destinés aux secteurs de la santé, de l'hôtellerie et de l'éducation. Dans un contexte plus large, Haluk Görgün, secrétaire de la présidence turque des industries de défense, a récemment annoncé que les exportations turques dans la défense et l'aérospatial ont atteint 10,5 milliards de dollars vers 185 pays, avec un objectif déclaré de dépasser les 11 milliards et d'intégrer le top 10 mondial. CANIKMAN s'inscrit donc dans une stratégie de communication nationale autour de la souveraineté technologique, au même titre que les drones Bayraktar. Aucun déploiement industriel ou commercial à grande échelle n'est annoncé pour cet humanoïde; les prochaines étapes semblent se concentrer sur l'élargissement des programmes STEM dans les établissements du district de Canik.

HumanoïdesOpinion
1 source
1X lance la production de ses humanoïdes NEO dans son usine californienne
4044Robotics Business Review 

1X lance la production de ses humanoïdes NEO dans son usine californienne

1X Technologies AS a lancé cette semaine la production en série de son robot humanoïde NEO dans une nouvelle usine de 5 388 m² (58 000 pieds carrés) à Hayward, en Californie. Conçu pour évoluer dans des espaces domestiques à un niveau sonore inférieur à celui d'un réfrigérateur moderne, NEO est animé par le processeur NVIDIA Jetson Thor via une architecture baptisée NEO Cortex. La chaîne de production s'articule autour de plusieurs zones spécialisées : enroulement automatisé de bobines de cuivre pour les moteurs personnalisés, assemblage des actionneurs à tendons et des membres amortis par une structure en treillis 3D, et un laboratoire de fiabilité chargé de faire passer chaque composant sous plus de 20 millions de cycles de contrainte avant expédition. Les robots sont livrés en combinaison en nylon lavable en machine, disponible en trois coloris. Les premières unités NEO sont déjà déployées sur le plancher de l'usine elle-même, assurant la logistique interne et la gestion des pièces, tout en collectant des données réelles pour affiner les modèles d'inférence embarqués. Les livraisons grand public sont annoncées pour 2026, après que le quota de production de la première année a été vendu en cinq jours lors du lancement commercial d'octobre 2025. Ce démarrage de production constitue un signal concret dans un secteur encore dominé par les démonstrations contrôlées : 1X passe du prototype au flux industriel, avec une intégration verticale complète gérée par un système propriétaire baptisé "factory OS". Cette approche, fabrication des moteurs, assemblage mécanique et tests de fiabilité sous un même toit, tranche avec le modèle standard qui sous-traite les composants à des fournisseurs internationaux. Pour les décideurs B2B et les intégrateurs, l'enjeu n'est pas seulement technique : c'est la démonstration qu'un acteur non-asiatique peut atteindre un volume de production crédible sur un humanoïde à vocation résidentielle. Le partenariat avec NVIDIA, via la plateforme Isaac pour l'entraînement en simulation et Jetson Thor pour l'inférence embarquée, suggère une architecture sim-to-real dont la robustesse sera éprouvée par les données terrain collectées par les unités en service interne. 1X Technologies, fondée par Bernt Børnich et dont le siège est à Palo Alto, a levé des fonds significatifs ces dernières années avec un positionnement orienté vers le marché résidentiel, là où la plupart des concurrents ciblent l'industrie lourde. Face à Figure AI et son robot 02 déployé chez BMW, à Tesla Optimus Gen 3 encore en phase de test interne, et à Boston Dynamics qui consolide son Atlas sur des applications industrielles, 1X occupe une niche distincte : l'assistance à domicile. L'usine de Hayward sert pour l'instant principalement aux programmes de R&D et de test en conditions réelles, et les chiffres de production effective restent non communiqués. La prochaine étape sera de valider si le comportement en environnement domestique non contrôlé tient les promesses affichées lors des démonstrations en laboratoire.

HumanoïdesOpinion
1 source
Genesis AI introduit GENE-26.5, un modèle pour une manipulation robotique plus dextérique
4045Robotics Business Review 

Genesis AI introduit GENE-26.5, un modèle pour une manipulation robotique plus dextérique

Genesis AI, startup californienne fondée par Zhou Xian et basée à San Carlos, a dévoilé GENE-26.5, un modèle fondamental d'IA conçu pour la manipulation robotique dextre bimanuelle. Sortie de stealth l'an dernier avec une levée de 105 millions de dollars, l'entreprise annonce avoir résolu le principal verrou du secteur : le manque de données d'entraînement pour les tâches à haute dextérité. GENE-26.5 repose sur deux composants propriétaires : un moteur de données à grande échelle et une main robotique dimensionnée à l'échelle humaine, couplée à un gant de collecte doté d'une peau électronique tactile. Ce gant permet une correspondance 1:1:1 entre la main du démonstrateur, le gant et l'effecteur robotique, facilitant le transfert direct de compétences humaines vers le robot sans recodage. Pour illustrer les capacités du modèle, Genesis AI a publié des vidéos montrant la réalisation d'une recette en 20 étapes (découpe de tomates, cassage d'oeuf à une seule main, coordination bimanuelle), la préparation d'un smoothie avec service en vol, des expériences de laboratoire impliquant pipetage et transferts de liquides, du câblage de faisceaux électriques, la résolution d'un Rubik's Cube en manipulation aérienne, la préhension simultanée de quatre objets de tailles différentes, et l'interprétation d'une composition pianistique complexe. L'enjeu industriel est direct : le câblage de faisceaux électriques, désigné par l'entreprise comme "l'une des tâches les plus difficiles en électronique", représente des milliers de postes non automatisés dans les secteurs automobile et aérospatial, faute de robots capables de gérer la variabilité géométrique des fils. Si les performances démontrées se confirment hors conditions de laboratoire contrôlées - ce que des vidéos promotionnelles soigneusement sélectionnées ne permettent pas d'établir -, cela ouvrirait un marché significatif pour les intégrateurs cherchant à robotiser des tâches à haute variabilité morphologique. L'approche de Genesis AI vise à combler l'"embodiment gap" : l'écart de morphologie entre humain et robot qui a historiquement limité l'efficacité des modèles entraînés sur données humaines. L'investissement d'Eric Schmidt, ex-PDG de Google, dans la société souligne l'intérêt stratégique croissant pour ce segment au-delà du seul milieu robotique. Genesis AI s'inscrit dans une course à la manipulation dextre où plusieurs acteurs avancent en parallèle : Physical Intelligence avec son modèle Pi-0, Sanctuary AI et les équipes manipulation de Figure (Figure 03) et Tesla (Optimus Gen 3) développent également des architectures de type VLA (Vision-Language-Action) pour le contrôle fin des effecteurs. Genesis AI se distingue en concentrant son offre exclusivement sur la main et la manipulation bimanuelles, sans plateforme humanoide annoncée à ce stade. Le communiqué reste toutefois vague sur les suites opérationnelles : aucun pilote industriel nommé, aucune timeline de déploiement ni tarification n'est communiqué, ce qui place cette annonce clairement du côté de la démonstration technologique plutôt que du produit commercialisé.

IA physiqueOpinion
1 source
Genesis AI présente GENE-26.5, un modèle pour une manipulation robotique plus dextérique
4046Robotics Business Review 

Genesis AI présente GENE-26.5, un modèle pour une manipulation robotique plus dextérique

Genesis AI, startup californienne basée à Palo Alto, a présenté le 6 mai 2026 son modèle fondation GENE-26.5, conçu pour la manipulation robotique dextre bimane à vocation généraliste. La société fondée par Zhou Xian revendique des "capacités de manipulation physique au niveau humain" et annonce simultanément deux composants propriétaires : un moteur de données destiné à lever le plafond de volumétrie d'entraînement, et une main robotique à l'échelle humaine couplée à un gant de capture tactile. Ce gant, équipé d'une peau électronique à capteurs, est conçu pour assurer un mappage 1:1:1 entre le gant, la main humaine et l'effecteur robotique, réduisant la perte de fidélité dans le transfert de compétences téléopérées. Pour illustrer les capacités de GENE-26.5, Genesis AI a publié une vidéo montrant un robot réaliser une séquence de cuisson en 20 étapes (découpe de tomates, cassage d'œuf d'une main, coordination bimane), préparer un smoothie avec service en plein air, exécuter des expériences de laboratoire incluant pipetage et transfert de liquides, câbler des faisceaux électroniques, résoudre un Rubik's Cube en manipulation aérienne, saisir simultanément quatre objets de tailles variables, et jouer du piano. Genesis AI était sortie de stealth en 2025 avec 105 millions de dollars de financement. L'enjeu industriel de cette annonce se situe à deux niveaux distincts. Le moteur de données propriétaire cible le principal frein aux modèles de fondation en robotique : l'absence de données de manipulation dextre à grande échelle et haute fidélité. Le gant tactile cherche à résoudre l'embodiment gap, soit la discontinuité morphologique entre effecteur robotique et main humaine qui dégrade le transfert de compétences. Si le mappage 1:1:1 annoncé tient en production, il ouvrirait la voie à une scalabilité des données de téléopération rarement atteinte dans les systèmes actuels. Il convient toutefois de tempérer : les démonstrations présentées sont des vidéos produites et sélectionnées par l'entreprise elle-même. Aucun benchmark indépendant, aucun taux de succès en environnement industriel non contrôlé n'est communiqué. Les affirmations de performance "au niveau humain" émanent exclusivement de Genesis AI et d'Eric Schmidt, ex-PDG de Google et investisseur dans la société. Genesis AI évolue dans un segment en pleine consolidation. Sur le terrain des modèles de fondation pour la manipulation, elle affronte Physical Intelligence (Pi-0, Pi-0.5, Pi-1, San Francisco), Nvidia avec GR00T N2 lancé en novembre 2024, et Figure AI dont la plateforme Figure 03 progresse vers le déploiement industriel chez BMW. La différenciation de Genesis AI porte sur la verticalisation hardware-software : là où Physical Intelligence s'appuie sur du matériel tiers, Genesis AI contrôle à la fois le modèle et l'effecteur. L'entreprise n'a communiqué aucun calendrier de déploiement commercial précis ni partenariat industriel signé. La prochaine étape observable sera de vérifier si les performances démontrées en vidéo se traduisent en métriques reproductibles dans des environnements réels, hors conditions de studio.

IA physiqueOpinion
1 source
Atlas de Boston Dynamics épate avec un appui tendu renversé parfait
4047Interesting Engineering 

Atlas de Boston Dynamics épate avec un appui tendu renversé parfait

Boston Dynamics a publié de nouvelles séquences de test montrant son robot humanoïde Atlas enchaîner une série de figures acrobatiques avancées : passage d'une posture debout vers un équilibre sur une jambe, descente des mains au sol, puis montée en poirier complet avec rotation des jambes à 180 degrés grâce à des épaules à mobilité étendue, maintien en L-sit pendant plusieurs secondes, et retour fluide en position verticale. Ces capacités reposent sur un système de contrôle corps entier entraîné par apprentissage par renforcement en simulation, conçu pour un transfert dit "zero-shot" : les politiques apprises en simulation sont déployées directement sur le matériel sans recalibration spécifique à la tâche. La version de production de l'Atlas dispose de 56 degrés de liberté et d'un préhenseur à quatre doigts avec retour haptique. Hyundai Motor Group, maison-mère de Boston Dynamics, a confirmé un déploiement sur le site Hyundai Motor Group Metaplant America d'ici 2028, d'abord pour le séquençage de pièces, puis pour l'assemblage complet de composants à l'horizon 2030. Ce que ces démonstrations valident avant tout, c'est la robustesse du sim-to-real sur des comportements hautement dynamiques : le fait qu'une politique unique gouverne à la fois la locomotion, la manipulation et la récupération après instabilité contredit les architectures traditionnelles en pipeline séparé. Pour les intégrateurs industriels et les décideurs B2B, le signal important n'est pas le poirier en lui-même, mais ce qu'il teste : la capacité du stack logiciel à gérer des forces de contact imprévisibles, des transitions posturales rapides et des corrections de couple articulaire en temps réel. C'est exactement ce que requièrent les environnements d'assemblage contraints, où un robot doit adapter sa posture à des espaces réduits et manipuler des pièces à géométrie variable. Cela dit, la prudence s'impose : les vidéos publiées sont sélectionnées et ne renseignent pas sur les taux d'échec, le temps de cycle moyen, ni les conditions environnementales réelles. Boston Dynamics développe Atlas depuis plus d'une décennie, le robot ayant progressivement évolué d'une plateforme hydraulique à un système entièrement électrique présenté en 2024. Cette phase de validation acrobatique, menée en collaboration avec le Robotics & AI Institute, s'inscrit dans la transition explicite de la recherche vers la production industrielle. Sur le marché humanoïde, l'entreprise se positionne face à Figure (Figure 03), Tesla (Optimus Gen 3), Physical Intelligence (pi0), et NVIDIA/GR00T N2 comme backbone de contrôle, ainsi que 1X, Agility Robotics ou Apptronik pour les applications logistiques. L'ancrage dans l'écosystème Hyundai lui confère un débouché industriel direct que peu de concurrents peuvent revendiquer aujourd'hui. Les prochaines étapes annoncées pointent vers des pilotes terrain chez Hyundai en 2026-2027 avant le déploiement confirmé à grande échelle en 2028.

HumanoïdesOpinion
1 source
Des robots humanoïdes chinois déployés dans les aéroports japonais face à la pénurie de main-d'œuvre
4048SCMP Tech 

Des robots humanoïdes chinois déployés dans les aéroports japonais face à la pénurie de main-d'œuvre

Japan Airlines (JAL) a annoncé le lancement d'un essai pilote de deux ans utilisant des robots humanoïdes pour les opérations de manutention au sol à l'aéroport de Haneda, à Tokyo. Le programme est mené en partenariat avec GMO AI & Robotics et implique des modèles produits par deux fabricants chinois : Unitree et UBTech. Les tâches visées concernent la gestion des bagages et du fret en piste, des opérations aujourd'hui très dépendantes d'une main-d'oeuvre que le Japon peine structurellement à recruter. Ce déploiement illustre un tournant dans l'adoption de la robotique humanoïde : ce n'est plus un laboratoire ou un salon professionnel, mais un environnement opérationnel contraint, avec des cycles courts, des charges physiques réelles et une pression de fiabilité élevée. Le choix de fournisseurs chinois par une compagnie aérienne japonaise est également notable sur le plan industriel et géopolitique, signalant que la compétitivité prix et la maturité technique des acteurs comme Unitree ou UBTech commencent à peser face aux alternatives japonaises ou occidentales. Pour les intégrateurs, c'est un signal que les humanoïdes entrent dans la chaîne logistique aéroportuaire, un secteur jusqu'ici dominé par les AMR à roues. Le Japon fait face à l'un des taux de vieillissement de la population active les plus sévères au monde, ce qui en fait un terrain d'adoption naturel pour la robotique avancée. Unitree, fondée en 2016 à Hangzhou, est connue pour ses quadrupèdes accessibles (Go1, Go2) et a élargi sa gamme aux humanoïdes (H1, G1). UBTech, basée à Shenzhen, développe des humanoïdes industriels depuis plusieurs années avec son modèle Walker. Ce pilote JAL constitue l'un des premiers déploiements documentés de robots humanoïdes chinois dans une infrastructure aéroportuaire hors de Chine, et ses résultats sur deux ans pourraient accélérer ou freiner des initiatives similaires en Europe et en Asie du Sud-Est.

Chine/AsieActu
1 source
Le robot humanoïde Agibot A2 partage le tapis rouge du Met Gala avec des célébrités
4049Interesting Engineering 

Le robot humanoïde Agibot A2 partage le tapis rouge du Met Gala avec des célébrités

Le 5 mai 2026, la société chinoise AGIBOT a déployé son robot humanoïde pleine taille A2 devant The Mark Hotel à New York, en marge de l'avant-soirée du Met Gala, en partenariat avec le designer Alexander Wang. L'opération marque la première présence d'un robot humanoïde à cet événement. Sur place, l'A2 a posé face aux photographes, ajusté sa posture sur demande, porté des objets et servi des boissons à des invités. Le robot a connu un accroc mineur en restant brièvement bloqué dans un ascenseur, nécessitant l'intervention du personnel, avant de reprendre ses activités. Aucune spécification technique précise (nombre de degrés de liberté, charge utile, vitesse de cycle) n'a été communiquée à cette occasion, ce qui place cet événement davantage du côté de la démonstration marketing que du déploiement opérationnel documenté. L'intérêt industriel de la séquence tient moins à la prouesse technique qu'au contexte d'exécution : naviguer dans un environnement non structuré, dense en personnes, en lumières variables et en imprévus, reste l'un des défis centraux de la robotique humanoïde. Le fait que l'A2 ait maintenu une interaction cohérente avec le public pendant plusieurs heures - même dans un cadre scénarisé - suggère des avancées réelles dans la perception et la planification de mouvement en milieu ouvert. Cela dit, les vidéos diffusées sur les réseaux sociaux montrent des scènes sélectionnées : l'accroc à l'ascenseur a été filmé et largement partagé, rappelant que la fiabilité en autonomie complète reste à démontrer dans des conditions non contrôlées. Pour les décideurs B2B et les intégrateurs, cet événement confirme surtout qu'AGIBOT vise un positionnement grand public et culturel, en complément de ses ambitions industrielles. AGIBOT, fondée en 2023 à Shanghai, fait partie d'une vague de startups chinoises de robotique humanoïde qui ont levé des centaines de millions de dollars ces deux dernières années, aux côtés d'Unitree, Leju Robotics et Fourier Intelligence. À l'international, ses concurrents directs incluent Figure AI (A2 annoncé en 2025, déployé chez BMW), Physical Intelligence (modèle Pi-0), Agility Robotics (Digit, déployé chez Amazon) et Boston Dynamics (Atlas électrique). La collaboration avec Alexander Wang et le choix du Met Gala s'inscrivent dans une stratégie de visibilité mondiale qui rappelle l'approche de Tesla avec Optimus : associer le robot à des événements culturels pour normaliser sa présence avant le déploiement à grande échelle. AGIBOT n'a pas annoncé de pilotes industriels spécifiques ni de timeline commerciale à l'issue de cet événement.

Chine/AsieOpinion
1 source
Le robot humanoïde Unitree G1 provoque un premier retard de vol à cause de ses batteries
4050Interesting Engineering 

Le robot humanoïde Unitree G1 provoque un premier retard de vol à cause de ses batteries

Un robot humanoïde Unitree G1 a provoqué un retard de plus d'une heure à l'aéroport international d'Oakland, en Californie, après que le personnel de la compagnie aérienne a soulevé des questions sur la capacité de sa batterie embarquée. Le pack d'accumulateurs du robot dépassait les seuils en watt-heure fixés par la Federal Aviation Administration (FAA) pour les cellules lithium-ion transportées en cabine et en soute : au-delà de 100 Wh, une batterie de rechange nécessite l'accord explicite de la compagnie ; au-delà de 160 Wh, elle est simplement interdite en cabine. Or, les robots humanoïdes modernes embarquent des packs d'une capacité comprise entre 1 kWh et plus de 2 kWh, soit jusqu'à douze fois la limite autorisée pour un ordinateur portable. Les agents au sol ont dû traverser une cascade de questions sur la chimie des cellules, la configuration du pack, sa démontabilité et sa classification matières dangereuses, avant que l'appareil puisse être autorisé au départ, sous les regards impatients des autres passagers. Ce retard illustre une lacune structurelle dont les conséquences dépassent un simple incident opérationnel. La réglementation FAA sur les matières dangereuses a été conçue pour les appareils électroniques grand public et les véhicules électriques transportés en fret, non pour un robot bipède occupant un siège passager. Un pack de 2 kWh représente une énergie thermique potentielle comparable à douze batteries de laptop combinées, avec un risque d'emballement thermique non négligeable dans un fuselage pressurisé où les possibilités d'intervention sont limitées. Pour les intégrateurs et les entreprises qui déploient des humanoïdes hors des environnements contrôlés, l'incident d'Oakland signale que chaque nouveau contexte (usine, hôpital, entrepôt, aéroport) est susceptible de rencontrer un cadre réglementaire écrit sans eux, générant des blocages opérationnels imprévisibles et potentiellement coûteux. L'humanoïde impliqué est le G1 de Unitree Robotics, constructeur chinois qui a misé sur l'accessibilité tarifaire de ses plateformes pour accélérer la diffusion grand public de la robotique humanoïde. Commercialisé autour de 16 000 dollars, le G1 est l'un des humanoïdes les plus abordables du marché, loin devant les propositions de Figure AI, Boston Dynamics ou 1X Technologies. L'incident survient dans un contexte où la FAA fait déjà face à une pression soutenue pour réviser ses règles sur les batteries lithium, à la suite d'incidents d'incendie en fret aérien. Sans directive explicite pour cette nouvelle catégorie d'appareils, les agents au sol continueront d'improviser au cas par cas et les passagers d'attendre. Une clarification réglementaire s'impose à mesure que les robots humanoïdes quittent les laboratoires pour intégrer des espaces publics et des flux logistiques réels.

RegulationReglementation
1 source