smallfryy/corl-2025-papers

✨ 200+ robotics papers from CoRL 2025, with TLDRs, project pages, code, and more

85

12 commits

updated Oct 1, 2025

See the code

README

CoRL 2025 Papers

A list of 200+ CoRL papers (orals & posters) with TLDRs, project pages, code, etc

CORL Logo

Orals

#Paper TitleTLDRProject PagePaperCode
1ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered ScenesTwo-stage teacher–student framework enabling zero-shot dexterous grasping in clutter.linklinklink
2ScrewSplat: An End-to-End Method for Articulated Object RecognitionLearns geometry and kinematics from RGB using Gaussian splatting with screw axes.N/Alinklink
3Visual Imitation Enables Contextual Humanoid ControlLarge-scale visual imitation enables humanoids to act contextually in varied environments.N/Alinklink
4Sampling-based System Identification with Active Exploration for Legged Sim2Real LearningActive exploration improves system ID and sim-to-real transfer for legged robots.N/Alinklink
5DemoSpeedup: Accelerating Visuomotor Policies via Entropy-Guided Demonstration AccelerationSpeeds up visuomotor policy training by entropy-guided demo selection.N/AlinkN/A
6RoboArena: Distributed Real-World Evaluation of Generalist Robot PoliciesDistributed real-world benchmark for evaluating generalist robot policies.linklinklink
7Latent Theory of Mind: A Decentralized Diffusion Architecture for Cooperative ManipulationMulti-agent cooperative manipulation via diffusion-based latent theory of mind.N/AlinkN/A
8Non-conflicting Energy Minimization in Reinforcement Learning based Robot ControlEnergy-efficient robot control via non-conflicting energy minimization in RL.N/AlinkN/A
9Belief-Conditioned One-Step Diffusion: Real-Time Trajectory Planning with Just-Enough SensingDiffusion planner for real-time trajectories under partial observability.N/AlinkN/A
10Cross-Sensor Touch GenerationGenerates cross-sensor tactile signals to improve robot perception.linkOpenReviewN/A
11X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-RealReal-to-sim-to-real pipeline for transferring skills across robot embodiments.linklinkN/A
12Data Retrieval with Importance Weights for Few-Shot Imitation LearningImproves few-shot imitation learning by weighting retrieved demos for efficiency.N/AlinkN/A
13Versatile Loco-Manipulation through Flexible Interlimb CoordinationEnables loco-manipulation by flexibly coordinating robot limbs.N/AlinkN/A
14Reactive In-Air Clothing Manipulation with Confidence-Aware Dense Correspondence and Visuotactile AffordanceIn-air garment manipulation using dense visual-tactile correspondences and affordances.N/AlinkN/A
15Training Strategies for Efficient Embodied ReasoningProposes strategies to make embodied reasoning more efficient.N/AlinkN/A
16Divide, Discover, Deploy: Factorized Skill Learning with Symmetry and Style PriorsFactorized skill learning with priors for modular deployment.linklinkN/A
17Tactile Beyond Pixels: Multisensory Touch Representations for Robot ManipulationBuilds rich tactile representations that fuse multiple modalities.N/AlinkN/A
18Planning from Point Clouds over Continuous Actions for Multi-object RearrangementPlanner for rearrangement tasks directly from raw point clouds.N/AlinkN/A
19Stack It Up!: 3D Stable Structure Generation from 2D Hand-drawn SketchConverts 2D sketches into physically stable 3D structures.N/AlinkN/A
20DexSkin: High-Coverage Conformable Robotic Skin for Learning Contact-Rich ManipulationFlexible, conformable robotic skin for learning contact-rich tasks.N/AlinkN/A
21SAVOR: Skill Affordance Learning from Visuo-Haptic Perception for Robot-Assisted Bite AcquisitionLearns visuo-haptic affordances for assistive bite acquisition.N/AlinkN/A
22SAIL: Faster-than-Demonstration Execution of Imitation Learning PoliciesExecutes imitation learning policies faster than human demonstrations.N/AlinkN/A
23Geometric Red-Teaming for Robotic ManipulationStress-tests robot manipulation with geometric adversaries.N/AlinkN/A
24HuB: Learning Extreme Humanoid BalanceTrains humanoids for extreme balancing and recovery.N/AlinkN/A
25Vision-Language-Action Model with Open-World GeneralizationVLA model trained to generalize to open-world robotic tasks.N/AlinkN/A
26Fabrica: Dual-Arm Assembly of General Multi-Part Objects via Integrated Planning and LearningCombines planning and learning for generalizable dual-arm multi-part assembly.N/AlinkN/A
27Streaming Flow Policy: Simplifying diffusion/flow-matching policies by treating action trajectories as flow trajectoriesSimplifies diffusion policies by reformulating action trajectories as flow trajectories.N/AlinkN/A
28Steering Your Diffusion Policy with Latent Space Reinforcement LearningUses reinforcement learning in latent space to guide and improve diffusion policies.linklinklink
29AirExo-2: Scaling up Generalizable Robotic Imitation Learning with Low-Cost ExoskeletonsScales robotic imitation learning using low-cost wearable exoskeleton data collection.linklinkN/A
30FetchBot: Learning Generalizable Object Fetching in Cluttered Scenes via Zero-Shot Sim2RealZero-shot sim-to-real transfer for object fetching in cluttered environments.linklinkN/A
31One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose EstimationOne-shot 6D pose estimation using single-image 3D object generation with domain randomization.N/Alinklink
32KineSoft: Learning Proprioceptive Manipulation Policies with Soft Robot HandsTrains manipulation policies for soft robot hands using proprioceptive sensing.N/AlinkN/A
33Real2Render2Real: Scaling Robot Data Without Dynamics Simulation or Robot HardwareData scaling pipeline using rendering to bypass robot hardware and dynamics simulation.N/Alinklink
34FACET: Force-Adaptive Control via Impedance Reference Tracking for Legged RobotsForce-adaptive impedance tracking improves control of legged robots.N/AlinkN/A
35DexUMI: Using Human Hand as the Universal Manipulation Interface for Dexterous ManipulationLeverages the human hand as a universal interface for dexterous robotic manipulation.N/Alinklink
36The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative AudioIntegrates audio with vision for multimodal sim-to-real robot policies.linklinkN/A
37ReWiND: Language-Guided Rewards Teach Robot Policies without New DemonstrationsUses language-guided rewards to improve robot policies without requiring new demos.N/AlinkN/A
38Learning a Unified Policy for Position and Force Control in Legged Loco-ManipulationUnified policy framework for position and force control in legged loco-manipulation.N/AlinkN/A
39Omni-Perception: Omnidirectional Collision Avoidance of Legged Robots in Dynamic EnvironmentsOmnidirectional perception enables collision avoidance for legged robots in dynamic settings.N/AlinkN/A
40Real-Time Out-of-Distribution Failure Prevention via Multi-Modal ReasoningPrevents OOD failures in real-time with multi-modal reasoning.N/AlinkN/A
41LocoFormer: Generalist Locomotion via Long-context AdaptationGeneralist locomotion policy trained with long-context sequence adaptation.linklinklink
42ImMimic: Cross-Domain Imitation from Human Videos via Mapping and InterpolationCross-domain imitation by mapping and interpolating human videos for robot learning.N/AlinkN/A

Posters

#Paper TitleTLDRProject PagePaperCode
1CLONE: Closed-Loop Whole-Body Humanoid Teleoperation for Long-Horizon TasksRobust whole-body humanoid teleoperation using mixture-of-experts control and LiDAR correction.linklinkN/A
2Disentangled Multi-Context Meta-Learning: Unlocking Robust and Generalized Task LearningDisentangles task factors for robust meta-learning and sim-to-real transfer.N/AlinkN/A
3Meta-Optimization and Program Search using Language Models for Task and Motion PlanningUses LLMs for meta-optimization and program search in task and motion planning.N/AlinkN/A
4Text2Touch: Tactile In-Hand Manipulation with LLM-Designed Reward FunctionsLeverages LLM-designed reward functions for tactile in-hand robot manipulation.N/AlinkN/A
5Multi-Loco: Unifying Multi-Embodiment Legged Locomotion via Reinforcement Learning Augmented DiffusionUnifies locomotion control across embodiments with RL-augmented diffusion models.N/AlinkN/A
6SimShear: Sim-to-Real Shear-based Tactile ServoingUses shear-based tactile feedback for sim-to-real transfer in tactile servoing.N/AlinkN/A
7Focusing on What Matters: Object-Agent-centric Tokenization for Vision Language Action modelsIntroduces object-agent-centric tokenization to improve VLA model reasoning.N/AOpenReviewN/A
8AT-Drone: Benchmarking Adaptive Teaming in Multi-Drone PursuitBenchmark for evaluating adaptive teaming strategies in multi-drone pursuit tasks.N/AlinkN/A
9Uncertainty-Aware Scene Understanding via Efficient Sampling-Free Confidence EstimationConfidence estimation for scene understanding without expensive sampling.N/AlinkN/A
10ObjectReact: Learning Object-Relative Control for Visual NavigationLearns object-relative navigation control for robust visual navigation.LinklinkLink
11Decentralized Aerial Manipulation of a Cable-Suspended Load Using Multi-Agent Reinforcement LearningDecentralized multi-agent RL for aerial manipulation of suspended loads.N/AlinkN/A
12ReasonPlan: Unified Scene Prediction and Decision Reasoning for Closed-loop Autonomous DrivingIntegrates scene prediction and decision reasoning for end-to-end autonomous driving.N/AlinkN/A
13Embrace Contacts: humanoid shadowing with full body ground contactsEnables humanoid shadowing with consistent full-body ground contacts.N/AlinkN/A
14Distilling for Long-Horizon Prehensile and Non-Prehensile ManipulationDistills policies to handle long-horizon prehensile and non-prehensile tasks.N/AlinkN/A
15Constraint-Aware Diffusion Guidance for Robotics: Real-Time Obstacle Avoidance for Autonomous RacingUses diffusion guidance for real-time obstacle avoidance in racing scenarios.N/AlinkN/A
16Learning Impact-Rich Rotational Maneuvers via Centroidal Velocity Rewards and Sim-to-Real Techniques: A One-Leg Hopper Flip Case StudyTrains one-leg hopper to flip using impact-rich rewards and sim-to-real techniques.N/AlinkN/A
17LodeStar: Long-horizon Dexterity via Synthetic Data Augmentation from Human DemonstrationsEnhances dexterity with synthetic data augmentation from human demonstrations.linklinkN/A
18Imitation Learning Based on Disentangled Representation Learning of Behavioral CharacteristicsApplies disentangled representation learning for imitation learning of behaviors.N/AlinkN/A
19Motion Priors Reimagined: Adapting Flat-Terrain Skills for Complex Quadruped MobilityAdapts flat-terrain locomotion skills to complex terrains using motion priors.linklinklink
20Sequence Modeling for Time-Optimal Quadrotor Trajectory Optimization with Sampling-based Robustness AnalysisApplies sequence modeling for fast and robust quadrotor trajectory optimization.N/AlinkN/A
21HALO: Human Preference Aligned Offline Reward Learning for Robot NavigationAligns offline reward learning with human preferences for navigation tasks.N/AlinkN/A
22RoboMonkey: Scaling Test-Time Sampling and Verification for Vision-Language-Action ModelsScales up verification and sampling for VLA models during test-time.linklinklink
23Constraint-Preserving Data Generation for One-Shot Visuomotor Policy GeneralizationGenerates constraint-preserving data to improve one-shot visuomotor generalization.N/AlinkN/A
24Hand-Eye Autonomous Delivery: Learning Humanoid Navigation, Locomotion and ReachingTrains humanoid robots for navigation and reaching in delivery scenarios.N/AlinkN/A
25FLARE: Robot Learning with Implicit World ModelingImplicit world modeling for more efficient and robust robot learning.N/AlinkN/A
26From Real World to Logic and Back: Learning Generalizable Relational Concepts For Long Horizon Robot PlanningLearns relational concepts that bridge real-world experience with symbolic planning for long-horizon tasks.N/AlinkN/A
27NeuralSVCD for Efficient Swept Volume Collision DetectionNeural approach to fast swept-volume–based collision detection for motion planning.N/AlinkN/A
28MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from InterventionInverse RL method that aligns policies from sparse interventions via max-entropy residual Q-learning.LinklinkN/A
29Joint Model-based Model-free Diffusion for Planning with ConstraintsCombines model-based and model-free diffusion to plan under explicit constraints.N/AlinkLink
30DEQ-MPC : Deep Equilibrium Model Predictive ControlUses deep equilibrium networks to solve MPC problems efficiently at inference time.N/AlinkN/A
31CUPID: Curating Data your Robot Loves with Influence FunctionsApplies influence functions to select training data that most benefits robot learning.N/AlinkN/A
32Eye, Robot: Learning to Look to Act with a BC-RL Perception-Action LoopTrains perception to support action using a behavior-cloning + RL loop for active visual policies.N/AlinkN/A
33Imagine, Verify, Execute: Memory-guided Agentic Exploration with Vision-Language ModelsUses VLMs with memory to imagine plans, verify outcomes, and execute tasks agentically.linklinkN/A
34Dynamics-Compliant Trajectory Diffusion for Super-Nominal Payload ManipulationGenerates manipulation trajectories via diffusion that respect dynamics under heavy payloads.N/AlinkN/A
35CoRI: Communication of Robot Intent for Physical Human-Robot InteractionFramework for communicating robot intent to improve safety and fluency in pHRI.N/AlinkN/A
36KoopMotion: Learning Almost Divergence Free Koopman Flow Fields for Motion PlanningLearns Koopman operator–based flow fields that guide smooth, divergence-free motion plans.N/AlinkN/A
37Learning Smooth State-Dependent Traversability from Dense Point CloudsPredicts traversability as a smooth, state-dependent function directly from dense 3D point clouds.N/AlinkN/A
38Leveraging Correlation Across Test Platforms for Variance-Reduced Metric EstimationReduces evaluation variance by exploiting correlations across heterogeneous testbeds.N/AlinkN/A
39Agreement Volatility: A Second-Order Metric for Uncertainty Quantification in Surgical Robot LearningIntroduces a second-order metric capturing volatility in model agreement to quantify uncertainty.N/AlinkN/A
40Sample-Efficient Online Control Policy Learning with Real-Time Recursive Model UpdatesOnline control learning with recursive updates to maintain real-time performance.N/AlinkN/A
41Lucid-XR: An Extended-Reality Data Engine for Robotic ManipulationBuilds an XR-based engine to synthesize diverse manipulation data at scale.N/AOpenReviewN/A
42CLAMP: Crowdsourcing a LArge-scale in-the-wild haptic dataset with an open-source device for Multimodal robot PerceptionCollects large-scale in-the-wild haptic data using an open-source crowdsourced device.N/AlinkN/A
43Distributed Upload and Active Labeling for Resource-Constrained Fleet LearningActive labeling and distributed upload strategies tailored for fleet learning under bandwidth limits.N/AOpenReviewN/A
44DreamGen: Unlocking Generalization in Robot Learning through Video World ModelsUses video world models to improve generalization across robot tasks and environments.N/AlinkN/A
45LocoTouch: Learning Dynamic Quadrupedal Transport with Tactile SensingIncorporates tactile feedback for robust, dynamic quadruped transport behaviors.N/AlinkN/A
46TopoCut: Learning Multi-Step Cutting with Spectral Rewards and Discrete Diffusion PoliciesSolves multi-step cutting via discrete diffusion guided by topology-aware rewards.N/AlinkN/A
47WoMAP: World Models For Embodied Open-Vocabulary Object LocalizationUses open-vocabulary world models to localize objects for embodied agents.N/AlinkN/A
48MirrorDuo: Reflection-Consistent Visuomotor Learning from Mirrored Demonstration PairsImproves visuomotor learning by enforcing reflection consistency across mirrored demos.N/AOpenReviewN/A
49First Order Model-Based RL through Decoupled BackpropagationEnables efficient model-based RL via a first-order method with decoupled gradients.N/AlinkN/A
50CLASS: Contrastive Learning via Action Sequence Supervision for Robot ManipulationContrastive pretraining supervised by action sequences to enhance manipulation policies.N/AlinkN/A
51Articulated Object Estimation in the WildEstimates articulation and pose of everyday objects from unconstrained, real-world data.N/AlinkN/A
52Multimodal Fused Learning for Solving the Generalized Traveling Salesman Problem in Robotic Task PlanningFuses multiple sensing/modalities to solve generalized TSP instances for robot task planning.N/AlinkN/A
53Dexplore: Scalable Neural Control for Dexterous Manipulation from Reference Scoped ExplorationUnified optimization uses MoCap as soft guidance to scale dexterous manipulation control.N/AlinkN/A
54PrioriTouch: Adapting to User Contact Preferences for Whole-Arm Physical Human-Robot InteractionLearns and prioritizes user-specific contact preferences for safer whole-arm pHRI.linklinkN/A
55UnPose: Uncertainty-Guided Diffusion Priors for Zero-Shot Pose EstimationUses diffusion priors with uncertainty to enable model-free, zero-shot 6D pose estimation.N/AlinkN/A
56Distilling On-device Language Models for Robot Planning with Minimal Human InterventionDistills compact LMs on-device to plan robot actions with minimal human supervision.N/AlinkN/A
57Mechanistic Interpretability for Steering Vision-Language-Action ModelsProbes and steers VLA internals using mech-int tools to improve safety and control.N/AlinkN/A
58FFHFlow: Diverse and Uncertainty-Aware Dexterous Grasp Generation via Flow Variational InferenceGenerates diverse, uncertainty-aware dexterous grasps using flow-based variational inference.N/AlinkN/A
59Tool-as-Interface: Learning Robot Policies from Observing Human Tool UseTransfers tool-use knowledge from human demonstrations to robot visuomotor policies.N/AlinkN/A
60DiWA: Diffusion Policy Adaptation with World ModelsOffline fine-tuning of diffusion policies using a learned world model instead of real interactions.linklinkN/A
61Self-supervised Learning Of Visual Pose Estimation Without Pose Labels By Classifying LED StatesReplaces pose labels with LED-state classification to self-supervise pose estimation.N/AlinkN/A
62Diffusion-Guided Multi-Arm Motion PlanningGuides multi-arm planning with diffusion priors to handle high-dimensional coordination.N/AlinkN/A
63GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question AnsweringEmploys online 3D semantic scene graphs to plan, explore, and answer embodied questions.linklinkN/A
64Enter the Mind Palace: Reasoning and Planning for Long-term Active Embodied Question AnsweringStructured memory (“mind palace”) for long-term EQA with exploration–recall tradeoffs.N/AlinkN/A
65Steerable Scene Generation with Post Training and Inference-Time SearchSteers generative scene models via post-training objectives and search during inference.N/AlinkN/A
66RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action ModelsEnables in-context task adaptation for pre-trained VLA models without full finetuning.LinklinkN/A
67ARCH: Hierarchical Hybrid Learning for Long-Horizon Contact-Rich Robotic AssemblyHierarchical composition of parametric skills plus high-level policy for contact-rich assembly.linklinkN/A
68Pointing3D: A Benchmark for 3D Object Referral via Pointing GesturesBenchmark for grounding 3D object references expressed via human pointing gestures.N/AlinkN/A
69Merging and Disentangling Views in Visual Reinforcement Learning for Robotic ManipulationImproves manipulation RL by merging/disentangling multi-view representations.N/AlinkN/A
70Learning Deployable Locomotion Control via Differentiable SimulationTrains locomotion controllers in differentiable simulation for real-world deployment.N/AlinkN/A
71BEHAVIOR Robot Suite: Streamlining Real-World Whole-Body Manipulation for Everyday Household ActivitiesOpen robot suite + algorithms for bimanual, mobile whole-body household manipulation.linklinklink
72GraspQP: Differentiable Optimization of Force Closure for Diverse and Robust Dexterous GraspingDifferentiable force-closure QP yields diverse, stable dexterous grasps and dataset.linklinklink
73Adapting by Analogy: OOD Generalization of Visuomotor Policies via Functional CorrespondenceImproves OOD generalization by mapping task analogies via functional correspondence.N/AlinkN/A
74Long Range Navigator (LRN): Extending robot planning horizons beyond metric mapsLearns affordance frontiers from vision to plan over horizons far beyond local maps.linklinkN/A
75Toward Real-World Cooperative and Competitive Soccer with Quadrupedal Robot TeamsHierarchical MARL for decentralized quadruped robot soccer in real-world settings.N/AlinkN/A
76Multi-critic Learning for Whole-body End-effector Twist TrackingUses multiple critics to improve whole-body control for accurate end-effector twist tracking.N/AlinkN/A
77SIREN: Semantic, Initialization-Free Registration of Multi-Robot Gaussian Splatting MapsRegisters multi-robot Gaussian splat maps using semantics without requiring initialization.LinklinkN/A
78Rapid Mismatch Estimation via Neural Network Informed Variational InferenceEstimates model–reality mismatch quickly using VI guided by neural networks.N/AlinkN/A
79In-Context Iterative Policy Improvement for Dynamic ManipulationIteratively improves manipulation policies via in-context updates without full retraining.N/AlinkN/A
80Cost-aware Discovery of Contextual Failures using Bayesian Active LearningFinds failure modes with a cost-aware Bayesian active learning strategy.N/AlinkN/A
81KDPE: A Kernel Density Estimation Strategy for Diffusion Policy Trajectory SelectionSelects better diffusion trajectories via kernel density estimation over candidates.N/AlinkN/A
82SocialNav-SUB: Benchmarking VLMs for Scene Understanding in Social Robot NavigationBenchmarks vision-language models for socially aware navigation scene understanding.N/AlinkN/A
83Generating Robot Constitutions & Benchmarks for Semantic SafetyCreates rule “constitutions” and benchmarks to evaluate semantic safety in robots.N/AlinkN/A
84Few-Shot Neuro-Symbolic Imitation Learning for Long-Horizon Planning and ActingCombines neuro-symbolic reasoning with few-shot imitation for long-horizon tasks.N/AlinkN/A
85Capability-Aware Shared Hypernetworks for Flexible Heterogeneous Multi-Robot CoordinationUses shared hypernetworks aware of robot capabilities for heterogeneous team coordination.N/AlinkN/A
86AimBot: A Simple Auxiliary Visual Cue to Enhance Spatial Awareness of Visuomotor PoliciesAdds an auxiliary visual cue to boost spatial awareness in visuomotor policies.N/AlinkN/A
87Beyond Constant Parameters: Hyper Prediction Models and HyperMPCPredicts time-varying parameters via hyper models and integrates them into MPC.N/AlinkN/A
88FLOWER: Democratizing Generalist Robot Policies with Efficient Vision-Language-Flow ModelsBuilds efficient VLF models to make generalist robot policies more accessible.N/AlinkN/A
89Subteaming and Adaptive Formation Control for Coordinated Multi-Robot NavigationDynamically forms subteams and adapts formations for coordinated navigation.N/AlinkN/A
90Force-Modulated Visual Policy for Robot-Assisted Dressing with Arm MotionsIntegrates force modulation into visual policies for safer robot-assisted dressing.N/AlinkN/A
91ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable DiffusionComposes diffusion skills to follow instructions for navigation in dynamic scenes.N/AlinkN/A
92Train-Once Plan-Anywhere Kinodynamic Motion Planning via Diffusion TreesTrains diffusion trees once to enable generalizable kinodynamic motion planning.N/AlinkN/A
93ZipMPC: Compressed Context-Dependent MPC Cost via Imitation LearningLearns compact, context-aware MPC cost functions from demonstrations.N/AlinkN/A
94EndoVLA: Dual-Phase Vision-Language-Action for Precise Autonomous Tracking in EndoscopyTwo-phase VLA framework for accurate autonomous camera tracking in endoscopy.N/AlinkN/A
95Morphologically Symmetric Reinforcement Learning for Ambidextrous Bimanual ManipulationExploits morphological symmetry to learn ambidextrous bimanual manipulation skills.N/AlinkN/A
96Robot Operating Home Appliances by Reading User ManualsExtracts procedural knowledge from manuals to operate home appliances autonomously.N/AlinkN/A
97CARE: Enhancing Safety of Visual Navigation through Collision Avoidance via Repulsive EstimationImproves navigation safety with a repulsive-estimation collision avoidance module.N/AlinkN/A
98MimicFunc: Imitating Tool Manipulation from a Single Human Video via Functional CorrespondenceImitates tool-use from a single video by aligning functional correspondences.N/AlinkN/A
99CogniPlan: Uncertainty-Guided Path Planning with Conditional Generative Layout PredictionPredicts environment layouts conditionally and plans paths with uncertainty guidance.LinklinkN/A
100Fast Flow-based Visuomotor Policies via Conditional Optimal Transport CouplingsTrains fast visuomotor policies using conditional optimal transport–based flow couplings.N/AlinkN/A
101Enabling Long(er) Horizon Imitation for Manipulation Tasks by Modeling Subgoal TransitionsImproves long-horizon imitation by explicitly modeling transitions between subgoals.N/AlinkN/A
102Search-TTA: A Multi-Modal Test-Time Adaptation Framework for Visual Search in the WildPerforms multi-modal test-time adaptation to robustify visual search in-the-wild.N/AlinkN/A
103Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement LearningHierarchical co-self-play enables coordinated multi-drone volleyball behaviors.N/AlinkN/A
104Wheeled Lab: Modern Sim2Real for Low-cost, Open-source Wheeled RoboticsLow-cost open-source wheeled robotics platform with strong sim-to-real pipeline.N/AlinkN/A
105DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot ControlVLM enhanced with a plug-in diffusion expert for general-purpose robot control.LinklinkLink
106From Space to Time: Enabling Adaptive Safety with Learned Value Functions via Disturbance RecastingRecasts disturbances and learns value functions to adapt safety constraints over time.N/AlinkN/A
107Mobi-: Mobilizing Your Robot Learning PolicyFramework/tools to package and deploy learned robot policies across platforms (“mobilize”).LinklinkLink
108Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-top ManipulationCombines visual foresight with task-agnostic pose estimation for table-top tasks.N/AlinkN/A
109Diffusion Dynamics Models with Generative State Estimation for Cloth ManipulationDiffusion-based dynamics and generative state estimation for deformable cloth manipulation.N/AlinkN/A
110Contrastive Forward Prediction Reinforcement Learning for Adaptive Fault-Tolerant Legged RobotsContrastive forward prediction enables adaptive, fault-tolerant legged locomotion.N/AlinkN/A
111Action-Free Reasoning for Policy GeneralizationEncourages high-level reasoning without action supervision to improve generalization.LinklinkN/A
112Learn from What We HAVE: History-Aware VErifier that Reasons about Past Interactions OnlineOnline verifier leverages historical interactions to prevent policy failures.N/AlinkN/A
113KineDex: Learning Tactile-Informed Visuomotor Policies via Kinesthetic Teaching for Dexterous ManipulationKinesthetic teaching with tactile cues to train dexterous visuomotor policies.N/AlinkN/A
114FlashBack: Consistency Model-Accelerated Shared AutonomyUses consistency models to accelerate and stabilize shared autonomy.N/AlinkN/A
115Granular loco-manipulation: Repositioning rocks through strategic sand avalancheManipulates granular media to reposition rocks via controlled sand avalanches.N/AlinkN/A
116D-CODA: Diffusion for Coordinated Dual-Arm Data AugmentationGenerates coordinated bimanual data via diffusion for dual-arm manipulation learning.N/AlinkN/A
117JaxRobotarium: Training and Deploying Multi-Robot Policies in 10 MinutesJAX-based framework for rapid training/deployment of multi-robot policies.N/AlinkN/A
118Uncertainty-aware Latent Safety Filters for Avoiding Out-of-Distribution FailuresLatent-space safety filters with uncertainty estimates to avoid OOD failures.N/AlinkN/A
119ATK: Automatic Task-driven Keypoint Selection for Robust Policy LearningSelects task-relevant keypoints automatically to improve policy robustness.N/AlinkN/A
120ManipBench: Benchmarking Vision-Language Models for Low-Level Robot ManipulationBenchmark to test VLMs on low-level manipulation perception and control tasks.N/AlinkN/A
121IRIS: An Immersive Robot Interaction SystemImmersive system for interacting with robots using mixed/extended reality interfaces.N/AlinkN/A
122ActLoc: Learning to Localize on the Move via Active Viewpoint SelectionActively selects viewpoints to maintain localization accuracy while moving.N/AlinkN/A
123AnyPlace: Learning Generalizable Object Placement for Robot ManipulationLearns placement policies that generalize across objects and contexts.LinklinkLink
124AutoEval: Autonomous Evaluation of Generalist Robot Manipulation Policies in the Real WorldAutomates real-world evaluation of generalist manipulation policies with minimal setup.LinklinkLink
125Poke and Strike: Learning Task-Informed Exploration PoliciesDesigns exploration policies that “poke & strike” based on task-informed signals.N/AlinkN/A
126Ensuring Force Safety in Vision-Guided Robotic Manipulation via Implicit Tactile CalibrationImproves force safety in vision-guided manipulation by implicitly calibrating tactile responses.N/AlinkN/A
127Off Policy Lyapunov Stability in Reinforcement LearningAnalyzes and enforces Lyapunov stability guarantees for off-policy RL controllers.N/AlinkN/A
128ReCoDe: Reinforcement Learning-based Dynamic Constraint Design for Multi-Agent CoordinationLearns task-dependent constraints to coordinate multiple agents more effectively.N/AlinkN/A
129Human-like Navigation in a World Built for HumansPlans and navigates using priors that emulate human motion patterns and preferences.N/AlinkN/A
130Efficient Evaluation of Multi-Task Robot Policies With Active Experiment SelectionActively selects informative trials to evaluate multi-task policies with fewer experiments.N/AlinkN/A
131Fail2Progress: Learning from Real-World Robot Failures with Stein Variational InferenceUses SVGD to turn failure experiences into policy improvements from real robot runs.LinklinkN/A
132ControlVLA: Few-shot Object-centric Adaptation for Pre-trained Vision-Language-Action ModelsAdapts pretrained VLA models to new objects/tasks with few-shot object-centric tuning.N/AlinkN/A
133SafeBimanual: Diffusion-based trajectory optimization for safe bimanual manipulationOptimizes bimanual trajectories with diffusion priors while enforcing safety constraints.N/AlinkN/A
134Junction State Estimation for Efficient Exploration in Reinforcement LearningDetects “junction” states to guide exploration and reduce sample complexity in RL.N/AlinkN/A
135QuaDreamer: Controllable Panoramic Video Generation for Quadruped RobotsGenerates controllable panoramic videos to train and evaluate quadruped perception stacks.N/AlinkN/A
136COMBO-Grasp: Learning Constraint-Based Manipulation for Bimanual Occluded GraspingLearned constraint-based policies for robust bimanual grasping under occlusion.N/AlinkN/A
137D-Cubed: Latent Diffusion Trajectory Optimisation for Dexterous Deformable ManipulationOptimizes dexterous trajectories for deformables using latent diffusion models.LinklinkN/A
138Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot ManipulationExtends VLA planning capabilities to long-horizon manipulation tasks.LinklinkN/A
139ImLPR: Image-based LiDAR Place Recognition using Vision Foundation ModelsLeverages VFM features for robust image-based LiDAR place recognition.N/AlinkN/A
140MoTo: A Zero-shot Plug-in Interaction-aware Navigation for General Mobile ManipulationZero-shot, plugin-based navigation that accounts for interactions in mobile manipulation.N/AlinkN/A
141RobotxR1: Enabling Embodied Robotic Intelligence on Large Language Models through Closed-Loop Reinforcement LearningCombines LLM reasoning with closed-loop RL for embodied robotic tasks.N/AlinkN/A
142GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action DataPretrains a grasping foundation model on large-scale synthetic action sequences.LinklinkLink
143Learning from 10 Demos: Generalisable and Sample-Efficient Policy Learning with Oriented Affordance FramesAchieves generalization from ~10 demos using oriented affordance-frame supervision.N/AlinkN/A
144Learning Long-Context Diffusion Policies via Past-Token PredictionTrains diffusion policies to leverage long past-context using next/past-token prediction.LinklinkN/A
145Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot ManipulationGenerates diverse human videos in novel scenes to bootstrap generalizable manipulation.LinklinkN/A
146Articulate AnyMesh: Open-vocabulary 3D Articulated Objects ModelingModels open-vocabulary articulated objects by inferring meshes and kinematic structure.N/AlinkN/A
147Phantom: Training Robots Without Robots Using Only Human VideosTrains robot policies purely from human videos without robot data collection.LinklinkLink
148Residual Neural Terminal Constraint for MPC-based Collision Avoidance in Dynamic EnvironmentsAdds a learned residual terminal constraint to MPC for safer collision avoidance.N/AlinkN/A
149Hold My Beer: Learning Gentle Humanoid Locomotion and End-Effector Stabilization ControlTrains humanoids for soft-contact locomotion with stabilized end-effector control.N/AlinkN/A
150TReF-6: Inferring Task-Relevant Frames from a Single Demonstration for One-Shot Skill GeneralizationInfers task-relevant frames from a single demo to enable one-shot skill generalization.N/AlinkN/A
151UniTac2Pose: A Unified Approach Learned in Simulation for Category-level Visuotactile In-hand Pose EstimationUnifies visual+tactile cues in sim to estimate in-hand pose at the category level.N/AlinkN/A
152Bipedal Balance Control with Whole-body Musculoskeletal Standing and Falling SimulationsUses musculoskeletal simulations of standing/falling to learn robust biped balance control.N/AlinkN/A
153Do LLM Modules Generalize? A Study on Motion Generation for Autonomous DrivingEvaluates whether LLM-based modules generalize to unseen driving motion generation tasks.N/AlinkN/A
154AgentWorld: An Interactive Simulation Platform for Scene Construction and Mobile Robotic ManipulationInteractive platform for constructing scenes and training mobile manipulation policies.N/AlinkN/A
155FastUMI: A Scalable and Hardware-Independent Universal Manipulation Interface with DatasetHardware-agnostic manipulation interface with a large supporting dataset for scaling.linklinklink
156Towards Generalizable Safety in Crowd Navigation via Conformal Uncertainty HandlingApplies conformal uncertainty methods to ensure safety during crowd navigation.N/Alinklink
157Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic ManipulationUses VLMs with reflection to plan multi-stage long-horizon manipulation sequences.linklinklink
158Unsupervised Skill Discovery as Exploration for Learning Agile LocomotionDiscovers diverse skills for locomotion, turning exploration into agile behaviors.N/AlinkN/A
159HyperTASR: Hypernetwork-Driven Task-Aware Scene Representations for Robust ManipulationHypernetworks generate task-aware scene embeddings to improve manipulation robustness.N/AlinkN/A
160GENNAV: Polygon Mask Generation for Generalized Referring Navigable RegionsGenerates polygon masks for referred navigable regions to guide embodied navigation.linklinkN/A
161PicoPose: Progressive Pixel-to-Pixel Correspondence Learning for Novel Object Pose EstimationLearns dense correspondences progressively to estimate 6D poses of novel objects.N/AlinkN/A
162CHD: Coupled Hierarchical Diffusion for Long-Horizon TasksCouples hierarchical policies with diffusion for scalable long-horizon task planning.N/AlinkN/A
163BEVCalib: LiDAR-Camera Calibration via Geometry-Guided Bird’s-Eye View RepresentationPerforms LiDAR–camera calibration using geometry cues in BEV space without markers.linklinklink
164Latent Adaptive Planner for Dynamic ManipulationPlans dynamic manipulations by adapting in a learned latent space of strategies.N/AlinkN/A
165SLAC: Simulation-Pretrained Latent Action Space for Whole-Body Real-World RLPretrains a latent action space in sim to accelerate whole-body RL on hardware.linklinklink
166Neural Robot DynamicsLearns differentiable robot dynamics models that capture complex contact effects.linklinklink
167GC-VLN: Instruction as Graph Constraints for Training-free Vision-and-Language NavigationTurns instructions into graph constraints to enable training-free VLN execution.N/AlinkN/A
168Constrained Style Learning from Imperfect Demonstrations under Task OptimalityExtracts task-consistent style from noisy demos while enforcing optimality constraints.N/AlinkN/A
169TypeTele: Releasing Dexterity in Teleoperation by Dexterous Manipulation TypesTeleop framework decomposed by manipulation “types” to increase dexterous capability.linklinkN/A
170VT-Refine: Learning Bimanual Assembly with Visuo-Tactile Feedback via Simulation Fine-TuningCombines vision+tactile feedback with sim-finetuning for precise bimanual assembly.N/AlinkN/A
171Adapt3R: Adaptive 3D Scene Representation for Domain Transfer in Imitation LearningAdapts 3D scene representations to new domains to improve imitation policy transfer.N/AlinkN/A
172FOMO-3D: Using Vision Foundation Models for Long-Tailed 3D Object DetectionLeverages VFM priors to handle long-tailed distributions in 3D detection tasks.N/AlinkN/A
173Extracting Visual Plans from Unlabeled Videos via Symbolic GuidanceInduces symbolic plans from unlabeled videos and converts them to robot-executable steps.N/AlinkN/A
174Self-supervised perception for tactile skin covered dexterous handsSelf-supervised learning for perception on dexterous hands covered with tactile skin.N/AlinkN/A
175Predictive Red Teaming: Breaking Policies Without Breaking Robots“Red teams” robot policies in simulation to expose failures before real-world deployment.linklinkN/A
176Learning Long-Horizon Robot Manipulation Skills via Privileged ActionUses privileged action signals during training to acquire long-horizon manipulation skills.N/AlinkN/A
177Towards Embodiment Scaling Laws in Robot LocomotionEmpirical study of how embodiment and data scale affect locomotion policy performance.N/AlinkN/A
178O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic ManipulationOne-shot affordance grounding between novel 3D objects to generalize manipulation skills.N/AlinkN/A
179Estimating Value of Assistance for Online POMDP Robotic AgentsQuantifies assistance value online to decide when human help benefits a POMDP agent.N/AlinkN/A
180Shortcut Learning in Generalist Robot Policies: The Role of Dataset Diversity and FragmentationAnalyzes shortcut biases and how dataset diversity/fragmentation impact generalist policies.N/AlinkN/A
181SDS – See it, Do it, Sorted: Quadruped Skill Synthesis from Single Video DemonstrationDerives quadruped skills from a single video demo using perception-to-action synthesis.linklinklink
182TrackVLA: Embodied Visual Tracking in the WildEmbeds tracking into VLA frameworks for robust in-the-wild target following.linklinklink
183GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic ManipulationLeverages human behavior data to improve affordance learning for manipulation tasks.N/AlinkN/A
184LaDi-WM: A Latent Diffusion-Based World Model for Predictive ManipulationUses latent diffusion world models to predict future states for manipulation planning.N/AlinkN/A
185ManiFlow: A General Robot Manipulation Policy via Consistency Flow TrainingTrains a general manipulation policy using consistency-based flow training objectives.linklinkN/A
186Robot Learning from Any ImagesBootstraps visuomotor skills from broad internet-scale images via clever supervision.N/AlinkN/A
187Deep Reactive Policy: Learning Reactive Manipulator Motion Planning for Dynamic EnvironmentsEnd-to-end learned reactive planner for manipulators operating in dynamic scenes.linklinkN/A
188CASPER: Inferring Diverse Intents for Assistive Teleoperation with Vision Language ModelsInfers user intent distributions via VLMs to assist teleoperation effectively.N/AlinkN/A
189UniSkill: Imitating Human Videos via Cross-Embodiment Skill RepresentationsTransfers skills from human videos to robots using cross-embodiment representations.linklinklink
190ParticleFormer: A 3D Point Cloud World Model for Multi-Object, Multi-Material Robotic ManipulationParticle-based world model on point clouds to handle multi-object, multi-material dynamics.N/AlinkN/A
191Crossing the Human-Robot Embodiment Gap with Sim-to-Real RL using One Human DemonstrationBridges human-to-robot embodiment gap via sim-to-real RL seeded by one human demo.N/Alinklink
192One Demo is Worth a Thousand Trajectories: Action-View Augmentation for Visuomotor PoliciesAction-view augmentation from a single demo to train robust visuomotor policies.N/AlinkN/A
193VLM-AD: End-to-End Autonomous Driving through Vision-Language Model SupervisionSupervises end-to-end driving policies using high-level VLM reasoning signals.N/AlinkN/A
194LLM-Guided Probabilistic Program Induction for POMDP Model EstimationUses LLMs to induce probabilistic programs that estimate POMDP dynamics/observations.N/AlinkN/A
195Vision in Action: Learning Active Perception from Human DemonstrationsLearns active perception strategies from human demos for better task performance.linklinklink
196Point Policy: Unifying Observations and Actions with Key Points for Robot ManipulationRepresents both observations and actions as keypoints to simplify manipulation learning.linklinklink
197From Tabula Rasa to Emergent Abilities: Discovering Robot Skills via Real-World Unsupervised Quality-DiversityDiscovers diverse real-world skills via unsupervised quality-diversity search.N/AlinkN/A
198Robust Dexterous Grasping of General ObjectsDesigns policies for robust dexterous grasping across varied, previously unseen objects.linklinklink
199Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on HumanoidsTransfers vision-based dexterous manipulation skills onto humanoid platforms via RL.linklinkN/A
200Humanoid Policy ~ Human PolicyExplores alignment between humanoid robot policies and human-like control strategies.linklinklink
201ToddlerBot: Open-Source ML-Compatible Humanoid Platform for Loco-ManipulationOpen-source humanoid platform designed for learning-based loco-manipulation research.linklinklink
202TWIST: Teleoperated Whole-Body Imitation SystemTeleoperation framework enabling full-body imitation to collect rich humanoid data.linklinklink
203exUMI: Extensible Robot Teaching System with Action-aware Task-agnostic Tactile RepresentationExtensible teaching system that learns task-agnostic tactile reps aware of action context.N/AlinkN/A
204OPAL: Visibility-aware LiDAR-to-OpenStreetMap Place Recognition via Adaptive Radial FusionPerforms LiDAR↔OSM place recognition using visibility-aware, radial fusion in BEV.N/AlinkN/A
205CDP: Towards Robust Autoregressive Visuomotor Policy Learning via Causal DiffusionIntroduces causal diffusion to stabilize autoregressive visuomotor policy learning.N/AlinkN/A
206Robot Trains Robot: Automatic Real-World Policy Adaptation and Learning for HumanoidsHumanoids auto-adapt policies in the real world via self-training and evaluation loops.N/AlinkN/A
207See, Point, Fly: A Learning-Free VLM Framework for Universal Unmanned Aerial NavigationLearning-free VLM pipeline that parses language/vision prompts for UAV navigation targets.linklinklink
208LaVA-Man: Learning Visual Action Representations for Robot ManipulationLearns visual action embeddings to improve generalization in robot manipulation.N/AlinkN/A
2093DS-VLA: A 3D Spatial-Aware Vision Language Action Model for Robust Multi-Task ManipulationVLA model with explicit 3D spatial awareness for robust, multi-task manipulation.N/AlinkN/A
210Uncertainty-aware Accurate Elevation Modeling for Off-road Navigation via Neural ProcessesNeural processes produce uncertainty-aware elevation maps for safer off-road planning.N/AlinkN/A
211Generalist Robot Manipulation beyond Action Labeled DataTrains generalist manipulation policies without relying on explicit action labels.linklinklink
212BranchOut: Capturing Realistic Multimodality in Autonomous Driving DecisionsModels branching, multimodal futures to better capture diverse driving decisions.N/AlinkN/A
213Co-Design of Soft Gripper with Neural PhysicsJointly optimizes soft gripper design and control with differentiable neural physics.linklinklink
214Elucidating the Design Space of Torque-aware Vision-Language-Action ModelsSystematic study of torque-aware VLA design choices for manipulation performance.N/AlinkN/A
215RoboChemist: Long-Horizon and Safety-Compliant Robotic Chemical ExperimentationAutomates long-horizon chemical experiments with explicit safety constraints.N/AlinkN/A
216COLLAGE: Adaptive Fusion-based Retrieval for Augmented Policy LearningRetrieves and fuses relevant experience adaptively to augment policy learning.linklinklink
217GraspMolmo: Generalizable Task-Oriented Grasping via Large-Scale Synthetic Data GenerationGenerates large-scale synthetic data to train task-oriented grasping policies.linklinklink
218Motion Blender Gaussian Splatting for Dynamic ReconstructionCombines motion blending with Gaussian splats to reconstruct dynamic scenes.N/AlinkN/A
219Improving Efficiency of Sampling-based Motion Planning via Message-Passing Monte CarloMessage-passing Monte Carlo reduces variance and improves sampling-based planning efficiency.N/AlinkN/A
220CaRL: Learning Scalable Planning Policies with Simple RewardsScales planning policies using simple reward structures with strong generalization.N/AlinkN/A
221Pseudo-Simulation for Autonomous DrivingUses pseudo-simulated data to train and evaluate driving policies more efficiently.N/Alinklink
corl-2025
robotics
robot-learning

smallfryy/corl-2025-papers

✨ 200+ robotics papers from CoRL 2025, with TLDRs, project pages, code, and more

85

12 commits

updated Oct 1, 2025

See the code

README

CoRL 2025 Papers

A list of 200+ CoRL papers (orals & posters) with TLDRs, project pages, code, etc

CORL Logo

Orals

#Paper TitleTLDRProject PagePaperCode
1ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered ScenesTwo-stage teacher–student framework enabling zero-shot dexterous grasping in clutter.linklinklink
2ScrewSplat: An End-to-End Method for Articulated Object RecognitionLearns geometry and kinematics from RGB using Gaussian splatting with screw axes.N/Alinklink
3Visual Imitation Enables Contextual Humanoid ControlLarge-scale visual imitation enables humanoids to act contextually in varied environments.N/Alinklink
4Sampling-based System Identification with Active Exploration for Legged Sim2Real LearningActive exploration improves system ID and sim-to-real transfer for legged robots.N/Alinklink
5DemoSpeedup: Accelerating Visuomotor Policies via Entropy-Guided Demonstration AccelerationSpeeds up visuomotor policy training by entropy-guided demo selection.N/AlinkN/A
6RoboArena: Distributed Real-World Evaluation of Generalist Robot PoliciesDistributed real-world benchmark for evaluating generalist robot policies.linklinklink
7Latent Theory of Mind: A Decentralized Diffusion Architecture for Cooperative ManipulationMulti-agent cooperative manipulation via diffusion-based latent theory of mind.N/AlinkN/A
8Non-conflicting Energy Minimization in Reinforcement Learning based Robot ControlEnergy-efficient robot control via non-conflicting energy minimization in RL.N/AlinkN/A
9Belief-Conditioned One-Step Diffusion: Real-Time Trajectory Planning with Just-Enough SensingDiffusion planner for real-time trajectories under partial observability.N/AlinkN/A
10Cross-Sensor Touch GenerationGenerates cross-sensor tactile signals to improve robot perception.linkOpenReviewN/A
11X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-RealReal-to-sim-to-real pipeline for transferring skills across robot embodiments.linklinkN/A
12Data Retrieval with Importance Weights for Few-Shot Imitation LearningImproves few-shot imitation learning by weighting retrieved demos for efficiency.N/AlinkN/A
13Versatile Loco-Manipulation through Flexible Interlimb CoordinationEnables loco-manipulation by flexibly coordinating robot limbs.N/AlinkN/A
14Reactive In-Air Clothing Manipulation with Confidence-Aware Dense Correspondence and Visuotactile AffordanceIn-air garment manipulation using dense visual-tactile correspondences and affordances.N/AlinkN/A
15Training Strategies for Efficient Embodied ReasoningProposes strategies to make embodied reasoning more efficient.N/AlinkN/A
16Divide, Discover, Deploy: Factorized Skill Learning with Symmetry and Style PriorsFactorized skill learning with priors for modular deployment.linklinkN/A
17Tactile Beyond Pixels: Multisensory Touch Representations for Robot ManipulationBuilds rich tactile representations that fuse multiple modalities.N/AlinkN/A
18Planning from Point Clouds over Continuous Actions for Multi-object RearrangementPlanner for rearrangement tasks directly from raw point clouds.N/AlinkN/A
19Stack It Up!: 3D Stable Structure Generation from 2D Hand-drawn SketchConverts 2D sketches into physically stable 3D structures.N/AlinkN/A
20DexSkin: High-Coverage Conformable Robotic Skin for Learning Contact-Rich ManipulationFlexible, conformable robotic skin for learning contact-rich tasks.N/AlinkN/A
21SAVOR: Skill Affordance Learning from Visuo-Haptic Perception for Robot-Assisted Bite AcquisitionLearns visuo-haptic affordances for assistive bite acquisition.N/AlinkN/A
22SAIL: Faster-than-Demonstration Execution of Imitation Learning PoliciesExecutes imitation learning policies faster than human demonstrations.N/AlinkN/A
23Geometric Red-Teaming for Robotic ManipulationStress-tests robot manipulation with geometric adversaries.N/AlinkN/A
24HuB: Learning Extreme Humanoid BalanceTrains humanoids for extreme balancing and recovery.N/AlinkN/A
25Vision-Language-Action Model with Open-World GeneralizationVLA model trained to generalize to open-world robotic tasks.N/AlinkN/A
26Fabrica: Dual-Arm Assembly of General Multi-Part Objects via Integrated Planning and LearningCombines planning and learning for generalizable dual-arm multi-part assembly.N/AlinkN/A
27Streaming Flow Policy: Simplifying diffusion/flow-matching policies by treating action trajectories as flow trajectoriesSimplifies diffusion policies by reformulating action trajectories as flow trajectories.N/AlinkN/A
28Steering Your Diffusion Policy with Latent Space Reinforcement LearningUses reinforcement learning in latent space to guide and improve diffusion policies.linklinklink
29AirExo-2: Scaling up Generalizable Robotic Imitation Learning with Low-Cost ExoskeletonsScales robotic imitation learning using low-cost wearable exoskeleton data collection.linklinkN/A
30FetchBot: Learning Generalizable Object Fetching in Cluttered Scenes via Zero-Shot Sim2RealZero-shot sim-to-real transfer for object fetching in cluttered environments.linklinkN/A
31One View, Many Worlds: Single-Image to 3D Object Meets Generative Domain Randomization for One-Shot 6D Pose EstimationOne-shot 6D pose estimation using single-image 3D object generation with domain randomization.N/Alinklink
32KineSoft: Learning Proprioceptive Manipulation Policies with Soft Robot HandsTrains manipulation policies for soft robot hands using proprioceptive sensing.N/AlinkN/A
33Real2Render2Real: Scaling Robot Data Without Dynamics Simulation or Robot HardwareData scaling pipeline using rendering to bypass robot hardware and dynamics simulation.N/Alinklink
34FACET: Force-Adaptive Control via Impedance Reference Tracking for Legged RobotsForce-adaptive impedance tracking improves control of legged robots.N/AlinkN/A
35DexUMI: Using Human Hand as the Universal Manipulation Interface for Dexterous ManipulationLeverages the human hand as a universal interface for dexterous robotic manipulation.N/Alinklink
36The Sound of Simulation: Learning Multimodal Sim-to-Real Robot Policies with Generative AudioIntegrates audio with vision for multimodal sim-to-real robot policies.linklinkN/A
37ReWiND: Language-Guided Rewards Teach Robot Policies without New DemonstrationsUses language-guided rewards to improve robot policies without requiring new demos.N/AlinkN/A
38Learning a Unified Policy for Position and Force Control in Legged Loco-ManipulationUnified policy framework for position and force control in legged loco-manipulation.N/AlinkN/A
39Omni-Perception: Omnidirectional Collision Avoidance of Legged Robots in Dynamic EnvironmentsOmnidirectional perception enables collision avoidance for legged robots in dynamic settings.N/AlinkN/A
40Real-Time Out-of-Distribution Failure Prevention via Multi-Modal ReasoningPrevents OOD failures in real-time with multi-modal reasoning.N/AlinkN/A
41LocoFormer: Generalist Locomotion via Long-context AdaptationGeneralist locomotion policy trained with long-context sequence adaptation.linklinklink
42ImMimic: Cross-Domain Imitation from Human Videos via Mapping and InterpolationCross-domain imitation by mapping and interpolating human videos for robot learning.N/AlinkN/A

Posters

#Paper TitleTLDRProject PagePaperCode
1CLONE: Closed-Loop Whole-Body Humanoid Teleoperation for Long-Horizon TasksRobust whole-body humanoid teleoperation using mixture-of-experts control and LiDAR correction.linklinkN/A
2Disentangled Multi-Context Meta-Learning: Unlocking Robust and Generalized Task LearningDisentangles task factors for robust meta-learning and sim-to-real transfer.N/AlinkN/A
3Meta-Optimization and Program Search using Language Models for Task and Motion PlanningUses LLMs for meta-optimization and program search in task and motion planning.N/AlinkN/A
4Text2Touch: Tactile In-Hand Manipulation with LLM-Designed Reward FunctionsLeverages LLM-designed reward functions for tactile in-hand robot manipulation.N/AlinkN/A
5Multi-Loco: Unifying Multi-Embodiment Legged Locomotion via Reinforcement Learning Augmented DiffusionUnifies locomotion control across embodiments with RL-augmented diffusion models.N/AlinkN/A
6SimShear: Sim-to-Real Shear-based Tactile ServoingUses shear-based tactile feedback for sim-to-real transfer in tactile servoing.N/AlinkN/A
7Focusing on What Matters: Object-Agent-centric Tokenization for Vision Language Action modelsIntroduces object-agent-centric tokenization to improve VLA model reasoning.N/AOpenReviewN/A
8AT-Drone: Benchmarking Adaptive Teaming in Multi-Drone PursuitBenchmark for evaluating adaptive teaming strategies in multi-drone pursuit tasks.N/AlinkN/A
9Uncertainty-Aware Scene Understanding via Efficient Sampling-Free Confidence EstimationConfidence estimation for scene understanding without expensive sampling.N/AlinkN/A
10ObjectReact: Learning Object-Relative Control for Visual NavigationLearns object-relative navigation control for robust visual navigation.LinklinkLink
11Decentralized Aerial Manipulation of a Cable-Suspended Load Using Multi-Agent Reinforcement LearningDecentralized multi-agent RL for aerial manipulation of suspended loads.N/AlinkN/A
12ReasonPlan: Unified Scene Prediction and Decision Reasoning for Closed-loop Autonomous DrivingIntegrates scene prediction and decision reasoning for end-to-end autonomous driving.N/AlinkN/A
13Embrace Contacts: humanoid shadowing with full body ground contactsEnables humanoid shadowing with consistent full-body ground contacts.N/AlinkN/A
14Distilling for Long-Horizon Prehensile and Non-Prehensile ManipulationDistills policies to handle long-horizon prehensile and non-prehensile tasks.N/AlinkN/A
15Constraint-Aware Diffusion Guidance for Robotics: Real-Time Obstacle Avoidance for Autonomous RacingUses diffusion guidance for real-time obstacle avoidance in racing scenarios.N/AlinkN/A
16Learning Impact-Rich Rotational Maneuvers via Centroidal Velocity Rewards and Sim-to-Real Techniques: A One-Leg Hopper Flip Case StudyTrains one-leg hopper to flip using impact-rich rewards and sim-to-real techniques.N/AlinkN/A
17LodeStar: Long-horizon Dexterity via Synthetic Data Augmentation from Human DemonstrationsEnhances dexterity with synthetic data augmentation from human demonstrations.linklinkN/A
18Imitation Learning Based on Disentangled Representation Learning of Behavioral CharacteristicsApplies disentangled representation learning for imitation learning of behaviors.N/AlinkN/A
19Motion Priors Reimagined: Adapting Flat-Terrain Skills for Complex Quadruped MobilityAdapts flat-terrain locomotion skills to complex terrains using motion priors.linklinklink
20Sequence Modeling for Time-Optimal Quadrotor Trajectory Optimization with Sampling-based Robustness AnalysisApplies sequence modeling for fast and robust quadrotor trajectory optimization.N/AlinkN/A
21HALO: Human Preference Aligned Offline Reward Learning for Robot NavigationAligns offline reward learning with human preferences for navigation tasks.N/AlinkN/A
22RoboMonkey: Scaling Test-Time Sampling and Verification for Vision-Language-Action ModelsScales up verification and sampling for VLA models during test-time.linklinklink
23Constraint-Preserving Data Generation for One-Shot Visuomotor Policy GeneralizationGenerates constraint-preserving data to improve one-shot visuomotor generalization.N/AlinkN/A
24Hand-Eye Autonomous Delivery: Learning Humanoid Navigation, Locomotion and ReachingTrains humanoid robots for navigation and reaching in delivery scenarios.N/AlinkN/A
25FLARE: Robot Learning with Implicit World ModelingImplicit world modeling for more efficient and robust robot learning.N/AlinkN/A
26From Real World to Logic and Back: Learning Generalizable Relational Concepts For Long Horizon Robot PlanningLearns relational concepts that bridge real-world experience with symbolic planning for long-horizon tasks.N/AlinkN/A
27NeuralSVCD for Efficient Swept Volume Collision DetectionNeural approach to fast swept-volume–based collision detection for motion planning.N/AlinkN/A
28MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from InterventionInverse RL method that aligns policies from sparse interventions via max-entropy residual Q-learning.LinklinkN/A
29Joint Model-based Model-free Diffusion for Planning with ConstraintsCombines model-based and model-free diffusion to plan under explicit constraints.N/AlinkLink
30DEQ-MPC : Deep Equilibrium Model Predictive ControlUses deep equilibrium networks to solve MPC problems efficiently at inference time.N/AlinkN/A
31CUPID: Curating Data your Robot Loves with Influence FunctionsApplies influence functions to select training data that most benefits robot learning.N/AlinkN/A
32Eye, Robot: Learning to Look to Act with a BC-RL Perception-Action LoopTrains perception to support action using a behavior-cloning + RL loop for active visual policies.N/AlinkN/A
33Imagine, Verify, Execute: Memory-guided Agentic Exploration with Vision-Language ModelsUses VLMs with memory to imagine plans, verify outcomes, and execute tasks agentically.linklinkN/A
34Dynamics-Compliant Trajectory Diffusion for Super-Nominal Payload ManipulationGenerates manipulation trajectories via diffusion that respect dynamics under heavy payloads.N/AlinkN/A
35CoRI: Communication of Robot Intent for Physical Human-Robot InteractionFramework for communicating robot intent to improve safety and fluency in pHRI.N/AlinkN/A
36KoopMotion: Learning Almost Divergence Free Koopman Flow Fields for Motion PlanningLearns Koopman operator–based flow fields that guide smooth, divergence-free motion plans.N/AlinkN/A
37Learning Smooth State-Dependent Traversability from Dense Point CloudsPredicts traversability as a smooth, state-dependent function directly from dense 3D point clouds.N/AlinkN/A
38Leveraging Correlation Across Test Platforms for Variance-Reduced Metric EstimationReduces evaluation variance by exploiting correlations across heterogeneous testbeds.N/AlinkN/A
39Agreement Volatility: A Second-Order Metric for Uncertainty Quantification in Surgical Robot LearningIntroduces a second-order metric capturing volatility in model agreement to quantify uncertainty.N/AlinkN/A
40Sample-Efficient Online Control Policy Learning with Real-Time Recursive Model UpdatesOnline control learning with recursive updates to maintain real-time performance.N/AlinkN/A
41Lucid-XR: An Extended-Reality Data Engine for Robotic ManipulationBuilds an XR-based engine to synthesize diverse manipulation data at scale.N/AOpenReviewN/A
42CLAMP: Crowdsourcing a LArge-scale in-the-wild haptic dataset with an open-source device for Multimodal robot PerceptionCollects large-scale in-the-wild haptic data using an open-source crowdsourced device.N/AlinkN/A
43Distributed Upload and Active Labeling for Resource-Constrained Fleet LearningActive labeling and distributed upload strategies tailored for fleet learning under bandwidth limits.N/AOpenReviewN/A
44DreamGen: Unlocking Generalization in Robot Learning through Video World ModelsUses video world models to improve generalization across robot tasks and environments.N/AlinkN/A
45LocoTouch: Learning Dynamic Quadrupedal Transport with Tactile SensingIncorporates tactile feedback for robust, dynamic quadruped transport behaviors.N/AlinkN/A
46TopoCut: Learning Multi-Step Cutting with Spectral Rewards and Discrete Diffusion PoliciesSolves multi-step cutting via discrete diffusion guided by topology-aware rewards.N/AlinkN/A
47WoMAP: World Models For Embodied Open-Vocabulary Object LocalizationUses open-vocabulary world models to localize objects for embodied agents.N/AlinkN/A
48MirrorDuo: Reflection-Consistent Visuomotor Learning from Mirrored Demonstration PairsImproves visuomotor learning by enforcing reflection consistency across mirrored demos.N/AOpenReviewN/A
49First Order Model-Based RL through Decoupled BackpropagationEnables efficient model-based RL via a first-order method with decoupled gradients.N/AlinkN/A
50CLASS: Contrastive Learning via Action Sequence Supervision for Robot ManipulationContrastive pretraining supervised by action sequences to enhance manipulation policies.N/AlinkN/A
51Articulated Object Estimation in the WildEstimates articulation and pose of everyday objects from unconstrained, real-world data.N/AlinkN/A
52Multimodal Fused Learning for Solving the Generalized Traveling Salesman Problem in Robotic Task PlanningFuses multiple sensing/modalities to solve generalized TSP instances for robot task planning.N/AlinkN/A
53Dexplore: Scalable Neural Control for Dexterous Manipulation from Reference Scoped ExplorationUnified optimization uses MoCap as soft guidance to scale dexterous manipulation control.N/AlinkN/A
54PrioriTouch: Adapting to User Contact Preferences for Whole-Arm Physical Human-Robot InteractionLearns and prioritizes user-specific contact preferences for safer whole-arm pHRI.linklinkN/A
55UnPose: Uncertainty-Guided Diffusion Priors for Zero-Shot Pose EstimationUses diffusion priors with uncertainty to enable model-free, zero-shot 6D pose estimation.N/AlinkN/A
56Distilling On-device Language Models for Robot Planning with Minimal Human InterventionDistills compact LMs on-device to plan robot actions with minimal human supervision.N/AlinkN/A
57Mechanistic Interpretability for Steering Vision-Language-Action ModelsProbes and steers VLA internals using mech-int tools to improve safety and control.N/AlinkN/A
58FFHFlow: Diverse and Uncertainty-Aware Dexterous Grasp Generation via Flow Variational InferenceGenerates diverse, uncertainty-aware dexterous grasps using flow-based variational inference.N/AlinkN/A
59Tool-as-Interface: Learning Robot Policies from Observing Human Tool UseTransfers tool-use knowledge from human demonstrations to robot visuomotor policies.N/AlinkN/A
60DiWA: Diffusion Policy Adaptation with World ModelsOffline fine-tuning of diffusion policies using a learned world model instead of real interactions.linklinkN/A
61Self-supervised Learning Of Visual Pose Estimation Without Pose Labels By Classifying LED StatesReplaces pose labels with LED-state classification to self-supervise pose estimation.N/AlinkN/A
62Diffusion-Guided Multi-Arm Motion PlanningGuides multi-arm planning with diffusion priors to handle high-dimensional coordination.N/AlinkN/A
63GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question AnsweringEmploys online 3D semantic scene graphs to plan, explore, and answer embodied questions.linklinkN/A
64Enter the Mind Palace: Reasoning and Planning for Long-term Active Embodied Question AnsweringStructured memory (“mind palace”) for long-term EQA with exploration–recall tradeoffs.N/AlinkN/A
65Steerable Scene Generation with Post Training and Inference-Time SearchSteers generative scene models via post-training objectives and search during inference.N/AlinkN/A
66RICL: Adding In-Context Adaptability to Pre-Trained Vision-Language-Action ModelsEnables in-context task adaptation for pre-trained VLA models without full finetuning.LinklinkN/A
67ARCH: Hierarchical Hybrid Learning for Long-Horizon Contact-Rich Robotic AssemblyHierarchical composition of parametric skills plus high-level policy for contact-rich assembly.linklinkN/A
68Pointing3D: A Benchmark for 3D Object Referral via Pointing GesturesBenchmark for grounding 3D object references expressed via human pointing gestures.N/AlinkN/A
69Merging and Disentangling Views in Visual Reinforcement Learning for Robotic ManipulationImproves manipulation RL by merging/disentangling multi-view representations.N/AlinkN/A
70Learning Deployable Locomotion Control via Differentiable SimulationTrains locomotion controllers in differentiable simulation for real-world deployment.N/AlinkN/A
71BEHAVIOR Robot Suite: Streamlining Real-World Whole-Body Manipulation for Everyday Household ActivitiesOpen robot suite + algorithms for bimanual, mobile whole-body household manipulation.linklinklink
72GraspQP: Differentiable Optimization of Force Closure for Diverse and Robust Dexterous GraspingDifferentiable force-closure QP yields diverse, stable dexterous grasps and dataset.linklinklink
73Adapting by Analogy: OOD Generalization of Visuomotor Policies via Functional CorrespondenceImproves OOD generalization by mapping task analogies via functional correspondence.N/AlinkN/A
74Long Range Navigator (LRN): Extending robot planning horizons beyond metric mapsLearns affordance frontiers from vision to plan over horizons far beyond local maps.linklinkN/A
75Toward Real-World Cooperative and Competitive Soccer with Quadrupedal Robot TeamsHierarchical MARL for decentralized quadruped robot soccer in real-world settings.N/AlinkN/A
76Multi-critic Learning for Whole-body End-effector Twist TrackingUses multiple critics to improve whole-body control for accurate end-effector twist tracking.N/AlinkN/A
77SIREN: Semantic, Initialization-Free Registration of Multi-Robot Gaussian Splatting MapsRegisters multi-robot Gaussian splat maps using semantics without requiring initialization.LinklinkN/A
78Rapid Mismatch Estimation via Neural Network Informed Variational InferenceEstimates model–reality mismatch quickly using VI guided by neural networks.N/AlinkN/A
79In-Context Iterative Policy Improvement for Dynamic ManipulationIteratively improves manipulation policies via in-context updates without full retraining.N/AlinkN/A
80Cost-aware Discovery of Contextual Failures using Bayesian Active LearningFinds failure modes with a cost-aware Bayesian active learning strategy.N/AlinkN/A
81KDPE: A Kernel Density Estimation Strategy for Diffusion Policy Trajectory SelectionSelects better diffusion trajectories via kernel density estimation over candidates.N/AlinkN/A
82SocialNav-SUB: Benchmarking VLMs for Scene Understanding in Social Robot NavigationBenchmarks vision-language models for socially aware navigation scene understanding.N/AlinkN/A
83Generating Robot Constitutions & Benchmarks for Semantic SafetyCreates rule “constitutions” and benchmarks to evaluate semantic safety in robots.N/AlinkN/A
84Few-Shot Neuro-Symbolic Imitation Learning for Long-Horizon Planning and ActingCombines neuro-symbolic reasoning with few-shot imitation for long-horizon tasks.N/AlinkN/A
85Capability-Aware Shared Hypernetworks for Flexible Heterogeneous Multi-Robot CoordinationUses shared hypernetworks aware of robot capabilities for heterogeneous team coordination.N/AlinkN/A
86AimBot: A Simple Auxiliary Visual Cue to Enhance Spatial Awareness of Visuomotor PoliciesAdds an auxiliary visual cue to boost spatial awareness in visuomotor policies.N/AlinkN/A
87Beyond Constant Parameters: Hyper Prediction Models and HyperMPCPredicts time-varying parameters via hyper models and integrates them into MPC.N/AlinkN/A
88FLOWER: Democratizing Generalist Robot Policies with Efficient Vision-Language-Flow ModelsBuilds efficient VLF models to make generalist robot policies more accessible.N/AlinkN/A
89Subteaming and Adaptive Formation Control for Coordinated Multi-Robot NavigationDynamically forms subteams and adapts formations for coordinated navigation.N/AlinkN/A
90Force-Modulated Visual Policy for Robot-Assisted Dressing with Arm MotionsIntegrates force modulation into visual policies for safer robot-assisted dressing.N/AlinkN/A
91ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable DiffusionComposes diffusion skills to follow instructions for navigation in dynamic scenes.N/AlinkN/A
92Train-Once Plan-Anywhere Kinodynamic Motion Planning via Diffusion TreesTrains diffusion trees once to enable generalizable kinodynamic motion planning.N/AlinkN/A
93ZipMPC: Compressed Context-Dependent MPC Cost via Imitation LearningLearns compact, context-aware MPC cost functions from demonstrations.N/AlinkN/A
94EndoVLA: Dual-Phase Vision-Language-Action for Precise Autonomous Tracking in EndoscopyTwo-phase VLA framework for accurate autonomous camera tracking in endoscopy.N/AlinkN/A
95Morphologically Symmetric Reinforcement Learning for Ambidextrous Bimanual ManipulationExploits morphological symmetry to learn ambidextrous bimanual manipulation skills.N/AlinkN/A
96Robot Operating Home Appliances by Reading User ManualsExtracts procedural knowledge from manuals to operate home appliances autonomously.N/AlinkN/A
97CARE: Enhancing Safety of Visual Navigation through Collision Avoidance via Repulsive EstimationImproves navigation safety with a repulsive-estimation collision avoidance module.N/AlinkN/A
98MimicFunc: Imitating Tool Manipulation from a Single Human Video via Functional CorrespondenceImitates tool-use from a single video by aligning functional correspondences.N/AlinkN/A
99CogniPlan: Uncertainty-Guided Path Planning with Conditional Generative Layout PredictionPredicts environment layouts conditionally and plans paths with uncertainty guidance.LinklinkN/A
100Fast Flow-based Visuomotor Policies via Conditional Optimal Transport CouplingsTrains fast visuomotor policies using conditional optimal transport–based flow couplings.N/AlinkN/A
101Enabling Long(er) Horizon Imitation for Manipulation Tasks by Modeling Subgoal TransitionsImproves long-horizon imitation by explicitly modeling transitions between subgoals.N/AlinkN/A
102Search-TTA: A Multi-Modal Test-Time Adaptation Framework for Visual Search in the WildPerforms multi-modal test-time adaptation to robustify visual search in-the-wild.N/AlinkN/A
103Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement LearningHierarchical co-self-play enables coordinated multi-drone volleyball behaviors.N/AlinkN/A
104Wheeled Lab: Modern Sim2Real for Low-cost, Open-source Wheeled RoboticsLow-cost open-source wheeled robotics platform with strong sim-to-real pipeline.N/AlinkN/A
105DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot ControlVLM enhanced with a plug-in diffusion expert for general-purpose robot control.LinklinkLink
106From Space to Time: Enabling Adaptive Safety with Learned Value Functions via Disturbance RecastingRecasts disturbances and learns value functions to adapt safety constraints over time.N/AlinkN/A
107Mobi-: Mobilizing Your Robot Learning PolicyFramework/tools to package and deploy learned robot policies across platforms (“mobilize”).LinklinkLink
108Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-top ManipulationCombines visual foresight with task-agnostic pose estimation for table-top tasks.N/AlinkN/A
109Diffusion Dynamics Models with Generative State Estimation for Cloth ManipulationDiffusion-based dynamics and generative state estimation for deformable cloth manipulation.N/AlinkN/A
110Contrastive Forward Prediction Reinforcement Learning for Adaptive Fault-Tolerant Legged RobotsContrastive forward prediction enables adaptive, fault-tolerant legged locomotion.N/AlinkN/A
111Action-Free Reasoning for Policy GeneralizationEncourages high-level reasoning without action supervision to improve generalization.LinklinkN/A
112Learn from What We HAVE: History-Aware VErifier that Reasons about Past Interactions OnlineOnline verifier leverages historical interactions to prevent policy failures.N/AlinkN/A
113KineDex: Learning Tactile-Informed Visuomotor Policies via Kinesthetic Teaching for Dexterous ManipulationKinesthetic teaching with tactile cues to train dexterous visuomotor policies.N/AlinkN/A
114FlashBack: Consistency Model-Accelerated Shared AutonomyUses consistency models to accelerate and stabilize shared autonomy.N/AlinkN/A
115Granular loco-manipulation: Repositioning rocks through strategic sand avalancheManipulates granular media to reposition rocks via controlled sand avalanches.N/AlinkN/A
116D-CODA: Diffusion for Coordinated Dual-Arm Data AugmentationGenerates coordinated bimanual data via diffusion for dual-arm manipulation learning.N/AlinkN/A
117JaxRobotarium: Training and Deploying Multi-Robot Policies in 10 MinutesJAX-based framework for rapid training/deployment of multi-robot policies.N/AlinkN/A
118Uncertainty-aware Latent Safety Filters for Avoiding Out-of-Distribution FailuresLatent-space safety filters with uncertainty estimates to avoid OOD failures.N/AlinkN/A
119ATK: Automatic Task-driven Keypoint Selection for Robust Policy LearningSelects task-relevant keypoints automatically to improve policy robustness.N/AlinkN/A
120ManipBench: Benchmarking Vision-Language Models for Low-Level Robot ManipulationBenchmark to test VLMs on low-level manipulation perception and control tasks.N/AlinkN/A
121IRIS: An Immersive Robot Interaction SystemImmersive system for interacting with robots using mixed/extended reality interfaces.N/AlinkN/A
122ActLoc: Learning to Localize on the Move via Active Viewpoint SelectionActively selects viewpoints to maintain localization accuracy while moving.N/AlinkN/A
123AnyPlace: Learning Generalizable Object Placement for Robot ManipulationLearns placement policies that generalize across objects and contexts.LinklinkLink
124AutoEval: Autonomous Evaluation of Generalist Robot Manipulation Policies in the Real WorldAutomates real-world evaluation of generalist manipulation policies with minimal setup.LinklinkLink
125Poke and Strike: Learning Task-Informed Exploration PoliciesDesigns exploration policies that “poke & strike” based on task-informed signals.N/AlinkN/A
126Ensuring Force Safety in Vision-Guided Robotic Manipulation via Implicit Tactile CalibrationImproves force safety in vision-guided manipulation by implicitly calibrating tactile responses.N/AlinkN/A
127Off Policy Lyapunov Stability in Reinforcement LearningAnalyzes and enforces Lyapunov stability guarantees for off-policy RL controllers.N/AlinkN/A
128ReCoDe: Reinforcement Learning-based Dynamic Constraint Design for Multi-Agent CoordinationLearns task-dependent constraints to coordinate multiple agents more effectively.N/AlinkN/A
129Human-like Navigation in a World Built for HumansPlans and navigates using priors that emulate human motion patterns and preferences.N/AlinkN/A
130Efficient Evaluation of Multi-Task Robot Policies With Active Experiment SelectionActively selects informative trials to evaluate multi-task policies with fewer experiments.N/AlinkN/A
131Fail2Progress: Learning from Real-World Robot Failures with Stein Variational InferenceUses SVGD to turn failure experiences into policy improvements from real robot runs.LinklinkN/A
132ControlVLA: Few-shot Object-centric Adaptation for Pre-trained Vision-Language-Action ModelsAdapts pretrained VLA models to new objects/tasks with few-shot object-centric tuning.N/AlinkN/A
133SafeBimanual: Diffusion-based trajectory optimization for safe bimanual manipulationOptimizes bimanual trajectories with diffusion priors while enforcing safety constraints.N/AlinkN/A
134Junction State Estimation for Efficient Exploration in Reinforcement LearningDetects “junction” states to guide exploration and reduce sample complexity in RL.N/AlinkN/A
135QuaDreamer: Controllable Panoramic Video Generation for Quadruped RobotsGenerates controllable panoramic videos to train and evaluate quadruped perception stacks.N/AlinkN/A
136COMBO-Grasp: Learning Constraint-Based Manipulation for Bimanual Occluded GraspingLearned constraint-based policies for robust bimanual grasping under occlusion.N/AlinkN/A
137D-Cubed: Latent Diffusion Trajectory Optimisation for Dexterous Deformable ManipulationOptimizes dexterous trajectories for deformables using latent diffusion models.LinklinkN/A
138Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot ManipulationExtends VLA planning capabilities to long-horizon manipulation tasks.LinklinkN/A
139ImLPR: Image-based LiDAR Place Recognition using Vision Foundation ModelsLeverages VFM features for robust image-based LiDAR place recognition.N/AlinkN/A
140MoTo: A Zero-shot Plug-in Interaction-aware Navigation for General Mobile ManipulationZero-shot, plugin-based navigation that accounts for interactions in mobile manipulation.N/AlinkN/A
141RobotxR1: Enabling Embodied Robotic Intelligence on Large Language Models through Closed-Loop Reinforcement LearningCombines LLM reasoning with closed-loop RL for embodied robotic tasks.N/AlinkN/A
142GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action DataPretrains a grasping foundation model on large-scale synthetic action sequences.LinklinkLink
143Learning from 10 Demos: Generalisable and Sample-Efficient Policy Learning with Oriented Affordance FramesAchieves generalization from ~10 demos using oriented affordance-frame supervision.N/AlinkN/A
144Learning Long-Context Diffusion Policies via Past-Token PredictionTrains diffusion policies to leverage long past-context using next/past-token prediction.LinklinkN/A
145Gen2Act: Human Video Generation in Novel Scenarios enables Generalizable Robot ManipulationGenerates diverse human videos in novel scenes to bootstrap generalizable manipulation.LinklinkN/A
146Articulate AnyMesh: Open-vocabulary 3D Articulated Objects ModelingModels open-vocabulary articulated objects by inferring meshes and kinematic structure.N/AlinkN/A
147Phantom: Training Robots Without Robots Using Only Human VideosTrains robot policies purely from human videos without robot data collection.LinklinkLink
148Residual Neural Terminal Constraint for MPC-based Collision Avoidance in Dynamic EnvironmentsAdds a learned residual terminal constraint to MPC for safer collision avoidance.N/AlinkN/A
149Hold My Beer: Learning Gentle Humanoid Locomotion and End-Effector Stabilization ControlTrains humanoids for soft-contact locomotion with stabilized end-effector control.N/AlinkN/A
150TReF-6: Inferring Task-Relevant Frames from a Single Demonstration for One-Shot Skill GeneralizationInfers task-relevant frames from a single demo to enable one-shot skill generalization.N/AlinkN/A
151UniTac2Pose: A Unified Approach Learned in Simulation for Category-level Visuotactile In-hand Pose EstimationUnifies visual+tactile cues in sim to estimate in-hand pose at the category level.N/AlinkN/A
152Bipedal Balance Control with Whole-body Musculoskeletal Standing and Falling SimulationsUses musculoskeletal simulations of standing/falling to learn robust biped balance control.N/AlinkN/A
153Do LLM Modules Generalize? A Study on Motion Generation for Autonomous DrivingEvaluates whether LLM-based modules generalize to unseen driving motion generation tasks.N/AlinkN/A
154AgentWorld: An Interactive Simulation Platform for Scene Construction and Mobile Robotic ManipulationInteractive platform for constructing scenes and training mobile manipulation policies.N/AlinkN/A
155FastUMI: A Scalable and Hardware-Independent Universal Manipulation Interface with DatasetHardware-agnostic manipulation interface with a large supporting dataset for scaling.linklinklink
156Towards Generalizable Safety in Crowd Navigation via Conformal Uncertainty HandlingApplies conformal uncertainty methods to ensure safety during crowd navigation.N/Alinklink
157Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic ManipulationUses VLMs with reflection to plan multi-stage long-horizon manipulation sequences.linklinklink
158Unsupervised Skill Discovery as Exploration for Learning Agile LocomotionDiscovers diverse skills for locomotion, turning exploration into agile behaviors.N/AlinkN/A
159HyperTASR: Hypernetwork-Driven Task-Aware Scene Representations for Robust ManipulationHypernetworks generate task-aware scene embeddings to improve manipulation robustness.N/AlinkN/A
160GENNAV: Polygon Mask Generation for Generalized Referring Navigable RegionsGenerates polygon masks for referred navigable regions to guide embodied navigation.linklinkN/A
161PicoPose: Progressive Pixel-to-Pixel Correspondence Learning for Novel Object Pose EstimationLearns dense correspondences progressively to estimate 6D poses of novel objects.N/AlinkN/A
162CHD: Coupled Hierarchical Diffusion for Long-Horizon TasksCouples hierarchical policies with diffusion for scalable long-horizon task planning.N/AlinkN/A
163BEVCalib: LiDAR-Camera Calibration via Geometry-Guided Bird’s-Eye View RepresentationPerforms LiDAR–camera calibration using geometry cues in BEV space without markers.linklinklink
164Latent Adaptive Planner for Dynamic ManipulationPlans dynamic manipulations by adapting in a learned latent space of strategies.N/AlinkN/A
165SLAC: Simulation-Pretrained Latent Action Space for Whole-Body Real-World RLPretrains a latent action space in sim to accelerate whole-body RL on hardware.linklinklink
166Neural Robot DynamicsLearns differentiable robot dynamics models that capture complex contact effects.linklinklink
167GC-VLN: Instruction as Graph Constraints for Training-free Vision-and-Language NavigationTurns instructions into graph constraints to enable training-free VLN execution.N/AlinkN/A
168Constrained Style Learning from Imperfect Demonstrations under Task OptimalityExtracts task-consistent style from noisy demos while enforcing optimality constraints.N/AlinkN/A
169TypeTele: Releasing Dexterity in Teleoperation by Dexterous Manipulation TypesTeleop framework decomposed by manipulation “types” to increase dexterous capability.linklinkN/A
170VT-Refine: Learning Bimanual Assembly with Visuo-Tactile Feedback via Simulation Fine-TuningCombines vision+tactile feedback with sim-finetuning for precise bimanual assembly.N/AlinkN/A
171Adapt3R: Adaptive 3D Scene Representation for Domain Transfer in Imitation LearningAdapts 3D scene representations to new domains to improve imitation policy transfer.N/AlinkN/A
172FOMO-3D: Using Vision Foundation Models for Long-Tailed 3D Object DetectionLeverages VFM priors to handle long-tailed distributions in 3D detection tasks.N/AlinkN/A
173Extracting Visual Plans from Unlabeled Videos via Symbolic GuidanceInduces symbolic plans from unlabeled videos and converts them to robot-executable steps.N/AlinkN/A
174Self-supervised perception for tactile skin covered dexterous handsSelf-supervised learning for perception on dexterous hands covered with tactile skin.N/AlinkN/A
175Predictive Red Teaming: Breaking Policies Without Breaking Robots“Red teams” robot policies in simulation to expose failures before real-world deployment.linklinkN/A
176Learning Long-Horizon Robot Manipulation Skills via Privileged ActionUses privileged action signals during training to acquire long-horizon manipulation skills.N/AlinkN/A
177Towards Embodiment Scaling Laws in Robot LocomotionEmpirical study of how embodiment and data scale affect locomotion policy performance.N/AlinkN/A
178O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic ManipulationOne-shot affordance grounding between novel 3D objects to generalize manipulation skills.N/AlinkN/A
179Estimating Value of Assistance for Online POMDP Robotic AgentsQuantifies assistance value online to decide when human help benefits a POMDP agent.N/AlinkN/A
180Shortcut Learning in Generalist Robot Policies: The Role of Dataset Diversity and FragmentationAnalyzes shortcut biases and how dataset diversity/fragmentation impact generalist policies.N/AlinkN/A
181SDS – See it, Do it, Sorted: Quadruped Skill Synthesis from Single Video DemonstrationDerives quadruped skills from a single video demo using perception-to-action synthesis.linklinklink
182TrackVLA: Embodied Visual Tracking in the WildEmbeds tracking into VLA frameworks for robust in-the-wild target following.linklinklink
183GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic ManipulationLeverages human behavior data to improve affordance learning for manipulation tasks.N/AlinkN/A
184LaDi-WM: A Latent Diffusion-Based World Model for Predictive ManipulationUses latent diffusion world models to predict future states for manipulation planning.N/AlinkN/A
185ManiFlow: A General Robot Manipulation Policy via Consistency Flow TrainingTrains a general manipulation policy using consistency-based flow training objectives.linklinkN/A
186Robot Learning from Any ImagesBootstraps visuomotor skills from broad internet-scale images via clever supervision.N/AlinkN/A
187Deep Reactive Policy: Learning Reactive Manipulator Motion Planning for Dynamic EnvironmentsEnd-to-end learned reactive planner for manipulators operating in dynamic scenes.linklinkN/A
188CASPER: Inferring Diverse Intents for Assistive Teleoperation with Vision Language ModelsInfers user intent distributions via VLMs to assist teleoperation effectively.N/AlinkN/A
189UniSkill: Imitating Human Videos via Cross-Embodiment Skill RepresentationsTransfers skills from human videos to robots using cross-embodiment representations.linklinklink
190ParticleFormer: A 3D Point Cloud World Model for Multi-Object, Multi-Material Robotic ManipulationParticle-based world model on point clouds to handle multi-object, multi-material dynamics.N/AlinkN/A
191Crossing the Human-Robot Embodiment Gap with Sim-to-Real RL using One Human DemonstrationBridges human-to-robot embodiment gap via sim-to-real RL seeded by one human demo.N/Alinklink
192One Demo is Worth a Thousand Trajectories: Action-View Augmentation for Visuomotor PoliciesAction-view augmentation from a single demo to train robust visuomotor policies.N/AlinkN/A
193VLM-AD: End-to-End Autonomous Driving through Vision-Language Model SupervisionSupervises end-to-end driving policies using high-level VLM reasoning signals.N/AlinkN/A
194LLM-Guided Probabilistic Program Induction for POMDP Model EstimationUses LLMs to induce probabilistic programs that estimate POMDP dynamics/observations.N/AlinkN/A
195Vision in Action: Learning Active Perception from Human DemonstrationsLearns active perception strategies from human demos for better task performance.linklinklink
196Point Policy: Unifying Observations and Actions with Key Points for Robot ManipulationRepresents both observations and actions as keypoints to simplify manipulation learning.linklinklink
197From Tabula Rasa to Emergent Abilities: Discovering Robot Skills via Real-World Unsupervised Quality-DiversityDiscovers diverse real-world skills via unsupervised quality-diversity search.N/AlinkN/A
198Robust Dexterous Grasping of General ObjectsDesigns policies for robust dexterous grasping across varied, previously unseen objects.linklinklink
199Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on HumanoidsTransfers vision-based dexterous manipulation skills onto humanoid platforms via RL.linklinkN/A
200Humanoid Policy ~ Human PolicyExplores alignment between humanoid robot policies and human-like control strategies.linklinklink
201ToddlerBot: Open-Source ML-Compatible Humanoid Platform for Loco-ManipulationOpen-source humanoid platform designed for learning-based loco-manipulation research.linklinklink
202TWIST: Teleoperated Whole-Body Imitation SystemTeleoperation framework enabling full-body imitation to collect rich humanoid data.linklinklink
203exUMI: Extensible Robot Teaching System with Action-aware Task-agnostic Tactile RepresentationExtensible teaching system that learns task-agnostic tactile reps aware of action context.N/AlinkN/A
204OPAL: Visibility-aware LiDAR-to-OpenStreetMap Place Recognition via Adaptive Radial FusionPerforms LiDAR↔OSM place recognition using visibility-aware, radial fusion in BEV.N/AlinkN/A
205CDP: Towards Robust Autoregressive Visuomotor Policy Learning via Causal DiffusionIntroduces causal diffusion to stabilize autoregressive visuomotor policy learning.N/AlinkN/A
206Robot Trains Robot: Automatic Real-World Policy Adaptation and Learning for HumanoidsHumanoids auto-adapt policies in the real world via self-training and evaluation loops.N/AlinkN/A
207See, Point, Fly: A Learning-Free VLM Framework for Universal Unmanned Aerial NavigationLearning-free VLM pipeline that parses language/vision prompts for UAV navigation targets.linklinklink
208LaVA-Man: Learning Visual Action Representations for Robot ManipulationLearns visual action embeddings to improve generalization in robot manipulation.N/AlinkN/A
2093DS-VLA: A 3D Spatial-Aware Vision Language Action Model for Robust Multi-Task ManipulationVLA model with explicit 3D spatial awareness for robust, multi-task manipulation.N/AlinkN/A
210Uncertainty-aware Accurate Elevation Modeling for Off-road Navigation via Neural ProcessesNeural processes produce uncertainty-aware elevation maps for safer off-road planning.N/AlinkN/A
211Generalist Robot Manipulation beyond Action Labeled DataTrains generalist manipulation policies without relying on explicit action labels.linklinklink
212BranchOut: Capturing Realistic Multimodality in Autonomous Driving DecisionsModels branching, multimodal futures to better capture diverse driving decisions.N/AlinkN/A
213Co-Design of Soft Gripper with Neural PhysicsJointly optimizes soft gripper design and control with differentiable neural physics.linklinklink
214Elucidating the Design Space of Torque-aware Vision-Language-Action ModelsSystematic study of torque-aware VLA design choices for manipulation performance.N/AlinkN/A
215RoboChemist: Long-Horizon and Safety-Compliant Robotic Chemical ExperimentationAutomates long-horizon chemical experiments with explicit safety constraints.N/AlinkN/A
216COLLAGE: Adaptive Fusion-based Retrieval for Augmented Policy LearningRetrieves and fuses relevant experience adaptively to augment policy learning.linklinklink
217GraspMolmo: Generalizable Task-Oriented Grasping via Large-Scale Synthetic Data GenerationGenerates large-scale synthetic data to train task-oriented grasping policies.linklinklink
218Motion Blender Gaussian Splatting for Dynamic ReconstructionCombines motion blending with Gaussian splats to reconstruct dynamic scenes.N/AlinkN/A
219Improving Efficiency of Sampling-based Motion Planning via Message-Passing Monte CarloMessage-passing Monte Carlo reduces variance and improves sampling-based planning efficiency.N/AlinkN/A
220CaRL: Learning Scalable Planning Policies with Simple RewardsScales planning policies using simple reward structures with strong generalization.N/AlinkN/A
221Pseudo-Simulation for Autonomous DrivingUses pseudo-simulated data to train and evaluate driving policies more efficiently.N/Alinklink
corl-2025
robotics
robot-learning