Latest Research in Embodied Vision-Language Control
794 research papers · 2026 median publication year
Top Research Topics in Embodied Vision-Language Control
- Robotics — 559 papers
- Computer Vision and Pattern Recognition — 107 papers
- Artificial Intelligence — 38 papers
- Machine Learning — 21 papers
- Robot Manipulation and Learning — 20 papers
- Multimodal Machine Learning Applications — 9 papers
- Reinforcement Learning in Robotics — 8 papers
- Computation and Language — 6 papers
- Systems and Control — 3 papers
- Human Pose and Action Recognition — 3 papers
Highest-Cited Papers
- Civil: causal and intuitive visual imitation learning
- Explicit Language Memory for Long-Horizon Planning in Vision-Language-Action Models
- Teach and Grow: An Agent-Centered Architecture for General Robot Learning
- PonderPounce: A Pretrained MLLM as an Episode Context Engine for Robot Control
- M2Tok: Multi-head Multi-codebook Discrete Action Tokenization for Vision-Language-Action Models
- MAGMA-GEN: Validated Recovery Supervision from Ambiguous Failures via Counterfactual Re-Execution
- A survey on large model-driven embodied grasping technologies
- Skeleton-guided geometry-aware auto-labeling for robotic grasping: From 4-DoF learning to 6-DoF execution
- Runtime Safety Filtering for Two-Terminal Hazards in Robotic Battery Recycling
- TraceFlow: Guiding Frozen Flow-Matching Robot Policies with Success and Failure Traces
- Robotic Video World Models: A Survey of Applications, Research Challenges, Future Directions
- CoRef-GS: Cooperative Referring Gaussian Splatting for Multi-Agent Scene Understanding
- Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation
- HEROIC: Heterogeneous Evidential Reasoning for Open-Vocabulary Identification and Cross-Robot Collaboration
- ForwardDLO: Model-Based Bimanual Shape Matching of Unconstrained Deformable Linear Objects
- Recovering Aggressively Pruned Vision-Language-Action Models with Offline Hidden-State Distillation
- SceneTeract: Probing and Improving Agent-Aware Activity Reasoning in 3D Indoor Scenes
- HIL-UMI: Bringing Human-in-the-Loop Post-Training of Vision-Language-Action Models to Universal Manipulation Interface
- Graph-Aware Group Testing with Locally Clustered Infections
- Imagine-TAMP: Imagination-Guided Task and Motion Planning in Partial Observability
Sub-Regions
- Robotics — 689 papers
- Advanced Battery Technologies Research — 102 papers
- Computer Vision and Pattern Recognition — 90 papers