Latest Research in Computation and Language
155 research papers · 2026 median publication year
Top Research Topics in Computation and Language
- Computer Vision and Pattern Recognition — 79 papers
- Artificial Intelligence — 35 papers
- Machine Learning — 11 papers
- Computation and Language — 9 papers
- Robotics — 8 papers
- Multimodal Machine Learning Applications — 5 papers
- Embedded Systems Design Techniques — 2 papers
- Human-Computer Interaction — 1 papers
- Aesthetic Perception and Analysis — 1 papers
- Multiagent Systems — 1 papers
Highest-Cited Papers
- Prompt-Driven Exploration
- DeliveryGym: An RL Environment for Long-Horizon Embodied Agent Planning with Adaptive Curriculum
- Cross-Modal Attention Acts as a Frequency Filter: Why Verbose Prompts Improve Robustness in Vision-Language Models
- Uni-LaDiR: Latent Diffusion Unifies Multimodal Reasoning
- Learning from Success and Failure: Acquiring Adaptive Dialogue Strategies for Social Robots
- EmbodiedMind: Adaptive Data Curation and Prefix-Tree Reinforcement Learning for Efficient Embodied Intelligence
- SIMLIFE: Pattern Understanding for Long-Horizon Human-Agent Partnership
- RankGround: Efficient High-Resolution GUI Grounding via Lightweight Reranker-Guided Crop Selection
- Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning
- LM Fight Arena: Benchmarking Large Multimodal Models via Game Competition
- Visual Input and Its Framing Affect Attribute-based Descriptions Produced by Large Vision-Language Models
- MUSE: Benchmarking Large Vision-Language Models on Multi-Modal Understanding in Situated Education
- AMIGO: Agentic Multi-Image Grounding Oracle Benchmark
- Anchoring What Matters: A Dual-Level Learning Framework for Visually-Grounded Multimodal Reasoning
- Using OCR Heads to Verbalize Image Semantics
- Where Should Language Sit in a Multimodal Model? Lessons from What Language Does to Human Perception and Cognition
- A Survey of Visual Question Answering for Embodied Robots: Tasks, Methods, and Future Directions
- MPCoT: Reward-Guided Multi-Path Latent Reasoning for Test-Time Scalable Vision-Language-Action
- GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
- StackTok: Accelerating VLMs Inference with Budget-Adaptive Visual Token Selection