Latest Research in Document Optical Recognition

65 research papers · 2026 median publication year

Top Research Topics in Document Optical Recognition

Highest-Cited Papers

  1. A Free Lunch? Adapting PP-OCRv6 for Historical Text Recognition
  2. When Low CER is Not Enough: An Analysis of Hallucinations in Vision-Language OCR Systems on Historical Uruguayan Documents
  3. Localization for Indoor Robots using Implicit Map Representations
  4. Synthetic Data-Driven Transformer OCR for Kurdish Sorani via Dynamic Line Generation and Script-Aware Normalization
  5. Measuring Annotation Efficiency for Handwritten Devanagari Recognition: Sample-Complexity Curves for Four Pretraining Regimes
  6. A Lightweight Web Platform for Real-Time Kuzushiji Recognition via One-Shot Pruning
  7. A Multilevel Visual and Textual Framework for Near-Duplicate Diagram Detection in Electronic Documents
  8. Automated Handwriting Analysis for Early Risk Screening of Learning Disabilities in Arabic-Speaking Children Using Convolutional Neural Networks (CNNs)
  9. A Hybrid Multimodal Transformer-Based Approach for Text Extraction and Audio Generation from Images Using NLP
  10. A Hybrid Multimodal Transformer-Based Approach for Text Extraction and Audio Generation from Images Using NLP
  11. PorTEXTO: A European Portuguese Benchmark for Visual Text Extraction
  12. Character-Level Visual Guidance for Arbitrarily Shaped Scene Text Detection and Recognition
  13. News/Resources
  14. ExpertHTR: Unified Handwritten Text Recognition with Multi-Task Learning and Sparse Mixture-of-Experts
  15. Combining Synthetic and Real Data for Low-Resource Historical OCR: A Manchu Case Study
  16. The Small Sample Challenge: Unsupervised Authorship Clustering in Croatian
  17. EMBLEM: Enhancing Multi-script Table Detection through Masking
  18. Rotation-free Online Handwritten Character Recognition Using Linear Recurrent Units
  19. Unsupervised Domain Adaptation for Symbol Spotting in Historical Encrypted Manuscripts
  20. Reading or Guessing? Visual Grounding Failures of Vision-Language Models for OCR in Ancient Greek Editions

Sub-Regions

Controls
|||
ALL TIME
JAN
FEB
MAR
APR
MAY
JUN
JUL
AUG
SEP
L2 Region - - 2026 Sep Q3

Document Optical Recognition

65 papers

Top Topics (10)

Computer Vision and Pattern Recognition24
Handwritten Text Recognition Techniques16
Computation and Language8
Machine Learning3
Academic Writing and Publishing2
Intelligence, Security, War Strategy2
Robotics and Sensor-Based Localization1
Image Processing and 3D Reconstruction1
Writing and Handwriting Education1
Gun Ownership and Violence Research1

Top Publications (20)

1.A Free Lunch? Adapting PP-OCRv6 for Historical Text Recognition2.When Low CER is Not Enough: An Analysis of Hallucinations in Vision-Language OCR Systems on Historical Uruguayan Documents3.Localization for Indoor Robots using Implicit Map Representations4.Synthetic Data-Driven Transformer OCR for Kurdish Sorani via Dynamic Line Generation and Script-Aware Normalization5.Measuring Annotation Efficiency for Handwritten Devanagari Recognition: Sample-Complexity Curves for Four Pretraining Regimes6.A Lightweight Web Platform for Real-Time Kuzushiji Recognition via One-Shot Pruning7.A Multilevel Visual and Textual Framework for Near-Duplicate Diagram Detection in Electronic Documents8.Automated Handwriting Analysis for Early Risk Screening of Learning Disabilities in Arabic-Speaking Children Using Convolutional Neural Networks (CNNs)9.A Hybrid Multimodal Transformer-Based Approach for Text Extraction and Audio Generation from Images Using NLP10.A Hybrid Multimodal Transformer-Based Approach for Text Extraction and Audio Generation from Images Using NLP11.PorTEXTO: A European Portuguese Benchmark for Visual Text Extraction12.Character-Level Visual Guidance for Arbitrarily Shaped Scene Text Detection and Recognition13.News/Resources14.ExpertHTR: Unified Handwritten Text Recognition with Multi-Task Learning and Sparse Mixture-of-Experts15.Combining Synthetic and Real Data for Low-Resource Historical OCR: A Manchu Case Study16.The Small Sample Challenge: Unsupervised Authorship Clustering in Croatian17.EMBLEM: Enhancing Multi-script Table Detection through Masking18.Rotation-free Online Handwritten Character Recognition Using Linear Recurrent Units19.Unsupervised Domain Adaptation for Symbol Spotting in Historical Encrypted Manuscripts20.Reading or Guessing? Visual Grounding Failures of Vision-Language Models for OCR in Ancient Greek Editions

Sub-Regions (3)

AI Navigator

Ask Laika to Summarize, Analyze, and Connect papers live on the map.

Summarize Papers & Methodologies

Extract key findings, datasets, and comparative methods across publications.

Benchmark Rankings & Visual Analytics

Rank top research institutions, authors, funders, topics, and journals by Field-Weighted Citation Impact (FWCI) and paper volume with instant charts.

Connect Distant Disciplines

Bridge topological clusters on the map to find hidden collaborative intersections.