返回
A Comprehensive Review on Document Image Binarization
DOI:10.3390/jimaging11050133.png)
摘要
En 中文
在当今的数字时代,将纸质文档转换为数字格式的做法已十分普遍。该过程涉及通过电子方式扫描和存储大量文档。这些文档来自各种来源,包括记录和报告、相机拍摄的文本和屏幕截图、官方文件、报纸、医疗报告、乐谱等。在文档分析技术领域,一个关键步骤是文档图像二值化。其目标是从图像中消除不必要的数据,仅保留文本。尽管存在多种二值化技术,但文档图像中的退化现象可能会阻碍其有效性。本研究的目标是提供对文档二值化领域的全面综述和分析,强调其重要性,并解决图像二值化过程中遇到的问题。此外,它还提供了对用于图像二值化的技术和方法的见解。本文还介绍了用于评估二值化精度、模型训练、评估指标以及近期方法有效性的基准数据集。
Keyword:
binarization
document analysis
image processing
machine learning
text analysis
thresholding
期刊
J
IF:
3.3
论文数:
1.1K
被引数:
4.4K
机构
引用论文
LayoutLM: Pre-training of Text and Layout for Document Image UnderstandingLayoutLM: 用于文档图像理解的文本和布局的预培训

