术语

文档扫描

使用扫描仪、手机摄像头或专用扫描应用,把纸张、收据、证件或印刷页面等实体文档转换为数字图片或 PDF。

扫描与拍照的区别

给文档拍照与扫描文档看起来相似,但结果差别很大。

照片会从单一角度记录文档,并使用现场光线。结果往往包含透视变形(文档看起来像梯形而不是矩形)、光线不均(亮斑和阴影)、纸张未完全铺平造成的弯曲边缘,以及文档边缘周围的杂乱背景。

无论使用平板扫描仪,还是软件形式的手机扫描应用,扫描过程都会通过处理修正这些问题。透视校正会把文档拉正为矩形,自动裁剪会去除背景,对比度增强会平衡光线差异,并让文字与纸张之间的边界更清晰。最终结果接近平板扫描仪输出:画面干净、平整,方向正确。

这些差异会影响后续使用。文档照片也许足够让人阅读,但其中的不一致会给 OCR 处理、自动归档和长期保存带来问题。正确扫描的文档更容易稳定处理,分享或打印时也更整洁。

文档扫描的常见用途

  • 收据与费用记录——购物后立即扫描收据,可以在热敏纸褪色前留下数字记录。与纸质收据相比,扫描件更容易整理、搜索和提交报销。
  • 合同和法律文档数字化——把已签署的协议、租约和法律文件转换为可搜索 PDF,便于访问、备份和按关键词查找。
  • 证件和资质材料采集——扫描护照、驾驶证和资质证书,用于身份验证、申请流程和安全存储。
  • 医疗与保险记录——把纸质表格、检验结果和保险卡数字化,用于个人留档,并与医疗服务人员安全共享。
  • 学术与研究资料——扫描书页、期刊文章和手写笔记,方便数字批注、引用和整理。

扫描与 OCR

扫描本身只会生成图片,也就是文字的画面,而不是实际文本数据。对人来说,文档看起来是文字;对计算机来说,它只是一组像素。

OCR(Optical Character Recognition,光学字符识别)会分析扫描图片、识别字符形状,并转换成机器可读的文本,从而连接这两种形式。把 OCR 输出作为文本层嵌入 PDF 后,就得到可搜索 PDF:视觉上仍与原扫描件相同,但下方的文字可以选择、搜索和复制。

OCR 的准确度很大程度上取决于扫描质量。300 DPI 或更高分辨率、清晰且对比度高的扫描件,文字识别通常更准确。模糊、对比度低或歪斜的图片则容易产生错误,需要手动修正。

把扫描与 OCR 放在同一流程中,完成文档采集、处理并直接输出可搜索 PDF,可以省去单独运行 OCR 的步骤。连续处理多份文档时,这种端到端方式尤其有用,能把一摞纸质资料直接变成可搜索的数字档案。

常见问题

  • 扫描分辨率太低。 低于 200 DPI 的图片也许人眼还能辨认文字,但 OCR 很难准确处理。需要处理或归档的文档,建议至少使用 300 DPI。
  • 扫描前没有摆正文档。 文档放歪,扫描结果也会歪。许多扫描应用能自动修正轻微旋转,但从一开始就把文档对齐,效果最好。
  • 归档时保存为 JPG。 JPG 的有损压缩会降低文字边缘清晰度,较低质量设置下尤其明显。归档文档应使用 PNG(单页)或 PDF(多页),以保留文字清晰度。
  • 扫描 PDF 后没有运行 OCR。 只包含扫描图片的 PDF 无法搜索、选择文字或建立索引。如果日后需要搜索文档或提取文字,应始终运行 OCR。

常见问题

可以用手机扫描文档吗?

可以。对大多数日常文档来说,现代手机摄像头配合扫描应用,能得到接近专用扫描仪的效果。应用会自动完成透视校正、裁剪和对比度增强。

扫描文档与拍摄文档有什么区别?

拍照会原样记录相机看到的画面,包括透视变形、阴影和不均匀光线。扫描会通过处理修正这些问题,得到平整、光线均匀并正确裁剪的结果,看起来更像真正的扫描件。

扫描文档应该保存成什么格式?

PDF 是多页文档的标准格式,因为它能保留版式,也支持用于搜索的文本层。单页扫描件可以保存为 PNG 以获得无损画质,或保存为 JPG 以减小文件。

扫描后文档会自动变得可搜索吗?

不会。普通扫描只会生成图片,也就是文字的图像,而不是实际文本数据。要让文档可搜索,必须用 OCR(光学字符识别)处理扫描件,检测画面中的文字并将其转换为机器可读的文本层。

扫描文档应该使用多高的分辨率?

大多数文档使用 300 DPI 即可,既能提供足够细节供 OCR 处理,输出也清晰可读。小字号文档或需要尽量保留细节时,可使用 600 DPI。更高分辨率会显著增大文件,但画质收益逐渐变小。

参考资料

相关资料

什么是文档扫描? | 术语表 | Shotomatic