OCR 是什么?为什么 AI 读扫描版 PDF、表格和截图前通常都得先过它
OCR 是 Optical Character Recognition 的缩写,中文通常叫光学字符识别。它做的事情很直接:把图片里的字、扫描件里的字、截图里的字尽量变成机器能继续处理的文本。很多人以为 AI 能看懂 PDF,是模型直接把文档“读懂”了,但对大量扫描版 PDF、发票、表格截图来说,第一...
AI百科 • Admin •
77
找到 2 篇相关文章
OCR 是 Optical Character Recognition 的缩写,中文通常叫光学字符识别。它做的事情很直接:把图片里的字、扫描件里的字、截图里的字尽量变成机器能继续处理的文本。很多人以为 AI 能看懂 PDF,是模型直接把文档“读懂”了,但对大量扫描版 PDF、发票、表格截图来说,第一...
上传 PDF 后 AI 还是答错,问题往往不在模型会不会读,而在它拿到的根本不是你以为的那份“干净文本”。PDF 对机器来说常常只是一个排版容器,里面可能有扫描图片、双栏布局、跨页表格、页眉页脚和错乱阅读顺序。前面解析歪了,后面回答再努力也只能在歪材料上发挥。 PDF 问答最容易卡在前面这三层 - ...