OCR 是什么?为什么 AI 读扫描版 PDF、表格和截图前通常都得先过它
OCR 是 Optical Character Recognition 的缩写,中文通常叫光学字符识别。它做的事情很直接:把图片里的字、扫描件里的字、截图里的字尽量变成机器能继续处理的文本。很多人以为 AI 能看懂 PDF,是模型直接把文档“读懂”了,但对大量扫描版 PDF、发票、表格截图来说,第一...
AI百科 • Admin •
78
找到 4 篇相关文章
OCR 是 Optical Character Recognition 的缩写,中文通常叫光学字符识别。它做的事情很直接:把图片里的字、扫描件里的字、截图里的字尽量变成机器能继续处理的文本。很多人以为 AI 能看懂 PDF,是模型直接把文档“读懂”了,但对大量扫描版 PDF、发票、表格截图来说,第一...
上传 PDF 后 AI 还是答错,问题往往不在模型会不会读,而在它拿到的根本不是你以为的那份“干净文本”。PDF 对机器来说常常只是一个排版容器,里面可能有扫描图片、双栏布局、跨页表格、页眉页脚和错乱阅读顺序。前面解析歪了,后面回答再努力也只能在歪材料上发挥。 PDF 问答最容易卡在前面这三层 - ...
扣子知识库上传失败,最容易让人误判成“文件坏了”,但公开 issue 里更常见的情况是:解析、embedding、存储这三层里的某一层没对齐。你会看到的报错可能是 num_rows 不一致、 column size not match 、 batch size is invalid ,也可能是加载 ...
Coze 知识库上传失败,最容易让人误判成“文件坏了”,但公开 issue 里更常见的情况是:解析、embedding、存储这三层里的某一层没对齐。你会看到的报错可能是 num_rows 不一致、 column size not match 、 batch size is invalid ,也可能是...