ToolNavs Outils IA à découvrir
Proposer Connexion

Reconnaissance de texte OCR

Avant qu'un modèle puisse raisonner sur une page scannée, les caractères doivent être lus correctement. Ce tag réunit l'analyse de mise en page, la reconnaissance multilingue, la sortie PDF structurée et les arbitrages entre PaddleOCR et HunyuanOCR.

L'OCR ne se limite plus à reconnaître des caractères : il faut localiser titres et tableaux, fixer l'ordre de lecture des pages en deux colonnes, et une erreur suffit pour que la QA en aval recolle des notes de bas de page en contre-sens crédible. PP-StructureV3 de PaddleOCR gère mise en page et tableaux, HunyuanOCR couvre scènes de rue et écriture manuscrite avec environ un milliard de paramètres, DeepSeek-OCR compresse la page en tokens visuels pour économiser le contexte.