Tags

端到端

GOT-OCR2.0:邁向 OCR-2.0 的通用 OCR 理論與統一端到端模型
AI

GOT-OCR2.0:邁向 OCR-2.0 的通用 OCR 理論與統一端到端模型

光學字元辨識(OCR)幾十年來一直被視為已解決的問題——對於具有簡單文字的清晰掃描文件而言。但真實世界的視覺內容遠更雜亂多樣。帶有複雜符號的數學方程式、具有不規則儲存格結構的表格、帶有專門符號的樂譜,以及招牌和標籤上的場景文字,都挑戰了假設乾淨、線性文字在均勻背景上的傳統 OCR 方法。

TAG