手机拍歪的文档,也能直接解析?
ModelScope 分享了 TeleOCR:一个 1.2B 参数的开源视觉语言模型,面向数字文档和手机拍摄文档,采用 Apache 2.0 许可证。
它不只识别文字,还关注表格、公式与阅读顺序。项目展示了对弯曲、透视变形文档的解析,无需先用专门模型把图片拉直。
按项目公布的测试结果,TeleOCR 在 OmniDocBench v1.6 上的综合分为 96.87。配图也展示了其他文档测试集的对比;跑分不代表所有实际场景,使用前仍建议拿自己的文档测试。
做文档数字化、表格提取或 OCR 工作流的朋友,可以了解一下。
🔗GitHub地址:https://github.com/caipeng328/TeleOCR
模型地址:https://modelscope.ai/models/XingChen-AGI/TeleOCR
#TeleOCR #OCR #文档识别 #视觉语言模型 #AI工具 #开源模型 #ModelScope
