Fable 5.1文档OCR性能实测提升
Fable 5.1 没有自带文档 OCR 基准测试,因此我们在 ParseBench 上对它进行了基准测试:这是一个综合解析基准测试,包含了金融、法律、保险等多个领域的 2000+ 份真实文档。
值得肯定的是,这是近些年来我们能记得的少数几个文档 OCR 性能相比上一代模型确实有所提升的前沿模型!✅
它在我们所有指标上都全面超过了 Fable 5,从表格、内容忠实度、格式、图表到视觉定位都是如此。✅
它是目前解析表格表现最好的模型之一。
这很棒,因为虽然前沿模型在推理基准测试上进步飞速,但在视觉理解方面一直没有进展。
在此之前,最新的模型(Opus 5、5.6-Sol、3.7 Flash)在视觉理解任务上已经停滞不前。
显然,你不应该单独使用 Fable 5.1 作为文档 OCR 工具;除了缺少必要的元数据之外,它每页还要花费 15 美分——这比 LlamaParse 默认的智能代理模式贵 10-15 倍,而二者性能相近。
如果你对追踪我们已经完成基准测试的 90 多个文档 OCR 解决方案感兴趣,查看 ParseBench。
如果你正在寻找一个专用的、SOTA OCR 工具来为你的文档处理工作流提供支持,查看 LlamaParse。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖