主要来源Jerry Liu
查看原文事件专题 · 多源确认
ExtractBench上线测试前沿模型文档提取能力
ExtractBench已在Kaggle上线,测试了5.6 Sol、OpenAI模型、Gemini 3 Flash和Opus 5等前沿模型在文档提取任务中的表现。该基准测试涵盖370个企业文档,涉及8个商业领域和67种文档类型,包括长记录列表、噪声扫描、手写和复杂表格等。LlamaParse作为专用提取工具,在价格/性能前沿提供基础引用功能。
当前结论
Llama团队发布了ExtractBench基准,测试了5.6 Sol等模型在复杂文档提取上的表现,还对比了LlamaParse等工具。
9 个信源73° AI 热度最后更新 2026/9/3 01:40:35
证据链
相关来源 1IT之家
查看原文相关来源 2DeepLearning.AI
查看原文相关来源 3LlamaIndex
查看原文相关来源 4OpenAI Blog
查看原文相关来源 5techcrunch
查看原文相关来源 6Decoder
查看原文相关来源 7arXiv: OpenAI
查看原文相关来源 8宝玉
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。