Hugging Face Blog·· 2024-07-18AI 评分42
Hugging Face 发布 Docmatix:面向文档视觉问答的超大规模数据集
Docmatix - a huge dataset for Document Visual Question Answering
AI 导读
Hugging Face 发布 Docmatix,一个面向文档视觉问答(DocVQA)的数据集,包含 240 万张图像和 950 万对 Q/A,规模是此前数据集的 240 倍。该数据集由 PDFA 的 210 万份 PDF 转录文本经 Phi-3-small 生成 Q/A,并过滤掉 15% 的幻觉样本。用其微调 Florence-2 后,DocVQA 性能相对提升近 20%。
来源:Hugging Face Blog · huggingface.co