跳到正文
Hugging Face Blog·· 2024-07-18AI 评分42

Hugging Face 发布 Docmatix:面向文档视觉问答的超大规模数据集

Docmatix - a huge dataset for Document Visual Question Answering

AI 导读

Hugging Face 发布 Docmatix,一个面向文档视觉问答(DocVQA)的数据集,包含 240 万张图像和 950 万对 Q/A,规模是此前数据集的 240 倍。该数据集由 PDFA 的 210 万份 PDF 转录文本经 Phi-3-small 生成 Q/A,并过滤掉 15% 的幻觉样本。用其微调 Florence-2 后,DocVQA 性能相对提升近 20%。

来源:Hugging Face Blog · huggingface.co