5月18日,腾讯混元联合SSV数字文化实验室、安阳师范学院、中科院信工所、南开大学等机构发布古文字识别评测基准Chronicles-OCR。该基准覆盖甲骨文至草书“七体之变”,包含2800张经专家多层标注的图像,设立跨时代字符检测、细粒度识别、古文转写和字体分类四项任务,用于评估多模态大模型在跨三千年文字演化中的视觉与语义能力。对28个主流模型测试显示,古早字体识别表现显著不足,细粒度识别最高准确率仅27.1%,且推理模式会降低稳定性。该基准已开源,旨在推动数字人文与多模态技术发展。
5月18日,腾讯混元联合SSV数字文化实验室、安阳师范学院、中科院信工所、南开大学等机构发布古文字识别评测基准Chronicles-OCR。该基准覆盖甲骨文至草书“七体之变”,包含2800张经专家多层标注的图像,设立跨时代字符检测、细粒度识别、古文转写和字体分类四项任务,用于评估多模态大模型在跨三千年文字演化中的视觉与语义能力。对28个主流模型测试显示,古早字体识别表现显著不足,细粒度识别最高准确率仅27.1%,且推理模式会降低稳定性。该基准已开源,旨在推动数字人文与多模态技术发展。