腾讯混元大模型联合SSV数字文化实验室、多所高校及故宫博物院发布Chronicles-OCR,这是首个覆盖汉字“七体演变”的古文字OCR评测基准。数据集包含2800张高质量图像,由专家多层交叉标注,涵盖甲骨文、金文至楷书等字体,并设置检测、识别等多项任务。对28个主流多模态模型评测显示,在古文字场景下端到端检测任务表现不佳,细粒度识别最高准确率仅27.1%,开启推理模式反而降低性能。结果表明当前模型更依赖纹理而非笔画特征,古文字识别能力仍存在明显不足。
腾讯混元大模型联合SSV数字文化实验室、多所高校及故宫博物院发布Chronicles-OCR,这是首个覆盖汉字“七体演变”的古文字OCR评测基准。数据集包含2800张高质量图像,由专家多层交叉标注,涵盖甲骨文、金文至楷书等字体,并设置检测、识别等多项任务。对28个主流多模态模型评测显示,在古文字场景下端到端检测任务表现不佳,细粒度识别最高准确率仅27.1%,开启推理模式反而降低性能。结果表明当前模型更依赖纹理而非笔画特征,古文字识别能力仍存在明显不足。