Epoch AI研究测试Pangram、GPTZero和Originality.ai三款AI文本检测器,样本涵盖495篇ChatGPT发布前的人类原创博客、小说和科学写作。结果显示,普通AI生成文本漏检率最高仅0.7%;但在Claude Opus 4.8、GPT-5.5和Gemini 3.1 Pro模仿特定作者文风后,297篇生成文本平均约13%未被识别。其中科学写作最难检测,三款工具漏检率分别达25%、24%和29%。
Epoch AI研究测试Pangram、GPTZero和Originality.ai三款AI文本检测器,样本涵盖495篇ChatGPT发布前的人类原创博客、小说和科学写作。结果显示,普通AI生成文本漏检率最高仅0.7%;但在Claude Opus 4.8、GPT-5.5和Gemini 3.1 Pro模仿特定作者文风后,297篇生成文本平均约13%未被识别。其中科学写作最难检测,三款工具漏检率分别达25%、24%和29%。