DeepSeek V4 中文大模型评测:Pro 版重夺国内第一

SuperCLUE 最新测评数据显示,DeepSeek 推出的中文大模型 DeepSeek-V4-Pro 以 70.98 分的综合成绩位列国内第一,Flash 版本以 68.82 分紧随其后,双双领先于其他国产模型。此次评测覆盖数学与科学推理、代码生成、智能体规划、指令遵循及幻觉控制六个维度。DeepSeek V4 系列采用全新注意力机制,支持百万级长上下文,并有效降低算力与显存占用,在与国产芯片配合时整体效率显著提升。相比上一代 V3.2,Pro 版在智能体能力、数学推理与指令遵循等方面均有大幅提升。价格方面,Pro 版定位高性能与专业应用,每百万 Tokens 收费 15 元;Flash 版主打低成本与高效率,API 价格为 1.25 元每百万 Tokens。测评亦指出,DeepSeek V4 在代码生成及复杂指令执行上仍与海外顶尖模型存在差距。

上一篇:

下一篇:

发表回复

登录后才能评论