B站上线“AI无限竞技场”大模型测评榜,并公布首轮排名。该榜单汇总10位UP主对上百个大模型的真实场景实测,覆盖代码、推理、协作、知识等主题,采用开放命题和同题对比方式,排名实时刷新。首轮结果显示,GPT-6Astra位列第一并获登顶次数冠军,GLM-5.3居其后,前五名中国产大模型占三席。DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、MiniMax等模型纳入对比,榜单将持续向全站UP主开放报名。
B站上线“AI无限竞技场”大模型测评榜,并公布首轮排名。该榜单汇总10位UP主对上百个大模型的真实场景实测,覆盖代码、推理、协作、知识等主题,采用开放命题和同题对比方式,排名实时刷新。首轮结果显示,GPT-6Astra位列第一并获登顶次数冠军,GLM-5.3居其后,前五名中国产大模型占三席。DeepSeek、Kimi、ChatGPT、Claude、Gemini、豆包、千问、MiniMax等模型纳入对比,榜单将持续向全站UP主开放报名。