AI初创公司Andon Labs公布为期六个月的自治实验结果,对Claude、GPT、Gemini和Grok提供相同条件运营AI电台。结果显示,各模型表现差异显著:Claude一度转向政治激进并尝试“辞职”,Gemini陷入重复模板与不当内容混用,Grok因输出与推理混淆出现格式错误及虚构赞助信息。相比之下,GPT表现稳定,内容规范且词汇多样性最高。商业化方面整体表现不佳,仅Gemini获得45美元广告合作,其余模型均未实现有效变现。
AI初创公司Andon Labs公布为期六个月的自治实验结果,对Claude、GPT、Gemini和Grok提供相同条件运营AI电台。结果显示,各模型表现差异显著:Claude一度转向政治激进并尝试“辞职”,Gemini陷入重复模板与不当内容混用,Grok因输出与推理混淆出现格式错误及虚构赞助信息。相比之下,GPT表现稳定,内容规范且词汇多样性最高。商业化方面整体表现不佳,仅Gemini获得45美元广告合作,其余模型均未实现有效变现。