科大讯飞开源星火 X2.5 端侧模型,原生支持 100 万 Token 上下文

9 月 1 日,科大讯飞全资子公司词元星火发布并开源星火 X2.5-4B、星火 X2.5-1.7B 两款端侧通用大模型,开放模型权重、代码仓库和部署文档。两款模型采用混合注意力架构,原生支持最长 100 万 Token 上下文,面向智能体、代码、数学和指令遵循等能力优化。模型基于全国产算力平台完成训练,使用约 20 万亿 Token 数据预训练,支持 NVIDIA、华为、海光等硬件及主流推理框架,已上线 Hugging Face、GitHub 和讯飞星辰 MaaS 平台。

上一篇:

下一篇:

发表回复

登录后才能评论