财跃星辰联合上海交通大学安泰经济与管理学院花成副教授团队开源发布金融推理大模型Alpha-R1。模型基于8B参数规模,引入“语义门控”推理技术和两阶段强化学习框架,可结合实时行情与财经新闻生成市场状态,并从候选策略中筛选匹配方案。团队使用2025年全年未参与训练的真实行情开展样本外模拟,Alpha-R1在标普500任务中的模拟年化收益为47.87%,DeepSeek-R1在标普500和沪深300任务中分别为21.94%和14.66%。模型、代码及论文已同步开源,并在罗素2000、中证1000等未见股票池中进行测试。