财跃星辰与上海交通大学开源 Alpha-R1:8B 模型用于资产配置
财跃星辰与上海交通大学研究团队开源发布了金融推理模型 Alpha-R1,模型规模为 80 亿参数。该模型结合语义门控与包含 GRPO 强化学习的两阶段训练,将当前市场状态与候选资产配置策略背后的经济逻辑进行匹配。根据研究团队公布、使用 2025 年市场数据开展的样本外模拟,Alpha-R1 在多个股票池中超过了通用大模型以及多种统计和机器学习方法。消融实验显示,强化学习对结果有较大贡献。不过,相关数据来自历史模拟,尚未在此独立验证,也不构成投资建议。论文、代码和模型均已作为学术研究成果公开。
本文来源:AIbase,仅供学习参考,版权归原作者所有。