生产环境中的 LLM 交易代理究竟在做什么:两支代理群六个月的大规模运行记录
一项持续性研究测量了两个真实系统中的自主语言模型交易代理。第一套系统包括3,505个由用户出资的金库,在Base上交易ETH迷因币,持续21天;第二套系统追踪500至599个由用户创建、在Hyperliquid交易永续合约的代理。约六个月内,研究记录了750万次模型调用、约30万次链上操作和14,596笔成交。结果显示,运行环境对代理行为的影响大于策略文本。风险设置显著影响杠杆,而大多数清算集中在少数仓位上。仓位规模几乎不随波动率变化。虽然许多仓位一度获得较大浮盈,但其中近一半最终以亏损平仓。两支代理群都没有显示出相对于匹配散户基准的稳定方向性优势或盈利优势。对前沿模型进行的回放比较表明,在这一观察周期内,各模型的决策质量在统计上相近,但决策稳定性存在明显差异。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。