arXiv · Software Engineering· Siyu Wang, Yifan Wang, Yuecheng He·· 16 小时前AI 评分48
MintEval:LLM 是否实现了你要求的交易策略?自然语言到策略代码的行为等价性基准
MintEval: Do LLMs Implement the Trading Strategy You Asked For? A Behavioural-Equivalence Benchmark for Natural-Language-to-Strategy Code
AI 导读
研究者推出 MintEval 基准,用可组合构建块程序化生成参考策略并回译为交易员指令,逐 bar 在相同市场数据与摩擦下比较动作而非代码相似度或收益。
来源:arXiv · Software Engineering · arxiv.org