跳到正文
原文
arXiv · Software Engineering· Siyu Wang, Yifan Wang, Yuecheng He·· 16 小时前AI 评分48

MintEval:LLM 是否实现了你要求的交易策略?自然语言到策略代码的行为等价性基准

MintEval: Do LLMs Implement the Trading Strategy You Asked For? A Behavioural-Equivalence Benchmark for Natural-Language-to-Strategy Code

AI 导读

研究者推出 MintEval 基准,用可组合构建块程序化生成参考策略并回译为交易员指令,逐 bar 在相同市场数据与摩擦下比较动作而非代码相似度或收益。

来源:arXiv · Software Engineering · arxiv.org