跳到正文
原文
arXiv · Machine Learning Theory· Nickil Maveli, Antonio Vergari, Shay B. Cohen·· 17 小时前AI 评分36

LLM 算法代码检索能力评测:合成还是回忆?

Are you Synthesizing or Recalling? Evaluating LLMs on Algorithmic Code Retrieval

AI 导读

研究者提出将知名算法的代码生成视为参数化代码检索,并发布基准 AlgoREval,含 599 个问题,覆盖 77 种经典算法、14 个领域、7 种编程语言和 4 种图输入表示。

来源:arXiv · Machine Learning Theory · arxiv.org