arXiv · Machine Learning Theory· Nickil Maveli, Antonio Vergari, Shay B. Cohen·· 17 小时前AI 评分36
LLM 算法代码检索能力评测:合成还是回忆?
Are you Synthesizing or Recalling? Evaluating LLMs on Algorithmic Code Retrieval
AI 导读
研究者提出将知名算法的代码生成视为参数化代码检索,并发布基准 AlgoREval,含 599 个问题,覆盖 77 种经典算法、14 个领域、7 种编程语言和 4 种图输入表示。
来源:arXiv · Machine Learning Theory · arxiv.org