arXiv · Human-Computer Interaction· Chang Han, Andrew McNutt, Katherine Isaacs·· 3 小时前AI 评分32
LLM 在可视化 DSL 中失败在哪里
Where LLMs Fail with Visualization DSLs
AI 导读
研究评估了 10 种 JSON 风格可视化 DSL 与 3 个 LLM 在 41 个任务上的表现,通过 JSON 与渲染检查及失败案例定性编码,识别出 4 种重复失败模式并关联到具体 DSL 特性。论文讨论未来 DSL 设计考量,旨在让模型更易生成正确的可视化规范。
来源:arXiv · Human-Computer Interaction · arxiv.org