arXiv · Computers and Society· Ronald J. Bodkin, Bahrad A. Sokhansanj, Gillian K. Hadfield·· 3 小时前AI 评分41
理解力审计:降低自动化 AI 研究风险的机制
Comprehension Audits to Mitigate Risks from Automated AI Research
AI 导读
论文提出理解力审计这一新型开发流程保障机制,要求相关责任人向审计方解释其研发贡献以证明理解,未达标即暂停开发并逐级加重后果。分析显示,领先开源 AI 项目代码产出增加,但每行代码的人工评审评论率下降,自动化舰队账户的评审率更低。作者建议实验室引入嵌入式独立审计员执行该机制。
来源:arXiv · Computers and Society · arxiv.org