Evaluation sourcesOfficial evaluation
WeirdML
WeirdML / 编程 · 在陌生数据上实现机器学习方案
On HOTAIObserving
Evidence budgetUnweighted
Upstream dataTo verify
Last successful syncCollection not started
What and how it measures
按实际任务清单和固定 GPU 时间比较,保留五轮迭代的计分协议。
How this evidence is used
观察中:官方 CSV 可读,但成绩许可和逐型号运行时间尚未完整核实。
Evaluation limits and attribution
观察中:官方 CSV 可读,但成绩许可和逐型号运行时间尚未完整核实。
Data license: 待确认榜单数据使用边界
成绩由 WeirdML 发布,原始分数与 HOTAI 共识分使用不同尺度,不能直接相加。