2 evaluationsLow confidenceRank range第 1 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 2 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 3 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 4 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range5—6 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range6—8 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range6—7 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range5—8 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range9—10 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range10—11 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range9—11 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 12 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 13 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 14 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range第 15 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range16—17 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range16—17 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range18—20 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range18—19 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range19—20 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range21—23 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range21—23 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range22—25 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range22—24 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range25—28 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range25—28 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range24—29 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range25—30 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range26—31 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
2 evaluationsLow confidenceRank range29—31 名Rank after checking eligibility across 8 scenarios. 3 scenarios lack enough evidence. This is not a confidence interval.
¥0.0243
¥2.92
¥5.83
48.9
Up to 30 models are shown per board
The consensus index is not accuracy; ties follow the ranking supported by shared evidence.
How to read this board
当前知识榜采用 Epoch 的两项评测,来自同一家机构。 Prices do not affect ranking; missing scores are not treated as zero, and the index is not accuracy.
API prices come from vendor websites and are shown per million tokens. USD quotes are converted using the 2026-09-30 exchange rate. Cached price is the input price after a cache hit; cache writes, storage and subscription fees are separate.