把我們押在「主隊勝」跟「客隊勝」的場次分開算 — 如果一邊命中率明顯高過另一邊,表示模型對主場優勢的估計偏掉。
| 聯盟 | 模型版本 | 勝率 | 命中 / 嘗試 | 已結算 | 平均信心 |
|---|---|---|---|---|---|
| MLB | elo-v1 | 57.8% | 26 / 45 | 45 | 53.0% |
| 聯盟 | 模型版本 | 勝率 | 命中 / 嘗試 | 已結算 | 平均信心 |
|---|---|---|---|---|---|
| MLB | elo-v1 | 52.3% | 224 / 428 | 439 | 53.4% |
| NBA | elo-v1 | 樣本不足 (n=19) | 3 / 9 | 19 | 59.8% |
| 聯盟 | 模型版本 | 勝率 | 命中 / 嘗試 | 已結算 | 平均信心 |
|---|---|---|---|---|---|
| MLB | elo-v1 | 52.7% | 477 / 905 | 916 | 53.5% |
| NBA | elo-v1 | 40.0% | 10 / 25 | 35 | 61.3% |
| 聯盟 | 模型版本 | 勝率 | 命中 / 嘗試 | Brier | 已結算 |
|---|---|---|---|---|---|
| FIFA World Cup | wc-elo-v1 | 62.0% | 57 / 92 | 0.2567 | 92 |
完美校準
我們說「70% 會贏」的場次,實際贏了幾成?點越貼近虛線,模型對自己的信心越誠實。藍 = 比預測還準(偏保守),紅 = 比預測差(偏自信),綠 = ±5% 內。
勝負模型 · 已結算 930 場(不含作廢)