開発ログ

市場情報を利用するChallengerモデルを検証する

30秒でわかる今回の進展

市場情報を予測へ加えたChallengerモデルを、既存Baselineと同じ基準で比較できる状態にしました。

重要なのは、単に「市場を使うモデル」を作ったことではありません。市場情報の重みをゼロにした場合にBaselineを再現できること、BaselineとChallengerを比較できること、Brier lossで評価できることまで検証対象として固定しました。

これにより、今後は市場情報の有無による違いを、同じ土俵で確認できます。

何を確認したか

今回、正式な検証対象として確認したのは次の項目です。

  • market_aware_probability
  • baseline_reproduction_at_zero_weight
  • baseline_vs_challenger_comparison
  • brier_loss_evaluation

市場情報を利用した確率を扱えることに加え、市場情報の重みをゼロにしたときBaselineを再現できることを確認対象にしています。

これは、Challengerとの差分を市場情報の影響として比較するための重要な基準です。

検証結果

対象8件をすべて判定し、未解決は0件でした。全8件が VERIFIED となっています。

今回できるようになったこと

これまでの工程では、市場オッズを確率へ変換し、Fair Oddsとの乖離や条件別の市場Biasを扱う基準を整えてきました。

今回、その市場情報を実際にChallengerモデルへ組み込み、既存Baselineと比較するための実験土台まで進みました。

ただし、この工程だけで「市場情報を使えば性能が上がる」と結論づけることはしません。今回確認したのは、比較と評価を正しく行える状態です。

次の工程

次は、オッズ変動とAlpha減衰を分析します。

予測時点で見つけた市場とのズレが、時間経過やオッズ変化によってどのように変わるのかを確認し、実際の意思決定時点で使える情報かどうかへ近づけていきます。

制約

この工程のEvidenceに記録されていない性能・収益・精度は主張しません。公開内容は、Task Evidenceで確認できた範囲に限定しています。

全体ロードマップを見る →

← 開発ログへ戻る

掲載内容は、その時点の開発・検証記録です。将来の利益や的中を保証するものではありません。