30秒でわかる概要
競馬AIの今後の研究方針と実行ロードマップを全面的に再設計しました。
これからのPrimary Predictionは、**レース前日23時**で情報を固定します。
その時点までに利用可能な情報だけから、
**勝率 → Fair Odds(適正オッズ) → 市場価格との比較**
という順番で検証します。
今回、研究を進めるための3つのAuthorityを確認し、**3件すべて検証済み・未解決0件**となりました。
今後のロードマップは**8フェーズ・70タスク**。ただし固定上限ではなく、各フェーズ入口でEvidenceに応じて詳細タスクを追加できる構造です。
---
今回なにを変えた?
これまでのPost-Canonical開発を踏まえ、今後の競馬AI研究について3つの基準を正式化しました。
予測時点
Primary Cutoff:
RACE_DAY_MINUS_1_23_00_JST
つまり**レース前日23時**です。
Primary Pathでは同日情報を使用しません。
予測対象
Primary Target:
WIN_PROBABILITY
まず勝率を推定します。
価格
Fair Oddsは予測確率から算出します。
基本構造は、
**前日までのデータ → 勝率 → Fair Odds → 市場との比較**
です。
---
なぜ前日23時で固定する?
過去検証では、予測時点ではまだ知ることができなかった情報が後からデータへ反映される可能性があります。
そのため、モデルの性能だけでなく、
**「その情報は予測時点で本当に利用可能だったか」**
を確認できる研究構造が必要です。
今回、Primary Predictionの時間境界を明示し、後続工程から同じ基準を参照できるようにしました。
---
ロードマップ
新しい研究ロードマップは、
- 8フェーズ
- 70ロードマップタスク
- 8つのPhase Entry Expansion Task
で構成されています。
ただし70タスクは固定上限ではありません。
Phase EntryまたはEvidence Triggerによって追加検証が必要になった場合は、詳細タスクを追加します。
これにより、完了済みの履歴を保持したまま、研究を追加・分岐できます。
---
これから調べること
大きな流れは次のとおりです。
**前日23時時点のデータ整合性確認**
↓
**Baseline勝率モデル**
↓
**Calibration・Fair Odds**
↓
**特徴量研究**
↓
**モデル比較**
↓
**市場価格との比較**
↓
**購入条件・リスク管理**
↓
**Forward Validation**
↓
**Shadow運用**
最終的には、過去データ上だけではなく、実際に前日に保存した予測と確定結果を比較できる状態を目指します。
---
特徴量研究では何を見る?
今後は、近走、能力、距離・コース、タイム、ペース・脚質、騎手・調教師、血統などを順番に検証する予定です。
重要なのは、
**「追加したら良くなった」という結果だけを集めないこと。**
効果がなかった特徴量や却下した仮説も含め、
**何を変えたら、評価がどう変わったか**
を追跡できる研究記録にします。
---
今回確認した3つのAuthority
POST_CANONICAL_RESEARCH_CONSTITUTION_V1
結果:
RESEARCH_CONSTITUTION_VALIDATED
確認した主な内容:
- Primary Cutoff:前日23時
- Primary Target:勝率
- Fair Odds:予測確率から算出
- Primary Pathでは同日情報を禁止
POST_CANONICAL_EXECUTION_ROADMAP_V1
結果:
ROADMAP_AUTHORITY_VALIDATED
確認した主な内容:
- 8フェーズ
- 70ロードマップタスク
- 8 Phase Entry Expansion Tasks
- 詳細化はPhase Entry / Evidence Triggerで実施
POST_CANONICAL_ROADMAP_SUPERSESSION_AUTHORITY_V1
結果:
SUPERSESSION_AUTHORITY_VALIDATED
確認した主な内容:
- RF_DEV_118以前の完了履歴を保持
- 旧RF_DEV_119以降の計画を新ロードマップへ置換
- PRE15はHistorical Non-Primary Referenceとして保持
- Primary Timepointを前日23時へ変更
**3件すべて判定済み、未解決0件です。**
---
Verification
Task Evidence上では以下を確認しています。
task_substance_status:PASStask_substance_coverage:PASStask_substance_unresolved:PASStask_substance_evidence_refs:PASS
Evidence Stage:
TASK_COMPLETE_VALIDATED
---
今回まだ分かっていないこと
このTaskでは、予測性能・精度・収益・回収率の改善は検証していません。
今回確定したのは、
**今後の研究を、どの時点の情報・どの予測対象・どのロードマップで進めるか**
という研究基盤です。
---
次へ
次はPhase 13Rで、
**前日23時の時点で本当に利用可能だったデータだけを使えているか**
を含め、研究項目とデータ準備状況を詳細化します。
そこからBaseline勝率モデルへ進みます。
---
Task ID:
RF_DEV_119_POST_CANONICAL_RESEARCH_STRATEGY_AND_EXECUTION_ROADMAP_V1