예측 방식
예상의 근거를 공개하지 않는 사이트는 검증할 수 없습니다. 이 페이지는 어떤 데이터로 무엇을 계산했고, 무엇을 쓰지 않았는지까지 밝힙니다.
데이터 출처
전적으로 공공데이터포털에 공개된 한국마사회 오픈API를 사용합니다. 비공개 정보나 출처 불명의 자료는 쓰지 않습니다.
- 출전표 상세정보 — 경주 시행 전 확정되는 출주마·마번·부담중량·레이팅·기수·조교사 정보
- 경주성적정보 — 시행 후의 착순·경주기록·마체중·배당률·날씨·주로 상태, 그리고 S1F·코너별·G1F 구간 통과순위와 구간 기록
예측 엔진이 산출하는 것
과거 수년간의 경주 결과를 학습한 통계 모형(그래디언트 부스팅)이 출주마별 우승 확률과 3착 이내 확률을 산출합니다. 한 경주에서 우승하는 말은 정확히 한 마리이므로, 산출된 확률은 경주 내 합계가 100%가 되도록 정규화합니다. 이 정규화 덕분에 산출값을 배당률과 직접 비교할 수 있습니다.
엔진이 종합하는 지표는 크게 다음 네 갈래입니다.
- 당일 공개 정보 — 거리, 등급, 두수, 출주번호, 부담중량, 레이팅, 연령·성별
- 마필 이력 — 과거 승률·복승률, 최근 착순 추이, 경주 내 상대 속도지수, 휴양 일수, 거리 적성, 등급 이동, 마체중 증감
- 각질과 전개 — 과거 S1F 통과순위로 판정한 선행·선입·추입, 그리고 같은 경주에 선행마가 몇 두 몰렸는지에 따른 전개 유불리
- 기수·조교사 이력 — 누적 승률, 최근 성적, 기수-마필 조합 성적
의도적으로 배제한 것
배당률을 예측에 쓰지 않습니다. 배당률은 대중의 예측이 집약된 매우 강력한 신호라, 피처로 넣으면 적중률은 쉽게 올라갑니다. 그러나 그렇게 만든 모델은 결국 인기 순위를 따라 읽는 것에 가까워집니다. 이 사이트는 배당률을 평가 단계에서만 사용해, 1인기(최저 단승배당)를 그대로 찍었을 때와 모델의 성적을 비교합니다. 시장을 이기지 못하는 예상은 존재 이유가 없기 때문입니다.
또한 경주 후에만 알 수 있는 값(착순, 경주기록, 당일 마체중)은 어떤 형태로도 피처에 들어가지 않습니다. 이 원칙은 자동화된 회귀 테스트로 매 빌드마다 검증합니다. 특정 시점의 예측값을 계산할 때 그 이후 데이터를 삭제하고 다시 계산해도 결과가 동일해야 통과합니다.
예상은 공개 후 수정하지 않습니다
예측은 경주 시작 전에 생성해 저장하고, 경주일이 지나면 어떤 경우에도 다시 쓰지 않습니다. 사후에 손댈 수 있다면 적중률 전체가 의미를 잃습니다. 기수 변경이나 출주 취소가 반영되는 것은 경주일 이전까지입니다.
경주 단평에 대하여
경주 페이지의 단평은 자동 생성됩니다. 다만 숫자를 만들지는 않습니다. 승률과 순위는 예측 엔진이 산출한 값이고, 문장 생성에는 데이터베이스에서 뽑은 사실과 그 수치만 전달됩니다. 부상 이력이나 조교 상태처럼 입력에 없는 정보는 서술하지 못하도록 제약되어 있습니다. 인상평이 아니라 수치의 번역입니다.
이 방법의 한계
- 경마에는 모델이 볼 수 없는 요소가 많습니다. 당일 컨디션, 주행 중 진로 방해, 기수의 전술적 판단은 데이터에 남지 않거나 사후에만 드러납니다.
- 신마나 전입마는 이력이 없어 예측 정확도가 크게 떨어집니다.
- 적중률이 높아도 수익이 보장되지 않습니다. 인기마를 주로 맞히면 배당이 낮아 회수율은 오히려 낮을 수 있습니다.
면책
본 사이트는 참고용 정보를 무료로 제공합니다. 마권 구매를 권유하지 않으며, 구매 결과에 대해 책임지지 않습니다. 경마는 만 19세 이상만 참여할 수 있고, 과도한 베팅은 도박 중독으로 이어질 수 있습니다. 도움이 필요하면 한국도박문제예방치유원(1336)에 문의하세요.