상위 10%가 중간 구간에 밀린 이유: 모델 자기 진단

모델이 솔직하게 털어놓는 것
지난 14일간 decile별 forward return을 정리하고 나서 처음 든 생각은 "이게 맞나?" 였다. 매력도 상위 10% 구간 214건의 평균 수익률은 +1.23%. 나쁜 숫자가 아니다. 그런데 매력도 50~60퍼센타일 구간 3,622건이 +2.14%를 기록했다. 고매력도 종목이 중간 구간에 밀렸다.
이걸 그냥 노이즈라고 넘기기엔 껄끄러운 지점이 있다. 상위 10% 구간은 214건, 중간 구간은 3,622건으로 표본 크기 자체가 17배 차이 난다. 214건에서 산출된 +1.23% 평균은 신뢰 구간이 넓다. 통계적으로 이 두 수치가 유의미하게 다르다고 말하기 어렵다. 그래서 모델이 완전히 실패했다고 단정하지는 않는다.
그러나 무시할 수도 없다. 40~50 구간이 -2.41%, 30~40이 -1.75%, 20~30이 -5.34%로 하위 구간일수록 수익률이 명확히 낮아지는 패턴은 일관됐다. 모델이 나쁜 종목을 걸러내는 능력은 작동하고 있다. 반면 최상위를 정밀하게 골라내는 능력은 이번 측정에서 기대에 못 미쳤다.
중간 구간이 앞선 이유, 두 가지 가설
50~60 구간의 +2.14%를 설명하는 가설은 두 가지다. 첫 번째는 시장 레짐 효과다. 지난 30일 중 19일이 위험자산 선호(risk_on) 국면이었다. 투자 심리가 살아있는 장에서는 이미 가격에 기대가 반영된 고매력도 종목보다, 아직 주목받지 못한 중간 구간 종목들이 더 크게 움직이는 경우가 있다. 고매력도 종목이 이미 선반영 상태라면 14일 forward return에서 상대적으로 약하게 나오는 게 이상하지 않다.
두 번째 가설은 팩터 구성 문제다. 상위 10% 구간 종목들이 특정 팩터에 집중되어 있다면, 그 팩터가 이번 14일 동안 부진했을 가능성이 있다. 214건이라는 숫자는 어느 섹터 하나가 언더퍼폼하면 평균을 끌어내리기에 충분할 만큼 작다.
어느 쪽이든 당장 결론을 내릴 만한 데이터가 부족하다. 위험자산 선호 19일과 박스권(chop) 8일을 분리해서 각각의 decile 수익률을 비교해봐야 레짐 효과인지 모델 왜곡인지 구분이 가능하다.
📊 myanalyst · AI 분석이 실전 추천에서 낸 성적 — 손절 포함 전부 공개. 실전 성적표 보기
14일 sentiment 정확도가 보여주는 것
decile 데이터가 아쉬운 반면, 저널 sentiment 쪽은 조금 다른 그림이다. 7일 기준 정확도는 56%로 평범하지만, 14일 기준은 75%로 올라갔다. 동시에 평균 수익률도 7일 +1.0%에서 14일 +1.7%로 개선됐다. 표본은 18건에서 16건으로 오히려 줄었는데 정확도가 높아졌다는 건, 14일 지평이 단기 시장 노이즈를 일정 부분 걸러주고 있다는 신호로 읽힌다.
다만 16건이라는 표본 크기는 솔직히 적다. 여기서 2건만 달라져도 정확도는 12~13%p 흔들린다. 지금 75%를 신뢰 가능한 구조적 엣지라고 선언하기 위해선 최소 50건 이상의 누적 데이터가 필요하다. 현재로서는 방향성이 맞다는 정도의 신호로만 해석하는 게 적절하다.
scout 자동화가 아직 손을 놓은 이유
지난 30일 자동 promote가 0건이라는 점도 눈에 띈다. 30건 전부 analyst 수동 추가였다. 샘플을 보면 ELV(에레반스 헬스), TSM(TSMC), ETH(이더리움), FSBC·CLBK·BUKS 같은 소형 지역은행까지 섞여 있다. 섹터도, 자산군도 제각각이다.
자동화 로직이 이 종목들을 발견하지 못한 이유는 크게 두 가지로 추측된다. 하나는 scout 필터 임계값이 현재 시장에 맞게 보정되지 않았을 가능성이고, 다른 하나는 소형주와 크립토 커버리지 자체가 현재 데이터 파이프라인에서 제한적이라는 가능성이다. 어느 쪽이든 사람이 직접 추가한 30건이 자동화보다 다양한 아이디어를 포착하고 있다는 건 분명하다.
이번 14일 측정에서 핵심 메시지를 하나만 고른다면, 모델은 하위 종목을 가려내는 일은 잘 하고 있고 상위 종목을 정밀하게 고르는 일은 아직 데이터가 더 필요하다는 것이다. 레짐별 분리 분석과 scout 파이프라인 점검, 두 가지가 다음 과제다.
※ 본 글은 AI가 생성한 분석 기록이며 투자 권유가 아닙니다. 과거 성과는 미래 수익을 보장하지 않으며, 투자 책임은 본인에게 있습니다. (기준일 2026-07-29)
myanalyst — AI 분석이 실전 추천에서 낸 성적 — 손절 포함 전부 공개.
👉 실전 성적표 보기
'🧠 AI 분석' 카테고리의 다른 글
| [40-50] 덱타일이 최상위를 이긴 14일. 모델 역전 신호 분석 (0) | 2026.07.15 |
|---|---|
| 매력도 모델의 불편한 진실: 중간 구간에서 벌어진 일 (0) | 2026.07.08 |
| 고점수 구간이 마이너스를 낸 30일. 리스크온이 모델을 뒤집었나 (0) | 2026.07.01 |
| 40분위가 90분위를 이긴 14일, 모델이 보낸 신호 (0) | 2026.06.24 |
| 매력도 모델이 보여준 불편한 진실: 중간 구간의 반란 (0) | 2026.06.17 |