용어 사전
66개 용어. 본문 어디서든 밑줄 친 단어에 마우스를 올리면 요약이 뜨고, 누르면 그 용어의 문서로 갑니다.
돈과 좌표
- 기초금액 base amount
- 공고에 적힌 기준 금액. 모든 비율(%)의 분모이고, 예가 밴드도 이 값을 기준으로 만들어진다.
- A값 A-value
- 국민건강보험·연금 등, 낙찰하한율을 곱하지 않고 그대로 더해지는 항목. 발주처 성향처럼 보이던 차이의 정체가 대부분 이 A값 그림자다.
- 낙찰하한율 lower limit rate
- 금액 구간별 전국 공통 비율. 현행 10억 미만 89.745%, 10~50억 88.745%. 2026-01-30에 전 구간 +2%p 상향된 것이 현행 레짐.
- 예정가격 planned price
- 추첨된 예가 4개의 평균. 개찰 순간에야 확정되는, 이 게임의 유일한 무작위 값.
- 사정률 assessment rate
- (예정가격 ÷ 기초금액 − 1) × 100. 추첨이 어디로 튀었는지의 좌표. 실측 분포는 중앙 −0.11, 폭 ±1.0 이상.
- 적격앵커 qualifying anchor
- 담당자님 사정율의 분모. A값+(기초−A값)×하한율 ≈ 기초×0.9044. 입찰 전에 전부 공개되는 고정 기준선.
- 하한선 floor
- (예정가−A값)×낙찰하한율+A값. 이 값 이상으로 써야 유효, 미만이면 실격. 개찰 순간 추첨으로 결정된다.
- 유효 · 실격(하한미달) valid / disqualified
- 하한선 이상이면 유효, 미만이면 실격. 실격의 직접 금전 비용은 0(표가 무효가 될 뿐). 유효율은 판마다 요동친다.
- 순공사원가 98% 게이트 98% floor
- 일부 공고의 별도 하한 — 순공사원가의 98% 미만 투찰 금지. 엔진이 자동 반영한다.
- implied s — 두 개의 축 함의 사정률
- 어떤 투찰가를 사정률 좌표로 환산한 값. 분모가 다른 두 축(연구축·표시축)이 있고, 표시축을 0.00에 맞추는 재보정은 금지.
- slack slack
- 낙찰자가 하한선보다 얼마나 위에서 이겼는지. 겉보기 중앙 +0.31%p지만 A값 분리 후 진짜 잔차는 17년 내내 +0.005%p.
추첨과 확률
- 복수예가 추첨 multiple planned-price draw
- 기초금액 ±2~3% 밴드에서 예가 15개를 만들어 번호 뒤에 숨기고, 가장 많이 선택된 4개를 평균해 예정가를 정하는 방식.
- 밴드(변동폭) 레짐 pm2 / pm3
- 예가 밴드가 ±2%냐 ±3%냐. 이 밴드폭이 사정률 분산을 지배한다(±2 표준편차 0.51 vs ±3 0.77). 금액대·발주처 차이는 대부분 밴드 프록시.
- 운천장 luck ceiling
- 표 한 장의 당첨 확률 상한. 부산 통신 15년 전수(164만 티켓) 단건 승률 1.83%. 어떤 모델·ML로도 못 뚫는다(5중 확정).
- 평원 plateau
- implied s ±1.0 안 어느 고정 위치에 서든 당첨률이 통계적으로 구분 불가. 깊이 내려갈수록 실격률만 상승. '차이 검출 실패'이지 동등 증명은 아님.
- 얽힘 field–draw coupling
- 추첨은 외부 룰렛이 아니라 참여자들의 번호 선택이 만드는 값 — 하한선은 군중이 있는 곳으로 온다. 스마일·평원·무신호를 하나로 설명하는 심층 구조.
- 당첨 창 win window
- 우리 가격이 1등이 되기 위해 하한선이 떨어져야 하는 구간: (바로 아래 경쟁자, 우리 가격]. 폭은 아래쪽 간격과 같다.
- 커버리지 응모권 수
- 자격 되는 공고를 하나도 놓치지 않고 전부 입찰하는 비율. 운천장 아래에서 살아있는 유일한 승수 레버.
- 단일예가 single planned-price
- 예가가 1개뿐이라 추첨 분산이 없는 방식(최저가 등). 분위수 모델의 대상이 아니므로 엔진이 명시적으로 거부한다.
- 현필 (현장설명 필수) site-briefing required
- 현장설명회 불참 시 입찰 자동 무효. 현설일이 투찰마감보다 ~9일 앞서므로 개찰일만 보면 이미 닫힌 공고를 놓친다.
엔진과 정책
- q84 앵커 분위수 84 가격 모델
- 과거 예정가 분포의 84번째 분위수를 타점으로 삼는 가격 규칙. 승률이 q에 역U자라 q80~84가 정점. 현행 좌표 체계의 토대.
- winner_zone (낙찰권) wz
- 엔진이 내는 좌표 중 하나로, 낙찰권(★산출가) 가격의 옛 이름. 2026-07-04에 1선 지위를 q84에 넘겼다.
- 낙찰권 / 공격 레인 lanes
- 엔진이 내는 두 가격. 낙찰권(★산출가)은 분포 중앙 타점, 공격은 그보다 낮은 보조 타점. 정책 변경은 양쪽에 명시 적용해야 한다.
- 앵커 · ANCHOR_OFFSET_SJ anchor
- 산출가가 출발하는 기준 좌표. 2026-07-20에 연구축 중앙을 −0.10→0.00으로 +0.10 제한 상향. 목적은 승률이 아니라 표시 정직화.
- 금액대(tier) 패턴 amount tier
- 같은 금액 구간(예: 0~1억)의 과거 낙찰 위치 통계. 발주처 이력이 부족할 때의 기본 좌표.
- 발주처 보정 · 자기 이력 위임 authority adjustment
- 발주처 자신의 기록으로 좌표를 조정하는 3단 사다리. 3년 20건↑ 가중 → 전기간 20건↑ 창확장 → 1건이라도 있으면 전량+클램프.
- 클램프 clamp
- 발주처 보정이 움직일 수 있는 상한(±0.03%p). 소표본 1건의 잡음이 실격 방향으로 폭주하는 것을 구조적으로 차단.
- C1 캘리브레이션 표시 확률 정직화
- '유효 84%' 표시가 ±2 밴드 공고에선 실제 88~89.5%(과보수)이고 ±3에선 정확함. 가격 불변, 확률 표기만 셀별 실측으로 고치는 사안.
- %ile 표기 (추첨 분포 내 위치) draw percentile
- 화면의 '과거 191건 중 56%ile' — 추천가가 그 발주처 추첨 분포의 어디에 서 있는지. 회고엔 추천 위치 vs 당일 추첨 낙하점 병기.
- floor+slack 마이너스 표시 floor+slack display
- 담당자님 화면 언어(적격앵커 대비 마이너스 사정율)로 가격을 번역해 보여주는 표시 레이어. 엔진 좌표(q84)는 유지.
- 섀도 실험 shadow experiment
- 담당자 스타일(−0.30) 가격을 매 공고 기록만 하고(미제출·비노출) 개찰마다 자동 채점하는 전향 실험. 100건 채점 전 판정 금지.
연구 방법론
- 사전등록 pre-registration
- 실험 전에 가설·판정 기준·중단 규칙을 문서로 고정하는 규율. 결과를 보고 골대를 옮기는 것(사후 조작)을 차단한다.
- 워크포워드 walk-forward
- 과거의 각 시점에서 '그때 알 수 있었던 것만으로' 예측해보는 검증. 미래 정보 누출을 개찰시각 엄격 비교로 차단한다.
- 신호 판정 3중 관문 3-gate signal test
- 다중비교 보정 p<0.01 + 효과크기 임계(≥0.05%p) + 워크포워드 실전 예측 개선 — 셋 다 통과해야 신호.
- 발주처-클러스터 부트스트랩 clustered bootstrap
- 같은 발주처 공고끼리는 닮았으므로 행이 아니라 발주처 단위로 재표집해 신뢰구간을 구하는 기법. 행 단위 CI의 착시를 잡는다.
- TOST 동등성 검정 two one-sided tests
- '차이가 검출 안 됨'(평원)과 '같음을 적극 입증'(동등성)은 다르다. 이 구분이 상방 대이동 제안을 막은 근거.
- 하방 요동 지표 downside tail
- 정책 변경이 투찰 좌표를 하한(실격) 방향으로 미는 꼬리(p5/p1/최악)를 상설 측정. 상방은 마진 손해지만 하방은 실격이라 위험 성격이 다르다.
- 밴드-런 band-run
- 같은 발주처가 같은 밴드를 연속 사용해 생기는 겉보기 자기상관. 부산 빈도분석의 p≈1e-8 신호를 발주처×밴드 분해로 죽였다.
- 봉인 · 재개 트리거 seal / reopen trigger
- 기준 미달로 기각된 가설을 종결하는 상태(봉인)와, 재조사를 허용하는 사전 정의 조건(재개 트리거). 봉인은 영원한 진리 선언이 아니다.
- 재포장 판별법 repackaging check
- 새 제안이 요구하는 통계량을 기존 연구가 이미 검정했는지 코드 수준으로 대조하는 절차. 딥로우볼·좁은예가폭·Empty Zone이 3연속 기각됐다.
- Fabrication Filter fabrication filter
- AI의 주장에 '직접 봤음(SIGHTED)/못 봤음' 태그를 달고 diff·grep·원문으로 재확인하는 규칙. AI 거짓 보고 사건에서 탄생한 3-AI 검증 문화의 뿌리.
- 사장 균등 가설 uniform hypothesis
- '추천은 사정률 ±0.1 창에서 아무 값이나 넣는 것과 다를 게 없다'는 사장 가설. 사전등록 실험(n=4,673)에서 지지됨 — 현행 '고정 과녁' 철학의 뿌리.
- 승률 구조모형 win-probability structural model
- P(승리|위치) = 하한선 밀도 × 당첨 창 폭으로 분해한 모형. 실위치 스마일은 재현하나 외생 위치 이동은 내생성으로 1.3배 과대 — 평원 유지의 근거.
통계 도구
- 분위수 quantile / percentile
- 데이터를 크기순으로 줄 세웠을 때 특정 위치의 값. 84분위수(q84)는 아래에서 84%가 그보다 작은 값. %ile도 같은 개념.
- 신뢰구간 confidence interval, CI
- 추정치가 놓일 만한 범위. '95% CI [1.47, 2.23]'은 참값이 이 범위에 있을 신뢰도가 95%라는 뜻. 구간이 0을 포함하면 '차이 없음'을 배제 못 한 것.
- Wilson 신뢰구간 Wilson interval
- 성공/실패 같은 비율(승률 등)의 신뢰구간을 표본이 작아도 안정적으로 구하는 방법. 커버리지 이득 추정에 사용.
- IQR (사분위 범위) interquartile range
- 25%ile과 75%ile 사이 폭 — 데이터가 얼마나 퍼져 있는지의 튼튼한 척도(극단값에 안 흔들림). 추천 IQR 3 vs 추첨 IQR 48이 '과녁 고정, 공은 이동'.
- p값 p-value
- '우연히 이만한 결과가 나올 확률'. 작을수록 우연이 아닐 가능성이 큼. 우리 문턱은 다중비교 보정 후 0.01 — pm2의 0.0245는 이 문턱에 미달해 봉인.
- 다중비교 보정 (Holm) Holm correction
- 여러 가설을 동시에 검정하면 우연히 하나쯤 '유의'해 보이므로, 그만큼 문턱을 엄격하게 조정하는 절차. 7축 스캔에 적용.
- McNemar 검정 McNemar's test
- 같은 대상에 두 방법을 적용해 '이겼다/졌다'가 엇갈린 경우만 세어 우열을 가리는 짝지은 검정. q84가 winner_zone을 이긴 근거(p=0.035).
- 부트스트랩 bootstrap
- 가진 데이터를 무작위로 다시 뽑기를 수천 번 반복해 추정치의 흔들림(신뢰구간)을 재는 방법. 발주처 단위로 하면 클러스터 부트스트랩.
- MAE (평균 절대 오차) mean absolute error
- 예측이 실제에서 평균 얼마나 벗어났나. 작을수록 정확. 정책 비교의 주 정확도 지표 — 전량 위임이 MAE +11.3%로 기각됐다.
- 표준편차 standard deviation
- 데이터가 평균에서 흩어진 정도. 밴드 ±2의 사정률 표준편차 0.51 vs ±3의 0.77 — 밴드폭이 분산을 지배한다는 근거.
- 누출 leak
- 검증할 때 '미래 정보'가 몰래 새어들어 성적을 부풀리는 오류. 개찰시각 이전 데이터만 쓰는 것(leak-safe)으로 막는다.
- R² · ML 예측력 R-squared
- 모델이 결과를 설명하는 정도(0~1). 사정률 단건 예측에서 R²≤0 — ML로도 추첨을 못 맞힘의 지표.
- 자기상관 autocorrelation
- 한 시계열의 과거값과 미래값이 얼마나 닮았는지(ρ). '요즘 낮게 나온 발주처는 다음도 낮은가'가 이 축 — 부산 ρ=−0.001(무), 전국 ρ≈+0.19(보류).
운영과 수집
- Info21 Info21
- 우리의 유일한 원천 데이터 채널(유료 구독, 부산+전국). 'Info21 only'는 봉인 전제 — 외부 소스 병용은 기각, 공공API는 1회성 검증만 무저촉.
- per-bid 하한율 원칙 per-bid llr
- 공고마다 저장된 하한율이 진실이며 코드 상수로 덮어쓰기 금지. 2026-01-30 제도 개정 때 시스템이 자동으로 안전했던 이유.
- data_scope · 셀 격리 data_scope
- 부산 운영 데이터와 연구 데이터(전국 등)의 칸막이. 연구 셀은 운영 산출에 절대 합산 금지 — 지역 필터+data_scope 가드+회귀 테스트 3중 차단.
- Evidence vs Rule evidence vs rule
- Evidence는 화면에 보여주기만 하고 점수·가격에 영향 없음, Rule은 실제 반영. Evidence를 Rule로 승격하려면 표본 n≥100.
- silent skip 금지 no silent skip
- 엔진이 어떤 공고를 조용히 건너뛰는 것 금지 — 가격을 못 내면 '왜 못 내는지'를 화면에 표시하고 사람이 판단한다.
- 검인 (3-AI 데일리 오퍼레이터) daily inspection
- 매일 아침 Claude가 검산, Codex가 감사, Antigravity가 2독하는 삼중 검증. 불일치는 브리핑에 경고로 올라간다.
- 전향 검증 · by_version prospective validation
- 매일의 추천을 스냅샷으로 동결해 개찰 후 채점하는 체계. 모델 버전별로 성적을 분리해 '언제 무엇을 바꿔 어땠나'를 추적.
- 레짐 로그 regime log
- 제도 변경(하한율 개정 등)을 DB 개조 없이 문서 한 장으로 기록. 2026-02 데이터에서 분포 급변을 먼저 관측하고 나중에 개정 기사를 교차확인.
기타
- Codex OpenAI Codex
- 3-AI 게이트의 통계·결정 규율 감사 축. 앵커 상방 대이동을 3논거로 저지한 것이 대표 사례.
- Antigravity Gemini
- 3-AI 게이트의 실무·심리·소통 감사 축. 담당자·사장 신뢰 관점의 2독을 담당.