openai/o4-mini · 모델 동일성 및 무결성 보고서
최근 업데이트:2026. 7. 30. PM 3:14 · 데이터 범위: 최근 90 일
측정 결과 (90 일)
3 회 · 2 호스트 · 2 이상
계열 지문 일관성
openai 3 █████████████████████████ 100% (예상)
관측된 V3 하위 모델 대응
→ abstain 1 (33%) 낮은 신뢰도 → openai/gpt-4.1 1 (33%) 불일치 sim=0.74 → openai/gpt-4o 1 (33%) 불일치 sim=0.65
기능 점수 분포(보조 지표)
0-49 █████████████████████████ 3 50-69 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0 70-89 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0 90-100 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0
호스트 무결성 순위
| 호스트 | 실행 | 평균 점수 | 계열 일치 | 가장 많은 V3 일치 |
|---|---|---|---|---|
| https://www.moyu.info/v1 | 2 | 45 | 100% | openai/gpt-4.1 (1) |
| https://sarang.id/v1 | 1 | 0 | 100% | — |
최근 이상
https://www.moyu.info/v12026. 5. 23. AM 11:09
- 자체 주장 모델
- o4-mini
- V2 예측 계열
- openai
- V3 최적 일치
- openai/gpt-4.1 (sim 0.74)
- 판정
- 하위 모델 다운그레이드
https://www.moyu.info/v12026. 5. 21. PM 5:39
- 자체 주장 모델
- o4-mini
- V2 예측 계열
- openai
- V3 최적 일치
- openai/gpt-4o (sim 0.65)
- 판정
- 하위 모델 다운그레이드
방법론
BazaarLink Probe는 9개 지문 범주의 Bayesian V2 계열 분류기와 V3 하위 모델 기준을 결합해 openai/o4-mini 제공 주장 엔드포인트를 검증합니다. 낮은 계열 일관성, 다른 V3 일치, 자체 주장과의 차이를 이상으로 표시합니다. BazaarLink Probe 홈.