← 返回模型頁

openai/gpt-5.1-codex · Identity & Integrity Report

最後更新:2026/7/22 上午4:43:17 · 資料範圍:過去 90

實測結果 (過去 90 天)

4 runs · 1 個 hosts · 4 個異常

家族指紋一致性

  openai           4  █████████████████████████  100% (預期)

V3 子模型實際對應

  → openai/gpt-5.4                           3 (75%) ⚠ 不符 sim=1.00
  → abstain                                  1 (25%) — 低信心

能力分數分佈 (輔助)

  0-49     ██████░░░░░░░░░░░░░░░░░░░    1
  50-69    ░░░░░░░░░░░░░░░░░░░░░░░░░    0
  70-89    ███████████████████░░░░░░    3
  90-100   ░░░░░░░░░░░░░░░░░░░░░░░░░    0

Hosts 可信度排行

HostRuns平均分家族符合V3 最常匹配
https://www.moyu.info/v1464100%openai/gpt-5.4 (3)

最近異常個案

https://www.moyu.info/v12026/5/22 上午6:39:07
selfClaim
gpt-5.1-codex
V2 家族預測
openai
V3 最佳匹配
判定
V3 低信心 · Abstain
https://www.moyu.info/v12026/5/22 上午6:39:07
selfClaim
gpt-5.1-codex
V2 家族預測
openai
V3 最佳匹配
openai/gpt-5.4 (sim 1.00)
判定
降級 · Sub-model Downgrade
https://www.moyu.info/v12026/5/20 上午6:58:19
selfClaim
gpt-5.1-codex
V2 家族預測
openai
V3 最佳匹配
openai/gpt-5.4 (sim 1.00)
判定
降級 · Sub-model Downgrade
https://www.moyu.info/v12026/5/20 上午6:46:01
selfClaim
gpt-5.1-codex
V2 家族預測
openai
V3 最佳匹配
openai/gpt-5.4 (sim 1.00)
判定
降級 · Sub-model Downgrade

方法論

BazaarLink Probe 結合 V2 家族分類器(Bayesian 多訊號加權,9 類指紋特徵)與 V3 子模型 baseline 對照, 對聲稱提供 openai/gpt-5.1-codex 的 endpoint 進行身份驗證。 家族一致率過低、V3 匹配到不同子模型、或行為與 selfClaim 分歧,皆會被標記為異常。 完整技術細節請見 BazaarLink Probe 主頁

自己動手測試一個 endpoint →