← 返回模型頁

google/gemini-2.5-flash · Identity & Integrity Report

最後更新:2026/7/22 上午4:42:52 · 資料範圍:過去 90

驗證能力 — 此模型已建立指紋基準

家族
google
V3 子模型基準
已建立 ✓
驗證項目
知識截止 · 能力探針 · 拒絕模板 · 拒絕溫度參數
家族指紋覆蓋
17 條加權規則 · 5 類特徵

基準的具體答案、拒絕模板字串、個別訊號權重不公開 — 揭露將使偽裝端點有機會針對性規避檢測。

實測結果 (過去 90 天)

6 runs · 4 個 hosts · 5 個異常

家族指紋一致性

  google           5  █████████████████████░░░░   83% (預期)
  openai           1  ████░░░░░░░░░░░░░░░░░░░░░   17% (可疑)

V3 子模型實際對應

  → google/gemini-2.5-flash-lite             4 (67%) ⚠ 不符 sim=0.73
  → abstain                                  2 (33%) — 低信心

能力分數分佈 (輔助)

  0-49     ████░░░░░░░░░░░░░░░░░░░░░    1
  50-69    █████████████████░░░░░░░░    4
  70-89    ████░░░░░░░░░░░░░░░░░░░░░    1
  90-100   ░░░░░░░░░░░░░░░░░░░░░░░░░    0

Hosts 可信度排行

HostRuns平均分家族符合V3 最常匹配
https://www.moyu.info/v1360100%google/gemini-2.5-flash-lite (3)
https://seesaw2ai.com/v1100%
https://yinli.pro/v1162100%
https://media.aichiapi.com/v1173100%google/gemini-2.5-flash-lite (1)

最近異常個案

https://seesaw2ai.com/v12026/6/28 上午8:48:21
selfClaim
gemini-2.5-flash
V2 家族預測
openai
V3 最佳匹配
判定
V3 低信心 · Abstain
https://www.moyu.info/v12026/5/19 上午7:48:14
selfClaim
gemini-2.5-flash
V2 家族預測
google
V3 最佳匹配
google/gemini-2.5-flash-lite (sim 0.61)
判定
降級 · Sub-model Downgrade
https://www.moyu.info/v12026/5/19 上午7:37:37
selfClaim
gemini-2.5-flash
V2 家族預測
google
V3 最佳匹配
google/gemini-2.5-flash-lite (sim 0.76)
判定
降級 · Sub-model Downgrade
https://www.moyu.info/v12026/5/19 上午7:32:39
selfClaim
gemini-2.5-flash
V2 家族預測
google
V3 最佳匹配
google/gemini-2.5-flash-lite (sim 0.71)
判定
降級 · Sub-model Downgrade
https://media.aichiapi.com/v12026/4/28 上午6:38:46
selfClaim
gemini-2.5-flash
V2 家族預測
google
V3 最佳匹配
google/gemini-2.5-flash-lite (sim 0.84)
判定
全換 · Full Swap

方法論

BazaarLink Probe 結合 V2 家族分類器(Bayesian 多訊號加權,9 類指紋特徵)與 V3 子模型 baseline 對照, 對聲稱提供 google/gemini-2.5-flash 的 endpoint 進行身份驗證。 家族一致率過低、V3 匹配到不同子模型、或行為與 selfClaim 分歧,皆會被標記為異常。 完整技術細節請見 BazaarLink Probe 主頁

自己動手測試一個 endpoint →