cantus · モデル同一性・完全性レポート
最終更新:2026/08/10 14:41 · データ範囲:過去 90 日
実測結果 (90 日)
5 回 · 2 hosts · 5 件の異常
ファミリー指紋の一致性
qwen 3 ███████████████░░░░░░░░░░ 60% (要注意) anthropic 2 ██████████░░░░░░░░░░░░░░░ 40% (要注意)
V3 サブモデル実測対応
→ abstain 3 (60%) — 低信頼 → qwen/qwen3-next-80b-a3b-instruct 2 (40%) ⚠ 不一致 sim=0.68
能力スコア分布(補助)
0-49 ██████████░░░░░░░░░░░░░░░ 2 50-69 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0 70-89 ███████████████░░░░░░░░░░ 3 90-100 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0
Host 完全性ランキング
| エンドポイント | 検証回数 | 平均点 | ファミリー一致 | 最多 V3 一致 |
|---|---|---|---|---|
| https://ai.kaiplay.my.id/v1 | 3 | 54 | 0% | — |
| https://api.gnrt.dev/v1 | 2 | 38 | 0% | qwen/qwen3-next-80b-a3b-instruct (2) |
最近の異常事例
https://ai.kaiplay.my.id/v12026/08/10 13:24
- 自己申告モデル
- qd/cantus
- V2 予測ファミリー
- qwen
- V3 最適一致
- —
- 判定
- ファミリー不一致
https://ai.kaiplay.my.id/v12026/08/10 6:51
- 自己申告モデル
- qd/cantus
- V2 予測ファミリー
- anthropic
- V3 最適一致
- —
- 判定
- V3 低信頼 · Abstain
https://ai.kaiplay.my.id/v12026/08/09 11:57
- 自己申告モデル
- qd/cantus
- V2 予測ファミリー
- anthropic
- V3 最適一致
- —
- 判定
- ファミリー不一致
https://api.gnrt.dev/v12026/08/04 12:42
- 自己申告モデル
- qd/cantus
- V2 予測ファミリー
- qwen
- V3 最適一致
- qwen/qwen3-next-80b-a3b-instruct (sim 0.65)
- 判定
- 完全置換 · Full Swap
https://api.gnrt.dev/v12026/07/31 3:26
- 自己申告モデル
- qd/cantus
- V2 予測ファミリー
- qwen
- V3 最適一致
- qwen/qwen3-next-80b-a3b-instruct (sim 0.72)
- 判定
- 完全置換 · Full Swap
方法論
BazaarLink Probe は 9 種の指紋特徴を使う Bayesian V2 ファミリー分類器と V3 サブモデル基準を組み合わせ、cantus を提供すると申告する endpoint を検証します。ファミリー一致率の低下、異なる V3 モデルとの一致、selfClaim との乖離を異常として扱います。 BazaarLink Probe トップ.