gpt5 · รายงานตัวตนและความถูกต้องของโมเดล
อัปเดตล่าสุด:30 ก.ค. 2569 12:43 · ช่วงข้อมูล: ย้อนหลัง 90 วัน
ผลที่วัดได้ (90 วัน)
6 ครั้ง · 4 โฮสต์ · 6 ความผิดปกติ
ความสอดคล้องของลายนิ้วมือตระกูล
openai 6 █████████████████████████ 100% (น่าสงสัย)
การจับคู่โมเดลย่อย V3 ที่สังเกต
→ openai/gpt-5 3 (50%) ไม่ตรง sim=0.85 → abstain 2 (33%) ความมั่นใจต่ำ → openai/gpt-5-mini 1 (17%) ไม่ตรง sim=0.76
การกระจายคะแนนความสามารถ (ตัวช่วย)
0-49 █████████████████░░░░░░░░ 4 50-69 ████░░░░░░░░░░░░░░░░░░░░░ 1 70-89 ████░░░░░░░░░░░░░░░░░░░░░ 1 90-100 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0
อันดับความถูกต้องของโฮสต์
| โฮสต์ | จำนวนครั้ง | คะแนนเฉลี่ย | ตระกูลตรงกัน | V3 ที่ตรงบ่อยที่สุด |
|---|---|---|---|---|
| https://www.moyu.info/v1 | 3 | 50 | 0% | openai/gpt-5 (3) |
| https://alloy-liver-congressional-role.trycloudflare.com/v1 | 1 | 33 | 0% | — |
| https://conduit.ozdoev.net/v1 | 1 | 80 | 0% | openai/gpt-5-mini (1) |
| https://vip.j3gb.com/v1 | 1 | 0 | 0% | — |
ความผิดปกติล่าสุด
https://alloy-liver-congressional-role.trycloudflare.com/v128 ก.ค. 2569 05:11
- โมเดลที่อ้างเอง
- gpt-5
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://conduit.ozdoev.net/v111 ก.ค. 2569 03:26
- โมเดลที่อ้างเอง
- gpt-5
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- openai/gpt-5-mini (sim 0.76)
- คำตัดสิน
- สลับโมเดลทั้งหมด
https://vip.j3gb.com/v19 ก.ค. 2569 11:27
- โมเดลที่อ้างเอง
- gpt-5
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://www.moyu.info/v122 พ.ค. 2569 10:35
- โมเดลที่อ้างเอง
- gpt-5
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- openai/gpt-5 (sim 0.73)
- คำตัดสิน
- สลับโมเดลทั้งหมด
https://www.moyu.info/v122 พ.ค. 2569 07:46
- โมเดลที่อ้างเอง
- gpt-5
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- openai/gpt-5 (sim 0.91)
- คำตัดสิน
- สลับโมเดลทั้งหมด
https://www.moyu.info/v120 พ.ค. 2569 06:16
- โมเดลที่อ้างเอง
- gpt-5
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- openai/gpt-5 (sim 0.92)
- คำตัดสิน
- สลับโมเดลทั้งหมด
วิธีการ
BazaarLink Probe ผสานตัวจำแนกตระกูล Bayesian V2 ในเก้าหมวดลายนิ้วมือกับข้อมูลอ้างอิงโมเดลย่อย V3 เพื่อตรวจ endpoint ที่อ้าง gpt5 ความสอดคล้องต่ำ ผล V3 ต่างกัน หรือไม่ตรงคำอ้าง จะถูกทำเครื่องหมายผิดปกติ หน้าแรก BazaarLink Probe.