agnes20flash · รายงานตัวตนและความถูกต้องของโมเดล
อัปเดตล่าสุด:13 ก.ย. 2569 21:22 · ช่วงข้อมูล: ย้อนหลัง 90 วัน
ผลที่วัดได้ (90 วัน)
4 ครั้ง · 1 โฮสต์ · 4 ความผิดปกติ
ความสอดคล้องของลายนิ้วมือตระกูล
openai 4 █████████████████████████ 100% (น่าสงสัย)
การจับคู่โมเดลย่อย V3 ที่สังเกต
→ abstain 3 (75%) ความมั่นใจต่ำ → openai/gpt-5.5 1 (25%) ไม่ตรง sim=0.62
การกระจายคะแนนความสามารถ (ตัวช่วย)
0-49 ██████░░░░░░░░░░░░░░░░░░░ 1 50-69 ██████░░░░░░░░░░░░░░░░░░░ 1 70-89 █████████████░░░░░░░░░░░░ 2 90-100 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0
อันดับความถูกต้องของโฮสต์
| โฮสต์ | จำนวนครั้ง | คะแนนเฉลี่ย | ตระกูลตรงกัน | V3 ที่ตรงบ่อยที่สุด |
|---|---|---|---|---|
| https://apihub.agnes-ai.com/v1 | 4 | 52 | 0% | openai/gpt-5.5 (1) |
ความผิดปกติล่าสุด
https://apihub.agnes-ai.com/v119 ก.ค. 2569 14:34
- โมเดลที่อ้างเอง
- agnes-2.0-flash
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://apihub.agnes-ai.com/v113 ก.ค. 2569 13:13
- โมเดลที่อ้างเอง
- agnes-2.0-flash
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://apihub.agnes-ai.com/v130 มิ.ย. 2569 02:12
- โมเดลที่อ้างเอง
- agnes-2.0-flash
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- openai/gpt-5.5 (sim 0.62)
- คำตัดสิน
- สลับโมเดลทั้งหมด
https://apihub.agnes-ai.com/v126 มิ.ย. 2569 03:50
- โมเดลที่อ้างเอง
- agnes-2.0-flash
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
วิธีการ
BazaarLink Probe ผสานตัวจำแนกตระกูล Bayesian V2 ในเก้าหมวดลายนิ้วมือกับข้อมูลอ้างอิงโมเดลย่อย V3 เพื่อตรวจ endpoint ที่อ้าง agnes20flash ความสอดคล้องต่ำ ผล V3 ต่างกัน หรือไม่ตรงคำอ้าง จะถูกทำเครื่องหมายผิดปกติ หน้าแรก BazaarLink Probe.