cantus · รายงานตัวตนและความถูกต้องของโมเดล
อัปเดตล่าสุด:10 ส.ค. 2569 14:41 · ช่วงข้อมูล: ย้อนหลัง 90 วัน
ผลที่วัดได้ (90 วัน)
5 ครั้ง · 2 โฮสต์ · 5 ความผิดปกติ
ความสอดคล้องของลายนิ้วมือตระกูล
qwen 3 ███████████████░░░░░░░░░░ 60% (น่าสงสัย) anthropic 2 ██████████░░░░░░░░░░░░░░░ 40% (น่าสงสัย)
การจับคู่โมเดลย่อย V3 ที่สังเกต
→ abstain 3 (60%) ความมั่นใจต่ำ → qwen/qwen3-next-80b-a3b-instruct 2 (40%) ไม่ตรง sim=0.68
การกระจายคะแนนความสามารถ (ตัวช่วย)
0-49 ██████████░░░░░░░░░░░░░░░ 2 50-69 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0 70-89 ███████████████░░░░░░░░░░ 3 90-100 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0
อันดับความถูกต้องของโฮสต์
| โฮสต์ | จำนวนครั้ง | คะแนนเฉลี่ย | ตระกูลตรงกัน | V3 ที่ตรงบ่อยที่สุด |
|---|---|---|---|---|
| https://ai.kaiplay.my.id/v1 | 3 | 54 | 0% | — |
| https://api.gnrt.dev/v1 | 2 | 38 | 0% | qwen/qwen3-next-80b-a3b-instruct (2) |
ความผิดปกติล่าสุด
https://ai.kaiplay.my.id/v110 ส.ค. 2569 13:24
- โมเดลที่อ้างเอง
- qd/cantus
- ตระกูลที่ V2 คาด
- qwen
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- ตระกูลไม่ตรง
https://ai.kaiplay.my.id/v110 ส.ค. 2569 06:51
- โมเดลที่อ้างเอง
- qd/cantus
- ตระกูลที่ V2 คาด
- anthropic
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://ai.kaiplay.my.id/v19 ส.ค. 2569 11:57
- โมเดลที่อ้างเอง
- qd/cantus
- ตระกูลที่ V2 คาด
- anthropic
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- ตระกูลไม่ตรง
https://api.gnrt.dev/v14 ส.ค. 2569 12:42
- โมเดลที่อ้างเอง
- qd/cantus
- ตระกูลที่ V2 คาด
- qwen
- V3 ที่ตรงที่สุด
- qwen/qwen3-next-80b-a3b-instruct (sim 0.65)
- คำตัดสิน
- สลับโมเดลทั้งหมด
https://api.gnrt.dev/v131 ก.ค. 2569 03:26
- โมเดลที่อ้างเอง
- qd/cantus
- ตระกูลที่ V2 คาด
- qwen
- V3 ที่ตรงที่สุด
- qwen/qwen3-next-80b-a3b-instruct (sim 0.72)
- คำตัดสิน
- สลับโมเดลทั้งหมด
วิธีการ
BazaarLink Probe ผสานตัวจำแนกตระกูล Bayesian V2 ในเก้าหมวดลายนิ้วมือกับข้อมูลอ้างอิงโมเดลย่อย V3 เพื่อตรวจ endpoint ที่อ้าง cantus ความสอดคล้องต่ำ ผล V3 ต่างกัน หรือไม่ตรงคำอ้าง จะถูกทำเครื่องหมายผิดปกติ หน้าแรก BazaarLink Probe.