mercury2 · รายงานตัวตนและความถูกต้องของโมเดล
อัปเดตล่าสุด:1 ก.ย. 2569 12:42 · ช่วงข้อมูล: ย้อนหลัง 90 วัน
ผลที่วัดได้ (90 วัน)
5 ครั้ง · 2 โฮสต์ · 5 ความผิดปกติ
ความสอดคล้องของลายนิ้วมือตระกูล
openai 4 ████████████████████░░░░░ 80% (น่าสงสัย) anthropic 1 █████░░░░░░░░░░░░░░░░░░░░ 20% (น่าสงสัย)
การจับคู่โมเดลย่อย V3 ที่สังเกต
→ abstain 5 (100%) ความมั่นใจต่ำ
การกระจายคะแนนความสามารถ (ตัวช่วย)
0-49 ██████████░░░░░░░░░░░░░░░ 2 50-69 ███████████████░░░░░░░░░░ 3 70-89 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0 90-100 ░░░░░░░░░░░░░░░░░░░░░░░░░ 0
อันดับความถูกต้องของโฮสต์
| โฮสต์ | จำนวนครั้ง | คะแนนเฉลี่ย | ตระกูลตรงกัน | V3 ที่ตรงบ่อยที่สุด |
|---|---|---|---|---|
| https://api.inceptionlabs.ai/v1 | 4 | 31 | 0% | — |
| https://api.aurorallm.online/v1 | 1 | 53 | 0% | — |
ความผิดปกติล่าสุด
https://api.inceptionlabs.ai/v11 ก.ย. 2569 11:02
- โมเดลที่อ้างเอง
- mercury-2
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://api.inceptionlabs.ai/v128 ส.ค. 2569 02:03
- โมเดลที่อ้างเอง
- mercury-2
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://api.inceptionlabs.ai/v117 ส.ค. 2569 15:22
- โมเดลที่อ้างเอง
- mercury-2
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://api.inceptionlabs.ai/v117 ส.ค. 2569 15:21
- โมเดลที่อ้างเอง
- mercury-2
- ตระกูลที่ V2 คาด
- openai
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
https://api.aurorallm.online/v114 ส.ค. 2569 06:16
- โมเดลที่อ้างเอง
- openai-inception/mercury-2
- ตระกูลที่ V2 คาด
- anthropic
- V3 ที่ตรงที่สุด
- —
- คำตัดสิน
- V3 ความมั่นใจต่ำ — งดตัดสิน
วิธีการ
BazaarLink Probe ผสานตัวจำแนกตระกูล Bayesian V2 ในเก้าหมวดลายนิ้วมือกับข้อมูลอ้างอิงโมเดลย่อย V3 เพื่อตรวจ endpoint ที่อ้าง mercury2 ความสอดคล้องต่ำ ผล V3 ต่างกัน หรือไม่ตรงคำอ้าง จะถูกทำเครื่องหมายผิดปกติ หน้าแรก BazaarLink Probe.