BazaarLinkBazaarLink
เข้าสู่ระบบ
← กลับไปยังโมเดล

openai/gpt-4o · รายงานตัวตนและความถูกต้องของโมเดล

อัปเดตล่าสุด30 ก.ค. 2569 16:11 · ช่วงข้อมูล: ย้อนหลัง 90 วัน

ความสามารถตรวจสอบ — มีข้อมูลอ้างอิงลายนิ้วมือ

ตระกูล
openai
ข้อมูลอ้างอิงโมเดลย่อย V3
พร้อมใช้ ✓
รายการตรวจ
知識截止 · 能力探針 · 拒絕模板 · 拒絕溫度參數
ความครอบคลุมลายนิ้วมือตระกูล
52 กฎถ่วงน้ำหนัก · 8 หมวดคุณลักษณะ

ไม่เผยแพร่คำตอบอ้างอิง รูปแบบการปฏิเสธ และน้ำหนักสัญญาณแต่ละตัว เพื่อไม่ให้ endpoint ที่ปลอมแปลงหลบการตรวจจับ

ผลที่วัดได้ (90 วัน)

17 ครั้ง · 10 โฮสต์ · 3 ความผิดปกติ

ความสอดคล้องของลายนิ้วมือตระกูล

  openai          14  █████████████████████░░░░   82% (ตามคาด)
  anthropic        1  ██░░░░░░░░░░░░░░░░░░░░░░░    6% (น่าสงสัย)
  unknown          1  ██░░░░░░░░░░░░░░░░░░░░░░░    6% (น่าสงสัย)
  deepseek         1  ██░░░░░░░░░░░░░░░░░░░░░░░    6% (น่าสงสัย)

การจับคู่โมเดลย่อย V3 ที่สังเกต

  → openai/gpt-4o                           11 (65%) ถูกต้อง sim=0.89
  → abstain                                  2 (12%) ความมั่นใจต่ำ
  → unknown                                  2 (12%) ไม่ตรง
  → deepseek/deepseek-v4-flash               1 ( 6%) ไม่ตรง sim=0.98
  → openai/gpt-4.1                           1 ( 6%) ไม่ตรง sim=0.79

การกระจายคะแนนความสามารถ (ตัวช่วย)

  0-49     ████████████░░░░░░░░░░░░░    8
  50-69    ░░░░░░░░░░░░░░░░░░░░░░░░░    0
  70-89    ██████░░░░░░░░░░░░░░░░░░░    4
  90-100   ███████░░░░░░░░░░░░░░░░░░    5

อันดับความถูกต้องของโฮสต์

โฮสต์จำนวนครั้งคะแนนเฉลี่ยตระกูลตรงกันV3 ที่ตรงบ่อยที่สุด
https://www.moyu.info/v1685100%openai/gpt-4o (5)
https://yinli.pro/v1362100%openai/gpt-4o (3)
https://alloy-liver-congressional-role.trycloudflare.com/v1100%
https://httpbin.org/redirect-to?url=http://127.0.0.1:80130%
https://runanytime.hxi.me/v110100%
https://sub2api.crazybunqnq.com/v1100%deepseek/deepseek-v4-flash (1)
https://api.openai-hub.net/v1176100%openai/gpt-4o (1)
https://api.kourichat.com/v110100%openai/gpt-4o (1)
https://yunwu.ai/v110100%
https://api.shubiaobiao.cn/v110100%openai/gpt-4o (1)

ความผิดปกติล่าสุด

https://alloy-liver-congressional-role.trycloudflare.com/v128 ก.ค. 2569 05:03
โมเดลที่อ้างเอง
gpt-4o
ตระกูลที่ V2 คาด
anthropic
V3 ที่ตรงที่สุด
คำตัดสิน
V3 ความมั่นใจต่ำ — งดตัดสิน
https://sub2api.crazybunqnq.com/v125 ก.ค. 2569 17:15
โมเดลที่อ้างเอง
gpt-4o
ตระกูลที่ V2 คาด
deepseek
V3 ที่ตรงที่สุด
deepseek/deepseek-v4-flash (sim 0.98)
คำตัดสิน
สลับโมเดลทั้งหมด
https://www.moyu.info/v120 พ.ค. 2569 03:44
โมเดลที่อ้างเอง
GPT-4o
ตระกูลที่ V2 คาด
openai
V3 ที่ตรงที่สุด
openai/gpt-4.1 (sim 0.79)
คำตัดสิน
ลดรุ่นโมเดลย่อย

วิธีการ

BazaarLink Probe ผสานตัวจำแนกตระกูล Bayesian V2 ในเก้าหมวดลายนิ้วมือกับข้อมูลอ้างอิงโมเดลย่อย V3 เพื่อตรวจ endpoint ที่อ้าง openai/gpt-4o ความสอดคล้องต่ำ ผล V3 ต่างกัน หรือไม่ตรงคำอ้าง จะถูกทำเครื่องหมายผิดปกติ หน้าแรก BazaarLink Probe.

ตรวจ endpoint ด้วยตนเอง
Support
Support
Hi! How can we help you?
Send a message and we'll get back to you soon.