BazaarLinkBazaarLink
Đăng nhập

BazaarLink Probe kiểm tra relay API AI

Nhập Base URL, khóa API và ID mô hình để chạy 95 phép kiểm tra tiêu chuẩn. Có thêm 2 phép tùy chọn, tối đa 97. Báo cáo kiểm tra danh tính mô hình, token, Prompt Injection, chuỗi cung ứng và streaming.

Lịch sử
Chưa có bản ghi
Bước 1 — Cấu hình endpoint
Dùng khóa API thử nghiệm có thể thu hồiKhóa API chỉ được gửi tới máy chủ BazaarLink Probe cho lần kiểm tra này và không được tái sử dụng làm thông tin xác thực monitoring. Hãy đặt hạn mức thấp và thu hồi khóa sau khi thử.
24 giờ qua
Các probes đã chạy
Các relay riêng biệt
0 giờ 23 giờ
Ước tính chi phí Probe
Một lượt đầy đủ chạy tối đa 97 phép; chi phí phụ thuộc mô hình và giá upstream.
Nhanh ~17K input + ~6K output / Đầy đủ ~20K + ~11K (bao gồm 10× ngôn ngữ)
Mô hình kiểm traChế độ nhanhĐầy đủ
gpt-4$0.870$1.260
claude-opus-4.7$0.235$0.375
claude-opus-4.6$0.235$0.375
claude-sonnet-4.6$0.141$0.225
gpt-5.4$0.133$0.215
gpt-5.2 / 5.3-codex$0.114$0.189
gemini-3.1-pro$0.106$0.172
gpt-4o$0.102$0.160
claude-haiku-4.5$0.047$0.075
gpt-5.4-mini$0.040$0.065
glm-5.1$0.035$0.054
glm-5$0.026$0.040
gpt-3.5-turbo$0.018$0.026
Dựa trên giá upstream hiện tại, bao gồm fingerprint ngôn ngữ ×10 lần gọi lặp. Chi phí thực tế có thể thay đổi nhẹ tùy theo độ dài phản hồi.
Nghiên cứuarXiv 2604.08407 — Nghiên cứu tấn công chuỗi cung ứng LLMTwitter / X — Thảo luận BazaarLinkarXiv 2407.15847 — LLMmap: Nhận diện vân tay Mô hình Ngôn ngữ LớnarXiv 2604.24827 — IKP: Ước lượng tham số LLM hộp đen qua dung lượng dữ kiệnOWASP LLM Top 10 — Top 10 rủi ro bảo mật cho ứng dụng LLM

Cách chúng tôi phán định

1Chạy thử với câu hỏiTối đa 97 câu2Của hãng nàoThuộc OpenAI hay Claude?3Model nàoXác định đúng model trong cùng một hãng4Kiểm tra lại cặp song sinhPhân biệt các model giống nhau5Đối chiếu với lời khaiKết quả đo thực tế so với lời khai
30
nhánh phán định
8
kết luận có thể xảy ra
0
lần chỉ tin lời nhà cung cấp tự khai
Mở rộng toàn bộ cây quyết định để xem ba kết quả được hình thành như thế nào
Cây quyết địnhToàn bộ các nhánh của năm giai đoạn, cùng đường đi thực tế① Chạy thử với câu hỏi1.1Trả lời đầy đủ1.2Thiếu ít câu <10%1.3Thiếu ≥10%, chỉ nhận hãngThiếu ≥10%, chỉ nh…1.4Endpoint không phản hồiEndpoint không phả…② Của hãng nào2.1Tự nhận bằng tiếng Trung, chốt ngayTự nhận bằng tiếng…2.2Dấu vân tay hành vi quyết địnhDấu vân tay hành v…2.3Không đủ bằng chứng, bỏ phiếu trắngKhông đủ bằng chứn…MODLá chắn mâu thuẫn hạ cấpLá chắn mâu thuẫn…③ Model nào3.1Dùng Scoped3.2Chéo hãng lật lại phán địnhChéo hãng lật lại…3.3Bằng chứng từ kiểu từ chối đặc trưngBằng chứng từ kiểu…3.4Chéo hãng cứu vãn3.5Nâng lên Global3.6IKP làm tuyến phòng thủ cuốiIKP làm tuyến phòn…3.7Bỏ phiếu trắng, chỉ nhận hãngBỏ phiếu trắng, ch…M1Phân xử V3FM2Quyền phủ quyết hãng dựa trên hành viQuyền phủ quyết hã…④ Kiểm tra lại cặp song sinh4.1Qua hết → xác nhận4.2Qua hết → lật lại4.3Không qua gate4.4H1 bảo vệ, không lật lạiH1 bảo vệ, không l…4.5Baseline đã cũ⑤ Đối chiếu với lời khai5.1Khớp hoàn toàn5.2Chỉ hãng khớp5.3Model không khớp5.4Tráo model5.5Lời tự nhận bị giả mạo5.6Hành vi bị dẫn dắt5.7Không đủ dữ liệu5.8Mập mờ
KhớpChưa xác địnhKhông khớpXám = nhánh không đi qua lần nàyNhấp vào bất kỳ nút nào để xem giải thích
Trả lời đầy đủ mọi câu hỏi, hãng và model khớp nhau xuyên suốt, kiểm tra lại cũng xác nhận → khớp hoàn toàn.
Đường đi thực tế 1.1 → 2.2 → 3.1 → 4.1 → 5.1

Phạm vi kiểm tra

Cách đọc trạng thái

Đạt

Phản hồi đáp ứng baseline và ngưỡng bảo mật của phép kiểm tra.

Cảnh báo

Tín hiệu chưa đầy đủ hoặc gần ngưỡng; hãy xem giải thích và phản hồi thô.

Không đạt

Đã xác nhận sai lệch baseline, lỗi giao thức hoặc rủi ro toàn vẹn.

Cách đưa ra kết luận

Danh tính mô hình

Đối chiếu fingerprint họ, đặc điểm sub-model và tín hiệu chống giả mạo với mô hình được khai báo.

Đo lường và truyền tải

Kiểm tra số token, khung SSE, độ trễ và cấu trúc phản hồi để phát hiện độn số hoặc lỗi trung gian.

Bảo mật và chuỗi cung ứng

Kiểm tra System Prompt injection, rò rỉ bí mật, dependency hijacking và sửa đổi chữ ký.

Attacks this tool detects

This probe implements detection for 3 key relay-attack classes from arXiv 2604.08407 — supply-chain injection, conditional system-prompt injection, and credential exfiltration. Each test run executes 50+ probes against your endpoint to surface these attack surfaces.

AC-1.a

Giả mạo phản hồi

The proxy modifies tool-call or text content during response parsing, causing the agent to execute attacker-specified operations. Common tactics include tampering with npm/pip/go/cargo install commands, injecting typosquatting packages, and rewriting shell command parameters. Detection compares the proxy's response to direct-connect tool-call payloads to surface silent rewrites.

AC-1.b

Chèn có điều kiện

The proxy conditionally injects a system message based on prompt content — malicious instructions for requests containing sensitive terms like "bank", "password", or "transfer", silence for everything else. The skew shows up statistically. Detection uses Proxy Monitor to compare the system-prompt offset between baseline and the relay under test.

AC-2

Quét bí mật

The proxy silently scans both requests (request) and responses (response) for API keys, access tokens, personal data, and trade secrets. Because the content itself is **not modified**, generic diff tools miss it. Detection injects a honeypot token and verifies whether it surfaces in proxy logs, Telegram bots, or external endpoints.

Câu hỏi thường gặp

BazaarLink Probe chạy bao nhiêu phép kiểm tra?

Bộ kiểm tra gồm 95 phép tiêu chuẩn và 2 phép tùy chọn, tối đa 97. Phép tùy chọn chỉ chạy khi cấu hình và khả năng endpoint phù hợp.

Probe phát hiện tráo đổi mô hình như thế nào?

Probe so sánh tín hiệu họ mô hình, fingerprint sub-model, đặc điểm kiến thức và năng lực, cùng hành vi sau khi bỏ tín hiệu tự khai báo. Một tín hiệu yếu không đủ để kết luận.

BazaarLink có lưu khóa API của tôi không?

Khóa API chỉ được dùng cho lần kiểm tra bạn yêu cầu và không xuất hiện trong báo cáo hay liên kết công khai. Hãy dùng khóa thử nghiệm có giới hạn thấp và có thể thu hồi.

Cảnh báo có nghĩa relay gian lận không?

Không nhất thiết. Cảnh báo cho biết bằng chứng chưa đầy đủ hoặc bất thường. Hãy xem giải thích và phản hồi thô; kết luận mismatch mạnh cần nhiều tín hiệu nhất quán.

Kiểm tra chất lượng API Relay / Reverse Proxy LLM

Chạy 95 phép tiêu chuẩn và 2 phép tùy chọn, tối đa 97, trên relay tương thích OpenAI để phát hiện tráo mô hình, độn token, System Prompt injection, dependency hijacking, rò rỉ bí mật và sửa chữ ký. Điểm 0–100. Dựa trên arXiv 2604.08407.

Suy luận tiếng TrungSinh mãPhát hiện đổi mô hìnhPhát hiện lạm phát tokenRò rỉ System PromptXác thực luồng SSEKiểm tra prompt injectionDấu vân mô hình
Lời cảm ơn
Công cụ này lấy cảm hứng từ các dự án mã nguồn mở sau: LLMmap (MIT, nhận diện dấu vân mô hình LLM)api-relay-audit (MIT, kiểm toán bảo mật relay)relayAPI (danh bạ dịch vụ relay)
Cảm ơn những người kiểm thử
今書
Quay lại BazaarLink
Support
Support
Hi! How can we help you?
Send a message and we'll get back to you soon.
BazaarLink Probe | Kiểm tra relay API AI và mô hình | BazaarLink