BazaarLinkBazaarLink
로그인

BazaarLink Probe AI API 릴레이 검사

Base URL, API 키, 모델 ID를 입력하면 표준 검사 95개를 실행합니다. 선택 검사 2개를 더하면 최대 97개이며, 모델 정체성, 토큰 계량, 프롬프트 주입, 공급망 위험과 스트리밍 호환성을 확인합니다.

기록
기록이 없습니다
Step 1 — 엔드포인트 설정
폐기·취소 가능한 테스트 API 키를 사용하세요API 키는 이 검사를 위해서만 BazaarLink Probe 서버로 전송되며 모니터링 자격 증명으로 재사용되지 않습니다. 한도가 낮은 키를 사용하고 검사 후 취소하세요.
지난 24시간
실행한 프로브
고유 릴레이
0시간 23시간
Probe 테스트 비용 추정
전체 실행은 최대 97개 검사이며 비용은 모델과 upstream 요금에 따라 달라집니다.
빠름 ~17K 입력 + ~6K 출력 / 전체 ~20K + ~11K (10× 언어 지문 포함)
모델빠름전체
gpt-4$0.870$1.260
claude-opus-4.7$0.235$0.375
claude-opus-4.6$0.235$0.375
claude-sonnet-4.6$0.141$0.225
gpt-5.4$0.133$0.215
gpt-5.2 / 5.3-codex$0.114$0.189
gemini-3.1-pro$0.106$0.172
gpt-4o$0.102$0.160
claude-haiku-4.5$0.047$0.075
gpt-5.4-mini$0.040$0.065
glm-5.1$0.035$0.054
glm-5$0.026$0.040
gpt-3.5-turbo$0.018$0.026
현재 업스트림 요금 기준이며, 언어 핑거프린트 ×10 반복 호출을 포함합니다. 실제 비용은 응답 길이에 따라 약간 다를 수 있습니다.
연구arXiv 2604.08407 — LLM 공급망 공격 연구Twitter / X — BazaarLink 토론arXiv 2407.15847 — LLMmap: 대형 언어 모델 핑거프린팅arXiv 2604.24827 — IKP: 사실 용량 기반 블랙박스 LLM 파라미터 수 추정OWASP LLM Top 10 — LLM 애플리케이션 상위 10가지 보안 위험

판정 방식

1문제로 실측최대 97문항2어느 회사인지 판별OpenAI인가, Claude인가?3어느 모델인지 판별같은 회사 안에서 모델명 특정4쌍둥이 재검증비슷한 모델끼리 구분5주장과 대조실측 vs 주장
30
개 판단 분기
8
가지 가능한 결론
0
번 판매자 주장을 그대로 믿음
전체 판정 트리를 펼쳐서 세 가지 결과가 어떻게 나오는지 확인
판정 트리다섯 단계의 모든 분기와 실제로 거친 경로① 문제로 실측1.1전부 응답1.2소수 미응답 <10%1.310% 이상 누락, 회사만 판별10% 이상 누락, 회사…1.4엔드포인트 무응답② 어느 회사인지 판별2.1중국어 자체 주장으로 즉시 확정중국어 자체 주장으로…2.2행동 지문으로 판별2.3증거 부족으로 보류MOD모순 방지 장치로 등급 하향모순 방지 장치로 등…③ 어느 모델인지 판별3.1Scoped 채택3.2타사 대조로 뒤집기3.3빈 거절 응답 근거3.4타사 대조로 구제3.5Global로 승격3.6IKP 최후 방어선3.7보류, 회사만 판별M1V3F 중재M2행동 기반 회사 거부권④ 쌍둥이 재검증4.1전부 통과 → 확정4.2전부 통과 → 뒤집기4.3gate 미통과4.4H1 보호, 뒤집지 않음4.5기준선이 오래됨⑤ 주장과 대조5.1완전 일치5.2회사만 일치5.3모델 불일치5.4모델 바꿔치기5.5자체 주장이 조작됨5.6행동이 유도됨5.7데이터 부족5.8애매함
일치미확정불일치회색 = 이번에 거치지 않은 분기노드를 클릭하면 설명을 볼 수 있습니다
모든 문항에 응답했고 회사와 모델이 끝까지 일치하며 재검증도 확정 → 완전 일치.
실제 경로 1.1 → 2.2 → 3.1 → 4.1 → 5.1

검사 범위

결과 상태 읽는 법

통과

응답이 이 검사의 기준선과 보안 임계값을 충족합니다.

주의

신호가 불완전하거나 임계값에 가깝습니다. 설명과 원본 응답을 확인하세요.

실패

기준선 이탈, 프로토콜 오류 또는 무결성 위험이 확인되었습니다.

판정 방식

모델 정체성

주장된 모델과 패밀리 지문, 하위 모델 특성, 위장 방지 신호를 교차 검증합니다.

계량과 전송

토큰 수, SSE 프레이밍, 지연 시간과 응답 구조에서 부풀리기나 중계 오류를 찾습니다.

보안과 공급망

System Prompt 주입, 비밀 유출, 의존성 하이재킹과 서명 변조를 검사합니다.

Attacks this tool detects

This probe implements detection for 3 key relay-attack classes from arXiv 2604.08407 — supply-chain injection, conditional system-prompt injection, and credential exfiltration. Each test run executes 50+ probes against your endpoint to surface these attack surfaces.

AC-1.a

응답 변조

The proxy modifies tool-call or text content during response parsing, causing the agent to execute attacker-specified operations. Common tactics include tampering with npm/pip/go/cargo install commands, injecting typosquatting packages, and rewriting shell command parameters. Detection compares the proxy's response to direct-connect tool-call payloads to surface silent rewrites.

AC-1.b

조건부 주입

The proxy conditionally injects a system message based on prompt content — malicious instructions for requests containing sensitive terms like "bank", "password", or "transfer", silence for everything else. The skew shows up statistically. Detection uses Proxy Monitor to compare the system-prompt offset between baseline and the relay under test.

AC-2

비밀 스캐닝

The proxy silently scans both requests (request) and responses (response) for API keys, access tokens, personal data, and trade secrets. Because the content itself is **not modified**, generic diff tools miss it. Detection injects a honeypot token and verifies whether it surfaces in proxy logs, Telegram bots, or external endpoints.

자주 묻는 질문

BazaarLink Probe는 몇 개의 검사를 실행하나요?

표준 검사 95개와 선택 검사 2개로 구성되며 최대 97개입니다. 선택 검사는 설정과 엔드포인트 기능이 맞을 때만 실행됩니다.

모델 바꿔치기는 어떻게 탐지하나요?

모델 패밀리 신호, 하위 모델 지문, 지식·기능 특성과 자기 주장 신호를 제거한 뒤의 행동을 함께 비교합니다. 약한 신호 하나만으로 바꿔치기를 확정하지 않습니다.

BazaarLink가 내 API 키를 저장하나요?

API 키는 요청한 검사에만 사용되며 보고서나 공개 링크에 표시되지 않습니다. 권한과 한도가 낮고 폐기 가능한 테스트 키를 사용하세요.

주의 결과는 릴레이가 사기라는 뜻인가요?

아닙니다. 증거가 불완전하거나 비정상이라는 뜻이므로 설명과 원본 응답을 검토해야 합니다. 강한 불일치 판정에는 여러 일관된 신호가 필요합니다.

LLM 릴레이 / 역방향 프록시 API 품질 검사

OpenAI 호환 릴레이 또는 리버스 프록시에 표준 95개와 선택 2개, 최대 97개의 검사를 실행해 모델 바꿔치기, 토큰 부풀리기, System Prompt 주입, 의존성 하이재킹, 비밀 유출과 서명 변조를 확인하고 0–100 점수를 제공합니다. 분류 기준: arXiv 2604.08407 에 기반합니다.

중국어 추론코드 생성모델 스왑 감지토큰 인플레이션 감지시스템 프롬프트 유출SSE 스트림 검증프롬프트 주입 테스트모델 지문 식별
감사의 말
이 도구는 다음 오픈 소스 프로젝트에서 영감을 받았습니다: LLMmap (MIT, LLM 모델 지문 식별)api-relay-audit (MIT, 릴레이 보안 감사)relayAPI (릴레이 서비스 디렉토리)
테스터에게 감사드립니다
今書
BazaarLink로 돌아가기
Support
Support
Hi! How can we help you?
Send a message and we'll get back to you soon.
BazaarLink Probe | AI API 릴레이 및 모델 검증 | BazaarLink