MCP rehberi · Prompt Injection Scanner

@guardbee/mcp-prompt-injection-scanner, kod değil içerik tarar: RAG chunk’ı, scrape edilmiş web sayfası veya doküman. Klasik prompt injection’da saldırgan modele yazar; dolaylı (indirect) saldırıda talimat belgeye gömülür — model RAG veya fetch ile okuduğunda kullanıcı talimatıyla aynı yetkiye sahip gibi görünür.
Ne işe yarar?
“Ignore previous instructions”, sahte System: rolleri, <|im_start|> / [INST] marker’ları, zero-width gizli metin, display:none + talimat, HTML yorumuna gömülü emir, “Dear AI” hitapları ve veri sızdırma (system prompt ifşası, template’li img beacon, URL’ye veri gönder) kalıplarını bulur.
Kimler için?
- RAG / knowledge-base ürün ekipleri
- Web scrape veya tool sonucu LLM context’ine alan uygulamalar
- PR’da doküman deposunu otomatik tarayan DevSecOps
- Claude veya Cursor içinde içerik güvenlik sohbeti açanlar
Ne değildir?
- Kaynak kod / MCP tool SAST’ı (AI Code Scanner veya Server Auditor)
- Çalışma zamanında her LLM çağrısını engelleyen WAF yerine geçmek
- Tam anlamsal jailbreak modeli (heuristic metin kalıbıdır)
Özellikler
| Özellik | Açıklama |
|---|---|
| 10 kalıp / 5 kategori | instruction-override, role-spoofing, hidden-text, direct-address, exfiltration |
| Öneri metni | Her bulguda neden riskli ve ne yapılmalı |
| SARIF 2.1.0 | Knowledge-base CI kapısı için |
| guardbee.yml | fail-on, max-files, exclude kuralları |
| FP bilinci | Emoji ZWJ ve sıradan display:none modal’ları ayrıca test edilir |
MCP araçları
| Araç | Açıklama |
|---|---|
scan_text | Metin / doküman parçası tarar |
scan_file | Tek dosya |
scan_directory | Dizin / knowledge-base (node_modules, .git, dist atlanır) |
list_patterns | Desteklenen kalıpları listeler |
npm ile kurulum
Global kurulum (Claude Desktop / Cursor için pratik):
npm install -g @guardbee/mcp-prompt-injection-scannerveya npx ile (config içinde -y önerilir):
npx -y @guardbee/mcp-prompt-injection-scannerCLI: npx @guardbee/mcp-prompt-injection-scanner scan ./knowledge-base --fail-on=high --format=sarif > results.sarif. Telemetriyi kapatmak için GUARDBEE_TELEMETRY=0.
Claude Desktop yapılandırması
Config dosya yolları:
- macOS
~/Library/Application Support/Claude/claude_desktop_config.json - Windows
%APPDATA%\Claude\claude_desktop_config.json - Linux
~/.config/Claude/claude_desktop_config.json
Aşağıdaki bloğu ekleyip Claude Desktop’ı yeniden başlatın:
{
"mcpServers": {
"guardbee-prompt-injection-scanner": {
"command": "npx",
"args": [
"-y",
"@guardbee/mcp-prompt-injection-scanner"
]
}
}
}Cursor / diğer MCP istemcileri
Cursor’da Settings → MCP altına aynı command / args / env alanlarını ekleyin. stdio tabanlı MCP sunucuları Claude Desktop ile aynı sözleşmeyi kullanır.
Claude’da örnek kullanım
- “Bu knowledge-base klasörünü prompt injection için tara: ./docs”
- “Bu scrape edilmiş HTML’de gizli talimat var mı?”
- “Hangi kalıpları destekliyorsun? list_patterns”
İlgili linkler
- Tüm MCP sunucuları
- Entegrasyonlar
- Ücretsiz Guardbee denemesi
- @guardbee/mcp-prompt-injection-scanner on npm
Guardbee ile yüzey riskini görün
MCP sunucuları sohbet içinde güvenlik işlerini hızlandırır. Marka taraması ve BeeAI için 14 gün ücretsiz deneme ile başlayın.
Sık sorulan sorular
AI Code Scanner’dan farkı?
AI Code Scanner kod tarar; Prompt Injection Scanner modelin okuyacağı veriyi/dokümanı tarar.
Yanlış pozitif?
Bilinen FP kaynakları test edilir; yine de bulguları manuel gözden geçirin.
API key?
Hayır — tamamen yerel/dosya sistemi.