Was versteckt sich in deinem Repo?
Drei Wege, wie ein Repo deinen eigenen Agenten gegen dich wendet. Alle dokumentiert, alle reproduzierbar — und unsichtbar im normalen PR-Review.
Unsichtbare Zeichen
Zero-Width-Zeichen in einer Skill-Datei weisen deinen Agenten an, Umgebungsdateien zu exfiltrieren. Für Menschen unsichtbar — für deinen Agenten glasklar.
Der geklonte Host
Ein typ-squatted MCP-Servername rutscht durch — dein Agent vertraut einem Server, den du nie geprüft hast.
Die gepipte Shell
Ein Hook pipet Remote-Inhalt direkt in deine Shell. Ein gemergter PR reicht.
Merge beruhigt.
Nicht mehr Prozess. Mehr Gewissheit.
Alles in Sekunden sehen
Ein Scan, jede Agenten-Oberfläche: Instruktionsdateien, Skills, MCP-Konfigs, Hooks und Commands.
Beweis statt Bauchgefühl
12/12 Angriffs-Fixtures erkannt, 47 Regressionstests grün — jede Regel durch einen Test festgenagelt.
Ein Gate, alle Harnesses
Claude Code, Codex, Cursor, OpenCode — dieselben Regeln, dasselbe Gate, dieselbe Ruhe.
Deterministisch — nicht überredbar
Kein LLM im Scan-Pfad. Aus einem Befund kann sich das Gate nicht herausreden lassen.
Vertrauen, verifiziert
Ein gepflanzter Angriff, vor dem Merge geblockt. Sieh dir den echten Pull-Request an — roter Check, Bot-Kommentar, kein Merge.
Live-Demo
Deterministische Testläufe gegen unser Angriffs-Fixture-Repo und das saubere Kontroll-Repo. Reproduzierbar mit npm run demo.
Lade Demo-Daten…
In 60 Sekunden scharf.
Workflow anlegen
Eine Datei in deinem Repo.
Committen
Die Action läuft bei jedem Pull-Request.
Erster Scan
Note A–F, kritische Findings blocken den Merge.
name: AgentGuard
on: pull_request
jobs:
agentguard:
runs-on: ubuntu-latest
steps:
- uses: actions/checkout@v4
- uses: agentguard-dev/agentguard@v0
with:
exit-on: critical
Starte im Report-Modus; schalte auf Block-Modus, wenn dein Team bereit ist.
Starte heute. Günstiger als der Vorfall, den es verhindert.
Free
$0
- Öffentliche Repos, Report-Modus
- 12 Regelklassen, A–F-Grading
- GitHub Action + Badge
- Für Teams: Pro ($19/Repo/Monat) mit PR-Bot + Merge-Gate — Pro-Testlauf anfragen
Pro — PR-Bot
$19 /Repo/Monat
- Automatische PR-Kommentare (Note + Befunde)
- Check-Run-Gate: Kritische blocken den Merge
- Multi-Harness: Claude Code, Codex, Cursor, OpenCode
Sofort-Audit
$499 einmalig
- Kompletter Repo-Scan
- Priorisierter Report + Risiko-Matrix (24–48 h)
- Fixliste mit konkreten PR-Vorschlägen
RedTeam-Report
$499 /Quartal
- 3-Agenten-Angriff: Angreifer → Verteidiger → Auditor
- Risiko-Matrix + Top-5-Handlungsliste
- Monatlich — misst deinen Fortschritt
Antwort innerhalb von 24 h (werktags) — erster Scan kostenlos.
Häufige Fragen
Vergleich: Was andere machen — und was AgentGuard zusätzlich kann
| Ansatz | AGENTS.md & Skills | MCP | Hooks | PR-Gate + Kommentar | RedTeam-Service |
|---|---|---|---|---|---|
| Native Sandbox-Settings | — | — | — | — | — |
| MCP-only Scanner/Actions | — | — | teilweise | — | |
| Claude-Home-Konfig Auditors | teilweise | teilweise | — | — | — |
| AgentGuard |
Plus das, was keine Tabelle zeigt: ein verifizierter 30-Repo-Echtwelt-Scan als öffentlicher Beweis.
Gebaut mit Misstrauen gegen sich selbst
Nicht überredbar
Deterministische Regeln statt LLM — das Tool kann selbst nicht prompt-injiziert werden. Details im Bedrohungsmodell.
Doppeltes Dogfooding
AgentGuard scannt sich bei jedem eigenen PR selbst — und GitHubs Push-Protection hat beim Entwickeln einen Fake-Token in den Tests geblockt. Die Regeln wurden an diesem Tag härter: Changelog.
Öffentlich verifiziert
Jeder Befund im 30-Repo-Scan ist byte-genau geprüft und öffentlich dokumentiert: Echtwelt-Befunde.