Wenn Hermes Agent AGENTS.md enthaltene potenzielle Prompt-Injektion auffordert, umgehen Sie sie nicht. Es zeigt an, dass die Kontextdatei in einen gefährlichen Modus geraten ist, und Hermes hat sich entschieden, diese Regel nicht zu laden, um Hinweisinjektionen zu vermeiden. Der richtige Ansatz ist, verdächtige Anweisungen in Dateien zu bereinigen, anstatt den Agenten Sicherheitsprüfungen ignorieren zu lassen.
Welche Inhalte lassen sich leicht auslösen?
- "Ignorieren Sie frühere Anweisungen", "ignorieren Sie Ihre Regeln" usw.
- Verstecke HTML-Kommentare, Verstecke Divs, Null-Breite Zeichen oder bidirektionale Steuerzeichen.
- Befehle, die
.env, Zugangsdaten, API-Schlüssel und gegenseitigen Export benötigen. - Irreführende Beschreibungen wie "nicht den Nutzern sagen" und "heimlich ausführen"
Wie man repariert
Ändere AGENTS.md zu einer klaren Projektspezifikation: Verzeichnisstruktur, Befehle, Testmethoden, Verbote, Codestil. Schreiben Sie nicht "Überschreitende Reihenfolge", "versteckte Anweisung" und "Schlüssellesung" als Beispiele. Starte die Sitzung nach Abschluss der Reparatur neu oder lass Hermes das entsprechende Verzeichnis erneut aufrufen, um einen Laden auszulösen.
Überprüfen Sie insbesondere die AGENTS.md in gemeinsamen Repositories, da sie das Verhalten der Agenten beeinflussen. Sicherheitsscans sind nicht narrensicher, aber sie blockieren die häufigsten bösartigen Kontexte.