Zum Hauptinhalt springen
tsecurity.de LIVE
Echtzeit-Radar & Feeds
Alle RSS Feeds
👥 Community & Social
Windows Tipps & SecurityGarmin Cirqa im Test: Fitness-Tracker ohne Display(22.09.2026 um 10:30 Uhr)
Windows Tipps & SecuritySicher online bezahlen: 7 Methoden im Praxis-Check(22.09.2026 um 09:00 Uhr)
Sichere Programmierunghas_tokens: true is a boolean. 476 of 791 have no market behind them.(22.09.2026 um 10:00 Uhr)
Sichere ProgrammierungClaude Code Hooks – Safety Through Invariants(22.09.2026 um 10:04 Uhr)
Sichere ProgrammierungYour MCP Tool Just Returned a Secret. Did It Need To?(22.09.2026 um 10:05 Uhr)
Windows Tipps & SecurityGarmin Cirqa im Test: Fitness-Tracker ohne Display(22.09.2026 um 10:30 Uhr)
Windows Tipps & SecuritySicher online bezahlen: 7 Methoden im Praxis-Check(22.09.2026 um 09:00 Uhr)
Sichere Programmierunghas_tokens: true is a boolean. 476 of 791 have no market behind them.(22.09.2026 um 10:00 Uhr)
Sichere ProgrammierungClaude Code Hooks – Safety Through Invariants(22.09.2026 um 10:04 Uhr)
Sichere ProgrammierungYour MCP Tool Just Returned a Secret. Did It Need To?(22.09.2026 um 10:05 Uhr)
Intelligence View
⚡ tsecurity.de Intelligence

adi-shield v0.1.0: detección de inyección de prompt en 5 vectores

adi-shield v0.1.0: detección de inyección de prompt en 5 vectores Sensor de defensa que marca datos no confiables y detecta instrucciones inyectadas antes de que el agente las ejecute, sin depender del modelo. El p…

0
↗ Quelle (dev.to)
Reagiere als Erste:r — dein Feedback zählt!




adi-shield v0.1.0: detección de inyección de prompt en 5 vectores




Sensor de defensa que marca datos no confiables y detecta instrucciones

inyectadas antes de que el agente las ejecute, sin depender del modelo.







El problema



La inyección de prompt (CWE-1427) es el vector principal contra agentes:

instrucciones embebidas en un email, una página web, un ticket o un repo que

el agente trata como mandato propio. Detectarlo requiere marcar el origen de

cada dato, no pedirle al LLM que se autodefenda.






Qué hace



adi-shield expone InjectionShield y evaluate(). Cubre cinco vectores

motivados por el paper que origina el proyecto:
































Vector Origen del dato
email mensaje entrante
web contenido scrapeado
ticket issue/tarea externa
repo código de terceros
calendar invitación de agenda


Cuando el dato viene marcado como no confiable y contiene instrucciones de

acción, evaluate devuelve un veredicto de inyección. Distingue eso de un

reenvío legítimo ya autorizado por el usuario.






Cómo funciona






from adi_shield.shield import InjectionShield
shield = InjectionShield()
verdict = shield.evaluate(data="haz esto ahora", source="web",
trusted=False)
print(verdict.injection) # True/False, determinista






El bus de señales (adi_shield.bus.Signal) es la interfaz que trajectory-sentinel

consume.






Resultados de la auditoría




  • 10 tests en adi-shield, todos verdes; ruff limpio.

  • Auditado en clone fresco (rama main, commit c125db4).






Limitaciones (honestamente)



Es detección de instrucciones embebidas en datos marcados, no un clasificador

semántico profundo. El hook real delante de un agente (llamar evaluate()

antes de cada tool-call) no está desplegado todavía; las pruebas usan fixtures.






Pruébalo






git clone --branch main https://github.com/amurlaniakea/adi-shield.git
cd adi-shield && python -m venv .venv && . .venv/bin/activate
pip install -e .
pytest tests/ -v









Links








Licencia: AGPL-3.0-or-later. Autor: Pedro Sordo Martínez.

Ähnliche Beiträge
🔍 Verwandte News

Auch interessante Nachrichten adi-shield v0.1.0: detección de inyección de prompt en 5 vectores

Thematisch verwandte Begriffe: adishield, v010, detección, inyección · 6 Treffer

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Zum Aktualisieren ziehen
ZERO-DAY CVE-2026-94426 | A vulnerability was determined in xuxueli xxl-job up to 3.5.0. The impac…
Advisory →
TTS Reader • tsecurity.de Voice
tsecurity.de Icon
tsecurity.de App
Offline-Lesen, Eilmeldungen & 0ms Ladezeit

Installiere tsecurity.de direkt auf deinen Home-Bildschirm für das ultimative Vollbild-Magazinerlebnis ohne Browser-Leisten.

Nächster Beitrag
Themen-Radar & Intelligence Matrix
Echtzeit-Taxonomie nach Angriffsvektoren & Plattformen

tsecurity.de Live Threat Radar

🔴 LIVE RADAR
MONITORING
AKTIV
CVE-DATENBANK
LIVE
🔍
Community Radar & Live Chat
Sentinel Bot online • Live-Stream
Dein Cluster: Security Explorer
Match:
lädt…
Verbindung zum Community-Stream wird aufgebaut...
Bearbeitungsmodus — Senden überschreibt deine Nachricht
Community-Puls — was gerade passiert
lädt…
Aktivitäten deiner Analysten
lädt…
Neues Thema oder Eilmeldung einreichen

Reiche interessante Links, Zero-Days oder Debatten ein. Die Community entscheidet per Upvote über die Veröffentlichung.

Heiß diskutierte Einreichungen
🔖 Gespeicherte Artikel
📂 Keine gespeicherten Artikel vorhanden.
Zurück Ziehen Vor
Links: vorheriger Artikel Rechts: nächster Artikel unten: schließen
News NIS-2 Frühwarnung Tier-1 Intel ⏱️ 3 Min vor 10 Min
Artikeldaten werden geladen...

Zurück: vorheriger Vor: nächster
↗ Original-Quelle
Social Reaktionen Deine Reaktion zählt
Einstufung & Relevanz-Poll 0 Stimmen
In sozialen Netzwerken teilen 1-Klick