🛡️ TSEcurity Gatekeeper
URL VERIFIZIERT

OpenAI Details GPT-Red: An Internal Automated Red-Teaming Model That Beat Human Red-Teamers 84% To 13% On Prompt Injection

🔒 https://marktechpost.com
«OpenAI trained GPT-Red, an internal-only attacker model, using self-play reinforcement learning against a population of defender LLMs. It beat human red-teamers 84% to 13% on a replicated indirect prompt injection arena,...»
Automatische Weiterleitung... 1.5s
Link in Zwischenablage kopiert!