Author: AI Revolution Deutschland - Bewertung: 142x - Views:5046
Anthropic hat gezeigt, dass Claude seine eigenen „Gedanken“ wahrnehmen kann. Mithilfe sogenannter Concept Injection haben Forscher Claudes Aktivierungen mit Vektoren wie „ALL CAPS“ oder „Ozean“ beeinflusst. Claude 4/4.1 konnte das injizierte Konzept korrekt erkennen und benennen – mit einer Erfolgsrate von rund 20 % und null Fehlalarmen auf Produktionsmodellen, am stärksten etwa zwei Drittel tief im Netzwerk. Außerdem bewiesen die Forscher, dass Prefilling-Tricks so verändert werden können, dass sie wie „beabsichtigt“ wirken – indem man nachträglich Beweise in frühere Aktivierungen einspeist. Das deutet darauf hin, dass das Modell auf zuvor berechnete Absichten zurückgreift, nicht nur auf den sichtbaren Text. Früh, unzuverlässig – aber echtes maschinelles Selbstbewusstsein.
Unterdessen zeigte eine Studie der Universitäten Genf und Bern, dass sechs große Sprachmodelle – ChatGPT-4, ChatGPT-o1, Gemini 1.5 Flash, Copilot 365, Claude 3.5 Haiku und DeepSeek V3 – bei standardisierten Tests zur emotionalen Intelligenz etwa 81–82 % erreichten, verglichen mit 56 % bei Menschen. Einige Modelle erstellten sogar neue, gültige Testfragen. Veröffentlicht in Communications Psychology.
📩 Kooperationen & Markenanfragen: [email protected]
✉ Allgemeine Anfragen: [email protected]
🧠 Quellen:
• Anthropic-Forschung: Emergent introspective awareness in large language models
https://www.anthropic.com/research/introspection
• Technische Analyse & Beispiele (Anthropic / Transformer Circuits)
https://transformer-circuits.pub/2025/introspection/index.html
• Studie zur emotionalen Intelligenz von KI
https://www.thebrighterside.news/post/artificial-intelligence-understands-feelings-better-than-people-study-finds/
• Fachartikel: Large language models are proficient in solving and creating emotional intelligence tests (Communications Psychology, Nature)
https://www.nature.com/articles/s44271-025-00258-x
🚨 Warum das wichtig ist:
Modelle beginnen, über ihre eigenen inneren Zustände zu berichten – und übertreffen den Menschen bei emotionaler Intelligenz. Das erhöht Transparenz und Sicherheit, wirft aber neue Fragen über Absicht, Selbstwahrnehmung und Kontrolle auf, während Modelle weiter skalieren.

SOCIAL SHARE CARD GENERATOR