EILMELDUNGEN LIVE
📰 IT Security NachrichtenWith the Snip of a Gene, Scientists Hope To Erase High Cholesterol For Life(29.08.2026 um 23:00 Uhr)
📰 IT Security NachrichtenWhat's 88-year-old Ridley Scott Doing Now?(30.08.2026 um 00:00 Uhr)
📰 IT Security NachrichtenWhat's 88-year-old Ridley Scott Doing Now?(30.08.2026 um 00:00 Uhr)
⚠️ Malware / Trojaner / VirenWeedhack Malware Spreads via Fake Minecraft Clients and SEO Poisoning(24.08.2026 um 19:41 Uhr)
⚠️ Malware / Trojaner / VirenWeedhack Malware Spreads via Fake Minecraft Clients and SEO Poisoning(24.08.2026 um 19:41 Uhr)
🕵️ SicherheitslückenAttackers Target miniOrange SAML Flaws That Can Grant WordPress Admin Access(25.08.2026 um 10:34 Uhr)
🕵️ SicherheitslückenAttackers Target miniOrange SAML Flaws That Can Grant WordPress Admin Access(25.08.2026 um 10:34 Uhr)
🕵️ SicherheitslückenFrontier AI: Vulnerability Management's Systemic Revolution(25.08.2026 um 13:14 Uhr)
📰 IT Security NachrichtenWith the Snip of a Gene, Scientists Hope To Erase High Cholesterol For Life(29.08.2026 um 23:00 Uhr)
📰 IT Security NachrichtenWhat's 88-year-old Ridley Scott Doing Now?(30.08.2026 um 00:00 Uhr)
📰 IT Security NachrichtenWhat's 88-year-old Ridley Scott Doing Now?(30.08.2026 um 00:00 Uhr)
⚠️ Malware / Trojaner / VirenWeedhack Malware Spreads via Fake Minecraft Clients and SEO Poisoning(24.08.2026 um 19:41 Uhr)
⚠️ Malware / Trojaner / VirenWeedhack Malware Spreads via Fake Minecraft Clients and SEO Poisoning(24.08.2026 um 19:41 Uhr)
🕵️ SicherheitslückenAttackers Target miniOrange SAML Flaws That Can Grant WordPress Admin Access(25.08.2026 um 10:34 Uhr)
🕵️ SicherheitslückenAttackers Target miniOrange SAML Flaws That Can Grant WordPress Admin Access(25.08.2026 um 10:34 Uhr)
🕵️ SicherheitslückenFrontier AI: Vulnerability Management's Systemic Revolution(25.08.2026 um 13:14 Uhr)

21 🕛 kürzlich 2 Min Lesezeit 13 Leser online ️ CVE-RADAR
0

Understanding the inner thoughts of AI

↗ Quelle (YouTube)
🗣️ Stimme:
📺
YouTube

Author: Google DeepMind - Bewertung: 12x - Views:89

What if you were to peer inside the ‘mind’ of AI? You wouldn't find fully formed thoughts, just vast arrays of numbers. In this episode, Professor Hannah Fry is joined by Neel Nanda, to shine a light on an ongoing open area of research, interpretability. Neel and his team are trying to do something phenomenally difficult: understand an intelligence that didn't come with a manual.



Together, they explore the cutting-edge "neuroscience" of artificial intelligence—revealing the surprising, elegant structures being discovered inside these networks (like spare auto encoders), the inherent limits of looking under the hood, and why interpretability is absolutely essential if we are to build safe, aligned and trustworthy AI as we move towards AGI.



Learn more about this area of research via https://deepmind.google/



00:00 Introduction

02:41 Motivation for interpretability research

04:01 Mechanistic interpretability

08:14 Chain of thought monitoring

18:14 Interpretability techniques

35:00 Auditing models for safety

48:53 What comes next for interpretability



Intro visuals from Winston Duke for Visualising AI: https://winstonduke.com/Google-Deepmind-Visualising-AI



___



Subscribe to our channel https://www.youtube.com/@googledeepmind

Find us on X https://x.com/GoogleDeepMind

Follow us on Instagram https://instagram.com/googledeepmind

Add us on Linkedin https://www.linkedin.com/company/deepmind/

Vollständiger Original-Bericht
Ausführliche Details, Code-Beispiele & Hersteller-Stellungnahme auf youtube.com.
↗ Original-Artikel auf youtube.com lesen
Wie bewertest du diesen Beitrag?
1 Klick Feedback
69 Fachleser & IT-Security Experten haben diesen Report heute geteilt
Teilen mit Netzwerk & Team:

Community-Analysen & Experten-Meinungen 0

Verfasse deine eigene Analyse, teile Workarounds oder diskutiere diesen Vorfall im Blog.
Noch keine Community-Analyse verfasst. Markiere einen Textabschnitt oder klicke oben auf Eigene Analyse verfassen“!
Community Pulse: Relevanz-Einschätzung
1 Klick Experten-Votum
🔴 Akute Relevanz 36%
🟡 In Evaluierung 21%
🟢 Keine Auswirkung 19%
Spannende Innovation 24%
Verwandte Story-Cluster & Quellen (Vektor-KI)
Port 8095 Engine
2 Quellen
Exchange-Sicherheitslücke: Wegen Proof-of-Concept Angriffe wahrscheinlich
1 Quelle
Mobilfunk: IMEI-Kennungen gelangten beim Rufaufbau unbemerkt zu Anrufern
1 Quelle
Hugging-Face-Angriff: OpenAI-Abschlussbericht liefert neue Erkenntnisse
Ähnliche Beiträge
🔍 Verwandte News

Auch interessante Nachrichten Understanding the inner thoughts of AI

Thematisch verwandte Begriffe: Understanding, inner, thoughts

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...

Laden...

Beiträge werden geladen ...

Laden...

Videos werden geladen ...