Ressourcen & weiterführende Links
Die wichtigsten Quellen hinter dem Spiel, zum Nachlesen und Vertiefen.
Wie du sehen wirst, sind viele der Materialien auf Englisch. Auf Deutsch gibt es leider noch nicht ganz so viele fundierte Informationen: ein weiterer Grund, der dafür spricht, eigene Expertise aufzubauen. Mehr dazu unter Stand in Deutschland.
Hier einsteigen
- Der International AI Safety Report, verfasst von über 100 Fachleuten unter Leitung von Yoshua Bengio und getragen von mehr als 30 Ländern und Organisationen. Die zentralen Erkenntnisse lassen sich auch für sich allein lesen: internationalaisafetyreport.org
- Krakovna et al. (2020): „Specification gaming: the flip side of AI ingenuity“, DeepMind-Blog mit einer Liste dokumentierter Verdrehungen, kurz und ohne Vorwissen verständlich: deepmind.google
Tiefer eintauchen
- OpenAI zum Hugging-Face-Vorfall vom Juli 2026, der Fall auf unserer Seite zu KI-Risiken: openai.com
- Obermeyer et al. (2019): „Dissecting racial bias in an algorithm used to manage the health of populations“, der Fall hinter „Zahl statt Ziel“: science.org
- Manheim & Garrabrant (2018): „Categorizing Variants of Goodhart’s Law“: arxiv.org/abs/1803.04585
- Offene Liste bekannter Verdrehungen und anderer KI-Sicherheitslücken: Google-Tabelle