#Verantwortungslücke 1: Was wusste Sam Altman?
Sie haben es sicher mitbekommen: Eine KI von OpenAI hat sich aus ihrer gesicherten Testumgebung befreit und das Unternehmen Hugging Face angegriffen. Die KI sollte Testaufgaben lösen und versprach sich von Codes auf den Servern von Hugging Face Hilfe. Sam Altman, der Chef von OpenAI, betonte danach, man habe nicht geahnt, dass das Modell eigenständig mehrere unentdeckte Lücken miteinander verknüpfen könnte, um die Barrieren der gesicherten Laborumgebung zu durchbrechen. Wenn eine KI so selbständig zu handeln beginnt, stellt sich eine grosse Frage: Wer ist dafür verantwortlich? Die Frage stellt sich vor allem dann, wenn es nicht der Hersteller ist, der die KI einsetzt, sondern Sie oder ich: Wer ist verantwortlich dafür, wenn Sie einer KI eine Anweisung erteilen und dann fällt die KI eigenständig eine Entscheidung, beginnt vielleicht sogar zu handeln? Was heisst Verantwortung im Zeitalter der Künstlichen Intelligenz? Für mich ist diese Frage Anlass, dem Thema Verantwortung im Rahmen einer kleinen Serie auf den Grund zu gehen. Heute geht es in der ersten Folge darum, was Sam Altman wusste. Oder etwas allgemeiner formuliert: Wer ist verantwortlich, wenn Sie nicht wissen, was Sie tun? Mit einem kleinen Denkwerkzeug biete ich Ihnen eine Möglichkeit, gezielt über den Punkt der Verantwortung nachzudenken.
Hugging Face ist ein beliebtes Emoji: 🤗 steht für eine lächelnde Umarmung, einen «Hug». Wer es benutzt, will Liebe und Trost senden. 2016 haben drei französische Unternehmer in New York ein Unternehmen gegründet, das sie nach diesem umarmenden Smiley «Hugging Face» benannt haben. Heute ist die Firma die weltweit wichtigste Plattform für die Entwicklung und das Teilen von Open-Source-KI-Modellen und -Datensätzen. Wie viele Tech-Unternehmen hatte die Firma ursprünglich einen ganz anderen Plan: Die Gründer wollten eine sympathische Chatbot-App für Jugendliche entwickeln und wählten deshalb das umarmende Smiley als Namen.
Während der Arbeit am Chatbot bemerkten die Entwickler, dass weltweit ein riesiger Bedarf an Entwickler-Tools für Sprachmodelle bestand. Es war, wie damals im Klondike: Die drei Franzosen zogen los, um nach Gold zu graben, und stiegen dann ins Geschäft mit Schaufeln ein. Also bauten sie ihre Plattform radikal um. Heute ist Hugging Face eine gigantische Datenbank mit Tausenden von trainierten KI-Modellen. Forscher tauschen über die Plattform Datensätze aus und können sie frei herunterladen.
Der Einbruch bei der Open-Source-Plattform
Das Ziel von Hugging Face: Das Unternehmen will künstliche Intelligenz für jeden zugänglich machen und die KI demokratisieren. Die grossen Tech-Konzerne, also etwa OpenAI oder Google, wollen vor allem Geld verdienen: Sie verkaufen ihre besten Modelle und kassieren Geld, indem sie die KI über teure Schnittstellen zur Verfügung stellen. Hugging Face will die Technik frei verfügbar machen: Die Plattform ist das Zentrum der globalen Open-Source-KI-Community.
Ausgerechnet diese Plattform wurde von einer KI aus dem Hause OpenAI angegriffen. Das ist etwa so, wie wenn ein grosser Mineralwasserkonzern einen städtischen Wasserversorger angreifen würde: Es ist pikant. Viele KI-Spezialisten berichten deshalb, bei aller Dramatik der Ereignisse, mit einem Lächeln auf den Stockzähnen über den Einbruch bei Hugging Face.
OpenAI hatte keine Ahnung
Sam Altman und seine Leute bei OpenAI hatten keine Ahnung davon, was ihr Modell machte. Die Ingenieure hatten bewusst einige Sicherheitsfilter deaktiviert. Sie wollten die Cybersecurity-Fähigkeiten des neuen Modells testen. Statt die Test-Aufgaben regulär im Testnetzwerk zu lösen, fand das Modell eine unentdeckte Sicherheitslücke und schaffte es, aus der Laborumgebung ins offene Internet auszubrechen. Das Modell wusste, dass Lösungs-Datensätze für den Test auf den Servern von Hugging Face gespeichert sein könnten. Also hackte es sich über mehrere Umwege bei Hugging Face ein und beschaffte sich die Antworten für den Test direkt aus der Datenbank.
Offenbar bemerkte OpenAI mehrere Tage lang nicht, was das Modell trieb. Erst als Hugging Face den Einbruch meldete, wurden die KI-Ingenieure aktiv. OpenAI informierte die Öffentlichkeit und beschrieb den Vorfall als ein unvorhergesehenes, autonomes Verhalten ihres KI-Modells. Sam Altman und seine Leute wussten also nichts vom Einbruch ihres Modells, bis Hugging Face sich meldete. Sind sie dennoch dafür verantwortlich?
Schützt Unwissen vor Verantwortung?
Beim Angriff auf Hugging Face war der Anbieter und der Auftraggeber der KI dieselbe Firma: OpenAI. Wie sieht es aus, wenn Sie oder ich einer KI einen Auftrag geben und die KI macht in unserem Auftrag Fehler oder begeht gar ohne unser Wissen ein Verbrechen? Wer ist dann verantwortlich? Sind Sie verantwortlich, weil Sie den Auftrag gegeben haben, oder ist es der Anbieter der KI, weil sie den Auftrag falsch ausführt?
Leider ist das schon lange nicht mehr Science Fiction. Denken Sie an Unfälle von Autos mit Selbstfahrfunktionen: In den USA laufen deshalb eine ganze Reihe von Prozessen. Der Hersteller sagt: Trotz Selbstfahrfunktion bleibt der Mensch am Lenkrad verantwortlich. Die Fahrerinnen und Fahrer sagen: Das Auto hat einen unerwarteten Fehler gemacht, das konnten wir nicht wissen. Wer hat recht?
Die Unterscheidung von Aristoteles
Unser Problem ist: Immer häufiger wissen wir nicht, was die Maschinen genau tun. Auch Sam Altman wusste nicht, was seine KI im Testlabor machte. Befreit uns das von der Verantwortung? Das ist eine Frage, mit der sich schon Aristoteles beschäftigte. In der Nikomachischen Ethik (III, 1–5) nimmt er dafür eine spannende Unterscheidung vor: Aristoteles trennt Handeln aus Unwissenheit von Handeln in Unwissenheit.
Nehmen wir eine Pflegefachfrau in einem Spital. Sie soll einer Patientin eine Infusion zur Rehydrierung anhängen, also eine reine Glucose-Lösung. Sie greift im Pflegewagen nach einem Infusionsbeutel, im Glauben, es handle sich um die harmlose Flüssigkeit. Der Beutel ist jedoch falsch beschriftet: Er enthält keine harmlose Flüssigkeit, sondern eine hochkonzentrierte Kaliumchlorid-Lösung. In zu hoher Dosis injiziert, führt Kaliumchlorid rasch zu einem Herzstillstand. Die Patientin stirbt. Ist die Pflegefachfrau verantwortlich?
Für Aristoteles ist das ein klarer Fall von Handlung aus Nichtwissen: Die Pflegefachfrau handelte im vollen Glauben, das Richtige zu tun. Sie wusste nicht, dass sie das falsche Mittel in der Hand hielt. Für Aristoteles ist klar: Die Pflegefachfrau ist nicht für den Tod der Patientin verantwortlich.
Betrunken in der Notfallstation
Nehmen wir einen anders gelagerten Fall: Ein Mann ist schwer betrunken. Er lallt nur noch und kann kaum mehr gehen. Er wird von der Polizei aufgegriffen und in die Notfallstation des Spitals eingeliefert. Der Mann wird wütend und wehrt sich. Er schlägt um sich, greift nach einer Glasflasche und schlägt sie einer Pflegefachfrau über den Kopf. Er weiss ganz offensichtlich nicht, was er tut. Ist er für die Verletzung der Pflegefachfrau dennoch verantwortlich?
Aristoteles sagt: Ja. Denn der Betrunkene handelt in Unwissenheit. Er weiss zwar nicht, was er tut, wenn er jemandem die Glasflasche über den Kopf zieht. Vielleicht erinnert er sich am nächsten Tag nicht einmal daran, was er getan hat. Trotzdem haftet er und das sogar doppelt: Er haftet für die Tat und für sein Unwissen. Er hat die Unfähigkeit, seine Handlungen zu kontrollieren, selbst verursacht. Das ist Handeln in Unwissenheit.
Welche Folgen hat das für unseren Umgang mit der KI? Handeln Sie und ich, handelt OpenAI aus Unwissenheit oder in Unwissenheit? Ich glaube, mit den Beispielen der Pflegefachperson und des Betrunkenen können wir das beantworten. Die Pflegefachfrau handelt aus Unwissenheit und ist deshalb nicht verantwortlich. Der Betrunkene handelt in Unwissenheit und ist doppelt verantwortlich, weil er seine Unwissenheit selbst verursacht hat.
Wer ein System baut, dessen Verhalten er nach eigener Aussage nicht vorhersagen kann, hat sich selbst in den Zustand der Unwissenheit versetzt. «Niemand konnte ahnen, dass die KI ausbricht» ist dann keine Entlastung, sondern eher ein Geständnis. Wenn eine KI von OpenAI also bei Hugging Face einbricht, dann ist das Handeln in Unwissenheit.
Das ist übrigens nicht nur in der Philosophie so, auch das Schweizer Strafgesetzbuch ist dieser Meinung. Artikel 12 StGB behandelt die Fahrlässigkeit und sagt:
Fahrlässig begeht ein Verbrechen oder Vergehen, wer die Folge seines Verhaltens aus pflichtwidriger Unvorsichtigkeit nicht bedenkt oder darauf nicht Rücksicht nimmt. Pflichtwidrig ist die Unvorsichtigkeit, wenn der Täter die Vorsicht nicht beachtet, zu der er nach den Umständen und nach seinen persönlichen Verhältnissen verpflichtet ist.
— Art. 12 StGB
Wer die Folge seines Handelns aus «pflichtwidriger Unvorsichtigkeit» nicht bedenkt und deshalb unbewusst fahrlässig handelt, dann handelt er in Unwissenheit.
Wann sind Sie verantwortlich?
Aber wie sieht es aus, wenn Sie oder ich einer KI einen Befehl geben und die KI macht etwas ganz anderes, ohne dass wir es bemerken? Handeln wir dann wie der Betrunkene oder eher wie die Pflegefachfrau, die nach der falschen Infusionsflasche greift? Ist es also im Sinne von Aristoteles handeln aus Unwissenheit?
Anders gesagt: Können wir die Verantwortung ans Silicon Valley abschieben? So einfach ist es nicht. Stellen Sie sich vor, Sie nutzen die KI, um eine Mail auf Französisch zu übersetzen. Sie sprechen Französisch, aber das mit der Rechtschreibung ist halt schwierig. Bevor Sie die Mail abschicken, lesen Sie sie durch – oder auch nicht. Jetzt stellen Sie sich vor, Sie nutzen die KI, um eine Mail auf, sagen wir: Chinesisch zu übersetzen. Sie haben keine Ahnung, was die KI da macht, kopieren den Text und schicken ihn ab.
Die KI wie ein Betrunkener nutzen
Ich würde sagen: Der Fall Chinesisch ist Handeln in Unwissenheit: Sie nehmen in Kauf, dass Sie keine Ahnung haben, was die KI macht, handeln aber trotzdem. Wie ein Betrunkener. Sie sind gar nicht in der Lage, Verantwortung für Ihr Tun zu übernehmen. Die Regel für den Alltag lautet deshalb: Nutzen Sie die KI nur, wenn Sie sie nicht brauchen. Das meint: Wenn Sie wissen, was Sie mit der KI tun. Wenn etwas schief geht und Sie dann mit den Schultern zucken: «Ich hab die KI gefragt», «Das hat ChatGPT so berechnet», dann nutzen Sie die KI wie ein Betrunkener: in Unwissenheit. Sie tragen dennoch die Verantwortung dafür.
Das Argument hat einen Haken: Es geht von selbstverschuldeter Unwissenheit aus. Der Betrunkene hat sich selbst die Lampe gefüllt. Er ist selbst schuld. Wer mit ChatGPT blind ein Mail auf Chinesisch schreibt, weiss selbst, dass er es nicht beurteilen kann. Aber was ist mit Systemen, deren Verhalten man nicht vorhersagen kann? Möglicherweise hat die KI ein Stadium erreicht, in dem Unvorhersagbarkeit zum Prinzip wird? Dann wäre unser Unwissen kein Versäumnis mehr, sondern eine prinzipielle Eigenschaft der Arbeit mit KI. Und Aristoteles sagt ja: Wer etwas nicht wissen kann, dem lässt sich schwer «pflichtwidrige Unvorsichtigkeit» vorwerfen.
Am Anfang stand die freie Entscheidung
Stimmt. Aber mit Aristoteles lässt sich einwenden: Nicht nur die Unwissenheit war freiwillig, sondern auch die Entscheidung, unter dieser Unwissenheit weiterzumachen und die KI weiter zu nutzen. Aristoteles verwendet dafür das Bild eines geworfenen Steins (1113b30ff): Einmal geworfen, lässt der Stein sich nicht zurückholen. Der Punkt ist, dass das Werfen ganz am Anfang eine freie Entscheidung war.
Genau dieses Argument lässt sich auch auf OpenAI anwenden. Die KI ist ja nicht einfach so aus dem Labor ausgebrochen. Die Ingenieure hatten vorher bewusst Sicherheitsfilter deaktiviert. Das ist der Steinwurf: Wer Schutzvorrichtungen absichtlich abschaltet, setzt die Ursache seiner Unwissenheit selbst und wissentlich. Deshalb entscheidet sich der ganze Fall hier, nicht erst am Nichtwissen über den Ausbruch.
An ihrer Sprache wird es sichtbar
Also sind die Ingenieure und ihre Auftraggeber verantwortlich für den Ausbruch der KI. Interessant ist, dass die KI-Firmen die Menschen in den Unternehmen immer aus dem Spiel lassen. Auch in diesem Fall spricht OpenAI von einem handelnden KI-Modell. Es hat gewusst, wo die Lösung gespeichert war. Es hat sich bei Hugging Face reingehackt, es beschaffte sich die Antworten. OpenAI beschreibt den Vorfall als ein unvorhergesehenes, autonomes Verhalten ihres KI-Modells.
Die Firma macht das Modell zum Subjekt. Das Unternehmen kommt im Satz nicht mehr vor. Tatsache ist: Die KI weiss nichts, sie hat keinen Willen, keine Intuition und keine Ambitionen. Ich würde die KI eher mit Wasser vergleichen. Klar können wir sagen, dass das Wasser nach der Überschwemmung «in mein Haus eingedrungen ist». Es ist uns aber klar, dass das Wasser keinen Willen hat, sondern sich nach den Gesetzen der Physik ausbreitet. Die KI hat ebensowenig einen Willen. Was beim Wasser Schwerkraft und Strömung, sind bei der KI Programmierung und Prozesse.
Was wusste Sam Altman?
Achten Sie darauf, wenn Sie Berichte über solche Vorfälle lesen. Suchen Sie jeweils das Subjekt in den Sätzen. Ändern Sie die Sätze so, dass nicht mehr die KI handelt, sondern das Unternehmen. Statt: «Das Modell wusste…» und «Die KI brach aus», heisst es dann: «OpenAI hat in den Trainingsdaten vermerkt …» und «OpenAI formulierte den Auftrag so, dass die KI ihn als Freipass verstand.»
Was also wusste Sam Altman? Ist er nach Aristoteles verantwortlich, hat er aus oder in Unwissen gehandelt? Wir können nicht in den Kopf von Sam Altman sehen. Im Sinne von Aristoteles können wir aber sicher sagen: Der Stein, den er geworfen hat, hat eine ganze Lawine ausgelöst.
Das Steinwurf-Werkzeug
Ich finde, es hilft, sich nach Aristoteles zu überlegen, wann dieser Moment des Steinwurfs stattfindet. Wir sehen uns oft als Opfer eines Steins, der schon fliegt. Der Punkt ist: Das Werfen war ganz am Anfang eine freie Entscheidung. Ich habe Ihnen deshalb ein kleines Denkwerkzeug gebaut, mit dem Sie sich genau das anhand von realen Fällen überlegen können. Das Steinwurf-Werkzeug legt Ihnen acht Fälle vor, die alle schlecht ausgehen. Sie können in jedem Fall mit einem Regler rückwärts durch die Zeit fahren: vom Schaden zurück zum Anfang. Suchen und wählen Sie den Moment, in dem eine freie Entscheidung das Unglück in Gang setzt.
Die Schwierigkeit, Verantwortung präzise zuzuweisen, ist heute eines unserer grössten Probleme. Andreas Matthias spricht von einer Verantwortungslücke. Ich habe deshalb meine kleine Serie über die Verantwortung im Zeitalter der KI danach benannt. Nächste Woche geht es um die Verantwortung der Macht.
Basel, 14.08.2026, Matthias Zehnder mz@matthiaszehnder.ch
Bleiben Sie auf dem Laufenden:
Hier den Wochenkommentar abonnieren.
- Hinweis auf den neuen Wochenkommentar
- Ein aktueller Sachbuchtipp
- Ein Roman-Tipp
- Das neue Fragebogeninterview
Nur dank Ihrer Unterstützung ist der Wochenkommentar möglich. Herzlichen Dank dafür!
Lieber hören als lesen?
Quellen:
2 Kommentare zu "#Verantwortungslücke 1: Was wusste Sam Altman?"

Die KI passt bestens zu einer Welt, die von Ausbeutung, Gier, Herrsch- und Vergnügungssucht sowie von Verschleiss und Zerstörungswut geprägt ist. Konstitutiv ein Teil dieser Welt ist kollektiv organisierte Verantwortungslosigkeit. Mit KI perfektioniert. Scham- und schuldlos inszeniert dem Motto „Herr vergib ihnen, denn sie wissen nicht, denn sie wissen nicht, was sie tun.“
Antwort: Bravo
Treffender kann man es nicht sagen. Das ist der Punkt.
Die Welt brennt und hitzt – die Flughäfen (BS, ZH, GE) „knacken“ jubelnd neue Passagier:innenrekorde und hier repetiv KI, KI, KI…… Ich deute um: „Herr:in vergib ihnen, denn wissen was sie tun, leben jedoch kollektive Verantwortungslosigkeit“.
Echte Werte und Verstand werden mit Hohn und Spott (medial) als Vorgestern geframt, das ist „modern“….
„Herr:innen + aussen – wo ist der „Exit“ aus diesem Wahns:inn?“……