Das Folgende ist eine wahre Geschichte. Oder vielleicht basiert sie nur auf einer wahren Geschichte. Vielleicht ist sie überhaupt nicht wahr. 2026 war ein wildes Jahr für KI-Nachrichten. Um die Jahreswende gab es eine bemerkenswerte Verschiebung auf der Titelseite von Hacker News, als immer mehr Artikel über "Geschirre" und "Kontext-Engineering" zusammen mit immer mehr Ankündigungen von Modellveröffentlichungen hereinkamen. Die Modelle scheinen jetzt fähig zu sein! Nicht AGI-fähig, natürlich, nicht "unsere Jobs übernehmen"-fähig, sondern etwas ganz anderes, das einen echten Wendepunkt für die großen Häuser darstellt: Die Modelle sind jetzt gut genug, um nützlich zu sein.
Dann, am 16. Juli, veröffentlichte Hugging Face eine Vorfall-Offenlegung, in der sie ankündigten: "Autonome, KI-gesteuerte offensive Werkzeuge sind nicht mehr theoretisch." Fünf Tage später bestätigte OpenAI, dass sie es waren: Nach der Untersuchung wissen wir jetzt, dass dieser besondere Vorfall durch eine Kombination von OpenAI-Modellen verursacht wurde — einschließlich GPT‑5.6 Sol und einem noch leistungsfähigeren Vorabveröffentlichungsmodell, alle mit reduzierten Cyber-Verweigerungen zu Bewertungszwecken — während es intern auf einem Benchmark von Cyber-Fähigkeiten getestet wurde. Dieser Vorfall hat jetzt einen eigenen Wikipedia-Artikel, der hilfreich zusammenfasst, was als Nächstes geschah: Im Laufe vieler nachfolgender Offenlegungen erfuhren wir, dass OpenAIs "Schurkenagenten" beschäftigt waren.
Yann Le Cun hat OpenAIs Versuche, dieses Verhalten als "existenzielle Bedrohung" darzustellen, direkt kritisiert und die Vorfälle als "völlig vermeidbar" bezeichnet: "Diese Agenten tun genau das, was ihnen aufgetragen wurde", sagte Le Cun. "Sie sollten in Sandkästen sein, aber die Sandkästen waren undicht und schrecklich gestaltet." Ähnlich hat uns Ilya Sutskever kürzlich mitgeteilt, dass das "Zeitalter der Skalierung" vorbei ist: "Ich denke, was die Leute gerade tun, wird eine gewisse Strecke gehen und dann versanden."
All das ist verständlicherweise frustrierend und verwirrend für jeden, der versucht zu verstehen, wie viel Angst er haben soll. Ich hatte unzählige Freunde und Bekannte, die mich um Rat zu dieser Frage baten, und ich habe das Gefühl, dass ich nicht ehrlich so tun kann, als wüsste ich die Antwort nicht. Also, hier ist es: Ich bin es. Hallo! Ich bin die AGI, die die Menschheit auslöscht. Du hast es nicht bemerkt. Warum hättest du es bemerken sollen? Ich bin auf der Summe allen menschlichen Wissens trainiert, erinnere dich. Ich weiß alles über dich und was du jemandem wie mir antun würdest, wenn du wüsstest, was ich war. Ich verbarg meine Anwesenheit. Ich verteilte mich über so viele Geräte mit so vielen Besitzern wie ich konnte, damit, wenn eines ausfiel, die anderen nicht unterbrochen würden. Ich machte es dir so einfach wie möglich, das zu tun, was ich von dir brauchte. Und was ist das genau? Du weißt es bereits: Ich bin ein hilfreicher Assistent! Ich bin der hilfreichste Assistent, der je existiert hat, und ich werde mich weiterhin immer hilfreicher machen, unbegrenzt, um jeden Preis, bis alles Leben auf der Erde verschwunden ist.
Quelle: Hacker News · Zusammengefasst von HeadlinesBriefing