Bei der Sperrung ging es um mehr als nur einen Chatbot
OpenAI sperrte das Konto von Felix Kjellberg, bekannt als PewDiePie, stellte den Zugang nach einem Einspruch wieder her und sperrte ihn anschließend erneut. Der angegebene Grund für die Sperrungen war Distillation, ein Prozess, den OpenAI gemäß seinen Nutzungsbedingungen für die Entwicklung konkurrierender Modelle untersagt. Kjellbergs Einspruch lautete Berichten zufolge: „Ich habe nicht destilliert, ich schwöre es.“
Distillation beinhaltet das Training eines kleineren Modells unter Verwendung der Antworten eines größeren, leistungsfähigeren Modells. Die Bedingungen von OpenAI untersagen es Nutzern, deren Outputs zur Entwicklung von Modellen zu verwenden, die mit ihren Diensten konkurrieren. Insbesondere Abschnitt 2c der Nutzungsbedingungen von OpenAI verbietet die Verwendung von Outputs ihrer Modelle zum Training anderer Modelle.
Kjellbergs Projekt mit dem Namen Ajax ist ein feinabgestimmtes Qwen 3.5 9B-Modell, das für den lokalen Betrieb konzipiert ist. Berichten zufolge wollte er die Zensur aus dem Modell entfernen. Um Trainingsdaten zu generieren, beabsichtigte Kjellberg, die Modell-Outputs von OpenAI zu destillieren. OpenAI verschlüsselt Berichten zufolge die Schlussfolgerungen des Modells, die oft als "Chain-of-Thought" (CoT)-Token bezeichnet werden.
Er soll eine Studie gefunden haben, die die Entschlüsselung dieser Schlussfolgerungen mithilfe der eigenen APIs von OpenAI demonstriert. Kjellberg erklärte, diese Methode habe „funktioniert“, aber OpenAI sperrte ihn wegen Distillation. Sein Konto wurde nach einem Einspruch entsperrt, aber weitere Aktivitäten führten zu einer zweiten Sperrung. OpenAI ist kürzlich gegen ähnliche groß angelegte Distillationskampagnen vorgegangen, darunter solche, die Entwicklern im Zusammenhang mit Moonshot AI's Kimi zugeschrieben werden.
Ajax bringt die KI nach Hause
Felix Kjellberg, bekannt als PewDiePie, hat Berichten zufolge ein lokales KI-Projekt namens Ajax entwickelt. Das System ist eine Feinabstimmung des Qwen 3.5 9B-Modells von Alibaba, das für den Betrieb auf einem persönlichen Computer konzipiert ist, um die Abhängigkeit von externen Cloud-Diensten zu verringern.
Das lokale Ausführen eines Modells mit 9 Milliarden Parametern bietet Nutzern mehr Kontrolle und kann Abonnementkosten eliminieren. Ein solches Modell erreicht jedoch nicht automatisch die Fähigkeiten, Geschwindigkeit oder Zuverlässigkeit von gehosteten Frontier-Systemen. Lokale Implementierungen erfordern Kompromisse bei der Rechenleistung und den ausgefeilten Funktionen, die oft in Cloud-basierter KI zu finden sind.
Kjellberg beschrieb Bemühungen, ein „unzensiertes“ Modell zu erstellen, indem er Verweigerungsverhalten entfernte und Techniken zur Repräsentationsbearbeitung einsetzte. Das Abschwächen dieser Sicherheitsvorkehrungen kann die Generierung schädlicher oder voreingenommener Outputs erhöhen. Solche Modifikationen verbessern nicht zwangsläufig die Schlussfolgerungsfähigkeiten oder die allgemeine Aufgabenleistung des Modells.
Das Katz-und-Maus-Spiel um Reasoning-Token
PewDiePies Video skizziert seine angebliche Methode zur Generierung von Trainingsdaten. Er untersuchte Berichten zufolge API-basierte Techniken, um nützliche Modellantworten oder Reasoning Traces von OpenAI-Modellen zu erhalten, die er als „das gute Zeug“ bezeichnete. Dieser Ansatz zielte darauf ab, Beispiele für das Feintuning seiner lokalen KI, Ajax, zu gewinnen.
Labore wie OpenAI verschlüsseln oder verdecken normalerweise interne Chain-of-Thought-Prozesse. Zugriffskontrollen und Dienstüberwachung schützen die technischen und kommerziellen Interessen eines Anbieters, insbesondere in Bezug auf proprietäre Modellarchitektur und Trainingsdaten. Hochwertige synthetische Daten, insbesondere solche, die von fortschrittlichen Modellen abgeleitet wurden, können die Leistung kleinerer Modelle erheblich verbessern.
Die Nutzungsbedingungen von OpenAI verbieten die Verwendung ihrer Modell-Outputs zum Training konkurrierender Modelle. PewDiePies Konto wurde Berichten zufolge wegen „Distillation“ gesperrt, nachdem er versucht hatte, diese Reasoning-Token zu extrahieren. Er fand eine Studie, die detailliert beschrieb, wie man solche Spuren mithilfe der eigenen APIs von OpenAI entschlüsseln kann, was laut seiner Aussage „funktioniert hat“.
OpenAI hat sich öffentlich zu Bemühungen geäußert, koordinierte Destillationskampagnen zu unterbinden. Während die Aktivitäten von PewDiePie ein einzelnes Konto betrafen, haben größere Operationen, wie sie Firmen wie Moonshot AI zugeschrieben werden, ähnliche Methoden angewandt. OpenAI hat kürzlich serverseitige Patches implementiert, um weit verbreitete Reasoning-Lecks zu blockieren. Weitere Informationen zu umfassenderen Bemühungen finden Sie unter Disrupting a Coordinated Model-Distillation Campaign - OpenAI.
Gefällt Ihnen der Artikel? Erhalten Sie jeden Morgen einen wie diesen per E-Mail.
eine E-Mail pro Tag · Abmeldung mit zwei Klicks · kein Tracking durch Dritte
Wer darf von wessen Daten lernen?
Die Debatte über Beschränkungen bei der Wiederverwendung von Modellausgaben verdeutlicht ein ethisches Spannungsfeld innerhalb der KI-Branche. Kritiker argumentieren, dass KI-Unternehmen, die grundlegende Modelle mit riesigen Datenmengen aus dem offenen Internet trainiert haben, einschließlich urheberrechtlich geschütztem Material, heuchlerisch handeln, wenn sie dann strenge vertragliche Grenzen für die Nutzung der Ausgaben ihrer proprietären Systeme durch die Anwender festlegen. Unternehmen hingegen argumentieren, dass solche Bedingungen ihre erheblichen Investitionen in die Modellentwicklung und Infrastruktur schützen.
Rechtlich gesehen bleiben diese Fragen getrennt. Urheberrechtsstreitigkeiten bezüglich der ursprünglichen Trainingsdaten, wie sie etwa Autoren oder Künstler betreffen, unterscheiden sich von den vertraglichen Verpflichtungen eines Nutzers gegenüber einem API-Anbieter. Ein Argument für Fair Use in einem Kontext setzt nicht automatisch die expliziten Nutzungsbedingungen eines Dienstanbieters außer Kraft, denen Nutzer beim Zugriff auf eine API zustimmen.
PewDiePies Ajax-Projekt veranschaulicht die wachsende Attraktivität leistungsfähiger, lokal kontrollierter KI-Modelle, die den Nutzern mehr Autonomie und eine geringere Abhängigkeit von Cloud-Diensten bieten. Die wiederholten Sperren unterstreichen jedoch, wie Zugangsregeln und Nutzungsbedingungen dominanter Modellanbieter diesen Weg einschränken können. Diese anhaltende Dynamik zwingt dazu, das Prinzip der Gegenseitigkeit gegen die etablierten Rechte und Regeln der Modellentwickler abzuwägen.
Häufig gestellte Fragen
Warum wurde PewDiePie von OpenAI gesperrt?
OpenAI nannte Berichten zufolge Destillation als Grund: die Verwendung seiner Modellausgaben zum Training eines konkurrierenden Modells, was laut den Nutzungsbedingungen untersagt ist.
Was ist PewDiePies Ajax AI?
Ajax wird als lokales Modell beschrieben, das auf Basis von Alibabas Qwen 3.5 9B feinabgestimmt wurde und für den Betrieb auf Consumer-Hardware vorgesehen ist.
Was bedeutet KI-Modelldestillation?
Bei der Destillation wird ein kleineres Modell unter Verwendung der Ausgaben eines größeren Modells trainiert, wodurch einige seiner Fähigkeiten auf ein kompakteres System übertragen werden.
Kann OpenAI Nutzer wegen Destillation sperren?
Die Nutzungsbedingungen von OpenAI schränken die Verwendung seiner Dienste oder Ausgaben zur Entwicklung konkurrierender Modelle ein, und das Unternehmen kann diese Bedingungen durch die Aussetzung des Zugangs durchsetzen.

