KI Texte erkennen: Funktionieren die Detection Tools?

Woher weiß ich, was ein Mensch geschrieben hat – und was eine KI? Menschen können dies nicht unterscheiden. Auch wenn sie es behaupten… Wie sieht es mit einer anderen KI aus? Erkennt sie, was künstlich generierter Text ist? Ein paar Tools gab’s ja schon, die das mittelgut unterscheiden konnten. Jetzt hat OpenAI einen classifier rausgebracht. Wir widmen uns also einem heißen Thema. KI Texte erkennen: Funktionieren die Detection Tools?

 

Das neueste Tools vom Platzhirsch itself: OpenAI classifier

 

Hier die Eckdaten, wie zuverlässig das neue Tool von OpenAI KI-produzierte Texte erkennt: Aus dem Test-Set an englischsprachigen Texten wurden 26% der Texte korrekt als KI-produziert erkannt, aber auch 9% der vom Menschen geschriebenen als KI-produziert gelabelt. Schon ärgerlich… oder ein Gütesiegel, wenn man so schreibt, dass die KI einen für seinesgleichen hält? 

 

Die Zuverlässigkeit der Bewertung: Tendenziell Münzwurf

 

Die Zuverlässigkeit der Ergebnisse ist bei längeren Texten besser als bei kürzeren. Insgesamt ist das Ergebnis auf gut deutsch also eher mau. Auch eine KI kann definitiv nicht zuverlässig erkennen, ob ein Text von einer KI erzeugt wurde oder nicht.  OpenAI selbst gibt folgende Hinweise: Das Tool funktioniert wirklich sehr schlecht bei Texten, die kürzer sind als 1.000 Zeichen. Und sogar noch schlechter, wenn die Texte nicht englischsprachig sind. Vom Menschen editierte Texte sind nicht identifizierbar. 

Aber: Einfach ausprobieren. Hier geht’s zum Tool.

 

Wie funktionieren KI Detection Tools überhaupt? 

 

Die Detektoren überprüfen die Wahrscheinlichkeiten innerhalb eines Texts. Kurzer Exkurs: Die Text-KI kennt ja keine Zusammenhänge. Sie arbeitet lediglich mit Wahrscheinlichkeiten. Es wird prognostiziert, welcher Buchstabe am wahrscheinlichsten auf den vorhergehenden folgt. Diese Wahrscheinlichkeit lässt sich beziffern. Wenn die Buchstaben mit einer hohen Wahrscheinlichkeit aufeinanderfolgen, dann ist der Text vermutlich KI-produziert, so die Annahme des Detektors. Ganz simpel gesagt: Steht da wirres Zeug, dann nimmt das detection tool an, dass vermutlich ein Mensch dahintersteckt. Eine KI würde so etwas nicht tun 🙂

Übrigens könnt ihr euch im OpenAI Playground die Wahrscheinlichkeiten anzeigen lassen. Einfach bevor ihr auf „Submit“ klickt unten rechts „show probabilities“ aktivieren – siehe Screenshot:

 

 

KI-Texte erkennen: Welche Tools gibt’s noch? 

 

Humans deserve the truth, sagt gptzero. Den Human Content Score berechnet Contentatscale. Und Ensur.it verspricht mehr Integrity in an AI-inhabited world. Und hier geht’s noch zu DetectGPT, das in Tests besser abschneidet, aber höhere Rechenleistung benötigt.

 

Und was ist mit Digital Watermarks? 

 

Aktuell sind watermarks derzeit noch nicht im Einsatz, so OpenAI. Aber wie würden die überhaupt funktionieren? Noch ein Exkurs in die Statistik: Menschliche und natürliche Texte folgen einem Muster. Diese Muster lassen sich statistisch darstellen. Die zugrundeliegenden Wahrscheinlichkeiten dieser Muster bedingen die Texterzeugung. Auf das erste Wort folgt ein möglichst wahrscheinliches zweites Wort – und so fort. Eine Möglichkeit, einen Text zu „watermarken“ ist, die Satzstruktur zu verändern. Zu randomisieren. Aber eigentlich nur zu pseudo-randomisieren. Denn ein trainiertes System kann diese Pseudo-Randomisierung erkennen und daraus schließen, dass der Text künstlich generiert ist. Ein Mensch hat nicht die geringste Ahnung, dass irgendwas am Text pseudo-randomisiert – oder eben faul ist. Hier gibt’s mehr Informationen für die, die es genauer wissen wollen.

 

Fazit: Ein Wett-Rüsten um das Erkennen natürlicher Sprache

 

Insgesamt betrachtet wirkt es wie ein Wettrennen. Immer bessere Sprachmodelle produzieren immer bessere Texte und die Detektoren entwickeln sich weiter. Aber immer einen Schritt hintendran. Digital watermarks sind derzeit Zukunftsmusik und können nach Aussage von OpenAI auch leicht umgangen werden: Wenn man den Text umschreibt. KI Texte erkennen: Funktionieren die Detection Tools? Nicht wirklich gut.

 

und hier noch der Prompt zum Beitragsbild: stable diffusion 2.1: detective, close up portrait photo by annie leibovitz, film, studio lighting, detailed skin

Wer hat's geschrieben?

Das könnte Dich auch interessieren:
KI im Einsatz
Ich habe Claude auf einen Game Boy von 1989 gebracht, ohne selbst eine Zeile Code zu schreiben

Das Wichtigste in Kürze​   Claude DMG ist ein Homebrew-Spiel für den originalen Game Boy von 1989, eine Parodie auf Claude und das KI-Ökosystem. Der komplette Code entstand in der Zusammenarbeit mit Claude, ohne eigene Programmierkenntnisse: C für die ROM, JavaScript für den Browser-Emulator. Spielbar gratis im Browser und auf echter Game-Boy-Hardware per Flashcart. Kosten: rund 150 Euro an Credits, umgesetzt mit Fable 5 (bewusst überdimensioniert). Marketing-Lektion: Das KI-Modell muss zur Aufgabe passen. Das teuerste ist selten die richtige Wahl. Es

Weiterlesen »
KI im Einsatz
Behörde für freigesetzte Menschenzeit: Was zurückbleibt, wenn die KI übernimmt

„Der macht das jetzt für mich, was soll ich tun, zugucken?“ Diesen Satz höre ich in fast jedem Workshop. Genau da liegt das Problem: Selbstwirksamkeit bei KI-Agenten bleibt auf der Strecke, weil du zusiehst, statt zu handeln. Und kaum jemand kann sagen, was er mit der Zeit anfinge, die dabei frei wird. Genau um diese Frage haben wir eine kleine Behörde gebaut. Sie heißt Behörde für freigesetzte Menschenzeit, sie steht unter bffmz.de, und sie ist so

Weiterlesen »
KI im Einsatz
DeutschlandGPT im Test: die DSGVO-KI-Plattform aus Deutschland

Das ist Teil 4 unserer Testreihe zu europäischen KI-Alternativen. Wie wir testen und welche Tools noch dran sind, findest du in der Übersicht: Europäische KI-Alternativen im Test. „DeutschlandGPT“ klingt nach der patriotischen Antwort auf ChatGPT, und viele Mittelständler schauen genau deshalb hin. Spannend ist, was wirklich dahintersteckt. Vorweg, weil es fair ist: Um ein Tool wirklich zu beurteilen, müsste man es über Monate mit echten Projekten nutzen. Wir machen hier einen kleinen, immer gleichen Test,

Weiterlesen »
KI im Einsatz
Lumo von Proton: der datenschutz-kompromisslose KI-Assistent im Test

Das ist Teil 3 unserer Testreihe zu europäischen KI-Alternativen. Wie wir testen und welche Tools noch dran sind, findest du in der Übersicht: Europäische KI-Alternativen im Test. Wenn du KI nutzt, aber ein mulmiges Gefühl bei sensiblen Inhalten hast, ist Lumo genau für dich gebaut. Der Assistent kommt von Proton, den Machern des verschlüsselten Mail-Diensts, und stellt Datenschutz kompromisslos an die erste Stelle. Nach dem Allrounder Mistral Vibe und der Suche xprivo ist Lumo unser dritter

Weiterlesen »
KI im Einsatz
xprivo: die europäische KI-Suche im Test

Das ist Teil 2 unserer Testreihe zu europäischen KI-Alternativen. Wie wir testen und welche Tools noch dran sind: zur Übersicht. Wenn du KI zum Recherchieren nutzt, läuft das meistens über Perplexity, ein US-Tool. xprivo will genau hier die europäische Antwort sein: KI-Suche, die recherchiert und Quellen liefert, aber komplett in Europa läuft. Vorweg, wie immer in dieser Reihe: Das ist kein monatelanger Test, sondern ein kurzes Reinschauen mit einer festen Aufgabe. Für einen ersten Eindruck

Weiterlesen »
Aktuelles
Wie deutsch ist Langdock wirklich?

Teil unserer Reihe zu europäischen KI-Alternativen. Wie wir testen und warum manche Tools nicht in den Test kommen: zur Übersicht. Langdock gilt als deutsches KI-Startup und europäischer Hoffnungsträger. Das stimmt auch, zum Teil. Schaut man genauer hin, ist die Geschichte nur etwas vielschichtiger, als die Schlagzeilen vermuten lassen. Souveränitäts-Check: ♦ US-Eigentum. Die Langdock GmbH sitzt in Berlin (HRB 254499 B), gehört laut Gesellschafterliste aber zu 100 Prozent der Langdock Inc. mit Sitz in Delaware, USA. Öffentlich eingeordnet

Weiterlesen »

Hey Du. Willst du AI Content Manager werden?

Dann ab ins kostenfreie Info-Webinar am 25.03. um 12:00 Uhr. 

🚀 Exklusive Back-to-School-Aktion 🚀

Spare 880 € beim KI-Marketing-Bootcamp!

Bring eine Kolleg*in mit und erhalte 50% Rabatt für deine Begleitung.

Nur für kurze Zeit und solange Kontingent reicht! Aktion endet am 16. September 2024.