Ein Mathematiker der TU Dresden stellt eine unbequeme Frage an OpenAI: Sind unveröffentlichte Forschungsinhalte aus seinen privaten ChatGPT-Gesprächen in das Training der Modelle geflossen?
Andreas Thom, Professor für Geometrie, hatte nach eigener Darstellung über Monate hinweg mit einem Kollegen Forschungsideen über ChatGPT diskutiert. Am 29. Juni deaktivierte er in den Einstellungen die Nutzung seiner Daten für das Modelltraining. Anfang August kündigte OpenAI einen mathematischen Durchbruch an. Thom erschien der dort eingeschlagene Lösungsweg auffällig, weil er nicht der naheliegendste gewesen sei. Daraus leitet er einen Verdacht ab, keinen Beweis.
OpenAI weist das zurück. Der Forscher Mark Sellke erklärte, Gespräche wie die von Thom würden dafür nicht verwendet. Thom hält diese Zurückweisung für pauschal und in wesentlichen Punkten irreführend.
Der Fall reiht sich in eine ältere Auseinandersetzung ein. Bei einem OpenAI-Beweis zu den Navier-Stokes-Gleichungen hatte der Mathematiker Gonzalo Cao-Labora fehlende Quellenangaben moniert; das Unternehmen ergänzte sie nachträglich.
Belegt ist bislang nichts. Bemerkenswert ist der Vorgang trotzdem. Wer an einer deutschen Universität forscht und dabei kommerzielle Chatbots nutzt, hat kaum ein Mittel, den Weg der eigenen Daten zu prüfen. Die Beweislast liegt faktisch beim Anbieter, und die Kontrolle darüber ebenso.