10.05.2023

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

Wie AI-Sprachmodelle zu ihren Antworten kommen, bleibt häufig unklar. Ein Team von OpenAI will nun mit einem AI-Tool ChatGPT und Co erklären.
/artikel/openai-tool-soll-chatgpt-verhalten-erklaeren
ChatGPT OpenAI AI-Sprachmodell
(c) Rolf van Root / unsplash

Wie kommt ChatGPT nur darauf? Diese Frage taucht unter anderem auf, wenn das AI-Sprachmodell mal wieder völlig haarsträubende Unwahrheiten von sich gibt. Dass KI-Laien sie nicht beantworten können, verwundert nicht. Doch auch für ausgewiesene Expert:innen lässt sich das „Verhalten“ von AI-Sprachmodellen oft nicht nachvollziehen. Die Rede ist dann immer wieder von einer „Blackbox“. Doch damit will sich ein Team bei OpenAI, dem Unternehmen hinter ChatGPT, nicht zufrieden geben. Es will die vielschichtigen Wege der Künstlichen Intelligenzen (nicht nur des Sprachmodells aus dem eigenen Haus) erklären – natürlich mit einem anderen AI-Tool.

„Wollen der Antwort, die das Modell produziert, vertrauen können“

Mit diesem soll automatisch ermittelt werden, welche Teile eines AI-Sprachmodells für welche seiner „Verhaltensweisen“ verantwortlich sind. Zukünftig sollen damit immer wieder auftretende Probleme der Modelle vermieden werden. „Wir wollen damit voraussehen können, was die Probleme mit einem KI-System sein werden“, erklärt William Saunders, Leiter eines beteiligten Teams bei OpenAI, gegenüber dem US-Magazin TechCrunch. „Wir wollen letztlich wissen, dass wir dem, was das Modell tut, und der Antwort, die es produziert, vertrauen können“.

GPT-2 wird mit GPT-4 getestet

Konkret basiert das neue Tool auf dem ebenfalls von OpenAI stammenden Sprachmodell GPT-4. Getestet wird aktuell an einfacheren Modellen, vor allem am Vor-Vorgänger GPT-2 [Anm. ChatGPT basiert momentan auf GPT-3]. Dabei eruiert das Tool, welche „Neuronen“ des getesteten Modells durch einen Prompt konkret aktiviert werden. Diese „Neuronen“ sind – vereinfacht gesagt – zusammenhängende Informationen, die das Modell zu einem bestimmten Thema erlernt hat. GPT-2 hat laut den Forschern rund 300.000 davon. GPT-4 liefert dann eine Erklärung, warum diese Neuronen aktiviert wurden und wie ihr „Verhalten“ zu verstehen ist. Dazu simuliert das neuere Sprachmodell das erwartete „Verhalten“ und macht einen Abgleich.

Neues OpenAI-Tool noch im Anfangsstadium

„Mit dieser Methodik können wir für jedes einzelne Neuron eine Erklärung für das finden, was es tut, und auch eine Bewertung darüber abgeben, wie gut diese Erklärung mit dem tatsächlichen Verhalten übereinstimmt“, sagt Jeff Wu, ebenfalls OpenAI-Teamleiter, gegenüber TechCrunch. Tatsächlich waren diese Erklärungen laut Team bislang erst bei einem Bruchteil der getesteten Neuronen akkurat. Das neue Tool befinde sich aktuell noch im Anfangsstadium, wird betont. Es ist Open Source auf der Plattform Github zugänglich.

Deine ungelesenen Artikel:
30.09.2026

WeAreDevelopers: Mehr als 10.000 Besucher:innen bei erstem USA-World-Congress in San José

WeAreDevelopers expandierte mit seinem World Congress erstmals in die USA. Über 10.000 Brancheninsider diskutierten in San José über KI im Produktiveinsatz.
/artikel/wearedevelopers-mehr-als-10-000-besucherinnen-bei-erstem-usa-world-congress-in-san-jose
30.09.2026

WeAreDevelopers: Mehr als 10.000 Besucher:innen bei erstem USA-World-Congress in San José

WeAreDevelopers expandierte mit seinem World Congress erstmals in die USA. Über 10.000 Brancheninsider diskutierten in San José über KI im Produktiveinsatz.
/artikel/wearedevelopers-mehr-als-10-000-besucherinnen-bei-erstem-usa-world-congress-in-san-jose
© WeAreDevelopers

Bereits im Juli 2025 kündigte das WeAreDevelopers-Team, rund um Sead Ahmetović, Benjamin Ruschin und Thomas Pamminger ihre US-Premiere 2026 an. Nun hat das 2017 in Wien gegründete Unternehmen den Sprung über den Atlantik umgesetzt. Nach Event-Stationen in Österreich und Deutschland hielt das Wiener Startup, das eine globale Entwickler-Plattform betreibt, vom 23. bis 25. September 2026 seinen ersten World Congress im Silicon Valley ab.

KI im Produktivbetrieb

In Partnerschaft mit dem US-Softwareanbieter Docker versammelte die Veranstaltung mehr als 10.000 Developer, AI Builder und Führungskräfte im San José Convention Center. Im Mittelpunkt stand die Frage, wie KI-gestützte Software den Schritt vom Prototyp in den Produktivbetrieb schafft.

„Zwei Jahre voller Demos und Pilotprojekte haben gezeigt, was möglich ist. Jetzt geht es darum, KI erfolgreich in die Systeme zu integrieren, auf die sich Unternehmen täglich verlassen. Das ist die eigentliche Aufgabe für die Branche“, sagt Sead Ahmetović, CEO und Co-Founder von WeAreDevelopers. „Genau deshalb bringen wir alle an einen Tisch.“

Docker-Präsident Mark Cavage stellte auf der Main Stage unter anderem die neuen Docker Cloud Sandboxes für die isolierte Ausführung von KI-Agenten vor. Zu den Speakern zählten Thomas Dohmke (Entire, ex-GitHub), Amjad Masad (Replit) sowie DOOM-Miterfinder John Romero.

Nächster Halt Indien

Mit dem Debüt in Nordamerika treibt das Unternehmen seine internationale Expansion voran. Den Jahresabschluss soll die WeAreDevelopers Conference India am 25. und 26. November in Bengaluru bilden.

„Softwareentwicklung mit KI braucht einen globalen Dialog. Und der muss auf technischer Ebene stattfinden: zwischen den Menschen, die die eigentliche Arbeit machen, und den Führungskräften, die über die Zukunft ihrer Unternehmen entscheiden“, betont Executive Chairman und Co-Founder Benjamin Ruschin zum Ausbau der internationalen Präsenz.

Toll dass du so interessiert bist!
Hinterlasse uns bitte ein Feedback über den Button am linken Bildschirmrand.
Und klicke hier um die ganze Welt von der brutkasten zu entdecken.

brutkasten Newsletter

Aktuelle Nachrichten zu Startups, den neuesten Innovationen und politischen Entscheidungen zur Digitalisierung direkt in dein Postfach. Wähle aus unserer breiten Palette an Newslettern den passenden für dich.

Montag, Mittwoch und Freitag

AI Summaries

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Welche gesellschaftspolitischen Auswirkungen hat der Inhalt dieses Artikels?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Welche wirtschaftlichen Auswirkungen hat der Inhalt dieses Artikels?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Welche Relevanz hat der Inhalt dieses Artikels für mich als Innovationsmanager:in?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Welche Relevanz hat der Inhalt dieses Artikels für mich als Investor:in?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Welche Relevanz hat der Inhalt dieses Artikels für mich als Politiker:in?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Was könnte das Bigger Picture von den Inhalten dieses Artikels sein?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Wer sind die relevantesten Personen in diesem Artikel?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären

AI Kontextualisierung

Wer sind die relevantesten Organisationen in diesem Artikel?

Leider hat die AI für diese Frage in diesem Artikel keine Antwort …

Neues OpenAI-Tool soll ChatGPT-Verhalten erklären