Zum Inhalt springen
Implementa.

Einen KI-Agent bauen · Guide 7 von 9

Einen Agenten mit ChatGPT bauen: was ein Custom GPT löst und wo er bricht

Ein Custom GPT ist kein Agent. Er ist ein Formular mit Goldfischgedächtnis: Jedes Gespräch startet bei null, er schreibt nicht unter eigenem Namen in deine Systeme, und niemand prüft, ob er richtig liegt. Und trotzdem ist er der richtige Startpunkt, denn ein Nachmittag reicht, um herauszufinden, ob dein Fall dort hineinpasst. Dieser Leitfaden handelt von den vier Wänden, an denen er immer bricht, und von dem Test, der dir sagt, an welcher du stehst — bevor du für das Nächste bezahlst.

Was ein Custom GPT genau ist (und warum er kein Agent ist)

Ein Custom GPT ist ChatGPT mit einem Textfeld davor. In diesem Feld stehen Anweisungen — wie er sich verhalten soll, welchen Ton er nutzt, was er nicht tun darf — und daneben kannst du bis zu 20 Wissensdateien mit je bis zu 512 MB anhängen, Fähigkeiten wie Websuche aktivieren und Apps oder Actions an externe APIs hängen. Das war es. Viel mehr, als es aussieht, und viel weniger, als dir verkauft wird.

Der Unterschied zu einem Agenten ist keine Frage der Leistung, sondern der Architektur. Ein Agent entscheidet, welches Werkzeug er nutzt, erinnert sich zwischen Interaktionen und misst seine eigene Arbeit. Ein Custom GPT macht das Erste halb und keines der beiden anderen. Der ehrliche Vergleich lautet also nicht „GPT gegen Agent", sondern „sehr gutes Formular gegen System". Ein Formular mit Goldfischgedächtnis: Es bedient dich tadellos und weiß morgen nicht mehr, wer du bist.

Eine Sache hat sich geändert, und du solltest sie kennen, bevor du den Editor öffnest: Neue GPTs lassen sich auf privaten ChatGPT-Konten nicht mehr erstellen — weder Free noch Go, Plus oder Pro. Erstellen und Veröffentlichen hängen heute an einem Business-, Enterprise- oder Edu-Workspace und dessen Berechtigungen. Bereits bestehende GPTs laufen weiter. Wenn dein Plan „ich baue den Agenten Samstagnachmittag" über dein Plus-Konto lief, fang genau da an.

Was er wirklich löst — und gut löst

Mit einem Custom GPT anzufangen ist nicht naiv: Es ist die billigste Diagnose, die es gibt. An einem Nachmittag findest du heraus, ob dein Problem Wissen war (die Leute finden die Information nicht) oder Prozess (die Information ist da, aber niemand handelt). Zwei verschiedene Probleme, und nur eines davon löst ein Agent.

  • Wiederkehrendes Urteil, einmal aufgeschrieben. Wie wir ein Angebot formulieren, was wir im Erstgespräch fragen, welchen Ton wir bei einem wütenden Kunden anschlagen. Zehn Leute wenden denselben Maßstab an, ohne ihn auswendig zu können.
  • Nachschlagen in stabiler Dokumentation. Produkthandbuch, Spesenrichtlinie, Vertragsbedingungen. Wenn sich das Dokument zweimal im Jahr ändert, ist der GPT das richtige Werkzeug und mehr braucht es nicht.
  • Erster Durchgang bei repetitiver Arbeit. Entwürfe, Zusammenfassungen, einfache Klassifikation. Ein Mensch prüft und schickt raus. Hier spart der GPT echte Stunden — und zwar ab Tag eins.
  • Einfache Actions, nur lesend. Verfügbarkeit prüfen, eine Bestellung suchen, einen Wert aus einem deiner Systeme holen. Lesen, nicht schreiben: minimales Risiko, hoher Nutzen.

Das ist die nützliche Obergrenze. Sie zu überschreiten kostet echtes Geld, und die gute Nachricht ist: Der GPT sagt dir Bescheid. Wenn er bricht, bricht er immer an einer von vier Wänden. Zu erkennen, welche deine ist, ist die halbe Arbeit. Die andere Grenze — die Obergrenze von No-Code, wenn du einen Ablauf zwischen Tools automatisieren willst und kein Gespräch — steht in mit KI automatisieren ohne zu programmieren.

Wand 1: Er merkt sich nichts zwischen Gesprächen

Die Dokumentation von OpenAI lässt keinen Interpretationsspielraum: GPTs nutzen weder den gespeicherten Speicher noch benutzerdefinierte Anweisungen noch frühere Unterhaltungen. Jedes Gespräch startet bei null. Das Einzige, was bleibt, ist das, was du in Anweisungen und Dateien geschrieben hast — für alle gleich, jeden Tag.

Klingt nach technischem Detail und ist die Wand, an der die meisten Projekte sterben, weil man sie spät bemerkt. Der Support-GPT läuft in der Demo großartig, und drei Wochen später fragt jemand, warum er schon wieder die Bestellnummer will, die er am Dienstag genannt hat. Das ist kein Fehler: Das ist das Design. Ein GPT hat keinen Zustand; er hat Anweisungen.

Wand 2: Er schreibt nicht mit eigener Identität in deine Systeme

Actions verbinden einen GPT tatsächlich mit deinen APIs, mit drei Authentifizierungsarten: keine, API-Key oder OAuth. Der Unterschied dazwischen ist exakt der Unterschied zwischen Demo und System. Mit API-Key betritt der GPT dein System mit einer einzigen Identität für alle: Dein Audit-Log sagt nicht „María hat den Bestellstatus geändert", sondern „der GPT war es". Mit OAuth meldet sich jede Person mit ihrem eigenen Konto an und du bekommst die Nachvollziehbarkeit zurück — im Tausch gegen einen echten Autorisierungsfluss mit Tokens, Scopes und Wartung.

Auth-ModusWer der Agent für dein System istWofür es wirklich taugt
KeineEin Anonymer aus dem InternetÖffentliche Daten. Sonst nichts.
API-KeyEin einziger technischer Nutzer, für alle derselbeLesen und Demos. Schreiben nur, wenn dir egal ist, wer was tat.
OAuth (Authorization Code)Jede Person mit eigenem Konto und eigenen RechtenEchtes Schreiben mit Nachvollziehbarkeit. Kostet Integrationsarbeit.

Zwei weitere Einschränkungen bringen viele durcheinander. Ein GPT kann Apps oder Actions nutzen, aber nicht beides gleichzeitig. Und in verwalteten Workspaces kann der Admin Actions auf eine Liste erlaubter Domains beschränken: keine Domain in der Liste, keine Actions. Heißt: Der Teil, der deinen GPT zu etwas macht, das ausführt, hängt an einer Berechtigung, die du vermutlich nicht kontrollierst. Wenn du ernsthaft schreiben willst — Kontakt anlegen, Opportunity verschieben, Sequenz auslösen — geht das Gespräch nicht mehr um Prompts, sondern um KI mit deinem CRM verbinden und KI in deine Systeme integrieren.

Wand 3: Niemand misst, ob er richtig liegt

Das ist die leise Wand. Wer einen GPT baut, kann die einzelnen Unterhaltungen nicht sehen, die Nutzer mit ihm führen: So steht es in der Dokumentation von OpenAI, und als Datenschutzentscheidung ist das vernünftig. Die operative Folge ist es weniger. Sie bedeutet, dass du das Einzige nicht tun kannst, was ein System besser macht: die Fälle anschauen, in denen es danebenlag.

In Enterprise und Edu bekommst du Workspace-Analytics mit einem GPT-Bereich und die Unterhaltungen in der Compliance-Plattform. Das gibt dir Adoption und Compliance-Spuren — wie viele Leute es nutzen, wie oft. Es gibt dir keine Treffergenauigkeit. Zwei Zahlen, die ständig verwechselt werden und in entgegengesetzte Richtungen zeigen: Ein GPT, der schlecht antwortet, erzeugt mehr Unterhaltungen, nicht weniger.

  1. Adoption — wie viele Leute ihn öffnen. Das siehst du. Das steigt allein durch Neugier.
  2. Treffergenauigkeit — welcher Anteil der Antworten korrekt und umsetzbar ist. Das zählt. Das siehst du nicht.
  3. Fehlerkosten — was passiert, wenn er falsch liegt. Das entscheidet, ob der GPT etwas Echtes anfassen darf. Siehst du auch nicht.

Der Ausweg ist nicht aufzugeben, sondern die Schleife außerhalb von ChatGPT zu bauen — ein Satz echter Fragen mit erwarteten Antworten, den du jedes Mal von Hand durchgehst, wenn du die Anweisungen anfasst. Das ist Handarbeit, unbequem und funktioniert. Wie dieser Satz entsteht, steht in wie man einen KI-Agenten trainiert. Und in dem Moment, in dem diese Schleife so wehtut, dass du sie automatisieren willst, baust du keinen GPT mehr: Du baust einen Agenten.

Wand 4: Er hat keinen Verantwortlichen im Organigramm

Hier lohnt sich Präzision, denn die bequeme Version dieser Wand stimmt nicht mehr. In einem verwalteten Workspace geht die Inhaberschaft an einen Workspace-Owner über, wenn der Eigentümer eines GPT deaktiviert oder entfernt wird, und der GPT wird als nicht zugewiesen markiert, damit jemand ihn prüft oder neu zuweist. Das Konto geht nicht verloren. Das Problem liegt woanders.

Was verloren geht, ist das Urteil. Die Anweisungen eines GPT sind reiner Text in einem Formular: keine Versionshistorie, kein Review, kein Kommentar, der erklärt, warum im März dieser seltsame Satz über Rabatte dazukam. Wenn die Person geht, die ihn geschrieben hat, überlebt der Text und das Warum nicht. Sechs Monate später antwortet der GPT weiter mit einer Richtlinie, die nicht mehr gilt, und niemand merkt es, weil — siehe Wand 3 — niemand die Unterhaltungen liest.

Die zwei Fragen, die dir sagen, an welcher Wand du stehst

Du brauchst keine zweiwöchige Analyse. Zwei Fragen ordnen deinen Fall ein:

  1. Muss das zweite Gespräch wissen, was im ersten passiert ist? Wenn ja → Wand 1, Gedächtnis. Kein GPT hilft dir, mit oder ohne Anweisungen.
  2. Muss das Ergebnis in einem deiner Systeme landen, und muss nachvollziehbar sein, wer es geschrieben hat? Wenn ja → Wand 2, Identität. Du brauchst OAuth und Schreibvalidierung, oder du brauchst etwas anderes.

Wenn beide Antworten „nein" lauten, bleib, wo du bist: Der GPT ist das richtige Werkzeug, und mehr auszugeben ist Geldverbrennen. Wenn eine „ja" lautet, ist dein Problem Architektur und bessere Anweisungen lösen es nicht. Und Vorsicht vor der üblichen Falle: Wand 3 und 4 tauchen in diesem Test nicht auf, weil sie nie der Grund sind, warum jemand den Sprung wagt — sie sind der Grund, warum der GPT sechs Monate nach dem Abnicken leise stirbt.

Wenn dein Fall ist…Ein Custom GPTWas du wirklich brauchst
Stabile Dokumentation nachschlagenReichtNichts weiter
Wiederkehrendes Urteil auf Entwürfe anwendenReichtMenschliche Prüfung
Einen Kunden über mehrere Tage betreuenReicht nichtPersistentes Gedächtnis
Ins CRM oder ERP schreiben, mit AuditReicht nichtOAuth, Validierung und Logs
Auf deiner Website oder im Produkt antwortenUnmöglichDie API, kein GPT

Was man baut, wenn der GPT nicht mehr reicht

Kurze Antwort: dasselbe, plus die vier Teile, die der GPT nicht hat. Persistentes Gedächtnis, damit das System weiß, was vorher passiert ist. Identität pro Nutzer, damit es mit Namen schreibt. Evals, damit jemand weiß, ob es richtig liegt. Und ein menschlicher Verantwortlicher mit Namen im Organigramm, damit sich die Anweisungen ändern, wenn sich die Richtlinie ändert.

Das ist kein Sprung ins Ungewisse und kein Neubau bei null: Die Arbeit im GPT — die geschliffenen Anweisungen, die Dokumente, die wirklich funktioniert haben, die echten Fragen der Leute — ist genau das Ausgangsmaterial. Genau deshalb ist es eine gute Idee, mit einem GPT anzufangen, obwohl du weißt, dass er zu klein wird: Du baust keinen Wegwerf-Prototyp, du schreibst die Spezifikation.

Wenn das Ziel ein Assistent auf deiner Website oder in deinem Produkt ist, führt der Weg über einen RAG-Chatbot auf deiner Wissensbasis. Ist es interne Arbeit mit Prozessen und Systemen dazwischen, über KI-Agenten für Unternehmen. Und wenn du gar nicht bauen, sondern ChatGPT so wie es ist im Team nutzen wolltest, ist das ein anderes Gespräch und es steht hier: ChatGPT in einem echten Unternehmen nutzen.

Wir machen den langweiligen Teil: Wir bauen KI-Mitarbeiter, die sich erinnern, mit eigener Identität in deine Systeme schreiben und jemanden haben, der prüft, ob sie richtig liegen. Wir verkaufen nicht den Prompt. Wir berechnen das laufende System.

Und wenn du hier ankommst und feststellst, dass der GPT zu kurz greift, lautet die nächste Entscheidung nicht, welches Werkzeug — sondern auf welcher Ebene: das steht in Plattformen für KI-Agenten, mit den drei Ausstiegsfragen, die du beantworten solltest, bevor du irgendetwas unterschreibst.

Häufig gestellte Fragen

Einen Custom GPT baust du ohne eine einzige Zeile: Anweisungen in einem Textfeld, bis zu 20 Wissensdateien (je 512 MB) und Fähigkeiten wie Websuche. Was ohne Code nicht geht, ist genau der Teil, der daraus einen Agenten macht: einen Endpunkt für Actions bereitstellen, ihn authentifizieren und validieren, was er schreibt. Ohne Code hast du einen sehr guten Assistenten, der deine Dokumente liest; mit Code hast du etwas, das ausführt. Quelle: Creating and editing GPTs, OpenAI Help Center, abgerufen am 2. September 2026.

Nein. Die Dokumentation von OpenAI ist eindeutig: GPTs nutzen weder gespeicherten Speicher noch benutzerdefinierte Anweisungen noch frühere Unterhaltungen — jedes Gespräch startet neu. Persistent ist nur, was du in Anweisungen und Wissensdateien geschrieben hast, für alle identisch. Wenn dein Fall verlangt, dass das System weiß, was letzte Woche mit genau diesem Kunden war, endet dort der GPT und beginnt ein Agent mit echtem Gedächtnis. Quelle: GPTs in ChatGPT, OpenAI Help Center, abgerufen am 2. September 2026.

Nein. OpenAI sagt es ohne Umschweife: GPTs sind dafür gebaut, innerhalb von ChatGPT zu laufen, und sind kein Weg, ChatGPT in eine externe Website oder Anwendung einzubetten; dafür gibt es die API. Wenn du einen Assistenten in deinem Produkt oder auf deiner Website willst, suchst du keinen GPT — du suchst einen Chatbot auf Basis deiner Wissensbasis. Quelle: GPTs in ChatGPT, OpenAI Help Center, abgerufen am 2. September 2026.

Kommt darauf an, wo er lebt. In verwalteten Workspaces (Business, Enterprise, Edu) geht die Inhaberschaft an einen Workspace-Owner über, wenn der Eigentümer deaktiviert wird, und der GPT wird als nicht zugewiesen markiert, damit er neu zugewiesen werden kann. Das löst das Konto, nicht das Problem: Die Anweisungen bleiben Text ohne Versionshistorie, ohne Review und ohne jemanden im Organigramm, der für ihre Pflege zuständig ist. Der GPT stirbt nicht am Konto; er stirbt, weil ihn niemand aktualisiert. Quelle: Managing GPT access in Enterprise and Edu workspaces, OpenAI Help Center, abgerufen am 2. September 2026.

KI-Impact-Plan · kostenlos

Der Guide ist generisch. Dein Plan nicht.

Erzähl uns von deinem Unternehmen und du bekommst eine Diagnose mit Prioritäten, Zahlen und dem, was zuerst gebaut wird. Ohne Sales-Termin, ohne einen Euro zu zahlen.

Einen Agenten mit ChatGPT bauen: was ein Custom GPT löst und wo er bricht · Implementa