ChatGPT für interne Dokumente: DSGVO-Check 2026
Interne Dokumente ins öffentliche ChatGPT? Riskant. Der DSGVO-Check 2026: was erlaubt ist, wo Fallstricke liegen und welche Alternative Quellen nennt.
Das öffentliche ChatGPT ist für vertrauliche Unternehmensdokumente nicht ohne Weiteres geeignet. Eingaben können außerhalb der EU verarbeitet und je nach Tarif zur Modellverbesserung genutzt werden. DSGVO-konform wird der Einsatz erst mit EU-Hosting, einem Auftragsverarbeitungsvertrag, vertraglich ausgeschlossener Trainingsnutzung und nachvollziehbaren Antworten mit Quellenangabe. Das leisten dedizierte B2B-Systeme, nicht der Standard-Chatbot.

Kann man ChatGPT mit internen Unternehmensdokumenten nutzen?
Der Wunsch ist verständlich. ChatGPT beantwortet Fragen in Sekunden, und das eigene Handbuch oder die Spezifikation einfach hineinzukopieren liegt nahe. Technisch funktioniert das. Die Frage ist nicht, ob es geht, sondern ob es darf.
Sobald vertrauliche Konstruktionsdaten, Kundeninformationen oder personenbezogene Daten ins Spiel kommen, wird aus einer Komfortfrage eine Compliance-Frage. Und die beantwortet sich nicht am Funktionsumfang, sondern an Datenstandort, Vertragslage und Nachvollziehbarkeit.
Dieser Beitrag beantwortet der Reihe nach: was die DSGVO in dieser Situation konkret verlangt, welche Risiken tatsächlich entstehen, was sich zwischen den ChatGPT-Tarifen ändert, wann der Einsatz vertretbar ist und wann nicht, und was die Alternative leisten muss.
Was die DSGVO in dieser Situation konkret verlangt
Die DSGVO verbietet den Einsatz von KI nicht. Sie stellt Bedingungen, und die lassen sich auf vier Fragen herunterbrechen.
Gibt es eine Rechtsgrundlage? Sobald personenbezogene Daten verarbeitet werden, braucht die Verarbeitung eine Grundlage, etwa ein berechtigtes Interesse oder die Vertragserfüllung. Technische Unterlagen wirken auf den ersten Blick unverfänglich, enthalten aber häufiger Personenbezug als gedacht: Namen von Prüfern in Protokollen, Ansprechpartner in Projektakten, Unterschriften in Freigaben.
Ist die Rolle geklärt? Wer ein Werkzeug einsetzt, ist Verantwortlicher. Der Anbieter ist Auftragsverarbeiter. Diese Beziehung braucht einen Vertrag nach Art. 28 DSGVO. Ohne ihn fehlt die Grundlage dafür, dass ein Dienstleister personenbezogene Daten in Ihrem Auftrag verarbeitet.
Wohin fließen die Daten? Verlässt die Verarbeitung den EU-Raum, greifen die Anforderungen an Drittlandübermittlungen. Es gibt Wege, das zu regeln, aber sie müssen bewusst gewählt und dokumentiert sein, nicht stillschweigend in Kauf genommen.
Bleibt die Verarbeitung zweckgebunden? Werden Eingaben verwendet, um Modelle zu verbessern, ist das eine weitere Verarbeitung zu einem anderen Zweck. Genau hier liegt der Unterschied zwischen einem Werkzeug, das Ihre Frage beantwortet, und einem Werkzeug, das aus Ihrer Frage lernt.
Ausführlich sortiert sind diese Punkte auf der Seite zu DSGVO-konformen KI-Tools, inklusive einer Prüfliste, die Sie ins Auswahlgespräch mitnehmen können.
Welche Risiken entstehen beim Hochladen interner Dokumente?
Datenstandort. In der kostenlosen Version ist oft nicht transparent, wo Eingaben verarbeitet werden. Bei einem Drittlandtransfer greifen zusätzliche Anforderungen der DSGVO. Hinzu kommt: Ein europäisches Rechenzentrum allein löst die Frage nicht, wenn der Betreiber einem Konzern mit US-Sitz gehört und damit dem US Cloud Act unterliegt. Was der Standort praktisch ändert und was nicht, steht im Beitrag zu EU-Hosting und KI.
Trainingsnutzung. Je nach Tarif und Einstellung können Eingaben zur Verbesserung der Modelle verwendet werden. Für interne Dokumente ist das ein No-Go, das vertraglich ausgeschlossen sein muss. Der entscheidende Punkt ist die Rechtsform der Zusage: Eine Einstellung im Konto lässt sich durch ein Update oder einen Tarifwechsel verändern, eine Vertragsklausel nicht.
Fehlender Auftragsverarbeitungsvertrag. Ohne AVV fehlt die rechtliche Grundlage für die Verarbeitung personenbezogener Daten durch einen Dienstleister. Für ein privat angelegtes Konto existiert dieser Vertrag in aller Regel gar nicht, weil das Konto nicht dem Unternehmen gehört.
Geschäftsgeheimnisse, nicht nur Datenschutz. Eine Konstruktionszeichnung enthält oft keinen Personenbezug und ist trotzdem das Wertvollste im Haus. Der Schutz von Geschäftsgeheimnissen setzt voraus, dass angemessene Geheimhaltungsmaßnahmen getroffen wurden. Ein unkontrollierter Upload in ein privates Chatbot-Konto arbeitet gegen genau diesen Nachweis.
Keine Nachvollziehbarkeit. Ein allgemeiner Chatbot formuliert aus seinem Trainingswissen und belegt seine Aussagen nicht. Bei technischen Inhalten ist eine Antwort ohne Quelle nicht überprüfbar und damit nicht belastbar. Warum das gerade bei technischer Dokumentation zählt, zeigt der Beitrag zu KI mit Quellenangabe.
Was sich zwischen den ChatGPT-Tarifen ändert
Die häufigste Verwechslung in dieser Diskussion: ChatGPT ist nicht ein Produkt, sondern eine Produktfamilie mit deutlich unterschiedlichen Bedingungen.
In den Consumer-Tarifen liegt die Kontrolle über die Trainingsnutzung bei einer Einstellung im Konto. Das Konto gehört der Person, nicht dem Unternehmen. Es gibt keinen unternehmensweiten Vertrag, keine zentrale Verwaltung von Zugriffen und keine Möglichkeit, den Umgang mit Daten organisatorisch durchzusetzen.
In den Business-Tarifen ändert sich das Bild: Es gibt vertragliche Zusagen, Administrationsfunktionen und in der Regel den Ausschluss der Trainingsnutzung. Das ist ein echter Unterschied und der Grund, warum die pauschale Aussage "ChatGPT ist verboten" genauso falsch ist wie "ChatGPT ist freigegeben".
Was sich dadurch nicht automatisch erledigt, sind die Fragen nach dem Verarbeitungsort und nach der Konzernzugehörigkeit des Anbieters. Diese beiden Punkte bleiben unabhängig vom Tarif zu bewerten.
Weil sich Tarifbedingungen ändern, gehört an dieser Stelle ein methodischer Hinweis statt einer Momentaufnahme: Lassen Sie sich die aktuell geltenden Vertragsbedingungen und den Auftragsverarbeitungsvertrag zeigen, statt sich auf eine Zusammenfassung im Netz zu verlassen. Das gilt für jeden Anbieter, auch für uns.
Anwendung und Schnittstelle sind zwei verschiedene Dinge
Ein Unterschied, der regelmäßig für Missverständnisse sorgt: Die Chat-Anwendung im Browser und die Programmierschnittstelle desselben Anbieters unterliegen unterschiedlichen Bedingungen. Wenn Ihre IT sagt "wir nutzen das Modell über die API, das ist geregelt", dann sagt das nichts darüber aus, was passiert, wenn jemand parallel die Weboberfläche mit einem privaten Konto öffnet.
Beide Wege müssen getrennt bewertet und getrennt geregelt werden. Für die Praxis heißt das: Eine Freigabe für ein integriertes System ist keine Freigabe für den Chatbot im Browser, und umgekehrt.
Vier Missverständnisse, die in jeder Diskussion auftauchen
"Wir anonymisieren die Dokumente vorher." Das klingt sauber und scheitert in der Praxis am Aufwand. Wer eine Antwort in zwei Minuten braucht, schwärzt keine 40 Seiten. Außerdem ist bei technischen Unterlagen oft nicht der Name das Problem, sondern die Zeichnung selbst. Anonymisierung hilft beim Datenschutz und gar nicht beim Geschäftsgeheimnis.
"Wir laden ja nur einen Ausschnitt hoch." Der Ausschnitt ist häufig genau der Teil, der zählt: die Toleranzangabe, die Berechnungsgrundlage, die Abweichung vom Standard. Die Menge entscheidet nicht über die Schutzwürdigkeit.
"Wir sind zu klein, um interessant zu sein." Die DSGVO kennt keine Untergrenze für die Anwendbarkeit ihrer Grundsätze, und der Schutz von Geschäftsgeheimnissen hängt nicht an der Unternehmensgröße, sondern daran, ob angemessene Maßnahmen getroffen wurden. Kleine Zulieferer arbeiten zudem oft mit Unterlagen ihrer großen Kunden, deren Geheimhaltungsvereinbarungen mitlaufen.
"Das Modell merkt sich das doch nicht." Ob ein Modell aus einer Eingabe lernt, ist eine Frage der Vertragsbedingungen, nicht der Intuition. Und selbst wenn kein Training stattfindet, wurden die Daten übermittelt und verarbeitet. Die datenschutzrechtliche Frage stellt sich bereits bei der Übermittlung, nicht erst beim Training.
Entscheidungsbaum: Wann ist ChatGPT vertretbar, wann nicht?
Der folgende Ablauf beantwortet die Frage für einen konkreten Anwendungsfall. Arbeiten Sie ihn von oben nach unten ab und hören Sie beim ersten Nein auf.
Schritt 1: Enthält das Dokument personenbezogene Daten oder Geschäftsgeheimnisse? Nein, es geht um öffentlich verfügbare Inhalte oder allgemeine Formulierungshilfe. → Der Einsatz ist unkritisch. Weiterlesen lohnt sich trotzdem für den nächsten Fall. Ja. → Weiter zu Schritt 2.
Schritt 2: Nutzen Sie ein Firmenkonto mit Unternehmensvertrag? Nein, es ist ein privates oder selbst angelegtes Konto. → Nicht vertretbar. Hier fehlt die vertragliche Grundlage vollständig, unabhängig von jeder Einstellung. Ja. → Weiter zu Schritt 3.
Schritt 3: Liegt ein Auftragsverarbeitungsvertrag vor, und ist die Trainingsnutzung darin ausgeschlossen? Nein oder unklar. → Nicht vertretbar, bis das geklärt ist. Diese Klärung dauert Tage, nicht Monate. Ja. → Weiter zu Schritt 4.
Schritt 4: Ist der Verarbeitungsort geklärt und die Drittlandfrage bewertet? Nein. → Zurückstellen und mit dem Datenschutzbeauftragten bewerten. Die Bewertung fällt je nach Datenkategorie unterschiedlich aus. Ja. → Weiter zu Schritt 5.
Schritt 5: Muss die Antwort belegbar sein? Ja, es geht um Normen, Toleranzen, Prüfschritte oder Angaben, die in ein Dokument oder eine Entscheidung einfließen. → Der allgemeine Chatbot ist das falsche Werkzeug. Nicht aus Datenschutzgründen, sondern weil eine Antwort ohne Quellenangabe hier keinen Wert hat. Nein, es geht um Formulierung, Zusammenfassung oder Struktur. → Vertretbar im geklärten Rahmen.
Der Ablauf zeigt einen Punkt, der in Datenschutzdiskussionen gern untergeht: Selbst wenn alle rechtlichen Fragen sauber beantwortet sind, bleibt bei technischen Inhalten ein fachliches Problem übrig. Das ist Schritt 5, und er entscheidet in der Praxis öfter als die Schritte davor.
Öffentliches ChatGPT vs. dedizierte KI für interne Dokumente
| Kriterium | Öffentliches ChatGPT | Dedizierte KI für interne Dokumente |
|---|---|---|
| Datenstandort | oft USA oder Drittland | EU-Rechenzentrum |
| Trainingsnutzung der Eingaben | je nach Tarif möglich | vertraglich ausgeschlossen |
| Auftragsverarbeitungsvertrag | eingeschränkt | Standard |
| Quellenangabe | nein | ja, bis auf Datei und Seite |
| Zugriffskontrolle und Audit-Log | begrenzt | rollenbasiert und protokolliert |
| Wissensbasis | allgemeines Trainingswissen | ausschließlich Ihre Dokumente |
| Verhalten bei Wissenslücken | formuliert plausibel weiter | verweist auf fehlenden Beleg |
| Löschung auf Anforderung | tarifabhängig | mit Frist und Protokoll |
Die letzte Zeile wird oft übersehen und ist im Auswahlgespräch eine der wirksamsten Fragen: Was genau wird gelöscht, in welcher Frist, und bekommen Sie darüber einen Nachweis? Dokumentkopien, Index, Embeddings und Caches sind vier verschiedene Dinge.
Das eigentliche Risiko heißt Schatten-IT
In der Praxis entscheidet selten die Richtlinie darüber, was passiert, sondern die Verfügbarkeit einer Alternative.
Ein Konstrukteur steht vor einer Frage, deren Antwort in einer 300-seitigen Norm oder in einem Projektordner von 2019 steckt. Er hat zwei Möglichkeiten: eine halbe Stunde suchen oder den Absatz in ein Chatfenster kopieren. Wenn es keinen freigegebenen dritten Weg gibt, entsteht der unfreigegebene von selbst, und zwar unsichtbar.
Das führt zu einer unbequemen Schlussfolgerung: Ein Verbot ohne Alternative erhöht das Risiko, statt es zu senken. Es verlagert die Nutzung nur dorthin, wo niemand sie sieht. Ein sauber geprüftes Werkzeug ist deshalb auch ein Datenschutzinstrument. Es nimmt dem Umweg den Anlass.
Praktisch heißt das: Richtlinie und Werkzeug gehören zusammen eingeführt. Die Richtlinie allein erzeugt Schatten-IT, das Werkzeug allein erzeugt Wildwuchs.
Worauf sollten Sie bei einer DSGVO-konformen Lösung achten?
Werden die Daten in der EU verarbeitet, und ist der Betreiber ohne US-Konzernmutter? Das entscheidet über die Anwendbarkeit des US Cloud Act.
Ist die Trainingsnutzung vertraglich ausgeschlossen, nicht nur per Häkchen in den Einstellungen?
Belegt das System jede Antwort mit einer Quelle? Ohne Beleg bleibt jede Aussage ein Vertrauensvorschuss.
Gibt es eine rollenbasierte Zugriffskontrolle und ein Audit-Log? Nicht jeder im Unternehmen soll jedes Dokument abfragen können.
Wie lange dauert eine vollständige Löschung, und was umfasst sie? Eine Löschzusage, die nur die Dokumentkopien meint, ist unvollständig.
Wie diese Punkte bei KoAssist konkret umgesetzt sind, inklusive Subprozessoren und Datenfluss, steht auf der Seite zu Sicherheit und EU-Hosting. Eine anbieterunabhängige Prüfliste für Ihr Auswahlgespräch finden Sie unter DSGVO-konforme KI-Tools. Und wie sich KoAssist gegenüber ChatGPT und anderen Werkzeugen einordnet, zeigt der Vergleich.
Was Sie in den nächsten zwei Wochen klären können
Die Diskussion bleibt oft deshalb liegen, weil sie als Grundsatzfrage geführt wird. Sie ist aber in wenigen Schritten operationalisierbar.
Erst den Ist-Stand feststellen. Fragen Sie im Team offen und ohne Sanktionsandrohung, wer aktuell welches Werkzeug für welche Aufgabe nutzt. Die Antwort ist selten "niemand", und sie ist die Grundlage für alles Weitere. Wer stattdessen mit einer Ermahnung beginnt, bekommt keine belastbare Auskunft.
Dann die Aufgaben sortieren, nicht die Werkzeuge. Trennen Sie zwischen Aufgaben ohne schutzwürdigen Inhalt, etwa Formulierungshilfe und Übersetzung, und Aufgaben an internen Unterlagen. Für die erste Gruppe braucht es meist nur eine klare Regel. Die zweite Gruppe ist der eigentliche Bedarf, und sie ist meist kleiner und konkreter als befürchtet.
Danach die Vertragslage prüfen. Für den bestehenden Tarif: Gibt es einen Auftragsverarbeitungsvertrag, ist die Trainingsnutzung ausgeschlossen, wo wird verarbeitet? Diese drei Fragen beantwortet ein Anbieter innerhalb weniger Tage oder gar nicht. Beides ist eine verwertbare Information.
Zuletzt entscheiden, ob ein zweites Werkzeug nötig ist. Wenn die Aufgaben aus Gruppe zwei überwiegen und Antworten belegbar sein müssen, führt der Weg zu einem dedizierten System. Wenn nicht, genügt eine geregelte Nutzung des vorhandenen.
Diese Reihenfolge hat einen praktischen Vorteil: Sie erzeugt nach spätestens zwei Wochen eine Entscheidungsgrundlage, statt eine Grundsatzdebatte zu verlängern, während im Hintergrund weiter hochgeladen wird.
Was bedeutet das für die Praxis?
Das öffentliche ChatGPT ist ein hervorragendes Werkzeug für allgemeine Aufgaben. Für vertrauliche interne Dokumente ist es das falsche Werkzeug, nicht weil es zu schwach wäre, sondern weil es für einen anderen Zweck gebaut ist.
Was technische Teams brauchen, ist kein allwissender Chatbot, sondern ein System, das ausschließlich aus den eigenen Unterlagen antwortet, jede Aussage belegt und die Daten in einem rechtssicheren Rahmen verarbeitet. Der entscheidende Unterschied liegt nicht in der Intelligenz des Modells, sondern in Herkunft der Antwort und Kontrolle über die Daten.
Wenn Sie die Frage für Ihr Unternehmen entscheiden müssen, hilft der Entscheidungsbaum weiter oben als Gesprächsgrundlage mit IT und Datenschutz. Er beantwortet in zehn Minuten, was sonst drei Termine kostet.
Dieser Beitrag ersetzt keine Rechtsberatung. Er soll Ihnen die Fragen liefern, mit denen Sie in die interne Abstimmung gehen.
Wie das mit Ihren eigenen Dokumenten aussieht, sehen Sie am besten direkt: Demo buchen.
Mehr zum größeren Zusammenhang finden Sie in unserem Themen-Hub KI in der Konstruktion, der Datenschutz, Quellenangabe und weitere Anwendungsfälle im Überblick einordnet.
Die Alternative im eigenen Bestand ist der Wissensassistent: Er arbeitet auf den Dokumenten, die ohnehin im Unternehmen liegen.
Häufige Fragen
Darf ich interne Dokumente in das öffentliche ChatGPT hochladen?
Für vertrauliche oder personenbezogene Inhalte ist davon abzuraten, solange kein Auftragsverarbeitungsvertrag besteht und der Datenstandort sowie die Trainingsnutzung nicht geklärt sind. Viele Unternehmen untersagen das Hochladen interner Dokumente in öffentliche Chatbots daher per Richtlinie.
Ist ChatGPT Enterprise DSGVO-konform?
Enterprise- und Team-Tarife bieten gegenüber der kostenlosen Version mehr Kontrolle, etwa den Ausschluss der Trainingsnutzung und vertragliche Zusagen. Ob der Einsatz vollständig DSGVO-konform ist, hängt aber vom konkreten Datenstandort, vom Auftragsverarbeitungsvertrag und vom Anwendungsfall ab und sollte im Einzelfall geprüft werden.
Werden meine Eingaben zum Training der KI genutzt?
In kostenlosen Consumer-Versionen ist das je nach Einstellung möglich. In B2B-Tarifen lässt sich die Trainingsnutzung in der Regel ausschließen. Diese Zusage sollte vertraglich festgehalten und nicht nur in den Einstellungen aktiviert sein.
Is it safe to upload internal documents to ChatGPT?
Die Frage wird oft auf Englisch gesucht und hat dieselbe Antwort: Es kommt auf Tarif, Datenstandort und Vertragslage an. Ohne Auftragsverarbeitungsvertrag, ohne geklärten Verarbeitungsort und ohne vertraglich ausgeschlossene Trainingsnutzung ist das Hochladen vertraulicher Unterlagen nicht vertretbar. Mit diesen drei Punkten wird daraus eine Einzelfallprüfung, keine pauschale Freigabe.
Was passiert mit Dokumenten, die ich bereits hochgeladen habe?
Prüfen Sie zuerst, welcher Tarif und welche Einstellung zum Zeitpunkt des Uploads galten, und ob die Inhalte personenbezogene Daten oder Geschäftsgeheimnisse enthielten. Löschen Sie die betroffenen Konversationen und dokumentieren Sie den Vorgang. Bei personenbezogenen Daten gehört der Fall zum Datenschutzbeauftragten, der beurteilt, ob eine meldepflichtige Verletzung vorliegt.
Reicht eine interne Richtlinie als Schutz?
Eine Richtlinie ist notwendig, aber allein wirkungslos, wenn es keinen freigegebenen Weg gibt. Wer eine Antwort braucht und kein zugelassenes Werkzeug hat, weicht aus. Wirksam wird die Richtlinie erst in Kombination mit einer bereitgestellten Alternative, die die tatsächliche Aufgabe löst.
Dürfen wir ChatGPT wenigstens zum Übersetzen technischer Texte nutzen?
Das hängt allein am Inhalt, nicht an der Aufgabe. Eine Übersetzung ist datenschutzrechtlich keine harmlosere Verarbeitung als eine Zusammenfassung, weil der Text in beiden Fällen vollständig übermittelt wird. Bei öffentlich verfügbaren Texten ist das unkritisch. Bei einer internen Betriebsanleitung oder einer Spezifikation gelten dieselben Fragen nach Vertrag, Verarbeitungsort und Trainingsausschluss wie bei jeder anderen Nutzung.
Was ist die Alternative zu ChatGPT für interne Dokumente?
Dedizierte B2B-Systeme verarbeiten Ihre Dokumente in einem EU-Rechenzentrum, schließen die Trainingsnutzung vertraglich aus und belegen jede Antwort mit Quelle. Sie antworten ausschließlich aus Ihren Unterlagen statt aus allgemeinem Modellwissen. Mehr dazu im Beitrag zu KI mit Quellenangabe.
KI-Assistenten für die Konstruktion vergleichen
Vier Kategorien von Werkzeugen stehen zur Auswahl, und sie lösen verschiedene Probleme. Welche Kriterien im Engineering wirklich entscheiden.

Normensuche im Maschinenbau: Der Praxis-Guide 2026
Konstrukteure verlieren Stunden mit der Suche nach Normeninhalten. Wo heute gesucht wird, was das wirklich kostet und wie KI die Normensuche beschleunigt.

On-Prem oder EU-Cloud für KI auf Konstruktionsdaten
On-Premise gilt als die sichere Variante. Tatsächlich verlagert der Betrieb im eigenen Haus vor allem die Verantwortung. Woran die Entscheidung wirklich hängt und welche Anforderung On-Prem tatsächlich erzwingt.
