Datenschutz-Compliance für AI-Coding-Tools:
die Fragen, die Sie vor dem Kauf stellen sollten
Ordnen Sie Ihre Daten zunächst in 3 Klassen – Quellcode, Secrets, Kundendaten – und stellen Sie dem Anbieter dann 5 Fragen, die in den Vertrag gehören. Nur 2 davon können Sie selbst überprüfen; der Rest beruht auf schriftlichen Bedingungen, und eine mündliche Zusicherung ist bei einem Audit wertlos.
Aktualisiert 2026-09-02
Vier Zahlen, die Sie zuerst klären sollten
Daten klassifizieren
Der Quellcode selbst, die darin eingebetteten Secrets und alle darin enthaltenen Kundendaten – drei sehr unterschiedliche Schutzbedarfe und Gegenmaßnahmen.
Die in den Vertrag gehören
Wo die Daten liegen, wie lange sie gespeichert werden, ob damit etwas trainiert wird, wer sie lesen kann und wie schnell Sie nach einem Vorfall informiert werden. Jede fehlende Antwort ist eine Lücke beim Audit.
Die Sie selbst durchführen können
Welchen Endpunkt Anfragen tatsächlich erreichen (Client-Konfiguration oder Paketmitschnitt) und ob der Transport durchgehend per TLS erfolgt. Alles andere beruht auf Vertragsbedingungen.
Schriftliche Grundlage
Nur etwas Schriftliches lässt sich Rechtsabteilung und Audit vorlegen. Was ein Vertriebsmitarbeiter gesagt hat oder was in einem Community-Thread behauptet wird, ist keine Grundlage.
Compliance bei AI-Coding ist nicht gewöhnliche SaaS-Compliance
Bei gewöhnlicher SaaS laden Sie Geschäftsdaten hoch. Bei AI-Coding laden Sie den Quellcode selbst hoch, oft ganze Dateien und Verzeichnisstrukturen. Schlimmer noch: Quellcode trägt häufig weitere Dinge mit sich – fest codierte Schlüssel, Verbindungsstrings, echte Kundendatensätze aus Tests, interne Hostnamen. Sobald diese mit dem Kontext nach außen gelangen, geht es nicht mehr nur darum, dass „jemand unseren Code gesehen hat“. Der erste Schritt besteht also nicht darin, den Anbieter zu befragen, sondern herauszufinden, was tatsächlich in Ihrem Repository steckt.
Die fünf Punkte, die Sie vor dem Kauf klären sollten
① In welcher Rechtsordnung die Daten liegen und ob sie Grenzen überschreiten. ② Wie lange Anfragen und Antworten aufbewahrt werden und ob sich das abschalten lässt. ③ Ob etwas davon in Modelltraining oder Evaluierung einfließt. ④ Wer beim Anbieter sie lesen kann und unter welchen Bedingungen. ⑤ Wie schnell und an wen Sie nach einem Vorfall informiert werden. Lassen Sie sich alle fünf Punkte schriftlich bestätigen – Nutzungsbedingungen, ein Auftragsverarbeitungszusatz oder der Vertrag selbst genügen, solange es ein Dokument ist, das Sie der Rechtsabteilung vorlegen können. Alles, was nur mündlich beantwortet wurde, sollten Sie als Lücke behandeln.
Drei Schritte in dieser Reihenfolge
Zuerst nach innen schauen: Scannen Sie die Repositories, die Sie anbinden möchten, und entfernen Sie fest codierte Secrets, echte Kundendatensätze und interne Hostnamen. Der Nutzen hängt nicht davon ab, welchen Anbieter Sie wählen, und es ist der einzige Teil der Kette, der vollständig in Ihrer Hand liegt.
Dann nach außen schauen: Senden Sie die fünf Fragen an Ihre Kandidaten und verlangen Sie schriftliche Antworten. Prüfen Sie parallel die zwei Dinge, die Sie selbst verifizieren können – welchen Endpunkt Anfragen tatsächlich erreichen und ob der Transport durchgehend verschlüsselt ist.
Zum Schluss schriftlich festhalten: Aufbewahrungsdauer, Nutzung für Training und Meldefrist gehören in den Vertrag oder den Auftragsverarbeitungsvertrag. Wenn ein Anbieter nur „in der Regel nicht“ anbieten kann, bewerten Sie das Risiko so, als täte er es.
Was Sie überprüfen können und was auf Bedingungen beruht
Das können Sie überprüfen
① Worauf der Endpunkt in Ihrer Client-Konfiguration zeigt (Umgebungsvariablen, Konfigurationsdateien oder ein Paketmitschnitt verraten es). ② Ob der Transport durchgängig per TLS erfolgt. ③ Ob das in der Antwort zurückgegebene Modell dasjenige ist, das Sie angefragt haben. ④ Ob die Abrechnungsgrundlage mit der Nutzung übereinstimmt. Das sind technische Fakten – ein Test klärt sie.
Hier gelten allein die Vertragsbedingungen
① In welcher Rechtsordnung die Daten physisch liegen. ② Wie lange sie tatsächlich aufbewahrt und wie sie gelöscht werden. ③ Ob sie in einen Trainings- oder Evaluierungsdatensatz gelangen. ④ Wie der interne Zugriff aufgeteilt ist. ⑤ An wen sie in Unterauftragsverarbeitung weitergegeben werden. Nichts davon lässt sich auf der Client-Seite beobachten – behandeln Sie diese Punkte als Vertragsfragen, statt zu hoffen, sie messen zu können.
Direktkauf vs. Kauf über einen Reseller oder Gateway
Den Dienst des Herstellers direkt kaufen
Die kürzeste Kette von Bedingungen und ein eindeutiger Vertragspartner; Enterprise-Tarife bieten in der Regel einen AVV (DPA), Audit-Logs und Steuerung der Aufbewahrung. Der Preis dafür ist die Zugangshürde – Region, Seats, Mindestvertragswerte – sowie Abrechnungs- und Rechnungsformate, die möglicherweise nicht zu dem passen, was Ihre Finanzabteilung benötigt.
Über einen Reseller oder Ihr eigenes Gateway
Damit lösen Sie Zugang und Abrechnung, zahlen aber mit einem zusätzlichen Hop: Ihre Anfragen laufen über einen Dritten. Die Bewertung lautet deshalb: „Was macht diese Schicht, was speichert sie, und wo ist das schriftlich festgehalten?“ Beachten Sie, dass ein Reseller nicht der offizielle Kanal des Herstellers ist und nicht im Namen des Herstellers Zusagen machen kann – die Bedingungen des Anbieters gelten weiterhin für Sie.
Fragen so formulieren, dass sie beantwortbar sind
Fragen Sie nicht „Sind Sie sicher?“. Stellen Sie Fragen, die sich mit Ja oder Nein beantworten lassen und in einen Vertrag aufgenommen werden können: „Wie viele Tage werden Anfrage- und Antwortinhalte aufbewahrt?“ „Welche Rollen können in diesem Zeitraum darauf zugreifen?“ „Werden sie in irgendeiner Form für Modelltraining oder Evaluierung verwendet?“ „In welchen Rechtsordnungen liegen die Daten?“ „Wie lang ist die Meldefrist in Stunden nach einem Sicherheitsvorfall?“ Archivieren Sie die Antworten mit Datum. Sollte sich die Haltung des Herstellers später ändern, haben Sie zumindest eine Vergleichsbasis.
Zu QCode – nur das, was sich überprüfen lässt
Wir sind eine Reseller-Plattform für mehrere Modell-APIs: Ihre Anfragen werden letztlich von den offiziellen APIs von Anthropic, OpenAI, Google und anderen bedient. Wir trainieren keine eigenen Modelle und wir trainieren nicht mit Ihren Anfragen. Die Abrechnung folgt dem Usage-Block in der Antwort, und die Rechnung lässt sich Zeile für Zeile abgleichen. Der Sicherheitshinweis auf unserer Seite /enterprise hält schriftlich fest, dass wir weder Nutzercode noch Gesprächsinhalte oder Geschäftsdaten speichern, dass Anfragen transparent an die Upstream-API weitergeleitet werden und dass dazwischen keine Daten zwischengespeichert werden – der „Cache-Vorteil“ auf der Preisseite bezieht sich auf den Prompt-Caching-Rabatt der Upstream-Anbieter selbst, nicht auf Speicherung auf unserer Seite. Das ist eine schriftliche Aussage, die Sie an Ihre Rechtsabteilung weitergeben können. Wir sind für keinen Upstream-Anbieter ein offizieller Kanal und können nicht in deren Namen Zusagen machen – deren Nutzungsbedingungen gelten weiterhin für Sie. Regelungen zu Aufbewahrung und Zugriff richten sich nach unseren Nutzungsbedingungen; wenn der Enterprise-Einkauf etwas Schriftliches benötigt, sprechen Sie es bitte in den Vertragsverhandlungen an.
FAQ
Wird mein Quellcode zum Training eines Modells verwendet?
Das hängt vom Weg ab, den Ihr Datenverkehr nimmt, und von den damit verbundenen Bedingungen. Diese Frage kann kein Test beantworten – holen Sie von jeder Partei in der Kette eine schriftliche Aussage ein. Für unseren Teil gilt: Wir trainieren keine eigenen Modelle und wir trainieren nicht mit Ihren Anfragen; die Richtlinie jedes Upstream-Anbieters richtet sich nach dessen eigenen Bedingungen.
Wie bestätige ich, dass Anfragen wirklich den Endpunkt erreichen, den ich annehme?
Lesen Sie die Endpunkt-Variable in Ihrer Client-Konfiguration aus und zeichnen Sie den Datenverkehr bei Bedarf einmal mit. Das ist eine der wenigen Tatsachen, die Sie selbst klären können. Wenn das zurückgemeldete Modell ein Präfix oder einen Anbieternamen trägt, der nicht in Ihrer Anfrage stand, sitzt dazwischen eine Umschreibungsschicht, nach der Sie fragen sollten.
Was ist das Nützlichste, das ich als Erstes tun kann?
Scannen Sie die Repositories, die Sie anbinden möchten, und entfernen Sie hartcodierte Secrets, echte Kundendaten und interne Hostnamen. Der Nutzen ist unabhängig von der Anbieterwahl, und es ist das einzige Glied der Kette, das vollständig in Ihrer Hand liegt.
Der Anbieter sagt: „Wir speichern keine Daten.“ Reicht das?
Nein. Holen Sie schriftliche Bedingungen ein, die Aufbewahrungsdauer, Entsorgung der Daten nach Ablauf und den jeweiligen Geltungsbereich festlegen. Eine mündliche Zusicherung ist bei einem Audit keine Grundlage, und „in der Regel nicht“ sollte risikobewertet werden, als würde der Anbieter speichern.
Kann ein Reseller im Namen des Herstellers Compliance-Zusagen geben?
Nein. Ein Reseller kann nur zusagen, was seine eigene Schicht tut und speichert. Die Upstream-Bedingungen gelten weiterhin für den Endnutzer, und wer behauptet, „im Namen des Herstellers zu Zusagen befugt“ zu sein, dem sollten Sie das entsprechende Dokument abverlangen.
Wie verankern wir das im Team, statt es bei einem Richtliniendokument zu belassen?
Drei konkrete Maßnahmen: ① Secret-Scanning in die CI aufnehmen, damit keine neuen hartcodierten Zugangsdaten eingecheckt werden können; ② pro Person und pro Pipeline einen eigenen API-Key ausstellen, damit sich ein Vorfall auf eine Quelle zurückführen lässt; ③ Aufbewahrungsdauer und Meldefrist in den Kaufvertrag aufnehmen, statt sie in einem E-Mail-Verlauf zu belassen.
Quellen
Diese Seite ist eine Fragenliste aus Käufersicht und gibt keine spezifischen Zahlen einzelner Anbieter wieder – Aufbewahrung, Trainingsnutzung und Zugriffskontrolle richten sich bei jedem Anbieter nach dessen eigenen Nutzungsbedingungen und Zusatzvereinbarungen zur Datenverarbeitung und ändern sich im Lauf der Zeit. Aussagen über QCode selbst (Reseller-Positionierung, keine eigenen Modelle, Abrechnungsgrundlage) stammen aus unseren Nutzungsbedingungen und unserer Preisseite (geprüft am 2026-09-02).
Bereinigen Sie das Repository, bevor Sie Anbieter in die engere Wahl nehmen
Secret-Scanning und personenbezogene Keys können Sie umsetzen, ohne auf jemanden zu warten.
Weiterführende Artikel
Wie Sie beurteilen, ob sich ein AI-API-Relay lohnt
Vier Selbsttests: Multiplikator-Umrechnung, Cache-Treffer, zurückgemeldetes Modell und Abgleich der Nutzung.
Eine AI-Coding-API für ein Team kaufen
Gemeinsames Kontingent, Limits für Parallelität und Zuordnung der Nutzung über Sub-Keys.
MCP-Sicherheit und Sandboxing
Berechtigungsgrenzen und Isolation, wenn Sie einem Agenten Tools öffnen.
Diese Seite bietet einen Selbstbewertungsrahmen für Käufer. Sie stellt keine Rechtsberatung dar und gibt die Bedingungen keines Anbieters wieder. Compliance-Beurteilungen sollten sich auf die schriftlichen Bedingungen der jeweiligen Partei, die vor Ort geltenden Vorschriften und Ihre eigene Rechtsberatung stützen.