Urheberrecht und generative KI: Nachweis der Herkunft von Datensätzen mit V-PROOF

Urheberrecht und generative KI: Nachweis der Herkunft von Datensätzen mit V-PROOF, V-PROOF Journal
KI-Regulierung & Urheberrecht

Urheberrecht und generative KI: Der Nachweis der Herkunft als rechtliche Verteidigung

Die EU-Richtlinie 2019/790 und Art. 53 des EU-KI-Gesetzes stimmen in einem Punkt überein: Ohne kryptografische Rückverfolgbarkeit der Trainingsdaten ist keine rechtliche Verteidigung möglich.

Veröffentlicht im Juli 2026 Lesezeit: 8 Min. EU-KI-Gesetz Copyright EU GenAI Datensatz

Wichtigste Erkenntnisse

  • Mehr als 30 laufende Klagen gegen LLM-Modelle in den USA und Europa (NYT gegen OpenAI, Getty gegen Stability AI, Universal Music gegen Anthropic). Der gemeinsame Kernpunkt: Welche Daten wurden verwendet und mit welcher Genehmigung?
  • Die EU-Richtlinie 2019/790, Art. 4, lässt Ausnahmen für Text Mining zu, erkennt jedoch das Recht des Rechteinhabers an, sich die Nutzung „ausdrücklich vorzubehalten“, wodurch eine rückwirkende rechtliche Verpflichtung für bereits trainierte Modelle entsteht.
  • Gemäß Art. 53 Abs. 1 Buchstabe d des EU-KI-Gesetzes sind Anbieter von allgemeinen KI-Modellen verpflichtet, eine „ausreichend detaillierte Zusammenfassung“ der Trainingsdaten unter Angabe der Quellen und Lizenzen zu veröffentlichen.
  • Ohne eine kryptografische „ hash “ des Datensatzes ab dem Zeitpunkt der Erfassung ist es technisch unmöglich nachzuweisen, welche genaue Version der Daten wann verwendet wurde und ob das Opt-out des Betroffenen bereits registriert worden war.
  • V-PROOF generiert zum Zeitpunkt der Datenaufnahme einen SHA-256-Hashwert des gesamten Datensatzes, der vor dem ersten Trainingszyklus in der L2-Datenbank versiegelt wird, wodurch ein Nachweis vor dem Prozess und nicht erst danach erstellt wird.

Zwei Vorschriften, ein und dasselbe Problem der Beweisführung

Das Training generativer KI-Modelle steht auf beiden Seiten des Atlantiks unter rechtlicher Beobachtung. In Europa stützt sich der Rechtsrahmen auf zwei Säulen, die sich gegenseitig verstärken.

EU-Richtlinie 2019/790 · Urheberrecht
Text- und Datenauswertung: Ausnahme unter bestimmten Voraussetzungen
Art. 3 sieht eine Ausnahme für den Bergbau im Forschungsbereich vor. Art. 4 erweitert die Ausnahme auf kommerzielle Nutzungen, erkennt jedoch das Recht des Urhebers an, seine Werke mittels eines maschinenlesbaren Opt-out-Mechanismus auszuschließen.
Praktische Auswirkung Wenn ein Inhaber vor dem Training eine Opt-out-Erklärung veröffentlicht hat und das System nicht nachweisen kann, wann die Daten verarbeitet wurden, gilt die Ausnahme nicht.
EU-KI-Gesetz · Art. 53 · GPAI
GPAI-Anbieter: Transparenzpflichten in Bezug auf Daten
Art. 53 Abs. 1 Buchstabe b: Technische Dokumentation der Trainingsdatensätze. Art. 53 Abs. 1 Buchstabe c: Aktive Maßnahmen zur Einhaltung des Urheberrechts. Art. 53 Abs. 1 Buchstabe d: Veröffentlichte Übersicht über Quellen und Lizenzen.
Frist Gilt für GPAI-Modelle ab August 2025. Geldbußen von bis zu 15 Mio. € oder 3 % des Gesamtumsatzes.
Erwägungsgrund 107 · EU-KI-Gesetz
Die Unterlagen müssen überprüfbar sein
Die Verordnung verlangt nicht nur eine Konformitätserklärung, sondern auch technische Unterlagen, anhand derer das IA-Amt die Einhaltung der Vorschriften überprüfen kann. Eine Behauptung ohne technische Nachweise hat für einen Prüfer keinen Wert.
V-PROOF-Unterscheidungsmerkmal Die Nachweise unter hash + timestamp können von Dritten ohne Zugriff auf interne Systeme überprüft werden.
Aktive Fälle 2024–2026
Die Rechtsprechung schreitet immer schneller voran
NYT gegen OpenAI (NY, 2023), Getty gegen Stability AI (Großbritannien/USA, 2023), Sammelklagen von Autoren gegen Meta, Anthropic und Google. Der sich abzeichnende Standard: Ohne nachweisbaren Beweis für den Datensatz gilt keine Unschuldsvermutung.
Trend Die Gerichte verlangen zunehmend technische Nachweise zum Datensatz und nicht mehr nur Nutzungsrichtlinien.

Warum interne Protokolle nicht ausreichen

Die übliche Reaktion von Organisationen auf ein Audit besteht darin, Systemprotokolle, Verträge mit Datenanbietern und interne Erklärungen zur Einhaltung der Vorschriften vorzulegen. Keines dieser Elemente hält einer strengen kontradiktorischen Prüfung stand, und zwar aus drei wesentlichen Gründen.

Das Problem der Wandelbarkeit

Die internen Protokolle können vom Systembetreiber geändert werden. Sie verfügen über keinen externen Zeitstempel. Sie erzeugen keinen überprüfbaren „ hash “. Im Falle eines Rechtsstreits kann die Gegenpartei deren Integrität anzweifeln, ohne dass es technische Beweise gibt, die dies widerlegen.

Die zweite Lücke ist subtiler: der Zeitpunkt der Erfassung. Ein am 15. März von einem Rechteinhaber veröffentlichter Opt-out-Ausschluss ist rechtswirksam, wenn das Modell am 20. März mit dem Training begonnen hat. Kann das System jedoch nicht genau nachweisen, wann es die jeweilige Datenverarbeitung durchgeführt hat, gilt der Ausschluss standardmäßig.

Die dritte Lücke betrifft die genaue Version des Datensatzes. Datensätze entwickeln sich weiter: Sie werden bereinigt, gefiltert und um Quellen ergänzt. Ohne eine versionsbezogene „ hash “ lässt sich nicht nachweisen, dass das Modell mit der bereinigten Version nach dem Filter trainiert wurde und nicht mit der vorherigen Version, die geschützte Inhalte enthielt.

Die Frage des Wirtschaftsprüfers

„Können Sie nachweisen, welche genaue Version des Datensatzes verwendet wurde, zu welchem genauen Zeitpunkt die Verarbeitung erfolgte und dass zu diesem Zeitpunkt keine Opt-out-Erklärungen der betroffenen Personen vorlagen?“ · Ist die Antwort nicht durch einen unabhängigen Dritten überprüfbar, bleibt das rechtliche Risiko bestehen.

Herkunftsnachweis-Pipeline, V-PROOF

V-PROOF erstellt zum Zeitpunkt der Datenaufnahme, noch vor Beginn jeglicher Trainingsprozesse, einen kryptografischen Nachweis des Datensatzes. Die Kette ist unveränderlich und kann von Dritten überprüft werden, ohne dass ein Zugriff auf interne Systeme erforderlich ist.

Technische Darstellung
Pipeline zur Datensatz-Fingerabdruckerkennung
📂
Datensatz
training_v2.4
12,8 GB · 4,2 Mio. Dokumente
AUFNAHME
⚙️
SHA-256
a3f8c...
HASH
🔗
IPFS-CID
QmX9f2...
IPFS
⛓️
L2-Basis
Block #,
TIMESTAMP
◈
V-SEAL
Überprüfbar
ohne Zwischenhändler
BELEGE
< 200ms
hash -Zeit pro Datei
SHA-256
Kryptografischer Standardalgorithmus des NIST
L2 Ethereum
Öffentliches Netzwerk · Überprüfung ohne Zugriff
∞
Beständigkeit, unveränderlich nach dem Versiegeln

Das Ergebnis ist ein Datensatz-V-SEAL : ein Datensatz, der die genaue Version des Datensatzes, den vollständigen SHA-256- hash , den IPFS-CID, die Blocknummer in Base L2 und den genauen timestamp des Vorgangs enthält. Dieser Datensatz kann von jedem Prüfer oder Gericht überprüft werden, ohne dass ein Zugriff auf die internen Systeme der Organisation erforderlich ist.

Betroffene Artikel, EU-KI-Gesetz und Urheberrechtsrichtlinie

Artikel Verpflichtung V-PROOF-Nachweis Module
EU-Richtlinie 2019/790 · Urheberrecht im digitalen Binnenmarkt
§ 3 Text Mining für Forschungszwecke: Nachweis, dass die Nutzung unter die Ausnahme fällt ✓ Hash des Datensatzes + Klassifizierung der Quelle bei der Erfassung SHA-256 IPFS
§ 4 Gewerbliche Nutzung: Nachweis, dass zum Zeitpunkt der Verarbeitung kein Opt-out vorlag ✓ Der Zeitstempel dokumentiert den genauen Zeitpunkt – entweder vor oder nach dem Ausschluss L2-Basis V-SEAL
EU-KI-Gesetz · GPAI-Modelle (gültig ab August 2025)
§ 53 Abs. 1 Buchstabe b Technische Dokumentation zu den verwendeten Trainingsdatensätzen ✓ Vollständiger Eintrag: Version, Quellen, hash, timestamp Governance IPFS
§ 53 Abs. 1 Buchstabe c Maßnahmen zur Einhaltung des Urheberrechts während der Schulung ~ V-PROOF dokumentiert den Vorgang; die Ausschlussrichtlinie wird vom Betreiber festgelegt Governance
§ 53 Abs. 1 Buchstabe d Veröffentlichung einer ausreichend detaillierten Zusammenfassung der Trainingsdaten (Quellen + Lizenzen) ✓ Nachprüfbarer Export des Datensatzregisters mit Lizenzmetadaten V-SEAL API
§ 55 Abs. 1 Buchstabe a GPAI-Modelle für systemische Risiken: Risikobewertung unter Einbeziehung eines Datensatzes ✓ Vollständige Rückverfolgbarkeit für die Prüfung durch das EU-IA-Büro L2-Basis V-SEAL
Vorteile von V-PROOF

Warum V-PROOF die richtige technische Lösung ist

Besondere Vorteile des kryptografischen Ansatzes von V-PROOF gegenüber deklarativen Ansätzen zur Einhaltung von Vorschriften.

01
Beweismittel, die vor dem Verfahren vorliegen, nicht danach
Der SHA-256- hash s des Datensatzes wird zum Zeitpunkt der Datenaufnahme generiert, also vor dem ersten Trainingszyklus. Es handelt sich dabei nicht um eine nachträgliche Konformitätserklärung, sondern um einen technischen Nachweis, der dem zu zertifizierenden Prozess vorausgeht. Dadurch kehrt sich die Beweislast im Rechtsstreit um.
EU-KI-Gesetz Art. 53 Abs. 1 Buchst. b · höchster Beweiswert
02
Durch den Konsens eines öffentlichen Netzwerks garantierte Unveränderlichkeit
Die Unveränderlichkeit hängt weder von der Integrität des Betreibers noch von V-PROOF ab: Sie wird durch den verteilten Konsens der Ethereum-L2-Basis gewährleistet. Kein Akteur, auch nicht die ausstellende Organisation selbst, kann einen bestätigten Block in der Blockchain ändern.
Ethereum L2-Basis · verteilter Konsens · nicht manipulierbar
03
Von jedem Prüfer ohne internen Zugriff überprüfbar
Jeder Wirtschaftsprüfer, jedes Gericht oder jede Aufsichtsbehörde kann die Existenz der Website hash und der Domain timestamp direkt auf basescan.org überprüfen, ohne dass ein Zugriff auf die Systeme der Organisation oder die Server von V-PROOF erforderlich ist. Öffentliche und dauerhafte Überprüfbarkeit.
basescan.org · Überprüfung ohne Zwischenhändler · dauerhaft
04
SHA-256: NIST-Standard, der in mehr als 40 Rechtsordnungen anerkannt ist
SHA-256 ist der kryptografische Hash-Algorithmus gemäß dem Standard NIST SP 800-107, der standardmäßig in Gerichtsverfahren in den USA, der EU, Großbritannien und den meisten internationalen Rahmenwerken für Cybersicherheit verwendet wird. Es besteht kein Risiko, dass der Algorithmus vor Gericht angefochten wird.
NIST SP 800-107 · globaler Standard
05
IPFS: Permanente Verteilung der gehashten Daten
Die IPFS-CID des Datensatzes ist eine deterministische, aus dem Inhalt abgeleitete Adresse: Derselbe Datensatz erzeugt immer dieselbe CID. Diese Eigenschaft der inhaltsbasierten Adressierung ermöglicht es, zu überprüfen, ob die Daten verändert wurden, ohne dass der ursprüngliche Datensatz an einem zentralen Ort gespeichert werden muss.
IPFS-Inhaltsadressierung · Verteilung ohne zentralen Server
06
Nachweisbarer Export für das Amt für geistiges Eigentum der EU
Der Datensatz- V-SEAL generiert einen exportierbaren Datensatz, der die Version des Datensatzes, den SHA-256- hash , den IPFS-CID, die Blocknummer und den timestamp enthält. Dieses Format entspricht genau den Anforderungen an eine „ausreichend detaillierte Zusammenfassung“ gemäß Art. 53 Abs. 1 Buchstabe d des EU-KI-Gesetzes und kann vom EU-KI-Büro ohne Zwischenstellen überprüft werden.
EU-KI-Gesetz Art. 53 Abs. 1 Buchstabe d · EU-KI-Amt · Exportprüfung
Stichwörter
EU-KI-Gesetz EU-Urheberrechtsgesetz 2019/790 GenAI Datensatz-Rückverfolgbarkeit Geistiges Eigentum KI SHA-256 IPFS L2-Datenbank Digitale Beweise GPAI KI-Governance
V-PROOF-Protokoll

Verfügt Ihr GPAI-Modell über einen Herkunftsnachweis für den Datensatz?

Die strategische V-PROOF-Diagnose bewertet Ihr rechtliches Risiko im Hinblick auf Art. 53 des EU-KI-Gesetzes und die Urheberrechtsrichtlinie und legt innerhalb von vier Wochen einen Plan zur Implementierung kryptografischer Nachweise fest.

Diagnose anfordern →

© 2026 V-PROOF Protocol · Journal · vproofprotocol.com

Dieser Artikel dient ausschließlich zu Informationszwecken und stellt keine Rechtsberatung dar. Wenden Sie sich bezüglich der konkreten Anwendung auf Ihre Organisation bitte an Ihre Rechtsabteilung.

Zurück
Zurück

V-PROOF-Protokoll: Rückverfolgbarkeit des Software-Lebenszyklus im Zeitalter des EU-Cyber-Resilience-Gesetzes

Weiter
Weiter

FFUUSS · OTS GROUP: KI-Compliance gemäß fünf gleichzeitigen ISO-Zertifizierungen, ohne eine einzige Nichtkonformität