ทันเอไอ

Global AI & tech news, in your language · every story source-checked

🌐Follow
← Back to news
LINE Facebook X
Tools & Open SourceVerified

KI-Unternehmen nutzen „Zerstörung echter Bücher“ zum Scannen von Trainingsdaten, um Inhaltskontamination zu vermeiden

Ein Untersuchungsbericht zeigt, dass mehrere KI-Unternehmen echte Bücher auseinandernehmen und Seiten scannen, um sie in Systeme einzuspeisen und eine Verschlechterung der KI durch das Lernen von Fake-Inhalten zu verhindern.

📅 23. Aug. 2026, 00:35
KI-Unternehmen nutzen „Zerstörung echter Bücher“ zum Scannen von Trainingsdaten, um Inhaltskontamination zu vermeiden

Die Welt der künstlichen Intelligenz steht vor neuen ethischen Fragen, nachdem Berichte bestätigten, dass mehrere KI-Unternehmen das sogenannte destruktive Scannen (Destructive Scanning) anwenden. Dabei werden die Buchrücken abgeschnitten und die Seiten getrennt, um sie in Hochgeschwindigkeitsscanner einzugeben, wodurch die Bücher im Prozess zerstört werden.

Der Grund für diese Massenzerstörung von Büchern liegt in der Nachfrage nach hochwertigen Trainingsdaten, die vor 2022 von Menschen verfasst wurden und noch nicht durch KI-generierte Inhalte kontaminiert sind. Dies soll dem „Model Collapse“ vorbeugen – einem Zustand, in dem die Leistung von KI nachlässt, wenn sie aus Daten lernt, die von anderen KIs generiert wurden.

Dieses Thema wurde durch eine Untersuchung von *404 Media* aufgedeckt, bei der ein AirTag in einem gebrauchten Buch versteckt wurde. Die Spur führte zu einer Einrichtung von Amazon in Las Vegas, wo Bücher zum Scannen zerstört werden. Darüber hinaus enthüllten Dokumente aus einer Klage gegen *Anthropic* das „Project Panama“, das ähnliche Bemühungen widerspiegelt, sowie rechtliche Debatten darüber, ob der Kauf und die Zerstörung von Büchern zum Scannen unter die faire Nutzung (Fair Use) fallen könnte.

Aufgrund dieser Situation haben Verbraucherschutzgruppen und öffentliche Organisationen begonnen, Maßnahmen zu ergreifen und die US-Handelskommission (FTC) aufgefordert, die Zerstörung von Kulturressourcen und die Monopolisierung von Daten in dieser Branche zu untersuchen.

Why it matters
Es spiegelt den enormen Bedarf globaler KI-Unternehmen an Rohdaten wider, der sich auf das kulturelle Erbe und geistiges Eigentum auswirkt und einen wichtigen Maßstab für künftige Urheberrechtsgesetze und die Datennutzung darstellen könnte.
#AI#ลิขสิทธิ์#Model Collapse#จริยธรรม AI
Sources (rewritten & summarized from): Hacker News · twit.tv · facebook.com · emeraldbook.org · facebook.com · forbes.com

Comments

Loading comments…

No sign-up needed · comments are auto-filtered and moderated