ทันเอไอ

Global AI & tech news, in your language · every story source-checked

🌐Follow
← Back to news
LINE Facebook X
Ferramentas/Código AbertoVerified

Empresas de IA usam “destruição de livros reais” para escanear dados de treinamento e evitar conteúdo contaminado

Mídia investigativa revela que várias empresas de IA optam por cortar lombadas e separar páginas de livros reais para digitalização, evitando a degradação dos modelos por dados sintéticos.

📅 23 de ago. de 2026, 00:35
Empresas de IA usam “destruição de livros reais” para escanear dados de treinamento e evitar conteúdo contaminado

O setor de inteligência artificial enfrenta um novo dilema ético após relatórios confirmarem que várias empresas de IA têm recorrido ao escaneamento destrutivo (Destructive Scanning). O método consiste em cortar a lombada e separar as páginas de livros para alimentá-los em scanners de alta velocidade, destruindo os exemplares no processo.

O motivo por trás da destruição em massa de livros é a necessidade de dados de treinamento de alta qualidade, genuinamente escritos por humanos antes de 2022 e livres de contaminação por conteúdos gerados por IA. Isso visa prevenir o fenômeno de Model Collapse (colapso do modelo), em que a eficácia da IA diminui ao aprender com dados gerados por outras IAs.

O assunto veio à tona após uma investigação do veículo *404 Media*, que escondeu um AirTag em um livro usado e rastreou seu destino até uma instalação da Amazon em Las Vegas, onde livros eram destruídos para escaneamento. Além disso, documentos de um processo contra a *Anthropic* revelaram o "Project Panama", refletindo esforços semelhantes e gerando debates legais sobre se comprar e destruir livros para escaneamento se enquadra no uso justo (Fair Use).

Diante da situação, grupos de defesa dos direitos do consumidor e organizações públicas começaram a agir, acionando a Comissão Federal de Comércio dos EUA (FTC) para investigar a destruição de recursos culturais e o monopólio de dados na indústria.

Why it matters
Revela os bastidores da enorme demanda por dados brutos por parte de empresas globais de IA, impactando o patrimônio cultural e a propriedade intelectual, o que pode estabelecer um precedente importante para as leis de direitos autorais e uso de dados no futuro.
#AI#ลิขสิทธิ์#Model Collapse#จริยธรรม AI
Sources (rewritten & summarized from): Hacker News · twit.tv · facebook.com · emeraldbook.org · facebook.com · forbes.com

Comments

Loading comments…

No sign-up needed · comments are auto-filtered and moderated