25:43
youtube.com 28/07/2026 SRT AI Coder TODAY

A Anthropic foi pega queimando livros para treinar IA...

A Anthropic foi pega queimando livros para treinar inteligência artificial.

Tecnologia Pirataria AI Anthropic

Conteudo

TLDR;

A Anthropic cortou as lombadas dos livros físicos, escaneou as páginas em scanners industriais de alta velocidade e incinerou os restos para obter dados limpos de IA. Eles destruíram os livros para adquirir milhões de títulos raros e anteriores a 2020, que não continham slop de IA, após tentativas de pirataria e licenciamento falharem. A empresa age de forma hipócrita ao usar dados roubados e propriedade intelectual alheia para treinar Claude, enquanto proíbe a destilação de seus próprios modelos por concorrentes.

Resumo

Empresas de IA como a Anthropic são acusadas de hipocrisia ao treinar seus modelos com conhecimento humano roubado, enquanto impedem que outros distillm seus sistemas. Segundo o relato, a empresa pirateou milhões de livros de bibliotecas ilegais como o Libgen para evitar custos e burocracia, e depois comprou obras físicas em larga escala, cortando lombadas, escaneando páginas em scanners industriais e incinerando os restos — inclusive edições únicas anteriores a 2020, livres de conteúdo gerado por IA. Esses dados estruturados foram usados no projeto Panama para treinar o Claude, criando uma biblioteca privada inacessível ao público. A empresa pagou um acordo de US$ 1,5 bilhão por pirataria, valor irrelevante diante de sua avaliação trilionária, mas critica abertamente a destilação por modelos chineses de código aberto. O mesmo padrão aparece em outras big techs, como a Nvidia, revelando uma corrida por dados de qualidade que destrói patrimônio cultural em nome do avanço tecnológico.