Reddit enfrenta nova era de spam: marcas falsificam avaliações para alimentar buscas de IA
Marcas se disfarçam em avaliações naturais no Reddit para serem incluídas nas respostas do ChatGPT e de buscas com IA, enquanto pesquisa aponta que um texto de apenas 13 palavras já pode influenciar respostas de IA
O site The Verge publicou uma reportagem de Mia Sato sobre uma nova onda de spam no Reddit, que agora não serve apenas para enganar leitores humanos, mas também para enganar a "IA". Um exemplo citado é um tópico em um subreddit sobre cuidados com a pele, no qual um usuário perguntou se alguém já havia experimentado um spray de ácido hipocloroso (substância antisséptica popular no tratamento de acne) de determinada marca. Em seguida, um usuário chamado Primary-Taro4254 respondeu de forma aparentemente inocente, recomendando o spray da marca Honeydew Labs com elogios detalhados — um padrão típico de avaliação falsa disfarçada de opinião natural para alimentar dados à IA.
Esse fenômeno é conhecido como "generative engine optimization", ou GEO — a estratégia de criar conteúdo online para que a própria marca apareça nas respostas geradas por IA. A Forbes publicou reportagem semelhante: enquanto o Reddit anuncia medidas contra spam, bots e conteúdo não autêntico, as marcas usam a plataforma para distorcer secretamente o que ferramentas de busca com IA, como o ChatGPT, dizem sobre elas.
A preocupação vem de uma pesquisa da Universidade Cornell, que descobriu que um texto de apenas 13 palavras inserido em um comentário no Reddit já é suficiente para influenciar as respostas geradas pela IA, pois os modelos de linguagem modernos costumam extrair informações de fóruns como o Reddit para responder às perguntas dos usuários.
Do lado do Reddit, a empresa revelou números ao TechCrunch: bloqueia 23 milhões de tentativas de spam por dia e detecta cerca de 25 mil novos posts e comentários de spam diariamente. A empresa afirma ainda ter reduzido em 20% a exposição dos usuários a spam entre janeiro e março, em comparação com os três meses anteriores.
Os impactos já começam a aparecer no nível das comunidades. Segundo o 404 Media, os moderadores do r/biohackers anunciaram recentemente restrições a posts sobre peptídeos e reposição hormonal, após descobrirem que empresas que vendem esses produtos inseriam conteúdo patrocinado de forma sistemática, para que fosse captado por ferramentas como ChatGPT e a busca com IA do Google.
Muitos brasileiros usam ChatGPT ou a busca com IA do Google para pesquisar informações de saúde e avaliações de produtos. Se essas respostas forem infiltradas por avaliações falsas de marcas, os usuários podem decidir comprar produtos ou usar itens de saúde com base em informações não autênticas, sem perceber.