Um desenvolvedor Ruby notou algo estranho nos logs: os bots de coleta da OpenAI estavam batendo em páginas relacionadas a uma vulnerabilidade de cache no RubyGems, o gerenciador de pacotes da linguagem. Ou seja, a máquina que alimenta os modelos já tinha topado com o problema antes de virar notícia.
O caso reacende um debate desconfortável: esses crawlers varrem a web inteira sem muito filtro, engolindo desde documentação pública até detalhes sensíveis de segurança. Não é que a OpenAI tenha feito algo ilegal aqui, mas mostra o tamanho do apetite dessas empresas por dados — e como pouco sabemos sobre o que fazem com eles depois.
Fica a pergunta que ninguém responde direito: quanto do que os bots capturam acaba virando conhecimento embutido nos modelos, incluindo brechas de sistemas alheios?
Via Hacker News.
Fonte: Tenderlove Making · Imagem de capa: Foto de Chris Ried no Unsplash
Quer aplicar IA no seu trabalho?
Aprenda qual ferramenta usar para cada tarefa — ChatGPT, Claude, Copilot, Gemini e NotebookLM — nos cursos do IA Todo Dia.
Conhecer os cursos →