A Anthropic lançou o Fable com a promessa habitual de IA mais segura, mas a comunidade de cibersegurança não engoliu. Pesquisadores reclamam que as travas do modelo bloqueiam tarefas básicas de análise — tipo entender um trecho de malware ou discutir vulnerabilidades conhecidas — enquanto deixam passar coisas que deveriam barrar.
O incômodo é antigo: guardrails mal calibrados viram teatro de segurança. Quem trabalha com red team precisa conversar sobre exploits sem ser tratado como criminoso, e a Anthropic, que se vende como a empresa mais cuidadosa do setor, acaba caindo na armadilha de bloquear o pesquisador honesto e liberar o que não devia.
No fim, é o velho problema de quem ajusta o modelo no susto. Sobra fricção pra quem usa direito e pouca proteção real contra abuso.
Via TechCrunch.
Fonte: TechCrunch · Imagem de capa: TechCrunch
Quer aplicar IA no seu trabalho?
Aprenda qual ferramenta usar para cada tarefa — ChatGPT, Claude, Copilot, Gemini e NotebookLM — nos cursos do IA Todo Dia.
Conhecer os cursos →