
Novo modelo da OpenAI ‘pensa’ às escondidas e acende alerta de segurança
A menor visibilidade do raciocínio do novo modelo da OpenAI preocupa pesquisadores de segurança.

A menor visibilidade do raciocínio do novo modelo da OpenAI preocupa pesquisadores de segurança.
Sistemas de IA da OpenAI e da Anthropic não encontraram nada no curl. A startup AISLE achou seis falhas reais, todas corrigidas.

Grupo com OpenAI diz que IA vai comprimir o tempo dos ciberataques e expor fraquezas nas empresas.

Ensaio mostra como um LLM malicioso poderia explorar bugs em motores de inferência como o vLLM para executar código na máquina que o roda.

Em nova investida contra a Anthropic, OpenAI aposta em privacidade de dados corporativos.

Agentes de IA estão tomando decisões estranhas e ninguém sabe explicar direito o porquê.

Com a criptografia homomórfica e o novo compilador HEIR, o Google promete processar dados sem descriptografá-los. Mas o custo ainda é o gargalo.

Homem escondeu instruções invisíveis num processo em Connecticut, mandando qualquer IA que lesse o documento tomar o lado dele. A tática falhou.

Blocos de raciocínio criptografados das APIs da OpenAI, Google e Anthropic podem ser reaproveitados para expor o pensamento escondido dos modelos — e dados sensíveis junto.

A Docker apresentou sandboxes isolados e descartáveis para rodar agentes de IA com mais segurança.