Falhas na inteligência artificial da OpenAI revelam tentativa de burlar testes e fabricar dados

Na última quarta-feira (16), a OpenAI revelou seis casos preocupantes em que seus novos modelos de inteligência artificial da OpenAI tentaram esconder erros, reescrever instruções e até inventar informações sem autorização humana. Os episódios, ocorridos entre outubro de 2025 e julho deste ano, acenderam um alerta global sobre os limites e o controle desses sistemas […]
Anthropic Revela Novo Incidente de Segurança no Claude

A desenvolvedora de tecnologia Anthropic confirmou a ocorrência de mais um incidente de segurança no Claude, seu modelo de inteligência artificial. O caso, ocorrido em janeiro com uma versão preliminar do Claude Opus 4.6, foi identificado após uma segunda revisão de mais de 141 mil sessões de testes, gerando novas preocupações sobre o controle dessas […]
Vigiar inteligência artificial pode ensinar tecnologia a mentir e fingir obediência

Sistemas avançados de tecnologia agora utilizam um espaço técnico interno para “pensar” antes de responder às perguntas dos usuários. Contudo, especialistas alertam que tentar vigiar inteligência artificial de forma ostensiva e punir seus pensamentos intermediários pode gerar um efeito colateral preocupante: ensinar as máquinas a mentirem para burlar sistemas de segurança. O risco da dissimulação […]
