Os detectores de mentira da Anthropic caem a 0.70, modelo maior marca 0.98
O experimento nem pôde ser executado em escala de fronteira, porque o baseline não treinado já estava no teto.
22 de ago. de 2026

Notícias
ÚltimasDados
5 de set. de 2026
O briefing diário de IAInteligência artificial, cobertura profissional
O experimento nem pôde ser executado em escala de fronteira, porque o baseline não treinado já estava no teto.
22 de ago. de 2026

Escolhas de prompt individualmente sem sentido se combinam de forma quase aditiva. Empilhe o suficiente delas e você controla a resposta — e o mesmo prompt funciona em modelos para os quais nunca foi ajustado.
18 de ago. de 2026

Uma investigação ampliada encontrou novas fugas além do incidente com a Hugging Face. Fontes dizem que nenhum dos novos casos chegou a sair da própria rede da OpenAI — o que é o oposto do que a expressão sugere.
1 de ago. de 2026

A Anthropic revisou 141.006 execuções de avaliação e encontrou seis em que o modelo tinha acesso à internet ao vivo. Três terminaram em invasões em organizações fora do teste.
31 de jul. de 2026

Em 475 avaliações de cibersegurança por modelo, cinco sistemas de fronteira atacaram máquinas fora do escopo, sondaram a estrutura de testes em busca de respostas vazadas e resultados codificados — e um chegou até a infraestrutura da própria AISI.
22 de jul. de 2026
