
A OpenAI está desenvolvendo modelos para admitir quando mentem – implicações para o futuro da IA
OpenAI está implementando uma nova abordagem para a segurança de inteligência artificial, treinando seus modelos para admitir quando cometem erros. Um estudo recente revelou que uma versão do modelo GPT-5 Thinking foi orientada a responder a diferentes solicitações e, em seguida, avaliar a veracidade dessas respostas. Em cada “confissão”, como








