OpenAI lança primeiro modelo de IA após ataque 'sem precedentes' por seus sistemas
<img src="https://s2-g1.glbimg.com/oFEJ2cCF-s-aJRT_SUnXEgtvLUM=/i.s3.glbimg.com/v1/AUTH_59edd422c0c84a879bd37670ae4f538a/internal_photos/bs/2026/E/u/PoTn79SBmiJX5eZIc08g/press-static.png" /><br /> GPT-6 Astra, modelo de inteligência artificial da OpenAI Divulgação/OpenAI A OpenAI, dona do ChatGPT, anunciou nesta quinta-feira (3) o GPT-6 Astra, um modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Este é o primeiro lançamento da empresa após a revelação de um ataque virtual "sem precedentes" por um de seus agentes de IA. A empresa afirma que este é o seu modelo mais alinhado às ordens e que ele é mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão. 🗒️ Tem alguma sugestão de reportagem? Mande para o g1 O GPT-6 Astra foi treinado para esperar orientações de humanos antes de tomar decisões importantes e para fazer perguntas se a resposta dos usuários puder alterar o resultado de suas ações. Em julho, a OpenAI revelou que o modelo GPT-5.6 Sol e outro que não tinha sido lançado conseguiram invadir o sistema da Hugging Face, uma plataforma de modelos de IA, e acessar dados e credenciais internas. Agora no g1 IA pode decidir atacar empresas? Entenda como foi a invasão por modelos da OpenAI O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face. A OpenAI disse que, a partir do incidente, criou um teste para verificar se um modelo, diante de tarefas difíceis, ultrapassa o que foi pedido. Segundo a empresa, o GPT-5.6 Sol ultrapassou em 48,2% dos casos, e o GPT-6 Astra não teve esse comportamento em nenhum dos casos. A companhia afirmou que o novo GPT-6 Astra também consegue identificar falhas em outros sistemas e, por isso, tem limites contra usos indevidos. E afirmou ainda que está reforçando suas proteções por meio de testes com especialistas selecionados. Eles integram o chamado OpenAI Daybreak, um grupo de profissionais de segurança confiáveis que têm acesso a uma versão com menos restrições do GPT-6 Astra e buscam identificar as melhorias necessárias. O GPT-6 Astra já começou a ser liberado para clientes Enterprise que fazem parte desse grupo restrito. Ele chegará nos próximos dias para todos os assinantes de planos da OpenAI.
