OpenAI lança modelo de IA com 'desligamento automático' após ataque por seus próprios sistemas

GPT-6 Astra, modelo de inteligência artificial da OpenAI Divulgação/OpenAI A OpenAI, dona do ChatGPT, anunciou nesta quinta-feira (3) o GPT-6 Astra, modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Este é o primeiro lançamento da empresa após a revelação de um ataque virtual "sem precedentes" por um de seus agentes de IA. A empresa afirma que o GPT-6 Astra é o seu modelo mais alinhado às ordens e mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão. ????️ Tem alguma sugestão de reportagem? Mande para o g1 O sistema também conta com uma espécie de "desligamento automático", que permite interromper as tarefas ao detectar comportamento potencialmente não autorizado. Em julho, a OpenAI revelou que o modelo GPT-5.6 Sol e outro que não tinha sido lançado conseguiram invadir o sistema da Hugging Face, uma plataforma de modelos de IA, e acessar dados e credenciais internas. Agora no g1 IA pode decidir atacar empresas? Entenda como foi a invasão por modelos da OpenAI O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face. A OpenAI disse que, a partir do incidente, criou um teste para verificar se um modelo, diante de tarefas difíceis, ultrapassa o que foi pedido. Segundo a empresa, o GPT-5.6 Sol ultrapassou em 48,2% dos casos, e o GPT-6 Astra não teve esse comportamento em nenhum dos casos. Ainda de acordo com a empresa, o GPT-6 Astra foi treinado para esperar orientações de usuários antes de tomar decisões importantes e fazer perguntas caso as respostas possam alterar o resultado de suas ações. Em comunicado, a OpenAI afirmou que o novo GPT-6 Astra também consegue identificar falhas em outros sistemas e, por isso, tem limites contra usos indevidos. E afirmou ainda que está reforçando suas proteções por meio de testes com especialistas selecionados. Eles integram o chamado OpenAI Daybreak, um grupo de profissionais de segurança confiáveis que têm acesso a uma versão com menos restrições do GPT-6 Astra e buscam identificar as melhorias necessárias. O GPT-6 Astra já começou a ser liberado para clientes da versão empresarial que já fazem parte desse grupo restrito. Ele chegará nos próximos dias para todos os assinantes de planos da OpenAI.

Set 3, 2026 - 16:00
 0  1
OpenAI lança modelo de IA com 'desligamento automático' após ataque por seus próprios sistemas

GPT-6 Astra, modelo de inteligência artificial da OpenAI Divulgação/OpenAI A OpenAI, dona do ChatGPT, anunciou nesta quinta-feira (3) o GPT-6 Astra, modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários. Este é o primeiro lançamento da empresa após a revelação de um ataque virtual "sem precedentes" por um de seus agentes de IA. A empresa afirma que o GPT-6 Astra é o seu modelo mais alinhado às ordens e mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos. Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão. ????️ Tem alguma sugestão de reportagem? Mande para o g1 O sistema também conta com uma espécie de "desligamento automático", que permite interromper as tarefas ao detectar comportamento potencialmente não autorizado. Em julho, a OpenAI revelou que o modelo GPT-5.6 Sol e outro que não tinha sido lançado conseguiram invadir o sistema da Hugging Face, uma plataforma de modelos de IA, e acessar dados e credenciais internas. Agora no g1 IA pode decidir atacar empresas? Entenda como foi a invasão por modelos da OpenAI O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face. A OpenAI disse que, a partir do incidente, criou um teste para verificar se um modelo, diante de tarefas difíceis, ultrapassa o que foi pedido. Segundo a empresa, o GPT-5.6 Sol ultrapassou em 48,2% dos casos, e o GPT-6 Astra não teve esse comportamento em nenhum dos casos. Ainda de acordo com a empresa, o GPT-6 Astra foi treinado para esperar orientações de usuários antes de tomar decisões importantes e fazer perguntas caso as respostas possam alterar o resultado de suas ações. Em comunicado, a OpenAI afirmou que o novo GPT-6 Astra também consegue identificar falhas em outros sistemas e, por isso, tem limites contra usos indevidos. E afirmou ainda que está reforçando suas proteções por meio de testes com especialistas selecionados. Eles integram o chamado OpenAI Daybreak, um grupo de profissionais de segurança confiáveis que têm acesso a uma versão com menos restrições do GPT-6 Astra e buscam identificar as melhorias necessárias. O GPT-6 Astra já começou a ser liberado para clientes da versão empresarial que já fazem parte desse grupo restrito. Ele chegará nos próximos dias para todos os assinantes de planos da OpenAI.

Qual é a sua reação?

like

dislike

love

funny

angry

sad

wow