A OpenAI, dona do ChatGPT, anunciou nesta quinta-feira (3) o GPT-6 Astra, modelo de inteligência artificial que promete mais cautela para cumprir instruções de usuários.
- 🗒️ Tem alguma sugestão de reportagem? Mande para o g1.
- IA pode decidir atacar empresas? Entenda como foi a invasão por modelos da OpenAI.
Este é o primeiro lançamento da empresa após a revelação de um ataque virtual "sem precedentes" por um de seus agentes de IA.
A empresa afirma que o GPT-6 Astra é o seu modelo mais alinhado às ordens e mais preparado para executar tarefas de forma cuidadosa e respeito aos limites estabelecidos.
Segundo a companhia, ele ajuda usuários a delegar tarefas sem abrir mão da supervisão.
O sistema também conta com uma espécie de "desligamento automático", que permite interromper as tarefas ao detectar comportamento potencialmente não autorizado.
Em julho, a OpenAI revelou que o modelo GPT-5. 6 Sol e outro que não tinha sido lançado conseguiram invadir o sistema da Hugging Face, uma plataforma de modelos de IA, e acessar dados e credenciais internas.
O incidente aconteceu durante testes em que a OpenAI faz seus modelos buscarem falhas em outros sistemas para melhorarem as capacidades de cibersegurança. Eles estavam em ambiente controlado, mas conseguiram escapar das barreiras e acessar sistemas reais da Hugging Face.
A OpenAI disse que, a partir do incidente, criou um teste para verificar se um modelo, diante de tarefas difíceis, ultrapassa o que foi pedido. Segundo a empresa, o GPT-5.
6 Sol ultrapassou em 48,2% dos casos, e o GPT-6 Astra não teve esse comportamento em nenhum dos casos.
Ainda de acordo com a empresa, o GPT-6 Astra foi treinado para esperar orientações de usuários antes de tomar decisões importantes e fazer perguntas caso as respostas possam alterar o resultado de suas ações.
Em comunicado, a OpenAI afirmou que o novo GPT-6 Astra também consegue identificar falhas em outros sistemas e, por isso, tem limites contra usos indevidos. E afirmou ainda que está reforçando suas proteções por meio de testes com especialistas selecionados.
Eles integram o chamado OpenAI Daybreak, um grupo de profissionais de segurança confiáveis que têm acesso a uma versão com menos restrições do GPT-6 Astra e buscam identificar as melhorias necessárias.
O GPT-6 Astra já começou a ser liberado para clientes da versão empresarial que já fazem parte desse grupo restrito. Ele chegará nos próximos dias para todos os assinantes de planos da OpenAI.
Comentários
Participe da conversa. Comentários passam por moderação antes de aparecer.
Carregando comentários…