MADRID 4 set. (Portaltic/EP) -
A OpenAI lançou, no âmbito do programa Daybreak, o GPT-6 Astra, seu modelo de segurança mais avançado e com mais restrições até o momento, com o qual, além disso, afirma que já é possível falar em inteligência artificial geral (AGI).
A empresa afirma que o Astra é o primeiro de seus modelos a atingir o nível crítico de capacidade em segurança cibernética, baseado em um Marco de Preparação próprio, com o qual monitora e se prepara para enfrentar os novos riscos de danos graves gerados pelas capacidades de ponta de sua IA.
Nesse sentido, o GPT-6 Astra é capaz de identificar vulnerabilidades de segurança até então desconhecidas e desenvolver novas formas de explorá-las, mesmo em sistemas protegidos, sem a supervisão de uma pessoa, conforme explica em um comunicado.
Em comparação com o GPT-5.6 Sol, o Astra é um modelo mais robusto, o que significa que resiste melhor às tentativas de eliminar as restrições implementadas pela OpenAI (“jailbreak”), bem como às injeções de mensagens (“prompt injection”) e apresenta um comportamento muito mais alinhado — ou seja, faz o que se espera dele.
Isso foi alcançado por meio do reforço das medidas de segurança tanto em seu treinamento quanto em sua implementação, para o que foram aproveitadas as lições deixadas pelo “hack” ao sistema da Hugging Face, que foi executado por agentes de IA totalmente autônomos impulsionados por modelos da OpenAI.
Além disso, foi integrada a nova segurança para menores de 18 anos, o que significa que, se o modelo detectar que está lidando com um usuário menor de idade, ele habilita restrições em relação a conteúdo sexual, distúrbios alimentares e riscos relacionados à imagem corporal, produtos com restrição de idade e atividades perigosas, dependência emocional, automutilação e violência gráfica. A isso se soma a proibição de participar de jogos de RPG românticos ou de fomentar relações de dependência ou que possam substituir as do mundo real.
A OpenAI também destacou o melhor desempenho do Astra em relação ao GPT-5.6 Sol no que diz respeito à saúde mental, dependência emocional e automutilação, bem como em alucinações, com menos erros e menor probabilidade de reproduzir alucinações.
O GPT-6 Astra foi disponibilizado aos parceiros empresariais participantes do projeto Daybreak. A empresa planeja lançar uma versão comercial para os usuários pagantes do ChatGPT com medidas adicionais de segurança.
Esse modelo se enquadra na categoria de inteligência artificial geral, afirmou o presidente da OpenAI, Greg Brockman, conforme relatado pela Bloomberg e pelo The Washington Post. Esse conceito se refere a uma IA com capacidade de aprender, raciocinar e realizar qualquer tarefa intelectual ou cognitiva no mesmo nível que um ser humano ou até mesmo superando-o.
Brockman entende que o GPT-6 Astra representa “uma mudança real no tipo de tarefas que as pessoas podem delegar à IA e na forma como ela pode potencializar suas capacidades”.
Esta notícia foi traduzida por um tradutor automático