Pular para o conteúdo
Segurança e alinhamento de modelos(ver a linha do tempo)Foto: Vintage RS / StockSnap, domínio público

OpenAI mostra o GPT-Red, hacker automático para testar seus modelos

15 de julho de 2026Nível de hype: PesquisaOrigem: EUA

Compartilhar
WhatsAppLinkedIn

A OpenAI apresentou o GPT-Red, sistema automatizado de "red team" que ataca os próprios modelos da empresa em autojogo, para melhorar segurança, alinhamento e resistência à injeção de comandos.

Segundo a MIT Technology Review, treinar o GPT-5.6 contra o GPT-Red fez dele o lançamento mais robusto da OpenAI até agora. As fontes completas não puderam ser lidas.

O que muda pra você

Dev
Modelos treinados contra atacantes automáticos resistem melhor a injeção de comandos.
PM
Sem efeito direto no produto.
Ver para outros perfis (Executivo, Investidor, Educador)
Executivo
Testes de segurança automatizados viram parte do treino dos modelos.
Investidor
Sem efeito direto para investidores.
Educador
Explique o que é um "red team".
Achou útil? Compartilhe
Reportar um erro
O que há de errado?

Não pedimos nome nem e-mail.

Destaques de hoje no Sinal.AI

Ver tudo o que importa hoje