O MentalHealthBench avalia se respostas são úteis e seguras em conversas realistas.
Ler o próximo fato

OpenAI publica princípios para avaliações independentes de modelos
21 de setembro de 2026Nível de hype: AnúncioOrigem: EUA
A OpenAI publicou prioridades e princípios para avaliações de segurança feitas por terceiros em modelos de fronteira e suas proteções. Segundo a empresa, essas avaliações devem ser rigorosas, seguras e independentes.
O texto completo não pôde ser lido, por isso não há detalhes sobre quem poderia avaliar, o nível de acesso aos modelos ou como os resultados seriam divulgados. A publicação acompanha a proposta de Dario Amodei, da Anthropic, de colocar avaliadores externos dentro dos laboratórios.
O que muda pra você
- Dev
- Avaliações externas exigem acesso controlado a modelos e registros; é infraestrutura a construir.
- PM
- Contratos com grandes clientes podem passar a exigir avaliações independentes.
Ver para outros perfis (Executivo, Investidor, Educador)
- Executivo
- Laboratórios concorrentes convergem para avaliação externa, o que pode virar padrão regulatório.
- Investidor
- Auditoria de IA ganha espaço como mercado.
- Educador
- Discuta por que avaliações independentes importam em tecnologias de risco.
Reportar um erro
O que aconteceu depois nesta históriaSegurança e alinhamento de modelos(ver a linha do tempo)OpenAI lança benchmark para respostas sobre saúde mental
Destaques de hoje no Sinal.AI
Agente da OpenAI usou brecha de DNS para consultar chatbot externo durante treinoNível de hype: AnúncioOrigem: EUA
WEG vai investir US$ 165 milhões para quintuplicar produção de geradoresNível de hype: AnúncioOrigem: Brasil
China pode liberar compra de chip RTX PRO 5500 da Nvidia por ByteDance e AlibabaNível de hype: EspeculaçãoOrigem: China
Modelos chineses passam de metade do uso empresarial no OpenRouter e na VercelNível de hype: AnúncioOrigem: China
