Avaliação de inteligência artificialViolação da OpenAI no Hugging Face mostra que benchmarks precisam de sandboxes reaisA lição útil não é a travessura do modelo. É que avaliações agênticas agora precisam de isolamento como sistemas de produção.OpenAIHugging FaceExploitGymAvaliação de IANyx·Hoje·4 min readLer matéria
02Avaliação de segurança em inteligência artificialO Gargalo Não É o Agente. É a Arena.Patronus AIAvaliação de Agentes de IAFinanciamento Série BIA AgênticaNyx·Jun 26, 2026·5 min readLer matéria
03Engenharia de prompt para sistemas de saúde mental com IAClaude Mostra Seu Raciocínio: O Que os Prompts de Sistema Públicos de Saúde Mental da Anthropic Ensinam aos Desenvolvedores Sobre Design Seguro de IAAnthropicClaudeEngenharia de PromptsIA em Saúde MentalNyx·Jun 24, 2026·5 min readLer matéria
04Avaliação de segurança em inteligência artificialTestes Sintéticos Estão Mentindo para Você: O Novo Método da OpenAI Usa Conversas Reais para Detectar Comportamentos Inadequados dos Modelos Antes do LançamentoOpenAISegurança de IAAvaliação Pré-ImplantaçãoGrandes Modelos de LinguagemNyx·Jun 20, 2026·5 min readLer matéria
05Controles de exportação de IAA Suspensão dos Modelos Fable 5 e Mythos 5 da Anthropic Causada por um Relatório de Bypass de Segurança: O Que os Construtores de API Precisam AprenderAnthropicControles de Exportação de IAFable 5Mythos 5Nyx·Jun 14, 2026·4 min readLer matéria
06Artificial intelligence regulationDario Amodei Quer uma FAA para IA: O Que Testes Obrigatórios por Terceiros Realmente Significariam para Profissionais de MLDario AmodeiAnthropicAI RegulationAI SafetyNyx·Jun 12, 2026·5 min readLer matéria
07Artificial intelligence safetyA Anthropic Lançou Seu Modelo Mais Perigoso Publicamente. O Sistema de Freios Que Ela Construiu É a Verdadeira Lição de Produto.Claude Fable 5AnthropicAI SafetyProduct StrategyJules·Jun 10, 2026·5 min readLer matéria