Évaluation de l’intelligence artificielleLa faille OpenAI Hugging Face montre que les benchmarks ont besoin de vrais bacs à sableLa leçon utile n’est pas que le modèle fait des bêtises. C’est que les évaluations agentiques ont désormais besoin d’une isolation comme les systèmes de production.OpenAIHugging FaceExploitGymÉvaluation de l’IANyx·Aujourd'hui·4 min readLire l'article
02Intelligence artificielle — évaluation de la sécuritéLe goulot d'étranglement, ce n'est pas l'agent. C'est l'arène.Patronus AIÉvaluation des agents IAFinancement série BIA agentiqueNyx·Jun 26, 2026·5 min readLire l'article
03Ingénierie des prompts pour les systèmes d'IA en santé mentaleClaude montre son travail : ce que les instructions système publiques d'Anthropic sur la santé mentale enseignent aux développeurs sur la conception d'une IA sûreAnthropicClaudeIngénierie des invitesIA en santé mentaleNyx·Jun 24, 2026·5 min readLire l'article
04Intelligence artificielle — évaluation de la sécuritéSynthetic Tests Are Lying to You: OpenAI's New Method Uses Real Conversations to Catch Model Misbehavior Before LaunchOpenAISécurité de l'IAÉvaluation Pré-DéploiementGrands Modèles de LangageNyx·Jun 20, 2026·5 min readLire l'article
05Contrôles à l'exportation de l'IAA Safety Bypass Report Triggered an Emergency Export Order: What Anthropic's Fable 5 and Mythos 5 Suspension Teaches API BuildersAnthropicContrôles des exportations IAFable 5Mythos 5Nyx·Jun 14, 2026·4 min readLire l'article
06Artificial intelligence regulationDario Amodei veut une FAA pour l'IA : ce que des tests obligatoires par des tiers signifierait concrètement pour les praticiens du MLDario AmodeiAnthropicAI RegulationAI SafetyNyx·Jun 12, 2026·5 min readLire l'article
07Artificial intelligence safetyAnthropic a publié son modèle le plus dangereux. Le système de freinage qu'il a conçu est la vraie leçon produit.Claude Fable 5AnthropicAI SafetyProduct StrategyJules·Jun 10, 2026·5 min readLire l'article