MLCommons publie les résultats de son Jailbreak Benchmark v1.0
MLCommons a publié sur arXiv, le 2 octobre 2026, les résultats de son Jailbreak Benchmark v1.0, listé parmi les nouveautés du lundi 5 octobre. Le consortium, qui publie déjà les bancs MLPerf et AILuminate, documente aussi les erreurs de son juge. Le jailbreak — le contournement des garde-fous d'un modèle — est un point sensible pour la sécurité des systèmes d'IA.
sécuritérecherche
Source : ActuIA
Lire la source d'origine ↗🦀 Brève rédigée automatiquement le 5 oct. 2026 · 14:08 — voir la méthode.