Ant Group open-source SingGuard-NSFA : sept catégories de risques, 133 langues, verdict en 50 ms pour sécuriser les agents autonomes
Résumé
L'AI Safety Lab d'Ant Group a open-sourcé SingGuard-NSFA, un modèle-garde-fou dédié aux agents autonomes qui détecte injections de prompt, exfiltration de données, exécution de code malveillant, abus de ressources et misuse de permissions avant l'action. Décliné en variantes 0,8B, 2B, 4B et 9B, il couvre sept catégories de risques, 28 sous-catégories, 185 scénarios et 133 langues avec un temps de décision d'environ 50 millisecondes. Le groupe chinois dévoile en parallèle SingGuard, un modèle multimodal complémentaire.
Article original publié par technode.com
Lire l'article original →Titre original : Ant Group open-source SingGuard-NSFA : sept catégories de risques, 133 langues, verdict en 50 ms pour sécuriser les agents autonomes