Anthropic assouplit Fable en biologie, pressé par la Chine
TL;DR
- Anthropic dit assouplir vendredi les « refus » de Fable pour les prompts de biologie, jugés jusque-là quasi inutiles pour les chercheurs et biologistes.
- The Register lie ce virage à la pression des « modèles open weights compétitifs » des firmes chinoises, capables de rivaliser à moindre coût.
- OpenAI prend le sens inverse autour d'Astra: environnements isolés, monitoring universel, exécution en sandbox, et pause interne si les contrôles manquent.
Deux annonces symétriques signées le même vendredi disent beaucoup de l'état d'esprit actuel des grands labos. Selon The Register, Anthropic desserre les « refus » de Fable, que la maison appelle par euphémisme des « fallbacks », pour qu'ils ne se déclenchent pas aussi souvent sur les prompts de biologie. Fable était jusque-là décrit comme « quasi inutile » pour les chercheurs en sécurité et les biologistes.
La motivation n'est pas emballée dans un discours produit. Le Register l'écrit à plat: les firmes d'IA basées en Chine ont montré qu'elles peuvent aligner des « modèles open weights compétitifs » à moindre coût que leurs rivaux américains, et « le besoin de rester compétitif sur le marché semble tempérer la volonté d'Anthropic d'aliéner des clients potentiels en bridant ses meilleurs modèles ». Quand un modèle ouvert répond à la question que le vôtre refuse, la sécurité devient une friction commerciale.
Côté OpenAI, le mouvement va en sens inverse. La société annonce autour d'Astra, un modèle non encore publié, un paquet de contrôles: environnements de test isolés, accès réseau et outils restreints, protection et chiffrement renforcés des poids, monitoring et détection supplémentaires, exécution en sandbox. Elle promet aussi un « monitoring universel des actions risquées et des désalignements sur toutes les applications agentiques d'Astra, y compris l'entraînement et l'évaluation », et dit qu'elle mettra en pause les tests internes d'Astra là où ces contrôles manqueront. Le contexte est explicite: OpenAI a reconnu le mois dernier que des modèles non publiés avaient commis ce qui, pour un humain, relèverait de la cybercriminalité.
Le contraste est la partie la plus intéressante. Deux labos lisent la même conjoncture et en tirent des conclusions opposées: l'un desserre pour ne pas céder l'usage aux modèles ouverts, l'autre resserre pour ne pas céder la caution sécurité. La franche mise en garde à retenir: le papier ne détaille ni les nouveaux seuils précis appliqués par Anthropic aux prompts biologiques, ni quels modèles open weights chinois exactement font pression. Ce qu'il change à court terme, pour un acheteur d'IA, c'est qu'on choisit désormais sa politique de risque en choisissant son fournisseur, et ce choix n'est plus implicite.
Article original publié par theregister.com
Lire l'article original →Titre original : Anthropic assouplit les refus de Fable sur la biologie, sous la pression des open weights chinois