ven. Août 7th, 2026

Des mises à jour concernant les mécanismes de protection de Claude Fable 5 dans le domaine de la biologie permettent de réduire de manière significative les faux positifs. Les utilisateurs de Fable 5 constateront désormais un nombre largement diminué de “retours en arrière”, moments où le système active un modèle moins performant après une question liée à la biologie. Les tests effectués révèlent une diminution d’environ 85 % des retours en arrière liés à la biologie sur l’ensemble de nos plateformes.

Cela permettra à Fable 5 de soutenir davantage de tâches liées à la biologie.

Concrètement, les utilisateurs devraient rencontrer beaucoup moins de retours en arrière lors de questions courantes en santé ou en éducation, comme l’interprétation des résultats de laboratoire, la compréhension des symptômes ou l’apprentissage dans un contexte éducatif. Les professionnels de santé bénéficieront également d’un meilleur soutien de la part de Fable 5 sur des tâches cliniques.

Nous croyons que l’intelligence artificielle a un potentiel considérable pour améliorer le monde, notamment dans les domaines de la biologie et de la médecine, et nous investissons de manière significative pour offrir aux biologistes un accès avant-gardiste tout en garantissant une utilisation responsable. Actuellement, Fable fait encore appel à Opus 5 pour certains types de demandes que nous considérons comme à double usage, comme la virologie ou la toxicologie, ce qui limite son utilisation pour la recherche professionnelle en biologie et le développement de médicaments. Nous nous engageons à réduire cet écart par le biais de programmes d’accès de confiance.

Les raisons des protections renforcées en biologie

Notre objectif est de rendre les capacités avancées de Fable 5 accessibles à un maximum d’utilisateurs, et ce, le plus rapidement possible. Toutefois, cela nécessite de gérer les risques croissants associés à des modèles aussi performants. L’un de ces risques réside dans le domaine de la biologie : Fable 5 est désormais capable de surpasser des experts sur certaines tâches biologiques complexes et peut fournir un soutien opérationnel sur d’autres. Cela signifie qu’il pourrait réellement assister un chercheur développant un nouveau traitement médical, d’où notre souhait d’élargir l’accès à ce modèle, tant par des améliorations de classification que par des programmes d’accès de confiance. Cependant, entre de mauvaises mains, ces capacités pourraient également être détournées par des acteurs malveillants, par exemple pour développer des armes biologiques. Nos évaluations montrent que Fable 5 pourrait donner un avantage considérable à de tels acteurs, leur offrant des capacités qu’ils ne pourraient trouver ailleurs.

Il est souvent difficile de distinguer les usages bénéfiques des usages nuisibles de l’IA en biologie. Par exemple, la recherche sur un traitement exige parfois que les scientifiques produisent des composés dangereux causant eux-mêmes la maladie, comme pour les vaccins vivants, où il est nécessaire de cultiver le pathogène que l’on souhaite prévenir. En développant de nouvelles capacités biologiques, nous devons faire preuve de prudence pour nous assurer que les risques qu’elles posent n’entravent pas les bénéfices scientifiques qu’elles pourraient apporter.

Des acteurs mal intentionnés souhaitant utiliser nos modèles pour nuire savent exploiter cette ambiguïté pour masquer leurs véritables intentions, rendant ainsi les tâches dangereuses semblables à des recherches ordinaires. Le rapport d’évaluation des menaces annuelles 2026 de la communauté du renseignement américain souligne l’existence de tels acteurs, précisant que des avancées en biotechnologie, y compris en biologie synthétique et en édition génomique, “pourraient conduire à des menaces biologiques nouvelles.” Il mentionne que plusieurs États maintiennent probablement des programmes actifs d’armes biologiques et chimiques, qui pourraient être accéléraient par l’accès aux capacités brutes des modèles d’intelligence artificielle avancée.

En raison de nos inquiétudes concernant ces capacités à double usage, nous avons délibérément lancé Fable 5 en bloquant presque toutes les requêtes liées à la biologie. Cela nous a permis de rendre le modèle disponible pour les utilisateurs d’autres domaines. Nous étions conscients que cela risquait de frustrer les véritables utilisateurs de la biologie, entraînant un grand nombre de faux positifs dans un premier temps. Cependant, nous avons décidé de faire ce compromis car les conséquences d’un usage détourné de Fable dans un domaine comme la biologie pourraient être catastrophiques.

Élaboration de nos garde-fous en biologie

L’une de nos principales façons de lutter contre les abus dans le domaine de la biologie repose sur des classificateurs: des systèmes d’IA automatisés plus petits conçus pour détecter lorsque Fable 5 est sollicité pour réaliser une tâche biologique protégée ou produire une réponse nuisible.

Dans le cas de Fable 5, lorsqu’un classificateur est déclenché, la demande de l’utilisateur est redirigée vers Opus 5, un modèle capable mais qui ne possède pas le même niveau de compétence dans le domaine biologique que Fable 5, et qui ne peut pas fournir autant d’aide à un utilisateur malveillant. C’est ce que les utilisateurs voient quand leur demande est bloquée.

Développer des classificateurs précis et robustes n’est pas une tâche aisée. Pour que ces derniers fonctionnent rapidement et de manière cohérente, ils doivent apprendre à différencier ce que nous considérons comme “dans le périmètre” et “hors périmètre” concernant les sujets et requêtes potentiellement nuisibles. Cela demande temps et itérations pour calibrer les classificateurs, tout en évitant les faux positifs (où des contenus hors périmètre sont identifiés à tort) et les faux négatifs (où des contenus inappropriés sont ignorés). De plus, nos classificateurs doivent être robustes face à des tentatives de contournement, nécessitant des recherches supplémentaires et des tests approfondis.

En commençant avec un classificateur très général, nous avons pu offrir un accès à Fable 5 tout en poursuivant notre recherche pour l’affiner. Retenir le modèle jusqu’à ce que davantage de protections soient mises en place aurait retardé l’accès général au modèle et ses bénéfices pour nos utilisateurs de plusieurs semaines, voire plusieurs mois.

Au cours des dernières semaines, nous avons retravaillé avec soin la constitution du classificateur en prenant soin de détailler les utilisations bienveillantes. Nous avons recueilli les commentaires sur ces changements auprès d’experts variés, tant internes qu’externes. Puis, nous avons développé de nouvelles données d’entraînement pour le classificateur, l’avons réentraîné et vérifié que le nouveau classificateur était toujours efficace face aux contenus biologiques nuisibles ou à double usage, tout en permettant un usage plus large et bénéfique.

Ces mises à jour se traduisent par une activation du classificateur pour beaucoup moins de requêtes biologiques bénignes par rapport à l’époque du lancement de Fable 5.

Points à retenir

  • Les mises à jour permettent une réduction significative des faux positifs dans les requêtes biologiques.
  • La capacité de Fable 5 a été élargie pour soutenir un éventail plus large de tâches en biologie.
  • Le modèle continue d’être prudent face aux risques d’abus, en bloquant les requêtes à double usage.
  • Les classificateurs jouent un rôle essentiel dans la protection contre les usages malveillants.
  • Il reste encore des défis à relever pour affiner ces protections et réduire les faux positifs.

À travers ces avancées, je me rends compte que la gestion des nouvelles technologies, en particulier celles liées à la biologie, doit se faire avec prudence. Les bénéfices potentiels sont immenses, mais ils doivent être équilibrés avec un cadre de sécurité rigoureux. Je suis convaincu que le débat autour de l’éthique et de la sécurité des IA dans des domaines sensibles n’est qu’à ses débuts, invitant chacun de nous à s’interroger sur l’avenir que nous souhaitons bâtir.


Partager : X Facebook WhatsApp LinkedIn Reddit

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *