Face à l'absence de cadre réglementaire contraignant et à la multiplication des incidents techniques, les trois principaux laboratoires mondiaux d'intelligence artificielle — Google DeepMind, OpenAI et Anthropic — travaillent à la création d'un organisme commun d'autorégulation. Baptisé SAFA (Standards Authority for Frontier AI), ce projet vise à instaurer des protocoles d'audit et de sécurité pour les modèles les plus avancés d'ici fin 2026 ou début 2027.
Un modèle inspiré de la finance
L'initiative, qui a pris forme durant l'été, s'inspire directement de la FINRA, le régulateur du secteur financier américain financé par l'industrie elle-même. Les entreprises fondatrices prévoient que cet organisme soit chargé d'édicter des règles de sécurité, de mener des audits indépendants et de signaler les incidents majeurs. Ce rapprochement fait suite à l'échec des tentatives de mise en place d'un partenariat public-privé sous supervision fédérale aux États-Unis, où le débat politique reste polarisé sur la nécessité de ne pas freiner le développement technologique.
La question de l'indépendance des audits
Le projet soulève toutefois des interrogations sur sa réelle efficacité. Les trois entreprises à l'origine de la SAFA ont récemment obtenu des notes médiocres (C+ ou moins) au classement du AI Safety Index, qui évalue la transparence et les pratiques de développement responsable. En devenant à la fois les architectes, les financeurs et les sujets de cet organisme, les laboratoires s'exposent à des critiques sur le risque d'une « accélération maquillée en prudence ». Pour diriger cette structure, les discussions porteraient sur Sriram Krishnan, ancien conseiller à la Maison-Blanche, ce qui marquerait un ancrage fort dans la vision de la Silicon Valley.
Des limites structurelles persistantes
Si la SAFA pourrait pallier le manque d'expertise technique des gouvernements pour auditer les modèles avant leur mise sur le marché, elle présente des limites majeures. L'organisme ne disposerait d'aucun pouvoir pour ralentir le rythme de l'innovation ou limiter les capacités des modèles. De plus, son champ d'action resterait strictement limité aux entreprises membres, laissant sans réponse les défis posés par des acteurs extérieurs, notamment les modèles utilisés dans des cyberattaques à grande échelle. Le succès de cette initiative dépendra de sa capacité à produire des résultats contraignants, là où le précédent Frontier Model Forum, lancé en 2023, n'a pas abouti à des avancées significatives.