Face à l'opacité croissante des laboratoires de pointe, la start-up Anthropic a publié un rapport proposant trois indicateurs clés pour mesurer le rythme de développement de l'intelligence artificielle. Cette initiative vise à instaurer une transparence nécessaire pour que la société civile puisse évaluer les risques et les progrès réels de cette technologie.
L'automatisation de la recherche par l'IA
Le premier indicateur concerne la part de recherche et développement (R&D) effectuée par l'IA elle-même. Anthropic révèle que 26 % de ses travaux de R&D sont désormais pilotés par son assistant Claude, bien que ce dernier opère en collaboration avec des chercheurs humains dans plus de 90 % des cas. Si cette automatisation permet d'accélérer la création de modèles plus performants, elle soulève des inquiétudes quant à la capacité humaine à comprendre et contrôler des systèmes dont la complexité croît de manière exponentielle.
La supervision des agents autonomes
Le second axe porte sur la surveillance des agents IA, des outils de plus en plus sollicités pour des tâches complexes. Anthropic a mis en place un système de contrôle capable d'intervenir sur les actions de ces agents. En août dernier, la société a analysé plus d'un million de décisions prises par environ 30 000 agents simultanément. Ce mécanisme de supervision a permis de bloquer 0,002 % des décisions jugées problématiques, illustrant l'enjeu crucial de maintenir des garde-fous face à une automatisation accrue des processus décisionnels.
L'allocation des ressources de calcul
Enfin, l'entreprise suggère de suivre la répartition de la puissance de calcul allouée à la R&D. Pour la semaine du 13 au 20 juillet, Anthropic a constaté que 6 % de ses ressources de calcul étaient dédiées à la recherche en sécurité, contre environ le double pour la R&D pilotée par l'IA. Bien que la recherche en sécurité soit moins gourmande en puissance de calcul que l'entraînement des modèles, cet indicateur offre un mécanisme de comparaison standardisé. Anthropic appelle ses concurrents à adopter ces mesures pour réduire l'écart d'information entre les laboratoires de pointe et le grand public, garantissant ainsi que la sécurité progresse au même rythme que les capacités technologiques.