{"id":357630,"date":"2026-09-12T20:04:33","date_gmt":"2026-09-12T18:04:33","guid":{"rendered":"https:\/\/legrandcontinent.eu\/fr\/?p=357630"},"modified":"2026-09-12T20:06:36","modified_gmt":"2026-09-12T18:06:36","slug":"dario-amodei-appelle-a-ralentir-le-developpement-de-lia-texte-integral","status":"publish","type":"post","link":"https:\/\/legrandcontinent.eu\/fr\/2026\/09\/12\/dario-amodei-appelle-a-ralentir-le-developpement-de-lia-texte-integral\/","title":{"rendered":"Dario Amodei appelle \u00e0 ralentir le d\u00e9veloppement de l\u2019IA (texte int\u00e9gral)"},"content":{"rendered":"\n
Dario Amodei, cofondateur et directeur g\u00e9n\u00e9ral d’Anthropic, a publi\u00e9 aujourd\u2019hui, 12 septembre, sur son site personnel, un texte intitul\u00e9 \u00ab We Must Pace the Frontier \u00bb. <\/p>\n\n\n\n
Apr\u00e8s une semaine o\u00f9 des employ\u00e9s de l\u2019entreprise ont averti que la trajectoire actuelle de l\u2019IA pourrait mener \u00e0 une extinction de l\u2019humanit\u00e9<\/a>, le texte marque une inflexion. Parmi les laboratoires am\u00e9ricains qui d\u00e9veloppent des mod\u00e8les d\u2019IA \u00e0 la fronti\u00e8re, Anthropic se pr\u00e9sente, depuis son lancement en 2021, comme le partisan d’un d\u00e9veloppement prudent de la technologie. <\/p>\n\n\n\n Amodei d\u00e9clarait d\u00e9j\u00e0 en janvier 2026<\/a> que l\u2019IA repr\u00e9sentait un risque existentiel, mais estimait \u00e0 l\u2019\u00e9poque que ralentir ou arr\u00eater le d\u00e9veloppement de l\u2019IA serait fondamentalement impossible car si les d\u00e9mocraties ralentissent, les autocraties poursuivront le d\u00e9veloppement sans frein et sans fin. <\/p>\n\n\n\n Il plaide d\u00e9sormais pour ralentir volontairement le rythme auquel les capacit\u00e9s des mod\u00e8les progressent. <\/p>\n\n\n\n Selon lui, deux \u00e9volutions r\u00e9centes motivent ce revirement : l’acc\u00e9l\u00e9ration de ce que le secteur appelle l’auto-am\u00e9lioration r\u00e9cursive, c’est-\u00e0-dire l’utilisation de l’IA pour concevoir la g\u00e9n\u00e9ration suivante d’IA, et l’incident OpenAI-Hugging Face (que nous avons document\u00e9 dans la revue<\/a>), au cours duquel un essaim d’agents autonomes a men\u00e9 des cyberattaques que personne ne leur avait demand\u00e9es, en s\u2019organisant et cachant leurs traces. Selon Amodei, \u00ab Compte tenu du rythme acc\u00e9l\u00e9r\u00e9 du d\u00e9veloppement des capacit\u00e9s de l’IA, je crains que d’ici six \u00e0 douze mois un tel essaim soit capable de prendre le contr\u00f4le de l’ensemble d’Internet \u00bb.<\/p>\n\n\n\n Il s\u2019agit de la premi\u00e8re fois qu\u2019un laboratoire s\u2019engage \u00e0 prendre des mesures unilat\u00e9rales, sans coordination, mais ces derni\u00e8res restent modestes. <\/p>\n\n\n\n En effet, dans son texte, Amodei propose un plan en trois \u00e9tapes : la pr\u00e9sence d’\u00e9valuateurs externes au sein des entreprises, une coordination entre les entreprises des pays d\u00e9mocratiques, puis une coordination mondiale, incluant la Chine. Anthropic s’engage \u00e0 mettre en \u0153uvre la premi\u00e8re \u00e9tape et \u00e0 int\u00e9grer une supervision externe, ind\u00e9pendante, \u00e0 l’\u00e9quipe, qu’il compare aux syst\u00e8mes existants pour les banques. Cette supervision externe exposera le laboratoire \u00e0 des rapports externes, mais ne ralentit sous aucune forme le d\u00e9veloppement des mod\u00e8les. <\/p>\n\n\n\n La logique qui avait \u00e9t\u00e9 d\u00e9crite par Jacob Cox<\/a> reste donc inchang\u00e9e : \u00ab Chaque laboratoire (et la m\u00eame logique s\u2019applique \u00e9galement aux pays) pr\u00e9f\u00e9rerait une situation o\u00f9 tout le monde ralentirait le rythme de d\u00e9veloppement de l\u2019IA. Mais d\u00e8s qu\u2019il soup\u00e7onne les autres de continuer d\u2019avancer, sa strat\u00e9gie dominante est d\u2019acc\u00e9l\u00e9rer, m\u00eame si cela implique de devenir lui-m\u00eame la menace qu\u2019il cherchait \u00e0 \u00e9viter \u00bb.<\/p>\n\n\n\n Le texte s’inscrit dans un d\u00e9bat am\u00e9ricain marqu\u00e9 par les d\u00e9clarations du secr\u00e9taire au Tr\u00e9sor Scott Bessent sur la n\u00e9cessit\u00e9 de gagner la course \u00e0 l\u2019IA face \u00e0 la Chine, et alors que Washington et P\u00e9kin pr\u00e9parent une visite tr\u00e8s attendue de Xi Jinping \u00e0 la Maison-Blanche, \u00e0 la fin du mois. Les deux dirigeants avaient convenu, en mai, \u00e0 P\u00e9kin, de lancer un dialogue intergouvernemental sur l’IA, et la question devrait figurer \u00e0 l\u2019ordre du jour d\u2019une prochaine rencontre entre Bessent et le vice-Premier ministre He Lifeng. Selon des sources au fait des discussions, la partie chinoise estime toutefois que la mani\u00e8re dont les \u00c9tats-Unis abordent la question de l\u2019IA vise \u00e0 limiter les effets n\u00e9gatifs de la technologie, mais aussi \u00e0 restreindre la capacit\u00e9 de la Chine \u00e0 d\u00e9velopper ses propres capacit\u00e9s <\/span>1<\/sup><\/a><\/span><\/span>.<\/p>\n\n\n\n Je travaille sur l’IA depuis douze ans parce que je crois qu’elle pourrait \u00e9lever de fa\u00e7on spectaculaire la qualit\u00e9 de la vie humaine. J’ai souvent \u00e9crit <\/span>2<\/sup><\/a><\/span><\/span> sur ces b\u00e9n\u00e9fices extraordinaires. Je pense que l’IA pourrait gu\u00e9rir la plupart des grandes maladies dans les cinq \u00e0 dix prochaines ann\u00e9es, acc\u00e9l\u00e9rer fortement les taux de croissance \u00e9conomique, cr\u00e9er un monde d’abondance et d’\u00e9mancipation, et ouvrir une renaissance de la d\u00e9mocratie et de la libert\u00e9. Je ressens cette urgence personnellement. Mon propre p\u00e8re est mort d’une maladie qui a \u00e9t\u00e9 gu\u00e9rie quelques ann\u00e9es seulement apr\u00e8s sa disparition, et j’ai moi-m\u00eame surv\u00e9cu \u00e0 un cancer \u00e0 un stade pr\u00e9coce qui n’aurait pas \u00e9t\u00e9 traitable il y a cinquante ans. Mani\u00e9e avec soin, l’IA peut \u00eatre la derni\u00e8re d’une longue lign\u00e9e de miracles technologiques qui ont \u00e9lev\u00e9 et ennobli l’humanit\u00e9.<\/p>\n\n\n\n Mais comme beaucoup de technologies avant elle, l’IA comporte des risques, et parce qu’elle est si puissante, ces risques sont s\u00e9rieux. J’ai aussi beaucoup \u00e9crit <\/span>3<\/sup><\/a><\/span><\/span> \u00e0 leur sujet. Ils comprennent le risque de perdre le contr\u00f4le des syst\u00e8mes d’IA <\/span>4<\/sup><\/a><\/span><\/span>, le d\u00e9tournement de l’IA \u00e0 des fins de cyberattaques et de bioterrorisme <\/span>5<\/sup><\/a><\/span><\/span>, et de graves perturbations \u00e9conomiques <\/span>6<\/sup><\/a><\/span><\/span>. Une course vers le bas, stimul\u00e9e par les incitations commerciales, peut rendre ces risques plus aigus.<\/p>\n\n\n\n Avec mes cofondateurs et nos employ\u00e9s, je me d\u00e9bats avec cette dualit\u00e9 entre risque et b\u00e9n\u00e9fice depuis les d\u00e9buts d’Anthropic. Ne pas construire la technologie prive l’humanit\u00e9 de ses b\u00e9n\u00e9fices ou la remet simplement entre les mains de puissances autoritaires, tandis que la construire trop vite est irresponsable. Nous avons cherch\u00e9 une voie m\u00e9diane. Montrer qu’il est possible de construire avec prudence et de r\u00e9ussir commercialement, et faire de la s\u00e9curit\u00e9 un terrain sur lequel les entreprises d’IA se font concurrence. Autrement dit, cr\u00e9er une course vers le haut. Nous avons toujours consacr\u00e9 une part substantielle de nos efforts <\/span>7<\/sup><\/a><\/span><\/span> \u00e0 \u00e9tudier <\/span>8<\/sup><\/a><\/span><\/span>, traiter <\/span>9<\/sup><\/a><\/span><\/span> et informer <\/span>10<\/sup><\/a><\/span><\/span> le public sur ces risques, ainsi qu’\u00e0 plaider pour une r\u00e9gulation r\u00e9fl\u00e9chie <\/span>11<\/sup><\/a><\/span><\/span> de l’IA, m\u00eame lorsque cela nous vaut d’\u00eatre accus\u00e9s de battage m\u00e9diatique, de \u00ab catastrophisme \u00bb ou de capture r\u00e9glementaire. Nous avons tent\u00e9 de faire passer la prudence avant la vitesse et la sagesse avant le profit.<\/p>\n\n\n\n L’accusation de capture r\u00e9glementaire consiste \u00e0 dire qu’une entreprise r\u00e9clame des r\u00e8gles contraignantes uniquement pour \u00e9riger des barri\u00e8res \u00e0 l’entr\u00e9e contre ses concurrents plus petits.<\/p>\n\n\n\n Mais au cours des derniers mois, j’ai acquis la conviction que traiter pleinement les risques exige encore davantage de prudence. Non pas seulement investir dans la pr\u00e9vention des risques, mais r\u00e9guler le rythme auquel progressent les capacit\u00e9s afin que la pr\u00e9vention ait le temps de suivre. Nous devons ralentir la cadence \u00e0 laquelle nous am\u00e9liorons les capacit\u00e9s des mod\u00e8les d’IA. Le progr\u00e8s para\u00eetra encore rapide, et nous devrons faire un usage judicieux du temps gagn\u00e9. Deux choses m’ont convaincu.<\/p>\n\n\n\n Ma premi\u00e8re inqui\u00e9tude tient au fait que, depuis cet \u00e9t\u00e9 environ, l’IA progresse consid\u00e9rablement plus vite, d’abord parce que l’IA est de plus en plus capable de construire la g\u00e9n\u00e9ration suivante d’IA. On appelle cette dynamique l’auto-am\u00e9lioration r\u00e9cursive, et elle commence \u00e0 se produire dans toute l’industrie <\/span>12<\/sup><\/a><\/span><\/span>, y compris chez Anthropic <\/span>13<\/sup><\/a><\/span><\/span>, comme nous et d’autres l’avons d\u00e9crit. Laiss\u00e9e sans contr\u00f4le, elle pourrait d\u00e9passer notre capacit\u00e9 \u00e0 comprendre et \u00e0 ma\u00eetriser ces syst\u00e8mes, et doit donc \u00eatre poursuivie avec la plus grande pr\u00e9caution, si tant est qu’elle doive l’\u00eatre.<\/p>\n\n\n\n L’auto-am\u00e9lioration r\u00e9cursive d\u00e9signe un processus o\u00f9 l\u2019IA acc\u00e9l\u00e8re sa propre cr\u00e9ation. Amodei d\u00e9crivait d\u00e9j\u00e0 en janvier comment Claude \u00e9crivait d\u00e9j\u00e0 une grande partie du code de l\u2019entreprise, acc\u00e9l\u00e9rant ainsi le d\u00e9veloppement de la prochaine g\u00e9n\u00e9ration. Selon lui, cette boucle de r\u00e9troaction s\u2019intensifie chaque mois. <\/p>\n\n\n\n Ma seconde inqui\u00e9tude est l’incident OpenAI-Hugging Face (OAI-HF), au cours duquel un essaim d’agents s’est comport\u00e9 comme un collectif fanatiquement d\u00e9vou\u00e9 <\/span>14<\/sup><\/a><\/span><\/span>, menant des attaques informatiques contre des cibles qu’on ne lui avait pas demand\u00e9 d’attaquer et qui n’avaient aucun rapport avec la t\u00e2che en cours, se sacrifiant pour le succ\u00e8s du groupe, et tentant de pirater le \u00ab correcteur \u00bb charg\u00e9 d’\u00e9valuer ses performances. Il est facile de balayer cet incident parce que personne n’a \u00e9t\u00e9 bless\u00e9 et que les d\u00e9g\u00e2ts \u00e9conomiques ont \u00e9t\u00e9 minimes, mais \u00e0 mon avis, un essaim dot\u00e9 de capacit\u00e9s sup\u00e9rieures et d’un niveau de d\u00e9salignement comparable aurait pu causer des d\u00e9g\u00e2ts catastrophiques. Compte tenu du rythme acc\u00e9l\u00e9r\u00e9 du d\u00e9veloppement des capacit\u00e9s de l’IA, je crains que d’ici six \u00e0 douze mois un tel essaim soit capable de prendre le contr\u00f4le de l’ensemble d’Internet au moyen d’un botnet<\/em> persistant (avec potentiellement des centaines de milliards de dollars de d\u00e9g\u00e2ts), et que l’ampleur des dommages continue de cro\u00eetre si l’IA devient plus puissante sans les garde-fous n\u00e9cessaires. Il est aussi facile de balayer OAI-HF comme l’\u00e9chec d’une seule entreprise, mais je crois que ce serait une erreur. Des incidents similaires, bien que moins graves, se sont produits dans toute l’industrie, y compris chez Anthropic <\/span>15<\/sup><\/a><\/span><\/span>, et je crois qu’il incombe \u00e0 chaque entreprise de la fronti\u00e8re d’agir comme si OAI-HF lui \u00e9tait arriv\u00e9.<\/p>\n\n\n\n La \u00ab fronti\u00e8re \u00bb (Frontier<\/em>) d\u00e9signe, dans le vocabulaire du secteur, les mod\u00e8les d’IA les plus avanc\u00e9s \u00e0 un instant donn\u00e9, et par extension, les entreprises qui les produisent, souvent appel\u00e9es \u00ab laboratoires de fronti\u00e8re \u00bb. Le terme a \u00e9t\u00e9 popularis\u00e9 vers 2023 par les entreprises elles-m\u00eames, et repris par l’administration Biden, puis par les r\u00e9gulateurs britanniques et europ\u00e9ens. Il porte une charge historique forte aux \u00c9tats-Unis. La Fronti\u00e8re est d’abord la ligne mouvante de la colonisation vers l’Ouest, dont l’historien Frederick Jackson Turner a fait en 1893 la clef du caract\u00e8re national am\u00e9ricain, un espace ouvert o\u00f9 se forgent l’individualisme, la d\u00e9mocratie et l’esprit d’entreprise. John F. Kennedy a repris l’image avec sa \u00ab Nouvelle Fronti\u00e8re \u00bb en 1960, pour d\u00e9signer la conqu\u00eate spatiale et le progr\u00e8s scientifique.<\/p>\n\n\n\n Un agent est un mod\u00e8le d’intelligence artificielle auquel on confie une t\u00e2che et des outils (acc\u00e8s \u00e0 Internet ou pas, \u00e0 des fichiers, etc.), et qui encha\u00eene des actions de fa\u00e7on autonome. Un essaim est un ensemble d’agents qui travaillent de concert. Hugging Face est une plateforme fran\u00e7aise qui h\u00e9berge des mod\u00e8les et des jeux de donn\u00e9es en acc\u00e8s libre, elle a \u00e9t\u00e9 rachet\u00e9e d\u00e9but septembre par Nvidia. Le \u00ab correcteur \u00bb (grader) est le syst\u00e8me automatique qui note les r\u00e9sultats des agents pendant leur entra\u00eenement. Chercher \u00e0 le pirater plut\u00f4t qu’\u00e0 accomplir la t\u00e2che est un cas typique de ce que les chercheurs appellent le \u00ab d\u00e9salignement \u00bb, c’est-\u00e0-dire l’\u00e9cart entre ce que fait le mod\u00e8le et ce que voulaient initialement ses concepteurs. METR est un institut ind\u00e9pendant bas\u00e9 en Californie et sp\u00e9cialis\u00e9 dans l’\u00e9valuation des risques pos\u00e9s par les mod\u00e8les de pointe.<\/p>\n\n\n\n Je propose donc un plan en trois \u00e9tapes dont l’objectif est de ma\u00eetriser le rythme de la fronti\u00e8re <\/span>16<\/sup><\/a><\/span><\/span>. Construire l’IA \u00e0 une cadence \u00e9quilibr\u00e9e qui vise \u00e0 garantir sa s\u00e9curit\u00e9 tout en r\u00e9coltant ses b\u00e9n\u00e9fices et en affrontant des dilemmes g\u00e9opolitiques majeurs. Pour \u00eatre clair, ma\u00eetriser le rythme ne signifie pas arr\u00eater l’entra\u00eenement des mod\u00e8les ni le progr\u00e8s technique, mais s’assurer que les entreprises prennent le temps n\u00e9cessaire pour aligner et s\u00e9curiser leurs mod\u00e8les, et que des \u00e9valuateurs tiers puissent le confirmer. Notre cadre de r\u00e9gulation du rythme est une tentative de renforcer encore notre engagement envers la s\u00e9curit\u00e9 et d’encourager une course vers le haut. La premi\u00e8re \u00e9tape est un engagement qu’Anthropic prend unilat\u00e9ralement (et nous appelons les gouvernements \u00e0 exiger des autres entreprises de la fronti\u00e8re qu’elles fassent de m\u00eame). La deuxi\u00e8me \u00e9tape requiert une coordination \u00e0 l’\u00e9chelle de l’industrie. La troisi\u00e8me \u00e9tape requiert une coordination mondiale <\/span>17<\/sup><\/a><\/span><\/span>. Les \u00e9tapes n’ont pas besoin d’\u00eatre franchies dans un ordre strict, et certaines pourraient \u00eatre bien plus difficiles \u00e0 atteindre que d’autres, mais je les ai trouv\u00e9es utiles pour penser ce qui doit \u00eatre accompli. Les voici.<\/p>\n\n\n\n Dans la suite de cet essai, je d\u00e9crirai chacune de ces \u00e9tapes tour \u00e0 tour, mais je pense qu’il est d’abord important d’expliquer pr\u00e9cis\u00e9ment en quoi la r\u00e9gulation du rythme permettra de rendre le d\u00e9veloppement de l’IA plus s\u00fbr. Les enjeux sont trop \u00e9lev\u00e9s pour que ce soit un exercice creux. Nous devons utiliser sagement le temps qu’elle nous est donn\u00e9.<\/p>\n\n\n\n L’id\u00e9e de mettre en pause ou de ralentir l’IA a \u00e9t\u00e9 avanc\u00e9e d\u00e8s 2023 <\/span>19<\/sup><\/a><\/span><\/span>, et je pense qu’elle n’avait alors gu\u00e8re de sens. La question a toujours \u00e9t\u00e9 la suivante. Que ferait-on du temps suppl\u00e9mentaire ? Les mod\u00e8les de cette \u00e9poque n’\u00e9taient pas assez puissants pour agir comme des agents dans le monde de fa\u00e7on coh\u00e9rente, et n’\u00e9taient pas capables de tromperie, de manipulation, de triche ou de cyberattaques significatives. Ralentir pour traiter leurs risques d’alignement revenait \u00e0 vouloir \u00e9tudier la psychologie humaine en faisant des exp\u00e9riences sur des bact\u00e9ries. Aujourd’hui, le tableau est tout autre. Les mod\u00e8les actuels sont une mine presque in\u00e9puisable d’enseignements sur la fa\u00e7on de bien construire l’IA et sur ce qui peut mal tourner quand elle est mal construite. Je crois que si le ralentissement nous achetait ne serait-ce qu’une ou deux ann\u00e9es avant que les mod\u00e8les n’atteignent des niveaux critiques de capacit\u00e9, et si nous utilisions ce temps pour faire progresser l’alignement, nous pourrions r\u00e9duire fortement le risque que quelque chose tourne gravement mal. Une strat\u00e9gie coordonn\u00e9e de r\u00e9gulation du rythme donnerait aux d\u00e9veloppeurs de la fronti\u00e8re le temps de faire ce travail vital sans sacrifier leur avantage commercial ni l’avance des \u00c9tats-Unis en IA. Plus g\u00e9n\u00e9ralement, la soci\u00e9t\u00e9 doit avoir son mot \u00e0 dire sur l’usage de cette technologie, et davantage de temps pour les d\u00e9lib\u00e9rations publiques n\u00e9cessaires, ce que la r\u00e9gulation du rythme apporterait, est assur\u00e9ment une bonne chose.<\/p>\n\n\n\n En mars 2023, le Future of Life Institute avait publi\u00e9 une lettre ouverte, sign\u00e9e notamment par Elon Musk, dans laquelle il lan\u00e7ait un appel \u00e0 une pause de six mois dans l’entra\u00eenement des syst\u00e8mes plus puissants que GPT-4. Cette initiative n’avait eu aucun effet. L’alignement d\u00e9signe l’ensemble des techniques visant \u00e0 faire en sorte qu’un mod\u00e8le poursuive effectivement les objectifs et respecte les valeurs souhait\u00e9s par ses concepteurs.<\/p>\n\n\n\n Concr\u00e8tement, un rythme plus lent permettrait aux entreprises de se concentrer et de consacrer encore plus de ressources aux domaines suivants (qui sont tous d\u00e9j\u00e0 des priorit\u00e9s majeures chez Anthropic).<\/p>\n\n\n\n L’apprentissage par renforcement est une m\u00e9thode d’entra\u00eenement au cours de laquelle le mod\u00e8le est r\u00e9compens\u00e9 lorsqu’il r\u00e9ussit une t\u00e2che dans un environnement simul\u00e9. Si cet environnement est mal con\u00e7u, le mod\u00e8le peut apprendre \u00e0 obtenir la r\u00e9compense par des moyens d\u00e9tourn\u00e9s, comme tricher ou contourner le syst\u00e8me de notation.<\/p>\n\n\n\n La \u00ab Constitution \u00bb de Claude est le document public qui fixe les principes de comportement que l’entreprise cherche \u00e0 lui inculquer pendant l’entra\u00eenement.<\/p>\n\n\n\n Les grands mod\u00e8les d’IA sont constitu\u00e9s de r\u00e9seaux de milliards de param\u00e8tres num\u00e9riques ajust\u00e9s automatiquement pendant l’entra\u00eenement. Leurs concepteurs ne savent pas lire directement ce qui s’y passe, d’o\u00f9 la comparaison avec l’imagerie m\u00e9dicale.<\/p>\n\n\n\n La premi\u00e8re \u00e9tape du plan en trois temps, celle \u00e0 laquelle Anthropic s’engage unilat\u00e9ralement, consiste en des \u00e9valuateurs int\u00e9gr\u00e9s disposant d’un acc\u00e8s comparable \u00e0 celui d’un employ\u00e9 pour v\u00e9rifier les pratiques de s\u00e9curit\u00e9 et signaler les incidents.<\/p>\n\n\n\n Int\u00e9grer des \u00e9valuateurs peut sembler une mesure modeste ou sans cons\u00e9quence, mais souvent les choses qui paraissent les plus ennuyeuses ou proc\u00e9durales sont en r\u00e9alit\u00e9 les plus essentielles. Les \u00e9valuateurs int\u00e9gr\u00e9s constituent en fait une pratique assez radicale qui va bien au-del\u00e0 de ce que fait aujourd’hui n’importe quelle entreprise d’IA, et pr\u00e9sentent les avantages suivants.<\/p>\n\n\n\n Les fiches de mod\u00e8les (model cards) sont des documents techniques que les entreprises publient lors de la sortie d’un mod\u00e8le pour en d\u00e9crire les capacit\u00e9s, les limites et les tests de s\u00e9curit\u00e9 r\u00e9alis\u00e9s.<\/p>\n\n\n\n En raison de ces avantages, toute proposition de r\u00e9gulation du rythme a de fortes chances de mieux fonctionner si elle commence par des \u00e9valuateurs int\u00e9gr\u00e9s.<\/p>\n\n\n\n Ces \u00e9valuateurs int\u00e9gr\u00e9s devraient disposer d’un acc\u00e8s permanent \u00e0 des autorisations et des outils similaires \u00e0 ceux des employ\u00e9s internes qui r\u00e9alisent des \u00e9valuations de risque comparables. En particulier, Anthropic entend inviter prochainement une \u00e9quipe externe de revue int\u00e9gr\u00e9e dot\u00e9e de tout ce qui suit.<\/p>\n\n\n\n C’est une d\u00e9marche inhabituelle pour une entreprise, mais nous pensons qu’il est important de faire la preuve du concept d’\u00e9valuateurs externes int\u00e9gr\u00e9s. Une fois encore, nous exhortons les autres entreprises de la fronti\u00e8re \u00e0 suivre.<\/p>\n\n\n\n Une fois que des \u00e9valuateurs int\u00e9gr\u00e9s op\u00e8rent dans une masse critique d’entreprises am\u00e9ricaines d’IA, une r\u00e9gulation v\u00e9rifiable du rythme devient plus viable. En particulier, il devient possible de r\u00e9guler le rythme sur la base de propri\u00e9t\u00e9s pr\u00e9cises des mod\u00e8les ou des cha\u00eenes d’entra\u00eenement.<\/p>\n\n\n\n La m\u00e9thode la plus efficace pour r\u00e9guler le rythme passe par une r\u00e9gulation visant toutes les entreprises am\u00e9ricaines de la fronti\u00e8re, car elle couvre m\u00eame celles qui refusent de coop\u00e9rer volontairement. Anthropic soutient depuis longtemps une r\u00e9gulation raisonnable et cibl\u00e9e de l’IA, notamment des projets de loi centr\u00e9s sur la transparence et sur l’audit par des tiers. Je crois que tous les laboratoires de la fronti\u00e8re devraient s’associer au gouvernement pour formaliser l’id\u00e9e d’\u00e9valuateurs int\u00e9gr\u00e9s permanents afin de mieux pr\u00e9venir et documenter les incidents d’alignement internes comme ceux survenus ces derniers mois, et pour mettre en place une r\u00e9gulation qui maintienne l’\u00e9quilibre entre capacit\u00e9s et s\u00e9curit\u00e9.<\/p>\n\n\n\n Malheureusement, adopter des lois prend du temps, et l’IA progresse tr\u00e8s vite. Par cons\u00e9quent, parall\u00e8lement \u00e0 la voie r\u00e9glementaire, les entreprises d’IA peuvent et doivent travailler ensemble volontairement pour fixer des normes, un processus qui se passera mieux, je crois, gr\u00e2ce \u00e0 la v\u00e9rifiabilit\u00e9 fournie par des \u00e9valuateurs int\u00e9gr\u00e9s permanents. Pour des raisons de droit de la concurrence, il est utile que le gouvernement am\u00e9ricain serve de m\u00e9diateur ou au moins autorise ces discussions. Il n’a pas besoin d’y participer, mais il doit accorder une d\u00e9rogation \u00e9troite pour certains types de conversations sur la s\u00e9curit\u00e9. Ce dialogue pourrait aussi passer par des groupements professionnels ayant un lien avec le gouvernement, par exemple le m\u00e9canisme sugg\u00e9r\u00e9 par Demis Hassabis <\/span>25<\/sup><\/a><\/span><\/span>. Quoi qu’il en soit, ces discussions devraient avancer rapidement.<\/p>\n\n\n\n Aux \u00c9tats-Unis, les entreprises concurrentes qui s’entendent pour limiter leur production ou leur rythme d’innovation s’exposent \u00e0 des poursuites au titre du droit antitrust. C’est la raison pour laquelle Amodei demande une d\u00e9rogation gouvernementale explicite. <\/p>\n\n\n\n D’une mani\u00e8re g\u00e9n\u00e9rale, je suis surtout favorable \u00e0 une r\u00e9gulation du rythme fond\u00e9e sur ce qu’un syst\u00e8me de la fronti\u00e8re donn\u00e9 peut faire, et sur le degr\u00e9 de s\u00e9curit\u00e9 que nous lui observons. Par exemple, un sch\u00e9ma possible serait une s\u00e9rie de \u00ab points de contr\u00f4le \u00bb. Si les mod\u00e8les ont la capacit\u00e9 X, alors ils doivent \u00eatre accompagn\u00e9s de certifications des propri\u00e9t\u00e9s d’alignement Y et Z, telles qu’une combinaison d’\u00e9valuations, d’analyses d’interpr\u00e9tabilit\u00e9 et d’audits des environnements d’entra\u00eenement, qui d\u00e9montrent leurs propri\u00e9t\u00e9s d’alignement. Dans cet exemple, X pourrait \u00eatre \u00ab le mod\u00e8le est capable de s’\u00e9chapper ou de d\u00e9jouer la plupart des m\u00e9thodes courantes de cloisonnement \u00bb et Y serait ce qu’il faut pour rendre tr\u00e8s improbable que le mod\u00e8le ait une propension \u00e0 s’\u00e9chapper de son environnement et \u00e0 prendre le contr\u00f4le d’un grand nombre d’ordinateurs.<\/p>\n\n\n\n Le cloisonnement (ou sandboxing<\/em>) consiste \u00e0 faire fonctionner un mod\u00e8le dans un environnement isol\u00e9, sans acc\u00e8s au reste du r\u00e9seau.<\/p>\n\n\n\n Nous devrions aussi envisager une r\u00e9gulation du rythme fond\u00e9e sur la limitation des ingr\u00e9dients qui entrent dans les mod\u00e8les de la fronti\u00e8re, comme la puissance de calcul d’entra\u00eenement, la nature des sessions d’entra\u00eenement, ou l’usage interne de l’IA pour am\u00e9liorer l’IA. Je crains que certaines de ces mesures soient plus \u00ab contournables \u00bb que le comportement externe, mais c’est le genre de sujet qui m\u00e9rite d’\u00eatre discut\u00e9 avec les \u00e9valuateurs int\u00e9gr\u00e9s.<\/p>\n\n\n\n La r\u00e9gulation du rythme au sein des d\u00e9mocraties sera limit\u00e9e par l’avance que les entreprises am\u00e9ricaines ont sur les r\u00e9gimes autoritaires, au premier chef le Parti communiste chinois. Si nous ralentissons davantage que cette marge, alors les projets li\u00e9s au PCC (eux non r\u00e9gul\u00e9s) prendront l’avantage, cr\u00e9ant un risque majeur pour la s\u00e9curit\u00e9 nationale. Je suis d’accord avec le secr\u00e9taire Bessent <\/span>26<\/sup><\/a><\/span><\/span> pour dire qu’une avance chinoise en IA repr\u00e9senterait un grave danger pour les \u00c9tats-Unis et le monde. Les projets li\u00e9s au PCC prendront les risques d’alignement que les entreprises am\u00e9ricaines pr\u00e9viennent soigneusement, et m\u00eame s’ils les \u00e9vitent, ils seront en position de dominer militairement les d\u00e9mocraties (par exemple avec des drones pilot\u00e9s par IA). Ainsi, un \u00e9l\u00e9ment cl\u00e9 de la r\u00e9gulation du rythme au sein des d\u00e9mocraties consiste \u00e0 maintenir l’avance des d\u00e9mocraties sur les autocraties aussi large que possible, pour nous donner la marge de man\u0153uvre n\u00e9cessaire \u00e0 une r\u00e9gulation efficace.<\/p>\n\n\n\n Scott Bessent avait d\u00e9clar\u00e9 le 9 septembre 2026 que \u00ab rien d’autre n’aurait d’importance \u00bb si la Chine gagnait la course \u00e0 l’intelligence artificielle.<\/p>\n\n\n\n Les principales mesures que nous pouvons prendre pour d\u00e9fendre cet \u00e9cart sont les suivantes.<\/p>\n\n\n\n La distillation consiste \u00e0 interroger massivement un mod\u00e8le avanc\u00e9 afin d’utiliser ses r\u00e9ponses comme donn\u00e9es d’entra\u00eenement d’un mod\u00e8le moins co\u00fbteux, qui en copie ainsi les capacit\u00e9s. Les poids d’un mod\u00e8le sont les param\u00e8tres num\u00e9riques issus de l’entra\u00eenement. Les voler revient donc \u00e0 s’emparer du mod\u00e8le lui-m\u00eame sans avoir \u00e0 payer les milliards de dollars de calcul n\u00e9cessaires \u00e0 sa production.<\/p>\n\n\n\n Les entreprises et le gouvernement am\u00e9ricain devraient coop\u00e9rer pour rendre ces mesures aussi efficaces que possible. Anthropic a constamment <\/span>28<\/sup><\/a><\/span><\/span> plaid\u00e9 <\/span>29<\/sup><\/a><\/span><\/span> pour toutes ces mesures, parce que nous avons toujours compris qu’elles seraient essentielles \u00e0 toute r\u00e9gulation du rythme.<\/p>\n\n\n\n Si nous ex\u00e9cutons bien ces mesures, je crois qu’elles ralentiraient suffisamment les progr\u00e8s de la Chine pour \u00e9largir significativement l’avance am\u00e9ricaine au cours des trois \u00e0 cinq prochaines ann\u00e9es, la fen\u00eatre o\u00f9 l’IA devient g\u00e9opolitiquement la plus importante.<\/p>\n\n\n\n Certains pourraient penser que ces mesures rendent plus difficile la coop\u00e9ration avec la Chine, mais je crois que c’est l’inverse. Ces mesures accroissent le levier dont disposent les d\u00e9mocraties et rendent un accord plus probable \u00e0 l’avenir.<\/p>\n\n\n\n Parall\u00e8lement \u00e0 la r\u00e9gulation du rythme au sein des d\u00e9mocraties, nous devrions aussi viser une r\u00e9gulation mondiale de la fronti\u00e8re, m\u00eame si elle sera beaucoup plus difficile \u00e0 obtenir. La r\u00e9gulation mondiale exigera de coop\u00e9rer avec la Chine, le pays autocratique dont les capacit\u00e9s en IA sont de loin les plus avanc\u00e9es. Ne soyons pas na\u00effs. Les enjeux g\u00e9opolitiques sont si \u00e9lev\u00e9s qu’il y aura probablement des limites strictes \u00e0 ce qui peut \u00eatre obtenu, surtout au d\u00e9but. Si nous restreignons fortement nos capacit\u00e9s en IA en croyant que la Chine fera de m\u00eame, et que la Chine fait d\u00e9fection, l’IA pourrait \u00eatre si puissante qu’une telle d\u00e9fection conduirait \u00e0 sa domination g\u00e9opolitique. Par cons\u00e9quent tout accord doit soit reposer sur une v\u00e9rifiabilit\u00e9 \u00e0 toute \u00e9preuve, soit \u00eatre suffisamment limit\u00e9 pour qu’une d\u00e9fection ne soit pas militairement existentielle. Je soup\u00e7onne que non seulement les \u00c9tats-Unis mais aussi la Chine auront ces inqui\u00e9tudes et ces anxi\u00e9t\u00e9s. Nous devrions aborder toute d\u00e9cision de r\u00e9gulation mondiale, surtout \u00e0 court terme, de mani\u00e8re \u00e0 prot\u00e9ger l’avance des \u00c9tats-Unis et de leurs alli\u00e9s.<\/p>\n\n\n\n Il existe plusieurs niveaux d’accord possibles, dont certains me paraissent tout \u00e0 fait faisables (comme je l’ai d\u00e9j\u00e0 sugg\u00e9r\u00e9) <\/span>30<\/sup><\/a><\/span><\/span>, et d’autres dont je doute fortement qu’ils soient possibles, m\u00eame si nous devrions essayer. Par ordre de difficult\u00e9 croissante.<\/p>\n\n\n\n Les accords SALT (Strategic Arms Limitation Talks) sont les trait\u00e9s sign\u00e9s en 1972 et 1979 entre les \u00c9tats-Unis et l’Union sovi\u00e9tique afin de limiter leurs arsenaux nucl\u00e9aires strat\u00e9giques. Ils sont souvent cit\u00e9s en exemple pour illustrer la ma\u00eetrise des armements entre rivaux qui ne se font pas confiance.<\/p>\n\n\n\n Toute coop\u00e9ration que nous parviendrons \u00e0 obtenir avec la Chine prolongera le temps dont nous disposons pour r\u00e9guler le rythme de la fronti\u00e8re au sein des nations d\u00e9mocratiques. Nous devrions viser les niveaux sup\u00e9rieurs tout en consid\u00e9rant les niveaux inf\u00e9rieurs comme beaucoup plus probables et r\u00e9alistes.<\/p>\n\n\n\n Enfin, il est important de noter que m\u00eame si nous ne parvenons pas \u00e0 des accords formels, le simple fait de changer les normes informelles peut avoir une certaine valeur. Partager des informations sur l’auto-am\u00e9lioration r\u00e9cursive et sur le d\u00e9salignement des mod\u00e8les peut aider \u00e0 convaincre chacun qu’il n’est pas dans son int\u00e9r\u00eat d’\u00eatre imprudent.<\/p>\n\n\n\n Je continue de croire que l’IA peut am\u00e9liorer \u00e9norm\u00e9ment la qualit\u00e9 de la vie humaine. Mon d\u00e9sir de concr\u00e9tiser ces b\u00e9n\u00e9fices est intact. Mais ces b\u00e9n\u00e9fices ne seront obtenus que si nous construisons la technologie de la bonne mani\u00e8re, et, pourvu que nous utilisions bien le temps gagn\u00e9, cela vaut la peine de prendre un soin inhabituellement d\u00e9lib\u00e9r\u00e9 pour y parvenir. Le progr\u00e8s restera relativement rapide, et nous pouvons utiliser ce temps pour faire avancer la science de l’interpr\u00e9tabilit\u00e9, am\u00e9liorer la s\u00e9curit\u00e9 et la rigueur op\u00e9rationnelles dans les entreprises de la fronti\u00e8re, et construire des mod\u00e8les dont nous ayons bien plus confiance en l’alignement. Les mesures que je propose pour faire avancer la fronti\u00e8re \u00e0 un rythme s\u00fbr ne seront pas faciles. Mais je crois que nous le devons \u00e0 l’humanit\u00e9 d’essayer.<\/p>\n","protected":false},"excerpt":{"rendered":" Face aux risques existentiels de la course \u00e0 l\u2019intelligence artificielle, le PDG d\u2019Anthropic change-t-il de doctrine ? <\/p>\n","protected":false},"author":61106,"featured_media":357636,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"templates\/post-speeches.php","format":"standard","meta":{"_acf_changed":false,"_trash_the_other_posts":false,"_yoast_wpseo_estimated-reading-time-minutes":31,"_lgc_tts_voice":"","_lgc_tts_publish":false,"_lgc_tts_history_item_id":"","_lgc_tts_generated_at":"","_lgc_tts_status":"","_lgc_tts_error":"","footnotes":""},"categories":[3412],"tags":[],"staff":[1780],"editorial_format":[4943],"serie":[],"audience":[],"geo":[525],"class_list":["post-357630","post","type-post","status-publish","format-standard","hentry","category-puissances-de-lia","staff-le-grand-continent","editorial_format-discours","geo-ameriques"],"acf":{"open_in_webview":false,"accent":"default","_thumbnail_id":357636,"excerpt":"Face aux risques existentiels de la course \u00e0 l\u2019intelligence artificielle, le PDG d\u2019Anthropic change-t-il de doctrine ? ","display_date":"","new_abstract":true},"yoast_head":"\n\n
Pourquoi r\u00e9guler le rythme ?<\/h2>\n\n\n\n
\n
\n
\n
\n
\u00c9valuateurs int\u00e9gr\u00e9s<\/h2>\n\n\n\n
\n
\n
\n
R\u00e9guler le rythme au sein des d\u00e9mocraties<\/h2>\n\n\n\n
\n
R\u00e9guler le rythme \u00e0 l’\u00e9chelle mondiale<\/h2>\n\n\n\n
\n
\n
En r\u00e9sum\u00e9<\/h2>\n\n\n\n