Longue Auto-Correction : repenser l'avenir de l'IA

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
La Longue Auto-Correction : un concept pour repenser notre approche de l'IA
La proposition de la Longue Auto-Correction émerge comme une alternative aux concepts de Pause de l'IA et de Longue Réflexion. Elle vise à repenser notre relation avec le développement des technologies d'intelligence artificielle en mettant l'accent sur l'amélioration de nos propres capacités humaines.
Les limites de la Pause de l'IA
L'idée de suspendre le développement de l'IA, souvent appelée Pause de l'IA, soulève des questions cruciales : jusqu'à quand devrions-nous arrêter, et dans quel but précis ? L'objectif sous-jacent semble être de garantir que les IA futures soient plus sûres. Cependant, le problème fondamental réside dans le fait que les humains eux-mêmes ne sont pas prêts à être les architectes, les superviseurs ou les bénéficiaires de ces technologies avancées. Notre incapacité à gérer ces rôles de manière sécurisée est un obstacle majeur à surmonter.
Les insuffisances de la Longue Réflexion
La Longue Réflexion, quant à elle, suggère que le principal défi est notre manque de temps pour bien réfléchir. Elle suppose que si nous pouvions simplement réfléchir davantage, ou si des IA alignées pouvaient nous aider à le faire, nous serions prêts à construire des technologies puissantes. Cependant, cette approche ne prend pas en compte les multiples défaillances humaines qui nécessitent une correction avant que nous puissions avancer en toute sécurité.
Un besoin de correction humaine
La Longue Auto-Correction propose un cadre pour aborder ces défaillances humaines. Nous ne sommes pas prêts à construire des technologies extrêmement puissantes car nous sommes actuellement trop imparfaits. Un processus long et incertain est nécessaire pour corriger ces défauts, et ce processus pourrait ne pas réussir.
Les défauts humains à corriger
Voici un résumé des défauts humains identifiés :
- L'absence d'un cadre moral opérationnel solide, avec des systèmes comme le conséquentialisme, la déontologie et l'éthique des vertus présentant tous des lacunes significatives.
- Une mauvaise performance en philosophie et en stratégie à long terme.
- Une surestimation de notre compétence philosophique et stratégique, malgré des preuves contraires, comme le montrent des cas tels que FTX et les débuts de MIRI.
- La morale humaine, souvent réduite à un jeu de statut, dévalorise la stratégie et la philosophie rigoureuses.
- Les motivations humaines sont souvent axées sur des valeurs positionnelles, telles que le pouvoir et le statut social, mais ces aspects sont rarement abordés dans les discussions sur la sécurité de l'IA.
- La facilité avec laquelle nous sommes manipulables par des concepts tels que la sycophantie ou des idéologies comme l'Objectivisme.
- Une incompréhension de la nature de la philosophie, nous empêchant d'aborder correctement ces problèmes.
- Une sous-estimation de l'ampleur des défaillances humaines et des problèmes de sécurité liés à l'IA, menant à des solutions partielles trop optimistes.
Cette liste n'est pas exhaustive et omet, par exemple, le fait que l'humain moyen est souvent ignorant de nombreux problèmes cruciaux. De plus, nous avons des difficultés significatives en matière de coordination complexe à grande échelle, notamment dans l'adoption ou la mise en œuvre de politiques gouvernementales qui seraient optimales.
Un espoir de progrès
Malgré ces défis, il existe un espoir que l'humanité puisse progresser. Historiquement, nous avons montré une capacité mystérieuse à avancer sur ces questions au fil du temps. Si nous parvenons à préserver un environnement propice à ce progrès et à éviter que quiconque ne le compromette définitivement, nous pourrions continuer à avancer vers une correction significative.
Vers une simplification conceptuelle
Il est probable que le concept de Longue Auto-Correction soit simplifié en "La Longue Correction" si l'idée gagne en popularité, à l'image de la façon dont "l'espace extérieur" est devenu simplement "espace".
L'altruisme efficace et les motivations humaines
Une question demeure : pourquoi n'existe-t-il pas une version de l'altruisme efficace qui exploite explicitement les motivations de statut pour améliorer le bien-être global ? Il est possible que discuter ouvertement de statut soit contre-productif à court terme, car cela pourrait renforcer les motivations de statut et réduire l'altruisme. Cependant, devons-nous avancer vers l'avenir en ignorant cet aspect de la nature humaine ?
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.