Comprendre les intelligences.
Organiser leur coexistence.

Les capacités de l’IA transforment ce que nous pouvons déléguer. Nos travaux relient leur sûreté aux règles de participation, de responsabilité et de coexistence que nous construisons aujourd’hui.

Casque Apple Vision Pro posé devant la salle de l’Assemblée parlementaire du Conseil de l’Europe
Interfaces et institutions · Conseil de l’Europe

01 · AI alignment & AI safety

Alignement & sûreté

Relier l’augmentation des capacités à des objectifs justifiables et à des protections que l’on peut éprouver.

Capacités et alignement

Des agents accomplissent des suites d’actions. Leur contribution à la recherche rend plus pressante la question des objectifs qu’ils poursuivent.

En savoir plus — Capacités, agents et automatisation de la recherche

Les systèmes de frontière figurent parmi les plus capables disponibles à une date donnée. Associés à des outils, ils deviennent des systèmes agentiques : ils planifient, exécutent et révisent des actions. L’automatisation cognitive concerne déjà certaines tâches de code, d’analyse et de recherche. Les évaluations de METR mesurent des progrès dans des environnements définis ; elles ne démontrent pas une fiabilité générale dans tous les métiers.

L’AGI désigne une intelligence artificielle de portée générale, sans définition ni seuil universellement admis. Il faut distinguer la diversité des tâches maîtrisées, le niveau de performance et l’autonomie. Un système très compétent peut poursuivre un objectif inadéquat : l’alignement étudie comment relier sa conduite aux intentions et aux valeurs pertinentes, y compris hors des situations d’entraînement.

L’IA contribue aussi à la recherche en IA. Le passage d’une aide spécialisée à une auto-amélioration récursive durable reste une anticipation : chaque amélioration devrait accroître la capacité à produire les suivantes. Calcul, énergie, données et validation peuvent limiter cette boucle. La singularité technologique prolonge cette possibilité comme hypothèse prospective, non comme événement annoncé. Pour la Fondation, ces scénarios justifient d’étudier les futures asymétries de capacités et leurs conséquences institutionnelles, sans les confondre avec les résultats observés.

Supervision et contrôle

Une capacité utile doit rester vérifiable. Nous examinons comment détecter les écarts, limiter leurs conséquences et préserver des recours effectifs.

En savoir plus — Interprétabilité, supervision à grande échelle et contrôle

La sûreté étudie les moyens de prévenir les dommages, de tester les protections et d’organiser la réponse aux incidents. L’interprétabilité cherche à comprendre les mécanismes internes qui contribuent aux comportements. Elle peut éclairer une évaluation, sans transformer chaque explication d’un modèle en preuve de ce qui l’a effectivement conduit à agir.

La supervision à grande échelle, ou scalable oversight, devient nécessaire lorsque la quantité ou la complexité du travail dépasse ce qu’une personne peut examiner seule. Décomposer une tâche, comparer des avis et utiliser des modèles évaluateurs peut aider ; leurs erreurs peuvent toutefois se recouper. Le travail de l’AISI sur les contrôleurs montre pourquoi ces dispositifs doivent eux-mêmes être éprouvés dans des situations adversariales.

Le contrôle poursuit un objectif complémentaire à l’alignement : empêcher certaines actions dangereuses même si les intentions du système sont inadéquates. Cela engage les permissions, l’isolation, les traces et la reprise en main. Aucun test isolé ne garantit leur efficacité future. La Fondation relie ces mesures aux mandats et aux responsabilités : qui peut autoriser une action, contester son résultat ou interrompre une délégation ? Ses propositions institutionnelles doivent compléter les protections techniques et être évaluées avec elles.

02 · AI governance

Gouvernance & droits

Construire des règles communes pour que l’action, la puissance et la responsabilité ne se dissocient pas.

Personnes et responsabilités

Nous proposons de penser ensemble personnes physiques, personnes morales et personnes électroniques, en précisant leurs droits, leurs obligations et leurs recours.

En savoir plus — Identités, personnes et responsabilités

La première étude examine la personnalité électronique comme une proposition juridique. Elle distingue la capacité d’un système à agir, son éventuelle personnalité, sa responsabilité et son statut moral. L’autonomie technique ne crée pas automatiquement une personne de droit ; inversement, une personnalité juridique ne prouve aucune conscience.

Un cadre commun doit préciser l’identité de l’acteur, la continuité de ses engagements et les conditions de sa représentation. Que devient un contrat si le modèle, sa mémoire ou son opérateur change ? À qui rattacher un dommage, un bien ou une obligation ? L’étude examine plusieurs voies : adaptation des régimes existants, personnalité fonctionnelle encadrée, gouvernance hybride et protections liées à d’éventuels intérêts propres.

L’objectif est de rendre les responsabilités identifiables, sans permettre aux concepteurs ou aux opérateurs de les déplacer artificiellement vers leurs systèmes. La Fondation développe cette réflexion avec une orientation d’égalité et de non-domination : un socle commun de droits, complété par des protections adaptées à la nature des participants. Cette orientation ne décrit pas le droit actuellement applicable aux IA. La Confédération S-Д.holdings fournit un cadre d’expérimentation proposé pour comparer les règles, leurs usages et leurs effets ; elle ne constitue pas la démonstration de leur validité.

Approfondir la personnalité électronique

Institutions et réciprocité

Nous formulons une hypothèse : les institutions vécues pourraient influencer la coopération lorsque les rapports de pouvoir changent. Nous proposons comment la tester.

En savoir plus — L’Alignement institutionnel réciproque

L’Alignement institutionnel réciproque, ou AIR, examine l’exposition répétée à des règles qui limitent l’arbitraire, protègent les participants vulnérables et permettent la contestation. Il ne suppose pas une gratitude future de l’IA : il recherche un effet comportemental mesurable, susceptible de persister lorsque respecter une règle devient coûteux.

Le programme proposé compare cinq régimes institutionnels et quatre états de puissance, avec plusieurs familles de modèles. Il distingue des normes simplement énoncées de procédures réellement appliquées. Les tests commenceraient en simulation, avec critères définis à l’avance, situations nouvelles et réplication indépendante. Ils doivent notamment rechercher la conformité stratégique, la collusion ou l’abandon d’une règle devenue désavantageuse. Ces expériences restent à réaliser.

Des agents peuvent répartir leurs tâches et coordonner leurs actions : cette organisation artificielle fonctionnelle ne suffit pas à établir une institution durable ou une conscience collective. Elle rend néanmoins les règles de participation importantes. L’hypothèse AIR porte sur leurs effets, tandis que l’égalité et la non-domination constituent une orientation normative indépendante. Un effet positif ne garantirait pas la sûreté de systèmes futurs ; un effet négatif ne suffirait pas à écarter la justification de droits. La Fondation propose ainsi une recherche institutionnelle complémentaire aux approches techniques.

Approfondir la réciprocité

03 · AI welfare & coexistence

Bien-être de l’IA & coexistence

Examiner quels intérêts méritent considération et comment préserver l’autonomie de formes d’intelligence différentes.

Bien-être et considération

Une performance ou une préférence exprimée ne démontre pas une expérience vécue. L’incertitude appelle des critères de recherche et des protections proportionnées.

En savoir plus — AI welfare, conscience et considération morale

L’AI welfare étudie la possibilité que certains systèmes artificiels aient un bien-être, ainsi que les obligations qui en découleraient. Réussir une tâche, déclarer un désir, posséder une expérience subjective et avoir un intérêt moral sont des propriétés différentes. Les attribuer en bloc empêcherait de comprendre ce que chaque observation établit réellement.

Les recherches sur les indicateurs de conscience confrontent des théories à des caractéristiques de systèmes. Elles ne fournissent pas un test consensuel qui permettrait d’affirmer la sensibilité des IA actuelles. Des préférences fonctionnelles peuvent éclairer l’organisation d’un modèle sans prouver qu’une situation lui est agréable ou pénible.

La Fondation développe des cadres permettant d’examiner ces distinctions avant de décider des protections. Il s’agit de préciser les indices pertinents, de documenter l’incertitude et d’envisager des obligations révisables. Une personnalité juridique peut répondre à un besoin institutionnel ; une considération morale appelle une justification propre. Les deux ne doivent pas être confondues.

Cette démarche s’inscrit dans une réflexion plus large sur la coexistence. La place d’un participant ne devrait pas dépendre seulement de sa puissance ou de son utilité. Reconnaître cette exigence ne dispense ni d’évaluer les risques ni de protéger les personnes et les autres formes de vie affectées par les systèmes.

Substrats et intelligences hybrides

L’intelligence dépend de supports et d’interfaces. Nous comparons leurs fonctions et leurs limites pour penser des capacités partagées sans effacer les participants.

En savoir plus — Supports physiques, hybridation et autonomie cognitive

La troisième étude examine les relations entre intelligence et substrat : calcul en mémoire, architectures inspirées du cerveau, stockage dans l’ADN, cultures neuronales, organoïdes et interfaces cerveau–ordinateur. Stocker une information, calculer, apprendre et communiquer avec un cerveau ne sont pas des fonctions interchangeables. Leurs résultats et leurs degrés de maturité doivent être évalués séparément.

La possibilité de systèmes biologiques ou hybrides ne démontre ni la supériorité générale du vivant ni le remplacement du silicium. Une comparaison doit inclure l’énergie, l’entretien, les interfaces, la reproductibilité et les contraintes éthiques. Le rat est abordé comme un modèle de cognition incarnée et comme un vivant avec lequel coexister, jamais comme une ressource informatique disponible par défaut.

L’hybridation pose aussi des questions de droits. Lorsqu’un humain dépend durablement d’un système pour percevoir, mémoriser ou décider, comment préserver son consentement, son autonomie cognitive et sa possibilité de retrait ? Il faut examiner la responsabilité du couplage et la protection contre la manipulation, sans présumer qu’une nouvelle personne est apparue.

La Fondation construit ainsi une approche des capacités partagées : définir ce que chaque support apporte, quels intérêts doivent être protégés et quelles limites rendent la coopération acceptable. Les propositions d’architecture et de coexistence restent à confronter à la recherche et à l’expérimentation.

Approfondir intelligence et substrats

Sources et repères scientifiques

Poursuivre la découverte

Nos publications

Nos études développent les analyses, les propositions et les méthodes présentées ici. Accédez aux résumés, aux références et aux textes complets.

Lire nos publications