Nos travaux.
Le débat en mouvement.

Les publications de la Fondation et une sélection de recherches extérieures pour comprendre ce qui change dans les capacités des systèmes, leur supervision et leur place dans la société.

Nos publications

Actualités de la Fondation

Recherches & développements extérieurs

Veille IA

Chaque article présente une source originale datée et explique ce qu’elle apporte aux questions de la Fondation.

Veille IA · Source extérieure

Publication originale · · Agents & gouvernance

Quand les agents d’IA entrent dans les organisations

Une enquête de l’OCDE décrit comment des organisations expérimentent et encadrent les agents d’IA. Elle rend concrète une question de gouvernance : comment déléguer des actions tout en conservant des responsabilités et des recours lisibles ?

Source : OCDE

Lire l’article
Veille IA · Source extérieure

Publication originale · · Alignement & transparence

Documenter les écarts entre consignes et comportements

OpenAI présente un cadre de signalement accompagné de six rapports sur ses modèles. Ces observations invitent à examiner comment les preuves d’un comportement problématique deviennent accessibles, contestables et utiles à la supervision des systèmes.

Source : OpenAI

Lire l’article
Veille IA · Source extérieure

Publication originale · · Essai · Alignement & prospective

« An Alien Mind » : penser l’alignement face à l’auto-amélioration

Dans un essai prospectif, Jakub Pachocki examine l’alignement et la supervision d’IA qui contribueraient davantage à leur propre développement. Ses anticipations ouvrent un débat ; elles ne constituent pas une démonstration expérimentale d’auto-amélioration récursive.

Source : Jakub Pachocki · OpenAI

Lire l’article
Veille IA · Source extérieure

Publication originale · · Contrôle & supervision

Mettre les contrôleurs d’IA à l’épreuve

L’AI Security Institute décrit ses tests adversariaux de systèmes chargés de surveiller des agents. Repérer une faiblesse permet d’améliorer une protection ; cela ne suffit pas encore à mesurer la sûreté globale d’un système.

Source : AI Security Institute

Lire l’article
Veille IA · Source extérieure

Publication originale · · Recherche en IA & capacités

Mesurer ce que l’IA apporte à sa propre recherche

METR compare le coût et les gains de l’optimisation menée par des agents avec ceux du travail humain. Cette approche aide à examiner concrètement ce que l’IA apporte déjà au développement de futurs systèmes.

Source : METR

Lire l’article
Veille IA · Source extérieure

Publication originale · · Interprétabilité & conscience

Une fenêtre partielle sur les représentations internes des modèles

Une équipe d’Anthropic propose une méthode pour examiner certaines représentations internes des modèles. Ces expériences éclairent leur fonctionnement et leurs comportements, tout en laissant ouverte la question distincte d’une éventuelle expérience subjective des systèmes.

Source : Gurnee et al. · Anthropic

Lire l’article