Mesurer le général
Quels tests distinguent une compétence apprise, un raisonnement transférable et une véritable généralisation ?
Distinguer les capacités déjà observées, l’intelligence générale hypothétique et une superintelligence qui reste à démontrer.
TROIS NIVEAUX À NE PAS CONFONDRE
Les catégories servent de repères. Leurs frontières exactes sont débattues, et aucun test unique ne suffit à attribuer une intelligence générale.
Les modèles savent coder, traduire et raisonner dans de nombreux contextes, mais ils commettent encore des erreurs inattendues.
ObservéIdée d’un système capable de généraliser ses compétences à une très large variété de tâches. La définition opérationnelle reste controversée.
Définition débattueHypothèse d’une intelligence dépassant largement les performances humaines sur de très nombreux domaines cognitifs pertinents.
HypothétiqueUne IA qui dépasse un champion aux échecs ou résout une tâche mathématique difficile ne possède pas pour autant toutes les capacités nécessaires à une intelligence générale.
Les capacités sont souvent irrégulières : une réussite impressionnante peut coexister avec une erreur élémentaire. Une évaluation sérieuse doit donc examiner plusieurs domaines, la fiabilité et les conditions réelles d’usage.
LES QUESTIONS OUVERTES
Quels tests distinguent une compétence apprise, un raisonnement transférable et une véritable généralisation ?
Comment éviter qu’un système très compétent soit aussi trompeur, fragile ou difficile à corriger ?
Existe-t-il un point identifiable à partir duquel parler d’ASI serait justifié ?
Travaux de tiers, cités pour éclairer le domaine. Ils ne sont pas des réalisations d’AI4ASI.