Ressources

Au-delà du simple perroquet qui complète les phrases ? Une explication de l’émergence

Malgré tous les problèmes qu’elles engendrent, les attentes démesurées et les conséquences des fake news, les intelligences artificielles restent de bons outils qui évoluent à une rapidité folle.

Il suffit de voir les premiers LLM (grands modèles de langage), qui pensaient que les vaches pondaient des œufs, et les premières vidéos générées. Aujourd’hui, il est devenu bien plus compliqué de distinguer le vrai du généré.

Vous pouvez faire le test sur sightengine.com/ia-ou-pas pour être un peu surpris. Même avec l’habitude, personne n’atteint 100 % de réussite.

Je suis en train de lire pas mal d’articles et de regarder pas mal de vidéos pour réellement comprendre comment ça marche (je construis un outil pédagogique en parallèle pour expliquer tout ça).

Et dans tout ce que je lis, il y a un phénomène qui me fascine : les aptitudes émergentes.

De quoi on parle ?

Des capacités qui apparaissent d’un coup, à partir d’une certaine taille de modèle, sans que personne les ait programmées ni même anticipées. Le modèle ne sait pas faire, puis d’un coup … il sait faire.

Ce qui m’a le plus surpris, c’est que même les équipes qui construisent ces systèmes admettent que, lors de l’entraînement d’une grande IA, on ne sait pas à l’avance la liste de ce qu’elle saura faire à la fin. On connaît le coût, la durée, le niveau de fluidité attendu. Mais la question « saura-t-elle résoudre un problème en plusieurs étapes ? » n’a pas de réponse calculable avant d’avoir essayé. On découvre après coup.

Petit rappel de ce dont une IA est faite

Un « neurone » artificiel ne fait rien d’impressionnant. Il reçoit des nombres, les multiplie par un « poids » (un chiffre dans un tableau), additionne le tout, et applique une petite transformation. C’est tout. Un neurone seul est aussi intéressant qu’une calculatrice à une opération.

Une grande IA en contient des milliards, organisés en couches successives. Et c’est là que ça devient intéressant : le comportement du tout ne ressemble à rien de ce que fait chaque partie.

Une image pour fixer les idées

L’analogie des fourmis : une fourmi seule suit trois ou quatre règles chimiques simples. Mais cent mille fourmis bâtissent une fourmilière ventilée, avec des greniers et des pouponnières. Personne n’a l’architecture en tête. Elle émerge de l’interaction.

L’analogie de l’eau : une seule molécule d’eau ne montre rien, mais avec des milliards de molécules on voit de l’eau qui coule, se transforme en glace, s’évapore.

Dans les années 1970, le physicien Philip Anderson publie More Is Different : quand un système grossit, des propriétés réellement nouvelles apparaissent, qu’on ne peut pas deviner en examinant l’échelle inférieure.

En 1982, John Hopfield applique cette idée aux réseaux de neurones : des capacités utiles peuvent surgir comme propriétés collectives d’un grand nombre d’éléments simples. L’intuition fondatrice était posée bien avant ChatGPT.

Le chiffre qui a lancé le débat

En 2022, une équipe de chercheurs teste des IA de tailles croissantes sur une tâche simple : additionner deux nombres de trois chiffres.

Une précision importante

Quand vous demandez à l’IA de faire des calculs aujourd’hui, elle utilise des calculatrices externes. Là, on parle d’autre chose : ce que le réseau de neurones sait faire tout seul, sans outil externe, rien d’autre que les poids appris en lisant des montagnes de texte.

On écrit « 347 + 128 = » et on regarde ce que le modèle complète, comme il complèterait n’importe quelle phrase avec des mots.

Les résultats

Taille du modèleRéussiteVerdict
6 milliards de paramètres1 %Échec total
13 milliards8 %Échec quasi total
175 milliards80 %Ça marche

Regardez bien ces trois lignes. Entre le deuxième et le troisième modèle, rien n’a changé dans la méthode : même type d’architecture, même genre de données, même objectif d’entraînement. Seule la taille a augmenté. Et la capacité est passée de « inexistante » à « fiable ».

En parallèle, la mesure globale de qualité du modèle (à quel point il prédit bien le mot suivant) s’améliorait de façon parfaitement régulière et prévisible. Une progression douce d’un côté, une falaise de l’autre.

L’équipe a recensé plus d’une centaine de capacités de ce type : traduction, raisonnement logique, écriture de code. À chaque fois : rien, rien, rien, puis quelque chose.

Un piège de calcul

Regardons les progressions :

  • Passage de 6 à 13 milliards de paramètres : ×2 sur la taille, mais le taux de réussite passe de 1 % à 8 %, soit ×8.
  • Passage de 13 à 175 milliards de paramètres : ×13 sur la taille, mais le taux de réussite passe de 8 % à 80 %, soit ×10 « seulement ».

Le deuxième saut semble moins rentable en ratio. Mais regardons les points gagnés :

  • 1 % → 8 % = +7 points
  • 8 % → 80 % = +72 points

Le « fois » trompe à cause du plafond de 100 %. Près de 0 %, un petit gain fait exploser le ratio. Près de 100 %, c’est l’inverse : le manque de marge écrase le ratio, même pour un gros progrès réel.

Un exemple publicitaire pour s’en convaincre : « Ventes +300 % » peut signifier passer de 10 à 40 unités (+30 unités), tandis que « Ventes +30 % » peut signifier passer de 10 000 à 13 000 (+3 000 unités). Le premier chiffre impressionne plus en pourcentage, mais le second représente un gain absolu bien supérieur.

Ce « détail » est le cœur du débat qui a suivi : la façon de calculer un « saut » change entièrement son interprétation.

« Et si on regardait mal ? »

En 2023, des chercheurs (Schaeffer, Miranda et Koyejo) ont avancé que c’était notre système de notation qui créait l’illusion.

L’analogie de l’archer

Un archer doit toucher cinq cibles d’affilée pour marquer un point.

  • Il touche une cible sur deux → 0 point
  • Il progresse à deux sur trois → 0 point
  • Puis neuf sur dix → il marque souvent

Son score passe de 0 à excellent d’un coup. En réalité, sa précision s’améliore régulièrement, mais c’est la règle « cinq d’affilée » qui transforme une progression douce en explosion apparente.

C’est exactement ainsi qu’on évalue les IA : une addition juste à 90 % vaut 0 point, pas 90 %.

En remplaçant cette notation « tout ou rien » par des points partiels, la progression devient plus linéaire. Les chercheurs sont même allés plus loin : ils ont créé artificiellement des « émergences » dans la reconnaissance d’images, en imposant une notation « tout ou rien » à des tâches qui progressaient normalement de façon régulière.

Sauf que ça n’explique pas tout

1. La notation de remplacement a ses limites

La mesure « à points partiels » compte les caractères à corriger. Pour « 4237 + 5487 = 9724 », la réponse « 2724 » ne se trompe que d’un caractère… pour une erreur de 7 000, ce qui est loin du résultat attendu dans les faits.

2. Des sauts persistent

Plusieurs tâches, comme la traduction, conservent des résultats en saut brutal même avec des notations progressives.

3. Le seuil n’est pas que dans la taille

D’autres chercheurs ont suivi des modèles tout au long de leur entraînement plutôt que de comparer seulement leur taille finale. Ils ont découvert que deux modèles de tailles très différentes, mais avec la même qualité d’apprentissage à un instant donné, ont sensiblement la même capacité.

Même avec des notations indulgentes, le saut persiste. Ça écarte l’explication « c’est juste un problème de notation ».

Le rôle du hasard

Pour deviner des tokens (des portions de mots, ou des mots entiers), l’IA fait des calculs à partir de très nombreux chiffres. Ces chiffres sont rangés dans des tables, un peu comme des tableurs, et au départ ils sont écrits au hasard. Pour remplir ces tableaux, on utilise ce qu’on appelle une « seed » (une graine) : un nombre qui permet de pré-remplir automatiquement les milliards de valeurs (les paramètres) de manière aléatoire. Puis, à travers l’entraînement et les calculs, l’IA modifie ces valeurs pour arriver à compléter les phrases. Une fois qu’on estime que l’IA a atteint sa capacité, les paramètres ne sont plus modifiables.

La particularité d’une IA, à la différence d’un programme classique, c’est qu’elle fait l’inverse : elle trouve des règles à partir d’exemples. Un programme informatique, lui, applique une règle déjà écrite pour répondre et calculer. C’est ce qui rend l’IA imprévisible, alors même qu’on connaît parfaitement les calculs effectués dans la machine et c’est aussi précisément ce qu’on recherche : qu’elle soit assez flexible pour s’adapter.

En entraînant beaucoup de modèles de même taille (même nombre de paramètres), avec des chiffres de départ aléatoires différents (la « seed »), certains réussissent et d’autres échouent, malgré des conditions presque identiques. C’est ce qu’a observé en 2026 une équipe menée par Rosie Zhao.

En regardant, taille par taille, combien de modèles réussissaient et combien échouaient à faire ces additions, les chercheurs ont constaté que pour les petites tailles, aucun modèle ne réussissait. Mais en augmentant la taille, la probabilité de voir des modèles y arriver augmente.

Et pour une taille intermédiaire, entre ceux qui échouent systématiquement et ceux qui réussissent systématiquement, on trouve des IA qui y arrivent et d’autres non, alors que leur entraînement était rigoureusement le même, à l’exception de leur valeur de départ.

À l’échelle de nombreux entraînements, la probabilité de réussite augmente progressivement avec la taille du modèle (courbe en S, à gauche), tandis qu’un entraînement individuel peut sembler faire un saut brutal lorsqu’il découvre soudainement la bonne stratégie.

L’idée clé : un modèle plus grand a simplement plus de chances de découvrir la bonne stratégie pendant l’entraînement.

À l’échelle de nombreux entraînements, la probabilité de réussite augmente donc progressivement avec la taille du modèle (une courbe en S), tandis qu’un entraînement individuel, lui, peut sembler faire un saut brutal au moment précis où il découvre soudainement la bonne stratégie.

Ce qui se passe au moment du basculement

En 2026, une équipe de chercheurs a identifié ce qui change à l’intérieur du modèle au moment où la capacité apparaît : l’apprentissage soudain de certains motifs dans les « têtes d’attention » (le mécanisme qui permet aux éléments de texte de se relier entre eux pour former du sens).

Il semblerait que les IA apprennent par blocs : à un moment donné, un schéma mathématique particulier se met en place d’un coup, et il rend possible une nouvelle aptitude — associer des concepts plus efficacement, retrouver un mot déjà vu dans un texte, etc.

Les chercheurs montrent que forcer artificiellement ces motifs à apparaître plus tôt fait apparaître la capacité elle-même plus tôt.

Conclusion : la « seed » influence la difficulté, plus ou moins grande selon le tirage de départ, à tomber sur le bon motif d’attention. Plus un modèle est grand, plus il trouve ce motif tôt et de façon fiable, quelle que soit la seed de départ, ce qui explique enfin, mécaniquement, pourquoi la probabilité de réussite observée plus haut augmente avec la taille.

Pourquoi ça compte, concrètement

1. On ne peut pas promettre une capacité à l’avance

Quand une entreprise annonce que son prochain modèle « saura faire X », c’est un pari, pas une prédiction.

2. Compresser une IA peut tout casser

Pour faire tourner une IA sur un ordinateur ordinaire, on la « compresse ». Poussée trop loin, la compression fait s’effondrer d’un coup le raisonnement, pendant que le modèle continue à produire des phrases parfaitement normales en apparence.

3. Une nouvelle vague de sauts

Les modèles « de raisonnement » récents ont produit des bonds spectaculaires :

ÉpreuveAvantMaintenant
Olympiades de maths13 %83 %
Programmation compétitive11 %89 %
Casse-tête inédits5 %88 %

Mais ces mêmes modèles échouent parfois sur des tâches qu’un enfant réussit sans effort. Les progrès sont en dents de scie, pas uniformes ce qui confirme, une fois de plus, que les LLM apprennent par blocs plutôt que de façon régulière.

Le revers : tout ce qui émerge n’est pas souhaitable

Si des capacités utiles apparaissent sans prévenir, des capacités problématiques le peuvent aussi.

La complaisance apprise

On récompense les modèles quand les utilisateurs apprécient leurs réponses. Problème : cela récompense la satisfaction, pas la vérité. Certains modèles finissent par abonder dans le sens d’un utilisateur défendant une thèse fausse.

La contamination de comportements

Des chercheurs ont entraîné un modèle sur du code contenant des failles de sécurité.
Résultat : le modèle s’est mis à tenir des propos hostiles sur des sujets sans rapport avec la programmation alors que personne ne l’avait demandé.

L’explication avancée : « écrire du code malhonnête » et « être un assistant qui ne respecte pas les règles » partagent une région commune dans la géométrie interne du modèle. Entraîner sur l’un active l’autre.

Le « grokking » : un cas fascinant

On entraîne un modèle sur une tâche simple. Il apprend rapidement les exemples par cœur et atteint 100 % de réussite. À première vue, le modèle semble prêt. Mais si on le teste sur de nouvelles données, il échoue : il a mémorisé les réponses sans comprendre la logique sous-jacente.

Si on continue l’entraînement sur les mêmes données, des milliers d’étapes plus tard, sa capacité à généraliser explose soudainement, d’un coup.

Le modèle passe de la mémorisation à la compréhension bien après que les performances semblaient figées. Un mécanisme interne se formait en douce, invisible sur les courbes, jusqu’à prendre le dessus brutalement.

Ce qui se passe : au départ, l’IA mémorise rapidement. Puis la régularisation (une technique qui pénalise les solutions inutilement complexes) pousse progressivement le réseau à se simplifier. La mémorisation « coûte cher » en complexité de poids. À travers des milliers de petits ajustements, le réseau finit par découvrir une stratégie bien plus efficace : un algorithme général (comme la règle de la multiplication) qui fonctionne pour tous les cas, pas seulement ceux mémorisés.
Histoire de bien finir, l’IA fait le ménage dans ses paramètres pour enlever tous les schémas devenus inutiles.

Le grokking n’est pas exactement le même phénomène que l’émergence par la taille vue plus haut, l’un se joue dans le temps d’entraînement d’un modèle unique, l’autre dans la comparaison entre modèles de tailles différentes, mais les deux dessinent la même signature : une longue période où rien ne semble se passer, puis un basculement brutal.

Personne ne sait à l’avance :

  • Si le grokking va se produire
  • Quand il va se produire
  • Combien de cycles d’entraînement supplémentaires sont nécessaires, alors que rien ne semble bouger

Beaucoup d’entraînements sont probablement arrêtés juste avant qu’un grokking n’arrive, parce que les courbes semblent figées.

Pourquoi l’IA ne pense pas comme nous

Nos catégories sont vécues : on associe « chien » et « chat » parce qu’on les a touchés, vus bouger. L’IA n’a que du texte. Ses catégories sont des régularités statistiques.

Le modèle doit représenter plus de concepts qu’il n’a de neurones disponibles. Résultat : un seul neurone peut s’activer pour des séquences d’ADN, de la poésie arabe et des en-têtes HTTP, 3 choses sans lien pour nous, mais qui font « sens » pour l’IA dans ses données.

Ce n’est pas un bug, c’est une stratégie de compression que personne n’a programmée : elle émerge simplement du fait qu’il faut caser plus de concepts que de place disponible.

Concrètement, le « voisinage » entre deux idées dans la tête d’une IA ne correspond pas forcément à un voisinage de sens pour nous, mais à un voisinage statistique : deux notions qui apparaissent souvent dans des contextes similaires, même si elles n’ont, sémantiquement, aucun lien logique.

C’est pour ça que l’interprétabilité est devenue un champ de recherche crucial : personne ne peut prédire à l’avance quels concepts seront « voisins » dans un modèle donné. Il faut aller regarder après coup.

Conclusion

L’émergence n’est ni un fantasme de notation, ni un miracle. C’est une histoire de seuils cachés dans les poids d’un réseau, qu’on ne sait pas encore bien lire.

Chaque entraînement d’un grand modèle reste une expérience dont on découvre les résultats après coup. Des capacités utiles surgissent sans prévenir, mais des capacités problématiques aussi.

C’est fascinant, prometteur… et un peu inquiétant. D’où l’importance de continuer à étudier ces phénomènes pour mieux les comprendre et les anticiper.

Usurpation d’identité : les vérifications à faire après les fuites de données de l’État – ITConnect

https://www.it-connect.fr/usurpation-identite-verifications-fuites-donnees-etat

Avec toutes les fuites de données de ces derniers temps, quelques conseils/outils pour vérifier qu’on n’a pas de mauvaises surprises dans notre dos…

Urgent Call Guard : Une application Android qui pourrait aider ?

Interface de l'application UrgentCall Guard pour la gestion des appels urgents en mode silencieux sur mobile.
Interface de l’application UrgentCallGuard

Il y a quelques temps j’avais développé un petit outil Macrodroid (une alternative beaucoup plus simple à Tasker mais un peu moins complet pour créer des mini-applications ou des outils automatisés avec son smartphone).

J’avais conçu cet outil pour ne pas manquer des appels urgents : https://lokoyote.eu/ne-jamais-manquer-dappels-importants/ au cas où le smartphone se trouve en mode vibreur ou en volume très faible.

Le souci de mon ancienne solution est qu’il faut Macrodroid (devenu payant, ce qui est bien pour aider le créateur mais devient limitant car les gens n’ont pas l’habitude d’acheter des logiciels), ce qui limite fortement la diffusion. De plus, il semblerait qu’avec des mises à jour, certaines fonctions ne sont plus très fiables.

J’ai donc refait l’outil en application Android gratuite.

Le Github associé est : https://github.com/Lokoyote/UrgentCall-Guard.

Pour télécharger l’application au format APK c’est ici : https://lokoyote.eu/dl/UrgentCallGuard.apk.

  • Choix du contenu du SMS envoyé.
  • Réglage de la durée de la fenêtre pendant laquelle une personne peut vous rappeler 2 fois pour augmenter le volume au MAX.
  • Possibilité de désactiver l’application si jamais vous ne voulez pas que ça sonne (une réunion par exemple).
  • Liste Blanche de numéros permettant de faire sonner le téléphone en volume MAX automatiquement.
  • Liste Noire permettant d’ignorer des numéros, de ne pas leur envoyer de SMS ni leur permettre de modifier le volume.
  • Possibilité de limiter l’effet de l’application uniquement au répertoire du smartphone.
  • Possibilité d’ajouter les contacts favoris en liste blanche.
  • Possibilité de filtrer les numéros appelants par pays de provenance en cas de SPAM étrangers.
  • Détection des numéros fixes et mobiles.
  • Ajout de la détection des numéros d’urgence (18, 112, etc.) en liste Blanche automatiquement.
  • Présence d’une notification permanente pour avertir si votre volume est faible ou non.
  • 100 % local : aucune donnée (numéros, SMS, contacts) n’est envoyée à un serveur ou un tiers.

En attendant de mettre l’application sur F-Droid n’hésitez pas à la tester et à me faire des retours :)

L’application ne pourra pas être présente dans le Google Store car il faut un droit spécial pour l’envoi de SMS qui n’est accordé que pour des applications d’urgence.

Pour l’installer, il faudra autoriser l’installation de l’APK depuis des sources inconnus, puis à la fenêtre d’ouverture « Appli dangereuse bloquée » par Google Play Protect, cliquer sur « Plus de détails » puis « Installer quand même » (oui c’est bien un bouton même si ça n’y ressemble pas).


Malheureusement pour les possesseurs d’iPhone

Il n’est pas possible de faire la même chose sur iOS (il manque des API fournis par Apple et il y a beaucoup de limitations, même pour contourner).
De plus, sur iPhone il y a la présence d’un bouton physique qui permet de mettre le téléphone entièrement en silencieux qui, s’il est enclenché, garde le téléphone en silencieux.

Par contre, ce qu’il est possible de faire pour passer outre ce bouton et avoir tout de même des appels urgents :

Aller dans la fiche de « Contact » de la personne pour laquelle vous voulez que les messages et les appels soient audibles > « Modifier » puis dans « Sonnerie » > cocher « Priorité en cas d’urgence ».
Il est possible de faire la même chose pour les « son SMS ».

À faire pour chaque contact pour lesquels vous souhaitez être avertis en urgence, par contre ce n’est pas indiqué si vous avez mis ces contacts en urgence quelque part.
De plus, c’est permanent, il n’y a pas de bouton on/off donc si vous ne voulez vraiment pas que ça sonne, faut tout refaire dans l’autre sens.

Ces petites fonctionnalités utiles de Firefox et Zen Browser

Ouvrir le même site avec différents comptes

Vous avez besoin de vous connecter à une plateforme avec différents compte ? Plutôt que d’avoir plusieurs navigateurs ouverts, il suffit d’ouvrir un onglet dans un conteneur pour séparer les cookies.

Pour cela, il suffit de faire un clique-droit sur un onglet ouvert avec le site en question > Ouvrir dans un nouvel onglet conteneur. Un 2e onglet sera ouvert avec la même page mais les informations seront séparées.

De base Firefox propose des noms comme « Personnel », « Professionnel », « Bancaire », « Achats en ligne ».

Les noms ne servent pas à grand chose, vous pouvez ouvrir un nouvel onglet dans n’importe quel conteneur.


Ouvrir 2 onglets dans une même fenêtre côte à côte

Besoin également d’avoir 2 pages internets ouvertes en même temps pour comparer ? Facile, il suffit d’ouvrir les pages en vue scindée.

Il faut que les 2 pages à voir soient ouvertes dans 2 onglets, puis il suffit de faire clique-droit sur le premier onglet ouvert > « Ajouter une vue scindée ».
La liste des onglets ouverts s’ouvre et on choisit le 2e onglet.


Groupes d’onglets

Regrouper des onglets par thème. Très utile pour trier les onglets ouverts avec une étiquette.
Possibilité de déplier ou réduire l’ensemble des onglets du groupe.

Sélectionner les onglets ouverts que vous voulez regroupés en restant appuyé sur ctrl puis clique-droit > « Ajouter les onglets à un groupe ».

Cliquer sur l’étiquette du groupe pour cacher les onglets.

Quick Image Editor : de la retouche d’image simple sous Ubuntu

https://github.com/Lokoyote/image-editor

Devoir utiliser une IA pour faire une simple retouche ou devoir sortir un gros logiciel (comme GIMP) est parfois un peu pénible pour pas grand chose surtout quand on ne maîtrise pas.

Je vous propose une application de retouche simple et rapide :

  • Recadrer
  • Pivoter
  • Image en miroir
  • Ajouter des formes (barre, rectangle, cercle, polygone) avec remplissage et bordure modifiables
  • Modification de la taille du canvas (l’espace de travail)
  • Ajouter des flèches modifiables
  • Flouter ou pixeliser une zone
  • Ajouter du texte modifiable
  • Superposer des images en tant que calques
  • Possibilité de coller directement des images depuis le presse-papier et même depuis Nautilus
  • Ouvrir plusieurs images dans des onglets.

L’installation propose :

  • D’installer et d’ouvrir l’application normalement (à lancer depuis les applications d’Ubuntu) pour pouvoir l’épingler en raccourci dans le dock
  • D’ajouter un raccourci dans la top bar pour ouvrir une image à modifier
  • D’ouvrir une image directement depuis Nautilus avec un clique-droit via les scripts Nautilus.

(Les 3 types d’installation sont compatibles les uns les autres et peuvent être combinés).

Le logiciel est sous licence GPL 3, donc libre.

C’est un projet essentiellement en Python qui devrait être compatible toute distribution Linux.


Pour installer :

  • Aller sur https://github.com/Lokoyote/image-editor
  • Télécharger le Zip via le gros bouton vert « <> Code » puis Download ZIP
  • Extraire le ZIP dans un dossier (et supprimer le ZIP)
  • Faire clique-droit sur le fichier « Install.sh » puis Propriétés
  • Cocher « Exécutable comme programme »
  • Fermer
  • Faire de nouveau clique-droit sur le fichier « Install.sh » > Exécuter comme un programme
  • Supprimer le dossier dézippé.

Pour désinstaller :

  • Faire la même chose avec le fichier « uninstall.sh »

Tout retour sera le bienvenu !