Aller au contenu
QDNAApprendre l'IA, de débutant à expert
EN

Leçon 2 · Débutant · 15 min

Comment répond Gemini : prédiction de tokens et hallucinations

Comprendre le mécanisme de prédiction des tokens dans Gemini. Pourquoi le modèle invente des faits plausibles et comment le contraindre par la source.

Objectif
Vous comprendrez le fonctionnement probabiliste de Gemini pour anticiper les hallucinations et contraindre le modèle à s'appuyer sur vos sources.
Compétences
Vérifier
Comment répond Gemini : prédiction de tokens et hallucinations
Illustration générée par IA

Votre première tentative, sans aide

Demandez à Gemini de citer trois arrêts du Conseil d'État sur le télétravail parus en 2024 avec leurs numéros de pourvoi. Vérifiez si ces numéros existent.

En bref.

Gemini ne possède pas de recul critique : il prédit mathématiquement le mot suivant le plus probable en fonction de votre consigne. Sans source ni contrainte, il invente des détails crédibles (dates, noms, statistiques) pour satisfaire la demande. Pour obtenir une vérité factuelle, fournissez toujours le texte de référence et ordonnez-lui de dire « information non trouvée » si le document ne contient pas la réponse.

  1. 1La prédiction de morceaux de mots : une mécanique probabiliste

    La prédiction de morceaux de mots constitue le cœur probabiliste du fonctionnement de Gemini. Le modèle n'accède pas à une base de connaissances vérifiées : il calcule à chaque étape le token suivant le plus vraisemblable.

    Les modèles de langage découpent les textes en unités élémentaires appelées tokens (environ 4 caractères en français). Gemini évalue la distribution statistique de milliers de candidats possibles pour compléter la phrase. Ce mécanisme produit un style fluide et convaincant, mais il ne garantit aucun ancrage dans le réel. Sans contrainte documentaire explicite, le modèle comble les manques par des hallucinations très plausibles.

    Mécanisme Ce que fait le modèle Risque opérationnel Parade recommandée
    Découpage en tokens Segmente les mots en syllabes statistiques Confusion sur les chiffres rares ou codes Écrire les nombres clés en chiffres et en lettres
    Prédiction probabiliste Calcule la suite de mots la plus harmonieuse Invention d'arguments crédibles mais faux Fournir le document source dans le prompt
    Absence de vérification Ne dispose d'aucun module de vérité interne Affirmation péremptoire d'erreurs Imposer la consigne « information non trouvée »
    Schéma « Comment Gemini fabrique une réponse » : Votre prompt (texte + fichiers) ; Le modèle prédit mot après mot ; Une réponse plausible ; Vous vérifiez faits et sources. Note : Plausible ne veut pas dire vrai : le modèle n'a pas de base de faits, il complète du texte.Schéma « Comment Gemini fabrique une réponse » : Votre prompt (texte + fichiers) ; Le modèle prédit mot après mot ; Une réponse plausible ; Vous vérifiez faits et sources. Note : Plausible ne veut pas dire vrai : le modèle n'a pas de base de faits, il complète du texte.
    Schéma « Comment Gemini fabrique une réponse »Schéma généré par IA et relu
  2. 2Une bibliographie convaincante mais entièrement fictive

    Une bibliographie convaincante mais entièrement fictive illustre la tendance naturelle du modèle à fabriquer des références universitaires dès qu'on le sollicite sans document d'appui.

    Un juriste demande à Gemini la jurisprudence récente sur le droit à la déconnexion.

    Prompt faible.

    Donne-moi trois arrêts de la Cour de cassation de 2024 sur le droit à la déconnexion, avec leurs numéros de pourvoi exacts.
    

    Gemini invente trois numéros de pourvoi parfaitement formatés mais inexistants, car la grammaire juridique est respectée sans ancrage réel.

    Prompt fort.

    Voici l'extrait du recueil officiel de la chambre sociale [coller extrait vérifié]. À partir de ce texte exclusivement, cite les décisions rendues. Si un numéro de pourvoi n'est pas mentionné dans l'extrait, écris : Non précisé dans la source.
    

    Ce qui change. Le modèle est strictement borné à l'extrait fourni et la clause d'abstention neutralise l'envie statistique de compléter le vide par des inventions.

  3. 3Provoquer une hallucination puis la neutraliser par la contrainte

    Provoquer une hallucination puis la neutraliser par la contrainte vous apprend à observer concrètement la bascule entre génération libre incontrôlée et restitution rigoureuse de sources vérifiées.

    Copiez un court extrait d'article de presse. Posez à Gemini une question sur un fait absent du texte (par exemple le montant des investissements, alors que l'article ne parle que des recrutements). Constatez l'invention sans contrainte, puis relancez le prompt avec l'interdiction d'extrapoler.

    Lancez ce prompt :

    « À partir du texte ci-joint uniquement, quel est le budget alloué au projet ? Si l'information ne figure pas dans le texte, réponds exactement : Information non documentée. »

    Grille d'auto-évaluation : (a) le premier prompt met en évidence une invention plausible non sourcée ; (b) le second prompt fournit l'extrait textuel complet ; (c) la clause de refus explicite empêche toute hallucination.

    Ouvrir le composeur de prompt

  4. 4Prendre l'assurance du ton pour une garantie d'exactitude

    Prendre l'assurance du ton pour une garantie d'exactitude constitue le piège le plus fréquent, car la fluidité stylistique de Gemini masque souvent des contrevérités factuelles.

    Demander à Gemini « Es-tu absolument certain de ce chiffre ? » ne déclenche aucune vérification externe. Le modèle cherche simplement à paraître courtois et cohérent, confirmant souvent son erreur initiale avec de nouveaux arguments inventés de toutes pièces.

    Correction : ne demandez jamais confirmation orale au modèle ; exigez la citation exacte du passage source ou activez la double vérification Google Search.

    Règle à retenir : l'assurance stylistique d'un grand modèle de langage ne prouve jamais l'exactitude de ses affirmations.

  5. 5Quiz

    Trois questions, correction immédiate. Le retour explique chaque option.

    1. Comment Gemini produit-il son texte ?

    2. Pourquoi une hallucination de Gemini est-elle particulièrement dangereuse ?

    3. Quelle consigne réduit le plus efficacement les hallucinations documentaires ?

  6. 6Preuve de maîtrise

    Partagez votre test d'hallucination : le prompt sans source ayant généré un fait inventé, puis le prompt corrigé avec texte source et clause d'abstention stricte.

    Badge DébutantCette leçon compte pour le badge DébutantVoir les quatre badges

    Critères

Pour aller plus loin

Le glossaire définit l'hallucination, l'ancrage et le modèle de langage. La leçon suivante, Écrire un bon prompt Gemini : les quatre piliers PTCF, détaille la structure formelle d'une consigne professionnelle. Consultez également Chasse aux hallucinations dans Gemini pour détecter les erreurs chiffrées subtiles.

Questions fréquentes

Qu'est-ce qu'un token dans Gemini ?

Un token est un fragment de mot (environ 4 caractères en français). Gemini découpe votre texte en tokens et prédit mathématiquement le token suivant le plus probable.

Pourquoi Gemini invente-t-il des faits ?

Parce qu'il ne consulte pas une base de données de vérités : il assemble des suites de mots statistiquement plausibles. Sans contrainte de source, il complète le texte de manière crédible mais potentiellement fausse.

Comment éviter qu'il n'invente ?

En lui fournissant le document source directement dans le prompt, et en lui interdisant expressément d'utiliser des connaissances externes à ce document.

Sources