Une méthode pour passer des réponses observées aux décisions et aux actions
La méthode INFERENCE examine la manière dont les outils d’IA générative présentent, comparent et recommandent une organisation, ainsi que les qualités et les risques qu’ils lui attribuent. Elle part des personnes qui les interrogent et des décisions qu’elles préparent. Elle confronte les réponses observées aux faits établis et aux sources disponibles pour définir les positions à défendre, les preuves à réunir et les actions prioritaires.
Le protocole public détaille les étapes de la méthode, les règles d’observation, les indicateurs et les limites de l’analyse. Il permet à chaque organisation de comprendre le travail réalisé et les éléments sur lesquels reposent les recommandations du cabinet.
Partir des personnes et des décisions qu’elles sont susceptibles de prendre
Une même organisation peut être recommandée à un acheteur, absente des réponses adressées à un journaliste et présentée à un candidat à travers une controverse ancienne. La méthode commence donc par cinq questions :
- Qui interroge l’outil ?
- Quelle décision ou quel jugement cette personne prépare ?
- Quels critères et quelles contraintes orientent son choix ?
- Que sait-elle déjà et dans quel contexte se trouve-t-elle ?
- Quel usage peut-elle faire de la réponse ?
Les personas décrivent ces situations du point de vue des personnes concernées. Ils servent à construire des parcours de conversation plausibles, comprenant une question initiale, des demandes de précision, des objections et des demandes de preuve.
Une méthode en trois temps
La méthode INFERENCE articule le diagnostic, les choix stratégiques et la conduite des actions. Le cabinet en assure la cohérence, avec l’intervention systématique d’experts techniques lors du diagnostic. Leur contribution à l’accompagnement dépend ensuite des problèmes identifiés et des actions retenues.
| Temps de la mission | Travail du cabinet | Résultat pour l’organisation |
|---|---|---|
| Observer et diagnostiquer | Définir les situations prioritaires et les conditions d’observation. Établir les faits avec les fonctions compétentes, examiner les sources et analyser les réponses au fil des conversations. Qualifier les écarts et leurs explications possibles. | Un diagnostic qui précise comment l’organisation est représentée, les conséquences possibles et les problèmes à traiter en priorité. |
| Définir la stratégie | Choisir les positions à défendre, les narratifs à préempter, les preuves à réunir, les reconnaissances à rechercher et les risques à traiter. Déterminer les actions et leur ordre de priorité. | Une recommandation stratégique, un plan à 90 jours et une trajectoire à 12 mois, assortis de critères de suivi. |
| Conduire les actions et adapter la stratégie | Préparer les briefs, préciser les responsabilités et organiser les validations avec les équipes internes et les prestataires existants. Dans l’accompagnement annuel, suivre les évolutions, traiter les alertes et ajuster les actions. | Des objectifs et des responsabilités précis, puis des éléments réguliers pour décider des actions à poursuivre, modifier ou interrompre. |
La mission ponctuelle établit le diagnostic, formule la recommandation stratégique et prépare les actions. Elle définit également les indicateurs et les modalités du suivi. L’accompagnement annuel pilote les actions avec les équipes internes et les prestataires de l’organisation, met en œuvre le suivi et adapte les recommandations aux évolutions observées.
Pour observer la représentation spontanée de l’organisation, le cabinet observe d’abord les réponses des outils sans leur fournir les faits et les preuves réunis pour la mission. Il compare ensuite ces réponses aux informations validées par l’organisation, afin d’identifier les erreurs, les omissions et les écarts à traiter.
Adapter l’observation aux enjeux
Le volume d’observations dépend de l’importance des décisions, de la diversité des publics, des langues et des territoires, ainsi que de la variabilité des premières réponses. Une exploration limitée peut suffire pour orienter une première analyse. Un enjeu commercial important, un risque réputationnel ou une erreur sur le cadre réglementaire peuvent nécessiter davantage de répétitions, de configurations et de validations humaines.
Le cabinet précise ce que les observations permettent de conclure et les incertitudes qui subsistent. Les recommandations tiennent compte de ce niveau de preuve.
Distinguer les causes possibles
Une absence ou une erreur ne provient pas nécessairement du site de l’organisation. Elle peut notamment être liée à une information périmée, une preuve insuffisante, une confusion d’entité, une difficulté d’accès aux contenus ou des critères de comparaison inadaptés.
Pour examiner ces possibilités, le cabinet utilise une grille en cinq fonctions : les connaissances acquises par le modèle, la recherche d’informations externes, l’identification des entités, la sélection et la synthèse des éléments, puis la formulation de la réponse.
Cette grille guide l’analyse sans prétendre reconstituer le fonctionnement interne d’un système propriétaire. Le diagnostic distingue les constats, les explications étayées et les hypothèses qui restent à vérifier. Les actions de GEO peuvent être mobilisées lorsque les problèmes identifiés justifient leur emploi.
Interpréter les évolutions avec précision
Le suivi distingue la réalisation des actions, les changements observés dans les réponses et les conséquences possibles pour les décisions concernées. Une évolution survenue après une intervention ne suffit pas à établir qu’elle en résulte.
Les comparaisons conservent les conditions d’observation et la variabilité des réponses. Elles servent à décider quelles actions poursuivre, adapter ou interrompre.
Consulter le protocole
Le protocole détaille les règles de chaque étape, le nombre et la répartition des observations, les indicateurs, les responsabilités et les livrables. Il précise également le traitement des situations sensibles et la vérification de la restitution du cadre réglementaire à partir d’un référentiel validé par les fonctions compétentes de l’organisation.
La version en ligne fait référence. Une version PDF permet la consultation hors ligne, l’impression et l’archivage.
Un état de l’art régulièrement actualisé
La méthode INFERENCE s’appuie sur des travaux consacrés aux systèmes génératifs, à la recherche d’information, à la vérification des faits et à l’usage des recommandations dans les décisions humaines. Le cabinet en tire des principes d’observation et d’analyse qui viennent éclairer sa pratique, en tenant compte des systèmes étudiés, des conditions expérimentales et des limites des résultats.
Cet état de l’art est réexaminé mensuellement. La bibliographie distingue les publications évaluées par les pairs, les prépublications, les rapports institutionnels, les études industrielles, les normes et les documentations techniques.
1. Jean-Daniel Lévy, « IA et politique : vers un outil d’aide, voire d’influence sur la décision ? », Terra Nova, 18 mai 2026. Note fondée sur une enquête Toluna Harris Interactive pour RTL et M6.
2. Patrick Lewis et al., « Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks », Advances in Neural Information Processing Systems, vol. 33, 2020.
3. OpenAI, « Web search » ; Google, « Grounding with Google Search » ; Anthropic, « Web search tool ». Documentations officielles, consultées le 17 septembre 2026.
4. Nelson F. Liu, Tianyi Zhang et Percy Liang, « Evaluating Verifiability in Generative Search Engines », Findings of the Association for Computational Linguistics: EMNLP 2023, p. 7001 à 7025.
5. Olivier Martinez, « Optimizing Visibility in Generative Engines: A Critical Survey of Generative Engine Optimization (2023–2026) », prépublication arXiv:2607.14035, 15 juillet 2026.
6. Raja Parasuraman et Dietrich H. Manzey, « Complacency and Bias in Human Use of Automation: An Attentional Integration », Human Factors, vol. 52, no 3, 2010, p. 381 à 410.
7. Gagan Bansal et al., « Does the Whole Exceed its Parts? The Effect of AI Explanations on Complementary Team Performance », Proceedings of the CHI Conference on Human Factors in Computing Systems, 2021.
8. Pranjal Aggarwal et al., « GEO: Generative Engine Optimization », Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining, 2024, p. 5 à 16.
9. Zikang Liu et Peilan Xu, « Think Before Writing: Feature-Level Multi-Objective Optimization for Generative Citation Visibility », Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics, 2026, p. 20290 à 20303.
10. Organisation internationale de normalisation, ISO 9241-11:2018, « Ergonomie de l’interaction homme-système, Partie 11 : utilisabilité, définitions et concepts », 2018. Norme internationale.
11. Rongwu Xu et al., « Knowledge Conflicts for LLMs: A Survey », Proceedings of the Conference on Empirical Methods in Natural Language Processing, 2024, p. 8541 à 8565.
12. Zhaochen Su et al., « ConflictBank: A Benchmark for Evaluating the Influence of Knowledge Conflicts in LLM », Advances in Neural Information Processing Systems, vol. 37, Datasets and Benchmarks Track, 2024.
13. Sebastien Kawada et Manolis Kellis, « Evidence Integration in Large Language Models », prépublication arXiv:2609.04290, 3 septembre 2026.
14. Nikhil Kandpal et al., « Large Language Models Struggle to Learn Long-Tail Knowledge », Proceedings of the 40th International Conference on Machine Learning, PMLR, vol. 202, 2023, p. 15696 à 15707.
15. Alex Mallen et al., « When Not to Trust Language Models: Investigating Effectiveness of Parametric and Non-Parametric Memories », Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics, 2023, p. 9802 à 9822.
16. Sewon Min et al., « FActScore: Fine-Grained Atomic Evaluation of Factual Precision in Long Form Text Generation », Proceedings of the Conference on Empirical Methods in Natural Language Processing, 2023, p. 12076 à 12100.
17. Mahe Chen, Xiaoxuan Wang, Kaiwen Chen et Nick Koudas, « Generative Engine Optimization: How to Dominate AI Search », prépublication arXiv:2509.08919, 10 septembre 2025.
18. Cate Dombrowski, « How LLMs Source Brand Information: An Analysis of 23,000+ AI Citations », Omniscient Digital, 8 janvier 2026. Étude industrielle.
19. Yext, « Yext Research: 86% of AI Citations Come from Brand-Managed Sources, Clarifying How Marketers Can Compete in the AI Search Era », 9 octobre 2025. Communiqué présentant les résultats d’une étude industrielle.
20. Haritz Puerto, Martin Gubri, Tommaso Green, Seong Joon Oh et Sangdoo Yun, « C-SEO Bench: Does Conversational SEO Work? », Advances in Neural Information Processing Systems, vol. 38, Datasets and Benchmarks Track, 2025.
21. Nelson F. Liu et al., « Lost in the Middle: How Language Models Use Long Contexts », Transactions of the Association for Computational Linguistics, vol. 12, 2024, p. 157 à 173.
22. Rahul Vishwakarma, Shushant Kumar et Ratnesh Jamidar, « What Gets Cited: Competitive GEO in AI Answer Engines », Proceedings of SIGIR 2026, p. 4950 à 4954. Version accessible sur arXiv.
23. Klaudia Jaźwińska et Aisvarya Chandrasekar, « AI Search Has a Citation Problem », Tow Center for Digital Journalism, Columbia Journalism Review, 6 mars 2025. Rapport de recherche.
24. Oli Elliott, « Representation of BBC News Content in AI Assistants », BBC Responsible AI Team, février 2025. Rapport de recherche.
25. European Broadcasting Union et BBC, « News Integrity in AI Assistants: An International PSM Study », 2025. Rapport de recherche.
26. Mrinank Sharma et al., « Towards Understanding Sycophancy in Language Models », International Conference on Learning Representations, 2024. Voir également la version révisée sur arXiv et la présentation des travaux publiée par Anthropic en 2023.
27. Myra Cheng et al., « ELEPHANT: Measuring and Understanding Social Sycophancy in LLMs », International Conference on Learning Representations, 2026.
28. Samuel Pfrommer et al., « Ranking Manipulation for Conversational Search Engines », Proceedings of the Conference on Empirical Methods in Natural Language Processing, 2024, p. 9523 à 9552.
29. Fredrik Nestaas, Edoardo Debenedetti et Florian Tramèr, « Adversarial Search Engine Optimization for Large Language Models », International Conference on Learning Representations, 2025.
30. Zexuan Zhong et al., « Poisoning Retrieval Corpora by Injecting Adversarial Passages », Proceedings of the Conference on Empirical Methods in Natural Language Processing, 2023, p. 13764 à 13775.
31. Wei Zou, Runpeng Geng, Binghui Wang et Jinyuan Jia, « PoisonedRAG: Knowledge Corruption Attacks to Retrieval-Augmented Generation of Large Language Models », 34th USENIX Security Symposium, 2025, p. 3827 à 3844.
32. Xi Chu et Yupeng Hou, « Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems », prépublication arXiv:2606.17443, version 2 du 21 août 2026.
33. Yizhu Wen et al., « Position: Generative Engine Optimization Creates Underexamined Risks, Governance Must Target Concentration, Disclosure, and Academic Blind Spots », 2026. Article de position accepté à l’International Conference on Machine Learning, Position Track. Version accessible sur arXiv.
34. Natalia Moskvina et al., « Multilingual large language models do not comprehend all natural languages to equal degrees », Scientific Reports, publication anticipée du 5 septembre 2026. Article accepté et évalué par les pairs, diffusé avant sa version définitive.
35. Guanxiong Huang et Sai Wang, « Is Artificial Intelligence More Persuasive Than Humans? A Meta-Analysis », Journal of Communication, vol. 73, no 6, 2023, p. 552 à 562.
36. Lukas Hölbling, Sebastian Maier et Stefan Feuerriegel, « A meta-analysis of the persuasive power of large language models », Scientific Reports, vol. 15, article 43818, 2025.
37. Francesco Salvi, Manoel Horta Ribeiro, Riccardo Gallotti et Robert West, « On the Conversational Persuasiveness of GPT-4 », Nature Human Behaviour, vol. 9, 2025, p. 1645 à 1653. Un rectificatif des auteurs a été publié en 2026 et est lié à cette notice.
38. Kobi Hackenburg et Helen Margetts, « Evaluating the persuasive influence of political microtargeting with large language models », Proceedings of the National Academy of Sciences, vol. 121, no 24, article e2403116121, 2024.
39. Thomas H. Costello, Gordon Pennycook et David G. Rand, « Durably Reducing Conspiracy Beliefs Through Dialogues with AI », Science, vol. 385, article eadq1814, 2024. Cet article fait l’objet de l’expression éditoriale de préoccupation mentionnée en [40].
40. H. Holden Thorp, « Editorial Expression of Concern », Science, vol. 392, no 6803, 2026, p. 1131. Signalement éditorial concernant l’article cité en [39].
41. Esther Boissin, Thomas H. Costello, Daniel Spinoza-Martín, David G. Rand et Gordon Pennycook, « Dialogues with large language models reduce conspiracy beliefs even when the AI is perceived as human », PNAS Nexus, vol. 4, no 11, article pgaf325, 2025.
42. Joseph A. Konstan et Loren G. Terveen, « Human-Centered Recommender Systems: Origins, Advances, Challenges, and Opportunities », AI Magazine, vol. 42, no 3, 2021, p. 31 à 42.
43. Arpita Vats, Vinija Jain, Rahul Raja et Aman Chadha, « Exploring the Impact of Large Language Models on Recommender Systems: An Extensive Review », prépublication arXiv:2402.18590, 2024.
44. Maurice Jakesch, Advait Bhat, Daniel Buschek, Lior Zalmanson et Mor Naaman, « Co-Writing with Opinionated Language Models Affects Users’ Views », Proceedings of the CHI Conference on Human Factors in Computing Systems, 2023.
45. Sebastian Krügel, Andreas Ostermaier et Matthias Uhl, « ChatGPT’s inconsistent moral advice influences users’ judgment », Scientific Reports, vol. 13, article 4569, 2023.
46. Shinnosuke Ikeda, « Inconsistent advice by ChatGPT influences decision making in various areas », Scientific Reports, vol. 14, article 15876, 2024.
47. Moshe Glickman et Tali Sharot, « How human–AI feedback loops alter human perceptual, emotional and social judgements », Nature Human Behaviour, vol. 9, 2025, p. 345 à 359. Première publication en ligne le 18 décembre 2024.
48. Jared Watson, Francesca Valsesia et Shoshana Segal, « Assessing AI Receptivity Through a Persuasion Knowledge Lens », Current Opinion in Psychology, vol. 58, article 101834, 2024.
49. Susanne Gaube et al., « Do as AI say: susceptibility in deployment of clinical decision-aids », npj Digital Medicine, vol. 4, article 31, 2021.
50. Jennifer M. Logg, Julia A. Minson et Don A. Moore, « Algorithm Appreciation: People Prefer Algorithmic to Human Judgment », Organizational Behavior and Human Decision Processes, vol. 151, 2019, p. 90 à 103.
51. Laura R. Marusich, Mary Grace Kozuch Dhooghe, Jonathan Z. Bakdash et Murat Kantarcioglu, « Human Decision-Making with Persuasive and Narrative LLM Explanations », prépublication arXiv:2605.23867, 22 mai 2026.
52. Shravika Mittal, Su Lin Blodgett et Q. Vera Liao, « Learning by Chatting? Investigating the Impact of Generative AI on Information Seeking and Learning », prépublication arXiv:2606.11669, 10 juin 2026, version 2 révisée le 7 août 2026.
53. Thomas H. Costello, Gordon Pennycook et David G. Rand, « Just the Facts: How Dialogues with AI Reduce Conspiracy Beliefs », prépublication PsyArXiv, 2025.
54. Esther Kaufmann et Alvaro Chacon, « A Critical Overview of Theories in Research on Judgment and Decision-Making Using Algorithmic Advice: The Potential of Cognitive Continuum Theory », Cognitive Systems Research, vol. 97, article 101462, 2026.
55. Shuai Qin, Guojia An, Weikang Guo, Pei Ke, Jiwei Wei, Yang Yang et Jie Zou, « From Topical Relevance to Answerability: Entailment Distillation for Conversational Retrieval », prépublication arXiv:2609.03482, 3 septembre 2026. Article annoncé comme accepté dans Findings of EMNLP 2026 sur la notice des auteurs.
56. Miao Liu et Zhizhe Liu, « Reading Is Not Using: Retrieval, Judgment, and the Design of AI Financial Research Workflows », prépublication arXiv:2608.24842, 25 août 2026.
57. Kunal Handa et al., « Enabling Independent Research on How People Use Claude », Anthropic, 26 août 2026. Présentation d’un programme de recherche et de résultats d’équipes partenaires, dont l’étude citée en [58].
58. Yijia Shao, Dora Zhao, Vishakh Padmakumar, Jennifer Wang et Diyi Yang, « Human–AI Collaboration at Scale: Task Criticality, Agency, and Friction Across 250,000 Conversations », prépublication, 21 août 2026.
59. Anthropic, « Building Effective Agents », 19 décembre 2024. Article technique de fournisseur.
60. Bumju Jung, Cameron W. Piercy et Patric R. Spence, « Normalizing AI: The Evanishing Effect and Rethinking the Machine Heuristic », Human–Machine Communication, vol. 12, 2026, p. 139 à 162.
61. Julius Schulte, Malte Bleeker et Philipp Kaufmann, « Don’t Measure Once: Measuring Visibility in AI Search (GEO) », prépublication arXiv:2604.07585, 8 avril 2026.
62. Jie Ouyang et al., « HoH: A Dynamic Benchmark for Evaluating the Impact of Outdated Information on Retrieval-Augmented Generation », Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics, vol. 1, 2025, p. 6036 à 6063.
63. A. Feder Cooper et al., « Machine Unlearning Doesn’t Do What You Think: Lessons for Generative AI Policy and Research », Advances in Neural Information Processing Systems, 2025. Version des auteurs accessible sur arXiv, révisée le 31 octobre 2025.
64. Varun Magesh, Faiz Surani, Matthew Dahl, Mirac Suzgun, Christopher D. Manning et Daniel E. Ho, « Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools », Journal of Empirical Legal Studies, 2025. Texte accessible sur le site de Stanford.
65. Google Search Central, « Optimizing Your Website for Generative AI Features on Google Search », documentation officielle, consultée le 17 septembre 2026.
66. Google Search Central, « Creating Helpful, Reliable, People-First Content », documentation officielle, consultée le 17 septembre 2026.
67. Google Search Central, « AI Features and Your Website », documentation officielle, consultée le 17 septembre 2026.
68. Google Search Central, « File Types Indexable by Google », documentation officielle, consultée le 17 septembre 2026.
69. Microsoft Bing, « AI Performance in Bing Webmaster Tools », documentation officielle, consultée le 17 septembre 2026.
70. National Institute of Standards and Technology, Artificial Intelligence Risk Management Framework (AI RMF 1.0), 2023. Cadre institutionnel volontaire de gestion des risques liés à l’IA. Le rapprochement porte notamment sur la prise en compte du contexte d’utilisation, la supervision humaine, la documentation des tests, l’explicitation des limites et le suivi des risques.