AEO — RAG — Chunks sémantiques

Comment réagir au choc de l'IA Overview de Google : connaître la RAG, l'AEO et les « chunks sémantiques » !

par Michel Brassinne et Claude Opus

Utiliser le générateur de chunks sémantiques
Transformez votre texte en blocs autonomes optimisés AEO

► Accéder au générateur

Comprendre l'utilité des chunks sémantiques

Les moteurs de réponse IA (AEO — « Answer Engine » qu'il faut « Optimiser », d'où AEO) ont remplacé la liste de liens de Google (les 10 liens de la page 1 de Google, la SERP — « search engine page results ») par une réponse qui précède toutes les autres. Une réponse IA synthétisée depuis des sources que l'utilisateur ne choisit plus. D'où la chute du taux de clic sur la liste qui suit le résumé de l'IA. Derrière ce bouleversement, existe une architecture à trois étages que tout producteur de contenu doit connaître et comprendre.

Depuis que les moteurs de réponse (Perplexity, ChatGPT, Google AI Overviews) supplantent les dix « liens bleus » de Google (SERP), un nouveau mécanisme s'impose. Il repose sur trois éléments : la RAG est le moteur, l'AEO est le résultat et les « chunks sémantiques » (l'écriture en « blocs autonomes » du point de vue du « sens », que vous allez devoir rédiger) sont le passage obligé entre les deux. C'est à ce niveau que vous pouvez agir pour avoir une chance d'être cité par l'IA (à condition que l'optimisation SEO soit déjà de qualité). Voici la mécanique de ce triptyque :

La RAG — Retrieval-Augmented Generation (Génération augmentée par récupération d'informations) est la mécanique interne, l'algorithme, des moteurs de réponse IA. Quand un utilisateur pose une question, l'algorithme de RAG va chercher sur le web les contenus qu'il juge pertinents, puis génère une synthèse et l'affiche. Une réponse qui suffit généralement à l'internaute qui a fait une recherche, une requête comme on dit.

L'AEO — Answer Engine Optimization (optimisation du moteur de réponse) est votre nouveau travail stratégique : l'objectif n'est plus seulement d'apparaître dans une liste de résultats de la SERP, mais d'apparaître dans le résumé IA, d'être la source (ou l'une des) que l'IA sélectionne, cite et restitue à l'internaute.

Entre ces deux pôles, les « chunks sémantiques » (chunk = fragment, morceau, et au total « blocs autonomes ») constituent le passage obligé. La RAG ne voit jamais un site dans sa globalité quand il construit sa réponse : il manipule des fragments, les vectorise, mesure leur proximité avec la requête. L'AEO consiste à façonner ces fragments de texte pour qu'ils soient sélectionnés. Chaque bloc de texte doit donc fonctionner comme une unité autonome, dense, complète du point de vue du sens, et donc capable de répondre seul à une question identifiable.

► Générateur de chunks sémantiques

Il s'avère que l'article de presse « classique » peut répondre à cette nouvelle obligation.

Rappel — Le format 1860

L'article de presse classique, celui que j'appelle le « format 1860 » (parce qu'il a été formaté à cette date), constitue encore aujourd'hui 90 % des articles de vos quotidiens (PQR ou PQN, presse quotidienne nationale ou régionale). Et le fait est que Google l'aime bien : tout simplement parce qu'il est clair, structuré, complet. Il est le fruit d'années de réflexion et de pratiques pour « accrocher » le lecteur du titre au point final.

Pour mémoire, voici son découpage : il est composé d'un surtitre (descriptif), d'un titre (accrocheur), d'un chapô (résumé de l'article qui doit répondre à toutes les questions de base : Quoi ? Qui ? Où ? Quand ? Comment ? Pourquoi ? Combien ?). En anglais, ça donne « 5W+2H » (what, why… + How, How much). Ensuite viennent les paragraphes de l'article, généralement précédés d'un intertitre, qui résume le paragraphe qui suit. Et ces paragraphes sont présentés dans l'ordre décroissant d'importance. C'est ce qu'on appelle la « pyramide inversée ». On résume tout ça en disant qu'il s'agit d'un article classique en « 5W+2H et pyramide inversée ». C'est le « format 1860 » !

→ Voir tous les formats sur mes-prompts-ia.com
■ ACTION — L'article de presse classique n'est pas incompatible avec la logique des chunks sémantiques : il en est même le véhicule naturel. Car chaque paragraphe et son intertitre constituent un bloc exploitable par la RAG, à condition qu'il se suffise à lui-même. L'intertitre devient alors l'étiquette du paragraphe-chunk, l'opérateur d'appariement entre requête et paragraphe.

Le « format 1860 » n'a donc pas besoin d'être réinventé — il doit être habillé autrement : nommer, ne jamais sous-entendre : vous devez faire de chaque paragraphe une réponse complète à une question que le lecteur ou la machine pourrait poser. Et cette question peut apparaître dans le texte de l'intertitre.

À cet effet, j'ai construit un générateur de chunks sémantiques : vous insérez vos brouillons de texte et le générateur construit des chunks sémantiques optimisés AEO.

Michel Brassinne

👉 Voici un EXEMPLE de création de chunks sémantiques à partir du texte ci-dessus