Quand un moteur IA récupère des sources, il remplit la fenêtre de contexte avec leur texte et génère une réponse à partir de ce qui tient. Un contenu clair, découpé en passages autonomes, trouve plus facilement sa place dans cette fenêtre et se cite plus fidèlement.
La fenêtre est finie : les moteurs privilégient donc les passages qui répondent directement à la question plutôt que les longs préambules. C'est une des raisons pour lesquelles une structure « réponse d'abord » obtient davantage de citations.
Comme elle se compte en tokens et non en mots, une page longue ou multilingue la remplit plus vite que son nombre de mots ne le laisse penser.