Aller au contenu
Rapport HEXART · 29 août 2026

224 articles rédigés par l'IA : rapport depuis notre propre site

Pendant cinq mois, nous avons publié sur ce site des contenus rédigés par un modèle de langage. Au total, 224 articles ont été produits. Seuls 18 pour cent répondent à une question réellement posée par les utilisateurs. Voici les chiffres, la méthode de calcul et l'impact d'une seule correction dans notre pipeline.

Nous publions ces données par manque de retours concrets sur le marché. Les guides sur l'IA et les mises en garde contre les pénalités SEO abondent, mais aucune entreprise ne dévoile les résultats réels de ses propres archives, y compris les échecs. Voici ce retour d'expérience.

Notre méthode de mesure

L'échantillon comprend 224 materiały publiczne de la rubrique actualités de hexart.pl, publiés entre le 3 avril et le 27 août 2026. Tous proviennent du même pipeline: le modèle choisissait le sujet, rédigeait le texte, sélectionnait les visuels et générait la voix off. Un opérateur humain validait la publication sans modifier le texte.

Nous divisons les données en deux périodes, suite à l'ajustement du pipeline le 19 août 2026: ajout d'une étape préalable pour cibler des requêtes sans réponse satisfaisante, et blocage systématique des contenus sans sources vérifiées. Ce point d'inflexion isole l'impact de ce changement précis du reste des tendances.

Les chiffres

7
IndicateurJusqu'au 18.08.2026À partir du 19.08.2026Pourquoi c'est important
Contenus publiés19311Le rythme a été volontairement réduit: de 82 contenus en avril à un par jour. Ce ralentissement n'a pas suffi à lui seul à améliorer les indicateurs suivants.
Le titre répond à une vraie intention de recherche34 (18%)11 (100%)Le chiffre le plus important de ce rapport. Quatre cinquièmes des publications des quatre premiers mois ne répondent à aucune question. Invité à proposer « du nouveau dans le secteur », le modèle invente le nom d'un phénomène et brode autour.
L'article comporte une liste de sources20 (9%)11 (100%)La phase de recherche existait déjà, mais ses résultats se perdaient avant l'enregistrement. Après correction, aucun contenu sans sources n'est mis en ligne. Pas même avec une visibilité réduite : rien n'est publié.
Acronyme inventé entre parenthèses dans le titre20Cas extrême du même mécanisme : le modèle baptise un phénomène, puis le réduit à un sigle de trois lettres pour lui donner des airs de terme technique.
L'article précise un montant, une date ou un chiffre0 (0%)10 (91%)Zéro n'est pas une image. Sur les 193 contenus de la première période, aucun montant en PLN n'apparaît : impossible d'évaluer un phénomène inexistant.
Lien vers la source dans le corps du paragraphe0 (0%)11 (100%)La liste de sources en bas de page est utile, le renvoi direct dans l'affirmation est indispensable. Sans lui, le lecteur ne peut rien vérifier et l'assistant IA n'a rien à citer.
Volume moyen d'un article1 822 caractères5 140 caractèresUn contenu qui répond à une question réelle est presque trois fois plus long. Formuler une réponse exige des conditions, des exceptions et des chiffres. La brièveté des débuts ne relevait pas de la concision, mais du vide.

Évolution dans le temps

La part dorée de la barre représente les contenus du mois qui répondent à une requête réelle. Le bond d'août s'explique par deux facteurs : un pipeline optimisé et vingt anciens articles réécrits manuellement sous les mêmes URL.

  • avril 202615/79 19%
  • mai 202620/61 33%
  • juin 20267/30 23%
  • juillet 20266/29 21%
  • août 202617/25 68%

Enseignements tirés des archives

5
  1. Le problème ne vient pas de la rédaction par un modèle. Il vient du prompt « écris sur un sujet inédit ».Invité à produire de la nouveauté dans un secteur, le modèle invente : il nomme un phénomène que personne n'a encore nommé et bâtit un texte autour. Le contenu obtenu est correct sur le plan linguistique, mais totalement introuvable : personne ne tape dans un moteur de recherche un nom inventé la veille. La même machine, soumise à une question réelle de client, rédige la réponse exacte à cette question. La différence tient en un seul paragraphe de consignes.
  2. Le volume de contenus sans valeur croît plus vite que le bénéfice de leur publication.Au plus fort de l'activité, 83% des URL du sitemap correspondaient à des articles d'actualité. La page d'offre destinée aux moteurs de recherche se retrouvait noyée parmi deux cents contenus sur des notions imaginaires. Après assainissement, cette proportion est tombée à la moitié, à nombre de pages d'offres constant.
  3. Supprimer est la pire décision possible.Une URL rendue publique doit continuer à répondre, sous peine de perdre les liens entrants. Un contenu sans potentiel reçoit la balise « noindex, follow », sort du sitemap et du flux RSS, mais reste en ligne et conserve son maillage interne. Le robot continue de le traverser vers les pages d'offres.
  4. Réécrire fonctionne mieux qu'ajouter un énième contenu à côté.Nous avons réécrit vingt contenus parmi les plus prometteurs sous leurs URL d'origine : nouveau titre, nouveau texte, liste de sources. Créer un nouvel article à côté d'un ancien gonfle le nombre de pages sans valeur ; remplacer le contenu à la même URL le réduit, tout en capitalisant sur une adresse déjà indexée.
  5. Un filtre automatique vaut mieux que de bonnes intentions.La consigne « écrivons sur ce que les gens cherchent » existait dès le début : elle n'a jamais fonctionné. Seule une règle dans le code, qui évalue le titre avant publication sans état d'âme, a donné des résultats. Une charte éditoriale sans contrôle technique reste une simple intention.

Notre méthode de calcul

« Répondre à une demande réelle » ressemble à un jugement de valeur, et le serait si un humain s'en chargeait. Chez nous, un programme applique la règle, celle-là même qui détermine l'indexation d'un contenu sur ce site. Cette règle est assez simple pour être reproduite sur vos propres archives :

  • Le titre est validé s'il commence par un mot interrogatif (combien, est-ce que, comment, quand, pourquoi, qui, où, que) ou s'il contient un point d'interrogation.
  • Il est également validé s'il comporte un montant avec son unité, un terme du registre juridique (RGPD, KSeF, loi, contrat, consentement) ou une promesse de méthode (guide, pas à pas, modèle, checklist).
  • Il est rejeté d'office s'il contient un acronyme en majuscules entre parenthèses. C'est la signature type d'un concept inventé par un modèle.
  • Il est rejeté si le total des termes anglophones du secteur et des mots étrangers avec une majuscule en milieu de phrase est supérieur ou égal à deux.
  • Le premier mot de chaque phrase et les termes entièrement en majuscules sont ignorés, pour éviter qu'un titre ne déclenche une fausse alerte systématique.

La règle est stricte par conception et écarte aussi des contenus potentiellement utiles. C'est délibéré : le coût d'un faux rejet est un article non indexé, le coût d'une fausse validation est une page sans valeur de plus dans le sitemap. Les chiffres présentés constituent donc une estimation basse.

Comment appliquer cette méthode chez vous

La séquence que nous avons suivie et que nous répéterions :

  1. Calculez la part. Prenez vingt titres du dernier trimestre et testez chacun comme requête exacte dans un moteur de recherche. Si personne ne recherche cette formulation, l'article ne répond à aucun besoin.
  2. Vérifiez le plan du site. Quand plus de 80% des URL correspondent aux actualités, les pages d'offres disparaissent des résultats.
  3. Ne supprimez rien. Attribuez noindex, follow, retirez le contenu du plan de site et du flux RSS, tout en le conservant en ligne.
  4. Réécrivez les meilleurs contenus sous les mêmes URL.
  5. Modifiez le prompt du générateur : passez de « écris sur un sujet récent » à une question précise de client. Cela tient en un paragraphe et ne coûte rien.

Notre méthode de chiffrage pour ces nettoyages et déploiements figure sur la page tarifs des déploiements IA. Les règles de publication des contenus générés par notre système sont consultables sur la page contenus générés par l'IA.

Questions fréquentes

Google pénalise-t-il les contenus rédigés par l'IA ?

Pas pour l'auteur en soi. La documentation de Google traite le contenu génératif à part et ne retient pas l'outil comme critère. Le critère est l'objectif du site. La sanction vise la production massive de pages sans valeur pour le lecteur, qu'elles soient rédigées par un modèle ou par un humain. Dans nos archives, le problème n'était pas une pénalité, mais le silence : 224 contenus et aucun trafic, car personne ne cherchait nos sujets.

Combien de vos articles IA répondaient à une vraie requête ?

Sur 193 contenus générés jusqu'au 18 août 2026, 34 répondaient au critère, soit 18%. Sur les 11 générés après correction du pipeline : 11 sur 11. Le critère est mécanique : le titre doit débuter par un mot interrogatif, comporter un point d'interrogation, un montant, une référence réglementaire ou l'annonce d'un guide, sans inventer de concept fictif.

Qu'avez-vous modifié exactement dans le générateur ?

Trois éléments. Une phase de recherche avant rédaction, qui cible une question sans bonne réponse existante plutôt qu'un sujet tendance. Un filtre bloquant tout contenu dépourvu de sources. Et une file de sujets prioritaires basés sur une demande validée, traitée avant la recherche automatique. Le rythme de publication reste identique : un contenu par jour.

Que faire des articles sans valeur ajoutée ?

Ne pas les supprimer. Une URL rendue publique doit continuer de répondre, sous peine de perdre les liens entrants externes. La bonne méthode : balise « noindex, follow » sur le contenu sans potentiel, retrait du plan du site et du flux RSS, tout en le maintenant sur le site et dans le maillage interne. Réécrivez les contenus les plus prometteurs sous la même URL. Nous en avons réécrit vingt.

D'où proviennent les chiffres de ce rapport ?

D'un fichier unique : la base d'articles de hexart.pl au 29 août 2026. L'échantillon comprend 224 contenus publics mis en ligne entre le 3 avril et le 27 août 2026. Aucune donnée issue d'études tierces ni d'estimations : le rapport concerne un seul site et ne décrit que celui-ci.

Citations et contact

Les données de ce rapport sont librement réutilisables sans accord préalable. Insérez un lien vers cette page pour permettre la vérification de la méthodologie. Si vous gérez des archives similaires et souhaitez comparer vos résultats, ou pour obtenir les données brutes, écrivez à : biuro@hexart.pl.

Échange sans engagement

Réserver un atelier avec Paul

Trente minutes ou atelier complet, selon vos besoins. Choisissez votre créneau dans l'agenda, la confirmation est immédiate.

Paul Lazniak

Fondateur de HEXART