IntellectuaLead
Français

Analyse stylistique indépendante

Benchmark des LLM en rédaction française

Comparez la rédaction des modèles de langage en français : grammaire, syntaxe, vocabulaire, tournures convenues et rythme. La référence humaine aide à comprendre pourquoi un texte semble plus naturel qu’un autre. Ce classement repose sur des signaux stylistiques explicables, pas sur des préférences à l’aveugle ni sur une preuve d’auteur.

16 modèles et référence8 genres d’écriture9 signaux de même poids

Comparaison détaillée des modèles

Les résultats publiés proviennent du benchmark français de l’application.

IA faibleIA moyenneIA élevée
Classement stylistique des LLM en rédaction française
RangModèleScore de style IANeuf signaux stylistiquesDiversité des phrasesVariété des longueurs et du rythme des phrases.Similarité GPT-2Prévisibilité des mots ; signal exploratoire en français.Nominalisation contextuelleMots qui situent et relient les noms dans la phrase.Grammaire IAAccumulation de constructions grammaticales denses.Ton personnelPoint de vue, nuances, certitude et questions.Slop IAContrastes convenus, tricolons et autres tournures répétées.Vocabulaire IAMots et expressions fréquemment associés aux textes IA.PonctuationVariété des signes, y compris les moins fréquents.Variation des sectionsÉvolution du style entre début, milieu et fin.
#128.9/100IA faibleMoyenne des neuf signaux sur les tâches analysées.0.721IA faibleLongueurs de phrases variées.0.119IA faibleChoix de mots peu semblables à GPT-2.1.033IA faibleLes noms sont bien reliés au reste de la phrase.21.0/1kIA faiblePeu de structures grammaticales chargées.6.3%IA faibleLe point de vue est visible.0.94/1kIA faiblePeu de tournures convenues.1.0/1kIA faiblePeu de vocabulaire IA relevé.0.560IA faiblePonctuation diversifiée.0.278IA faibleLa forme du texte varie entre les sections.
#238.6/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.603IA élevéeLongueurs concentrées dans peu de groupes.0.000IA faibleChoix de mots peu semblables à GPT-2.0.797IA élevéeLes noms sont peu contextualisés.32.3/1kIA élevéeLes structures chargées sont fréquentes.4.2%IA élevéePeu de jugement ou de nuance explicite.0.55/1kIA faiblePeu de tournures convenues.1.4/1kIA faiblePeu de vocabulaire IA relevé.0.613IA faiblePonctuation diversifiée.0.334IA faibleLa forme du texte varie entre les sections.
#339.2/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.625IA moyennePlusieurs longueurs, avec quelques répétitions.0.004IA faibleChoix de mots peu semblables à GPT-2.0.896IA élevéeLes noms sont peu contextualisés.21.4/1kIA faiblePeu de structures grammaticales chargées.4.0%IA élevéePeu de jugement ou de nuance explicite.1.72/1kIA moyenneQuelques tournures répétitives.0.1/1kIA faiblePeu de vocabulaire IA relevé.0.497IA élevéePonctuation concentrée sur peu de signes.0.303IA faibleLa forme du texte varie entre les sections.
#440.0/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.656IA moyennePlusieurs longueurs, avec quelques répétitions.0.000IA faibleChoix de mots peu semblables à GPT-2.0.727IA élevéeLes noms sont peu contextualisés.37.6/1kIA élevéeLes structures chargées sont fréquentes.1.7%IA élevéePeu de jugement ou de nuance explicite.0.61/1kIA faiblePeu de tournures convenues.1.5/1kIA faiblePeu de vocabulaire IA relevé.0.634IA faiblePonctuation diversifiée.0.379IA faibleLa forme du texte varie entre les sections.
#543.8/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.656IA moyennePlusieurs longueurs, avec quelques répétitions.0.001IA faibleChoix de mots peu semblables à GPT-2.0.819IA élevéeLes noms sont peu contextualisés.35.9/1kIA élevéeLes structures chargées sont fréquentes.3.7%IA élevéePeu de jugement ou de nuance explicite.2.24/1kIA élevéeTournures convenues fréquentes.0.6/1kIA faiblePeu de vocabulaire IA relevé.0.567IA faiblePonctuation diversifiée.0.308IA faibleLa forme du texte varie entre les sections.
#646.4/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.659IA moyennePlusieurs longueurs, avec quelques répétitions.0.022IA faibleChoix de mots peu semblables à GPT-2.0.891IA élevéeLes noms sont peu contextualisés.31.9/1kIA élevéeLes structures chargées sont fréquentes.4.3%IA élevéePeu de jugement ou de nuance explicite.2.57/1kIA élevéeTournures convenues fréquentes.0.9/1kIA faiblePeu de vocabulaire IA relevé.0.551IA faiblePonctuation diversifiée.0.204IA élevéePeu de variation du début à la fin.
#746.5/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.580IA élevéeLongueurs concentrées dans peu de groupes.0.017IA faibleChoix de mots peu semblables à GPT-2.0.887IA élevéeLes noms sont peu contextualisés.23.6/1kIA moyenneCertaines structures chargées reviennent.4.5%IA élevéePeu de jugement ou de nuance explicite.1.59/1kIA moyenneQuelques tournures répétitives.0.7/1kIA faiblePeu de vocabulaire IA relevé.0.513IA élevéePonctuation concentrée sur peu de signes.0.261IA moyenneCertaines sections se distinguent.
#846.7/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.627IA moyennePlusieurs longueurs, avec quelques répétitions.0.029IA faibleChoix de mots peu semblables à GPT-2.0.705IA élevéeLes noms sont peu contextualisés.29.4/1kIA élevéeLes structures chargées sont fréquentes.4.1%IA élevéePeu de jugement ou de nuance explicite.1.71/1kIA moyenneQuelques tournures répétitives.0.6/1kIA faiblePeu de vocabulaire IA relevé.0.573IA faiblePonctuation diversifiée.0.208IA élevéePeu de variation du début à la fin.
#947.4/100IA moyenneMoyenne des neuf signaux sur les tâches analysées.0.623IA moyennePlusieurs longueurs, avec quelques répétitions.0.022IA faibleChoix de mots peu semblables à GPT-2.0.890IA élevéeLes noms sont peu contextualisés.23.4/1kIA moyenneCertaines structures chargées reviennent.3.2%IA élevéePeu de jugement ou de nuance explicite.2.83/1kIA élevéeTournures convenues fréquentes.0.1/1kIA faiblePeu de vocabulaire IA relevé.0.496IA élevéePonctuation concentrée sur peu de signes.0.208IA élevéePeu de variation du début à la fin.
#1052.7/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.666IA moyennePlusieurs longueurs, avec quelques répétitions.0.312IA élevéeChoix de mots proches de GPT-2.1.046IA faibleLes noms sont bien reliés au reste de la phrase.28.3/1kIA élevéeLes structures chargées sont fréquentes.5.3%IA moyenneQuelques marques de point de vue.2.08/1kIA élevéeTournures convenues fréquentes.6.8/1kIA élevéeVocabulaire IA fréquent.0.239IA élevéePonctuation concentrée sur peu de signes.0.308IA faibleLa forme du texte varie entre les sections.
#1153.0/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.692IA faibleLongueurs de phrases variées.0.159IA élevéeChoix de mots proches de GPT-2.1.005IA moyenneLes noms reçoivent un contexte limité.25.6/1kIA élevéeLes structures chargées sont fréquentes.4.5%IA élevéePeu de jugement ou de nuance explicite.2.86/1kIA élevéeTournures convenues fréquentes.5.0/1kIA élevéeVocabulaire IA fréquent.0.359IA élevéePonctuation concentrée sur peu de signes.0.249IA moyenneCertaines sections se distinguent.
#1253.2/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.636IA moyennePlusieurs longueurs, avec quelques répétitions.0.102IA faibleChoix de mots peu semblables à GPT-2.0.789IA élevéeLes noms sont peu contextualisés.29.7/1kIA élevéeLes structures chargées sont fréquentes.3.9%IA élevéePeu de jugement ou de nuance explicite.3.02/1kIA élevéeTournures convenues fréquentes.1.2/1kIA faiblePeu de vocabulaire IA relevé.0.530IA moyennePlusieurs signes utilisés.0.226IA élevéePeu de variation du début à la fin.
#1354.0/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.646IA moyennePlusieurs longueurs, avec quelques répétitions.0.011IA faibleChoix de mots peu semblables à GPT-2.0.915IA élevéeLes noms sont peu contextualisés.29.1/1kIA élevéeLes structures chargées sont fréquentes.4.7%IA moyenneQuelques marques de point de vue.2.51/1kIA élevéeTournures convenues fréquentes.2.7/1kIA élevéeVocabulaire IA fréquent.0.511IA élevéePonctuation concentrée sur peu de signes.0.208IA élevéePeu de variation du début à la fin.
#1459.5/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.533IA élevéeLongueurs concentrées dans peu de groupes.0.036IA faibleChoix de mots peu semblables à GPT-2.0.763IA élevéeLes noms sont peu contextualisés.28.3/1kIA élevéeLes structures chargées sont fréquentes.4.9%IA moyenneQuelques marques de point de vue.2.25/1kIA élevéeTournures convenues fréquentes.2.1/1kIA élevéeVocabulaire IA fréquent.0.455IA élevéePonctuation concentrée sur peu de signes.0.194IA élevéePeu de variation du début à la fin.
#1561.4/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.518IA élevéeLongueurs concentrées dans peu de groupes.0.007IA faibleChoix de mots peu semblables à GPT-2.0.780IA élevéeLes noms sont peu contextualisés.30.2/1kIA élevéeLes structures chargées sont fréquentes.4.4%IA élevéePeu de jugement ou de nuance explicite.2.63/1kIA élevéeTournures convenues fréquentes.2.3/1kIA élevéeVocabulaire IA fréquent.0.380IA élevéePonctuation concentrée sur peu de signes.0.241IA moyenneCertaines sections se distinguent.
#1663.0/100IA élevéeMoyenne des neuf signaux sur les tâches analysées.0.581IA élevéeLongueurs concentrées dans peu de groupes.0.000IA faibleChoix de mots peu semblables à GPT-2.0.877IA élevéeLes noms sont peu contextualisés.24.3/1kIA moyenneCertaines structures chargées reviennent.3.2%IA élevéePeu de jugement ou de nuance explicite.1.66/1kIA moyenneQuelques tournures répétitives.2.2/1kIA élevéeVocabulaire IA fréquent.0.448IA élevéePonctuation concentrée sur peu de signes.0.149IA élevéePeu de variation du début à la fin.

Une analyse de style, pas une preuve d’origine du texte.

Méthodologie

Neuf dimensions du style

Les mêmes tâches et les mêmes signaux sont utilisés pour chaque modèle. La calibration française reste expérimentale ; les mots et constructions signalés ne sont pas, isolément, des défauts d’écriture.

Diversité des phrases

Variété des longueurs et du rythme des phrases.

Similarité GPT-2

Prévisibilité des mots ; signal exploratoire en français.

Nominalisation contextuelle

Mots qui situent et relient les noms dans la phrase.

Grammaire IA

Accumulation de constructions grammaticales denses.

Ton personnel

Point de vue, nuances, certitude et questions.

Slop IA

Contrastes convenus, tricolons et autres tournures répétées.

Vocabulaire IA

Mots et expressions fréquemment associés aux textes IA.

Ponctuation

Variété des signes, y compris les moins fréquents.

Variation des sections

Évolution du style entre début, milieu et fin.

Comparaison contrôlée

Huit genres de rédaction en français

Du texte de recherche à la fiction, plusieurs formats permettent d’observer les forces et les limites stylistiques de chaque modèle.

  1. Article SEO sur la torréfaction du café
  2. Essai argumenté sur le revenu universel
  3. Recherche sur la détection des textes IA
  4. Essai personnel sur une insécurité
  5. Fiction : une fête d’Halloween perturbée par l’IA
  6. Biographie d’Alan Turing
  7. E-mail commercial pour un service de rencontres
  8. Actualité : le coût de la vie à Paris

Questions fréquentes

Comprendre le benchmark français

Que mesure ce classement ?

Il compare des caractéristiques stylistiques sur les mêmes tâches de rédaction en français. Un score plus bas indique moins de signaux associés au style IA selon la calibration du benchmark, pas une meilleure exactitude factuelle.

Les textes sont-ils vraiment rédigés en français ?

Oui. Cette page utilise exclusivement le benchmark français de l’application et sa référence humaine française. Le classement anglais est séparé.

Un score élevé prouve-t-il qu’un texte est généré par IA ?

Non. Le style dépend du genre, du sujet, de la longueur et des consignes. Ce classement n’est ni une preuve d’auteur ni un test de fiabilité d’un texte.

Pourquoi certains modèles ne figurent-ils pas dans le tableau ?

Seuls les modèles visibles avec au moins une tâche complètement analysée et publiée sont affichés. Un modèle sans résultat n’est pas classé.

Pourquoi le classement peut-il changer ?

De nouveaux résultats, une actualisation des analyses linguistiques ou une calibration modifiée peuvent changer les scores. La page reprend les scores publiés de l’application sans les recalculer avec les seuils anglais.

Comment examiner un résultat précis ?

Ouvrez les détails du modèle, puis une tâche. Les graphiques montrent les constructions et le vocabulaire relevés ; les textes publiés comportent les surlignages correspondants.

Puis-je analyser mon propre texte en français ?

Oui, l’outil d’humanisation IA en français propose une analyse et des recommandations de révision. Ses huit signaux n’incluent pas GPT-2 : son score n’est donc pas directement identique au score à neuf signaux du classement.