📊

Compteur de fréquence des mots

Analysez la fréquence des mots dans n'importe quel texte. Trouvez les mots les plus courants, créez des nuages de mots.

Un compteur de fréquence des mots classe chaque mot d'un texte selon son nombre d'occurrences. Collez le texte dans Entrez le texte à analyser : le tableau se redessine à chaque frappe, sans bouton à presser. Un paragraphe de 38 mots sur un renard et un chien a donné Total de mots 26, Mots uniques 16 et Densité 61,5 %, avec fox à 5 (19,2 %), car Ignorer les mots courants est coché par défaut.

Total de mots
Mots uniques
Densité

Mots principaux ()

📊

Entrez le texte à analyser

Intégrer cet outil sur votre site

× px

                        

💡 Conseil d'intégration

Copiez le code d'intégration et collez-le dans le HTML de votre site. La version responsive s'adapte automatiquement à toutes les tailles d'écran.

1 avis

À propos de Compteur de fréquence des mots

Cette page compte les mots entièrement dans votre navigateur. Le texte est découpé sur tout ce qui n'est ni une lettre ni un chiffre, mis en minuscules si Ignorer la casse est coché, filtré avec une liste de mots vides intégrée si Ignorer les mots courants est coché, puis totalisé. Rien n'est téléversé, il n'y a pas d'autre limite de taille que la mémoire de votre navigateur, et le tableau se met à jour pendant la saisie plutôt qu'au clic sur un bouton.

Trois nombres surmontent le tableau. Total de mots est le décompte après filtrage, Mots uniques indique combien d'entrées distinctes contient la liste, et Densité vaut Mots uniques divisé par Total de mots, en pourcentage : c'est une mesure de la variété du vocabulaire, le rapport type-occurrence, et non la densité de mot-clé au sens des outils SEO. Cette dernière figure dans le tableau : le pourcentage affiché à côté de chaque mot est son propre nombre divisé par Total de mots.

Trois onglets changent ce qui est compté. Mots totalise les mots isolés ; Bigrammes totalise chaque paire adjacente et Trigrammes chaque triplet adjacent, tous deux construits à partir de la liste déjà filtrée : avec Ignorer les mots courants activé, les expressions obtenues associent des mots pleins qui n'étaient pas voisins à l'origine. Le panneau de résultats propose une vue Graphique en barres et une vue Nuage de mots, un sélecteur Afficher le top de 10, 30, 50 ou 100 lignes, et un bouton Exporter qui écrit ces lignes dans word-frequency.csv avec les colonnes Rank, Word, Count et Percentage.

La liste de mots vides est choisie d'après la langue de la page consultée ; il en existe pour l'anglais, le français, l'allemand, l'espagnol, l'italien, le portugais, le russe, le turc, le polonais et le chinois. L'outil n'ouvre pas de fichiers : il n'y a aucun champ de téléversement, un PDF ou un .docx doit donc être ouvert dans son propre lecteur et le texte copié ici. Comme le découpage ne garde que lettres et chiffres, les contractions se scindent — don't devient don et t — d'où le mot d'une seule lettre qui grimpe parfois dans le tableau.

Cas d'utilisation

Un correcteur qui relit un brouillon de 2 000 mots colle le texte, laisse Ignorer les mots courants activé et lit les dix premières lignes : un verbe à 2 % des mots pleins est en général le tic que l'auteur ne voit plus.
Une étudiante qui résume une œuvre passe à l'onglet Trigrammes pour repérer les tournures que l'auteur répète, puis exporte les 100 premières lignes dans word-frequency.csv afin de les trier dans un tableur.
Un rédacteur qui compare deux pages d'atterrissage analyse chacune et note la Densité : la version dont le rapport mots uniques sur total est le plus élevé est celle qui se répète le moins à longueur égale.
Un enseignant qui prépare une liste de vocabulaire décoche Ignorer les mots courants pour garder les mots outils, règle Afficher le top sur 100 et exporte le CSV comme liste de la classe.
Une traductrice qui vérifie la cohérence terminologique d'un long document colle le texte cible sur la page de cette langue, afin que la bonne liste de mots vides s'applique et que seuls les vrais termes remontent.

Comment utiliser

1

Collez ou tapez votre texte dans le champ Entrez le texte à analyser ; le tableau apparaît au fil de la frappe, sans bouton à presser.

2

Choisissez la façon de regrouper les mots avec les deux cases : Ignorer la casse fusionne Mot et mot, Ignorer les mots courants retire les mots vides de la langue de la page.

3

Sélectionnez un onglet : Mots pour les mots isolés, Bigrammes pour les paires adjacentes, Trigrammes pour les triplets adjacents.

4

Lisez Total de mots, Mots uniques et Densité au-dessus du tableau, puis la liste classée où chaque ligne affiche le nombre et sa part du total.

5

Basculez entre Graphique en barres et Nuage de mots, et réglez Afficher le top sur 10, 30, 50 ou 100 lignes.

6

Appuyez sur Exporter pour télécharger word-frequency.csv avec les colonnes Rank, Word, Count et Percentage pour les lignes affichées.

Astuces Pro

  • La tuile Densité vaut Mots uniques divisé par Total de mots, ce n'est pas la densité de mot-clé. Le chiffre demandé dans un brief SEO est le pourcentage affiché à côté de chaque mot du graphique, soit son nombre rapporté au Total de mots.
  • Tous les pourcentages sont calculés après filtrage. Avec Ignorer les mots courants coché, le dénominateur exclut les mots vides : les valeurs sont donc plus élevées qu'avec un outil qui compte tout. Décochez la case avant toute comparaison.
  • Bigrammes et Trigrammes sont construits sur la liste filtrée : avec Ignorer les mots courants activé, les paires réunissent des mots pleins qui n'étaient pas côte à côte dans le texte. Décochez d'abord la case pour obtenir de vraies expressions.
  • La liste de mots vides suit la langue de la page, pas celle de votre texte. Analyser un passage allemand sur la page française retire des mots outils français et laisse der, die et und en tête : ouvrez plutôt la version allemande de cet outil.
  • Exporter n'écrit que les lignes affichées, et Afficher le top vaut 30 par défaut. Réglez-le sur 100 avant d'exporter si vous voulez la traîne complète dans word-frequency.csv.

Dépannage

Problème:

Une lettre isolée comme t ou s se classe très haut.

Solution:

Les mots sont découpés sur tout caractère qui n'est ni une lettre ni un chiffre : les contractions se scindent, don't devient don et t, l'eau devient l et eau. Remplacez les apostrophes de votre texte avant de le coller, ou ignorez ces lignes.

Problème:

Total de mots est bien inférieur au nombre de mots annoncé par mon traitement de texte.

Solution:

Ignorer les mots courants est coché par défaut et retire une soixantaine de mots outils de la langue de la page avant tout comptage. Décochez la case pour voir le total complet, en sachant que tous les pourcentages changeront puisque le dénominateur augmente.

Problème:

Le CSV exporté s'arrête après 30 lignes.

Solution:

Exporter écrit exactement les lignes affichées, et le sélecteur Afficher le top vaut 30 par défaut. Réglez-le sur 50 ou 100, attendez que le tableau se redessine, puis relancez l'export.

Problème:

Un texte allemand ou turc laisse und, der ou bir en tête du classement.

Solution:

La liste de mots vides est choisie d'après la langue de la page, pas d'après votre texte. Ouvrez le même outil à son adresse allemande ou turque et collez-y le texte pour que la liste correspondante s'applique.

Questions fréquemment posées

Un outil qui prend un bloc de texte, le découpe en mots et indique combien de fois chacun apparaît, du plus fréquent au moins fréquent. Celui-ci ajoute la part du total que représente chaque mot, un décompte de mots uniques, trois modes de n-grammes et un export CSV. Tout le calcul se fait dans votre navigateur pendant la frappe : le texte ne quitte jamais la page.

À repérer les répétitions que l'on ne remarque plus, à vérifier qu'un document couvre vraiment les termes annoncés, à constituer des listes de vocabulaire, à comparer la variété de deux versions et à mesurer la présence d'un terme cible. C'est aussi la première étape de la plupart des analyses de texte : la liste classée dit de quoi parle un document avant même de le lire.

Pas en le téléversant : cette page n'a pas de sélecteur de fichier, seulement un champ texte. Ouvrez le PDF dans un lecteur, sélectionnez le texte, copiez-le et collez-le ici. Les PDF numérisés contiennent des images et non du texte : rien ne sera copié, il faut d'abord une reconnaissance optique. Idem pour les fichiers .docx.

Oui, et il n'y a aucune inscription. Le comptage est effectué par du JavaScript dans votre propre navigateur : il n'existe donc pas de quota serveur à vendre ni de limite de longueur au-delà de la mémoire de votre appareil. L'export CSV est inclus au lieu d'être la partie payante.

Non. L'outil fonctionne dans l'onglet déjà ouvert, sur téléphone comme sur ordinateur, et il continue de traiter un texte déjà collé si la connexion tombe, puisque l'analyse est locale. Il n'y a ni téléchargement ni extension de navigateur à ajouter.

En trois lignes : découpez le texte avec re.findall(r"[^\W_]+", text.lower()), passez le résultat à collections.Counter et appelez .most_common(30). Ajoutez votre propre liste de mots vides pour filtrer les mots outils. Cette page fait les mêmes étapes et y ajoute les pourcentages, les n-grammes et l'export, la partie la plus longue à écrire soi-même.

C'est Mots uniques divisé par Total de mots, en pourcentage. Sur le paragraphe d'exemple utilisé ici, il affichait 61,5 %, soit 16 entrées distinctes pour 26 mots comptés. Une valeur élevée signale un vocabulaire varié, une valeur basse des mots qui reviennent. Ce n'est pas la densité d'un mot-clé donné, laquelle figure à côté de chaque ligne.

Parce qu'Ignorer les mots courants est coché par défaut et retire une soixantaine de mots outils très fréquents dans la langue de la page avant tout comptage. Décochez la case et le, la, de et les autres réapparaissent dans le classement ; Total de mots augmente d'autant, ce qui abaisse tous les pourcentages.

Pas tant qu'Ignorer la casse est coché, ce qui est le réglage par défaut : Mot, mot et MOT sont regroupés en une seule entrée. Décochez la case et ils sont comptés séparément, ce qui sert à vérifier des noms propres ou des marques, mais scinde d'ordinaire un mot banal en deux lignes selon sa position en début de phrase.

Oui. Le bouton Exporter enregistre un fichier nommé word-frequency.csv comportant quatre colonnes — Rank, Word, Count et Percentage — et une ligne par entrée actuellement affichée. L'export respecte donc le réglage Afficher le top : passez-le de 30 à 100 si vous voulez davantage de lignes dans le fichier.

Outils populaires

Plus d'outils à afficher
Explorer tous les outils
FreeWebTools AI
Powered by free AI models · Full chat →