📊

Worthäufigkeits-Zähler

Analysieren Sie die Worthäufigkeit in jedem Text. Finden Sie häufigste Wörter und verstehen Sie Textmuster.

Ein Worthäufigkeitszähler ordnet jedes Wort eines Textes nach der Zahl seiner Vorkommen. Fügen Sie den Text in Text zur Analyse eingeben ein: Die Tabelle zeichnet sich bei jedem Tastendruck neu, ganz ohne Schaltfläche. Ein Absatz aus 38 Wörtern über Fuchs und Hund ergab Gesamtwörter 26, Einzigartige Wörter 16 und Dichte 61,5 %, mit fox bei 5 (19,2 %), weil Häufige Wörter ignorieren voreingestellt aktiv ist.

Gesamtwörter
Einzigartige Wörter
Dichte

Häufigste Wörter ()

📊

Text zur Analyse eingeben

Dieses Tool in Ihre Website einbetten

× px

                        

💡 Integrations-Tipp

Kopieren Sie den Einbettungscode und fügen Sie ihn in das HTML Ihrer Website ein. Die responsive Version passt sich automatisch an alle Bildschirmgrößen an.

1 Bewertung

Über Worthäufigkeits-Zähler

Diese Seite zählt Wörter vollständig in Ihrem Browser. Der Text wird an allem getrennt, was weder Buchstabe noch Ziffer ist, bei aktivem Groß-/Kleinschreibung ignorieren kleingeschrieben, bei aktivem Häufige Wörter ignorieren gegen eine eingebaute Stoppwortliste gefiltert und dann ausgezählt. Nichts wird hochgeladen, es gibt außer dem Arbeitsspeicher Ihres Browsers keine Größengrenze, und die Tabelle aktualisiert sich beim Tippen statt auf Knopfdruck.

Über der Tabelle stehen drei Zahlen. Gesamtwörter ist der Wert nach der Filterung, Einzigartige Wörter zählt die verschiedenen Einträge, und Dichte ist Einzigartige Wörter geteilt durch Gesamtwörter in Prozent – ein Maß für die Wortschatzvielfalt, die sogenannte Type-Token-Relation, nicht die Keyword-Dichte im Sinne von SEO-Werkzeugen. Die steht in der Tabelle: Der Prozentwert neben jedem Wort ist dessen eigene Anzahl geteilt durch Gesamtwörter.

Drei Reiter ändern, was gezählt wird. Wörter zählt Einzelwörter; Bigramme zählt jedes benachbarte Paar und Trigramme jedes benachbarte Tripel, beide aus der bereits gefilterten Liste gebildet. Bei aktivem Häufige Wörter ignorieren verbinden die Wendungen also Inhaltswörter, die im Original nicht nebeneinanderstanden. Der Ergebnisbereich bietet die Ansichten Balkendiagramm und Wortwolke, den Selektor Top anzeigen mit 10, 30, 50 oder 100 Zeilen und eine Schaltfläche Exportieren, die diese Zeilen als word-frequency.csv mit den Spalten Rank, Word, Count und Percentage schreibt.

Die Stoppwortliste richtet sich nach der Sprache der aufgerufenen Seite; Listen bestehen für Englisch, Französisch, Deutsch, Spanisch, Italienisch, Portugiesisch, Russisch, Türkisch, Polnisch und Chinesisch. Dateien öffnet das Werkzeug nicht: Es gibt kein Upload-Feld, ein PDF oder .docx muss also im eigenen Programm geöffnet und der Text herüberkopiert werden. Weil die Trennregel nur Buchstaben und Ziffern behält, zerfallen Verkürzungen – don't wird zu don und t –, weshalb gelegentlich ein einzelner Buchstabe in der Tabelle nach oben klettert.

Anwendungsfälle

Eine Lektorin prüft einen Entwurf von 2.000 Wörtern auf Wiederholungen, lässt Häufige Wörter ignorieren aktiv und liest die ersten zehn Zeilen; ein Verb bei 2 % der Inhaltswörter ist meist der Tick, den die schreibende Person selbst nicht sieht.
Ein Studierender, der einen Text zusammenfasst, wechselt zum Reiter Trigramme, um die vom Autor wiederholten Wendungen zu finden, und exportiert die ersten 100 Zeilen als word-frequency.csv zum Sortieren in der Tabellenkalkulation.
Ein Texter vergleicht zwei Landingpages, analysiert beide und notiert die Dichte: Die Fassung mit dem höheren Verhältnis von einzigartigen zu gesamten Wörtern wiederholt sich bei gleicher Länge weniger.
Eine Lehrkraft stellt eine Wortschatzliste zusammen, entfernt den Haken bei Häufige Wörter ignorieren, um Funktionswörter zu behalten, setzt Top anzeigen auf 100 und exportiert die CSV als Klassenliste.
Eine Übersetzerin prüft die Terminologietreue eines langen Dokuments und fügt den Zieltext auf der Seite jener Sprache ein, damit die passende Stoppwortliste greift und nur echte Fachbegriffe nach oben rücken.

Anleitung

1

Fügen Sie Ihren Text in das Feld Text zur Analyse eingeben ein; die Tabelle erscheint beim Tippen, ohne dass eine Schaltfläche nötig wäre.

2

Legen Sie mit den zwei Kästchen fest, wie Wörter zusammengefasst werden: Groß-/Kleinschreibung ignorieren fasst Wort und wort zusammen, Häufige Wörter ignorieren entfernt die Stoppwörter der Seitensprache.

3

Wählen Sie einen Reiter: Wörter für Einzelwörter, Bigramme für benachbarte Paare, Trigramme für benachbarte Tripel.

4

Lesen Sie Gesamtwörter, Einzigartige Wörter und Dichte über der Tabelle, dann die Rangliste, in der jede Zeile Anzahl und Anteil am Gesamtwert zeigt.

5

Wechseln Sie zwischen Balkendiagramm und Wortwolke und stellen Sie Top anzeigen auf 10, 30, 50 oder 100 Zeilen.

6

Drücken Sie Exportieren, um word-frequency.csv mit den Spalten Rank, Word, Count und Percentage für die angezeigten Zeilen zu laden.

Profi-Tipps

  • Die Kachel Dichte ist Einzigartige Wörter geteilt durch Gesamtwörter, nicht die Keyword-Dichte. Die von einem SEO-Briefing gemeinte Zahl steht neben jedem Wort im Balkendiagramm: dessen Anzahl im Verhältnis zu Gesamtwörter.
  • Alle Prozentwerte entstehen nach der Filterung. Mit aktivem Häufige Wörter ignorieren schließt der Nenner die Stoppwörter aus, die Werte fallen also höher aus als in einem Werkzeug, das alles mitzählt; entfernen Sie den Haken vor jedem Vergleich.
  • Bigramme und Trigramme entstehen aus der gefilterten Liste: Bei aktivem Häufige Wörter ignorieren verbinden die Paare Inhaltswörter, die im Text nicht benachbart waren. Nehmen Sie den Haken zuerst weg, wenn Sie echte Wendungen wollen.
  • Die Stoppwortliste folgt der Seitensprache, nicht Ihrem Text. Ein deutscher Absatz auf der englischen Seite verliert englische Funktionswörter und lässt der, die und und an der Spitze; öffnen Sie stattdessen die deutsche Fassung dieses Werkzeugs.
  • Exportieren schreibt nur die angezeigten Zeilen, und Top anzeigen steht voreingestellt auf 30. Stellen Sie den Wert auf 100, bevor Sie exportieren, wenn der lange Schwanz in word-frequency.csv landen soll.

Fehlerbehebung

Problem:

Ein einzelner Buchstabe wie t oder s steht weit oben in der Rangliste.

Lösung:

Wörter werden an jedem Zeichen getrennt, das weder Buchstabe noch Ziffer ist, sodass Verkürzungen zerfallen: don't wird zu don und t. Ersetzen Sie die Apostrophe im Text vor dem Einfügen oder überlesen Sie diese Zeilen.

Problem:

Gesamtwörter ist viel niedriger als die Wortzahl meiner Textverarbeitung.

Lösung:

Häufige Wörter ignorieren ist voreingestellt aktiv und entfernt rund siebzig Funktionswörter der Seitensprache, bevor überhaupt gezählt wird. Nehmen Sie den Haken weg für die volle Zahl und beachten Sie, dass sich alle Prozentwerte ändern, weil der Nenner wächst.

Problem:

Die exportierte CSV bricht nach 30 Zeilen ab.

Lösung:

Exportieren schreibt genau die angezeigten Zeilen, und der Selektor Top anzeigen steht voreingestellt auf 30. Stellen Sie ihn auf 50 oder 100, warten Sie das Neuzeichnen der Tabelle ab und exportieren Sie erneut.

Problem:

Ein französischer oder türkischer Text lässt les, des oder bir an der Spitze stehen.

Lösung:

Die Stoppwortliste wird aus der Sprache der aufgerufenen Seite gewählt, nicht aus Ihrem Text. Öffnen Sie dasselbe Werkzeug unter seiner französischen oder türkischen Adresse und fügen Sie den Text dort ein.

Häufig gestellte Fragen

Ein Werkzeug, das einen Textblock in Wörter zerlegt und meldet, wie oft jedes vorkommt, vom häufigsten zum seltensten. Dieses ergänzt den Anteil am Gesamtwert je Wort, eine Zahl einzigartiger Wörter, drei N-Gramm-Modi und einen CSV-Export. Die gesamte Rechnung läuft beim Tippen im Browser, der Text verlässt die Seite also nie.

Um Wiederholungen zu finden, die man selbst überliest, zu prüfen, ob ein Dokument die angekündigten Begriffe wirklich behandelt, Wortschatzlisten für den Unterricht zu bauen, zwei Fassungen auf Vielfalt zu vergleichen und die Präsenz eines Zielbegriffs zu messen. Es ist zudem der erste Schritt fast jeder Textanalyse: Die Rangliste verrät das Thema, bevor man ein Wort gelesen hat.

Nicht per Upload – diese Seite hat keine Dateiauswahl, nur ein Textfeld. Öffnen Sie das PDF in einem Betrachter, markieren und kopieren Sie den Text und fügen Sie ihn hier ein. Gescannte PDFs enthalten Bilder statt Text, da kommt nichts an; die brauchen zuerst eine Texterkennung. Für .docx-Dateien gilt dasselbe.

Ja, und es gibt nichts zu registrieren. Gezählt wird von JavaScript in Ihrem eigenen Browser, also gibt es kein Serverkontingent zu verkaufen und keine Längengrenze jenseits des Arbeitsspeichers Ihres Geräts. Der CSV-Export gehört dazu, statt der kostenpflichtige Teil zu sein.

Nein. Es läuft in dem Tab, den Sie ohnehin offen haben, auf dem Telefon ebenso wie am Rechner, und es arbeitet mit einem bereits eingefügten Text weiter, wenn die Verbindung abbricht, weil die Analyse lokal geschieht. Es gibt keinen Download und keine Browsererweiterung.

In drei Zeilen: Text mit re.findall(r"[^\W_]+", text.lower()) zerlegen, das Ergebnis an collections.Counter geben und .most_common(30) aufrufen. Eine eigene Stoppwortliste ergänzen Sie für die Filterung. Diese Seite macht dieselben Schritte und fügt Prozentwerte, N-Gramme und den Export hinzu – den Teil, der beim Selberschreiben am längsten dauert.

Er ist Einzigartige Wörter geteilt durch Gesamtwörter, in Prozent. Im Beispielabsatz dieser Seite standen dort 61,5 %, also 16 verschiedene Einträge auf 26 gezählte Wörter. Ein hoher Wert steht für abwechslungsreichen Wortschatz, ein niedriger für wiederkehrende Wörter. Es ist nicht die Dichte eines einzelnen Schlüsselworts – die steht neben jeder Zeile.

Weil Häufige Wörter ignorieren voreingestellt aktiv ist und rund siebzig der häufigsten Funktionswörter der Seitensprache vor dem Zählen entfernt. Nehmen Sie den Haken weg, und der, die, und und der Rest erscheinen wieder in der Rangliste; Gesamtwörter steigt entsprechend, was alle Prozentwerte senkt.

Nicht, solange Groß-/Kleinschreibung ignorieren aktiv ist, die Voreinstellung: Wort, wort und WORT werden zu einem Eintrag zusammengefasst. Ohne den Haken zählen sie getrennt, was zum Prüfen von Eigennamen oder Marken nützt, gewöhnliche Wörter aber meist auf zwei Zeilen verteilt, je nach Satzanfang.

Ja. Die Schaltfläche Exportieren speichert eine Datei namens word-frequency.csv mit vier Spalten – Rank, Word, Count und Percentage – und einer Zeile je aktuell angezeigtem Eintrag. Der Export folgt also der Einstellung Top anzeigen: Erhöhen Sie sie von 30 auf 100, wenn Sie mehr Zeilen in der Datei wollen.

Beliebte Werkzeuge

Keine weiteren Tools
Alle Tools erkunden
FreeWebTools AI
Powered by free AI models · Full chat →