Das Zählen von Leerzeichen ist ein nützliches grobes Maß und keine sprachbezogene Definition eines Wortes.
Bindestriche und Apostrophe erfordern eine explizite Richtlinie; Zwei seriöse Produkte können absichtlich unterschiedliche Gesamtwerte liefern.
Die Unicode-fähige Segmentierung ist vor allem für Sprachen wichtig, in denen nicht zwischen jedem Wort ein ASCII-Leerzeichen steht.
Die vollständige Erklärung
Fügen Sie denselben Absatz in zwei Wortzähler ein und Sie erhalten zwei Antworten. Beides ist nicht kaputt: Ein Wort ist keine genau definierte Einheit und jedes Werkzeug muss eine Regel auswählen. Das Gleiche gilt für Zeilen, die Groß-/Kleinschreibung und die Kommas in einer CSV-Datei – der Text sieht einfach aus und steckt voller Entscheidungen. Lesen Sie den vollständigen Ratgeber für die Begründung, Beispiele und Definitionen hinter dieser Antwort.