Tekens tellen
Typ iets en de meest gebruikte woorden verschijnen hier.
Typ iets en de meest gebruikte woorden verschijnen hier.
De telling loopt bij elke toetsaanslag mee, met en zonder spaties, naast de limieten waarvoor mensen hem meestal nodig hebben. Een teken betekent hier wat een mens als één teken zou zien, dus een emoji telt als één, hoeveel bytes hij ook kost. Er wordt niets verstuurd; het tellen gebeurt op de pagina.
Zo tel je tekens
Twee tellingen, omdat twee soorten mensen het vragen
Welk getal je wilt, hangt af van wie de limiet stelde. Sociale platforms, sms en bijna elk formulierveld tellen tekens inclusief spaties. Scripties, tijdschriften en sommige wedstrijdregels vragen vaker om tekens zonder spaties, en voor gewoon proza ligt dat getal ongeveer een zesde lager. Beide staan naast elkaar in de bovenste rij, dus je hoeft niets uit het hoofd te rekenen, en het verschil tussen de twee is gewoon je witruimte: spaties, tabs en regeleinden vallen allemaal weg.
Een emoji is hier één teken, en dat is een keuze
Onder de motorkap is een tekenreeks een rij code-eenheden, en één zichtbaar symbool kan er meerdere beslaan. Een duim omhoog met huidskleur is twee codepunten; een vlag is twee; een gezinsemoji is zeven. Deze pagina telt grafeemclusters met de eigen segmenter van de browser, dus elk daarvan is één, precies wat één druk op backspace weghaalt. Veel achterkanten tellen in plaats daarvan UTF-16-code-eenheden en zien twee, vier of elf voor dezelfde tekst. Weigert een veld een bio die volgens deze tool ruim kort genoeg is, dan is een verschil in wat beide kanten een teken noemen bijna altijd de oorzaak.
Waar de vijf limietbalken vandaan komen
Het sms-getal is rekenwerk en geen afspraak. De tekst van een sms is 140 octetten. Het GSM-7-bitsalfabet stopt één teken in zeven bits, en 140 octetten is 1.120 bits, dus er passen precies 160 tekens in. Gebruik één teken dat niet in dat alfabet zit, en een krul-aanhalingsteken of een gedachtestreepje uit een tekstverwerker is de gebruikelijke boosdoener, en het hele bericht schakelt over op UCS-2 met zestien bits per teken, en dat is 70. De balk hier is het geval van één bericht; aaneengeschakelde berichten zetten een kop binnen dezelfde 140 octetten en zakken naar 153 en 67.
De twee zoekgetallen zijn zachter. Google kapt een beschrijving en een titel af op weergegeven pixelbreedte, niet op een tekenaantal, en herschrijft beschrijvingen regelmatig, dus 155 en 60 zijn de lengtes die meestal overleven en geen gepubliceerde plafonds. Een regel met hoofdletters of brede letters loopt eroverheen; een regel met smalle niet. De 280 voor een bericht op X is een gewogen telling waarin tekens uit de CJK-reeksen twee kosten, en een link telt voor de vaste lengte van de linkverkorter, hoe lang hij ook echt is.
Wat de andere getallen betekenen
Een woord is hier een letter of cijfer gevolgd door een reeks letters, cijfers, apostrofs en koppeltekens, dus ‘state-of-the-art’ is één woord en ‘2026’ ook. Zinnen worden gesplitst op een punt, vraagteken, uitroepteken of beletselteken, en daardoor telt een afkorting als ‘bijv.’ als zinseinde; een tekst vol afkortingen scoort hoog. Leestijd rekent met 238 woorden per minuut, het gemiddelde voor stil lezen uit Brysbaerts meta-analyse van 2019, en spreektijd met 130. Lettergrepen worden geschat aan de hand van klinkergroepen met een regel voor stomme uitgangen die voor het Engels is gemaakt, dus voor Nederlandse tekst is het een ruwe schatting.
Waar mensen het voor gebruiken
- Een metabeschrijving inkorten tot de lengte die Google echt toont
- Een sms terugbrengen onder de 160 zodat hij als één bericht gaat
- Het ene geplakte krul-aanhalingsteken vinden dat een sms naar 70 tekens bracht
- Een bio controleren tegen een veldlimiet voordat het formulier hem weigert
- Tellen zonder spaties voor een inzending die dat zo vraagt
- Een bijschrift op maat maken voordat het in een feed wordt afgekapt
- De meest gebruikte woorden in een concept teruglezen om te zien wat het herhaalt
Vragen
Beide getallen staan tegelijk op het scherm. Sociale media en sms tellen spaties mee; scripties en tijdschriften vragen vaker om tekens zonder spaties, wat voor proza ongeveer een zesde lager ligt.
Meestal door emoji of letters met accenten. Deze telt wat jij een teken zou noemen; veel systemen tellen de onderliggende UTF-16-code-eenheden, dus één emoji telt daar als twee of meer.
Hier één. Een duim met huidskleur is twee codepunten, een vlag twee en een gezinsemoji zeven, maar allemaal zijn ze één grafeemcluster, en één backspace haalt elk ervan in zijn geheel weg.
280 voor een gewoon bericht, gewogen geteld: tekens uit de CJK-reeksen kosten er twee, dus dezelfde zichtbare lengte komt in het Nederlands verder dan in het Japans. Een link telt voor de vaste lengte van de verkorter.
Een bericht bevat 140 octetten. Het GSM-7-bitsalfabet slaat een teken op in zeven bits, en 1.120 bits gedeeld door zeven is precies 160.
Eén teken buiten dat 7-bitsalfabet zet het hele bericht om naar UCS-2 met zestien bits per teken, en 1.120 gedeeld door zestien is 70. Een krul-apostrof of een gedachtestreepje uit een tekstverwerker doet dat al.
De kop die de delen verbindt, zit binnen dezelfde 140 octetten en kost zeven septetten, dus delen zijn 153 tekens in het 7-bitsalfabet en 67 in UCS-2.
De uitbreidingsset: het dakje, accolades en vierkante haken, de tilde, het sluisteken, de backslash en het euroteken. Elk wordt opgeslagen als escape plus teken, dus elk kost twee van de 160.
Het is een werkgetal, geen regel. Google kapt af op weergegeven breedte en herschrijft beschrijvingen vaak, dus een regel brede hoofdletters wordt voor 155 afgebroken en een smalle overleeft erna.
Een letter of cijfer, gevolgd door een reeks letters, cijfers, apostrofs en koppeltekens. Dus ‘state-of-the-art’ is één woord en ‘2026’ ook.
Zinnen eindigen op een punt, vraagteken, uitroepteken of beletselteken, en er wordt niet geprobeerd afkortingen te herkennen. Een alinea met ‘bijv.’ en ‘dr.’ telt twee zinnen meer dan hij heeft.
238 woorden per minuut, het gemiddelde voor stil lezen uit Brysbaerts meta-analyse van 2019. Spreektijd rekent met 130, een gesprekstempo en geen presentatietempo.
Geschat, met een regel die voor Engelse spelling is gemaakt. Voor Nederlandse tekst is het getal dus grof; tel zelf als het echt moet kloppen.
Het telt als teken en als witruimte, dus in het getal met spaties en niet in dat zonder. Het aantal regels volgt het aantal regeleinden.
Er is er geen ingesteld. Het draait op je eigen apparaat, dus een heel hoofdstuk is geen probleem.
Nee. Er is geen upload en niets wordt bewaard; sluit het tabblad en het is weg.