In dit artikel lees je waarom sommige sms'jes in een seriebericht, zoals een aanmaningsrun, verschillend worden aangerekend terwijl de inhoud er hetzelfde uitziet. Je begrijpt hoe het coderingsformaat van een sms afhangt van de tekens die je gebruikt en hoe dat het aantal berichtdelen en de kosten beïnvloedt.
Inhoud
- Sms-coderingsformaten
- Tekenlimieten in GSM7 en Unicode
- Tekens die de codering beïnvloeden
- Impact op de sms-kosten
Fast lane
- Controleer de inhoud van je sms'jes.
- Let op de tekens die je gebruikt (accenten, symbolen, aanhalingstekens, emoji's).
- Houd er rekening mee dat alleen tekens buiten beide GSM7-sets het bericht naar Unicode omschakelen.
- Onthoud dat Unicode-berichten een kleinere tekenlimiet hebben, waardoor ze in meer delen worden opgesplitst en meer kosten.
Sms-coderingsformaten
Wanneer een sms wordt verzonden, hangt het coderingsformaat af van de tekens die het bevat. Er zijn twee gangbare coderingsstandaarden: GSM7 en Unicode (UCS2). De meeste berichten worden standaard met GSM7 verzonden. Pas wanneer de inhoud een teken bevat dat GSM7 niet kan weergeven, schakelt het hele bericht over naar Unicode. Die overschakeling verlaagt de tekenlimiet per berichtdeel en verhoogt daardoor de kosten.
Tekenlimieten in GSM7 en Unicode
Elk coderingsformaat heeft zijn eigen tekenlimiet per sms. Wanneer een bericht langer is dan de limiet voor een enkel bericht, wordt het in meerdere delen opgesplitst en wordt elk deel apart aangerekend. Berichten uit meerdere delen gebruiken een iets lagere limiet per deel, omdat een deel van de ruimte nodig is om de delen weer samen te voegen.
| Codering | Enkel bericht | Per deel (meerdere delen) |
|---|---|---|
| GSM7 | 160 tekens | 153 tekens |
| Unicode (UCS2) | 70 tekens | 67 tekens |
Tekens die de codering beïnvloeden
Niet elk ongewoon teken forceert een overschakeling naar Unicode. Het helpt om drie groepen te onderscheiden:
- GSM7-basistekens (tellen als 1 teken, geen overschakeling): alledaagse letters met accent zoals ä, ö, ü, é en è maken deel uit van de GSM7-basistekenset. Ze blijven in GSM7 gecodeerd en tellen elk als één teken.
- GSM7-uitgebreide tekens (tellen als 2 tekens, geen overschakeling): symbolen zoals | ^ { } € [ ] ~ maken deel uit van de uitgebreide GSM7-set. Het bericht blijft in GSM7 gecodeerd, maar elk van deze symbolen neemt twee van de beschikbare tekens in beslag.
- Niet-GSM7-tekens (forceren Unicode): alleen tekens buiten beide GSM7-sets schakelen het hele bericht over naar Unicode. De meest voorkomende oorzaken zijn typografische „slimme aanhalingstekens” (‘ ’ en “ ”) die tekstverwerkers automatisch invoegen in plaats van rechte aanhalingstekens (' en "), en de backtick (`). Ook emoji's vallen in deze groep.
Het belangrijkste punt: een overschakeling naar Unicode wordt niet veroorzaakt door alledaagse accenten of door het euroteken en de haakjes. Accenten tellen normaal, de uitgebreide symbolen tellen als twee tekens maar blijven GSM7, en het zijn de niet-GSM7-tekens, vooral slimme aanhalingstekens en de backtick, die de limiet verlagen naar 70 (of 67 per deel).
Impact op de sms-kosten
Dit is de reden waarom sommige berichten in een seriebericht, bijvoorbeeld een aanmaningsrun, verschillend worden aangerekend. Als de inhoud van één bericht een niet-GSM7-teken bevat, wordt dat bericht als Unicode verzonden en daalt de limiet van 160 naar 70. Dezelfde tekst die in één GSM7-bericht paste, heeft dan misschien twee of meer Unicode-delen nodig, en elk deel wordt apart aangerekend.
Daarom kun je hogere kosten zien voor berichten die er bijna identiek uitzien: één enkel slim aanhalingsteken of een backtick, vaak automatisch ingevoegd bij het kopiëren van tekst, is genoeg om een bericht op het Unicode-pad te zetten. Om de kosten laag te houden, gebruik je rechte aanhalingstekens en blijf je zo veel mogelijk binnen de GSM7-tekenset.
Let op: Dit artikel is met behulp van AI vertaald. Onze excuses voor eventuele fouten.