En este artículo aprenderás por qué algunos SMS de un mensaje en serie, como un ciclo de reclamación, se facturan de forma diferente aunque el contenido parezca el mismo. Entenderás cómo el formato de codificación de un SMS depende de los caracteres que uses y cómo eso afecta al número de partes del mensaje y al coste.
Contenido
- Formatos de codificación de SMS
- Límites de caracteres en GSM7 y Unicode
- Caracteres que afectan a la codificación
- Impacto en los costes de SMS
Fast lane
- Revisa el contenido de tus mensajes SMS.
- Ten en cuenta los caracteres que usas (acentos, símbolos, comillas, emojis).
- Recuerda que solo los caracteres que quedan fuera de ambos conjuntos GSM7 cambian el mensaje a Unicode.
- Recuerda que los mensajes Unicode tienen un límite de caracteres menor, por lo que se dividen en más partes y cuestan más.
Formatos de codificación de SMS
Cuando se envía un SMS, el formato de codificación depende de los caracteres que contiene. Existen dos estándares de codificación habituales: GSM7 y Unicode (UCS2). La mayoría de los mensajes se envían con GSM7 de forma predeterminada. Solo cuando el contenido incluye un carácter que GSM7 no puede representar, todo el mensaje cambia a Unicode. Ese cambio reduce el límite de caracteres por parte del mensaje y, por lo tanto, aumenta el coste.
Límites de caracteres en GSM7 y Unicode
Cada formato de codificación tiene su propio límite de caracteres por SMS. Cuando un mensaje supera el límite de un mensaje único, se divide en varias partes y cada parte se factura por separado. Los mensajes de varias partes usan un límite algo menor por parte, porque parte del espacio se necesita para volver a unir las partes.
| Codificación | Mensaje único | Por parte (varias partes) |
|---|---|---|
| GSM7 | 160 caracteres | 153 caracteres |
| Unicode (UCS2) | 70 caracteres | 67 caracteres |
Caracteres que afectan a la codificación
No todos los caracteres poco habituales fuerzan el cambio a Unicode. Conviene distinguir tres grupos:
- Caracteres básicos de GSM7 (cuentan como 1 carácter, sin cambio): las letras acentuadas de uso cotidiano como ä, ö, ü, é y è forman parte del conjunto de caracteres básicos de GSM7. Permanecen codificadas en GSM7 y cada una cuenta como un solo carácter.
- Caracteres extendidos de GSM7 (cuentan como 2 caracteres, sin cambio): símbolos como | ^ { } € [ ] ~ forman parte del conjunto extendido de GSM7. El mensaje permanece codificado en GSM7, pero cada uno de estos símbolos ocupa dos de los caracteres disponibles.
- Caracteres que no son de GSM7 (fuerzan Unicode): solo los caracteres que quedan fuera de ambos conjuntos GSM7 cambian todo el mensaje a Unicode. Las causas más habituales son las «comillas tipográficas» (‘ ’ y “ ”) que los editores de texto insertan automáticamente en lugar de las comillas rectas (' y "), y el acento grave o backtick (`). Los emojis también pertenecen a este grupo.
La idea clave: el cambio a Unicode no lo provocan los acentos habituales ni el símbolo del euro ni los corchetes. Los acentos cuentan con normalidad, los símbolos extendidos cuentan como dos caracteres pero siguen siendo GSM7, y son los caracteres que no son de GSM7, sobre todo las comillas tipográficas y el backtick, los que reducen el límite a 70 (o 67 por parte).
Impacto en los costes de SMS
Esto es lo que hace que algunos mensajes de un mensaje en serie, por ejemplo un ciclo de reclamación, se facturen de forma diferente. Si el contenido de un mensaje incluye un carácter que no es de GSM7, ese mensaje se envía como Unicode y su límite baja de 160 a 70. El mismo texto que cabía en un mensaje GSM7 puede necesitar entonces dos o más partes Unicode, y cada parte se factura por separado.
Por eso puedes ver un coste más alto en mensajes que parecen casi idénticos: una sola comilla tipográfica o un backtick, insertados a menudo de forma automática al copiar texto, bastan para llevar un mensaje a la vía Unicode. Para mantener los costes bajos, usa comillas rectas y quédate dentro del conjunto de caracteres GSM7 siempre que sea posible.
Aviso: Este artículo se ha traducido con ayuda de inteligencia artificial. Disculpa los posibles errores.