Unicode asigna a cada carácter un número llamado punto de código. Los primeros 65 536 forman el Plano Multilingüe Básico y caben en una sola unidad de dieciséis bits, que es como la mayoría de sistemas almacenan texto. Casi todos los emojis están por encima de ese límite.
Para representarlos, la codificación UTF-16 usa dos unidades combinadas, lo que se conoce como par suplente. Visualmente el emoji ocupa un hueco, pero un campo que cuente unidades en lugar de caracteres visibles lo cuenta como dos. En una biografía de TikTok limitada a 80, cinco emojis pueden consumir diez.
Algunos emojis van todavía más lejos. Los que llevan modificador de tono de piel son en realidad dos puntos de código encadenados, y los que representan familias o profesiones combinan varios mediante un carácter invisible llamado unión de anchura cero, U+200D. Un solo emoji visible puede estar hecho de siete puntos de código.
Esa mecánica explica otro comportamiento habitual. Al borrar un emoji compuesto, algunas aplicaciones lo eliminan entero y otras van quitando sus partes una a una, dejando a la vista los emojis intermedios. No es un error de la aplicación sino una diferencia en cómo cada una decide qué constituye un carácter para el usuario.