Byte Counter and Text Size Calculator

A byte counter that shows the exact byte length of your text, plus kilobytes and character count, using UTF-8 encoding. See how many bytes each character takes and stay within field, database and API limits.

Ce que fait cet outil

La taille du texte calcule exactement l'espace occupé par votre texte, en octets, kilo-octets et caractères, en utilisant le codage UTF-8, la norme pour le Web et la plupart des systèmes modernes. C'est l'outil dont vous avez besoin lorsqu'une limite est mesurée en octets plutôt qu'en caractères, ce qui est plus courant que prévu.

Pourquoi les octets diffèrent des caractères

En UTF-8, tous les caractères ne font pas un octet. Les lettres et les chiffres en anglais simple occupent chacun un octet. Ainsi, pour un texte simple, le nombre d'octets correspond au nombre de caractères. Mais les lettres accentuées prennent deux octets, de nombreux symboles et caractères non latins en prennent deux ou trois, et les emoji peuvent en prendre quatre. Cela signifie qu’une chaîne de 100 caractères peut faire bien plus de 100 octets. Lorsqu'un système mesure une limite en octets, compter les caractères vous induira en erreur, cet outil affiche la taille réelle des octets.

Quand la taille des octets compte

Les champs de base de données sont souvent définis avec des limites d'octets, de sorte qu'une valeur qui correspond à des caractères peut toujours être rejetée pour avoir dépassé la limite d'octets. Certaines API et protocoles mesurent les charges utiles en octets. Les messages SMS, les budgets de taille de fichier et certains champs de formulaire se soucient tous des octets. Les développeurs qui vérifient si une valeur correspond à une colonne ou si une charge utile est inférieure à une limite de taille ont besoin du nombre d'octets et non du nombre de caractères.

Lire le résultat

L'outil affiche trois nombres mis à jour au fur et à mesure que vous tapez : le nombre total d'octets sous UTF-8, l'équivalent en kilo-octets pour un texte plus volumineux et le nombre de caractères bruts à des fins de comparaison. Lorsque le nombre d'octets et de caractères divergent, cet écart correspond au contenu non-ASCII de votre texte, aux accents, aux symboles et aux emoji qui occupent chacun plus d'un octet. Tout est calculé dans votre navigateur, de sorte que même les textes sensibles restent sur votre appareil.

Caractères contre octets

Un caractère et un octet ne sont pas toujours la même chose. En ASCII simple, un caractère équivaut à un octet, mais en UTF-8, l'encodage standard du Web, les lettres accentuées, les emoji et les caractères non latins prennent chacun deux, trois ou quatre octets. Cet outil mesure à la fois : le nombre de caractères et la taille réelle en octets sous UTF-8. La différence est importante chaque fois qu'une limite est définie en octets plutôt qu'en caractères, ce qui est plus courant que ce à quoi la plupart des gens s'attendent.

Pourquoi la taille des octets est importante

Les champs de base de données sont souvent dimensionnés en octets, de sorte qu'une limite VARCHAR peut être atteinte avec moins de caractères que prévu si le texte contient des caractères multi-octets. Les charges utiles du réseau, les limites de taille des messages et les quotas de stockage sont mesurés en octets. Certaines API limitent le corps des requêtes en fonction de la taille en octets. Si vous avez déjà vu un texte rejeté parce qu'il était "trop ​​long" alors que le nombre de caractères semblait correct, les caractères multi-octets et une limite basée sur les octets en étaient probablement la cause. Mesurer la taille des octets à l’avance évite cette surprise.

UTF-8 et caractères multi-octets

UTF-8 code les lettres et les chiffres latins de base dans un seul octet chacun, de sorte que le texte anglais brut a un nombre de caractères et d'octets égal. Mais «é» fait deux octets, de nombreux caractères asiatiques font trois octets et les emoji en font généralement quatre. Ainsi, une chaîne de 100 caractères peut contenir entre 100 et 400 octets selon son contenu. Cet outil affiche la taille exacte en octets, la taille en kilo-octets et le nombre de caractères ensemble, afin que vous puissiez voir précisément comment votre texte se mesure par rapport à n'importe quelle limite, qu'elle soit définie en caractères ou en octets.

Questions fréquentes

Pourquoi mon nombre d’octets est-il supérieur à mon nombre de caractères ?
En UTF-8, les lettres accentuées, les symboles, les caractères non latins et les emoji occupent chacun plus d'un octet. Les lettres anglaises simples prennent un octet, donc les décomptes ne correspondent qu'au texte ASCII simple. L'écart est votre contenu non-ASCII.
Quel encodage utilise-t-il ?
UTF-8, l'encodage standard pour le Web et la plupart des systèmes modernes. C'est ce que les bases de données, les API et les navigateurs utilisent par défaut, de sorte que le nombre d'octets reflète la taille réelle du stockage et de la transmission.
Quand ai-je besoin de la taille en octets au lieu du nombre de caractères ?
Lorsqu'une limite est mesurée en octets, en champs de base de données, en certaines charges utiles d'API, en segments SMS et en certains champs de formulaire. Une valeur qui correspond à des caractères peut toujours dépasser une limite d'octets, donc la vérification des octets évite le rejet des données.
Combien d’octets prend un emoji ?
La plupart des emoji prennent quatre octets en UTF-8, et certaines combinaisons en prennent plus. C'est pourquoi une chaîne courte avec un emoji peut avoir une taille d'octet étonnamment grande.
Mon texte est-il téléchargé ?
Non. Le calcul s'exécute dans votre navigateur, de sorte que même le texte sensible reste sur votre appareil.
Quelle est la différence entre les caractères et les octets ?
En ASCII simple, ils sont égaux, mais en UTF-8, le standard du Web, les lettres accentuées, les emoji et les caractères non latins prennent plusieurs octets. Une chaîne peut donc contenir plus d'octets que de caractères. Cet outil montre les deux.
Pourquoi mon texte dépasse-t-il une limite alors que le nombre de caractères semble correct ?
La limite est probablement définie en octets et votre texte contient des caractères multi-octets (accents, emoji ou écriture non latine) qui occupent chacun plus d'un octet. Vérifiez la taille des octets, pas seulement le nombre de caractères.
Combien d’octets fait un emoji ?
La plupart des emoji font quatre octets en UTF-8, et certains emoji combinés en font plus. Un seul emoji peut donc utiliser autant d’espace que quatre caractères latins simples, ce qui est important pour les limites en octets.
Est-ce que cela mesure la taille en UTF-8 ?
Oui. Le nombre d'octets reflète l'encodage UTF-8, la norme pour le Web et la plupart des systèmes modernes, il correspond donc à la façon dont les bases de données, les API et les réseaux mesureront votre texte.