AccueilExplorerIndex A–ZMenaces
CODEX / CONCEPTS / ASCII & UNICODE

ASCII & Unicode

DébutantSynthèseMAJ 2026-10-09 · #texte #encodage #unicode

Comment « Bonjour 🎉 » devient des nombres : ASCII, UTF-8, émojis multi-octets. Et les bugs d'encodage.

D'ASCII à Unicode

ASCII (1963) : 128 caractères anglais. Unicode : 150 000+ symboles pour toutes les langues. UTF-8 : l'encodage malin — 1 octet pour l'ASCII (rétrocompatible), jusqu'à 4 pour le reste.

Le mojibake

⚠ « é » au lieu de « é » = texte UTF-8 lu comme Latin-1. Toujours déclarer l'encodage (HTML charset=utf-8, fichiers, bases) et ne jamais deviner.
✔ Pour aller plus loin : relisez la fiche Début de l'informatique.