ASCII & Unicode
Comment « Bonjour 🎉 » devient des nombres : ASCII, UTF-8, émojis multi-octets. Et les bugs d'encodage.
D'ASCII à Unicode
ASCII (1963) : 128 caractères anglais. Unicode : 150 000+ symboles pour toutes les langues. UTF-8 : l'encodage malin — 1 octet pour l'ASCII (rétrocompatible), jusqu'à 4 pour le reste.
Le mojibake
⚠ « é » au lieu de « é » = texte UTF-8 lu comme Latin-1. Toujours déclarer l'encodage (HTML
charset=utf-8, fichiers, bases) et ne jamais deviner.✔ Pour aller plus loin : relisez la fiche Début de l'informatique.