Les données numériques : Les caractères - Quiz
Les caractères
Lorsque nous écrivons un texte sur un ordinateur, nous utilisons des caractères. Une lettre, un chiffre, un espace, un signe de ponctuation ou un symbole sont tous des caractères. Pourtant, l'ordinateur ne comprend pas directement ces éléments : il ne manipule que des nombres écrits en binaire. Il faut donc établir une correspondance entre chaque caractère et un nombre. Cette correspondance est appelée un codage des caractères.
Le premier système largement utilisé est le code ASCII (American Standard Code for Information Interchange), créé dans les années 1960. Il attribue un nombre à chaque caractère. Par exemple, la lettre A est codée par le nombre 65, la lettre B par 66 et le chiffre 0 par 48. Ces nombres sont ensuite convertis en binaire pour être enregistrés dans la mémoire de l'ordinateur.
Le code ASCII d'origine permettait de représenter 128 caractères. Il convenait parfaitement à l'anglais, mais il ne possédait pas les lettres accentuées, les alphabets étrangers ni la plupart des symboles utilisés dans le monde.
Pour résoudre ce problème, un nouveau standard appelé Unicode a été créé. Son objectif est de donner un numéro unique à chaque caractère utilisé sur la planète. Il permet de représenter les lettres accentuées du français, les caractères grecs, russes, arabes, chinois, japonais, les symboles scientifiques, les caractères mathématiques et même les émojis.
Le système Unicode contient aujourd'hui plus de 149 000 caractères. Pour les enregistrer efficacement, plusieurs méthodes d'encodage existent. La plus utilisée est UTF-8, qui est devenue le standard du Web. Elle est capable de coder les caractères les plus courants sur un seul octet, tout en utilisant plusieurs octets lorsque cela est nécessaire.
Prenons un exemple. Le mot École contient une lettre accentuée. Avec un ancien codage ne prenant pas en charge les accents, ce mot pouvait être affiché sous une forme incorrecte comme École ou ?cole. Grâce à Unicode et à UTF-8, les caractères sont correctement interprétés sur presque tous les ordinateurs et smartphones modernes.
Le codage des caractères est indispensable pour enregistrer, afficher et transmettre les textes. Les navigateurs Internet, les logiciels de traitement de texte, les bases de données, les messageries ou encore les réseaux sociaux utilisent tous des systèmes de codage afin que les textes soient lus correctement, quelle que soit la langue employée.
Chaque fois que vous tapez une lettre au clavier, l'ordinateur la transforme immédiatement en un nombre, puis en une suite de bits. Lorsqu'il affiche ensuite cette lettre à l'écran, il effectue l'opération inverse. Derrière chaque texte que nous lisons se cache donc un immense ensemble de nombres soigneusement organisés.