Depuis 1998, Omniglot recense les alphabets, syllabaires et autres graphies du monde entier. Cette encyclopédie des systèmes d'écriture et des langues est devenue une référence discrète pour les traducteurs, les typographes, les enseignants et les créateurs de langues construites.

Le site est l'oeuvre de Simon Ager : "Omniglot was set up in 1998 by Simon Ager (that's me in the photo), and I have been maintaining and developing the site since then". On y apprend que de nombreuses personnes ont apporté du contenu, des corrections et des suggestions. Le nom, lui, vient du latin omnis ("tout") et du grec glossa ("langue").
Ce que contient le site
L'ampleur du catalogue est difficile à imaginer avant de le parcourir : Omniglot fournit des matériaux de référence pour environ 300 écritures utilisées dans différentes langues, auxquelles s'ajoutent plus de 1 000 systèmes d'écriture construits, adaptés ou fictifs. Le site propose aussi des ressources pour apprendre des langues. En novembre 2024, il détaillait plus de 2 100 langues.
Cette dualité - écritures réelles et écritures inventées - fait sa particularité. On y trouve aussi bien des alphabets en usage que des systèmes imaginés pour la fiction ou par des passionnés. Pour un créateur de langue construite, c'est souvent le premier endroit où l'on vérifie qu'un jeu de caractères n'existe pas déjà, ou où l'on s'inspire d'une logique graphique documentée.

Un site tenu par une seule personne, financé par la publicité
Derrière cette masse d'informations, il y a une seule personne. Omniglot a été constitué en société à responsabilité limitée en 2008, mais Simon Ager le rappelle sans détour : "This sounds quite grand, but it is in fact a one-man operation".
Le financement repose sur la publicité et les programmes d'affiliation : "Omniglot generates income via advertising and affiliate programs and has been my main source of income since 2008. The income from the site covers running costs of the site and of its creator/curator". Le site attire en moyenne environ 600 000 visites et 1 million de pages vues par mois.
D'Omniglot à l'Omniglot Challenge
L'influence du site dépasse le cercle des amateurs de langues. Ses matériaux ont servi de source à un recueil de caractères destiné au développement de l'intelligence artificielle, le "Omniglot Challenge". Ce corpus a été largement utilisé depuis sa première diffusion.
Un site artisanal, tenu par une personne, a ainsi fourni un jeu de caractères varié et bien documenté, devenu un outil de travail pour la reconnaissance d'écriture manuscrite et l'apprentissage à partir de peu d'exemples.
Encoder une écriture ne suffit pas à la rendre visible
La norme Unicode, qui permet aux écritures d'exister dans le numérique, progresse : elle couvre désormais 172 écritures et près de 160 000 caractères et symboles, avec en moyenne six nouvelles écritures par version.
Mais l'encodage officiel ne garantit rien. Comme le résume le Script Encoding Initiative de l'université de Berkeley, le travail ne s'arrête pas à la norme : il faut ce qu'on appelle le "full stack language enablement". En clair, un système d'écriture peut figurer dans Unicode sans qu'aucun fabricant n'investisse dans les polices, les claviers ou le rendu nécessaires. Les communautés les moins visibles restent alors sans solution.
Les conséquences sont concrètes : sans typographie numérique, "you can hardly be found on the net".
Faute d'écriture encodée, les communautés bricolent : écriture manuscrite, captures d'écran, polices non standard, translittération ou romanisation, claviers fabriqués maison. Ces outils locaux manquent d'internationalisation et de standardisation, exactement ce qu'Unicode cherche à apporter.
La moitié des écritures hors du numérique
Près de la moitié des systèmes d'écriture du monde restent non encodés, ce qui les exclut du numérique et les expose à l'extinction.
Des projets tentent de combler ce fossé. Le Missing Scripts Project réunit l'Atelier national de recherche typographique de Nancy, l'université des sciences appliquées de Mayence et le Script Encoding Initiative de Berkeley. Ensemble, ils travaillent à intégrer les écritures menacées et minoritaires dans la norme Unicode et à leur donner une forme typographique.

Leur tâche soulève une difficulté propre aux écritures inventées récemment. Encoder une "néographie" oblige à se demander si elle va durer. "A recurring challenge for encoding neographies is knowing whether they represent a passing experiment or durable system that a community will adopt", note le Script Encoding Initiative. Ces écritures évoluent beaucoup dans leurs premières années, ce qui pose problème au regard du caractère permanent d'un encodage Unicode. Les relecteurs exigent donc des preuves de stabilité, d'acceptation et de reconnaissance officielle.
La valeur d'une mémoire unique
Omniglot n'est ni Unicode ni un projet institutionnel. C'est un catalogue personnel, financé par la publicité, mis à jour par une seule main depuis 1998. Sa valeur tient précisément à cette continuité : une mémoire accumulée des écritures, y compris de celles qui n'ont jamais été encodées, ni même reconnues.
Cette fragilité rejoint celle des écritures encore absentes du numérique. Dans les deux cas, la survie dépend d'un petit nombre de personnes qui documentent, comparent et transmettent. Pour les traducteurs, les typographes et les communautés dont l'écriture attend encore sa place dans Unicode, la question n'est pas seulement technique. Elle est celle de savoir qui garde la trace, et pour combien de temps.