Riferimento Unicode

Come funziona il testo piccolo Unicode

Una guida pratica a caratteri, glifi, copertura incompleta, accessibilità, caratteri confondibili e copia sicura.

Revisionato il 27 agosto 2026 · Unicode 17.0.0 · Registro 1.0.0

Caratteri, glifi, font e CSS sono diversi

Un carattere è un’unità codificata a cui è assegnato un punto di codice. Un glifo è la forma usata da un font per disegnarlo. La proprietà CSS font-size modifica la presentazione mantenendo il carattere originale; questo generatore cambia il carattere stesso.

La distinzione conta quando il testo viene copiato, cercato, indicizzato, pronunciato o normalizzato. Un risultato dall’aspetto simile può avere un significato fonetico, matematico o modificatore.

Perché non esiste un alfabeto uniformemente piccolo

I simboli simili al maiuscoletto sono distribuiti tra IPA Extensions, Phonetic Extensions, i blocchi Latin Extended e altri intervalli. Anche le forme in apice e pedice sono incomplete. Sono state codificate per usi linguistici, matematici o tecnici specifici, non come alfabeto decorativo.

Questo registro distingue quindi tra corrispondenze verificate, approssimazioni visive facoltative e caratteri mantenuti invariati. Conserva un intero grafema quando non esiste una corrispondenza adatta.

Accenti, altre scritture ed emoji

Gli accenti precomposti, le sequenze combinanti, i caratteri CJK, arabi ed ebraici e le scritture non supportate restano intatti. Le emoji di famiglia, le bandiere e le sequenze con tonalità della pelle vengono segmentate come grafemi, così lo strumento non divide un simbolo visibile.

La conservazione non garantisce la compatibilità: la destinazione deve comunque disporre di un font e di un sistema di inserimento che supportino i caratteri originali e quelli trasformati.

Accessibilità, ricerca e caratteri confondibili

Gli screen reader possono annunciare un carattere trasformato usando il nome tecnico o il significato. Gli strumenti di ricerca e moderazione possono trattarlo diversamente dalla lettera normale. Caratteri visivamente simili possono inoltre essere usati per impersonare qualcuno.

Mantieni le informazioni essenziali in testo normale, evita identificatori trasformati e usa il testo sorgente come alternativa accessibile.

Metodo, provenienza e controllo delle modifiche

Il Registro 1.0.0 è una selezione del progetto basata sugli elenchi di nomi e sui dati di Unicode 17.0.0. Ogni voce registra nome di uscita, blocco, stato, avvertenza semantica, reversibilità e fonte. I test coprono alfabeti latini, cifre, segni combinanti, più scritture, emoji, caratteri invisibili, limiti, HTML letterale e conversioni sicure di andata e ritorno.

Le correzioni importanti cambiano la versione del registro e vengono annotate nel changelog del progetto. La Unicode Data Files and Software License si applica ai dati Unicode riutilizzati; le scelte curate di corrispondenza restano responsabilità del progetto.

Riferimenti primari