Riferimento Unicode
Come funziona il testo piccolo Unicode
Una guida pratica a caratteri, glifi, copertura incompleta, accessibilità, caratteri confondibili e copia sicura.
Revisionato il 27 agosto 2026 · Unicode 17.0.0 · Registro 1.0.0
Caratteri, glifi, font e CSS sono diversi
Un carattere è un’unità codificata a cui è assegnato un punto di codice. Un glifo è la forma usata da un font per disegnarlo. La proprietà CSS font-size modifica la presentazione mantenendo il carattere originale; questo generatore cambia il carattere stesso.
La distinzione conta quando il testo viene copiato, cercato, indicizzato, pronunciato o normalizzato. Un risultato dall’aspetto simile può avere un significato fonetico, matematico o modificatore.
Perché non esiste un alfabeto uniformemente piccolo
I simboli simili al maiuscoletto sono distribuiti tra IPA Extensions, Phonetic Extensions, i blocchi Latin Extended e altri intervalli. Anche le forme in apice e pedice sono incomplete. Sono state codificate per usi linguistici, matematici o tecnici specifici, non come alfabeto decorativo.
Questo registro distingue quindi tra corrispondenze verificate, approssimazioni visive facoltative e caratteri mantenuti invariati. Conserva un intero grafema quando non esiste una corrispondenza adatta.
Accenti, altre scritture ed emoji
Gli accenti precomposti, le sequenze combinanti, i caratteri CJK, arabi ed ebraici e le scritture non supportate restano intatti. Le emoji di famiglia, le bandiere e le sequenze con tonalità della pelle vengono segmentate come grafemi, così lo strumento non divide un simbolo visibile.
La conservazione non garantisce la compatibilità: la destinazione deve comunque disporre di un font e di un sistema di inserimento che supportino i caratteri originali e quelli trasformati.
Accessibilità, ricerca e caratteri confondibili
Gli screen reader possono annunciare un carattere trasformato usando il nome tecnico o il significato. Gli strumenti di ricerca e moderazione possono trattarlo diversamente dalla lettera normale. Caratteri visivamente simili possono inoltre essere usati per impersonare qualcuno.
Mantieni le informazioni essenziali in testo normale, evita identificatori trasformati e usa il testo sorgente come alternativa accessibile.
Metodo, provenienza e controllo delle modifiche
Il Registro 1.0.0 è una selezione del progetto basata sugli elenchi di nomi e sui dati di Unicode 17.0.0. Ogni voce registra nome di uscita, blocco, stato, avvertenza semantica, reversibilità e fonte. I test coprono alfabeti latini, cifre, segni combinanti, più scritture, emoji, caratteri invisibili, limiti, HTML letterale e conversioni sicure di andata e ritorno.
Le correzioni importanti cambiano la versione del registro e vengono annotate nel changelog del progetto. La Unicode Data Files and Software License si applica ai dati Unicode riutilizzati; le scelte curate di corrispondenza restano responsabilità del progetto.
Riferimenti primari
- Panoramica della versione Unicode 17.0.0 e database dei caratteri. Fonte primaria
- Elenchi dei nomi Unicode Phonetic Extensions e Superscripts and Subscripts. Fonte primaria 1 Fonte primaria 2
- Unicode Standard Annex n. 29 sui confini dei grafemi. Fonte primaria
- Unicode Technical Standard n. 39 sui caratteri confondibili e sui rischi di impersonificazione. Fonte primaria
- Unicode Data Files and Software License. Fonte primaria