Salta al contenuto
recaplica

    Un attimo: controllo di sicurezza

    Cloudflare vuole assicurarsi che tu non sia un robot. Spunta la casella qui sotto e la ricerca riparte da sola.

    EN
    recaplica Unicode: cos'è e perché ha sostituito ASCII
    © 2026 Recaplica · recaplica.com — Tutti i diritti riservati
    Home › Tecnologia

    Unicode: cos'è e perché ha sostituito ASCII

    Di Redazione Recaplica · Aggiornato il 24 settembre 2026

    Cosa stampare

    Con "Margini: predefiniti" compaiono anche i numeri di pagina.

    Slide

    Scegli il taglio

    Lampo10 slideIl filo essenziale, per presentarlo in classeCompleta15 slideTutti i capitoli e gli approfondimenti

    Tutte e due hanno le note del relatore.

    Canale Telegram
    recaplica Chiaro in 30 secondi, tuo in 10 minuti.
    In 30 secondi Punti chiave Numeri Approfondimento Presentazione Falsi miti Mappa concettuale Quiz Flashcards FAQ

    In 30 secondi lettura lampo

    Unicode è lo standard che assegna un numero univoco, chiamato code point, a ogni carattere di ogni lingua scritta nel mondo. È nato per sostituire ASCII, il codice del 1963 che con i suoi 128 caratteri copriva solo l'alfabeto inglese, senza accenti né altri alfabeti. Il testo viaggia quasi sempre in UTF-8, una delle forme con cui Unicode traduce quei numeri in byte, compatibile all'indietro: un testo scritto solo in ASCII è già un testo UTF-8 valido. La versione 18.0 dello standard, pubblicata a settembre 2026, copre 172.808 caratteri.

    Punti Chiave

    • Unicode assegna un numero, il code point, a ogni carattere di ogni lingua, non solo all'alfabeto inglese.
    • ASCII, pubblicato nel 1963, usa 7 bit per un massimo di 128 caratteri: lettere accentate e alfabeti non latini restano fuori.
    • UTF-8 traduce i code point di Unicode in sequenze da 1 a 4 byte ed è compatibile con ASCII, che resta un solo byte identico.
    • Lo Unicode Consortium, fondato nel gennaio 1991 in California, pubblicò la Versione 1.0 dello standard in ottobre dello stesso anno.
    • L'idea di una codifica universale nacque attorno al 1987, da discussioni tra ingegneri di Xerox e Apple.
    • La versione 18.0 dello standard, pubblicata a settembre 2026, copre 172.808 caratteri.

    I numeri chiave

    • 172.808 caratteri coperti dalla versione 18.0 dello standard Unicode, pubblicata a settembre 2026 Fonte: Unicode Consortium
    • 128 caratteri massimi rappresentabili da ASCII, lo standard pubblicato nel 1963 con 7 bit per carattere Fonte: Wikipedia, voce ASCII
    • 1991 anno di pubblicazione della Versione 1.0 dello standard Unicode, in ottobre Fonte: Unicode Consortium

    L'Approfondimento

    Un numero per ogni carattere

    Secondo la FAQ del Consortium Unicode, Unicode è lo standard di codifica universale dei caratteri, la base su cui si elaborano, si salvano e si scambiano i testi in qualunque lingua. A ogni carattere possibile — una lettera, un segno di punteggiatura, un simbolo — lo standard assegna un numero univoco, chiamato code point, scritto con la notazione U+ seguita da cifre esadecimali. Il computer, dentro, lavora sempre e solo in numeri binari: Unicode è il ponte che traduce quei numeri in caratteri leggibili da una persona.

    Esempio pratico: aprire lo stesso file di testo su un computer in Italia, uno in Giappone e uno in Arabia Saudita, e vedere ovunque gli stessi caratteri — accenti, ideogrammi, scrittura da destra a sinistra — è possibile solo perché tutti concordano sullo stesso numero per lo stesso carattere. Prima di Unicode, ogni sistema aveva la sua tabella, e lo stesso numero poteva corrispondere a lettere diverse da un computer all’altro.

    Perché ASCII non bastava più

    ASCII, pubblicato nel 1963 come standard ASA X3.4-1963, usa 7 bit per carattere: un valore da 0 a 127, per un totale di 128 code point, di cui 95 stampabili e 33 di controllo. Bastava per l’inglese scritto con la tastiera americana, ma secondo Wikipedia lo standard non supporta direttamente termini o nomi come résumé, jalapeño o naïve, perché non ha code point per le lettere con segni diacritici. Le revisioni successive provarono ad allargare lo spazio a 8 bit, con famiglie di codifiche “parenti” di ASCII pensate per singole lingue, restando però incompatibili tra loro: nessuna bastava a coprire più alfabeti insieme.

    Come funziona UTF-8

    Unicode assegna i numeri; UTF-8 è il modo più diffuso di trasformarli in byte da salvare o trasmettere. Lo specifica l’RFC 3629 dello IETF, pubblicato nel novembre 2003: ogni carattere diventa una sequenza da 1 a 4 byte, a seconda di quanto è alto il suo code point, fino a coprire l’intero intervallo U+0000-U+10FFFF. Il primo byte porta un pattern di bit che dice quanti byte seguono; i byte successivi iniziano sempre con gli stessi due bit, così un programma può sempre capire dove comincia un nuovo carattere, anche aprendo il file a metà.

    La caratteristica che ha reso UTF-8 la scelta più diffusa sul web è la compatibilità all’indietro: per l’RFC 3629, i caratteri US-ASCII sono codificati in un solo ottetto con il normale valore US-ASCII. Un file scritto solo in ASCII, letto come UTF-8, produce esattamente lo stesso testo — nessuna conversione, nessun byte che cambia. Quando un testo viaggia da un server a un browser, attraverso la rete che porta i dati da un capo all’altro, la codifica dichiarata deve combaciare con quella usata per scrivere il file, o i caratteri arrivano storpiati.

    ASCII (1963)Unicode più UTF-8
    Bit per carattere7, fissida 8 a 32, variabili (1-4 byte)
    Caratteri massimi128172.808 nella versione 18.0 (2026)
    Alfabeti copertisolo inglese, senza accentiogni lingua e sistema di scrittura coperto dallo standard
    Rapporto tra i due—i primi 128 caratteri restano un byte identico ad ASCII

    Una storia breve

    L’idea di una codifica universale nacque, secondo la pagina storica del Consortium, circa quattro anni prima della fondazione dell’ente — quindi attorno al 1987 — da discussioni tra ingegneri di Xerox (Joe Becker) e Apple (Lee Collins e Mark Davis). Lo Unicode Consortium fu costituito formalmente nel gennaio 1991, in California. La Versione 1.0 dello standard, Volume 1, fu pubblicata pochi mesi dopo, in ottobre dello stesso anno.

    Da allora lo standard è cresciuto versione dopo versione, aggiungendo alfabeti e nuovi intervalli di code point, compreso uno spazio di oltre 137.000 code point riservato all’uso privato, per chi ha bisogno di caratteri personalizzati fuori dallo standard. Chi scrive codice lavora quasi sempre con testo già codificato in Unicode, spesso attraverso l’algoritmo di UTF-8 descritto sopra, anche senza accorgersene: uno degli sviluppi raccontati nella storia del computer.

    Presentazione

    Slide pronte da scaricare e fare tue in PowerPoint o Google Slides, con le note del relatore. Scegli il taglio Lampo o quello Completo.

    Slide 1 della presentazione su Unicode: UnicodeSlide 2 della presentazione su Unicode: Quanti caratteri può scrivere un computer che ne conosce solo 128?Slide 3 della presentazione su Unicode: In questo RecapSlide 4 della presentazione su Unicode: Capitolo 01: Cos'è UnicodeSlide 5 della presentazione su Unicode: Un solo standard, per ogni linguaSlide 6 della presentazione su Unicode: Capitolo 02: I limiti di ASCIISlide 7 della presentazione su Unicode: ASCII contro Unicode più UTF-8Slide 8 della presentazione su Unicode: ASCII non sa scrivere accenti né altri alfabetiSlide 9 della presentazione su Unicode: Capitolo 03: Come funziona UTF-8Slide 10 della presentazione su Unicode: Un carattere, da 1 a 4 byteSlide 11 della presentazione su Unicode: Il gruppo che discusse la prima idea, 1987: Joe Becker, Lee Collins, Mark DavisSlide 12 della presentazione su Unicode: Capitolo 04: Una storia breveSlide 13 della presentazione su Unicode: Da un'idea allo standardSlide 14 della presentazione su Unicode: Perché un testo scritto solo in inglese pesa uguale in ASCII e in UTF-8?Slide 15 della presentazione su Unicode: Continua a leggere
    Lampo10 slideIl filo essenziale, per presentarlo in classeCompleta15 slideTutti i capitoli e gli approfondimenti

    Falsi miti

    • ✗ Mito Unicode e UTF-8 sono la stessa cosa

      ✓ Realtà Unicode è lo standard che assegna un numero, il code point, a ogni carattere; UTF-8 è solo uno dei modi per tradurre quei numeri in byte. La FAQ del Consortium Unicode nomina anche UTF-16 e UTF-32 come altre forme di trasformazione dello stesso standard.

    • ✗ Mito ASCII è stato sostituito e non serve più

      ✓ Realtà ASCII vive dentro UTF-8. Secondo l'RFC 3629, i caratteri US-ASCII restano codificati in un solo ottetto con lo stesso valore originale, quindi ogni testo scritto solo in ASCII è già un testo UTF-8 valido.

    • ✗ Mito Con Unicode ogni carattere pesa di più

      ✓ Realtà Non per i caratteri già coperti da ASCII. La FAQ UTF-8 del Consortium indica per loro un solo byte per carattere, lo stesso di ASCII: a pesare di più sono i caratteri fuori da quell'intervallo, come lettere accentate o alfabeti non latini.

    Mappa concettuale

    Trascina lo sfondo per muoverti e i nodi per riposizionarli; usa − e + per chiudere e aprire i rami.

    Personalizza
    Mappa concettuale: Unicode: cos'è e perché ha sostituito ASCII
    • Unicode
      • Cos'è
        • Standard universale assegna un numero, il code point, a ogni carattere di ogni lingua
        • Code point notazione U+, nell'intervallo da U+0000 a U+10FFFF
      • Perché è nato
        • Limiti di ASCII 128 caratteri a 7 bit, solo alfabeto inglese
        • Estensioni incompatibili le versioni a 8 bit di ASCII non erano compatibili tra loro
      • Come si codifica
        • UTF-8 da 1 a 4 byte per carattere, compatibile con ASCII
        • UTF-16 e UTF-32 altre forme di trasformazione dello stesso standard
      • Storia
        • 1987, prima idea discussioni tra ingegneri di Xerox e Apple
        • 1991, Consortium e Versione 1.0 ente fondato in gennaio, standard pubblicato in ottobre
      • Numeri
        • 128 caratteri il massimo di ASCII
        • 172.808 caratteri la versione 18.0 di Unicode, di settembre 2026

    Quiz: mettiti alla prova

    Rispondi alle domande per verificare quanto hai imparato: riceverai subito la correzione e una breve spiegazione.

    Voto 0/10 0/5
    1 Cos'è Unicode?

    Secondo la FAQ del Consortium Unicode, è lo standard universale di codifica dei caratteri: la base per elaborare, salvare e scambiare testo in qualunque lingua.

    2 Quanti caratteri può rappresentare al massimo ASCII, con i suoi 7 bit?

    ASCII usa 7 bit per carattere, un valore da 0 a 127: 128 code point in tutto, di cui 95 stampabili e 33 di controllo, secondo Wikipedia.

    3 Quanti byte può usare UTF-8 per codificare un singolo carattere?

    L'RFC 3629 descrive una codifica a lunghezza variabile, da 1 a 4 byte, fino a coprire l'intero intervallo U+0000-U+10FFFF.

    4 Perché un testo scritto solo in ASCII è già un testo UTF-8 valido?

    L'RFC 3629 specifica che i caratteri US-ASCII sono codificati in un solo ottetto con il normale valore US-ASCII, senza alcuna modifica.

    5 In che anno fu pubblicata la Versione 1.0 dello standard Unicode?

    Secondo il Consortium Unicode, la Versione 1.0, Volume 1, fu pubblicata nell'ottobre 1991, pochi mesi dopo la fondazione dell'ente, avvenuta in gennaio dello stesso anno.

    Risposte: 1-A · 2-A · 3-C · 4-A · 5-C

    Flashcards

    Tocca la carta per girarla e verifica se ricordi la risposta, poi passa alla successiva.

    1 / 7

    Spiegalo con parole tue

    Il test definitivo: se sai spiegarlo con parole semplici, lo hai capito davvero. Scrivi la tua spiegazione, poi confrontala col Recap.

    La tua spiegazione resta salvata solo su questo dispositivo.

    Unicode è lo standard che assegna un numero univoco, chiamato code point, a ogni carattere di ogni lingua scritta nel mondo. È nato per sostituire ASCII, il codice del 1963 che con i suoi 128 caratteri copriva solo l'alfabeto inglese, senza accenti né altri alfabeti. Il testo viaggia quasi sempre in UTF-8, una delle forme con cui Unicode traduce quei numeri in byte, compatibile all'indietro: un testo scritto solo in ASCII è già un testo UTF-8 valido. La versione 18.0 dello standard, pubblicata a settembre 2026, copre 172.808 caratteri.

    Domande e risposte

    Unicode e UTF-8 sono la stessa cosa?

    No. Unicode è lo standard che assegna un numero, il code point, a ogni carattere; UTF-8 è uno dei modi per tradurre quei numeri in byte da salvare o trasmettere. Esistono anche UTF-16 e UTF-32, altre forme di trasformazione dello stesso standard, secondo la FAQ del Consortium Unicode.

    Perché ASCII non bastava più?

    Perché con soli 128 caratteri a 7 bit copriva solo l'alfabeto inglese. Secondo Wikipedia, ASCII non supporta direttamente termini o nomi con segni diacritici come résumé, jalapeño o naïve, perché non ha code point per quelle lettere.

    Quanti byte occupa un carattere in UTF-8?

    Da 1 a 4, secondo l'RFC 3629: il numero di byte dipende da quanto è alto il code point del carattere, fino a coprire l'intervallo U+0000-U+10FFFF.

    Cosa significa la sigla ASCII?

    American Standard Code for Information Interchange. Fu pubblicato nel 1963, contemporaneamente all'introduzione del Teletype Model 33, secondo Wikipedia.

    Chi gestisce lo standard Unicode?

    Lo Unicode Consortium, l'organizzazione fondata nel gennaio 1991 in California, che mantiene e aggiorna lo standard: la versione 18.0, di settembre 2026, copre 172.808 caratteri.

    Fonti consultate

    • Unicode FAQ – Basic Questions, Unicode Consortium
    • Unicode FAQ – UTF-8, UTF-16, UTF-32 & BOM, Unicode Consortium
    • RFC 3629 – UTF-8, a transformation format of ISO 10646, IETF
    • History of Unicode, Unicode Consortium
    • Publication Dates for the Unicode Standard Books, Unicode Consortium
    • ASCII, Wikipedia
    • Unicode 18.0.0, Unicode Consortium

    Ogni Recap passa da una revisione indipendente prima della pubblicazione.

    Ogni sera, i nuovi Recap del giorno sul canale Telegram. Iscriviti al canale →

    Continua a imparare

    • Tecnologia Codice ASCII: cos'è la tabella dei caratteri Il codice ASCII è la tabella che assegna un numero fisso a ogni lettera, cifra, segno di punteggiatura e comando di controllo della tastiera, così che un computer, che maneggia solo numeri, possa rappresentare un testo. Pubblicato nel 1963 dal comitato ANSI X3.4 e adottato per i computer federali statunitensi nel 1968, secondo l'Engineering and Technology History Wiki dell'IEEE usa 7 bit e copre 128 caratteri, quasi tutti dell'alfabeto inglese. L'RFC 20 mostra come questi 7 bit entrino comodi in un byte a 8 bit, con il bit più alto lasciato a zero; usare anche quel bit in più apre altre combinazioni, la base delle varianti note come ASCII esteso. Coprendo solo l'inglese, però, ASCII non basta per le lingue con accenti, ideogrammi o altri alfabeti: un limite che Unicode arriverà a risolvere. Leggi il Recap →
    • Tecnologia Codice binario: cos'è e come il computer scrive i numeri Il codice binario è il modo in cui un computer rappresenta i numeri usando solo due cifre, 0 e 1. Il motivo è fisico: i suoi circuiti riconoscono con affidabilità due soli stati elettrici, corrente assente o corrente presente, e li chiamiamo comodamente 0 e 1. Come nel sistema decimale, ogni cifra vale in base alla posizione che occupa, ma qui le posizioni valgono potenze di due invece che di dieci: il numero 101 vale (1×4)+(0×2)+(1×1), cioè 5. Otto di queste cifre messe insieme formano un byte, l'unità con cui un computer rappresenta tipicamente un numero. Il binario basta per i numeri: per scrivere anche le lettere serve un'altra convenzione, come ASCII o Unicode, di cui parleremo in Recap dedicati. Leggi il Recap →
    • Tecnologia SEO, AEO, GEO: cosa sono? SEO, AEO e GEO sono tre sigle che descrivono come farsi trovare online, ma non sono la stessa cosa. La SEO (Search Engine Optimization) ottimizza un sito per comparire nei risultati tradizionali di un motore di ricerca, quelli con l'elenco di link blu. L'AEO (Answer Engine Optimization) punta a un traguardo diverso: comparire direttamente dentro una risposta, per esempio in un box vocale o in un riquadro che risponde senza bisogno di cliccare. La GEO (Generative Engine Optimization) è la più recente delle tre e riguarda la visibilità dentro le risposte scritte da un'intelligenza artificiale generativa. Google stessa, però, dice che i fondamentali della SEO restano validi anche per comparire nelle sue funzionalità basate su IA. Leggi il Recap →

    recaplica

    Chiaro in 30 secondi, tuo in 10 minuti.

    I Recap Mappe concettuali Chiedi un Recap Canale Telegram Crea una mappa concettuale Il metodo Chi siamo Privacy e cookie Note legali e condizioni d'uso

    © 2026 Recaplica · Un progetto di Curi S.r.l. — P. IVA 05472000750

    Statistiche, solo se vuoi

    Per capire quali Recap aiutano di più useremmo Google Analytics, con dati aggregati e anonimi. Parte solo col tuo ok, e puoi cambiare idea quando vuoi. Informativa privacy