Strumenti Testo Online Gratis — Analisi, Converti
Strumenti testo gratuiti: conta parole, converti maiuscolo/minuscolo, ordina righe, trova e sostituisci. Funziona offline nel browser, senza registrazione.
📖 Storia
La codifica del testo ha attraversato decenni di frammentazione: ASCII (1963, 128 caratteri), poi centinaia di encoding regionali incompatibili (ISO-8859-1 per l'Europa occidentale, Shift-JIS per il giapponese, GB2312 per il cinese). Il Consorzio Unicode fu fondato nel 1991 da Apple, IBM, Microsoft e altri per creare un unico standard universale.
UTF-8 fu progettato da Ken Thompson e Rob Pike nel settembre 1992 su un tovagliolo di carta in un ristorante del New Jersey. La sua genialità: compatibilità totale con ASCII per i primi 128 caratteri, ed estensione a byte multipli per tutto il resto. Oggi UTF-8 rappresenta il 98% dei siti web e ha de facto eliminato i problemi di encoding cross-platform.
💡 Curiosità
- Twitter/X permette 280 caratteri Unicode — ma un emoji flag come 🇮🇹 conta come 2 caratteri (codepoint), non 1, per via della codifica UTF-16.
- Le espressioni regolari (regex) furono formalizzate da Stephen Kleene negli anni '50 come notazione matematica per i linguaggi formali, poi implementate in Unix da Ken Thompson nel 1968.
- La lunghezza massima di un meta description SEO è circa 155-160 caratteri — oltre quel limite Google tronca il testo nei risultati di ricerca.
- Lorem Ipsum deriva dal "De Finibus Bonorum et Malorum" di Cicerone (45 a.C.), alterato e usato come testo segnaposto sin dal XVI secolo nelle tipografie.
❓ Domande Frequenti
Qual è la differenza tra caratteri e byte?
In ASCII un carattere = 1 byte. In UTF-8 un carattere può occupare 1-4 byte: caratteri ASCII usano 1 byte, latini estesi 2 byte, caratteri asiatici 3 byte, emoji 4 byte. Un testo di 100 caratteri giapponesi occupa 300 byte in UTF-8 ma 200 in UTF-16.
Cosa sono le espressioni regolari?
Le espressioni regolari (regex) sono sequenze di caratteri che definiscono un pattern di ricerca nel testo. \d+ corrisponde a una o più cifre; [A-Z]{2} a due lettere maiuscole; \b\w+@\w+\.\w+\b a indirizzi email semplici. Sono supportate in tutti i linguaggi di programmazione moderni e in molti editor di testo.
Come funziona il conteggio delle parole nei diversi sistemi?
La maggior parte dei sistemi definisce "parola" come sequenza di caratteri separata da spazi o punteggiatura. Microsoft Word e Google Docs usano algoritmi simili ma non identici — piccole differenze sono normali. Per lingue senza spazi come cinese e giapponese, il conteggio usa segmentazione morfologica, più complessa.
Strumenti correlati
Convertitore Dati Digitali — KB, MB, GB, TB Convertitore Basi Numeriche — Binario, Hex Convertitore Colori Online — HEX, RGB, HSL Calcolatrice Scientifica Online Gratis Dev Tools Online — Base64, JSON, Hash, UUID Generatore QR Code Online Gratis