Unicode está presente em mais de 60% da web
De acordo com dados divulgados pelo Google, o Unicode registrou um crescimento de 800% no marketshare desde 2006, e hoje está presente em mais de 60% da web. A empresa separou o ASCII (aproximadamente 16%), já que ele é um subconjunto da maioria das outras codificações. Mas, se ele for considerado, quase 80% dos documentos da web estão em Unicode.

Ele é um padrão que permite aos computadores representar e manipular, de forma consistente, texto de qualquer sistema de escrita existente, e consiste de pouco mais de 107 mil caracteres, um conjunto de diagramas de códigos para referência visual, uma metodologia para codificação e um conjunto de codificações padrões de caracteres, uma enumeração de propriedades de caracteres como caixa alta e caixa baixa, um conjunto de arquivos de computador com dados de referência, além de regras para normalização, decomposição, ordenação alfabética e renderização.
O Google afirmou que usa o Unicode há bastante tempo como o formato interno de todos os textos de busca e de processos da empresa: qualquer outra codificação é primeiro convertida para o Unicode.
A versão 6.1 do padrão, liberada no final de janeiro, veio com mais de 110 mil caracteres. Em breve, o Google realizará a atualização para essa versão e para o locale do Unicode a partir do CLDR 21 (ambos via ICU).
O gigante da internet afirmou que o crescimento do uso do Unicode torna mais fácil o processamento das várias linguagens que a empresa cobre. Sem ele, o índice unificado da companhia seria praticamente impossível.






