Visão geral
TRON Code é uma codificação de caracteres multibyte usada no projeto TRON. É similar ao Unicode, mas não usa o processo de unificação Han do Unicode: cada caractere de cada conjunto de caracteres CJK é codificado separadamente, incluindo equivalentes arcaicos e históricos de caracteres modernos. Isso significa que textos em chinês, japonês e coreano podem ser misturados sem qualquer ambiguidade quanto à forma exata dos caracteres; no entanto, isso também significa que muitos caracteres com semântica equivalente serão codificados mais de uma vez, complicando algumas operações.
TRON tem espaço para 150 milhões de pontos de código. Pontos de código separados para variantes chinesas, coreanas e japonesas dos mais de 70.000 caracteres Han no Unicode 4.1 (se isso fosse considerado necessário) exigiriam mais de 200.000 pontos de código no TRON. TRON inclui os caracteres não-Han do Unicode 2.0, mas não tem acompanhado as edições recentes do Unicode à medida que o Unicode se expande além do Plano Multilíngue Básico e adiciona caracteres a scripts existentes. A codificação TRON foi atualizada para incluir outras atualizações recentes de páginas de código, como JIS X 0213.
Fontes para a codificação TRON estão disponíveis, mas elas têm restrições para uso comercial.
Estrutura
Cada caractere no TRON Code tem dois bytes. De forma similar à ISO/IEC 2022, a codificação de caracteres TRON lida com caracteres em múltiplos conjuntos de caracteres dentro de uma única codificação de caracteres usando sequências de escape, chamadas de códigos especificadores de idioma, para alternar entre planos de 48.400 pontos de código. Os conjuntos de caracteres incorporados ao TRON Code incluem conjuntos de caracteres existentes, como JIS X 0208 e GB 2312, bem como outras fontes de caracteres, como o Dai Kan-Wa Jiten, e alguns scripts não incluídos em outras codificações, como os símbolos Dongba.
Da Wikipédia (CC BY-SA 4.0).