Conversor de largura completa e meia largura

Choose the target width. The converter uses explicit ASCII and Katakana character tables and leaves unsupported characters unchanged.

Target width

Altere apenas a largura dos caracteres em textos que misturam japonês e alfabeto latino. Escolha uma saída de largura completa ou meia largura para até 10.000 pontos de código Unicode. As tabelas explícitas de ASCII, pontuação e katakana são aplicadas na sessão atual do navegador; kanji, hiragana, emojis e caracteres não incluídos permanecem intactos.

As formas de largura completa e meia largura são caracteres Unicode distintos, não apenas uma configuração de tamanho da fonte. A seção 18.5 da especificação principal Unicode 17 explica sua origem nos sistemas do Leste Asiático, nos quais alguns caracteres ocupavam duas células e o ASCII uma.

Este conversor aplica deliberadamente um conjunto limitado e verificável de substituições. Não executa uma normalização geral de compatibilidade Unicode.

ASCII e espaço

Na direção de largura completa, cada caractere ASCII imprimível de U+0021 a U+007E corresponde a U+FF01 até U+FF5E. O espaço ASCII U+0020 torna-se o espaço ideográfico U+3000. A direção inversa altera apenas esses equivalentes. A tabela Unicode Halfwidth and Fullwidth Forms documenta estas correspondências.

Direção Entrada Saída
Para largura completa ABC 123!? ABC 123!?
Para meia largura ABC 123!? ABC 123!?
Para largura completa 東京2026 ガイド😀 東京2026 ガイド😀

No último exemplo, mudam os dígitos ASCII, o espaço e os katakana suportados. 東京 e o emoji permanecem intactos.

Katakana, pontuação e marcas sonoras

Uma tabela explícita inclui os katakana de meia largura, a pontuação japonesa e a marca de prolongamento. A lista de nomes Unicode de U+FF00 a U+FFEF registra pares como /, /, / e /.

Direção Entrada Saída
Para largura completa ガ パ ヴ ガ パ ヴ
Para meia largura ガ パ ヴ ガ パ ヴ
Para largura completa 。、「」・ー 。、「」・ー
Para meia largura 。、「」・ー 。、「」・ー

Os pares sonoros e semissonoros suportados são compostos explicitamente: ガ, パ, ヴ, além de ヷ e ヺ. Os kana não incluídos, como , , , , e , não são inferidos nem transliterados. U+FF9E e U+FF9F são os equivalentes estritos das marcas combinatórias U+3099 e U+309A. As marcas espaçadoras U+309B e U+309C permanecem inalteradas.

Uma ressalva precisa sobre normalização

Isto não é NFKC. O Anexo 15 da norma Unicode mostra que o NFKC também altera muitas formas de compatibilidade alheias à largura. Este conversor aplica somente as tabelas descritas.

Existe um detalhe intencional de composição: tanto o pré-composto como a sequência seguida de U+3099 são estreitados para ガ. Ao alargar esse resultado obtém-se o pré-composto habitual. A leitura visível é preservada, mas não se garante a recuperação da sequência original de pontos de código.

Direção Entrada Saída
Para largura completa ~〜~ ~〜~
Para meia largura ~〜~ ~〜~

O til U+007E do ASCII e o til U+FF5E de largura completa formam um par. O traço ondulado U+301C é outro caractere e não muda.

O que permanece inalterado

Tabulações, quebras de linha, espaços inquebráveis U+00A0, hiragana, kanji, emojis, hangul de meia largura, kana não suportados, dígitos árabe-indianos e qualquer ponto de código não incluído são preservados. O conversor não traduz, translitera, calcula nem converte hiragana em katakana.

A ficha do JIS X 0201:1997 da Japanese Standards Association fornece o contexto histórico do repertório. Esta ferramenta não examina a codificação de arquivos nem certifica a conformidade com o JIS ou requisitos de documentos oficiais. Atua apenas sobre o texto Unicode recebido pelo navegador.

Privacidade e limite

A conversão ocorre no navegador. O texto original e a direção são salvos no sessionStorage da sessão atual durante as três etapas. Não são enviados aos nossos servidores, não entram na URL e são apagados ao recomeçar. Os gerenciadores da área de transferência, as extensões e o destino em que você cola o resultado ficam fora do controle da ferramenta.

O limite é de 10.000 pontos de código Unicode, não de unidades UTF-16; por isso, um emoji conta uma vez. Uma base katakana com uma marca combinatória suportada pode se tornar um único caractere pré-composto. O limite controla a entrada e não garante o mesmo número de pontos de código na saída.

Perguntas frequentes

Não. Usa apenas os pares de largura explícitos de ASCII, espaço, pontuação e katakana. O NFKC tem efeitos de compatibilidade muito mais amplos.

Não. O hiragana permanece intacto. A ferramenta só altera os pares de largura indicados e não traduz nem translitera japonês.

A sequência decomposta e o ガ pré-composto tornam-se ambos ガ. A conversão para largura completa devolve depois o caractere pré-composto habitual.

Não. Só o til ASCII e o til de largura completa formam um par. O traço ondulado U+301C permanece inalterado.

Não. A codificação binária, a estrutura do arquivo e os requisitos documentais não são examinados, e nenhuma conformidade JIS ou oficial é certificada.

Não. É processado localmente e mantido apenas na sessão atual do navegador para a exibição em várias etapas.

Ferramentas relacionadas

Ferramenta disponível em outros idiomas