そもそも全角と半角はなぜあるのか──1バイトの世界に漢字を押し込んだ歴史
全角・半角という概念は、1バイトの英数字コードに2バイトの漢字をあとから組み込んだ日本語コンピュータの歴史から生まれました。等幅フォントに残る「半分の角」という語源をたどります。
「全角で入力してください」「半角に直してください」と当たり前のように求められますが、そもそもなぜ日本語の文字入力だけに「全角」「半角」という2種類の幅が存在するのか、立ち止まって考えたことがある人は多くないはずです。英語だけを使うコンピュータの世界には、そもそもこの区別自体が存在しません。
結論を先に書きます。
全角・半角という区別は、もともと1バイト=256通りしか文字を表現できなかったコンピュータの文字コードに、数千種類ある漢字をあとから押し込んだ、日本語コンピュータ化の歴史が生んだ産物です。等幅フォントで表示したとき、漢字1文字がちょうど英数字2文字分の横幅を占めたことから、英数字側が「漢字の半分の角」=半角と呼ばれるようになりました。
最初にあったのは「半角カナ」だけだった
1969年ごろに定められた日本語向けの文字コード(JIS X 0201の前身)は、**1バイト(8ビット、最大256通り)**の枠に収まる文字しか扱えませんでした。この枠には、アルファベット・数字・記号に加えて、カタカナを1バイトに収めた「半角カナ」が割り当てられます。
一方、漢字はこの時点ではまだコンピュータで扱えませんでした。理由は単純な算数です。1バイトでは256通りしか区別できず、日本語の常用漢字だけでも2000字を超えるため、とても収まりきらなかったのです。当時のコンピュータは英語圏で生まれた仕組みをそのまま流用していたため、まずは既存の1バイトの枠に「なんとか日本語らしきものを収める」ところから始まった、というのが実情でした。半角カナが濁点・半濁点を独立した1文字として扱う仕様になっているのも、限られた256通りの枠の中でやりくりした結果です。
漢字を扱うために「2バイト」の世界が作られた
漢字をコンピュータで扱うために、1978年に制定されたのが**2バイト(16ビット、最大65536通り)**の漢字コードです。2バイトあれば、常用漢字はもちろん、ひらがな・カタカナ・記号を含めて6000字を超える文字を収録できます。
この2バイトの文字コードには、既存の1バイトのカタカナ・記号も、改めて2バイト分の枠を使って収録し直されました。同じ「ア」でも、1バイトで表現された半角カタカナと、2バイトで表現された全角カタカナが、コード上は別の文字として並存することになったわけです。この「1バイトの世界」と「2バイトの世界」を1つの文章の中で共存させる仕組みとして、シフトJISなどの文字コードが考案され、コンピュータは特定のバイトの並びを見て「ここから2バイト文字が始まる」と判別するようになりました。
なぜ「半角」と呼ばれるようになったのか
当時のディスプレイやプリンタは、文字ごとに幅が変わらない等幅フォントが主流でした。この等幅フォントで表示すると、2バイトの漢字1文字は、ちょうど1バイトの英数字2文字分の横幅を占めます。
つまり画面上の見た目としては、
- 英数字1文字の幅 = 漢字1文字の幅のちょうど半分
という関係になり、ここから英数字側の幅を「半角」、漢字側の幅を「全角」と呼ぶようになった、というのが一般に語られる語源です。文字コードのビット数の違いが、そのまま画面上の見た目の幅の違いとして表れ、それが呼び名として定着したことになります。「全角」の「角」は、活版印刷で使われていた正方形の活字の枠(body)を指す言葉に由来するとも言われ、コンピュータ以前の印刷の世界の言葉が、そのまま文字コードの呼び名として受け継がれた形です。
今も残る全角半角の区別
現在主流のUnicodeでは、文字コードの技術的な制約自体はほとんど解消されています。世界中のあらゆる文字を1つの巨大な文字集合で扱えるようになったため、「1バイトに収まるかどうか」を気にする必要はなくなりました。それでもなお「全角スペース」「半角カナ」という区別が生き続けているのは、**East Asian Width(東アジアの文字幅)**という、文字ごとの表示幅の情報がUnicodeの規格そのものに引き継がれているためです。フォームの入力チェックや帳票のレイアウトが今も全角・半角にこだわるのは、この歴史の名残と言えます。
興味深いのは、幅の呼び名だけが「文化」として生き残り、当時の技術的な事情そのものはほとんど忘れられている点です。今の利用者の多くは「なぜ全角というのか」を意識せずに、フォームの指定に従って半角・全角を打ち分けています。1バイトに収まらない文字をどう扱うかという、コンピュータ黎明期の切実な制約から生まれた言葉が、技術的な理由が解消されたあとも呼び名として残り続けている、という点に、この区別の歴史の面白さがあります。
コピペした文章の全角・半角が入り混じって崩れてしまったときは、半角全角を整える で英数字・カナ・記号・空白をそれぞれ狙って統一できます。文章量や原稿の分量を確認するときに、全角・半角の内訳まで含めて数えたい場合は、文字数カウントを整える で貼り付けるだけで種類別の内訳まで一発表示されます。