全角半角変換(英数字・カタカナ・記号・スペース)|種類ごとに選べる・無料
英字・数字・記号・スペース・カタカナを、種類ごとに ON/OFF して全角⇔半角に変換します。変わった箇所と種類別の件数、変換できなかった文字の一覧を、結果にまとめて出します。
1,000,000 文字(コードポイント)以下。入力が止まると変換します。改行・タブはそのまま残します。
変わった文字は黄色の背景で示します。
| 種類 | 変換した数 | OFF のため残した数 |
|---|---|---|
| 英字 | 6 | 0 |
| 数字 | 10 | 0 |
| 記号 | 5 | 0 |
| スペース | 1 | 0 |
| カタカナ | 3 | 0 |
変換した1まとまりを1と数えます(ガ→ガ は1)。
- ひらがな 0字(半角形がないので、そのまま残しています)
- 変換しなかった文字(もとから全角/半角の字・漢字・絵文字など) 4字
- 文字数(コードポイント): 変換前 29字 → 変換後 32字(ガ は2字・ガ は1字)
全角と半角は、どの文字が対応しているか
このツールは、Unicode が全角形・半角形として決めている対応だけで変換します。UnicodeData(UCD 18.0.0)で、互換分解の型が <wide> の文字が全角形、<narrow> の文字が半角形です。<wide> の全角形は104字(U+3000 と U+FF01〜FF60・U+FFE0〜FFE6)で、このツールが扱う半角形は、半角カナのブロック U+FF61〜FF9F の63字です。半角ハングル(U+FFA0〜FFDC)と U+FFE8〜FFEE は対象外で、半角→全角のときは「変換できなかった文字」として一覧に出します。 UnicodeData.txt(UCD 18.0.0) UAX #11 East Asian Width Unicode 文字表 Halfwidth and Fullwidth Forms
変換する種類は5つです。種類ごとに、対応する文字は次のとおりです。
| 種類 | 含む文字 | 対応の数 |
|---|---|---|
| 英字 | A–Z a–z ⇔ ABC…z(U+FF21〜FF3A・FF41〜FF5A) | 52 |
| 数字 | 0–9 ⇔ 0〜9(U+FF10〜FF19) | 10 |
| 記号 | ASCII 記号32字 ⇔ U+FF01〜FF0F・FF1A〜FF20・FF3B〜FF40・FF5B〜FF5E/¢ £ ¬ ¯ ¦ ¥ ₩ ⇔ U+FFE0〜FFE6/⦅ ⦆ ⇔ U+FF5F・FF60 | 41 |
| スペース | U+0020 ⇔ U+3000 のみ | 1 |
| カタカナ(。、「」・ー を含む) | 半角カナ U+FF61〜FF9F の63字(ヲ〜ン・小書き・ー・。「」、・・゙ ゚)⇔ 全角。濁点・半濁点つき28字(濁音23+半濁音5)。゛゜(U+309B・309C)と結合文字(U+3099・309A) | 63+28 |
英字・数字・記号・スペースの変換ルール
英字と数字は、A–Z a–z 0–9 と全角の ABC…z・0〜9 が1対1です。記号は ASCII の記号32字に、¢ £ ¬ ¯ ¦ ¥ ₩ の7字と ⦅ ⦆ の2字を加えた41字です。
¥と \ 円記号 ¥(U+00A5)の全角形は ¥(U+FFE5)、バックスラッシュ \(U+005C)の全角形は \(U+FF3C)です。Unicode では U+005C と U+00A5 は別の字として扱われます。RFC 1468 には「The backslash is replaced by the Yen sign, and the tilde is replaced by overline.」という文があります。全角→半角のとき、¥ は U+00A5 の ¥ になり、\ にはしません。 RFC 1468(ISO-2022-JP)
~と〜 チルダ ~(U+007E)の全角形は ~(U+FF5E)です。波ダッシュ 〜(U+301C)には全角形・半角形の分解が無いので、変換しません。
ハイフンとダッシュ ハイフンマイナス -(U+002D)の全角形は -(U+FF0D)だけです。マイナス記号(U+2212)、ハイフン・ダッシュ類(U+2010〜2015)、長音 ー(U+30FC)は U+002D と対応しません。長音 ー は半角カナの ー(U+FF70)に対応するので、カタカナの種類で変換します。
引用符 ' " ` は U+FF07・U+FF02・U+FF40 と対応します。U+2018・U+2019・U+201C・U+201D の引用符には分解が無く、U+00B4 は <wide> ではないので、変換しません。
全角→半角の入力に次の13字があれば、変換せず、変換できなかった文字の一覧に「見た目が似た別の文字(変換しない)」として出します(種類の ON/OFF に関係なく出します): ´(U+00B4)、‐(U+2010)、‑(U+2011)、‒(U+2012)、–(U+2013)、—(U+2014)、―(U+2015)、‘(U+2018)、’(U+2019)、“(U+201C)、”(U+201D)、−(U+2212)、〜(U+301C)。
スペース 対応するのは U+0020 と U+3000 だけです。U+00A0 などの別の空白は変換しません。タブ・改行・制御文字も変えません。
カタカナ・濁点・半濁点の変換
半角カナのブロック U+FF61〜FF9F の63字は、全角に1対1で対応します(゙ ゚ を含む)。。、「」・ー の6字(。 、 「 」 ・ ー)もこのブロックにあるので、「カタカナ」の種類に入れています。
濁点・半濁点 半角→全角では ガ が ガ、パ が パ になり、全角→半角では ガ が ガ になります。UnicodeData の正規分解に従い、濁音23字(ガギグゲゴザジズゼゾダヂヅデドバビブベボヴヷヺ)と半濁音5字(パピプペポ)の合わせて28字が対象です。ヴ は ヴ、ヷ は ヷ、ヺ は ヺ になります。
半角→全角で、直前の字と合成できない ゙ ゚(行頭のもの、ア゙ のように基底が合成表にない組、2つ目の ゙ など)は、゛゜(U+309B・309C)に変換して「結合できなかった濁点」と数えます。全角→半角では、カ+U+3099 のように基底に結合文字が続く並びも ガ に変換します。直前が、このツールが半角にしたカタカナでない U+3099・309A(ひらがなの後・行頭・もとから半角のカナの後など)は変換せず、一覧に出します。半角にしたカタカナの後でも合成できない組(ア+U+3099 など)は ゙ ゚ にして、「結合できなかった濁点」と数えます。カタカナを OFF にしているときは、ON なら ゙ ゚ になる結合文字を一覧に出さず、OFF の件数に数えます。
半角形のないカタカナ カタカナのブロック(U+30A0〜30FF)の中で、半角形が無い字は11字です: ヮ ヰ ヱ ヵ ヶ ヸ ヹ ヽ ヾ ヿ ゠。変換せず、「半角形なし」として一覧に出します。ヸ・ヹ・ヾ は濁点つきの字ですが、半角形のある基底を持たないので変換しません。このブロックの外のカタカナ(U+31F0〜31FF の小書きカタカナ、U+32D0〜32FE の丸囲みカタカナなど)は、「変換しなかった文字」に数えます。
ひらがな 半角形が無いので、そのまま残します。全角→半角のときは、ひらがなの件数だけを結果に出します。
Excel の ASC 関数・JIS 関数との違い
Microsoft の ASC 関数の説明(日本語版)には、「2 バイト文字セット (DBCS) 言語の場合、全角 (2 バイト) 文字を半角 (1 バイト) 文字に変更します。」とあり、引数の説明に「文字列に全角文字が含まれない場合は、文字列は変換されません。」とあります。カタカナの例は画像で示されていて、代替テキストでは、全角カタカナの エ・ク・セ・ル が半角カタカナになる例です。 Microsoft サポート ASC 関数
JIS 関数の説明には、「この関数の名前および変換する文字は、使用する言語の設定によって異なります。日本語では、文字列内の半角 (1 バイト) の英数カナ文字を全角 (2 バイト) の文字に変換します。」とあります。 Microsoft サポート JIS 関数
このツールの変換は、上の「全角と半角は、どの文字が対応しているか」の対応だけです。記号・スペース・濁点つきカナ・長音・括弧の扱いは Microsoft の説明に書かれていないので、Excel の結果と一致するかは確認していません。このツールに、Excel に合わせる設定はありません。
半角カナが指定される例・全角が指定される例
RFC 1468 には「The Kana set of JIS X 0201 is not used in ISO-2022-JP messages.」とあります。ISO-2022-JP のメッセージでは、JIS X 0201 のカナ(半角カナ)は使われないということです。 RFC 1468(ISO-2022-JP)
中央信用金庫の「総合振込、給与振込・賞与振込(全銀フォーマット)」の項目表の値では、依頼人名(40桁)・受取人名(30桁)・金融機関名・支店名(各15桁)の文字形態は半角カナです。一方、楽天銀行の振込依頼人名の入力は「入力できる文字は「全角カナ英数」です。(48文字以内)」とあります。同じ振込でも、ファイルは半角カナ、画面は全角というように、入力口によって求められる形が違います。各金融機関の案内に従ってください。 中央信用金庫 全銀フォーマット 楽天銀行 振込依頼人名
濁点の文字数 半角カナの ガ は2コードポイント、全角の ガ は1コードポイントです。このツールの文字数はコードポイントで、銀行の入力欄の数え方とは別です。楽天銀行は「濁点「゛」、半濁点「゜」、スペースも1文字として数えます。」と案内していて、例は「例:スズキ(全角スペース)イチロウ → 9文字(濁音とスペースも文字数に入れます。)」です(原文では、この全角スペースが画像で表示されています)。
この変換で変えない文字
㈱ ① ㌔ ㎏ fi Ⅱ のような互換文字は変えません。互換分解を一括で適用する NFKC では、㈱ が (株)、① が 1、㌔ が キロ、㎏ が kg、fi が fi、Ⅱ が II に変わり、ガ も ガ、¥ も ¥ に変わります。このツールは <wide> と <narrow> の対応だけを使うので、これらは変換しません。表にない文字は、そのまま残して「変換しなかった文字(もとから全角/半角の字・漢字・絵文字など)」に数えます。
変換の方法と出典
入力を1コードポイントずつ読み、対応表にある文字だけを変換します。サロゲートペア(絵文字など)と ZWJ は触りません。結果に出す文字数も、コードポイントの数です。変換の対応は、UnicodeData(UCD 18.0.0)の <wide>・<narrow> の行と突き合わせて確かめています。
- UnicodeData.txt(UCD 18.0.0)
- UAX #11 East Asian Width
- RFC 1468(ISO-2022-JP)
- Microsoft サポート ASC 関数
- Microsoft サポート JIS 関数
よくある質問
全角を半角に一括で変換するには、どうすればよいですか?
結論:このページの入力欄に文章を貼り、方向を「全角 → 半角」にすると、英字・数字・記号・スペース・カタカナを種類ごとに選んで一括で変換できます。Excel には ASC 関数がありますが、ASC が変換する文字の範囲は Microsoft の ASC 関数の説明に書かれていません。
Excel の ASC 関数は何を変換しますか?
結論:Microsoft の説明(日本語版)には「2 バイト文字セット (DBCS) 言語の場合、全角 (2 バイト) 文字を半角 (1 バイト) 文字に変更します。」とあります。記号・スペース・濁点つきのカナ・長音・括弧をどう扱うかは、この説明に書かれていません。このツールの結果が Excel の結果と一致するかは確認していません。
¥と\は同じ文字ですか?
結論:Unicode では別の文字です。円記号 ¥ は U+00A5 で、全角形は U+FFE5 の ¥ です。バックスラッシュ \ は U+005C で、全角形は U+FF3C の \ です。このツールは ¥ を U+00A5 の ¥ に変換し、U+005C の \ にはしません。
~と〜は同じ文字ですか?
結論:Unicode では別の文字です。~ は U+FF5E の全角チルダで、半角形は U+007E の ~ です。〜 は U+301C の波ダッシュで、全角形・半角形の分解を持たないため、このツールは変換しません(変換できなかった文字の一覧に出します)。
半角カナの濁点は何文字ですか?
結論:半角カナの ガ は2コードポイント、全角の ガ は1コードポイントです。このツールの文字数はコードポイントで数えていて、銀行の入力欄の数え方とは別です。楽天銀行の振込依頼人名の案内には「例:スズキ(全角スペース)イチロウ → 9文字(濁音とスペースも文字数に入れます。)」とあります(原文では、この全角スペースが画像で表示されています)。そこでは、全角の ズ も ス と ゛ の2文字に数えられています。
入力した文章は送信されますか?
結論:ブラウザの中だけで変換していて、入力した文章は送信しません。共有用の URL にも文章は入らず、入るのは方向と5つの種類の ON/OFF だけです。
関連ツール
本ツールは Unicode の全角形・半角形の対応で文字を置き換える道具です。Excel の ASC 関数・JIS 関数や、各金融機関・各サービスの入力欄の結果と一致するとは限りません。提出先の指定に従って、結果を確認してから使ってください。