Unicode

Unicodeは、汎用的な文字コードの標準規格です。テキストファイル、Webページ、その他の種類のドキュメントで、個々の文字をどのように表現するかを定めています。

基本的な英語の文字だけを表現するために設計されたASCIIとは異なり、Unicodeは世界中のあらゆる言語の文字をサポートするために設計されました。標準のASCII文字セットがサポートする文字数は128文字だけですが、Unicodeはおよそ1,000,000文字をサポートできます。ASCIIが各文字の表現に1バイトだけを使うのに対し、Unicodeは各文字に最大4バイトを使用できます。

Unicodeにはいくつかの異なるエンコード方式がありますが、最も一般的なのはUTF-8とUTF-16です。UTF-8はWebで使われる標準的な文字コードになっており、多くのソフトウェアプログラムでデフォルトのエンコード方式としても使われています。UTF-8は1文字あたり最大4バイトをサポートしますが、頻繁に使われる文字を表すために4バイトを使うのは非効率的です。そのため、UTF-8は一般的な英語の文字の表現には1バイトだけを使います。ヨーロッパの文字(ラテン文字)、ヘブライ文字、アラビア文字は2バイトで表現され、中国語、日本語、韓国語などのアジアの文字には3バイトが使われます。その他のUnicode文字は4バイトで表現できます。

更新日 April 20, 2012 著者: Per C.

quiz知識をテストする

In what year was the 802.11a wireless standard released?

A
1999
0%
B
2001
0%
C
2003
0%
D
2005
0%
Correct! Incorrect!     View the 802.11a definition.
More Quizzes →

Tech Terms コンピューター辞書

このページのUnicodeの定義は、TechTerms.comの著者が執筆したオリジナルの定義です。このページを参照または引用する場合は、定義の直下にある緑色の引用バーをご利用ください。

私たちの目標は、コンピューター用語をわかりやすく説明することです。すべての定義において正確さとわかりやすさを追求しています。フィードバックや新しい技術用語の提案がある場合は、お問い合わせください

Tech Terms ニュースレター

毎日または毎週のニュースレターで技術知識を高めましょう!今すぐ購読して、新しい用語やクイズをメールでお受け取りください。

無料のTechTermsニュースレターに登録する

メールの受信頻度を選択してください

各メールのリンクから、いつでも登録解除または頻度変更ができます。 ご質問はこちらからお問い合わせください。

注意:ニュースレターは英語で配信されます。