文字コードとは?
文字コードとは、文字を数値に対応づけて表現する体系。ASCIIは英数字・記号を7ビットで表す規格。Unicodeは世界中の文字を統一的に扱う規格で、その代表的な符号化方式であるUTF-8は、文字によって1〜4バイトの可変長でデータ量を抑えつつ多言語を表現できる。
応用情報技術者試験の過去問では3回出題されています(2017年度〜2025年度)。
もじこーど
文字コードの意味
文字を数値に対応づけて表現する体系。ASCIIは英数字・記号を7ビットで表す規格。Unicodeは世界中の文字を統一的に扱う規格で、その代表的な符号化方式であるUTF-8は、文字によって1〜4バイトの可変長でデータ量を抑えつつ多言語を表現できる。
文字コードの具体例
異なる文字コードで作成されたファイルを誤った文字コードで開くと、文字化けが発生する。Web開発では現在、多言語対応のしやすさからUTF-8が広く使われている。
文字コードは試験でどう引っ掛けられる?
文字コードの不一致による文字化けの原因と対処(正しい文字コードを指定して開き直す)は頻出のテーマ。
文字コードと関連する用語
文字コードが出た過去問
UTF-8の説明に関する記述として、適切なものはどれか。
正解:1文字を1バイトから4バイト(又は6バイト)までの可変長で表現しており、ASCIIと上位互換性がある。
要点:UTF-8は1〜4バイトの可変長でASCIIと上位互換
UTF-8はUnicodeの符号化方式の一つで、1文字を1〜4バイト(元の規格では最大6バイト)の可変長で表現する。ASCIIの範囲の文字はそのまま1バイトで表されるため、既存のASCIIテキストがそのままUTF-8として通用する上位互換性をもつ。
出典:平成29年度 秋期 応用情報技術者試験 午前 問4(IPA)XMLにおいて、XML宣言中で符号化宣言を省略できる文字コードはどれか。
正解:UTF-16
要点:XMLで符号化宣言を省略できるのはUTF-8とUTF-16
XML宣言のencoding属性(符号化宣言)を省略できるのは、XMLプロセッサが既定で認識できるUTF-8とUTF-16だけです。UTF-16はBOMの有無とバイト並びから判別できるため宣言が不要です。それ以外の文字コードは明示しないと正しく解釈されません。
出典:令和4年度 秋期 応用情報技術者試験 午前 問7(IPA)30kバイトのJPEGファイルを電子メールに添付するとき,実際の転送データはおよそ何kバイトになるか。ここで,添付ファイルはMIME base64を用いてエンコ…
正解:40
要点:base64は3バイトを4文字にするため、約4/3倍に膨らむ
base64は3バイトのデータを4文字のASCIIに変換する方式なので、エンコード後のサイズはおよそ4/3倍になる。30kバイトのファイルなら30×4/3=40kバイト程度になる。実際には改行やヘッダーが加わるが、概算では40kバイトが妥当である。
出典:令和7年度 春期 応用情報技術者試験 午前 問34(IPA)
最終更新:2026-08-25/解説は資格暗記が独自に作成しています。 過去問の出典は各問題に記載のとおりです。