令和6年度 秋期 午前Ⅱ 問4
トランザクション処理
転置インデックスに関する記述
転置インデックスに関する記述として,適切なものはどれか。
- アSQL関数を評価した結果の値をインデックスとして使用する。
- イ最上位のノードから,実データへのポインタを格納したリーフノードへと至るポインタをインデックスとして使用する。
- ウテキストに含まれる単語に対して,その単語を含むテキストへのポインタをインデックスとして使用する。
- エヒープ領域を使用せずに実データを物理的に並べ替えたデータをインデックスとして使用する。
答えと解説を見る
✓ これが正解ウテキストに含まれる単語に対して,その単語を含むテキストへのポインタをインデックスとして使用する。
解説
単語ごとに、その単語を含むテキストへのポインタを持つ索引です。
転置インデックスは、文書の側から単語を引くのではなく、単語の側から、その単語が現れる文書を引けるようにした索引です。テキストを単語に分け、単語ごとに、その単語を含むテキストへのポインタの一覧を作っておきます。検索語が与えられたら、その単語の一覧を見るだけで該当するテキストが分かるので、全文検索で大量の文書を素早く探せます。本の巻末にある索引が、語からページを引けるのと同じ考え方です。見分ける軸は、インデックスのキーが何かです。キーがテキストに含まれる単語であれば転置インデックス、列の値や関数の結果であれば別の種類のインデックスと覚えておきましょう。
ほかの選択肢はなぜ違うのか
- アSQL関数を評価した結果の値をインデック…:SQL 関数を評価した結果の値をキーにするのは、関数や式の結果で作るインデックスの説明です。たとえば大文字に変換した値で検索したいときに使うもので、単語から文書を引く仕組みではありません。
- イ最上位のノードから,実データへのポインタ…:最上位のノードから、実データへのポインタを持つリーフノードまでをたどる構造は、B+木インデックスの説明です。キーの値で行を探すための木構造であり、単語からテキストを引く転置インデックスとは違います。
- エヒープ領域を使用せずに実データを物理的に…:ヒープ領域を使わず、実データそのものを物理的に並べ替えて持つのは、表のデータをキーの順に格納して索引として使う方式の説明です。テキスト中の単語を手掛かりにする仕組みではありません。
出典:令和6年度 秋期 データベーススペシャリスト試験 午前Ⅱ 問4
この解説に誤りを見つけたら教えてください。直して、直した記録を残します。誤りを報告する(メールが開きます)