調査方法
平均図鑑のデータがどのように作られているかを説明します。
メディアの概要
平均図鑑は、UGC(User Generated Content)――ブログ・note・YouTube等に投稿された 資格合格体験記――を独自に収集・集計したメディアです。 公式統計ではわからない「受験者のリアルな経験値」を数値化することを目的としています。
データ収集方法
収集対象
- 個人が執筆・投稿した合格体験記(ブログ・note・YouTube動画説明欄)
- 勉強時間・使用テキスト・合否結果・感想のいずれかが明記されているもの
- 投稿者本人の一次体験と判断できるもの
収集から除外するもの
- 資格スクール・予備校・アフィリエイトサイトなどの商業記事
- 体験記の形式をとった広告・PR記事
- 勉強時間などの具体的な数値が記載されていないもの
- 明らかに複数人をまとめた記事(個人の体験ではないもの)
収集手順
- 検索エンジンで「(資格名) 合格 体験記 勉強時間」などのキーワードで収集
- 収集したURLを手動で確認し、上記基準でフィルタリング
- データ項目(勉強時間・テキスト名・難易度感想など)を構造化して記録
集計方法
- 勉強時間:中央値および四分位数(Q1・Q3)を算出。平均値は外れ値の影響を受けやすいため補助的な参考値として扱います。
- 使用テキスト:言及件数を集計し、上位を掲載。複数テキスト併用の場合はそれぞれカウントします。
- 難易度・感想:テキスト頻度分析を行い、頻出フレーズを抽出して定性的に整理します。
- 合格率:収集したサンプル内の合否比率(「受けた」と明記したもの)から算出します。
生存バイアスについて
重要な注記:
本サイトのデータには生存バイアスが含まれます。ブログやnoteに合格体験記を投稿するのは
主に「合格した人」です。そのため、収集データ内の合格率は公式発表の合格率より
高く出る傾向があります。また、「短時間で合格した人」は体験記を書く動機が高く、
勉強時間が実際より短めに分布する可能性があります。
各ページにサンプル数を明記しますので、参考値としてご活用ください。
データの限界と透明性
- サンプル数が少ない資格では統計的信頼性が低くなります。各ページにサンプル数を明示します。
- 収集時期によってデータが偏る場合があります(試験改定前後など)。
- 地域・年齢・職業などの属性による偏りは制御できていません。
- データ源となった体験記の内容が正確かどうかは検証不能です。
更新頻度
データは不定期に随時追加します。更新の際は各ページに収集期間とサンプル数を記載します。 データの誤りや古い情報に気づかれた場合は、お問い合わせよりご連絡ください。