質的データ分析:手法・プロセス・ツール(2026年版ガイド)
執筆:Anqi Yu(Ghent University)· 監修:Prof. Shubin Yu(HEC Paris) · May 2026 · 更新日: 2026-05-30 · 17 min read
インタビューやフォーカスグループを実施したり、数百件の自由記述回答を集めたりしました。今、逐語記録の山を前に、これらすべての言葉をどうやって弁護できる知見へと変えればよいのか途方に暮れています。そのステップ——質的データ分析——こそ、質的研究の知的作業の大半が実際に起こる場所であり、研究者が最も道に迷いやすい場所です。
このガイドは、プロセス全体の実践的な地図です:質的データ分析とは何か、生の逐語記録から書かれた知見までのステップごとのワークフロー、主要な分析アプローチとそれぞれの使いどころ、コーディングが実際にどう機能するか、どのソフトウェアがあなたのニーズに合うか、そしてAIが今どこであなたの判断を奪わずに作業を速めるか。より広い基礎をまず知りたいなら、質的研究入門ガイドから始めてください。こちらは分析を深く掘り下げます。
質的データ分析とは何か?
質的データ分析(QDA)とは、非数値的なデータ——インタビュー逐語記録、フィールドノート、自由記述回答、文書、画像——を整理・検討・解釈して、パターン・テーマ・意味を見出すプロセスです。統計を生み出すのではなく、人々が何を言い、何をし、何を意味したかについての、データそのものに根ざした構造化された証拠ベースの解釈を生み出します。
固定した公式に従う統計分析とは異なり、QDAは解釈的で反復的です。データと、発展していく自分の考えとの間を行き来し、各パスで理解を洗練します。うまく行えば、それは体系的かつ透明です——誰もが、生の引用から最終的なテーマへどうたどり着いたかを追跡できるべきです。
質的データ分析と量的データ分析の比較
2種類の分析は異なる問いに答え、異なる論理に依拠します。その対比を理解すると、QDAが実際に何のためのものかが明確になります。
| 側面 | 質的データ分析 | 量的データ分析 |
| データ | テキスト、音声、画像、観察 | 数値と測定値 |
| 目標 | 意味とパターンを解釈する | 仮説を検証し、関係を定量化する |
| プロセス | 反復的で立ち現れる | 線形で事前定義される |
| 中核技法 | コーディングとテーマ開発 | 統計的検定 |
| アウトプット | テーマ、ナラティブ、モデル、理論 | 統計、p値、効果量 |
| 質の基準 | 信頼性 | 妥当性と信頼性 |
分析する対象となるデータの種類
QDAの技法は多くのデータソースに適用でき、ほとんどのプロジェクトは複数を混在させます:
- インタビュー逐語記録 ——最も一般的な質的データソース
- フォーカスグループの録音 ——参加者間の相互作用を含む
- 自由記述式の調査回答 ——短いが、しばしば大量
- フィールドノートと観察 ——エスノグラフィーや現地訪問から
- 文書と記録 ——政策、報告書、メディア、アーカイブ
- オンラインテキスト ——レビュー、フォーラム投稿、ソーシャルメディア
- 視覚・マルチメディアデータ ——写真、動画、画面録画
質的データ分析のプロセス
アプローチは異なりますが、ほぼすべての質的分析は同じ7つの段階を通って進みます。それらを一直線ではなくサイクルとして捉えてください——理解が深まるにつれ、しばしば前の段階に戻ります。
- 準備と文字起こし ——録音をテキストに変換し、データを整え、身元を特定する細部を匿名化する。AI文字起こしが今や数分で最初のパスを行う。
- 習熟 ——何かにラベルを付け始める前に、データを読み読み返し、第一印象についてメモを書く。
- コーディング ——データの断片に短く意味のあるラベルを付け、それらを取り出し比較できるようにする。
- カテゴリー化 ——関連するコードをより広いカテゴリーと候補テーマにまとめる。
- テーマとパターンの特定 ——カテゴリーを、あなたの問いとの関係でデータについて重要な何かを捉えるテーマへと洗練する。
- 解釈 ——テーマが何を意味し、どうつながり、リサーチクエスチョンにどう答えるかを説明する。
- 検証と執筆 ——解釈をデータに照らして確認し、支えとなる引用と明快な分析的ナラティブとともに提示する。
質的データ分析のアプローチ
「アプローチ」とは、あなたの分析を導く方法論を指します。それぞれ独自の論理を持ち、適切なものはリサーチクエスチョンとパラダイムによります。
テーマ分析
最も広く使われ柔軟なアプローチ:データセット全体のパターン(テーマ)を特定・分析・報告します。Braun and Clarkeの6段階法が標準的な参照です。単一の理論的学派に縛られずに、豊かで詳細なパターンを求めるときに最適。
グラウンデッド・セオリー
反復的なコーディングと定数比較を通じてデータから直接新しい理論を構築することを目指し、データ収集と分析を同時に行います。既存の理論がほとんど当てはまらないときに最適。
内容分析
テキストを体系的に分類し、概念の頻度を定量化することもでき、質的と量的の境界に位置します。データの中にあるものの、構造化され、時に数えられる要約が必要なときに最適。
ナラティブ分析
人々が語る物語——その構造、順序、そして個人が自分の経験をどう意味づけるか——に焦点を当てます。テーマだけでなく物語そのものが研究対象であるときに最適。
ディスコース分析
言語が社会的文脈の中で意味・アイデンティティ・権力をどう構成するために使われるかを検討します。コミュニケーション、レトリック、話しことばや書きことばの社会的機能を研究するのに最適。
フレームワーク分析
マトリクスベースのアプローチ(ケースを行、テーマを列とする)で、応用研究や政策研究で人気があります。部分的に事前定義された問いに対し、ケース横断的に透明で比較可能な分析が必要なときに最適。
解釈学的現象学的分析(IPA)
少人数の人々が重要な生きられた経験をどう意味づけるかを詳細に探ります。小規模で同質なサンプルによる、深く個別記述的な研究に最適。
どのアプローチを選ぶべきか?
| あなたの目標が… | 検討すべきもの |
| データセット全体で柔軟にパターンを見出す | テーマ分析 |
| 一から新しい理論を構築する | グラウンデッド・セオリー |
| 概念を要約し、可能なら数える | 内容分析 |
| 人々が自分の人生をどう物語るかを理解する | ナラティブ分析 |
| 言語・権力・レトリックを分析する | ディスコース分析 |
| 応用/政策研究のためにケースを比較する | フレームワーク分析 |
| ある生きられた経験を深く研究する | IPA |
コーディング:分析のエンジン
どのアプローチを選んでも、コーディングはそれを駆動する実践的なメカニズムです。コードとは、データの断片の意味を捉える短いラベルで、似た素材をグループ化し、データセット全体で比較できるようにします。
帰納的コーディングと演繹的コーディング
- 帰納的コーディング ——コードはあらかじめのリストなしにデータから立ち現れる。探索的な作業に最適。
- 演繹的コーディング ——理論や先行研究から構築したコードブックを適用する。既存の枠組みを検証・拡張するのに最適。
- ハイブリッドコーディング ——ほとんどの実際の研究は、いくつかの感受概念から演繹的に始め、帰納的なコードにも開かれたままにする。
コーディングのレベル
- オープンコーディング ——興味のあるすべてにラベルを付ける初期の細かいパス。
- 軸足コーディング ——コード間の関係を見出し、カテゴリーにまとめる。
- 選択的コーディング ——核となるテーマやストーリーラインの周りにカテゴリーを統合する。
いくつかの有用な技法
- イン・ヴィヴォ・コーディング ——参加者自身の言葉をコードラベルとして使い、彼らの声に近いままにする。
- コードブック ——各コードを定義し、包含/除外ルールと例を備えた生きた文書で、コーディングを一貫させる。
- メモイング ——進めながら分析的なノートを書く;メモは生のコードが解釈へと変わり始める場所。
手作業・ソフトウェア支援・AI支援の分析
実際に作業を行う大まかな方法が3つあり、それらはますます融合しつつあります。
| 方法 | 意味するもの | 最適な用途 |
| 手作業 | 蛍光ペン、付箋、表計算ソフト | 非常に小規模なデータセット;技を学ぶこと |
| ソフトウェア支援(CAQDAS) | NVivoやATLAS.tiのようなツールで整理・コード化・取り出しを行う | 監査証跡が必要な中〜大規模研究 |
| AI支援 | LLMがコードとテーマを提案し、研究者が検証する | 大規模データセットと迅速な最初のパスのコーディング |
AIは研究者を分析から排除しません——その時間の使いどころを変えるのです。最初のコーディングのパスに何週間も費やす代わりに、その時間を検討・修正・解釈に使います。判断は人間に残り、骨の折れる作業が速くなります。
信頼できるパターンはヒューマン・イン・ザ・ループです:AIがデータセット全体にわたってコードと候補テーマを数分で提案し、あなたはそれをデータに照らして確認し、誤りを直し、最終的な解釈を自分のものとします。これは厳密性を保ちつつ、大規模な質的研究をかくも遅くするボトルネックを取り除きます。
質的データ分析ソフトウェア
ソフトウェアがあなたの代わりにデータを分析してくれるわけではありませんが、整理・コード化・取り出しをはるかに扱いやすくし——査読者が期待する監査証跡を作ります。主要な選択肢の比較は次の通りです。
| ツール | 典型的なコスト | AI支援 | 組み込みの文字起こし | 学習曲線 |
| NVivo | 年額,000以上 | 限定的 | アドオン | 急 |
| ATLAS.ti | $$ | あり(新しめ) | アドオン | 中〜急 |
| MAXQDA | $$ | 限定的 | アドオン | 中 |
| Dedoose | $(月額) | 限定的 | なし | 中 |
| Taguette | 無料/オープンソース | なし | なし | 緩やか |
| QualiTaTi | 無料枠あり;Scholarは月額9から | あり——中核機能 | あり、自動 | 緩やか |
NVivoやATLAS.tiのような確立されたデスクトップパッケージは強力ですが高価で習得が大変です。Taguetteのようなオープンソースの選択肢は障壁を下げますが、できることは少なめです。AIネイティブのプラットフォームは文字起こしとAI支援コーディングを一つのワークフローに折り込み、それが機関ライセンスを持たない学生や小規模チームにとって魅力的な理由です。
分析における厳密性の確保
QDAは解釈的であるため、その信用性は統計ではなく透明性と規律に依拠します。これらの実践を最初から組み込んでください:
- 監査証跡 ——コードブックの変更からテーマの定義まで、すべての決定を文書化し、分析を再現可能にする。
- トライアンギュレーション ——複数のデータソース、手法、または分析者にわたって知見を裏づける。
- メンバーチェック ——解釈を参加者と共有し、真実味を持つか確認する。
- 評価者間信頼性 ——複数人がコード化するとき、一致度を測定し(例:Cohen κ、Krippendorff α)、不一致を解消する。
- 省察性 ——自分自身の視点が、何に気づき何を結論づけるかをどう形づくるかを記録する。
- 逸脱事例分析 ——立ち現れつつあるテーマに反するデータを積極的に探し、それを説明する。
避けるべきよくある間違い
- 分析する代わりに要約する ——人々が言ったことを、それが何を意味するかを解釈せずに記述する。
- 引用のつまみ食い ——自分の物語に合う証拠を選び、残りを無視する。
- 浅いコードが多すぎる ——意味のあるテーマへ統合することなく、すべてをコード化する。
- トピックとテーマを混同する ——テーマはデータについて主張をする;トピックは単なる主題領域にすぎない。
- 監査証跡を省く ——どうやって知見にたどり着いたかを説明できなくなる。
- データを先行する枠組みに無理やり押し込む ——期待に合わないものを無視する。
実例
自宅で慢性疾患を管理することについて25人の患者にインタビューしたとします。
- 準備 ——25件すべてのインタビューを自動文字起こしし、各々を確認し匿名化する。
- 習熟 ——すべての逐語記録を読み、「重荷になることへの恐れ」のような繰り返し現れる考えをメモする。
- コーディング ——AI支援の最初のパスが「薬の節約」「家族への症状隠し」「医師を信頼する/疑う」といったコードを生成し、あなたはそれをコードブックの中で洗練し定義する。
- カテゴリー化 ——コードを自己管理戦略や感情労働のようなカテゴリーにまとめる。
- テーマ化 ——テーマを開発する:「患者は病気と家族の感情を同時に管理している」。
- 検証 ——逸脱事例チェックを行い、サンプルで評価者間の一致を確認し、数名の患者とメンバーチェックする。
- 執筆 ——各テーマを代表的な引用とともに提示し、文献に結びつける。
要点
- 質的データ分析は、体系的で反復的なプロセスを通じて、非数値的なデータを証拠ベースの解釈へと変える。
- ワークフローは、準備と習熟から、コーディング、テーマ化、解釈、検証へと進む。
- アプローチ——テーマ分析、グラウンデッド・セオリー、内容、ナラティブ、ディスコース、フレームワーク、IPA——を問いに合わせて選ぶ。
- コーディングはエンジンである;厳密性は監査証跡、トライアンギュレーション、信頼性チェック、省察性から生まれる。
- AI支援のヒューマン・イン・ザ・ループ分析は、解釈を人間の手に残しつつ、最初のパスのボトルネックを取り除く。
よくある質問
質的データ分析を簡単に言うと何か?
それは、インタビューやノートのような非数値的なデータを整理し、コードでラベル付けし、人々が何を意味したかを説明するパターンとテーマを解釈することで、それを理解するプロセスです。
質的データ分析の主な手法は何か?
最も一般的なのは、テーマ分析、グラウンデッド・セオリー、内容分析、ナラティブ分析、ディスコース分析、フレームワーク分析、解釈学的現象学的分析(IPA)です。テーマ分析が最も広く使われ柔軟です。
質的分析におけるコーディングとは何を意味するか?
コーディングとは、データの断片に意味を捉える短いタグでラベルを付け、データセット全体で似た素材をグループ化・取り出し・比較できるようにすることです。コードはその後、カテゴリーとテーマに整理されます。
AIは質的データを分析できるか?
はい——AIはデータを文字起こしし、コードを提案し、トピックモデリングや感情分析を実行し、データセット全体にわたって候補テーマを数分で提案できます。研究者がすべての結果を検証・解釈するヒューマン・イン・ザ・ループのモデルで最もよく機能します。
質的データ分析にはどんなソフトウェアが使われるか?
一般的なツールには、NVivo、ATLAS.ti、MAXQDA、Dedoose、オープンソースのTaguette、そして文字起こしとAI支援コーディングを一つのワークフローに組み合わせるQualiTaTiのようなAIネイティブのプラットフォームがあります。
質的分析を厳密に保つにはどうすればよいか?
透明性と規律を通じて:監査証跡を保ち、ソース横断的にトライアンギュレーションし、評価者間信頼性を確認し、メンバーチェックを行い、省察性を実践し、テーマに反する逸脱事例を分析します。
コードとテーマの違いは何か?
コードはデータの特定の断片に付ける細かいラベルです;テーマは複数のコードから構築されるより広いパターンで、リサーチクエスチョンとの関係でデータセットについて分析的な主張をします。