やってみよう テキストマイニング (増訂版)(ヤッテミヨウ テキストマイニング)
自由回答アンケートの分析に挑戦!
Office・ビジネス- 著者:
- 牛澤 賢二(ウシザワ ケンジ)
- 出版社:
- 朝倉書店
- 出版日:
- 2021年04月30日頃
- ISBN:
- 9784254122619
- 在庫:
- 在庫あり
なぜ注目されているか
書籍紹介
知識・技術・資金がなくてもテキストマイニングができる!手順に沿って実際のアンケート結果を分析しながら,データの事前編集,単語抽出,探索的分析,仮説検証的分析まで楽しく学ぶ.最新の KH Coder 3 に対応した待望の改訂版.
1.テキストマイニングをはじめる
(考え方と手順,データ構造の特徴,分析のポイント)
2.データの事前編集
(有効データの抽出,表記の統一)
3.データの読み込みと前処理
(形態素解析,暫定リスト,辞書作成)
4.第 1 段階の分析 1:抽出語の分析
(リスト表示と集計,記述統計量とデータの可視化)
5.第 1 段階の分析 2:文書の分析
(類似サンプルのグループ化)
6.第 2 段階の分析:仮説検証的な分析
(仮説コードによる分類)
7.事例
(講義の感想の可視化,新規サービスのアイディア調
査,街のイメージ調査,週報の分析,公的統計へのコメ
ント分析)
付録:
(Excel マクロによるデータ整理,ベイズ学習とは,など)
技書の森解説
アンケートの自由回答欄は、集めたはいいものの手つかずのまま眠りがちなデータの筆頭です。数値項目のように単純集計できず、かといって全件を読んで要約するのも骨が折れる。本書はこの宙ぶらりんなテキストデータを、無償の分析ツール KH Coder で定量的に扱えるようにする入門書です。著者は牛澤賢二氏、朝倉書店から 2021 年に刊行されました。 KH Coder 3 に対応させた増訂版で、プログラミングの経験も高価な分析ソフトも前提にしないという間口の広さが一貫した方針になっています。
進み方は実践一本です。実際のアンケート回答データを素材に、表記ゆれの統一などの事前編集、形態素解析と辞書づくりといった前処理を済ませたうえで、抽出語の集計と可視化による探索的な分析、類似回答のグループ化、仮説コードを用いた検証型の分析へと段階的に登っていきます。終盤には講義の感想や街のイメージ調査など毛色の異なる事例が並び、自分のデータにどう応用するかの手がかりになります。付録では Excel マクロによるデータ整理にも触れています。
統計の専門教育を受けていない企画職や広報担当、卒論でアンケートを扱う学生が、最初の一冊として手順どおりに走り切れる難易度です。読み終える頃には、自由回答の山から傾向を取り出して報告書に落とすまでの道筋が、自分の手の中にあるはずです。