データを集め、整え、可視化や分析に使える状態にするための1日講座です。Web API、Webスクレイピング、PDF抽出などの収集方法と、OpenRefine や Google Colab などを使ったデータ加工を、実務に近い流れで学びます。
こんな方におすすめ
- 可視化や分析の前処理で時間がかかっている方
- Web、PDF、API など複数のデータ取得方法を学びたい方
- OpenRefine や Google Colab を使ったデータ加工を試したい方
- 出口となる可視化を意識してデータを整えたい方
この講座でできるようになること
- 効率よくデータを収集・加工できるようになります。
- 比較・検討に使えるデータの量と質を増やせるようになります。
- PDF、Web API、スクレイピングなど、データ取得方法を目的に応じて選べるようになります。
- 可視化という出口を意識して、扱いやすいデータ構造に整えられるようになります。
作るもの・扱う題材
Web API、Webスクレイピング、PDF抽出で得たデータを題材にします。ハッシュタグ、メンション、URL、絵文字の処理、PDF特有の汚れの除去、基盤情報との結合など、可視化前に必要な加工を扱います。
講座の特徴
少人数制で、収集と加工を分けずに、実際の作業の流れに沿って進めます。単発のテクニックではなく、可視化や分析につながる状態までデータを整える考え方を重視します。
使用するツール・事前準備
- OpenRefine
- Google Colaboratory
- IFTTT
- Tabula
- Googleシート
- ChatGPT
基本的にはノートPCとインターネットブラウザをご用意ください。
受講後に受け取れるもの
- 講習に利用したPDFファイルとサンプルデータを差し上げます。
- 講義の録画データをご提供します。繰り返し視聴いただくことで復習に役立てていただけます。
開催概要
- 価格: 22,000円(税込)
- 日程: 隔週 第2・4日曜日
- 定員: 最大5名程度
- 会場: ZOOMを利用したオンライン開催
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
- 10:00-17:00
タイムテーブル
10:00-11:25(85分)
- [収集] IFTTTやスクレイピングの手法でツイート簡単収集
- [加工] ハッシュタグ、メンション、URLだけを取り出す
- [加工] 絵文字だけを削除する
11:25-12:25(昼食休憩)
12:25-13:50(85分)
- [収集] PDFから表データの効率良い取り出し(1ファイルの場合・複数ファイルの場合)
- [加工] PDF特有の汚れを取り除く
- [加工] 基盤情報と結合する
13:50-14:00(休憩)
14:00-15:25(85分)
- [収集] ウェブAPIからデータを取得する(Colaboratory)
- [加工] データクレンジング中に必要なデータをウェブAPIから取り寄せる(OpenRefine)
15:25-15:35(休憩)
15:35-17:00(85分)
- [収集・加工] ChatGPTをデータクレンジングや加工への活用
- Q&A
ご注意
- 決済には Stripe を利用しております。
- 領収書の発行を承ります。
- オンラインによるご受講になります。環境設定についてはご案内ページを参照ください。
- ギフト購入もしていただけます(購入者と受講者が別)。ギフトという形で受講者へ送付いたします。
- 本講座で配布するスライドや動画を、受講していない第三者(同僚やご友人など)へは共有なさらないでください。
お申し込み
以下のフォームよりお申し込みください。 お申し込み後、Stripe 決済画面へ移動します。決済完了をもって正式な受付となります。
※ 決済完了をもって正式な受付となります。
決済へ進む (Stripe)