Python3.5+Selenium+PhantomJSでサーバサイドでスクレイピング①

Python3.5、Selenium、PhantomJSのインストール編

Javascriptがガシガシ動いているWebページだったり、
ログインが必要なサイトを
サーバサイドからスクレイピングをしたいときってありますよね!?

そんなの思ったこともないあなた!!
スクレイピングで、データを引っ張ってきてほしいというようなニーズは
意外と結構あるので、のぞくだけのぞいていってくださいm(_ _)m

Python3.5+Selenium+PhantomJSの組み合わせの特徴

スクレイピングにあたり、Node.jsを使ったり、
PhantomJSじゃなくてFireFoxでとかあると思うのですが、
以下の組み合わせをオススメします!
・Python3.5
・Selenium
・PhantomJS

理由としては・・・
①インストールが簡単
②当然、データベースへも接続できる
③ヘッドレスブラウザのPhantomJSを使うため、バックグラウンドで動作させられる
④Javascriptを記述して実行できる

などなど、他と比較したときに良いなっと思ったところになります

Python3.5、Selenium、PhantomJSのインストール方法

1、Python3.5

本体のダウンロード

事前に必要となるパッケージをインストール

本体のインストール

シンボリックリンクを作成

パッケージのアップグレード等

インストールされているかチェック

2、Selenium

これだけ

3、PhantomJS

本体のダウンロード

本体のインストール

パスの設定

インストールされているかチェック

最後に

サーバサイドからのスクレイピングの第一回目として、
Python3.5、Selenium、PhantomJSのインストール方法をご紹介しました。

色々な組み合わせを試してきたのですが、
これが一番楽にできたという印象です。

次回は、コードの例をあげて、スクレイピングしてみます!

関連記事

コメントは利用できません。

ピックアップ記事

  1. キレイステーション

ピックアップ記事

  1. 2013-11-8

    ダリが採点した画家たちランキング【前編】

    サルヴァドール・ダリという画家をご存知でしょうか?恐らく絵を見れば「あ〜なんか見たことある」と 誰し…

ピックアップ記事

  1. 2016-8-17

    【2016年度版】納豆に混ぜたら美味しいものランキングベスト3

    私は3度の飯より納豆が好きです! まぁ嘘なんですけど。でもそれなりに好きです。 でも市販の納豆っ…

ピックアップ記事

  1. 2016-11-15

    ずぼらさん必見!簡単ごはん『もぐー』の人気レシピ動画まとめ 〜ごはん編〜

    ずぼらでも簡単においしく作れるレシピまとめ もぐー(mogoo)とは、「かんたん・おいしい・たのし…
ページ上部へ戻る
Top