
スクレイピング・ハッキング・ラボ Pythonで自動化する未来型生活 (技術の泉シリーズ(NextPublishing))
齊藤 貴義
インプレスR&D / 2022-03-31
累計読者数6
平均ハイライト数 1.5件/人
推定読了時間 約5時間37分
star総合評価 33/100
boltライト読書型
check_circle推定完走率 14%
この本について
スクレイピングを始めたいと思っても、「入門記事はいくつか読んだけど、実際の現場ではどう動いているのか」が分からず手が止まること、けっこうあると思います。PDFを拾いたい、画像をまとめて保存したい、robots.txtをどう扱えばいいのか…いざやろうとすると細かい“実務の壁”にぶつかるあの感じです。自分も同じところで何度もつまずきました。 この本は、その手触りの悪い部分を丁寧に拾ってくれる実践寄りの内容でした。たとえば、pdfminerやpdf2txt.pyでPDFを扱うときの具体的な手順、urljoinやPath、uuidをどう組み合わせれば安全にファイルを保存できるか、といった「実際に書くとこうなる」がしっかり載っています。さらに、robots.txtの背景や扱い方も歴史を含めて説明されていて、単なる技術情報ではなく、判断の基準まで整えてくれるところがありがたかったです。 入門から一歩抜け出したいけれど、どこから“本当の実践”に踏み込めばいいか迷っている人に特に刺さると思います。自動化やデータ取得を仕事にうまく組み込みたい時、こういう現場の視点に触れるだけで、次の一手が見えやすくなります。
analytics
読書インサイト
ハイライト密度
開始終了
多くの読者は第5章に最もインサイトを感じており、全ハイライトの44%が集中しています。
読書の順序
この本の前に読まれた本
この本に似ている本
すべて見る arrow_right_alt![Pythonクローリング&スクレイピング[増補改訂版] -データ収集・解析のための実践開発ガイド-](https://m.media-amazon.com/images/I/71xlP7dE-tL._SY500.jpg)
79%
Pythonクローリング&スクレイピング[増補改訂版] -データ収集・解析のための実践開発ガイド-
加藤 耕太

69%
Pythonをおぼえたらブラウザ操作を自動化しよう: Seleniumで操作してBeautifulSoupで解析をする
辛島信芳

69%
Pythonクローリング&スクレイピング ―データ収集・解析のための実践開発ガイド―
加藤 耕太

68%
Pythonの文法は覚えたけど「じゃあこれで何ができるんだ?」と思っている人のための本
天田士郎

66%
機械学習を仕事にしたい君に
shimizu
書籍情報(出版社紹介・目次)expand_more
出版社による紹介
【2022年4月に内容を改訂しました】本書ではPythonを使ったWebスクレイピングテクニックについて解説します。いろいろなことをPythonで自動化していきましょう。日本の主要なサービスを題材に、スクレイピングでデータを取得する方法と、そのデータを元に分析や可視化していく手法を紹介していきます。スクレイピング環境の構築、スクレイピングを行うにあたって便利なライブラリの選定、ターゲットとなるWebサービスの選定、データ分析の手法など、初心者にもわかりやすく解説しています。 【目次】 第1章 スクレイピングの基礎 第2章 Pythonの導入 第3章 Pythonの環境構築 第4章 Python3の基礎 第5章 Beautiful Soupでスクレイピングする 第6章 スクレイピングのテクニックと考慮すべき点 第7章 PythonからSeleniumでブラウザーを操作する 第8章 Scrapyを使って、はてな匿名ダイアリーをクローリングする 第9章 MeCabとWord2Vecによる自然言語解析 第10章 Pandasによる解析とMatplotlibによる可視化 第11章 スクレイピング結果を自動通知する 第12章 スマートフォンでスクレイピング 第13章 Raspberry Piにポータブル・スクレイピング・ハッキング・ラボを構築する
読んだ内容を、もう忘れない。
BookNotion Zなら、Kindleのハイライトを自動で保存・整理。Notionにエクスポートして、いつでも振り返れます。
無料ではじめる
クレジットカード不要