Ryan Mitchell :Python による Web スクレイピング 第 2 版

2022-12-09

概要

まえがきから引用する。

(前略)本書は、Web スクレイピングに関するこの手の疑問や誤解に終止符を打つとともに、 最も一般的な Web スクレイピングについて万全のガイドとなるものです。

感想

要再読である。

のちに、Python 2年生 スクレイピングのしくみという、本書よりやさしそうな本も借りてきて勉強し直したことを白状する。

更新情報

p.71 のコードの最初の 2 行
from scrapy.contrib.linkextractors import LinkExtractor
from scrapy.contrib.spiders import CrawlSpider, Rule
を、次のように直さないと動かない。
from scrapy.linkextractors import LinkExtractor
from scrapy.spiders import CrawlSpider, Rule

p.73 の下のコードも同様である。

誤植

p.17 の中ほどのコードで、
html = urlopen('http://www.pythonscraping.com/pages/page1.html')
とある行は、正しくは
html = urlopen('http://www.pythonscraping.com/pages/warandpeace.html')
である。つまり、p.17 の上から 6 行目にある URL と同じである。

上から 13 行目、(前略)引数の追加もできます詳しくは、(後略)とあるが、途中で次のように句点を入れるべきだ:《(前略)引数の追加もできます。詳しくは、(後略)》

書誌情報

書名Python による Web スクレイピング 第 2 版
著者Ryan Mitchell
訳者黒川利明
発行日2019 年 3 月 22 日 初版第1刷
発行所オライリー・ジャパン
発売元オーム社
定価3200 円(税別)
サイズ
ISBN978-4-87311-871-0
その他越谷市立図書館で借りて読む