安裝scrapy框架并測試全過程
安裝scrapy框架并測試
這是個系列文章,主要是能讓大家快速的的做出一個小項目,主要是我現(xiàn)在在做計算機設(shè)計大賽,想把做過的東西記錄下來,后續(xù)我會將整個計設(shè)的項目的制作過程寫出來分享給大家。其中包括Django、mysql數(shù)據(jù)庫、前端等。
這些文章主要是記錄具體操作過程,具體的知識內(nèi)容還請去刷視頻,這里不做過多解釋。
安裝scrapy框架
在終端里先后運行這個語句即可安裝
pip install wheel pip install scrapy
在終端里輸入scrapy即可驗證是否安裝成功,以下是沒有安裝前的情況。

以下是安裝過后驗證的情況
這樣就說明安裝成功了。

我們需要在pycharm終端里創(chuàng)建一個工程
代碼如下:
scrapy startproject comment(comment為你的工程名稱)
創(chuàng)建成功如下

(這里注意,有些同學(xué)創(chuàng)建不成功報錯的,需要在pycharm終端里再次執(zhí)行pip install scrapy)
緊接著執(zhí)行下面提示的兩段代碼來創(chuàng)建我們的爬蟲主文件
cd comment
注意這里的example.com我們需要換成自己的起始url (這里隨便設(shè)一個就好,這個不影響我們的任務(wù))
scrapy genspider news(這里的news為爬蟲文件名稱)www.xxx.com
然后配置成如下的形式

注意這里的allowed_domains可以注釋掉,對我們的任務(wù)沒有太大的影響。start_urls里的url換成我們需要請求的網(wǎng)址。(這里我就用騰訊新聞的主頁來測試了)
在此之前我們需要在settings.py文件里完成如下配置:

然后在終端輸入以下代碼來運行爬蟲文件:
scrapy crawl news
運行成功!

這樣測試就完成了,可以進行后續(xù)的任務(wù)了。
總結(jié)
以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關(guān)文章
Django3基于WebSocket實現(xiàn)WebShell的詳細過程
最近工作中需要開發(fā)前端操作遠程虛擬機的功能,簡稱WebShell,普通應(yīng)用大部分用的都是wsgi.py配合nginx部署線上服務(wù). 這次主要使用asgi.py,具體實現(xiàn)過程跟隨小編一起看看吧2021-08-08

