Hello,大家好我是梅森Mason,今天我要帶各位來安裝網頁爬蟲的模組,以及用網頁爬蟲將原始碼寫到一份文件內。
安裝網頁爬蟲模組
首先按Windows鍵+R,跳出視窗後,打入cmd,按下確認,就會跳出一個黑底白字的視窗。

接著輸入pip install beautifulsoup4,按enter執行安裝。

執行安裝結果:

接著輸入pip install requests,按enter執行安裝。

執行安裝結果:

※re模組不需要安裝。
用網頁爬蟲把原始碼爬回並寫入一份文件
首先把requests模組import進來,接著從(from)bs4把BeautifulSoup import進來。

設定(放原始碼的變數)=requests(用來爬回原始碼).get(“網址(本篇使用教育部《成語典》的’王’字)”)
在下一行打上f(file檔案)=open(“檔案名稱.副檔名”),”模式(w模式=將原始碼加入到這個文檔)”,encoding utf-8(能防止文檔發生錯誤)
下一行打上f.write(放原始碼的變數.text)
最後打上f.close(),把檔案關閉

明天或後天就要教各位分析了喔!(周末有可能會因vpython課程暫停一次,敬請見諒(還是有可能會發爬蟲的文章,請注意!))
希望這些課程能給各位讀者大大幫助,歡迎把本文轉發,讓更多人知道喲!
By 那個成天泡在電腦裡的梅森 on May 21, 2021.