Hello,大家好我是梅森Mason,今天我要帶各位來完成昨天尚未完成的html課程,並介紹大家網頁爬蟲的模組及性能。

HTML練習(本篇的每個”-”代表一個空格)

接續昨天的課程(還沒看過的點→me←),本日要繼續教大家基本的HTML啦!

先叫出昨天的程式碼

噹啷!(特殊語助詞)

—- 內容

—-

內容

—-

——–

  • 內容
  •  ——–
  • 內容
  • ——–
  • 內容
  • —-

    —-

      ——–
    • 內容
    • ——–
    • 內容
    • ——–
    • 內容
    • ——–
    • 內容
    • —-

    —-<a href=”連結網址/“target=”_blank”>代表連結的文字

    OK,接著在下一行打上四個空格(重要),並加入

    <a href=”和/”target=”_blank”>和

    在<a href=”和/”target=”_blank”>中間加入連結網址,並在/”target=”_blank”>和中間加入有聯結的文字。

    範例:

    —-<a href=”https://masonlifemaker.medium.com/“target=”_blank”>梅森生活&創客 Mason Life & Maker

    效果:

    梅森生活&創客 Mason Life & Maker

    —- 內容

    —-

    內容

    —-

    ——–

  • 內容
  • ——–
  • 內容
  • ——–
  • 內容
  •  —-

    —-

      ——–
    • 內容
    • ——–
    • 內容
    • ——–
    • 內容
    • ——–
    • 內容
    •  —-

    —-<a href=”連結網址/”target=”_blank”>代表連結的文字

    —-”錯誤時的訊息”

    在下一行打上四個空格(重要),並加入<img src=”,打入圖片名稱(必須要存於電腦內),在後方打入”,接著加上alt=”,打入如果沒有圖片時顯示的錯誤訊息,在後方打入”和>。

    範例:

    —- <img src=”test.jpg” alt=”images error” >

    圖片正確效果:

    圖片錯誤效果:

    網頁爬蟲的模組

    requests 會把網頁的HTML原始碼爬回,以便進行分析

    re 正規表示法的處理模組

    Beautiful Soup4 用來解析HTML碼,專門處理其中的title標籤,以便提取其中的資料,這在網路資料採集時非常好用。

    希望這些課程能給各位讀者大大幫助,歡迎把本文轉發,讓更多人知道喲!

    By 那個成天泡在電腦裡的梅森 on May 20, 2021.

    Canonical link