Python爬蟲將爬取的圖片寫入world文檔的方法


作為初學爬蟲的我,無論是爬取文字還是圖片,都可以游刃有余的做到,但是爬蟲所爬取的內(nèi)容往往不是單獨的圖片或者文字,于是我就想是否可以將圖文保存至world文檔里,一開始使用了如下方法保存圖片:
with open('123.doc','wb')as file:file.write(response.content)file.close()
結(jié)果就是,world文檔里出現(xiàn)了一堆亂碼,此法不同,我就開始另尋他法,找了很久也沒有找到,只找到了關于Python操作world的方法。
于是我就開始了新的思路:使用原來的方法將圖片保存下來,再將圖片添加到world文檔里,最后將圖片刪除。這里使用的是python-dox庫,代碼如下:
import requestsfrom bs4 import BeautifulSoupimport osimport docxfrom docx import Documentfrom docx.shared import Inchesurl = 'https://www.qiushibaike.com/article/119757360'html = requests.get(url).contentsoup = BeautifulSoup(html,'html.parser')wen = soup.find('div',{"class":"content"}).textimg = str(soup.find('div',{"class":"thumb"})).split('src="')[1].split('"/')[0]tu = 'https:' + imgimg_name = img.split('/')[-1]#保存圖片至本地with open(img_name,'wb')as f:response = requests.get(tu).contentf.write(response)f.close()document = Document()document.add_paragraph(wen)#向文檔里添加文字document.add_picture(img_name)#向文檔里添加圖片document.save('tuwen.doc')#保存文檔os.remove(img_name)#刪除保存在本地的圖片
最后,還是實現(xiàn)了將圖文保存在了world文檔里,盡管方法有些笨……
以上這篇Python爬蟲將爬取的圖片寫入world文檔的方法就是小編分享給大家的全部內(nèi)容了,希望能給大家一個參考

搜索下方加老師微信
老師微信號:XTUOL1988【切記備注:學習Python】
領取Python web開發(fā),Python爬蟲,Python數(shù)據(jù)分析,人工智能等精品學習課程。帶你從零基礎系統(tǒng)性的學好Python!
*聲明:本文于網(wǎng)絡整理,版權(quán)歸原作者所有,如來源信息有誤或侵犯權(quán)益,請聯(lián)系我們刪除或授權(quán)

評論
圖片
表情
