小編給大家分享一下Python如何將爬取的圖片寫入world文檔,相信大部分人都還不怎么了解,因此分享這篇文章給大家參考一下,希望大家閱讀完這篇文章后大有收獲,下面讓我們一起去了解一下吧!
成都創(chuàng)新互聯(lián)公司是一家專業(yè)提供澄江企業(yè)網(wǎng)站建設(shè),專注與成都網(wǎng)站建設(shè)、成都網(wǎng)站制作、H5響應(yīng)式網(wǎng)站、小程序制作等業(yè)務(wù)。10年已為澄江眾多企業(yè)、政府機(jī)構(gòu)等服務(wù)。創(chuàng)新互聯(lián)專業(yè)的建站公司優(yōu)惠進(jìn)行中。無論是爬取文字還是圖片,都可以游刃有余的做到,但是爬蟲所爬取的內(nèi)容往往不是單獨(dú)的圖片或者文字,于是我就想是否可以將圖文保存至world文檔里,一開始使用了如下方法保存圖片:
with open('123.doc','wb')as file: file.write(response.content) file.close()
結(jié)果就是,world文檔里出現(xiàn)了一堆亂碼,此法不同,我就開始另尋他法,找了很久也沒有找到,只找到了關(guān)于Python操作world的方法。
于是我就開始了新的思路:使用原來的方法將圖片保存下來,再將圖片添加到world文檔里,最后將圖片刪除。這里使用的是python-dox庫,代碼如下:
import requests from bs4 import BeautifulSoup import os import docx from docx import Document from docx.shared import Inches url = 'https://www.qiushibaike.com/article/119757360' html = requests.get(url).content soup = BeautifulSoup(html,'html.parser') wen = soup.find('div',{"class":"content"}).text img = str(soup.find('div',{"class":"thumb"})).split('src="')[1].split('"/')[0] tu = 'https:' + img img_name = img.split('/')[-1] #保存圖片至本地 with open(img_name,'wb')as f: response = requests.get(tu).content f.write(response) f.close() document = Document() document.add_paragraph(wen)#向文檔里添加文字 document.add_picture(img_name)#向文檔里添加圖片 document.save('tuwen.doc')#保存文檔 os.remove(img_name)#刪除保存在本地的圖片
最后,還是實現(xiàn)了將圖文保存在了world文檔里,盡管方法有些笨……
以上是“Python如何將爬取的圖片寫入world文檔”這篇文章的所有內(nèi)容,感謝各位的閱讀!相信大家都有了一定的了解,希望分享的內(nèi)容對大家有所幫助,如果還想學(xué)習(xí)更多知識,歡迎關(guān)注創(chuàng)新互聯(lián)行業(yè)資訊頻道!
本文名稱:Python如何將爬取的圖片寫入world文檔-創(chuàng)新互聯(lián)
標(biāo)題鏈接:http://www.rwnh.cn/article46/doepeg.html
成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供靜態(tài)網(wǎng)站、服務(wù)器托管、定制開發(fā)、域名注冊、做網(wǎng)站、網(wǎng)站排名
聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網(wǎng)站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時需注明來源: 創(chuàng)新互聯(lián)
猜你還喜歡下面的內(nèi)容