最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python實現(xiàn)從web抓取文檔的方法

 更新時間:2014年09月26日 09:28:02   投稿:shichen2014  
這篇文章主要介紹了python實現(xiàn)從web抓取文檔的方法,以抓取人人網(wǎng)頁面為例講述了完整的web文檔抓取方法,需要的朋友可以參考下

本文實例講述了Python實現(xiàn)從Web的一個URL中抓取文檔的方法,分享給大家供大家參考。具體方法分析如下:

實例代碼如下:

import urllib 
doc = urllib.urlopen("http://www.python.org").read() 
print doc#直接打印出網(wǎng)頁 
def reporthook(*a): 
 print a 
#將http://www.renren.com網(wǎng)頁保存到renre.html中,
#每讀取一個塊調(diào)用一字reporthook函數(shù) 
 
urllib.urlretrieve("http://www.renren.com",'renren.html',reporthook) 
#將http://www.renren.com網(wǎng)頁保存到renre.html中 
urllib.urlretrieve("http://www.renren.com",'renren.html')

程序運行結(jié)果如下:

<!DOCTYPE html PUBLIC "-//W3C//DTD XHTML 1.0 Transitional//EN" "http://www.w3.org/TR/xhtml1/DTD/xhtml1-transitional.dtd">
..........................網(wǎng)頁內(nèi)容
</body>
</html>


(0, 8192, -1)
(1, 8192, -1)
(2, 8192, -1)

其中urllib.urlopen返回一個類文件對象。

希望本文所述對大家的Python程序設(shè)計有所幫助。

相關(guān)文章

最新評論

聊城市| 辽宁省| 巴林左旗| 广宗县| 什邡市| 健康| 阿巴嘎旗| 东台市| 钟祥市| 科技| 司法| 宁河县| 通榆县| 绥芬河市| 和平县| 保靖县| 桓台县| 齐河县| 普兰店市| 涟水县| 红桥区| 阳高县| 博湖县| 中卫市| 濮阳市| 繁峙县| 炎陵县| 太仆寺旗| 泗洪县| 邢台市| 古蔺县| 松江区| 武功县| 稻城县| 深泽县| 新蔡县| 准格尔旗| 临泽县| 惠来县| 额济纳旗| 那坡县|