最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python正則表達式匹配HTML頁面編碼

 更新時間:2015年04月08日 09:17:52   投稿:junjie  
這篇文章主要介紹了Python正則表達式匹配HTML頁面編碼,本文直接給出代碼和匹配實例,需要的朋友可以參考下

html頁面一般都會指定一個編碼,如何獲取到是處理html頁面的第一步,因為錯誤的編碼必然帶來后面處理的問題。這里我用python的正則表達式寫了個:

import re

a = ["<meta http-equiv="Content-Type" content="text/html; charset=utf-8" />",
   '<meta http-equiv=Content-Type content="text/html;charset=gb2312">',
   '<meta http-equiv="Content-Type" content="text/html; charset=iso-8859-1">',
   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />',
   '<meta http-equiv="content-type" content="text/html; charset=utf-8" />',
   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />',
   '<meta http-equiv="Content-Type" content="text/html; charset=gb2312" />'
   ]



b = "<meta[ ]+http-equiv=["']?content-type["']?[ ]+content=["']?text/html;[ ]*charset=([0-9-a-zA-Z]+)["']?"


B = re.compile(b, re.IGNORECASE)


for ax in a:
  r1 = B.search(ax)

  if r1:
    print r1.group()
    print r1.group(1), len(r1.group())
  else:
    print 'not match'

相關(guān)文章

最新評論

正镶白旗| 密云县| 建始县| 鄢陵县| 秦皇岛市| 改则县| 徐闻县| 宿松县| 红桥区| 开化县| 新密市| 杨浦区| 凤凰县| 洛阳市| 利津县| 江油市| 海南省| 密云县| 陵水| 宁陵县| 班戈县| 慈溪市| 彭泽县| 长岭县| 玉山县| 开封市| 浦东新区| 沭阳县| 土默特左旗| 华宁县| 永清县| 云浮市| 会泽县| 浦东新区| 巴马| 南开区| 田东县| 桃源县| 荃湾区| 浙江省| 墨脱县|