这两天学习了python3实现抓取网页资源的方法,发现了很多种方法,所以,今天添加一点小笔记。
1、最简单
import urllib.requestresponse = urllib.request.urlopen('http://python.org/')html = response.read()2、使用 Request
import urllib.request req = urllib.request.Request('http://python.org/')response = urllib.request.urlopen(req)the_page = response.read()3、发送数据
#! /usr/bin/env python3 import urllib.parseimport urllib.request url = 'http://localhost/login.php'user_agent = 'Mozilla/4.0 (compatible; MSIE 5.5; Windows NT)'values = { 'act' : 'login', 'login[email]' : 'yzhang@i9i8.com', 'login[password]' : '123456' } data = urllib.parse.urlencode(values)req = urllib.request.Request(url, data)req.add_header('Referer', 'http:///')a = urllib.request.urlopen(req).read()print(a)以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。