如何通过HTTP下载文件?

我有一个小工具，我用来从一个网站上下载一个MP3文件，然后构建/更新一个播客XML文件，我已经添加到iTunes。

创建/更新XML文件的文本处理是用Python编写的。但是，我在Windows .bat文件中使用wget来下载实际的MP3文件。我更喜欢用Python编写整个实用程序。

我努力寻找一种用Python实际下载该文件的方法，因此我使用了wget。

那么，如何使用Python下载文件呢?

当前回答

2012年，使用python请求库

>>> import requests
>>> 
>>> url = "http://download.thinkbroadband.com/10MB.zip"
>>> r = requests.get(url)
>>> print len(r.content)
10485760

您可以运行pip install请求来获取它。

请求比替代方法有很多优点，因为API简单得多。如果必须进行身份验证，则尤其如此。Urllib和urllib2在这种情况下非常不直观和痛苦。

2015-12-30

人们对进度条表示钦佩。这当然很酷。现在有几种现成的解决方案，包括tqdm:

from tqdm import tqdm
import requests

url = "http://download.thinkbroadband.com/10MB.zip"
response = requests.get(url, stream=True)

with open("10MB", "wb") as handle:
    for data in tqdm(response.iter_content()):
        handle.write(data)

这实际上是@kvance在30个月前描述的实现。

2012-05-24 20:08:29

其他回答

使用urllib.request.urlopen ():

import urllib.request
with urllib.request.urlopen('http://www.example.com/') as f:
    html = f.read().decode('utf-8')

这是使用库的最基本的方法，没有任何错误处理。您还可以执行更复杂的操作，例如更改头文件。

在Python 2中，该方法在urllib2中:

import urllib2
response = urllib2.urlopen('http://www.example.com/')
html = response.read()

2008-08-22 15:38:22

Python 3

urllib.request.urlopen 进口urllib.request Response = urllib.request.urlopen('http://www.example.com/') HTML = response.read() urllib.request.urlretrieve 进口urllib.request urllib.request.urlretrieve (' http://www.example.com/songs/mp3.mp3 ', ' mp3.mp3 ') 注意:根据文档，urllib.request.urlretrieve是一个“遗留接口”，并且“在未来可能会被弃用”(感谢gerrit)

Python 2

urllib2。urlopen(谢谢科里) 进口urllib2 Response = urllib2.urlopen('http://www.example.com/') HTML = response.read() urllib。urlretrieve(感谢PabloG) 进口urllib urllib.urlretrieve (' http://www.example.com/songs/mp3.mp3 ', ' mp3.mp3 ')

2015-08-06 13:30:31

延迟回答，但对于python>=3.6，您可以使用:

import dload
dload.save(url)

安装dload:

pip3 install dload

2020-02-24 07:12:14

为了这个目的，用纯Python编写了wget库。从2.0版开始，它就为urlretrieve注入了这些特性。

2013-09-25 17:55:16

另一种方法是调用外部进程，如curl.exe。Curl在默认情况下显示进度条、平均下载速度、剩余时间等，所有这些都整齐地格式化在一个表格中。将curl.exe放在与脚本相同的目录中

from subprocess import call
url = ""
call(["curl", {url}, '--output', "song.mp3"])

注意:不能使用curl指定输出路径，所以使用os。重命名之后

2020-09-14 00:20:55

如何通过HTTP下载文件?

推荐文章

最新文章

标签