- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我尝试在 Python 3.x 中使用 requests.get()
获取以下 URL: http://www.finanzen.net/suchergebnis.asp?strSuchString=DE0005933931 (此 URL 由基本 URL 和搜索字符串 DE0005933931
组成)。
请求被重定向(通过 HTTP 状态代码 301)到 http://www.finanzen.net/etf/ishares_core_dax%AE_ucits_etf_de在浏览器中(URL 中包含 character 0xAE 字符®)。将 requests.get()
与重定向 URL 一起使用也可以。
当尝试使用Python 2.7获取搜索字符串URL时,一切正常,并且我得到了重定向的响应,使用Python 3.x我收到以下错误:
UnicodeDecodeError: 'utf-8' codec can't decode byte 0xae in position 21: invalid start byte
用于测试的代码片段:
import requests
url_1 = 'http://www.finanzen.net/suchergebnis.asp?strSuchString=LU0274208692'
# redirected to http://www.finanzen.net/etf/db_x-trackers_msci_world_index_ucits_etf_1c
url_2 = 'http://www.finanzen.net/suchergebnis.asp?strSuchString=DE0005933931'
# redirected to http://www.finanzen.net/etf/ishares_core_dax%AE_ucits_etf_de
print(requests.get(url_1).status_code) # working
print(requests.get(url_2).status_code) # error with Python 3.x
更多信息:
requests.__version__ = '2.18.4'
但我其他 Python 版本(3.4、3.5)也会出现相同的错误。内部服务器错误
,并显示 https://www.hurl.it尝试获取上述 URL。也许这不是Python的问题。知道为什么这在 Python 2.7 中有效但在 Python 3.x 中无效以及我能对此做什么?
最佳答案
服务器使用编码为 Latin-1 的 URL 进行响应,该 URL 未进行 URL 编码;非 ASCII 字节显示为 0x??
十六进制转义:
Location: /etf/ishares_core_dax0xAE_ucits_etf_de
0xAE字节不是有效的URL字符;服务器在这里违反了标准。他们应该发送的是
Location: /etf/ishares_core_dax%AE_ucits_etf_de
或
Location: /etf/ishares_core_dax%C2%AE_ucits_etf_de
对 URL 的 Latin-1 或 UTF-8 编码使用转义数据。
我们可以通过不更改地返回 Location
header 来修补请求
,使其在面对此错误时更加稳健:
from requests.sessions import SessionRedirectMixin
def get_redirect_target(
self, resp, _orig=SessionRedirectMixin.get_redirect_target):
try:
return _orig(self, resp)
except UnicodeDecodeError:
return resp.headers['location']
SessionRedirectMixin.get_redirect_target = get_redirect_target
应用此补丁后,重定向将按预期工作。
我created a pull request改进位置处理。
关于Python 3.x 请求使用 unicode 字符进行重定向,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/47113376/
我正在尝试使用谷歌浏览器的 Trace Event Profiling Tool分析我正在运行的 Node.js 应用程序。选择点样本后,我可以在三种 View 之间进行选择: 自上而下(树) 自上而
对于一个可能是菜鸟的问题,我们深表歉意,但尽管在 SO 上研究了大量教程和其他问题,但仍找不到答案。 我想做的很简单:显示一个包含大量数据库存储字符串的 Android ListView。我所说的“很
我已经开始了一个新元素的工作,并决定给 Foundation 5 一个 bash,看看它是什么样的。在创建带有水平字段的表单时,我在文档中注意到的第一件事是它们使用大量 div 来设置样式。所以我在下
我有一个 Windows 窗体用户控件,其中包含一个使用 BeginInvoke 委托(delegate)调用从单独线程更新的第 3 方图像显示控件。 在繁重的 CPU 负载下,UI 会锁定。当我附加
我有一堆严重依赖dom元素的JS代码。我目前使用的测试解决方案依赖于 Selenium ,但 AFAIK 无法正确评估 js 错误(addScript 错误不会导致您的测试失败,而 getEval 会
我正在制作一款基于滚动 2D map /图 block 的游戏。每个图 block (存储为图 block [21][11] - 每个 map 总共 231 个图 block )最多可以包含 21 个
考虑到以下情况,我是前端初学者: 某个 HTML 页面应该包含一个沉重的图像(例如 - 动画 gif),但我不想强制客户缓慢地等待它完全下载才能享受一个漂亮的页面,而是我更愿意给他看一个轻量级图像(例
我正在设计一个小软件,其中包括: 在互联网上获取资源, 一些用户交互(资源的快速编辑), 一些处理。 我想使用许多资源(它们都列在列表中)来这样做。每个都独立于其他。由于编辑部分很累,我想让用户(可能
我想比较两个理论场景。为了问题的目的,我简化了案例。但基本上它是您典型的生产者消费者场景。 (我关注的是消费者)。 我有一个很大的Queue dataQueue我必须将其传输给多个客户端。 那么让我们
我有一个二元分类问题,标签 0 和 1(少数)存在巨大不平衡。由于测试集带有标签 1 的行太少,因此我将训练测试设置为至少 70-30 或 60-40,因此仍然有重要的观察结果。由于我没有过多地衡量准
我是一名优秀的程序员,十分优秀!