- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
嘿,有一些类似的问题,但没有一个完全像这样,而且相当多的问题已经存在多年并且已经过时了。
我在我的服务器上编写了一些代码,通过 boto3 方法 upload_file 使用 key 将 jpeg 照片上传到 s3 存储桶中。最初这看起来很棒。这是一个将文件上传到 s3 的 super 简单的解决方案。
问题是,我有用户。我的用户通过电话应用程序将他们的 jpeg 发送到我的服务器。虽然我承认我可以生成预先签名的上传 URL 并将它们发送到电话应用程序,但这需要对我们的电话应用程序和 API 进行大量重写。
所以我只希望手机应用程序将照片发送到服务器。然后我想将照片从服务器发送到 s3。我实现了这个,但它太慢了。我不能要求我的用户容忍这些缓慢的上传。
我能做些什么来加快速度?
我做了一些谷歌搜索,发现了这个:https://medium.com/@alejandro.millan.frias/optimizing-transfer-throughput-of-small-files-to-amazon-s3-or-anywhere-really-301dca4472a5
它建议解决方案是增加 TCP/IP 连接数。更多的 TCP/IP 连接意味着更快的上传。
好的,太好了!
我怎么做?如何增加 TCP/IP 连接数,以便更快地将单个 jpeg 上传到 AWS s3?
请帮忙。
最佳答案
具有讽刺意味的是,我们一直在使用 boto3
多年来,以及 awscli
,我们都喜欢他们。
但是我们经常想知道为什么 awscli 的 aws s3 cp --recursive
, 或 aws s3 sync
,通常比尝试通过 boto3
进行大量上传要快得多。 ,即使是 concurrent.futures
的 ThreadPoolExecutor
或 ProcessPoolExecutor
(你甚至不敢在你的 worker 之间共享相同的 s3.Bucket
:它在 the docs 中被警告,并且有充分的理由;讨厌的崩溃最终会在最不方便的时候接踵而至)。
最后,我硬着头皮查看了 awscli 在 boto3
之上引入的“自定义”代码。 .
基于这个小小的探索,这里有一种方法可以通过使用已内置于 boto3.s3.transfer
中的并发来加快将许多文件上传到 S3 的速度。 ,不仅适用于单个大文件可能的多个部分,还适用于各种大小的一大堆文件。据我所知,该功能并未通过 boto3
的更高级别的 API 公开。 boto3
中描述的文档。
下列:
boto3.s3.transfer
创建一个 TransferManager
,与 awscli 的 aws s3 sync
使用的相同, 例如。 urllib3
botocore
使用的最大池连接容量匹配(默认情况下,它最多使用 10 个连接)。 tqdm
进度条进行演示,但当然您可以使用任何您想要的回调)。 filelist
中有一堆文件下面,一共
total_size
字节:
import os
import boto3
import botocore
import boto3.s3.transfer as s3transfer
import tqdm
botocore_config = botocore.config.Config(max_pool_connections=20)
s3client = boto3.client('s3', config=botocore_config)
transfer_config = s3transfer.TransferConfig(
use_threads=True,
max_concurrency=20,
)
bucket_name = '<your-bucket-name>'
s3junkdir = 'some/path/for/junk'
%%time
progress = tqdm.tqdm(
desc='upload',
total=total_size, unit='B', unit_scale=1,
position=0,
bar_format='{desc:<10}{percentage:3.0f}%|{bar:10}{r_bar}')
s3t = s3transfer.create_transfer_manager(s3client, transfer_config)
for src in filelist:
dst = os.path.join(s3junkdir, os.path.basename(src))
s3t.upload(
src, bucket_name, dst,
subscribers=[
s3transfer.ProgressCallbackInvoker(progress.update),
],
)
s3t.shutdown() # wait for all the upload tasks to finish
progress.close();
关于amazon-web-services - 使用 boto3 时如何提高 AWS s3 上传速度?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/56639630/
我在想出一个算法时遇到了麻烦... 我有一系列 GPS 数据,以 1 秒为间隔记录时间、速度、距离。假设距离是米,速度是米/秒。可能有超过 2 小时的数据,或 7200 个点。这里的“时间”字段主要是
使用java排序器,即: Collections.sort(myArrayList, new Comparator() { @Override public int c
有什么区别吗 SELECT * FROM my_table 和 SELECT my_column_id FROM my_table 地点: my_table 有百万行 网站上有大量并发用户进行sql查
有2个样本。 在第一个示例中,使用 orderby 可以更快地获得结果。 (根据 phpmyadmin 速度报告) 在另一个例子中,我没有使用 order by,它给出的结果较慢。 (根据 phpmy
我注意到,如果我将训练数据加载到内存中并将其作为 numpy 数组提供到图中,与使用相同大小的 shuffle 批次相比,速度会有很大差异,我的数据有大约 1000 个实例。 使用内存 1000 次迭
我在 python 中使用破折号。我正在绘制记录到 SQLite 数据库中的实时数据,目前,我正在绘制单个值与时间线图。我计划再添加 20 个图表,但目前,随着时间的增加, plotly 变慢,我认为
我试图调用 hasNext Velocity 模板中的方法,以便根据 foreach 循环中的位置影响行为 - 仅 hasNext没有按照文档工作。 这是 Velocity 用户指南的片段,关于 ha
在我正在制作的游戏中,我有两个点,pt1 和 pt2,我想计算出它们之间的角度。我已经在较早的计算中计算出距离。显而易见的方法是对垂直距离上的水平距离进行反正切 (tan(theta) = opp/a
我经常遇到字符串值不存在和/或为空的情况。这是测试这种情况的最佳方法吗? #if( $incentive.disclaimer && $!incentive.disclaimer != '' )
我想将一个模板nested包含在其他模板cont1,cont2和cont3中。 并且嵌套模板应仅对cont1隐藏一个特定控件。 在包含在cont1中之前,我想为一些标志变量$hideMyControl
是否可以更改从“Windows Azure Media Encoder”输出的音频的播放速度? 我正在使用配置为“WMA High Quality Audio”的“Windows Azure Medi
我使用速度将String(template)与字段合并 hi there I'am ${name}, And I'am ${age} old. velocity将字段${name}和${age}与一种
我使用的是 LockedBitmap 类,它简化了 C# 中位图数据的处理。目前它正在将数据复制到本地 byte[] 数组中,然后通过其类方法访问该数组以获取/设置像素颜色值。 这比直接通过指针访问锁
我尝试在 VM_global_library.vm 文件中添加一堆 #set($x=abc) 语句,但这些变量在我的 VM 模板中不可用。 我想为图像的基本路径等设置一个全局变量。这可能吗? 最佳答案
我的项目结构: -src --main ---java ----makers -----SomeClass ---resources ----htmlPattern.vm 如何告诉 SomeClass
我正在尝试从 Velocity 中的字符串中删除不需要的字符(换行符可以,但不能像 EM 和 CAN ASCII 控制字符那样)。 #set($cleanScreen = $cleanScreen.r
我想在日.月.年之间的点处分割日期。例如:2015 年 1 月 14 日至 {14, 01, 2015}这是我使用的代码:dates3.get(0) 包含我从页面的文本字段获取的字符串“14.01.2
之后,从 1.5 升级到速度引擎 1.7 出现了 1.5 没有的问题。为了解释这个问题,我必须展示一个代码片段: #foreach($someVariable in $someCollection)
我想知道从表中选择所有字段是否更快: SELECT * 或只选择您真正需要的: SELECT field1, field2, field3, field4, field5... 假设表有大约 10 个
我正在尝试模仿照片应用程序的行为,在该应用程序中,用户用手指平移照片并且照片具有一定的速度。由于我不会深入的原因,我不能将 UIScrollView 与它的缩放 UIImageView 一起使用,而是
我是一名优秀的程序员,十分优秀!