- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
问题是尝试将数据上传到 SQL Server 并获得每秒 122 行(17 列)的速度。我决定在这里发布问题以及解决方法,希望有人知道明确的答案。
我发现的最相关的线程是,但问题有很大不同,仍然没有答案:
pyodbc - very slow bulk insert speed
这是一个简单的场景,我尝试使用 Python 将 350K 行的 CSV 上传到空白 SQL Server 表中。在尝试了一种最流行的方法后,即将其读取为 pandas DataFrame,创建一个 fast_executemany=True 的 sql_alchemy 引擎,并使用 to_sql() 方法存储到数据库中。我得到了 122 行/秒,这是 Not Acceptable 。
正如其他线程中提到的,这在 PostgreSQL 或 Oracle 中不会发生,我可以补充一点,在 MariaDB 中也不会发生。所以我尝试了一种不同的方法,使用 pyodbc cursor.executemany() 来查看 pandas 或 sql_alchemy 中是否存在错误。一样的速度。
下一步是生成合成数据来复制问题以提交错误……令我惊讶的是,生成的数据大约是 8000 条记录/秒。怎么回事?数据使用的数据类型(显然)与 CSV 中的数据类型相同。
经过数周尝试不同的事情后,我决定研究 pydobc 本身。在 pyodbc github 开发站点中,我在 https://github.com/mkleehammer/pyodbc/wiki/Binding-Parameters 找到了一条有趣的信息。 ,尤其是在 写入 NULL 在 解决方案和变通方法 部分。
事实上,CSV 第一行的 17 个字段中有 3 个被我手动转换为 Pandas 中的“Nan”或 None。令我惊讶的是,将这些 None/Nan/NULL 替换为 上的有效值仅第一行 ,将速度提高到 7-8000 条记录/秒。请注意,我没有在后续行中更改任何 None/Nan,仅在第一行中更改。
有谁明白为什么会这样?有没有比将 None/Nan 替换为有效值更优雅的解决方法?
更新 : Github 页面上似乎有几个相关的问题,并且都指向同一个问题。供引用:https://github.com/mkleehammer/pyodbc/issues/213 .该线程相对较旧,从 2017 年开始,但似乎如何处理 None/Nan 的问题仍然存在。
最佳答案
与 Microsoft SQL Server 对话时,pyodbc 至少在 4.0.30 版中存在错误。总之,SQL Server 对不同的字段类型使用不同类型的 NULL,pyodbc 不能仅从“无”推断使用哪个 NULL。为了克服这个限制,pyodbc 实现了两种方法:
关于python - 使用 pyodbc 批量插入 + SQL Server 使用 None/Nan 很慢 + 解决方法,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/61201530/
@Cacheable在同一类中方法调用无效 上述图片中,同一个类中genLiveBullets()方法调用同类中的queryLiveByRoom()方法,这样即便标识了Cacheable标签,
目录 @Transaction注解导致动态切换更改数据库失效 使用场景 遇到问题 解决 @Transaction
@RequestBody不能class类型匹配 在首次第一次尝试使用@RequestBody注解 开始加载字符串使用post提交(貌似只能post),加Json数据格式传输的时候,
目录 @Autowired注入static接口问题 @Autowired自动注入普通service很方便 但是如果注入static修饰的serv
目录 @RequestBody部分属性丢失 问题描述 JavaBean实现 Controller实现
目录 解决@PathVariable参数接收不完整的问题 今天遇到的问题是: 解决办法: @PathVariable接受的参
这几天在项目里面发现我使用@Transactional注解事务之后,抛了异常居然不回滚。后来终于找到了原因。 如果你也出现了这种情况,可以从下面开始排查。 1、特性 先来了解一下@Trans
概述: ? 1
场景: 在处理定时任务时,由于这几个方法都是静态方法,在aop的切面中使用@Around注解,进行监控方法调用是否有异常。 发现aop没有生效。 代码如下:
最近做项目的时候 用户提出要上传大图片 一张图片有可能十几兆 本来用的第三方的上传控件 有限制图片上传大小的设置 以前设置的是2M&nb
我已经实现了这个SCIM reference code在我们的应用程序中。 我实现的代码确实通过了此postman link中存在的所有用户测试集合。 。我的 SCIM Api 也被 Azure 接受
我一直对“然后”不被等待的行为感到困扰,我明白其原因。然而,我仍然需要绕过它。这是我的用例。 doWork(family) { return doWork1(family)
我正在尝试查找 channel 中的消息是否仍然存在,但是,我不确定如何解决 promise ,查看其他答案和文档,我可以看到它可能是通过函数实现的,但我是不完全确定如何去做。我希望能在这方面获得一些
我有以下情况: 同一工作区中的 2 个 Eclipse 项目:Apa 和 Bepa(为简洁起见,使用化名)。 Apa 项目引用(包括)Bepa 项目。 我在 Bepa 有一个类 X,具有公共(publ
这个问题已经有答案了: Why am I getting a NoClassDefFoundError in Java? (31 个回答) 已关闭 6 年前。 我正在努力学习 spring。所以我输入
我正在写一个小游戏,屏幕上有许多圆圈在移动。 我在两个线程中管理圈子,如下所示: public void run() { int stepCount = 0; int dx;
我在使用 Sympy 求解方程时遇到问题。当我运行代码时,例如: 打印(校正(10)) 我希望它打印一个数字 f。相反,它给我错误:执行中止。 def correction(r): from
好吧,我制作的每个页面都有这个问题。我不确定我做错了什么,但我所有的页面都不适用于所有分辨率。可能是因为我使用的是宽屏?大声笑我不确定,但在小于宽屏分辨率的情况下,它永远不会看起来正确。它的某些部分你
我正在尝试像这样进行一个非常简单的文化 srting 检查 if(culture.ToUpper() == "ES-ES" || "IT-IT") { //do something } else
Closed. This question is off-topic. It is not currently accepting answers. Learn more。 想改进这个问题吗?Upda
我是一名优秀的程序员,十分优秀!