- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我将 Django 与 Postgres 结合使用,并有下表:
class Person(models.Model):
person_id=models.IntegerField(primary_key=True)
name = models.CharField(max_length=500, blank=True)
description = models.ManyToManyField('descriptions.Description', through='DescriptionPersonUser')
class DescriptionPersonUser(models.Model):
person = models.ForeignKey(Person)
description = models.ForeignKey('descriptions.Description')
user = models.ForeignKey(User)
class Meta:
managed = True
unique_together = ('person', 'description', 'user')
class Description(models.Model):
description_id=models.AutoField (primary_key=True)
description_word=models.CharField(max_length=50, blank=True, unique=True)
class AuthUser(models.Model):
id = models.IntegerField(primary_key=True) # AutoField?
...
username = models.CharField(unique=True, max_length=30)
Person 表有超过 1.5 mio 行,其他表各不超过 100 行。据我了解,执行“正常”执行的查询仍然是合理的。我想通过从 DescriptionPersonUser 表中注释计数来对 Person 表进行排序。
person_list = Person.objects.annotate(count=Count('descriptionpersonuser')).order_by('-count')[:10]
此查询加载耗时约 50000 毫秒。比我尝试在原始 sql 中执行它并改进了很多到 cca 1900 ms。
person_list= Person.objects.raw('SELECT "person"."person_id", COUNT("persons_descriptionpersonuser"."id") AS "count" FROM "person" LEFT OUTER JOIN "persons_descriptionpersonuser" ON ( "person"."person_id" = "persons_descriptionspersonuser"."person_id" ) GROUP BY "person"."person_id" ORDER BY "count" DESC, "person"."person_id" ASC LIMIT 10'),
我还在 persons_descriptionpersonuser 上创建了索引:
CREATE INDEX index_descriptionpersonuser ON persons_descriptionpersonuser (person_id, description_id, id);
所以我的问题是:
已编辑(根据 Tomasz Jakub Rup 添加 EXPLAIN ANALYZE 结果的建议):
没有 index_descriptionpersonuser:
Limit (cost=138185.30..138185.33 rows=10 width=8) (actual time=2470.974..2470.976 rows=10 loops=1)
-> Sort (cost=138185.30..142177.82 rows=1597006 width=8) (actual time=2470.973..2470.975 rows=10 loops=1)
Sort Key: (count(persons_descriptionpersonuser.id)), person.person_id
Sort Method: top-N heapsort Memory: 25kB
-> GroupAggregate (cost=0.56..103674.58 rows=1597006 width=8) (actual time=0.402..1945.107 rows=1597006 loops=1)
Group Key: person.person_id
-> Merge Left Join (cost=0.56..79719.49 rows=1597006 width=8) (actual time=0.378..1014.179 rows=1597016 loops=1)
Merge Cond: (person.person_id = persons_descriptionpersonuse.person_id)
-> Index Only Scan using person_pkey on person (cost=0.43..75718.86 rows=1597006 width=4) (actual time=0.359..610.272 rows=1597006 loops=1)
Heap Fetches: 235898
-> Index Scan using persons_descriptionpersonuse_person_id on persons_descriptionpersonuser (cost=0.14..12.42 rows=19 width=8) (actual time=0.014..0.025 rows=20 loops=1)
Planning time: 17.879 ms
Execution time: 2472.821 ms
(13 rows)
使用 index_descriptionpersonuser:
Limit (cost=138185.55..138185.58 rows=10 width=8) (actual time=2341.349..2341.352 rows=10 loops=1)
-> Sort (cost=138185.55..142178.07 rows=1597006 width=8) (actual time=2341.325..2341.325 rows=10 loops=1)
Sort Key: (count(persons_descriptionpersonuser.id)), person.person_id
Sort Method: top-N heapsort Memory: 25kB
-> GroupAggregate (cost=0.56..103674.83 rows=1597006 width=8) (actual time=0.106..1819.330 rows=1597006 loops=1)
Group Key: person.person_id
-> Merge Left Join (cost=0.56..79719.74 rows=1597006 width=8) (actual time=0.092..877.874 rows=1597016 loops=1)
Merge Cond: (person.person_id = persons_descriptionpersonuser.person_id)
-> Index Only Scan using person_pkey on person (cost=0.43..75718.86 rows=1597006 width=4) (actual time=0.023..473.046 rows=1597006 loops=1)
Heap Fetches: 235898
-> Index Only Scan using index_descriptionpersonuser on persons_descriptionpersonuser (cost=0.14..12.44 rows=20 width=8) (actual time=0.059..0.085 rows=20 loops=1)
Heap Fetches: 20
Planning time: 0.715 ms
Execution time: 2343.815 ms
(14 rows)
作为Tomasz Jakub Rup建议优化的 sql 查询现在需要 cca 40 毫秒。以下是结果:
Limit (cost=1.50..1.52 rows=8 width=8) (actual time=0.061..0.064 rows=10 loops=1)
-> Sort (cost=1.50..1.52 rows=8 width=8) (actual time=0.060..0.061 rows=10 loops=1)
Sort Key: (count(id)), person_id
Sort Method: quicksort Memory: 25kB
-> HashAggregate (cost=1.30..1.38 rows=8 width=8) (actual time=0.039..0.044 rows=10 loops=1)
Group Key: person_id
-> Seq Scan on persons_descriptionpersonuser (cost=0.00..1.20 rows=20 width=8) (actual time=0.011..0.018 rows=20 loops=1)
Planning time: 0.175 ms
Execution time: 0.129 ms
(9 rows)
谢谢
最佳答案
第二个问题的答案:
查看结果
EXPLAIN ANALYZE SELECT "person"."person_...
查询。如果您在结果中找到 index_descriptionpersonuser
是,则您的查询使用索引。如果不是,请尝试创建其他索引。也许仅在 person_id
上?
第一个问题:是的,这个查询可以更快。显示 EXPLAIN ANALYZE...
的结果,然后我们尝试加快查询速度。
注意
原始查询可能更快,因为它们从 PostgreSQL 缓存中获取数据。
关于sql - Django 慢查询性能提升,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/34321314/
我对 Python-Django 和 web 开发还很陌生,我被困在这个使用 POST 创建新资源的特殊问题上。 我正在为 REST API 使用 Django REST 框架,我正在尝试创建一个新资
我已经使用 Django-storages 成功地将 Word 文档存储到 S3。 class Document(TitleSlugDescriptionModel, TimeStampedModel
我有 2 个关于模型代理的问题, 如何从模型对象创建代理对象? 如何从模型查询集创建代理查询集? 例如,假设我们定义了: from django.contrib.auth.models import
我想编写一个直接执行 HTTP 请求的单元测试(而不是使用 django.test.client.Client)。 如果您好奇为什么 - 那是因为我想测试我从 Django 应用程序公开的 Thrif
我为我的个人网站启动了一个 django 项目来学习 django。到目前为止,我已经将我的开发环境设置为我需要的一切,并遵循 this很棒的教程来创建一些基本的数据结构和模板。现在我想开始使用我之前
我已经阅读了很多关于如何在使用 Django 注册时添加额外字段的信息,例如 here 、 here 和 here 。代码片段是: forms.py(来自注册应用程序) class Registrat
我正在编写小型社交应用程序。功能之一是在网站标题中写入用户名。因此,例如,如果我登录并且我的名字是Oleg(用户名),那么我应该看到: Hello, Oleg | Click to edit prof
我有一个使用 Django 和 Django Rest 框架开发的应用程序。我想将 django-reversion 功能添加到我的应用程序中。 我已经尝试过http://django-reversi
我有一个简单的 HTML 表单,我没有使用 Django 表单,但现在我想添加一个选择。 选择最容易创建为 Django ChoiceField (与通过循环等手动创建选择相反),但是,如果没有在 D
我不明白为什么人们以两种方式编写外键,这样做的目的是什么?它们是相同还是不同? 我注意到有些人这样写: author = models.ForeignKey(Author, on_delete=mod
我想在我的 Django 应用程序中获取评论最多的十个帖子,但我做不到,因为我想不出合适的方法。 我目前正在使用 django 评论框架,并且我已经看到使用 aggregate or annotate
这对于 Django 1.2 仍然有效吗? Custom Filter in Django Admin on Django 1.3 or below 我已经尝试过,但管理类中的 list_filter
问题在于,当 django-compressor 编译为 .js 文件的 CoffeeScript 文件中引用 {{ STATIC_URL }} 时,它无法正确加载。 在我的 django 模板中,我
我正在尝试将一些字段从一个 django 模型移动到一个新模型。假设我有一个书籍模型: class Book(models.Model): title = models.CharField(max
我想在我的 Django 应用程序中获取评论最多的十个帖子,但我做不到,因为我想不出合适的方法。 我目前正在使用 django 评论框架,并且我已经看到使用 aggregate or annotate
目前我正在寻找在 Django 中实现访问控制。我已经阅读了有关内置权限的内容,但它并不关心每个对象的基础。例如,我想要“只有创建者可以删除自己的项目”之类的权限。所以我读到了 django-guar
嗨,我正在将我的 Django 模型的一个字段的值设置为其他模型的另一个字段的值。这个值应该是动态变化的。 这是我的第一个模型 class MainModel(AbstractBaseUser, Pe
我正在尝试为我的模型创建一个编辑表单。我没有使用模型表单,因为根据模型类型,用户可以使用不同的表单。 (例如,其中一个表单有 Tinymce 小部件,而另一个没有。) 有没有什么方法可以使用模型设置表
Django 模板中的搜索字段 如何在类似于此图像的 Django 模板中创建搜索字段 http://asciicasts.com/system/photos/1204/original/E354I0
根据 Django documentation ,如果 Django 安装激活了 AuthenticationMiddleware,HttpRequest 对象有一个“user”属性代表当前登录的用户
我是一名优秀的程序员,十分优秀!