python - 在 Python 3.6 中使用 setdefault 使用来自两个不同文件的信息显示(名称、id 和频率计数)-6ren

python - 在 Python 3.6 中使用 setdefault 使用来自两个不同文件的信息显示(名称、id 和频率计数)

转载作者：太空宇宙更新时间：2023-11-03 15:23:15

25

4

我正在尝试读取两个.dat 文件并创建一个程序，该程序使用aid2name 的值作为字典中的键，该字典具有aid2numplays 的键和值，设置为其值。完成这一切的目的是希望该文件能够生成包含(艺术家姓名、艺术家 ID、播放频率)的结果。值得注意的是，第一个文件提供艺术家姓名和艺术家 ID，而第二个文件提供用户 ID、艺术家 ID 和每个用户的频率。有什么想法如何按用户聚合这些频率，然后以(艺术家姓名、艺术家 ID、播放频率)格式显示它们？以下是我迄今为止所取得的成果:

import codecs
aid2name = {}
d2 = {}
fp = codecs.open("artists.dat", encoding = "utf-8")
fp.readline()  #skip first line of headers
for line in fp:
    line = line.strip()
    fields = line.split('\t')
    aid = int(fields[0])
    name = fields[1]
    aid2name = {int(aid), name}
    d2.setdefault(fields[1], {})
    #print (aid2name)
# do other processing
    #print(dictionary)

aid2numplays = {}
fp = codecs.open("user_artists.dat", encoding = "utf-8")
fp.readline()  #skip first line of headers
for line in fp:
    line = line.strip()
    fields = line.split('\t')
    uid = int(fields[0])
    aid = int(fields[1])
    weight = int(fields[2])
    aid2numplays = [int(aid), int(weight)]
    #print(aid2numplays)
    #print(uid, aid, weight)

for (d2.fields[1], value) in d2:
    group = d2.setdefault(d2.fields[1], {}) # key might exist already
    group.append(aid2numplays)

print(group)

最佳答案

编辑:关于setdefault的使用，如果您想按artistID对用户数据进行分组，那么您可以:

grouped_data = {}
for u in users:
    k, v = u[1], {'userID': u[0], 'weight': u[2]}
    grouped_data.setdefault(k, []).append(v)

这本质上与编写相同:

grouped_data = {}
for u in users:
    k, v = u[1], {'userID': u[0], 'weight': u[2]}
    if k in grouped_data:
        grouped_data[k].append(v)
    else:
        grouped_data[k] = [v]

作为如何计算艺术家在不同用户数据中出现的次数的示例，您可以将数据读入列表列表中:

with codecs.open("artists.dat", encoding = "utf-8") as f:
    artists = f.readlines()

with codecs.open("user_artists.dat", encoding = "utf-8") as f:
    users = f.readlines()

artists = [x.strip().split('\t') for x in artists][1:]  # [['1', 'MALICE MIZER', ..
users = [x.strip().split('\t') for x in users][1:]  # [['2', '51', '13883'], ..]

使用artistID作为键来迭代创建字典的艺术家。添加播放统计数据的占位符。

data = {}
for a in artists:
    artistID, name = a[0], a[1]
    data[artistID] = {'name': name, 'plays': 0}

迭代更新每行字典的用户:

for u in users:
    artistID = u[1]
    data[artistID]['plays'] += 1

数据输出:

{'1': {'name': 'MALICE MIZER', 'plays': 3},
 '2': {'name': 'Diary of Dreams', 'plays': 12},
 '3': {'name': 'Carpathian Forest', 'plays': 3},  ..}

编辑:要迭代用户数据并创建与用户关联的所有艺术家的字典，我们可以:

artist_list = [x.strip().split('\t') for x in artists][1:]
user_stats_list = [x.strip().split('\t') for x in users][1:]

artists = {}
for a in artist_list:
    artistID, name = a[0], a[1]
    artists[artistID] = name

grouped_user_stats = {}
for u in user_stats_list:
    userID, artistID, weight = u
    if userID not in grouped_user_stats:
        grouped_user_stats[userID] = { artistID: {'name': artists[artistID], 'plays': 1} }
    else:
        if artistID not in grouped_user_stats[userID]:
            grouped_user_stats[userID][artistID] = {'name': artists[artistID], 'plays': 1}
        else:
            grouped_user_stats[userID][artistID]['plays'] += 1
            print('this never happens') 
            # it looks the same artist is never listed twice for the same user

输出:

{'2': {'100': {'name': 'ABC', 'plays': 1},
       '51': {'name': 'Duran Duran', 'plays': 1},
       '52': {'name': 'Morcheeba', 'plays': 1},
       '53': {'name': 'Air', 'plays': 1}, .. }, 
 ..
}

关于python - 在 Python 3.6 中使用 setdefault 使用来自两个不同文件的信息显示(名称、id 和频率计数)，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/43350952/

25

4

0

文章推荐： python - pymongo geo2d 聚合结果以什么单位返回

文章推荐： python - Pandas 在迭代行时不保存更改

dart - ShadowDom外部的父级的属性已更改(显示:无->显示:flex->显示:无)
我的Angular-Component位于一个flexbox(id =“log”)中。可以显示或隐藏flexbox。我的组件内部有一个可滚动区域，用于显示日志消息。 (id =“message-li
phpinfo() 显示 MySQL，PMA 显示 MariaDB
我真的很困惑有一个 phpinfo() 输出: MySQL 支持启用客户端 API 版本 5.5.40 MYSQL_MODULE_TYPE 外部 phpMyAdmin 显示: 服务器类型:Mar
jquery - 在 jquery 切换中单击时更改按钮文本(显示/隐藏/显示)
我正在研究这个 fiddle : http://jsfiddle.net/cED6c/7/我想让按钮文本在单击时发生变化，我尝试使用以下代码: 但是，它不起作用。我应该如何实现这个？任何帮助都会很棒
php - cakephp 显示 ID 显示 table.name 来自两个不同表的关系
我应该在“dogs_cats”中保存表“dogs”和“cats”各自的ID，当看到数据时显示狗和猫的名字。我有这三个表: CREATE TABLE IF NOT EXISTS cats ( id
php - 使用 Blade 显示 HTML 显示 HTML 代码
我有一个字符串返回到我的 View 之一，如下所示: $text = 'Lorem ipsum dolor ' 我正在尝试用 Blade 显示它: {{$text}} 但是，输出是原始字符串而不是渲染
jquery - 使用 JQuery 显示/隐藏隐藏/显示 div，但单击按钮没有效果
我无法让我的链接(由图像表示，位于页面左侧)真正有效地显示一个 div(包含一个句子，位于中间)/单击链接时隐藏。这是我的代码: Practice
javascript - 显示 image1 的脚本，然后(随机毫秒)显示 image2 并停止
关闭。这个问题需要多问focused 。目前不接受答案。想要改进此问题吗？更新问题，使其仅关注一个问题 editing this post . 已关闭 4 年前。 Improve this ques
c# - ListView 显示 4 条记录。 DataGridView 显示 3 条记录？
最初我使用 Listview 来显示 oracle 结果，但是最近我不得不切换到 datagridview 来处理比 Listview 允许的更多的结果。然而，自从切换到数据网格后，我得到的结果越来越
xml - 如何使用 Apache fop 显示 Unicode 字符？显示 "?"而不是字符。
我一直在尝试插入一个 Unicode 字符 ∇ 或 ▽，所以它显示在 Apache FOP 生成的 PDF 中。这是我到目前为止所做的: 根据这个基本帮助 Apache XSL-FO Input，您
node.js - pm2 显示 1.2GB 而 heapdump 显示 80MB
我正在使用 node v0.12.7 编写一个 nodeJS 应用程序。我正在使用 pm2 v0.14.7 运行我的 nodejs 应用程序。我的应用程序似乎有内存泄漏，因为它从我启动时的大约 1
jquery - 如果 x 显示 x 如果 y 显示 y(我知道这个标题不好)
好的，所以我有一些 jQuery 代码，如果从下拉菜单中选择了带有前缀 Blue 的项目，它会显示一个输入框。代码: $(function() { $('#text1').hide();
google-chrome - Chrome 中的“检查元素”显示 LESS，但 Firefox 显示 CSS
当我试图检查 Chrome 中的 html 元素时，它显示的是 LESS 文件，而 Firefox 显示的是 CSS 文件。 (我正在使用 Bootstrap 框架) 如何在 Chrome 中查看 c
python - Microsoft Bot Emulator 显示 "sending failed. Retry"。 VSCode 显示 KeyError : 'HTTP_CONTEXT_TYPE'
我是 Microsoft Bot Framework 的新手，我正在通过 youtube 视频 https://youtu.be/ynG6Muox81o 学习它并在 Ubuntu 上使用 python
encoding - notepad++ 显示 ucs-2LE 而 ubuntu FILE [file] 显示 UTF-16LE，我很困惑？
我正在尝试转换从 mssql 生成的文件到 utf-8。当我打开他的输出 mssql在 Windows Server 2003 中使用 notepad++ 将文件识别为 UCS-2LE我使用 file
javascript帮助日期/显示
很难说出这里问的是什么。这个问题是含糊的、模糊的、不完整的、过于宽泛的或修辞性的，无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开它，visit the help center 。已关
jQuery点击关闭div(显示)
我正在尝试执行单击以打开/关闭一个 div 的功能。这是基本的，但是，点击只显示 div，当我点击“关闭”时，没有任何反应。 $(".inscricao-email").click(function
flutter - 显示/隐藏小部件而不重新创建它
假设我有 2 张卡片，屏幕上一次显示一张。我有一个按钮可以用其他卡片替换当前卡片。现在假设卡 1 上有一些数据，卡 2 上有一些数据，我不想破坏它们每个上的数据，或者我不想再次重建它们中的任何一个。
javascript - 显示()未定义
我正在使用 Eloquent Javascript 学习 Javascript。我在 Firefox 控制台上编写了以下代码，但它返回:“ReferenceError:show() 未定义”为什么？
symfony - 显示/隐藏某些菜单取决于奏鸣曲管理员角色
我正在使用 Symfony2 开发一个 web 项目，我使用 Sonata Admin 作为管理面板，一切正常，但我想要做的是，在 Sonata Admin 的仪表板菜单上，我需要显示隐藏一些菜单取决
angularjs - 显示/隐藏div取决于AngularJS中的下拉列表选择
我试图显示一个div，具体取决于从下拉列表中选择的内容。例如，如果用户从列表中选择“现金”显示现金div或用户从列表中选择“检查”显示现金div 我整理了样本，但样本不完整，需要接线 http://j

首页

博学

6Ren·AI

商城

python - 在 Python 3.6 中使用 setdefault 使用来自两个不同文件的信息显示(名称、id 和频率计数)