- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个包含 19 个 csv 文件的目录,每个文件都包含学生注册号及其姓名的列表。有两个名为 quiz1 和 quiz2 的独立文件,这两个文件都包含所有参加这些测验的学生的信息以及他们的姓名和获得的总分。每项测试中获得的分数必须分为不同的列,以及显示他们参加该特定测验的“noofpresent”列。
我的任务是解析所有这些文件并创建一个基本上如下所示的数据框。 上图显示了总共 19 个批处理中的 5 个批处理。
虽然我已经填写了 Batch4 的相关字段(如图所示),但我意识到对 18 个文件重复该过程是疯狂的。
我如何编写一个程序或函数来执行这两个测验的所有剩余 18 个批处理的所有操作?我只需要了解如何继续处理其余 18 个文件的自动化逻辑。
第 9 批的前任(例如):
这是我需要为 19 个批处理中的每一个批处理复制的代码:
import pandas as pd
spath = 'd:\\a2\\studentlist.csv'
q1path = 'd:\\a2\\quiz\\quiz1.csv'
q2path = 'd:\\a2\\quiz\\quiz2.csv'
b1path = 'd:\\a2\\batchwiselist\\1.csv'
b9path = 'd:\\a2\\batchwiselist\\9.csv'
tpath = 'd:\\a2\\testcasestudent.txt'
# the final dataframe that needs to be created and filled up eventually
idx = pd.MultiIndex.from_product([['batch1', 'batch2', 'batch3', 'batch4', 'batch9'], ['quiz1', 'quiz2']])
cols=['noofpresent', 'lesserthan50', 'between50and60', 'between60and70', 'between70and80', 'greaterthan80']
statdf = pd.DataFrame('-', idx, cols)
# ============BATCH 9===================]
# ----------- QUIZ 1 -----------]
# Master list of students in Batch 9
b9 = pd.read_csv(b9path, usecols=['studentName', 'admissionNumber'])
b9.rename(columns={'studentName' : 'Firstname'}, inplace=True)
# To match column from quiz1.csv to batch9.csv to for merger
# Master list of all who attended Quiz1
q1 = pd.read_csv(q1path, usecols = ['Firstname', 'Grade/10.00', 'State'], na_values = ['-', 'In progress', np.NaN])
q1.dropna(inplace=True)
q1['Grade/10.00'] = q1['Grade/10.00'] * 10
# Multiplying the grades by 10 to mark against 100 instead of 10
# Merge batch9 list of names to list of quiz1 on their firstname column
q1b9 = pd.merge(b9, q1)
q1b9 = q1.loc[q1['Firstname'].isin(b9.Firstname)] # checking if the name exits in either lists
q1b9.reset_index(inplace=True)
#print(q1b9)
lt50 = q1b9.loc[(q1b9['Grade/10.00'] < 50)]
#findout list of students whose grades are lesser than 50
out9q1 = (lt50['Grade/10.00'].count())
# print(out9q1) to just get the count of number of students who got <50 quiz1 from batch9
# Similar process for quiz2 below for batch9.
# -------------------- QUIZ 2 ------------------]
# Master list of all who attended Quiz2
q2 = pd.read_csv(q2path, usecols = ['Firstname', 'Grade/10.00', 'State'], na_values = ['-', 'In progress', np.NaN])
q2.dropna(inplace=True)
q2['Grade/10.00'] = q2['Grade/10.00'] * 10
# Merge B1 to Q2
q2b9 = pd.merge(b9, q2)
q2b9 = q2.loc[q2['Firstname'].isin(b9.Firstname)]
q2b9.reset_index(inplace=True)
q2b9.loc[(q2b9['Grade/10.00'] <= 50)].count()
lt50 = q2b9.loc[(q2b9['Grade/10.00'] < 50)]
out9q2 = (lt50['Grade/10.00'].count())
# print(out9q2)
上述代码针对所有在任一测验中得分低于 50 分的学生进行计算。我对batch4做了类似的事情。我需要复制此操作,以便一个函数可以对所有可用的剩余 (17-18) 批处理执行此操作。
最佳答案
在下面的代码中,我生成了所有 csv 路径并一一加载,然后执行所有过程,然后将结果数据帧保存在数据帧列表中,例如 [[batch1_q1_result,batch1_q2_result],[batch2_q1_result,batch2_q2_result] ...]
def doAll(baseBatchPath, numberOfBatches):
batchResultListAll = [] # this will store the resulted dataframes
spath = 'd:\\a2\\studentlist.csv'
q1path = 'd:\\a2\\quiz\\quiz1.csv'
q2path = 'd:\\a2\\quiz\\quiz2.csv'
tpath = 'd:\\a2\\testcasestudent.txt'
# the final dataframe that needs to be created and filled up eventually
idx = pd.MultiIndex.from_product([['batch1', 'batch2', 'batch3', 'batch4', 'batch9'], ['quiz1', 'quiz2']])
cols=['noofpresent', 'lesserthan50', 'between50and60', 'between60and70', 'between70and80', 'greaterthan80']
statdf = pd.DataFrame('-', idx, cols)
# Master list of all who attended Quiz1
q1 = pd.read_csv(q1path, usecols = ['Firstname', 'Grade/10.00', 'State'], na_values = ['-', 'In progress', np.NaN])
q1.dropna(inplace=True)
q1['Grade/10.00'] = q1['Grade/10.00'] * 10
# Master list of all who attended Quiz2
q2 = pd.read_csv(q2path, usecols = ['Firstname', 'Grade/10.00', 'State'], na_values = ['-', 'In progress', np.NaN])
q2.dropna(inplace=True)
q2['Grade/10.00'] = q2['Grade/10.00'] * 10
# generate each batch file path and do other works
for batchId in range(numberOfBatches-1):
batchCsvPath = baseBatchPath + str(batchId+1) + ".csv"
# Master list of students in Batch 9
batch = pd.read_csv(batchCsvPath, usecols=['studentName', 'admissionNumber'])
batch.rename(columns={'studentName' : 'Firstname'}, inplace=True)
# Merge eachBatch list of names to list of quiz1 on their firstname column
q1batch = pd.merge(batch, q1)
q1batch = q1.loc[q1['Firstname'].isin(batch.Firstname)] # checking if the name exits in either lists
q1batch.reset_index(inplace=True)
#print(q1batch)
lt50 = q1batch.loc[(q1batch['Grade/10.00'] < 50)]
#findout list of students whose grades are lesser than 50
outBatchq1 = (lt50['Grade/10.00'].count())
# print(outBatchq1) to just get the count of number of students who got <50 quiz1 from batch -> batchId
#do same for quiz 2
# Merge each Batch to Q2
q2batch = pd.merge(batch, q2)
q2batch = q2.loc[q2['Firstname'].isin(batch.Firstname)]
q2batch.reset_index(inplace=True)
q2batch.loc[(q2batch['Grade/10.00'] <= 50)].count()
lt50 = q2batch.loc[(q2batch['Grade/10.00'] < 50)]
outBatchq2 = (lt50['Grade/10.00'].count())
# print(outBatchq2)
# finally save the resulted DF for later use
batchResultListAll.append([q1batch, q2batch])
#call the function using base path and number of batch csv files
doAll("d:\\\\a2\\\\batchwiselist\\\\", 18)
关于python - 如何在 Python 中编写一个在 20 个不同的 csv 文件上运行该函数的函数?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/57430111/
我只想从客户端向服务器发送数组 adc_array=[w, x, y, z]。下面是客户端代码,而我的服务器是在只接受 json 的 python 中。编译代码时我没有收到任何错误,但收到 2 条警告
我是 lua 和 Node js 的新手,我正在尝试将我正在开发的移动应用程序连接到服务器。问题是它连接到服务器,但我尝试传递的数据丢失或无法到达服务器。对我正在做的事情有什么问题有什么想法吗? th
我在这个页面上工作 http://www.haskell.org/haskellwiki/99_questions/Solutions/4 我理解每个函数的含义,看到一个函数可以像这样以多种方式定义,
我目前正在尝试将数据写入 excel 以生成报告。我可以将数据写入 csv 文件,但它不会按照我想要的顺序出现在 excel 中。我需要数据在每列的最佳和最差适应性下打印,而不是全部打印在平均值下。这
所以,我正在做一个项目,现在我有一个问题,所以我想得到你的帮助:) 首先,我已经知道如何编写和读取 .txt 文件,但我想要的不仅仅是 x.hasNext()。 我想知道如何像 .ini 那样编写、读
我正在尝试编写一个函数,该函数将返回作为输入给出的任何数字的阶乘。现在,我的代码绝对是一团糟。请帮忙。 function factorialize(num) { for (var i=num, i
这个问题已经有答案了: Check variable equality against a list of values (16 个回答) 已关闭 4 年前。 有没有一种简洁或更好的方法来编写这个条件
我对 VR 完全陌生,正在 AFrame 中为一个类(class)项目开发 VR 太空射击游戏,并且想知道 AFrame 中是否有 TDD 的任何文档/标准。有人能指出我正确的方向吗? 最佳答案 几乎
我正在尝试创建一个 for 循环,它将重现以下功能代码块,但以一种更具吸引力的方式。这是与 Soundcould 小部件 API 实现一起使用的 here on stackoverflow $(doc
我有一个非常令人困惑的问题。我正在尝试更改属性文件中的属性,但它只是没有更改... 这是代码: package config; import java.io.FileNotFoundException
我对 VR 完全陌生,正在 AFrame 中为一个类(class)项目开发 VR 太空射击游戏,并且想知道 AFrame 中是否有 TDD 的任何文档/标准。有人能指出我正确的方向吗? 最佳答案 几乎
我正在开发一个用户模式(Ring3)代码级调试器。它还应支持.NET可执行文件的本机(x86)调试。基本上,我需要执行以下操作: 1).NET在隐身模式下加载某些模块,而没有LOAD_DLL_DEBU
我有一个列表,我知道有些项目是不必要打印的,我正在尝试通过 if 语句来做到这一点...但是它变得非常复杂,所以有没有什么方法可以在 if 语句中包含多个索引而无需打印重写整个声明。 看起来像这样的东
我很好奇以不同方式编写 if 语句是否会影响程序的速度和效率。所以,例如写一个这样的: bool isActive = true; bool isResponding = false; if (isA
我在搜索网站的源代码时找到了一种以另一种方式(我认为)编写 if 语句的方法。 代替: if(a)b; 或: a?b:''; 我读了: !a||b; 第三种方式和前两种方式一样吗?如果是,为什么我们要
我的数据采用以下格式(HashMap的列表) {TeamName=India, Name=Sachin, Score=170} {TeamName=India, Name=Sehwag, Score=
我目前正在完成 More JOIN operations sqlzoo 的教程,遇到了下面的代码作为#12 的答案: SELECT yr,COUNT(title) FROM movie JOIN ca
我正试图找到一种更好的方法来编写这段代码: def down_up(array, player) 7.downto(3).each do |row| 8.times do |col
出于某种原因,我的缓冲区中充满了乱码,我不确定为什么。我什至用十六进制编辑器检查了我的文件,以验证我的字符是否以 2 字节的 unicode 格式保存。我不确定出了什么问题。 [打开文件] fseek
阅读编码恐怖片时,我刚刚又遇到了 FizzBuzz。 原帖在这里:Coding Horror: Why Can't Programmers.. Program? 对于那些不知道的人:FizzBu
我是一名优秀的程序员,十分优秀!