- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个非常大的表,来自通过 Google Cloud Storage 进行的大查询。
表中的字段之一是邮政编码 (00000)。
无论如何,是否可以通过邮政编码查询表,并将结果导出到文件,以邮政编码作为文件名。每个文件都会有该邮政编码的记录。
这可以做到吗?
最佳答案
这是一个 Python 解决方案,我没有使用 BigQuery 导出。最终结果仍以换行符分隔的 json 文件形式保存在存储中(以便随后可以加载回 BigQuery)。它涉及一个查询,但对于非常大的表来说可能会变得昂贵。我使用一个包含一个 ZipCode 列和另外两列(col1、col2)的表作为示例,但这应该不重要。另外,我对身份验证部分进行了硬编码。
#!/usr/bin/python
from argparse import ArgumentParser
from google.cloud import bigquery
from google.cloud import storage
def main(project_id, dataset_id, table_id, bucket_name):
client = bigquery.Client.from_service_account_json('service_account.json',project=project_id)
dataset = client.dataset(dataset_id)
# Create a table for intermediate results
table_ref = client.dataset(dataset_id).table('tmp')
# Query job with 'tmp' as destination
# Group by non grouped/aggregated field ZipCode using ARRAY_AGG
job_config = bigquery.QueryJobConfig()
job_config.destination = table_ref
sql = 'SELECT ZipCode, ARRAY_AGG(STRUCT(col1, col2)) FROM `{}.{}.{}` GROUP BY ZipCode'.format(project_id, dataset_id, table_id)
query_job = client.query(
sql,
location='US',
job_config=job_config)
query_job.result()
storage_client = storage.Client()
bucket = storage_client.get_bucket(bucket_name)
rows = client.list_rows(client.get_table(table_ref))
for row in rows:
record=''
# Rest of row is a list of dictionaries with unicode items
for r in row[1:][0]:
r = {str(k):str(v) for k,v in r.items()}
record+=(str(r))+'\n'
# row[0] will have ZipCode which we want to use to name the exported files
filename=row[0]+'.json'
blob = bucket.blob(filename)
print 'Exporting to gs://{}/{}'.format(bucket_name,filename)
blob.upload_from_string(record)
# Delete the tmp table
client.delete_table(table_ref)
if __name__ == '__main__':
parser = ArgumentParser()
parser.add_argument('-p','--project', help="project where the ZipCode table resides", dest='project_id')
parser.add_argument('-d','--dataset', help="dataset with the ZipCode table", dest='dataset_id')
parser.add_argument('-t','--table', help="ZipCode table", dest='table_id')
parser.add_argument('-b','--bucket', help="destination bucket", dest='bucket')
args = parser.parse_args()
main(args.project_id,args.dataset_id,args.table_id,args.bucket)
关于python - 如何将表导出到以字段值作为文件名而不是部分的文件中,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/52371766/
是否可以调整此代码以导出foreach循环外的所有行: 这工作正常(内部循环): $vms = Get-VM | Where { $_.State –eq ‘Running’ } | Select-
我试图将我的 bundle.js 引入我的 Node 服务器,但显然 webpack 包在顶部的所有包代码之前缺少一个 module.exports =。 我可以手动将 module.exports
我有一个 android 项目,其中包含一个库项目。在这个库项目中,我包含了许多可绘制对象和动画。 问题是,当我将主项目导出为 .apk 时,它包括所有可绘制对象和动画,甚至是主项目中未使用的对象。
我的一个 mysql 用户以这种方式耗尽了他的生产数据库: 他将所有数据导出到转储文件,然后删除所有内容,然后将数据导入回数据库。他从 Innodb 大表空间中保存了一些 Gig(我不知道他为什么这样
我正在 pimcore 中创建一个新站点。有没有办法导出/导入 pimcore 站点的完整数据,以便我可以导出 xml/csv 格式的 pimcore 数据进行必要的更改,然后将其导入回来? 最佳答案
我有以下静态函数: static inline HandVal StdDeck_StdRules_EVAL_N( StdDeck_CardMask cards, int n
因为我更新了 angular cli 和 nestjs 版本,所以我收到了数百条警告,提示我无法找到我的自定义类型定义和接口(interface)。但是我的nestjs api仍然可以正常工作。 我正
Eclipse 的搜索结果 View 以其树状结构非常方便。有没有办法将这些结果导出为可读的文本格式或将它们保存到文件中以备后用? 我试过使用复制和粘贴,但生成的文本格式远不可读。 最佳答案 不,我认
我想在用户在 Chrome 中打开页面时使用 WebP否则它应该是 png。 我找到了这段代码: var isChrome = !!window.chrome && !!window.chrome.w
您好,我正在尝试根据“上次登录”导出 AD 用户列表 我已经使用基本 powershell 编写了脚本,但是如果有人可以使用“AzureAD 到 Powershell” 命令找到解决方案,我会很感兴趣
有没有办法启用 Stockchart 的导出?我知道这对于普通图表是可行的,但对于股票图表,当尝试启用导出模式时,我得到了未定义, 我尝试过:chart.export.enabled=true;和ch
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。 要求我们推荐或查找工具、库或最喜欢的场外资源的问题对于 Stack Overflow 来说是偏离主题的,因为
我正在尝试学习如何使用命令行将数据导入/导出到 Oracle。根据我的发现,看起来我应该使用 sqlldr.exe 文件来导入和导出,但我不确定除了 userid 之外还需要什么参数。谁能给我解释一下
您好,我正在尝试根据“上次登录”导出 AD 用户列表 我已经使用基本 powershell 编写了脚本,但是如果有人可以使用“AzureAD 到 Powershell” 命令找到解决方案,我会很感兴趣
我想生成一个 PDF,它将以表格格式显示查询集的输出,例如: query = ModelA.objects.filter(p_id=100) class ModelA(models.Model):
我有一个数据库代理,可以从 IBM Notes 数据生成 Word 文档。我正在使用 Java2Word API 来实现此目的,但不幸的是,该 API 几乎没有文档,而且我找不到任何有关表格格式(大小
我尝试将 Java 程序从 Eclipse 导出到 .jar 文件,但遇到了问题。它运行良好,但由于某种原因它没有找到它应该从中获取数据的文本文件。如果有人能帮忙解决这个问题,我将非常感激。 最佳答案
我正在尝试学习如何使用命令行将数据导入/导出到 Oracle。根据我的发现,看起来我应该使用 sqlldr.exe 文件来导入和导出,但我不确定除了 userid 之外还需要什么参数。谁能给我解释一下
使用LLVM / Clang编译到WebAssembly的默认代码生成将导出内存,并完全忽略表。 使用clang(--target=wasm32-unknown-unknown-wasm)定位Web组
我正在尝试在 HSQL 数据库中重新创建一个 oracle 数据库。 这是为了在本地开发人员系统上进行更好的单元测试。 我需要知道的是,是否有任何我可以在 oracle 服务器/客户端中使用的工具/命
我是一名优秀的程序员,十分优秀!