git - 仅在两次提交之间从 Git 历史记录中删除文件-6ren

git - 仅在两次提交之间从 Git 历史记录中删除文件

转载作者：太空狗更新时间：2023-10-29 14:20:29

26

4

我正在尝试使用 filter-branch 从我的历史记录中删除一些大文件.我以前成功地使用过这个命令，但我目前在处理特定的边缘情况时遇到了麻烦。

问题是这些大文件从未真正删除，而是被具有相同路径的较小版本替换。

据我所知，我相信我有一个独特的问题。

Git 日志

为了详细说明，这里是我的存储库的基本表示:

----- A ------ B ----------- HEAD

哪里:

A is the commit where the large files were introduced
B is the commit (about 30 later) where the large files were replaced with smaller ones
HEAD is thousands of commits forward of B (~2 years of active development)

Git 过滤分支

理论上，我应该能够做这样的事情:

git filter-branch --index-filter 'git rm --cached --ignore-unmatch filenames' <parent of A>..B

我相信我应该使用 <parent of A>因为filter-branch不包括在内。 (我不确定我是否还需要使用 B 的父级，但这是我现在最不担心的事情)。

运行这个给我错误:

$ git filter-branch --index-filter 'git rm --cached --ignore-unmatch filenames' <parent of A>..B 
Which ref do you want to rewrite?

所以我包括了--glob="refs/heads/master*"在似乎可以解决问题的命令末尾 ( source )。

执行完成后，文件已被完全删除 - 似乎 git 忽略了我指定的上限。

所以我想知道这种方法是否可行？

替代方法

我认为我应该列出一些其他的想法，以便可以将潜在的答案集中在解决问题上。

实用的方法是在 HEAD 处提交文件名更改，然后运行 git filter-branch ... HEAD .但是，我的存储库中有许多分支正在积极开发中，我相信这种方法会非常困惑。
另一种方法可能是做类似 here 中描述的事情.引用:create a temporary branch to point at HEAD^, filter-branch it, then add a graft to stitch the remaining commit on top of it, then filter-branch HEAD and then remove the graft.

希望有人以前遇到过这个问题并可以提供他们的专业知识。

更新

我要删除的文件总计 ~500MB 所以我非常想删除它们，这是可以理解的!在我加入公司很久之前，它们就已经投入使用，并且是我们从内部 Mercurial 服务器迁移到 GitHub 的残余(我想将 500MB 推送到内部服务器不会像 GitHub 那样引人注目...)。

更新2

我一直在关注 twalberg 的第二个答案(我认为我以正确的方式使用它):

git filter-branch --index-filter '(( $(git rev-list <SHA-of-child-of-B> --not $GIT_COMMIT | wc -l) > 0 )) && git rm --cached --ignore-unmatch <filenames>'

这会产生我期望的那种输出:

...
Rewrite dc8a4b29463bfa43c2f3efe0c6e5a29a5cc6e0ef (1071/5680)rm 'file1'
rm 'file2'
rm 'file3'
rm 'file4'
...

在(预期的？)错误结束之前:

Rewrite e6b712b57257e2edd0bb9fbbac59e4c9d7b5aa79 (1072/5680)index filter failed: (( $(git rev-list e6b712b --not $GIT_COMMIT | wc -l) > 0 )) && git rm -rf --ignore-unmatch <filename>

在哪里e6b712b是 B 的 child .

此时我假设一切正常，所以我对我的存储库进行本地文件系统克隆来测试它:

git clone file://<repo> <new repo>

对象的数量和包文件的大小减少了非常小的数量——我不确定为什么。通过运行 git count-objects -v针对原始存储库与具有 filter-branch 的存储库反对它:

原始存储库:

count: 0
size: 0
in-pack: 106640
packs: 1
size-pack: 815512
prune-packable: 0
garbage: 0

filter-branch ed 和文件系统克隆存储库:

count: 0
size: 0
in-pack: 96165
packs: 1
size-pack: 793656
prune-packable: 0
garbage: 0

我真的不确定为什么这仍然不起作用 - 也许我没有正确遵循建议的答案？

最佳答案

不幸的是，如果你真的想从你的存储库中删除这些对象(与简单地从当前和 future 的修订中删除它们相比)，filter-branch 是这样做的方法，如果你是要重写提交 A，每个提交到每个分支头的在其历史中包含 A 的每个提交也必须重写，因为提交的提交哈希取决于提交该提交的每个父级的哈希值。如果您不重写包含 A 的所有分支，那么这些对象仍然是您可访问历史记录中某些提交的合法部分，并且它们不会被修剪。

对于在其历史中包含 A 的每个分支 BR，这应该有效:

git filter-branch --index-filter 'git rm --cached --ignore-unmatch filenames' BR --not A~1

将从 A 重写(通过修剪 A 父级的分支)到分支 BR 的当前尖端。不过，它会从所有这些提交中删除文件，即使它们已被较新的较小版本替换。为了仅在提交 B 之前删除它们，您可以像这样扩展过滤器脚本:

... --index-filter '(( $(git rev-list <SHA-of-child-of-B> --not $GIT_COMMIT | wc -l) > 0 )) && git rm ...' ...

这使用 rev-list 列出当前正在重写的提交之后的所有修订，直到 B 的子级，计算这些行，并且只执行 git rm如果一个或多个修订落在该范围内(当 $GIT_COMMIT == B 时，将打印一行 - 因此需要使用 B 的子项)。

即使对于单个分支来说，这也是一个相当大的变化，如果你有很多分支是在 A 或之后产生的，那么你需要做很多工作，所以你必须决定它是否最终值得它，或者如果您只需要一个更大的磁盘(您没有明确提到这些文件有多大)。

关于git - 仅在两次提交之间从 Git 历史记录中删除文件，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/14837241/

26

4

0

文章推荐： javascript - 开发者工具查看一个脚本下载两次是否正常

文章推荐： git - 给定“ :/ with Jenkins时是否可以克隆git repo

文章推荐： javascript - 从 HTML 调用 babel 脚本中定义的 js 函数

iPhone:删除/删除 SQLite 数据库？
我知道如何通过iPhone开发创建sqlite数据库、向其中插入数据、删除行等，但我试图以编程方式删除整个数据库本身，但没有得到任何帮助。请有人指导我如何通过代码从设备中删除/删除整个 sqlite
teradata - 删除/删除 Teradata 中的数据库
请帮助指导如何在 Teradata 中删除数据库。当我运行命令DROP DATABASE database_name时，我收到错误消息: *** Failure 3552 Cannot DROP d
azure - 删除/删除 Azure 警报规则
Azure 警报规则的删除命令似乎不起作用，尝试了下面的方法，它返回状态为无内容，并且警报未被删除使用的命令Remove-AzAlertRule -ResourceGroup "RGName"-Na
elasticsearch - Elasticsearch 数据丢失/删除/删除
我在 flex 搜索中为大约50000个视频建立了索引，但是当它达到52000左右时，所有数据都被删除。嗯，这对我来说真的很奇怪，我没有为ES设置任何Heap大小或最小或最大大小的内存大小，因此它们没
python - Django:删除/删除 slug
我正在处理的问题是表单错误“输入由字母、数字、下划线或连字符组成的有效‘slug’。” 以下是我的表单字段验证: def clean_slug(self): slug = self.c
jQuery 删除 : $ ("..."). 删除() 与 .remove ("...")
阅读文档，我希望 $("#wrap2").remove(".error") 从中删除所有 .error 元素#wrap2。然而看看这个 JSFiddle: http://jsfiddle.net/h
php - 删除/删除 laravel 项目
嗨，我第一次尝试发现 laravel 我从 laravel 4.2 开始，我刚刚创建了一个新项目，但我误以为我写了这样的命令行 composer create-project laravel/lara
Apache 2.4 - 删除 |删除 |卸载
我已经在网上搜索了很长一段时间，但我找不到如何完全删除 apache 2.4 。使用: Windows 7 c:\apache24\ 我已经尝试了所有命令，但没有任何效果。 httpd -k shu
python - 删除/删除 pandas DataFrame 中任意列中具有特定字符串的行
可能是一个简单的答案，所以提前道歉(最少的编码经验)。我正在尝试从任何列中删除具有特定字符串(经济 7)的任何行，并且一直在尝试离开此线程: How to drop rows from pandas
c++ - 删除/删除 vector 项的最有效/最快的方法
有几种方法可以删除/移除 vector 中的项目。我有一个指针 vector ，我需要在类的析构函数中删除所有指针。什么是最有效/最快甚至最安全的方式？ // 1º std::for_each(v
linux - 删除 xinetd 导致 plesk 删除
我安装了一个 VNC 服务器并在某处阅读了我必须安装 xinetd 的信息。稍后我决定删除 VNC 服务器，所以我也删除了 xinetd。似乎 xinetd 删除了一些与 plesk 相关的文件，如果
android - 如何完全杀死/删除/删除/停止 AsyncTask
我制作了一个从我们的服务器下载视频的应用。问题是: 当我取消下载时，我打电话: myAsyncTask.cancel(true) 我注意到，myAsyncTask 并没有在调用取消时停止...我的 P
machine-learning - 删除/删除 Vertica 中的机器学习模型(如果存在)
是否可以在使用DELETE_MODEL删除模型之前检查模型是否存在我试图避免在尝试删除尚未创建的模型时收到错误消息。基本上我正在寻找对应的: DROP TABLE IF EXISTS 但对于模型。最
php - 如何使用 php 删除/删除 mySQL 中的特定表行？
我已经有了这个代码: 但它仍然会生成一个表行条目。我想做的是，当输入的数量为0时，表行将被删除。请耐心等待，因为我是 php 和 mySQL 编码新手。最佳答案您忘记执行查询。应该是 $que
c# - 删除 EWS 中的 Exchange 事件修改/删除(即恢复事件)
在 SharePoint 中，如果您删除/修改重复日历条目的单次出现，则不会真正删除/修改任何内容 - 相反，会创建一个新条目，告诉 SP 对于特定日期，该事件不存在或具有新参数. 因此，这可以通过删
javascript - Laravel 5.2 & Dropzone.js - 删除(删除)上传的图片
在 routes.php 中我有以下路由: Route::post('dropzone', ['as' => 'dropzone.upload', 'uses' => 'AdminPhotoContr
Node.JS app.get 错误..无法获取/删除/删除/15
在我的应用程序中，我正在尝试删除产品。当我第一次删除产品时，它会成功并且 URL 更改为/remove_category/15。我正在渲染到同一页面。现在，当我尝试删除另一个产品时，网址更改为/rem
bash - 匹配后如何使用 BSD/OS X sed 删除/删除 X 行
这个问题被问了很多次，但给出的答案都是 GNU sed 特定的。 sed -i '' "/${FIND}/,+2d""$FILE" 给出“预期的上下文地址”错误。有人可以给我一个例子，说明如何使用
javascript - Google Maps JavaScript API V3 - 卸载/解构/删除/删除
在使用 V3 API 时，我找不到任何方法来删除和清理 Google map 。我已经在 AJAX 站点中运行它，所以我想完全关闭它而无需重新加载页面。我希望有一个 .unload() 或 .de
sql-server - 如何创建一个可以创建/更改/删除 View 但不能表、可以读取数据但不能插入/更新/删除/截断数据的 Azure SQL 数据库用户？
是否可以创建一个 Azure SQL 数据库用户来执行以下操作: 针对所有表和 View 进行 SELECT 创建/更改/删除 View 但用户不应该不拥有以下权限: 针对任何表或 View 插入/更

首页

博学

6Ren·AI

商城