- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个列表列表:
[['suzy', 'joe', ...], ['suzy', 'tom', ...], ['paul', 'kristy', ...], [ “克里斯蒂”、“格里芬”、...]、...]
我想要的输出是将这些对聚类成两个列表:
['suzy', 'joe', 'tom']
['paul', 'kristy', 'griffin']
我读了this post那有一个类似的问题,但是用 networkx
回答了。但是,我正在避免使用 networkx
,并且一直在努力做到这一点。
我试着用一个名字创建一个字典,如果它们是一对的话,然后附加其他名字,但它变得越来越乱。感谢您的帮助!
最佳答案
您提到的 networkx
解决方案创建了一个无向图,其中节点是名称,边是观察到的配对。这些集群然后是 connected components图形的一部分,您可以使用图形遍历算法(例如 DFS、BFS)读取它。
所以,你有两个选择:
构建您自己的图形实现,不使用 networkx
,执行上述操作。我刚才描述的不是您只能使用 networkx
完成的事情。
使用 disjoint sets data structure生成分组。顾名思义,我们维护一组不相交的集合(其中一个集合代表一群人)。每当我们看到一对时,我们就会合并这对中的两个人最初所属的集群。下面给出了 union-find 的实现及其对您所描述问题的应用:
# Union-find by size.
def find(data, target):
if data[target] < 0:
return target
data[target] = find(data, data[target])
return data[target]
def union(data, first, second):
first_root, second_root = find(data, first), find(data, second)
if first_root == second_root:
return False
elif first_root < second_root:
data[first_root] += data[second_root]
data[second_root] = first_root
return True
else:
data[second_root] += data[first_root]
data[first_root] = second_root
return True
data = [['suzy', 'joe'], ['suzy', 'tom'], ['paul', 'kristy'], ['kristy', 'griffin']]
# Extract list of names from data.
name_set = set()
for pair in data:
name_set.add(pair[0])
name_set.add(pair[1])
name_list = list(name_set)
name_table = {name: index for index, name in enumerate(name_list)}
# Find disjoint sets.
disjoint_sets = [-1] * len(name_table)
for pair in data:
union(disjoint_sets, name_table[pair[0]], name_table[pair[1]])
# Read off disjoint sets into lists.
result = {}
for name in name_table:
set_id = find(disjoint_sets, name_table[name])
if set_id not in result:
result[set_id] = []
result[set_id].append(name)
print(list(result.values()))
关于python - 如何在没有 networkx 的情况下对对进行聚类,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/70660355/
我是 Java 新手,这是我的代码, if( a.name == b.name && a.displayname == b.displayname && a.linknam
在下面的场景中,我有一个 bool 值。根据结果,我调用完全相同的函数,唯一的区别是参数的数量。 var myBoolean = ... if (myBoolean) { retrieve
我是一名研究 C++ 的 C 开发人员: 我是否正确理解如果我抛出异常然后堆栈将展开直到找到第一个异常处理程序?是否可以在不展开的情况下在任何 throw 上打开调试器(即不离开声明它的范围或任何更高
在修复庞大代码库中的错误时,我观察到一个奇怪的情况,其中引用的动态类型从原始 Derived 类型更改为 Base 类型!我提供了最少的代码来解释问题: struct Base { // some
我正在尝试用 C# 扩展给定的代码,但由于缺乏编程经验,我有点陷入困境。 使用 Visual Studio 社区,我尝试通过控制台读出 CPU 核心温度。该代码使用开关/外壳来查找传感器的特定名称(即
这可能是一个哲学问题。 假设您正在向页面发出 AJAX 请求(这是使用 Prototype): new Ajax.Request('target.asp', { method:"post", pa
我有以下 HTML 代码,我无法在所有浏览器中正常工作: 我试图在移动到
我对 Swift 很陌生。我如何从 addPin 函数中检索注释并能够在我的 addLocation 操作 (buttonPressed) 中使用它。我正在尝试使用压力触摸在 map 上添加图钉,在两
我设置了一个详细 View ,我是否有几个 Nib 文件根据在 Root View Controller 的表中选择的项目来加载。 我发现,对于 Nibs 的类,永远不会调用 viewDidUnloa
我需要动态访问 json 文件并使用以下代码。在本例中,“bpicsel”和“temp”是变量。最终结果类似于“data[0].extit1” var title="data["+bpicsel+"]
我需要使用第三方 WCF 服务。我已经在我的证书存储中配置了所需的证书,但是在调用 WCF 服务时出现以下异常。 向 https://XXXX.com/AHSharedServices/Custome
在几个 SO 答案(1、2)中,建议如果存在冲突则不应触发 INSERT 触发器,ON CONFLICT DO NOTHING 在触发语句中。也许我理解错了,但在我的实验中似乎并非如此。 这是我的 S
如果进行修改,则会给出org.hibernate.NonUniqueObjectException。在我的 BidderBO 类(class)中 @Override @Transactional(pr
我使用 indexOf() 方法来精细地查找数组中的对象。 直到此刻我查了一些资料,发现代码应该无法正常工作。 我在reducer中尝试了上面的代码,它成功了 let tmp = state.find
假设我有以下表格: CREATE TABLE Game ( GameID INT UNSIGNED NOT NULL, GameType TINYINT UNSIGNED NOT NU
代码: Alamofire.request(URL(string: imageUrl)!).downloadProgress(closure: { (progress) in
我是一名优秀的程序员,十分优秀!