tensorflow - 使用机器学习或深度学习在给出节点到节点映射的情况下预测两个节点之间的链接概率-6ren

tensorflow - 使用机器学习或深度学习在给出节点到节点映射的情况下预测两个节点之间的链接概率

转载作者：行者123 更新时间：2023-12-04 06:29:57

26

4

有人可以指导我看一个教程，为下面给出的问题提供一个初步的想法。

我有一个作者到共同作者的映射，如下所示:

mapping
>>
{0: [2860, 3117],
 1: [318, 1610, 1776, 1865, 2283, 2507, 3076, 3108, 3182, 3357, 3675, 4040],
 2: [164, 413, 1448, 1650, 3119, 3238],
} # this is just sample


link_attributes.iloc[:5,:7]
>>

first   id  keyword_0   keyword_10  keyword_13  keyword_15  keyword_2
0        4      0        1.0             1.0    1.0         1.0
1        9      1        1.0             1.0    1.0         1.0
2        7      2        1.0             NaN    1.0         1.0
3        6      3        1.0             1.0    NaN         1.0
4        9      4        1.0             1.0    1.0         1.0

我必须预测在 Source 和 Sink 之间建立链接的概率

例如，如果我得到一个 Source=13 和 Sink=31，那么我必须找到在 13 和 31 之间建立链接的概率。所有链接是无向的。

最佳答案

import json
import numpy
from keras import Sequential
from keras.layers import Dense

def get_keys(data, keys):  # get all keys from json file
    if isinstance(data, list):
        for item in data:
            get_keys(item, keys)
    if isinstance(data, dict):
        sub_keys = data.keys()
        for sub_key in sub_keys:
            keys.append(sub_key)

# get all keys, each key is a feature of instances
json_data = open("nodes.json")  # read 4016 instances
jdata = json.load(json_data)
keys = []
get_keys(jdata, keys)
keys = set(keys)
print(set(keys))

def build_instance(json_object):  # use to build instance from json object, ex: instance = [f0,f1,f2,f3,....f404]
    features = []
    features.append(json_object.get('id'))
    for key in keys:
        value = json_object.get(key)
        if value is None:
            value = 0
        elif key == 'id':
            continue
        features.append(value)
    return features

# read all instances and format them, each instance will be [f0,f1, f2,...], as i read from json file, each instance will have 405 features
instances = []
num_of_instances = 0
for item in jdata:
    features = build_instance(item)
    instances.append(features)
    num_of_instances = num_of_instances + 1
    print(num_of_instances)

# read "author_id - co author ids" file
traintxt = open('train.txt', 'r')
lines = traintxt.readlines()

au_vs_co_auth_list = []
for line in lines:
    line = line.split('\t', 200)
    print(line)
    # convert value from string to int
    string = line[0]  # example line[0] = '14 445'
    id_vs_coauthor = string.split(" ", 200)
    id = id_vs_coauthor[0]
    co_author = id_vs_coauthor[1]

    line[0:1] = [int(id), int(co_author)]
    for i in range(2, len(line)):
        line[i] = int(line[i])
    au_vs_co_auth_list.append(line)

print(len(au_vs_co_auth_list))  # we have 4016 authors

X_train = []
Y_train = []
generated_train_pairs = []
train_num = 30000  # choose 30000 random training instances
for i in range(train_num):
    print(i)
    index1 = numpy.random.randint(0, len(au_vs_co_auth_list), 1)[0]
    co_authors_of_index1 = au_vs_co_auth_list[index1]
    author_id_of_index_1 = au_vs_co_auth_list[index1][0]

    if index1 % 2 == 0:  # try to create a sample that two author is not related
        index2 = numpy.random.randint(0, len(au_vs_co_auth_list), 1)[0]
        author_id_of_index_2 = au_vs_co_auth_list[index2][0]

        # make sure id1 != id2 and auth 1 and auth2 are not related
        while (index1 == index2) or (author_id_of_index_2 in co_authors_of_index1):
            index2 = numpy.random.randint(0, len(au_vs_co_auth_list), 1)[0]
            author_id_of_index_2 = au_vs_co_auth_list[index2][0]
        y = [0, 1]  # [relative=FALSE,non-related = TRUE]
    else:  # try to create a sample that two author is related
        author_id_of_index_2 = numpy.random.randint(1, len(co_authors_of_index1),size=1)[0]
        y = [1, 0]  # [relative=TRUE,non-related = FALSE]

    x = instances[author_id_of_index_1][1:] + instances[author_id_of_index_2][
                                              1:]  # x = [feature1, feature2,...feature404',feature1', feature2',...feature404']
    X_train.append(x)
    Y_train.append(y)
X_train = numpy.asarray(X_train)
Y_train = numpy.asarray(Y_train)
print(X_train.shape)
print(Y_train.shape)

# now we have x_train, y_train, build model right now
model = Sequential()
model.add(Dense(512, input_shape=X_train[0].shape, activation='relu'))
model.add(Dense(128, activation='relu'))
model.add(Dense(32, activation='relu'))
model.add(Dense(8, activation='relu'))
model.add(Dense(2, activation='sigmoid'))
model.compile(loss='categorical_crossentropy', optimizer='adam', metrics=['accuracy'])
model.fit(X_train, Y_train, batch_size=512, epochs=3, verbose=2)
model.save("model.h5")
# now to predict probability of linking between two author ids

id1 = 11  # just random
id2 = 732  # just random

author1 = None
author2 = None
for item in jdata:
    if item.get('id') == id1:
        author1 = build_instance(item)
    if item.get('id') == id2:
        author2 = build_instance(item)
    if author1 is not None and author2 is not None:
        break

x_test = author1[1:] + author2[1:]
x_test = numpy.expand_dims(numpy.asarray(x_test), axis=0)
probability = model.predict(x_test)

print("author id ", id1, " and author id ", id2, end=" ")
if probability[0][1] > probability[0][0]:
    print("Not related")
else:
    print("Related")
print(probability)

输出:

author id  11  and author id  732 related

关于tensorflow - 使用机器学习或深度学习在给出节点到节点映射的情况下预测两个节点之间的链接概率，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/61074729/

26

4

0

文章推荐： ruby-on-rails - Cucumber + webrat + selenium，如何忽略隐藏文本？

文章推荐： nservicebus - 使用 IHandleMessages 的一些困惑

文章推荐： linq - 使用具有外键的 EntityCollection 初始化 List

文章推荐： ruby-on-rails - Rails - 500 内部服务器错误

c# - 学习 C# 有助于或阻碍 VB.NET 学习
关闭。这个问题是opinion-based .它目前不接受答案。想要改进这个问题？更新问题，以便 editing this post 可以用事实和引用来回答它. 关闭 9 年前。 Improve
学习.NET8MiniApis入门
介绍篇什么是MiniApis？ MiniApis的特点和优势 MiniApis的应用场景环境搭建系统要求安装MiniApis 配置开发环境基础概念 MiniApis架构概述
Javascript(学习)
我正在从“JavaScript 圣经”一书中学习 javascript，但我遇到了一些困难。我试图理解这段代码: function checkIt(evt) { evt = (evt) ? e
String.intern() 学习
package com.fastone.www.javademo.stringintern; /** * * String.intern()是一个Native方法， * 它的作用是：如果字
macos - 学习 AppleScript
您会推荐哪些资源来学习 AppleScript。我使用具有 Objective-C 背景的传统 C/C++。我也在寻找有关如何更好地开发和从脚本编辑器获取更快文档的技巧。示例提示是“查找要编写脚本的
java - 学习 OpenCMS
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。想改善这个问题吗？更新问题，使其成为 on-topic对于堆栈溢出。 4年前关闭。 Improve thi
extjs - 学习 ExtJS4
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。想改善这个问题吗？更新问题，使其成为 on-topic对于堆栈溢出。 7年前关闭。 Improve thi
f# - 学习 F#
关闭。这个问题不符合 Stack Overflow guidelines 。它目前不接受答案。想改善这个问题吗？更新问题，以便堆栈溢出为 on-topic。 6年前关闭。 Improve this
flutter - 学习 flutter
我是塞内加尔的阿里。我今年60岁(也许这是我真正的问题-笑脸!!!)。我正在学习Flutter和Dart。今天，我想使用给定数据模型的列表(它的名称是Mortalite，请参见下面的代码)。我尝试
powershell - 学习……真的什么都行
关闭。这个问题是off-topic .它目前不接受答案。想改进这个问题？ Update the question所以它是on-topic对于堆栈溢出。 9年前关闭。 Improve this que
cappuccino - 学习 Cappuccino
学习 Cappuccino 的最佳来源是什么？我从事“传统”网络开发，但我对这个新框架非常感兴趣。请注意，我对 Objective-C 毫无了解。最佳答案如上所述，该网站是一个好地方，但还有一些其
java - 学习 HashMap
我正在学习如何使用 hashMap，有人可以检查我编写的这段代码并告诉我它是否正确吗？这个想法是有一个在公司工作的员工列表，我想从 hashMap 添加和删除员工。 public class Staf
jQuery CoffeeScript - 学习
我正在尝试将 jQuery 与 CoffeScript 一起使用。我按照博客中的说明操作，指示使用 $ -> 或 jQuery -> 而不是 .ready() 。我玩了一下代码，但我似乎无法理解我出错
javascript - PHP传递参数给新的字符串(学习)
还在学习，还有很多问题，所以这里有一些。我正在进行 javascript -> PHP 转换，并希望确保这些做法是正确的。是$dailyparams->$calories = $calories;一条
MySQL 使用临时表(学习)
我目前正在学习 SQL，以便从我们的 Magento 数据库制作一个简单的 RFM 报告，我目前可以通过导出两个查询并将它们粘贴到 Excel 模板中来完成此操作，我想摆脱 Excel 模板。我认为
Javascript > PHP (学习)
我知道我很可能会因为这个问题而受到抨击，但没有人问，我求助于你。这是否是一个正确的 javascript > php 转换 - 在我开始不良做法之前，我想知道这是否是解决此问题的正确方法。 JavaS
ruby - 学习/平铺的资源
除了 Ruby-Doc 之外，哪些来源最适合获取一些示例和教程，尤其是关于 Ruby 中的 Tk/Tile？我发现自己更正常了 http://www.tutorialspoint.com/ruby/r
Python 学习。为什么我只在第一次收到警告？
我只在第一次收到警告。这正常吗？ >>> cv=LassoCV(cv=10).fit(x,y) C:\Python27\lib\site-packages\scikit_learn-0.14.1-py
java - 学习/复习Java
按照目前的情况，这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持，但这个问题可能会引发辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开，visit the
c# - 学习.NET
As it currently stands, this question is not a good fit for our Q&A format. We expect answers to be

首页

博学

6Ren·AI

商城

tensorflow - 使用机器学习或深度学习在给出节点到节点映射的情况下预测两个节点之间的链接概率