展开菜单
首页 精品内容 本月促销 装机必备 Windows macOS软件 IOS软件 Android AI PDF教程 专题
全部分类

当前位置:

首页 > 编程开发 > 非加权图在推荐系统中的建模方法

非加权图在推荐系统中的建模方法

本文详细阐述如何在Java中为推荐系统构建非加权图,以有效管理和识别用户间的复杂关系,如“密切联系人”。文章从数据读取和存储入手,逐步指导如何将人员信息转化为图的节点,并基于共享属性(社区、学校、雇主)定义边,最终形成邻接列表表示的图结构,并整合隐私设置,为后续的推荐逻辑奠定基础。

构建Java推荐系统中的非加权图及关系建模

本文详细阐述如何在Java中为推荐系统构建非加权图,以有效管理和识别用户间的复杂关系,如“密切联系人”。文章从数据读取和存储入手,逐步指导如何将人员信息转化为图的节点,并基于共享属性(社区、学校、雇主)定义边,最终形成邻接列表表示的图结构,并整合隐私设置,为后续的推荐逻辑奠定基础。

在构建推荐系统时,有效地表示和管理实体之间的关系至关重要。对于需要基于“密切联系人”概念进行推荐的场景,图数据结构提供了一种直观且强大的建模方式。本文将指导您如何在Java中,从原始文件数据出发,构建一个非加权图来表示人员之间的关系,并集成隐私设置。

1. 数据模型定义

首先,我们需要定义用于存储人员和活动信息的Java类。这些类将作为图的节点和相关属性的载体。

import java.util.Objects;

// Person 类用于存储人员信息
public class Person {
    private String firstname;
    private String lastname;
    private String phone;
    private String email;
    private String community;
    private String school;
    private String employer;
    private String privacy; // "Y" 表示请求隐私,"N" 表示不请求

    // 构造函数
    public Person() {}

    // Getters and Setters
    public String getFirstname() { return firstname; }
    public void setFirstname(String firstname) { this.firstname = firstname; }
    public String getLastname() { return lastname; }
    public void setLastname(String lastname) { this.lastname = lastname; }
    public String getPhone() { return phone; }
    public void setPhone(String phone) { this.phone = phone; }
    public String getEmail() { return email; }
    public void setEmail(String email) { this.email = email; }
    public String getCommunity() { return community; }
    public void setCommunity(String community) { this.community = community; }
    public String getSchool() { return school; }
    public void setSchool(String school) { this.school = school; }
    public String getEmployer() { return employer; }
    public void setEmployer(String employer) { this.employer = employer; }
    public String getPrivacy() { return privacy; }
    public void setPrivacy(String privacy) { this.privacy = privacy; }

    // 判断是否请求隐私
    public boolean requestsPrivacy() {
        return "Y".equalsIgnoreCase(privacy);
    }

    // 重写 equals 和 hashCode 方法,确保在集合(如Map的键)中正确识别Person对象
    @Override
    public boolean equals(Object o) {
        if (this == o) return true;
        if (o == null || getClass() != o.getClass()) return false;
        Person person = (Person) o;
        return Objects.equals(firstname, person.firstname) &&
               Objects.equals(lastname, person.lastname) &&
               Objects.equals(email, person.email); // 假设 firstname, lastname, email 组合唯一标识一个人
    }

    @Override
    public int hashCode() {
        return Objects.hash(firstname, lastname, email);
    }

    @Override
    public String toString() {
        return "Person{" +
               "firstname='" + firstname + '\'' +
               ", lastname='" + lastname + '\'' +
               ", community='" + community + '\'' +
               ", school='" + school + '\'' +
               ", employer='" + employer + '\'' +
               ", privacy='" + privacy + '\'' +
               '}';
    }
}

// Activities 类用于存储活动信息 (在本教程中,活动信息不直接用于构建图,但作为原始数据的一部分保留)
public class Activities {
    private String firstname;
    private String lastname;
    private String activity;

    // 构造函数
    public Activities() {}

    // Getters and Setters
    public String getFirstname() { return firstname; }
    public void setFirstname(String firstname) { this.firstname = firstname; }
    public String getLastname() { return lastname; }
    public void setLastname(String lastname) { this.lastname = lastname; }
    public String getActivity() { return activity; }
    public void setActivity(String activity) { this.activity = activity; }

    @Override
    public String toString() {
        return "Activities{" +
               "firstname='" + firstname + '\'' +
               ", lastname='" + lastname + '\'' +
               ", activity='" + activity + '\'' +
               '}';
    }
}

注意事项:

  • Person 类中重写 equals() 和 hashCode() 方法至关重要。当 Person 对象被用作 Map 的键或存储在 Set 中时,这些方法确保了对象的正确比较和唯一性识别。通常,选择一个或多个属性组合作为唯一标识(例如,姓、名和电子邮件)。
  • privacy 属性的 requestsPrivacy() 方法提供了一个便捷的方式来检查隐私状态。

2. 数据读取与存储优化

原始数据文件需要被读取并存储到易于操作的集合中。ArrayList 是一个合适的选择,用于临时存储所有 Person 和 Activities 对象。

import java.io.File;
import java.io.FileNotFoundException;
import java.util.ArrayList;
import java.util.List;
import java.util.Scanner;

public class InfoReader {

    private List persons;
    private List activities;

    public InfoReader() {
        this.persons = new ArrayList<>();
        this.activities = new ArrayList<>();
    }

    public void ReadInfo() {
        // 读取人员数据
        try {
            // 请根据您的实际文件路径修改
            String personFileLocation = "path" + File.separator + "to" + File.separator + "SamplefilePersons2022Oct31text.csv";
            File personListFile = new File(personFileLocation);
            Scanner personScanner = new Scanner(personListFile);

            while (personScanner.hasNextLine()) {
                String nextline = personScanner.nextLine();
                String[] personComponents = nextline.split(",");
                if (personComponents.length >= 8) { // 确保数据完整性
                    Person newPerson = new Person();
                    newPerson.setFirstname(personComponents[0].trim());
                    newPerson.setLastname(personComponents[1].trim());
                    newPerson.setPhone(personComponents[2].trim());
                    newPerson.setEmail(personComponents[3].trim());
                    newPerson.setCommunity(personComponents[4].trim());
                    newPerson.setSchool(personComponents[5].trim());
                    newPerson.setEmployer(personComponents[6].trim());
                    newPerson.setPrivacy(personComponents[7].trim());
                    this.persons.add(newPerson); // 将 Person 对象存储到列表中
                }
            }
            personScanner.close(); // 关闭扫描器
        } catch (FileNotFoundException e) {
            System.err.println("人员文件未找到: " + e.getMessage());
            throw new RuntimeException("无法读取人员数据", e);
        }

        // 读取活动数据
        try {
            // 请根据您的实际文件路径修改
            String activityFileLocation = "path" + File.separator + "to" + File.separator + "SamplefileActivities2022Oct31text.csv";
            File activityListFile = new File(activityFileLocation);
            Scanner activityScanner = new Scanner(activityListFile);

            while (activityScanner.hasNextLine()) {
                String nextLine = activityScanner.nextLine();
                String[] activityComponents = nextLine.split(",");
                if (activityComponents.length >= 3) { // 确保数据完整性
                    Activities newActivity = new Activities();
                    newActivity.setFirstname(activityComponents[0].trim());
                    newActivity.setLastname(activityComponents[1].trim());
                    newActivity.setActivity(activityComponents[2].trim());
                    this.activities.add(newActivity); // 将 Activities 对象存储到列表中
                }
            }
            activityScanner.close(); // 关闭扫描器
        } catch (FileNotFoundException e) {
            System.err.println("活动文件未找到: " + e.getMessage());
            throw new RuntimeException("无法读取活动数据", e);
        }
    }

    public List getPersons() {
        return persons;
    }

    public List getActivities() {
        return activities;
    }
}

关键改进:

  • 在 InfoReader 类中定义了 persons 和 activities 两个 ArrayList 成员变量。
  • 在循环内部,创建 Person 或 Activities 对象后,立即将其添加到对应的列表中。
  • 添加了 trim() 方法去除字符串两端的空白,提高数据处理的健壮性。
  • 增加了 if (personComponents.length >= X) 检查,避免因数据行不完整而导致的 ArrayIndexOutOfBoundsException。
  • 在 try-catch 块中关闭了 Scanner 资源。

3. 图数据结构基础与表示

图由节点(Vertices/Nodes)边(Edges)组成。

  • 在我们的场景中,每个 Person 对象可以被视为一个节点
  • 如果两个人之间满足“密切联系人”的条件(共享社区、学校或雇主),则他们之间存在一条
  • 这是一个非加权图,因为边没有关联的权重(例如,联系的强度)。
  • 这是一个无向图,因为如果A是B的密切联系人,那么B也是A的密切联系人。

图的常见表示方法有邻接矩阵和邻接列表。对于稀疏图(边相对较少),邻接列表通常更高效,它使用 Map 来存储每个节点及其相邻节点列表。

import java.util.ArrayList;
import java.util.HashMap;
import java.util.List;
import java.util.Map;

public class Graph {
    // 邻接列表:Map 的键是 Person 节点,值是其所有相邻 Person 节点的列表
    private Map> adjList;

    public Graph() {
        this.adjList = new HashMap<>();
    }

    // 添加一个节点到图中(如果它还不存在)
    public void addPerson(Person person) {
        adjList.putIfAbsent(person, new ArrayList<>());
    }

    // 添加一条边:将 person2 添加到 person1 的邻接列表中,反之亦然(无向图)
    public void addRelationship(Person person1, Person person2) {
        // 确保两个人都已作为节点存在
        addPerson(person1);
        addPerson(person2);

        // 添加双向关系
        if (!adjList.get(person1).contains(person2)) {
            adjList.get(person1).add(person2);
        }
        if (!adjList.get(person2).contains(person1)) {
            adjList.get(person2).add(person1);
        }
    }

    // 获取某个人的所有密切联系人
    public List getCloseContacts(Person person) {
        return adjList.getOrDefault(person, new ArrayList<>());
    }

    // 打印图的结构
    public void printGraph() {
        for (Map.Entry> entry : adjList.entrySet()) {
            System.out.print("Person: " + entry.getKey().getFirstname() + " " + entry.getKey().getLastname() + " -> ");
            for (Person neighbor : entry.getValue()) {
                System.out.print(neighbor.getFirstname() + " " + neighbor.getLastname() + ", ");
            }
            System.out.println();
        }
    }
}

4. 构建人员关系图

现在,我们将读取的数据转换为图结构。核心逻辑是遍历所有人员对,检查他们是否符合“密切联系人”的条件,然后添加相应的边。

import java.util.List;
import java.util.Objects; // 用于Objects.equals的空值安全比较

public class GraphBuilder {

    public static Graph buildRecommendationGraph(List persons) {
        Graph graph = new Graph();

        // 将所有人员添加到图中作为节点
        for (Person p : persons) {
            graph.addPerson(p);
        }

        // 遍历所有人员对,建立密切联系关系
        for (int i = 0; i < persons.size(); i++) {
            for (int j = i + 1; j < persons.size(); j++) { // 避免重复和自连接
                Person p1 = persons.get(i);
                Person p2 = persons.get(j);

                // 判断是否为密切联系人:共享社区、学校或雇主
                boolean isCloseContact = false;
                if (p1.getCommunity() != null && !p1.getCommunity().isEmpty() &&
                    Objects.equals(p1.getCommunity(), p2.getCommunity())) {
                    isCloseContact = true;
                }
                if (p1.getSchool() != null && !p1.getSchool().isEmpty() &&
                    Objects.equals(p1.getSchool(), p2.getSchool())) {
                    isCloseContact = true;
                }
                if (p1.getEmployer() != null && !p1.getEmployer().isEmpty() &&
                    Objects.equals(p1.getEmployer(), p2.getEmployer())) {
                    isCloseContact = true;
                }

                if (isCloseContact) {
                    graph.addRelationship(p1, p2);
                }
            }
        }
        return graph;
    }

    // 整合隐私设置的推荐生成方法
    public static List getRecommendedContacts(Person targetPerson, Graph graph) {
        List recommendations = new ArrayList<>();

        // 如果目标人员请求隐私,则不进行任何推荐
        if (targetPerson.requestsPrivacy()) {
            System.out.println(targetPerson.getFirstname() + " " + targetPerson.getLastname() + " 已请求隐私,不生成推荐。");
            return recommendations;
        }

        // 获取目标人员的所有密切联系人
        List closeContacts = graph.getCloseContacts(targetPerson);

        // 过滤掉请求隐私的联系人
        for (Person contact : closeContacts) {
            if (!contact.requestsPrivacy()) {
                recommendations.add(contact);
            }
        }
        return recommendations;
    }

    public static void main(String[] args) {
        // 1. 读取数据
        InfoReader reader = new InfoReader();
        reader.ReadInfo(); // 确保您已修改文件路径

        List allPersons = reader.getPersons();
        // List allActivities = reader.getActivities(); // 活动数据在本例中不直接用于图构建

        // 2. 构建图
        Graph recommendationGraph = buildRecommendationGraph(allPersons);
        System.out.println("--- 图结构 ---");
        recommendationGraph.printGraph();

        // 3. 生成推荐
        System.out.println("\n--- 推荐结果 ---");
        if (!allPersons.isEmpty()) {
            // 假设我们想为列表中的第一个人生成推荐
            Person personToRecommendFor = allPersons.get(0);
            List recommendations = getRecommendedContacts(personToRecommendFor, recommendationGraph);

            System.out.println("为 " + personToRecommendFor.getFirstname() + " " + personToRecommendFor.getLastname() + " 推荐的联系人:");
            if (recommendations.isEmpty()) {
                System.out.println("  无推荐或所有密切联系人均已请求隐私。");
            } else {
                for (Person rec : recommendations) {
                    System.out.println("  - " + rec.getFirstname() + " " + rec.getLastname());
                }
            }

            // 示例:为另一个可能请求隐私的人生成推荐
            // 假设我们有一个名为 "John Doe" 的人,并且他请求了隐私
            Person privacyRequester = new Person();
            privacyRequester.setFirstname("John");
            privacyRequester.setLastname("Doe");
            privacyRequester.setPrivacy("Y"); // 设置为请求隐私
            privacyRequester.setCommunity("SomeCommunity"); // 确保equals方法能匹配
            privacyRequester.setSchool("SomeSchool");
            privacyRequester.setEmail("john.doe@example.com");

            // 假设 John Doe 也在 allPersons 列表中,或者我们只是模拟
            // 如果不在列表中,getCloseContacts可能返回空,这里仅为演示隐私过滤
            // 实际应用中,privacyRequester 应该来自 allPersons 列表
            List privacyRecommendations = getRecommendedContacts(privacyRequester, recommendationGraph);
            if (privacyRecommendations.isEmpty() && privacyRequester.requestsPrivacy()) {
                 // 已经打印了信息,这里不再重复
            } else if (!privacyRecommendations.isEmpty()) {
                System.out.println("为 " + privacyRequester.getFirstname() + " " + privacyRequester.getLastname() + " 推荐的联系人:");
                for (Person rec : privacyRecommendations) {
                    System.out.println("  - " + rec.getFirstname() + " " + rec.getLastname());
                }
            }
        } else {
            System.out.println("没有读取到人员数据,无法生成推荐。");
        }
    }
}

代码解析:

  • buildRecommendationGraph 方法负责图的实际构建。它首先将所有 Person 对象添加为图的节点,然后通过嵌套循环遍历所有人员对。
  • Objects.equals() 用于安全地比较字符串属性,即使其中一个为 null 也不会抛出 NullPointerException。
  • getRecommendedContacts 方法演示了如何利用构建好的图来生成推荐。它首先获取目标人员的所有直接密切联系人,然后根据隐私
本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
编程开发
相关文章 更多
精品专题 更多
本月促销

正软商城本月促销专区,汇集办公、设计、安全、影音、系统工具及AI软件等正版软件优惠活动,提供限时折扣、特价授权和优惠购买信息,活动库存及价格以页面实时展示为准。

装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

IOS软件

正软商城iOS软件专区,精选适用于iPhone和iPad的办公、学习、影音、设计、效率及AI应用,提供功能介绍、适用设备、系统要求和正版获取方式等信息。

AI

正软商城AI软件专区,汇集AI写作、AI绘画、AI视频、AI办公、AI编程、AI翻译、智能客服和数据分析等人工智能工具,提供功能介绍、适用平台、收费方式及正版购买信息。

PDF教程

正软商城PDF教程频道提供PDF编辑、转换、合并、拆分、压缩及格式处理方法,同时介绍常用PDF软件和工具的使用技巧。

Mac软件 更多
灵活计算器
灵活计算器

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

图几
图几

图几是一款适用于 macOS 的截图、标注与美化工具,支持离线操作保障隐私。界面整理和高频系统操作被放到一起考虑,桌面或窗口内容一多时,管理起来会更省心。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Menuist
Menuist

Menuist 是一款面向 macOS 的 Finder 右键菜单增强工具,主要用来补充新建文件、快捷导航等常用操作,让日常文件管理和访问路径时更高效、更顺手。

Mole
Mole

Mole 是一款专为 Mac 设计的深度清理优化工具,涵盖缓存清理、应用管理及实时状态监控等功能。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

WINDOWS 更多
Windows 10
Windows 10

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

傲梅轻松备份
傲梅轻松备份

傲梅轻松备份是一款专业易用的数据备份软件,为重要数据提供安全保障。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

Wise Folder Hider Pro
Wise Folder Hider Pro

Wise Folder Hider Pro 是一款专业级文件和文件夹隐藏加密软件,为私密数据添加多重保护。高频操作更强调就近处理,浏览、整理和跨目录移动文件时,来回切换和重复点击都会少很多。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

PinStack
PinStack

PinStack是一款轻量级的Windows平台剪贴板管理工具,优化您的剪贴板使用体验。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Seer
Seer

Seer是一款在Win平台下的空格键功能增强效率工具,只需轻敲空格键,就能预览几乎任何格式的文件。它更适合把零散的小功能集中起来使用,处理高频琐碎任务时会更省事。