null - 程序员宅基地

Graph-Toolformer: 基于大语言模型的多功能图数据推理引擎-程序员宅基地

技术标签：语言模型人工智能知识图谱

论文标题：

Graph-ToolFormer: To Empower LLMs with Graph Reasoning Ability via Prompt Augmented by ChatGPT

论文链接：

http://www.ifmlab.org/files/paper/graph_toolformer.pdf

源码链接：

https://github.com/jwzhanggy/Graph_Toolformer

背景介绍

最近几年，大语言模型（LLM）在自然语言处理的各类任务上都取得了非常优异的表现。并且，自从 2022 年底到现在，ChatGPT 和 New Bing Chat 相继出现以后，各种大语言模型被广泛应用到人们的学习、工作和生活当中，对我们的工作生活都产生了巨大的影响。

与此同时，在使用过程中，大语言模型的自带的诸多弊端也显现出来，包括 1）无法做复杂精确的数学计算；2）没法进行多步的逻辑推理；3）不能获得空间拓扑结构信息；4）难以准确感知时间信息等。

在现实生活中，除了文本数据外，还广泛存在各种其他类型的数据，例如 image 和 graph 等类型的数据。现在，把 LLM 扩展能够处理多模态数据是当前研究的重点，并且 OpenAI 最新的 GPT4 和 Google 新推出的 PaLM-E 都能够同时有效处理文字和图片（image）等数据。而如何使用 LLM 处理复杂的 graph 结构的数据，当前还是一个有待解决的问题。

研究问题

在现实生活中，很多数据都可以表示成 graph 结构数据。例如上图所示：

学术文献引用关系可以表示成 bibliographic network
生物医学里的蛋白质分子可以表示成 protein molecular graph
推荐系统可以表示成包括人和物品关系的 recommender system network
社交网络可以表示成包含用户和人际关系的 online social network
无结构的复杂文本数据也可表示成由 entity 和 relation 构成的 knowledge graph 等

本文主要研究如何使用 LLM 处理 graph 结构数据，并且进行复杂 graph 数据上的推理问题，其中包括

1. 简单 graph 的基本属性，例如：

半径，密度，最短路径等；

2. 复杂 graph 数据上的应用任务，例如：

基于 bibliographic network 的文献主题预测，
基于 protein molecular graph 的蛋白质分子功能检测，
基于 recommender system network 的时序商品推荐，
基于 online social network 的社区检测，
基于 knowledge graph 的知识图谱推理等。

上面这些 graph 结构数据上的推理任务往往都涉及（1）复杂的数学计算，（2）多步逻辑推理，（3）处理空间拓扑结构，（4）0感知时序信息等。而这些对模型的要求，正好对应了前面提到的 LLM 的诸多弱点。

解决方案

为了解决这些问题，并且使得 LLM 能够在 graph 结构数据上进行各种复杂推理的任务，基于最近的 ChatGPT 和 Toolformer 模型，本文提出了一个新的语言模型框架，Graph-Toolformer。Graph-Toolformer 针对各类 graph reasoning 任务，定义了对应的 API call，并且通过使用 LLM 生成 API call 来使用 LLM 控制和实现针对各类 graph 数据的 reasoning task。

如上图所示，本文提出的 Graph-Toolformer 包含多个功能模块：

1. 针对 graph reasoning 任务设计少量 API Call 样本：我们针对本文研究的 graph reasoning 任务设计了少量的 API call 样本，通过 API call 我们既可以加载 graph 数据，也可以对 graph 数据进行简单和复杂的推理任务。

2. 基于 ChatGPT 对 prompt 进行 augmentation：基于上一步的少量 API call prompt 样本，我们提出使用 ChatGPT 对训练数据进行增强。基于人工设计的 instruction 和少量 prompt example 数据，我们调用 ChatGPT API 利用 GPT3.5/GPT4 的 in-context learning 和 few-shot learning 的特性，成功对各类 graph reasoning 任务各自生成了一个比较大的训练数据，并对生成的数据进行了清洗和整理。

3. 使用现有 pre-train LLM 进行模型 fine-tuning：基于得到的训练数据，我们对现有 pre-train 的开源 causalLM 模型（例如 GPT-J 6B 和 LLaMA 7B）进行 fine-tuning。为了降低模型训练的内存开销，本位使用了最新的 LoRA，大预言模型 quantization 技术，并且使用了 bitsandbyte 的 8bit AdamW 作为训练使用的 optimizer。

本文模型的 fine-tuning 任务，在使用小的 batch-size 的情况下，最低仅仅需要 11GB 显存，完全可以在 1080Ti 的显卡上跑 fine-tuning。

4. 基于 external graph toolkits 的 graph reasoning：训练好的 LLM 可以对任意 graph reasoning 的输入，自动插入并生成对应含有 API call 的输出。并且通过 post-processing，我们可以调用外部的 graph reasoning 工具包，实现 API call 并且把返回结构加入的生成结构之中，实现使用 LLM 对 graph 结构数据进行复杂推理的任务。

Graph Reasoning Prompt示例

如下面两个表所示，我们展示了各种简单和复杂 graph reasoning prompt input-output 的示例。

graph 数据加载和简单 graph property reasoning 示例：

复杂 graph reasoning 任务示例：

实验结果

本文选取了多个 graph reasoning 的 benchmark 数据集，对 Graph-Toolformer 框架的表现进行验证，如下表所示：

各种 graph benchmark 数据集：

fine-tuning 后的模型生成的输出质量：

结论和后续工作

本文提出了通用的 Graph-ToolFormer 框架，实现了使用 LLM 来完成 graph reasoning 的任务。目前 Graph-ToolFormer 还只包含 GPT-J 一个语言模型和文中提到的少量 graph reasoning 任务。根据作者最新信息，他们将会继续向 Graph-ToolFormer 添加跟多的语言模型，graph data 和 graph reasoning 任务，并且会将 Graph-ToolFormer 上线且增加 GUI，使得用户可以在线完成各类型的 graph reasoning 任务。

本文链接：https://blog.csdn.net/zhaomengsen/article/details/130189978

原作者删帖不实内容删帖广告或垃圾文章投诉

智能推荐

【Ubuntu】Ubuntu安装安装opencv3.4.5_ubuntu安装opencv3.4.5-程序员宅基地

文章浏览阅读1.1k次。Ubuntu安装opencv，一步到位。_ubuntu安装opencv3.4.5

mysql非空约束_mySQL 约束 (Constraints)：一、非空约束 NOT NULL 约束-程序员宅基地

文章浏览阅读745次。非空约束 NOT NULL 约束：强制列不能为NULL 值，约束强制字段始终包含值。这意味着，如果不向字段添加值，就无法插入新记录或者更新记录。1.在"Persons" 表创建时在Id列、name列创建not null 约束：create table Persons(id int not NULL,p_name varchar(20) not null,deparment varchar(20),..._not null 使用constraint 去定义

Lable 显示 Html 标签（小技巧）_el-select label html-程序员宅基地

文章浏览阅读527次。使用NSHTMLTextDocumentType从HTML创建的NSAttributedString；这种方法有利有弊。大概看了一下，坑多。我感觉还好吧。像下面的第一段的富文本，如果拼起来会疯的，用下面方法。很容易搞定。-(void)testHtmlText{ UILabel *htmlLa = [[UILabel alloc]init]; htmlLa.frame = CGRectMake(100, 150, 200, 200); [self.vie._el-select label html

Contiki学习平台推荐_cc2538em-程序员宅基地

文章浏览阅读1.4w次，点赞5次，收藏11次。本文将介绍多款适合Contiki入门的学习平台（或开发平台）。随着厂商对Contiki的支持越来越多，Contiki的学习平台在这几年中发生了很大的变化，又随着国内爱好者人数的增加，适合国情的Contiki学习平台越来越多，价格也越来越便宜。总的来说，CC2530和MSP430等8位或16位MCU已经并不是主流的Contiki学习平台，而CC2538、CC2650和CC1310等越来越被爱好者接受。_cc2538em

Win10安装VS2022自带的Python，Python环境变量配置_vs2022的python的默认路径-程序员宅基地

文章浏览阅读4.9k次。1.首先找到VS安装目录下的Python，我的安装路径如下：每个人的安装路径不同，具体环境具体分析。2.添加环境变量，点击确定python3.打开cmd，输入命令python或者打开Power Shell，输入命令python..._vs2022的python的默认路径

UE4C++学习篇（十五）-- 射线检测之通道检测和对象检测_linetracesinglebychannel-程序员宅基地

文章浏览阅读4.2k次，点赞4次，收藏13次。在游戏中，常常会遇到和某些道具进行交互的情况，这个时候就需要使用射线检测去检测玩家是否能和道具进行交互。射线检测常用的有两种，一种是通道检测（LineTraceSingleByChannel），一种是对象检测（LineTraceSingleByObjectType）。..._linetracesinglebychannel

随便推点

python json解析_用Python编写JSON解析器的概述-程序员宅基地

文章浏览阅读892次。0x00 序言蒟蒻作者对Parser，Tokenizer这些东西并不很了解，或者说了解程度仅足以支撑我写一个JSON的解析器.....还望各路大佬多多指点，批评。另外这是我第一次在zhihu上写文章...并不太会用这个编辑器（感觉不太好用...?）所以排版有可能略难堪请各位多多包容（笑虽然Python已经有自带的json模块，但手动实现一个还是能在一定程度上提升对JsonParser的了解......._python json解析器

湘潭OJ-1267-树的直径-dp求法_oj树的直径-程序员宅基地

文章浏览阅读463次。http://202.197.224.59/OnlineJudge2/index.php/Problem/read/id/1267 这道题卡了我小半个月，最后发现错误竟然是不能用lld，在湘潭oj只能用i64d。。55 不过收获也是蛮大的。比较重要的地方 1 第一次dfs用后跟遍历，以求得到一条最长路。这时候求得是点为起点的时候的最长路 2 第二次是求点为终点的时候的最长路。注意。在_oj树的直径

CANopen指令_canopen指令表-程序员宅基地

文章浏览阅读568次。MC_ReadActualPosition_CO读位置。MC_ReadActualVelocity_CO读速度。MC_WriteParameter_CO写参数。MC_MoveAbsolute_CO绝对定位。MC_MoveRelative_CO相对定位。MC_MoveVelocity_CO速度指令。MC_ReadParameter_CO读参数。MC_Home_CO原点回零。MC_Power_CO使能。MC_Reset_CO复位。MC_Halt_CO暂停。MC_Stop_CO停止。MC_Jog_CO点动。_canopen指令表

Graph-Toolformer: 基于大语言模型的多功能图数据推理引擎-程序员宅基地

智能推荐

【Ubuntu】Ubuntu安装安装opencv3.4.5_ubuntu安装opencv3.4.5-程序员宅基地

mysql非空约束_mySQL 约束 (Constraints)：一、非空约束 NOT NULL 约束-程序员宅基地

Lable 显示 Html 标签（小技巧）_el-select label html-程序员宅基地

Contiki学习平台推荐_cc2538em-程序员宅基地

Win10安装VS2022自带的Python，Python环境变量配置_vs2022的python的默认路径-程序员宅基地

UE4C++学习篇（十五）-- 射线检测之通道检测和对象检测_linetracesinglebychannel-程序员宅基地

随便推点

python json解析_用Python编写JSON解析器的概述-程序员宅基地

湘潭OJ-1267-树的直径-dp求法_oj树的直径-程序员宅基地

CANopen指令_canopen指令表-程序员宅基地

JS-事件_js获取鼠标移动距离-程序员宅基地

高频知识汇总 |【计算机网络】面试题汇总（万字长文通俗易懂）_主路由器不经请求,主动向外发出的arp消息,这样其他机器就能知道默认网关的mac地址-程序员宅基地

配置双网卡双路由_双网卡路由设置-程序员宅基地

推荐文章

热门文章

相关标签