Graph-Toolformer: 基于大语言模型的多功能图数据推理引擎-程序员宅基地

技术标签: 语言模型  人工智能  知识图谱  

论文标题:

Graph-ToolFormer: To Empower LLMs with Graph Reasoning Ability via Prompt Augmented by ChatGPT

论文链接:

http://www.ifmlab.org/files/paper/graph_toolformer.pdf

源码链接:

https://github.com/jwzhanggy/Graph_Toolformer

背景介绍

最近几年,大语言模型(LLM)在自然语言处理的各类任务上都取得了非常优异的表现。并且,自从 2022 年底到现在,ChatGPT 和 New Bing Chat 相继出现以后,各种大语言模型被广泛应用到人们的学习、工作和生活当中,对我们的工作生活都产生了巨大的影响。

与此同时,在使用过程中,大语言模型的自带的诸多弊端也显现出来,包括 1)无法做复杂精确的数学计算;2)没法进行多步的逻辑推理;3)不能获得空间拓扑结构信息;4)难以准确感知时间信息等。

在现实生活中,除了文本数据外,还广泛存在各种其他类型的数据,例如 image 和 graph 等类型的数据。现在,把 LLM 扩展能够处理多模态数据是当前研究的重点,并且 OpenAI 最新的 GPT4 和 Google 新推出的 PaLM-E 都能够同时有效处理文字和图片(image)等数据。而如何使用 LLM 处理复杂的 graph 结构的数据,当前还是一个有待解决的问题。

研究问题

在现实生活中,很多数据都可以表示成 graph 结构数据。例如上图所示:

  • 学术文献引用关系可以表示成 bibliographic network

  • 生物医学里的蛋白质分子可以表示成 protein molecular graph

  • 推荐系统可以表示成包括人和物品关系的 recommender system network

  • 社交网络可以表示成包含用户和人际关系的  online social network

  • 无结构的复杂文本数据也可表示成由 entity 和 relation 构成的 knowledge graph 等

本文主要研究如何使用 LLM 处理 graph 结构数据,并且进行复杂 graph 数据上的推理问题,其中包括

1. 简单 graph 的基本属性,例如:

  • 半径,密度,最短路径 等;

2. 复杂 graph 数据上的应用任务,例如:

  • 基于 bibliographic network 的文献主题预测,

  • 基于 protein molecular graph 的蛋白质分子功能检测,

  • 基于 recommender system network 的时序商品推荐,

  • 基于 online social network 的社区检测,

  • 基于 knowledge graph 的知识图谱推理 等。

上面这些 graph 结构数据上的推理任务往往都涉及(1)复杂的数学计算,(2)多步逻辑推理,(3)处理空间拓扑结构,(4)0感知时序信息 等。而这些对模型的要求,正好对应了前面提到的 LLM 的诸多弱点。

解决方案

为了解决这些问题,并且使得 LLM 能够在 graph 结构数据上进行各种复杂推理的任务,基于最近的 ChatGPT 和 Toolformer 模型,本文提出了一个新的语言模型框架,Graph-Toolformer。Graph-Toolformer 针对各类 graph reasoning 任务,定义了对应的 API call,并且通过使用 LLM 生成 API call 来使用 LLM 控制和实现针对各类 graph 数据的 reasoning task。

如上图所示,本文提出的 Graph-Toolformer 包含多个功能模块:

1. 针对 graph reasoning 任务设计少量 API Call 样本:我们针对本文研究的 graph reasoning 任务设计了少量的 API call 样本,通过 API call 我们既可以加载 graph 数据,也可以对 graph 数据进行简单和复杂的推理任务。

2. 基于 ChatGPT 对 prompt 进行 augmentation:基于上一步的少量 API call prompt 样本,我们提出使用 ChatGPT 对训练数据进行增强。基于人工设计的 instruction 和少量 prompt example 数据,我们调用 ChatGPT API 利用 GPT3.5/GPT4 的 in-context learning 和 few-shot learning 的特性,成功对各类 graph reasoning 任务各自生成了一个比较大的训练数据,并对生成的数据进行了清洗和整理。

3. 使用现有 pre-train LLM 进行模型 fine-tuning:基于得到的训练数据,我们对现有 pre-train 的开源 causalLM 模型 (例如 GPT-J 6B 和 LLaMA 7B)进行 fine-tuning。为了降低模型训练的内存开销,本位使用了最新的 LoRA,大预言模型 quantization 技术,并且使用了 bitsandbyte 的 8bit AdamW 作为训练使用的 optimizer。

本文模型的 fine-tuning 任务,在使用小的 batch-size 的情况下,最低仅仅需要 11GB 显存,完全可以在 1080Ti 的显卡上跑 fine-tuning。

4. 基于 external graph toolkits 的 graph reasoning:训练好的 LLM 可以对任意 graph reasoning 的输入,自动插入并生成对应含有 API call 的输出。并且通过 post-processing,我们可以调用外部的 graph reasoning 工具包,实现 API call 并且把返回结构加入的生成结构之中,实现使用 LLM 对 graph 结构数据进行复杂推理的任务。

Graph Reasoning Prompt示例

如下面两个表所示,我们展示了各种简单和复杂 graph reasoning prompt input-output 的示例。

graph 数据加载和简单 graph property reasoning 示例:

复杂 graph reasoning 任务示例:

实验结果

本文选取了多个 graph reasoning 的 benchmark 数据集,对 Graph-Toolformer 框架的表现进行验证,如下表所示:

各种 graph benchmark 数据集:

fine-tuning 后的模型生成的输出质量:

结论和后续工作

本文提出了通用的 Graph-ToolFormer 框架,实现了使用 LLM 来完成 graph reasoning 的任务。目前 Graph-ToolFormer 还只包含 GPT-J 一个语言模型和文中提到的少量 graph reasoning 任务。根据作者最新信息,他们将会继续向 Graph-ToolFormer 添加跟多的语言模型,graph data 和 graph reasoning 任务,并且会将 Graph-ToolFormer 上线且增加 GUI,使得用户可以在线完成各类型的 graph reasoning 任务。

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/zhaomengsen/article/details/130189978

智能推荐

【Ubuntu】Ubuntu安装安装opencv3.4.5_ubuntu安装opencv3.4.5-程序员宅基地

文章浏览阅读1.1k次。Ubuntu安装opencv,一步到位。_ubuntu安装opencv3.4.5

mysql非空约束_mySQL 约束 (Constraints):一、非空约束 NOT NULL 约束-程序员宅基地

文章浏览阅读745次。非空约束 NOT NULL 约束:强制列不能为NULL 值,约束强制字段始终包含值。这意味着,如果不向字段添加值,就无法插入新记录或者更新记录。1.在"Persons" 表创建时在Id列、name列创建not null 约束:create table Persons(id int not NULL,p_name varchar(20) not null,deparment varchar(20),..._not null 使用constraint 去定义

Lable 显示 Html 标签 (小技巧)_el-select label html-程序员宅基地

文章浏览阅读527次。使用NSHTMLTextDocumentType从HTML创建的NSAttributedString;这种方法有利有弊。大概看了一下 ,坑多。我感觉还好吧。像下面的第一段的富文本,如果拼起来会疯的,用下面方法。很容易搞定。-(void)testHtmlText{ UILabel *htmlLa = [[UILabel alloc]init]; htmlLa.frame = CGRectMake(100, 150, 200, 200); [self.vie._el-select label html

Contiki学习平台推荐_cc2538em-程序员宅基地

文章浏览阅读1.4w次,点赞5次,收藏11次。本文将介绍多款适合Contiki入门的学习平台(或开发平台)。随着厂商对Contiki的支持越来越多,Contiki的学习平台在这几年中发生了很大的变化,又随着国内爱好者人数的增加,适合国情的Contiki学习平台越来越多,价格也越来越便宜。总的来说,CC2530和MSP430等8位或16位MCU已经并不是主流的Contiki学习平台,而CC2538、CC2650和CC1310等越来越被爱好者接受。_cc2538em

Win10安装VS2022自带的Python,Python环境变量配置_vs2022的python的默认路径-程序员宅基地

文章浏览阅读4.9k次。1.首先找到VS安装目录下的Python,我的安装路径如下:每个人的安装路径不同,具体环境具体分析。2.添加环境变量,点击确定python3.打开cmd,输入命令python或者打开Power Shell,输入命令python..._vs2022的python的默认路径

UE4C++学习篇(十五)-- 射线检测之通道检测和对象检测_linetracesinglebychannel-程序员宅基地

文章浏览阅读4.2k次,点赞4次,收藏13次。在游戏中,常常会遇到和某些道具进行交互的情况,这个时候就需要使用射线检测去检测玩家是否能和道具进行交互。射线检测常用的有两种,一种是通道检测(LineTraceSingleByChannel),一种是对象检测(LineTraceSingleByObjectType)。..._linetracesinglebychannel

随便推点

python json解析_用Python编写JSON解析器的概述-程序员宅基地

文章浏览阅读892次。0x00 序言蒟蒻作者对Parser,Tokenizer这些东西并不很了解,或者说了解程度仅足以支撑我写一个JSON的解析器.....还望各路大佬多多指点,批评。另外这是我第一次在zhihu上写文章...并不太会用这个编辑器(感觉不太好用...?)所以排版有可能略难堪请各位多多包容(笑虽然Python已经有自带的json模块,但手动实现一个还是能在一定程度上提升对JsonParser的了解......._python json解析器

湘潭OJ-1267-树的直径-dp求法_oj树的直径-程序员宅基地

文章浏览阅读463次。http://202.197.224.59/OnlineJudge2/index.php/Problem/read/id/1267 这道题卡了我小半个月,最后发现错误竟然是不能用lld,在湘潭oj只能用i64d。。55 不过收获也是蛮大的。 比较重要的地方 1 第一次dfs用后跟遍历,以求得到一条最长路。这时候求得是点为起点的时候的 最长路 2 第二次是求点为终点的时候的最长路。注意。在_oj树的直径

CANopen指令_canopen指令表-程序员宅基地

文章浏览阅读568次。MC_ReadActualPosition_CO读位置。MC_ReadActualVelocity_CO读速度。MC_WriteParameter_CO写参数。MC_MoveAbsolute_CO绝对定位。MC_MoveRelative_CO相对定位。MC_MoveVelocity_CO速度指令。MC_ReadParameter_CO读参数。MC_Home_CO原点回零。MC_Power_CO使能。MC_Reset_CO复位。MC_Halt_CO暂停。MC_Stop_CO停止。MC_Jog_CO点动。_canopen指令表

JS-事件_js获取鼠标移动距离-程序员宅基地

文章浏览阅读286次。2.1 什么是事件_js获取鼠标移动距离

高频知识汇总 |【计算机网络】面试题汇总(万字长文通俗易懂)_主路由器不经请求,主动向外发出的arp消息,这样其他机器就能知道默认网关的mac地址-程序员宅基地

文章浏览阅读1.3k次,点赞2次,收藏3次。这篇【计算机网络】是我在学习时自己整理的,大部分都是按我个人的理解来写的答案。废话不多说直接铺干货。_主路由器不经请求,主动向外发出的arp消息,这样其他机器就能知道默认网关的mac地址

配置双网卡双路由_双网卡路由设置-程序员宅基地

文章浏览阅读3.7k次,点赞10次,收藏11次。记一次配置双网卡_双网卡路由设置

推荐文章

热门文章

相关标签