首页
/ KagNet 开源项目教程

KagNet 开源项目教程

2024-09-21 23:48:42作者:秋阔奎Evelyn

1. 项目介绍

KagNet 是一个用于常识推理的知识感知图网络模型,由 USC INK 实验室开发。该模型在 EMNLP-IJCNLP 2019 会议上提出,旨在通过利用外部结构化的常识知识图谱来执行可解释的推理。KagNet 的核心思想是将问题-答案对从语义空间映射到知识图谱的符号空间,并通过图卷积网络和 LSTM 结合层次路径注意力机制来表示和评分答案。

2. 项目快速启动

2.1 环境准备

首先,确保你的系统已经安装了以下依赖:

sudo apt-get install graphviz libgraphviz-dev pkg-config
conda create -n kagnet_test python==3.6.3
conda activate kagnet_test
pip install torch torchvision
pip install tensorflow-gpu==1.10.0
conda install faiss-gpu cudatoolkit=10.0 -c pytorch -n kagnet_test
pip install nltk
conda install -c conda-forge spacy -n kagnet_test
python -m spacy download en
pip install jsbeautifier
pip install networkx
pip install dgl
pip install pygraphviz
pip install allennlp

2.2 下载和预处理数据

下载 CommonsenseQA 数据集并进行预处理:

cd datasets
mkdir csqa_new
wget -P csqa_new https://s3.amazonaws.com/commensenseqa/train_rand_split.jsonl
wget -P csqa_new https://s3.amazonaws.com/commensenseqa/dev_rand_split.jsonl
wget -P csqa_new https://s3.amazonaws.com/commensenseqa/test_rand_split_no_answers.jsonl
python convert_csqa.py csqa_new/train_rand_split.jsonl csqa_new/train_rand_split.jsonl.statements
python convert_csqa.py csqa_new/dev_rand_split.jsonl csqa_new/dev_rand_split.jsonl.statements
python convert_csqa.py csqa_new/test_rand_split_no_answers.jsonl csqa_new/test_rand_split_no_answers.jsonl.statements

2.3 概念接地和图构建

进行概念接地和图构建:

cd grounding
python batched_grounding.py generate_bash "datasets/csqa_new/train_rand_split.jsonl.statements"
bash cmd.sh
python batched_grounding.py combine "datasets/csqa_new/train_rand_split.jsonl.statements"
python prune_qc.py datasets/csqa_new/train_rand_split.jsonl.statements mcp

2.4 训练 KagNet 模型

使用预处理的数据训练 KagNet 模型:

cd models
python main.py

3. 应用案例和最佳实践

KagNet 主要应用于需要常识推理的任务,如问答系统、对话系统等。通过结合外部知识图谱,KagNet 能够提供更准确和可解释的推理结果。最佳实践包括:

  • 数据预处理:确保数据集的格式和内容符合 KagNet 的要求。
  • 模型调优:根据具体任务调整模型参数,如学习率、批量大小等。
  • 结果解释:利用 KagNet 的层次路径注意力机制,解释模型的推理过程。

4. 典型生态项目

  • ConceptNet:作为 KagNet 的主要外部知识图谱资源,ConceptNet 提供了丰富的常识知识。
  • CommonsenseQA:KagNet 在 CommonsenseQA 数据集上取得了最先进的性能,该数据集是评估常识推理模型的标准基准。
  • BERT:KagNet 结合了 BERT 模型进行文本表示,进一步提升了模型的性能。

通过这些生态项目的结合,KagNet 能够更好地应用于实际的常识推理任务中。

登录后查看全文
热门项目推荐

项目优选

收起
ohos_react_nativeohos_react_native
React Native鸿蒙化仓库
C++
176
262
RuoYi-Vue3RuoYi-Vue3
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
863
511
ShopXO开源商城ShopXO开源商城
🔥🔥🔥ShopXO企业级免费开源商城系统,可视化DIY拖拽装修、包含PC、H5、多端小程序(微信+支付宝+百度+头条&抖音+QQ+快手)、APP、多仓库、多商户、多门店、IM客服、进销存,遵循MIT开源协议发布、基于ThinkPHP8框架研发
JavaScript
93
15
openGauss-serveropenGauss-server
openGauss kernel ~ openGauss is an open source relational database management system
C++
129
182
openHiTLSopenHiTLS
旨在打造算法先进、性能卓越、高效敏捷、安全可靠的密码套件,通过轻量级、可剪裁的软件技术架构满足各行业不同场景的多样化要求,让密码技术应用更简单,同时探索后量子等先进算法创新实践,构建密码前沿技术底座!
C
259
300
kernelkernel
deepin linux kernel
C
22
5
cherry-studiocherry-studio
🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端
TypeScript
596
57
CangjieCommunityCangjieCommunity
为仓颉编程语言开发者打造活跃、开放、高质量的社区环境
Markdown
1.07 K
0
HarmonyOS-ExamplesHarmonyOS-Examples
本仓将收集和展示仓颉鸿蒙应用示例代码,欢迎大家投稿,在仓颉鸿蒙社区展现你的妙趣设计!
Cangjie
398
371
Cangjie-ExamplesCangjie-Examples
本仓将收集和展示高质量的仓颉示例代码,欢迎大家投稿,让全世界看到您的妙趣设计,也让更多人通过您的编码理解和喜爱仓颉语言。
Cangjie
332
1.08 K