找到30个数据集

过滤结果
  • ElementKG 2.0:面向化学领域的知识图谱

    ElementKG 2.0模拟化学家的认知逻辑闭环,以“元素-官能团-分子-反应-实验”为主线,构建覆盖化学反应全过程的统一知识表达框架。数据集旨在重构目前化学数据的组织维度,为面向自驱动化学实验室的智能体提供知识底座,促进计算化学与湿实验的衔接。ElementKG 2.0涵盖超过100万条化学反应与实验流程,超过1000万个化学物质。
  • TTG-Math:面向数学推理领域的知识图谱

    TTG-Math(Template-Theorems Graph for Math)是一套面向数学推理的“模板—定理”图谱/知识库:它借鉴人类解题的联想机制,将具体数学题抽象为可复用的问题模板与分步的解法模板,并把每一步所需的关键定理/规则与模板建立显式链接,从而在遇到新题时能先做“问题蒸馏”得到模板表征,再在图中检索最相关的模板与定理作为上下文输入给...
  • MolSafeKG:面向化学领域的知识图谱

    MolSafeKG 汇总了三种主要类型的信息:分子实体、结构特征以及安全性标注。分子实体的集合包含了从权威来源中精选出的 83,925 种独特的化合物。对于结构特征,我们编码了丰富的化学子结构信息,包括来自元素周期表的 117 种化学元素、149 种分类为 13 类的官能团以及从 ChEMBL 数据库中提取的 434...
  • PorousKG:面向多孔材料领域的知识图谱

    PorousKG 数据集主要面向多孔材料领域的知识抽取与知识图谱构建,核心语料来源于 32,000 余篇多孔材料相关的全文学术文献,并融合 剑桥结构数据库(CSD) 中的金属—有机框架(MOF)结构数据,以及 量子计算优化的 QMOF 数据库等权威结构化资源,形成“文献证据 + 结构数据 +...
  • AAKG:面向蛋白质工程的氨基酸知识图谱

    AAKG(Amino Acid Knowledge Graph)是面向蛋白质工程的氨基酸知识图谱,基于 AAontology 汇聚并结构化刻画 20 种天然氨基酸的多维理化属性与内在关联:在图谱中同时建模氨基酸实体与属性实体(如极性、体积等),并通过 rdftype...
  • ProteinKG65:多模态蛋白知识图谱

    ProteinKG65 是一个多模态蛋白知识图谱数据集,将蛋白实体与 GO 术语实体对齐到对应的蛋白序列与文本描述。数据规模约 61.4 万实体、562 万三元组,以 Protein–GO 注释关系为主,并包含 GO–GO 关系,覆盖 GO 的三大分支(MF/CC/BP)。为缓解长尾分布,数据将部分高频关系细化扩展至 65 类,并提供...
  • ElementKG:化学元素知识图谱

    ElementKG 数据集面向材料与化学领域的元素知识建模与推理需求,系统化汇聚了元素的结构化先验知识,包括元素的基础属性(如原子序数、原子量、价态/电负性等)、周期表层级关系(族/周期/类别等)以及元素间可解释的关联与约束关系。数据以可计算的知识图谱形式组织,支持元素表示学习、组成/性质预测、材料设计与分子生成等任务中的知识增强...
  • 基于 REfO 的 KBQA 实现及示例

    这是一个基于 Python 模块 REfO 实现的知识库问答初级系统. 该问答系统可以解析输入的自然语言问句生成 SPARQL 查询,进一步请求后台基于 TDB 知识库的 Apache Jena Fuseki 服务, 得到结果. 这是一个入门级的例子. 内含介绍此项目的 README.pdf. 方便用户快速把握这个项目的想法. 希望用户体会默认的 3...
  • 基于elasticsearch的KBQA实现及示例

    这是一个基于ElasticSearch实现的简单的基于知识库的问答系统。该问答系统可以解析输入的自然语言问句生成ES查询,然后执行得到结果。目前实现了按照名称检索实体,实体属性,多跳检索,以及检索符合多对属性要求的实体。
  • 国内行政区划知识数据

    国内省市县乡村之间的行政区划数据。由于数据庞大,请自行到网盘提取。 提取码:2oc9
  • 天气语义数据

    提供语义化的气象数据,外链到相关疾病、健康等数据。
  • IEPile

    IEPile:大规模信息提取语料库 这是论文 IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus 的官方仓库...
  • 基于知识图谱的多模态类比推理数据集

    ICLR2023“Multimodal Analogical Reasoning over Knowledge Graph”提出的数据集,包含一个多模态知识图谱数据集MarKG和一个多模态类比推理数据集MARS,用来评估模型的多模态类比推理能力。
  • DeepKE:浙江大学基于深度学习的开源中文知识图谱抽取工具

    DeepKE是一个开源和可扩展的知识图谱抽取工具,支持常规全监督、低资源少样本和文档级场景,覆盖各种信息抽取任务包括命名实体识别、关系抽取和属性抽取。通过一个统一的框架,DeepKE...
  • OpenUE 简单可用的通用自然语言信息抽取工具(浙江大学)

    OpenUE 是一个轻量级知识图谱抽取工具。 特点 基于预训练语言模型的知识图谱抽取任务 (兼容BERT, Roberta等预训练模型.) 实体关系抽取 事件抽取 槽位和意图抽取 更多的任务 训练和测试接口 快速部署NLP模型
  • KZSL -知识驱动的零样本学习开放资源

    语义信息的提出为零样本学习(Zero-shot Learning,...
  • KG4OpenKG

    从OpenKG.CN获取的KG4OpenKG数据集。截止日期为2018.11.22。
  • douban-movie-kg

    豆瓣电影的知识图谱,展示导演、编剧、演员与电影的关系