找到9个数据集

授权: Creative Commons Attribution Share-Alike 机构: 浙江大学

过滤结果
  • ElementKG 2.0:开源化学知识图谱

    ElementKG 2.0模拟化学家的认知逻辑闭环,以“元素-官能团-分子-反应-实验”为主线,构建覆盖化学反应全过程的统一知识表达框架。数据集旨在重构目前化学数据的组织维度,为面向自驱动化学实验室的智能体提供知识底座,促进计算化学与湿实验的衔接。ElementKG 2.0涵盖超过100万条化学反应与实验流程,超过1000万个化学物质。
  • InstructProteinKG:指令蛋白质知识图谱

    InstructProteinKG是一套面向蛋白序列—文本对齐与指令学习的蛋白知识图谱,主要由 UniProtKB/Swiss-Prot 的高质量结构化注释抽取得到,以“(Protein, relation, Annotation)”三元组组织蛋白与注释实体的关联,覆盖 GO 三大分支(BP/MF/CC) 以及 InterPro 的...
  • TTKG-Math:数学模板定理知识图谱

    TTG-Math(Template-Theorems Graph for Math)是一套面向数学推理的“模板—定理”图谱/知识库:它借鉴人类解题的联想机制,将具体数学题抽象为可复用的问题模板与分步的解法模板,并把每一步所需的关键定理/规则与模板建立显式链接,从而在遇到新题时能先做“问题蒸馏”得到模板表征,再在图中检索最相关的模板与定理作为上下文输入给...
  • MolSafeKG:化学安全知识图谱

    MolSafeKG 汇总了三种主要类型的信息:分子实体、结构特征以及安全性标注。分子实体的集合包含了从权威来源中精选出的 83,925 种独特的化合物。对于结构特征,我们编码了丰富的化学子结构信息,包括来自元素周期表的 117 种化学元素、149 种分类为 13 类的官能团以及从 ChEMBL 数据库中提取的 434...
  • PorousKG:多孔材料知识图谱

    PorousKG 数据集主要面向多孔材料领域的知识抽取与知识图谱构建,核心语料来源于 32,000 余篇多孔材料相关的全文学术文献,并融合 剑桥结构数据库(CSD) 中的金属—有机框架(MOF)结构数据,以及 量子计算优化的 QMOF 数据库等权威结构化资源,形成“文献证据 + 结构数据 +...
  • AAKG:氨基酸知识图谱

    AAKG(Amino Acid Knowledge Graph)是面向蛋白质工程的氨基酸知识图谱,基于 AAontology 汇聚并结构化刻画 20 种天然氨基酸的多维理化属性与内在关联:在图谱中同时建模氨基酸实体与属性实体(如极性、体积等),并通过 rdftype...
  • ProteinKG65:多模态蛋白质知识图谱

    ProteinKG65 是一个多模态蛋白知识图谱数据集,将蛋白实体与 GO 术语实体对齐到对应的蛋白序列与文本描述。数据规模约 61.4 万实体、562 万三元组,以 Protein–GO 注释关系为主,并包含 GO–GO 关系,覆盖 GO 的三大分支(MF/CC/BP)。为缓解长尾分布,数据将部分高频关系细化扩展至 65 类,并提供...
  • ElementKG 1.0:化学元素知识图谱

    ElementKG 数据集面向材料与化学领域的元素知识建模与推理需求,系统化汇聚了元素的结构化先验知识,包括元素的基础属性(如原子序数、原子量、价态/电负性等)、周期表层级关系(族/周期/类别等)以及元素间可解释的关联与约束关系。数据以可计算的知识图谱形式组织,支持元素表示学习、组成/性质预测、材料设计与分子生成等任务中的知识增强...
  • IEPile

    IEPile:大规模信息提取语料库 这是论文 IEPile: Unearthing Large-Scale Schema-Based Information Extraction Corpus 的官方仓库...
您也可以使用应用程式界面 (看 API文献)注册.