README.md

February 25, 2025 ยท View on GitHub

mmkg
Multi-modal Knowledge Graph

This repository is a collection of resources on multimodal knowledge graph, including datasets, research papers and contests.

Content

Multimodal Knowledge Graph Completion

TitleVenueYearCode
Image-embodied Knowledge Representation LearningIJICA2016Github
KG-BERT: BERT for Knowledge Graph CompletionarXiv2019Github
Multimodal Data Enhanced Representation LearningIJCNN2019Github
Multi-modal Multi-relational Feature Aggregation Network for Medical Knowledge Representation LearningACM Multimedia2020
Is Visual Context Really Helpful for Knowledge Graph? A Representation Learning PerspectiveACM Multimedia2021Github
Endowing Language Models with Multimodal Knowledge Graph RepresentationsarXiv2022Github
Hyper-node Relational Graph Attention Network for Multi-modal Knowledge Graph CompletionTOMM2022Github
Contrastive Multi-Modal Knowledge Graph Representation LearningTKDE2022
IMKGA-SM: Interpretable Multimodal Knowledge Graph Answer Prediction via Sequence ModelingarXiv2022
MMKRL: A robust embedding approach for multi-modal knowledge graph representation learningAppl. Intell.2022
MoSE: Modality Split and Ensemble for Multimodal Knowledge Graph CompletionEMNLP2022Github
OTKGE: Multi-modal Knowledge Graph Embeddings via Optimal TransportNIPS2022Github
Multimodal Knowledge Learning for Named Entity DisambiguationEMNLP-findings2022
Relation-enhanced Negative Sampling for Multimodal Knowledge Graph CompletionACM Multimedia2022
VISTA: Visual-Textual Knowledge Graph Representation LearningEMNLP-findings2023Github
TIVA-KG: A Multimodal Knowledge Graph with Text, Image, Video and AudioACM Multimedia2023Github
MPKGAC: Multimodal Product Attribute Completion in E-commerceWWW (Companion Volume)2023Github
Reviving the Context: Camera Trap Species Classification as Link Prediction on Multimodal Knowledge GraphsCIKM2023Github
LAFA: Multimodal Knowledge Graph Completion with Link Aware Fusion and AggregationAAAI2024
Zero-Shot Relational Learning for Multimodal Knowledge GraphsarXiv2024
MyGO: Discrete Modality Information as Fine-Grained Tokens for Multi-modal Knowledge Graph CompletionarXiv2024
Un-leashing the Power of Imbalanced Modality Information for Multi-modal Knowledge Graph CompletionLREC-COLING2024Github

Multimodal Entity Aligment

TitleVenueYearCode
MMEA: Entity Alignment for Multi-modal Knowledge GraphKSEM2020Github
Multi-modal entity alignment in hyperbolic spaceNeurocomputing2021
Visual Pivoting for (Unsupervised) Entity AlignmentAAAI2021Github
Multi-modal Siamese Network for Entity AlignmentKDD2022Github
MultiJAF: Multi-modal joint entity alignment framework for multi-modal knowledge graphNeurocomputing2022
Multi-modal Contrastive Representation Learning for Entity AlignmentCOLING2022Github
Attribute-Consistent Knowledge Graph Representation Learning for Multi-Modal Entity AlignmentWWW2023Github
Leveraging multimodal features for knowledge graph entity alignment based on dynamic self-attention networksExpert Systems with Applications2023Github
Probing the Impacts of Visual Context in Multimodal Entity AlignmentData Sci. Eng.2023
MEAformer: Multi-modal Entity Alignment Transformer for Meta Modality HybridACM Multimedia2023Github
Revisit and Outstrip Entity Alignment: A Perspective of Generative ModelsarXiv2023
Rethinking Uncertainly Missing and Ambiguous Visual Modality in Multi-Modal Entity AlignmentISWC2023Github
Multi-Modal Knowledge Graph Transformer Framework for Multi-Modal Entity AlignmentarXiv2023Github
Universal Multi-modal Entity Alignment via Iteratively Fusing Modality Similarity PathsarXiv2023Github

Multimodal Entity Linking

TitleVenueYearCode
Multimodal Named Entity Disambiguation for Noisy Social Media PostsACL2018
Building a Multimodal Entity Linking Dataset From TweetsLREC2020Github
Multimodal Entity Linking for TweetsECIR2020Github
Attention-Based Multimodal Entity Linking with High-Quality ImagesDASFAA2021
Weibo-MEL, Wikidata-MEL and Richpedia-MEL: Multimodal Entity Linking Benchmark DatasetsCCKS2021Github
Multimodal Entity Linking: A New Dataset and A BaselineACM Multimedia2021Github
Visual Entity Linking via Multi-modal LearningData Intell.2022
WikiDiverse: A Multimodal Entity Linking Dataset with Diversified Contextual Topics and Entity TypesACL2022Github
Multimodal Entity Linking with Gated Hierarchical Fusion and Contrastive TrainingSIGIR2022Github
Multimodal Entity Linking with Mixed Fusion MechanismDASFAA2022Github
AMELI: Enhancing Multimodal Entity Linking with Fine-Grained AttributesarXiv2023
Multi-Grained Multimodal Interaction Network for Entity LinkingKDD2023Github
Benchmarking Diverse-Modal Entity Linking with Generative ModelsACL-findings2023
Generative Multimodal Entity LinkingarXiv2023Github
Open-domain Visual Entity Recognition: Towards Recognizing Millions of Wikipedia EntitiesICCV2023Github
DRIN: Dynamic Relation Interactive Network for Multimodal Entity LinkingACM Multimedia2023Github
MMEL: A Joint Learning Framework for Multi-Mention Entity LinkingUAI2023Github
S2abEL: A Dataset for Entity Linking from Scientific TablesEMNLP2023Github
A Dual-way Enhanced Framework from Text Matching Point of View for Multimodal Entity LinkingAAAI2024Github
DWE+: Dual-Way Matching Enhanced Framework for Multimodal Entity Linking2024Github
Optimal Transport Guided Correlation Assignment for Multimodal Entity LinkingACL-findings2024Github
OVEL: Large Language Model as Memory Manager for Online Video Entity LinkingarXiv2024

Multimodal Named Entity Recognition

TitleVenueYearCode
Multimodal Named Entity Recognition for Short Social Media PostsNAACL-HLT2018
Adaptive Co-attention Network for Named Entity Recognition in TweetsAAAI2018
Visual Attention Model for Name Tagging in Multimodal Social MediaACL2018
Aiding Intra-Text Representations with Visual Context for Multimodal Named Entity RecognitionICDAR2019
Improving Multimodal Named Entity Recognition via Entity Span Detection with Unified Multimodal TransformerACL2020Github
Object-Aware Multimodal Named Entity Recognition in Social Media Posts With Adversarial LearningIEEE Trans. Multim.2021
RpBERT: A Text-image Relation Propagation-based BERT Model for Multimodal NERAAAI2021Github
Multi-modal Graph Fusion for Named Entity Recognition with Targeted Visual GuidanceAAAI2021Github
MNRE: A Challenge Multimodal Dataset for Neural Relation Extraction with Visual Evidence in Social Media PostsICME2021Github
PromptMNER: Prompt-Based Entity-Related Visual Clue Extraction and Integration for Multimodal Named Entity RecognitionDASFAA2022
CWI: A multimodal deep learning approach for named entity recognition from social media using character, word and image featuresNeural Comput. Appl.2022
MAF: A General Matching and Alignment Framework for Multimodal Named Entity RecognitionWSDM2022Github
Good Visual Guidance Makes A Better Extractor: Hierarchical Visual Prefix for Multimodal Entity and Relation ExtractionarXiv2022Github
ITA: Image-Text Alignments for Multi-Modal Named Entity RecognitionNAACL-HLT2022Github
CAT-MNER: Multimodal Named Entity Recognition with Knowledge-Refined Cross-Modal AttentionICME2022
Query Prior Matters: A MRC Framework for Multimodal Named Entity RecognitionACM Multimedia2022
Learning from Different text-image Pairs: A Relation-enhanced Graph Convolutional Network for Multimodal NERACM Multimedia2022Github
Named Entity and Relation Extraction with Multi-Modal RetrievalEMNLP2022Github
Joint Multimodal Entity-Relation Extraction Based on Edge-enhanced Graph Alignment Network and Word-pair Relation TaggingAAAI2023Github
A Novel Framework for Multimodal Named Entity Recognition with Multi-level AlignmentsarXiv2023
Grounded Multimodal Named Entity Recognition on Social MediaACL2023Github
MPMRC-MNER: A Unified MRC framework for Multimodal Named Entity Recognition based Multimodal PromptCIKM2023
MGICL: Multi-Grained Interaction Contrastive Learning for Multimodal Named Entity RecognitionCIKM2023
Prompt Me Up: Unleashing the Power of Alignments for Multimodal Entity and Relation ExtractionACM Multimedia2023
Fine-Grained Multimodal Named Entity Recognition and Grounding with a Generative FrameworkACM Multimedia2023Github
MCG-MNER: A Multi-Granularity Cross-Modality Generative Framework for Multimodal NER with InstructionACM Multimedia2023Github
Prompting ChatGPT in MNER: Enhanced Multimodal Named Entity Recognition with Auxiliary Refined KnowledgeEMNLP-findings2023Github
In-context Learning for Few-shot Multimodal Named Entity RecognitionEMNLP-findings2023
ESPVR: Entity Spans Position Visual Regions for Multimodal Named Entity RecognitionEMNLP-findings2023

Multimodal Event Extraction

TitleVenueYearCode
Image Enhanced Event Detection in News ArticlesAAAI2020Github
Cross-media Structured Common Space for Multimedia Event ExtractionACL2020
MERL: Multimodal Event Representation Learning in Heterogeneous Embedding SpacesAAAI2021
A Chinese Financial Event Extraction Dataset Constructed by Distant SupervisionIJCKG2021Github
CLIP-Event: Connecting Text and Images with Event StructuresCVPR2022Github
Multimedia Event Extraction From News With a Unified Contrastive Learning FrameworkACM Multimedia2022Github