Back to search

Article

Extractive Text-Image Summarization with Relation-Enhanced Graph Attention Network

2022-08-01

Abstract excerpt

Multi-modal summarization with multi-modal output (MSMO) aims to generate multi-modal summaries for a multi-modal document to improve readability of summaries by making use of information of different modalities. Most existing Seq2Seq-based MSMO models cannot well capture multi-modal relations which are significant for generating high-quality multi-modal summaries. To address this issue, this paper proposes a rela...

Topics

Open a Topic to create a Post that cites this publication.

Identifiers and source

Literature Corpus work
18fe2d80-5959-5e41-b395-6d18a68195cf
DOI
10.21203/rs.3.rs-1894502/v1
Open publication

Related research

Semantic proximity does not establish scientific evidence.

Click a neighbor to travelStep 1 · 12 closest
Interactive article relationship graphSelect a related publication card to move it into the centre and load its closest explainable connections. Solid lines are source-backed structured connections. Dashed lines are semantic discovery signals and are not scientific evidence.
Extractive Text-Image Summarization with Relation-Enhanced Graph Attention NetworkDOI 10.21203/rs.3.rs-1894502/v1
Select a neighboring publication to make it the new centre.