Computer Vision and Pattern Recognition · Computer Science
TRIE++: Towards End-to-End Information Extraction from Visually Rich Documents
Zhanzhan Cheng, Peng Zhang, Can Li, Qiao Liang +5
2022-07-15
Computer Vision and Pattern Recognition · Computer Science
TRIE: End-to-End Text Reading and Information Extraction for Document Understanding
Peng Zhang, Yunlu Xu, Zhanzhan Cheng, Shiliang Pu +4
2021-10-26
Computer Vision and Pattern Recognition · Computer Science
Extracting textual overlays from social media videos using neural networks
Adam Słucki, Tomasz Trzcinski, Adam Bielski, Paweł Cyrta
2018-05-02
Multimedia · Computer Science
AViTExt: Automatic Video Text Extraction, A new Approach for video content indexing Application
Baseem Bouaziz, Tarek Zlitni, Walid Mahdi
2013-01-11
Computer Vision and Pattern Recognition · Computer Science
Joint Multimedia Event Extraction from Video and Article
Brian Chen, Xudong Lin, Christopher Thomas, Manling Li +4
2021-09-28
Computation and Language · Computer Science
UniVIE: A Unified Label Space Approach to Visual Information Extraction from Form-like Documents
Kai Hu, Jiawei Wang, Weihong Lin, Zhuoyao Zhong +2
2024-01-18
Computer Vision and Pattern Recognition · Computer Science
Towards Robust Visual Information Extraction in Real World: New Dataset and Novel Solution
Jiapeng Wang, Chongyu Liu, Lianwen Jin, Guozhi Tang +5
2021-02-16
Computer Vision and Pattern Recognition · Computer Science
The VISIONE Video Search System: Exploiting Off-the-Shelf Text Search Engines for Large-Scale Video Retrieval
Giuseppe Amato, Paolo Bolettieri, Fabio Carrara, Franca Debole +4
2021-03-19
Computer Vision and Pattern Recognition · Computer Science
Deep Learning for Video-Text Retrieval: a Review
Cunjuan Zhu, Qi Jia, Wei Chen, Yanming Guo +1
2023-02-27
Computer Vision and Pattern Recognition · Computer Science
A Comprehensive Review of the Video-to-Text Problem
Jesus Perez-Martin, Benjamin Bustos, Silvio Jamil F. Guimarães, Ivan Sipiran +2
2021-12-02
Emerging Technologies · Computer Science
A Survey of Task-Based Machine Learning Content Extraction Services for VIDINT
Joshua Brunk, Nathan Jermann, Ryan Sharp, Carl D. Hoover
2022-07-12
Computer Vision and Pattern Recognition · Computer Science
Text-Video Retrieval via Variational Multi-Modal Hypergraph Networks
Qian Li, Lixin Su, Jiashu Zhao, Long Xia +5
2024-01-09
Computer Vision and Pattern Recognition · Computer Science
One-shot Key Information Extraction from Document with Deep Partial Graph Matching
Minghong Yao, Zhiguang Liu, Liangwei Wang, Houqiang Li +1
2021-09-30
Computer Vision and Pattern Recognition · Computer Science
HIP: Hierarchical Point Modeling and Pre-training for Visual Information Extraction
Rujiao Long, Pengfei Wang, Zhibo Yang, Cong Yao
2024-11-05
Computer Vision and Pattern Recognition · Computer Science
PICK: Processing Key Information Extraction from Documents using Improved Graph Learning-Convolutional Networks
Wenwen Yu, Ning Lu, Xianbiao Qi, Ping Gong +1
2020-07-21
Artificial Intelligence · Computer Science
UMIE: Unified Multimodal Information Extraction with Instruction Tuning
Lin Sun, Kai Zhang, Qingyuan Li, Renze Lou
2024-01-09
Computer Vision and Pattern Recognition · Computer Science
MatchVIE: Exploiting Match Relevancy between Entities for Visual Information Extraction
Guozhi Tang, Lele Xie, Lianwen Jin, Jiapeng Wang +5
2021-06-25
Computer Vision and Pattern Recognition · Computer Science
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models
Ziqin Zhou, Yifan Yang, Yuqing Yang, Tianyu He +6
2025-03-17
Computer Vision and Pattern Recognition · Computer Science
Contextual Explainable Video Representation: Human Perception-based Understanding
Khoa Vo, Kashu Yamazaki, Phong X. Nguyen, Phat Nguyen +2
2022-12-20
Computation and Language · Computer Science
A Challenging Multimodal Video Summary: Simultaneously Extracting and Generating Keyframe-Caption Pairs from Video
Keito Kudo, Haruki Nagasawa, Jun Suzuki, Nobuyuki Shimizu
2023-12-05