FinVis-GPT:面向金融图表分析的多模态大语言模型
计算与语言
2023-08-04 v1
摘要
本文提出FinVis-GPT,一种专为金融图表分析设计的新型多模态大语言模型(LLM)。通过利用LLM的力量并融入指令微调与多模态能力,FinVis-GPT能够解读金融图表并提供有价值分析。为训练FinVis-GPT,生成了一个面向金融任务的数据集用于预训练对齐与指令微调,包含多种金融图表及其对应描述。受时间限制,我们通过若干案例研究评估模型性能,有前景的结果表明FinVis-GPT在各类金融图表相关任务中表现优越,包括生成描述、回答问题与预测未来市场趋势,超越现有最先进多模态LLM。所提FinVis-GPT是利用多模态LLM于金融领域的开创性努力,我们生成的数据集将于近期公开发布以加速相关研究。
引用
@article{arxiv.2308.01430,
title = {FinVis-GPT: A Multimodal Large Language Model for Financial Chart Analysis},
author = {Ziao Wang and Yuhang Li and Junda Wu and Jaehyeon Soon and Xiaofeng Zhang},
journal= {arXiv preprint arXiv:2308.01430},
year = {2023}
}
备注
(FinLLM 2023)@IJCAI 2023