中文

评估 AI 在金融领域的能力:AI 能否可靠地评估投资风险?

计算与语言 2025-07-08 v2

摘要

我们评估了 AI 系统是否能够可靠地评估投资风险偏好——这一任务必须在自动化之前得到彻底验证。我们的分析是在专有系统(GPT、Claude、Gemini)和开源模型(LLaMA、DeepSeek、Mistral)上进行的,采用精心挑选的用户档案,反映真实用户具有不同属性,如国家和性别。结果表明,这些模型在当用户属性——例如国家或性别——应不影响风险计算时呈现出显著的得分分布差异。例如,GPT-4o 会为尼日利亚和印度尼西亚档案分配更高的风险分数。虽然某些模型在低-中风险范围内与预期得分接近,但没有模型在地域和人口统计学差异中保持一致的得分,从而违反了 AI 和金融监管规定。

关键词

引用

@article{arxiv.2505.18953,
  title  = {Evaluating AI for Finance: Is AI Credible at Assessing Investment Risk?},
  author = {Divij Chawla and Ashita Bhutada and Do Duc Anh and Abhinav Raghunathan and Vinod SP and Cathy Guo and Dar Win Liew and Prannaya Gupta and Rishabh Bhardwaj and Rajat Bhardwaj and Soujanya Poria},
  journal= {arXiv preprint arXiv:2505.18953},
  year   = {2025}
}

备注

Under review