从GPT-3到GPT-5:其能力、范围、局限性与后果的映射
人工智能
2026-04-14 v1
摘要
我们报告了GPT系列从GPT-3、GPT-3.5、GPT-4、GPT-4 Turbo、GPT-4o、GPT-4.1到GPT-5家族的进展。我们的工作是比较性的,而非单纯历史性的。我们研究了该系列在技术框架、用户交互、模态、部署架构和治理视角上的演变。工作聚焦五个反复出现的主题:技术进展、能力变化、部署转变、持久局限以及下游后果。在研究设计方面,我们考虑官方技术报告、系统卡、API和模型文档、产品公告、发布说明以及同行评议的二手研究。一个主要断言是,后续GPT代数不应仅仅解释为更大或更准确的语言模型。相反,该系列从规模化的few-shot文本预测器演变为一组对齐的、多模态的、面向工具的、长上下文的、日益集成到工作流程中的系统。这种发展使简单模型间的比较变得复杂,因为产品路由、工具访问、安全调优和界面设计成为有效系统的一部分。跨代际,若干局限性保持不变:幻觉、提示敏感性、基准测试脆弱性、跨域和跨人群行为不均、以及对架构和训练的公共透明度不完整。然而,该系列演进了软件开发、教育实践、信息工作、界面设计以及对前沿模型治理的讨论。我们推断,GPT-3向GPT-5的转变不仅仅是模型能力提升,更是一个更广泛地重新定义可部署AI系统的范畴、其评估方式以及在大规模使用时应将责任定位在何处的范畴。
引用
@article{arxiv.2604.10332,
title = {From GPT-3 to GPT-5: Mapping their capabilities, scope, limitations, and consequences},
author = {Hina Afridi and Habib Ullah and Sultan Daud Khan and Mohib Ullah},
journal= {arXiv preprint arXiv:2604.10332},
year = {2026}
}