从记号到智能体:面向研究者的大语言模型理解指南
计算与语言
2026-03-23 v1
摘要
研究者面临一个关键选择:如何使用——或不使用——大语言模型。熟练地使用它们需要理解塑造LLM能与否的机制。本章以无需技术专业知识的方式阐释LLM,拆解六大核心组成部分:预训练数据、分词与嵌入、Transformer架构、概率生成、对齐以及智能体能力。每部分既从技术基础出发,又从研究意义着手,识别具体的可行性与局限。本章不提供指令性指导,而是构建一种框架,帮助研究者批判性地判断LLM是否适合及如何适配特定研究需求,最终通过模拟社交媒体动态的LLM-based智能体案例加以说明。
关键词
引用
@article{arxiv.2603.19269,
title = {From Tokens To Agents: A Researcher's Guide To Understanding Large Language Models},
author = {Daniele Barolo},
journal= {arXiv preprint arXiv:2603.19269},
year = {2026}
}