中文

biorecap: 一个使用本地大语言模型总结bioRxiv预印本的R包

其他定量生物学 2024-08-22 v1

摘要

bioRxiv的建立促进了预印本在生命科学领域的快速采用,加速了新研究成果的传播。然而,每天发布的预印本数量巨大,可能令人不知所措,使得研究人员难以跟上最新进展。本文介绍了biorecap,一个R包,它使用在几乎任何商用笔记本电脑上本地运行的大语言模型(LLM)来检索和总结bioRxiv预印本。biorecap利用ollamar包与Ollama服务器和API端点进行接口,允许用户提示通过Ollama可用的任何本地LLM。该包遵循tidyverse约定,使用户能够将一个函数的输出通过管道传递给另一个函数。此外,biorecap提供了一个单一的包装函数,该函数生成一个带时间戳的CSV文件和HTML报告,其中包含用户可配置主题领域中近期预印本的简短摘要。通过将LLM的优势与本地执行的灵活性和安全性相结合,biorecap代表了管理现代科学研究中信息过载的工具的进步。biorecap R包可在GitHub上获取,地址为https://github.com/stephenturner/biorecap,采用开源(MIT)许可证。

关键词

引用

@article{arxiv.2408.11707,
  title  = {biorecap: an R package for summarizing bioRxiv preprints with a local LLM},
  author = {Stephen D. Turner},
  journal= {arXiv preprint arXiv:2408.11707},
  year   = {2024}
}

备注

5 pages, 1 figure