文章预览
点击蓝字 关注我们 关注并星标 从此不迷路 计算机视觉研究院 公众号ID | 计算机视觉研究院 学习群 | 扫码在主页获取加入方式 论文地址: https://arxiv.org/pdf/2401.02385.pdf 项目地址: https://github.com/jzhang38/TinyLlama/blob/main/README_zh-CN.md 计算机视觉研究院专栏 Column of Computer Vision Institute 小身板,大能量。 当大家都在研究大模型(LLM)参数规模达到百亿甚至千亿级别的同时,小巧且兼具高性能的小模型开始受到研究者的关注。 小模型在边缘设备上有着广泛的应用,如智能手机、物联网设备和嵌入式系统,这些边缘设备通常具有有限的计算能力和存储空间,它们无法有效地运行大型语言模型。因此,深入探究小型模型显得尤为重要。 接下来我们要介绍的这两项研究,可能满足你对小模型的需求。 TinyLlama-1.1B 来自新加坡科技设计大学(SUTD)的研究者近日
………………………………