看啥推荐读物
专栏名称: 计算机视觉研究院
主要由来自于大学的研究生组成的团队,本平台从事机器学习与深度学习领域,主要在人脸检测与识别,多目标检测研究方向。本团队想通过计算机视觉战队平台打造属于自己的品牌,让更多相关领域的人了解本团队,结识更多相关领域的朋友,一起来学习,共同进步!
今天看啥  ›  专栏  ›  计算机视觉研究院

轻量级模型,重量级性能,TinyLlama、LiteLlama小模型火起来了

计算机视觉研究院  · 公众号  ·  · 2024-03-27 14:29
点击蓝字关注我们关注并星标从此不迷路计算机视觉研究院公众号ID|计算机视觉研究院学习群|扫码在主页获取加入方式论文地址:https://arxiv.org/pdf/2401.02385.pdf项目地址:https://github.com/jzhang38/TinyLlama/blob/main/README_zh-CN.md计算机视觉研究院专栏Column of Computer Vision Institute小身板,大能量。当大家都在研究大模型(LLM)参数规模达到百亿甚至千亿级别的同时,小巧且兼具高性能的小模型开始受到研究者的关注。小模型在边缘设备上有着广泛的应用,如智能手机、物联网设备和嵌入式系统,这些边缘设备通常具有有限的计算能力和存储空间,它们无法有效地运行大型语言模型。因此,深入探究小型模型显得尤为重要。接下来我们要介绍的这两项研究,可能满足你对小模型的需求。TinyLlama-1.1B来自新加坡科技设计大学(SUTD)的研究者近日推出了 TinyLlama, ………………………………

原文地址:访问原文地址
快照地址: 访问文章快照