LLaMA-MoE是一个基于LLaMA和SlimPajama的开源混合专家(Mixture-of-Experts, MoE)模型系列。该项目旨在构建一个轻量级且人人可用的MoE模型。本文将为大家介绍LLaMA-MoE的主要特点、安装使用方法以及相关学习资源。
LLaMA-MoE通过以下两个步骤构建:
以下是使用LLaMA-MoE模型的简单示例:
import torch from transformers import AutoTokenizer, AutoModelForCausalLM model_dir = "llama-moe/LLaMA-MoE-v1-3_5B-2_8" tokenizer = AutoTokenizer.from_pretrained(model_dir, trust_remote_code=True) model = AutoModelForCausalLM.from_pretrained(model_dir, torch_dtype=torch.bfloat16, trust_remote_code=True) model.eval() model.to("cuda:0") input_text = "Suzhou is famous of" inputs = tokenizer(input_text, return_tensors="pt") inputs = inputs.to("cuda:0") pred = model.generate(**inputs, max_length=50, temperature=0.0) print(tokenizer.decode(pred.cpu()[0], skip_special_tokens=True))
conda create -n smoe python=3.11
pip3 install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118
pip install -r requirements.txt
pip install flash-attn==2.0.1 --no-build-isolation
git clone git@github.com:pjlab-sys4nlp/llama-moe.git
pip install -e .[dev]
详细的安装步骤请参考项目README。
LLaMA-MoE提供了多个版本的模型,包括3.0B和3.5B参数规模。以下是部分模型在各项任务上的表现:
模型 | 平均分 | SciQ | PIQA | WinoGrande | ARC-e | ARC-c | HellaSwag | LogiQA | BoolQ | LAMBADA | NQ | MMLU |
---|---|---|---|---|---|---|---|---|---|---|---|---|
LLaMA-MoE-3.0B | 55.5 | 84.2 | 77.5 | 63.6 | 60.2 | 40.9 | 70.8 | 30.6 | 71.9 | 66.6 | 17.0 | 26.8 |
LLaMA-MoE-3.5B (4/16) | 57.7 | 87.6 | 77.9 | 65.5 | 65.6 | 44.2 | 73.3 | 29.7 | 75.0 | 69.5 | 20.3 | 26.8 |
LLaMA-MoE-3.5B (2/8) | 57.6 | 88.4 | 77.6 | 66.7 | 65.3 | 43.1 | 73.3 | 29.6 | 73.9 | 69.4 | 19.8 | 27.0 |
完整的性能数据请查看项目README。
LLaMA-MoE项目为研究人员和开发者提供了一个轻量级且易于使用的混合专家模型。通过本文介绍的资源,读者可以快速了解项目的核心概念,并开始使用LLaMA-MoE进行实验和开发。欢迎大家探索这个有趣的项目,为NLP领域的发展贡献力量。
一站式AI创作平台
提供 AI 驱动的图片、视频生成及数字人等功能,助力创意创作
AI办公助手,复杂任务高效处理
AI办公助手,复杂任务高效处理。办公效率低?扣子空间AI助手支持播客生成、PPT制作、网页开发及报告写作,覆盖科研、商业、舆情等领域的专家Agent 7x24小时响应,生活工作无缝切换,提升50%效率!
AI数字人视频创作平台
Keevx 一款开箱即用的AI数字人视频创作平台,广泛适用于电商广告、企业培训与社媒宣传,让全球企业与个人创作者无需拍摄剪辑,就能快速生成多语言、高质量的专业视频。
AI辅助编程,代码自动修复
Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。
AI小说写作助手,一站式润色、改写、扩写
蛙蛙写作—国内先进的AI写作平台,涵盖小说、学术、社交媒体等多场景。提供续写、改写、润色等功能,助力创作者高效优化写作流程。界面简洁,功能全面,适合各类写作者提升内容品质和工作效率。