ChatGPT开源平替大盘点：从自主模型到Alpaca模式

FindTheChatGPTer

ChatGPT开源平替大盘点:从自主模型到Alpaca模式

随着ChatGPT的爆火,人工智能大语言模型成为了科技领域的焦点。然而,由于OpenAI并未开源ChatGPT,众多研究机构和开发者开始寻找开源替代方案。本文将全面介绍目前主流的ChatGPT开源平替项目,包括自主研发的大模型和基于LLaMA等的微调模型,为读者提供AI大模型领域的全景图。

一、自主模型篇

这一类模型采用非LLAMA等微调方式,自主设计或优化GPT、T5等模型架构,并实现从预训练、监督微调到强化学习的全周期过程。

ChatYuan

ChatYuan(元语AI)是由元语智能开发团队推出的对话大模型,被称为国内最早的功能型对话大模型之一。它支持写文章、写作业、写诗歌、中英文翻译等任务,在法律等特定领域也可以提供相关信息。ChatYuan目前只支持中文,底层采用7亿参数规模的T5模型,并基于PromptClue进行了监督微调。

ChatYuan架构

ChatYuan的开源地址为:https://github.com/clue-ai/ChatYuan

Colossal AI

最近,ColossalAI开源了他们的ChatGPT实现,分享了完整的三步策略,实现了ChatGPT核心的技术路线。这三个步骤包括:

SFT监督微调阶段
奖励模型(RM)训练阶段
强化学习(RLHF)阶段

ColossalAI的开源为研究人员提供了一个完整的ChatGPT复现框架。

Colossal AI架构

Colossal AI的开源地址为:https://github.com/hpcaitech/ColossalAI

ChatGLM

ChatGLM是清华大学技术成果转化公司智谱AI开源的对话模型,支持中英两种语言,目前开源了62亿参数量的模型。ChatGLM在模型架构上进行了优化,降低了部署和应用门槛,实现了大模型在消费级显卡上的推理应用。

ChatGLM实现了ChatGPT的强化学习人类对齐策略,使生成效果更贴近人类价值。它的能力域包括自我认知、提纲写作、文案写作、邮件写作助手、信息抽取、角色扮演、评论比较、旅游建议等。

ChatGLM示例

ChatGLM的开源地址为:https://github.com/THUDM/ChatGLM-6B

最近,该团队还开源了ChatGLM的多模态版本VisualGLM-6B,支持图像、中文和英文的多模态对话。VisualGLM-6B依靠来自CogView数据集的30M高质量中文图文对和300M经过筛选的英文图文对进行预训练,较好地将视觉信息对齐到ChatGLM的语义空间。

PaLM-rlhf-pytorch

PaLM-rlhf-pytorch号称首个开源ChatGPT平替项目,其基本思路是基于谷歌语言大模型PaLM架构,以及使用从人类反馈中强化学习的方法(RLHF)。PaLM是谷歌在2022年4月发布的5400亿参数全能大模型,基于Pathways系统训练。它可以完成写代码、聊天、语言理解等任务,并且在大多数任务上具有强大的少样本学习性能。

PaLM架构

PaLM-rlhf-pytorch的开源地址为:https://github.com/lucidrains/PaLM-rlhf-pytorch

OpenFlamingo

OpenFlamingo是一个对标GPT-4、支持大型多模态模型训练和评估的框架,由非盈利机构LAION重磅开源发布,是对DeepMind的Flamingo模型的复现。目前开源的是基于LLaMA的OpenFlamingo-9B模型。

Flamingo模型在包含交错文本和图像的大规模网络语料库上进行训练,具备上下文少样本学习能力。OpenFlamingo实现了原始Flamingo中提出的相同架构,在一个新的多模态C4数据集的5M样本和LAION-2B的10M样本上训练而来。

OpenFlamingo示例

OpenFlamingo的开源地址为:https://github.com/mlfoundations/open_flamingo

MOSS

MOSS是复旦大学发布的对话模型,支持插件化,如解方程、搜索等。MOSS的参数量为16B,在约七千亿中英文以及代码单词上预训练得到,后续经过对话指令微调、插件增强学习和人类偏好训练,具备多轮对话能力及使用多种插件的能力。

MOSS示例

MOSS的开源地址为:https://github.com/OpenLMLab/MOSS

mPLUG-Owl

mPLUG-Owl是一个对标GPT-4的开源多模态大模型,延续了mPLUG系列的模块化训练思想。目前开源了7B参数量的模型,同时首次针对视觉相关的指令理解提出一个全面的测试集OwlEval。通过人工评测对比了已有模型,包括LLaVA、MiniGPT-4等工作,mPLUG-Owl展示出更优的多模态能力,尤其在多模态指令理解能力、多轮对话能力、知识推理能力等方面表现突出。

mPLUG-Owl示例