serge

serge

开源自托管大语言模型聊天平台

Serge是一个开源的自托管大语言模型聊天平台,基于llama.cpp开发,支持运行GGUF模型。该项目采用SvelteKit构建前端,使用Redis存储聊天历史,并通过FastAPI和LangChain封装API。Serge目前支持超过30种主流大语言模型,如LLaMA、Mistral和Mixtral等。用户可以通过Docker或Kubernetes快速部署,无需API密钥即可搭建私有AI聊天服务。其简单的用户界面使得即使非技术用户也能轻松搭建和管理自己的AI聊天服务。

SergeLLaMAAI模型聊天界面自托管Github开源项目

Serge - 让LLaMA变得简单 🦙

许可证 Discord

Serge是一个使用llama.cpp制作的聊天界面,用于运行GGUF模型。无需API密钥,完全自托管!

  • 🌐 SvelteKit 前端
  • 💾 Redis 用于存储聊天历史和参数
  • ⚙️ FastAPI + LangChain 用于API,使用python绑定封装对llama.cpp的调用

🎥 演示:

demo.webm

⚡️ 快速开始

🐳 Docker:

docker run -d \ --name serge \ -v weights:/usr/src/app/weights \ -v datadb:/data/db/ \ -p 8008:8008 \ ghcr.io/serge-chat/serge:latest

🐙 Docker Compose:

services: serge: image: ghcr.io/serge-chat/serge:latest container_name: serge restart: unless-stopped ports: - 8008:8008 volumes: - weights:/usr/src/app/weights - datadb:/data/db/ volumes: weights: datadb:

然后,只需访问 http://localhost:8008 ,您可以在 http://localhost:8008/api/docs 找到API文档

🌍 环境变量

以下环境变量可用:

变量名描述默认值
SERGE_DATABASE_URL数据库连接字符串sqlite:////data/db/sql_app.db
SERGE_JWT_SECRET用于认证令牌加密的密钥。使用随机字符串uF7FGN5uzfGdFiPzR
SERGE_SESSION_EXPIRY用户需要重新认证的时间(分钟)60
NODE_ENVNode.js运行环境production

🖥️ Windows

确保您已安装Docker Desktop,配置了WSL2,并有足够的可用RAM来运行模型。

☁️ Kubernetes

wiki中可以找到在Kubernetes上设置Serge的说明。

🧠 支持的模型

类别模型
Alfred40B-1023
BioMistral7B
Code13B, 33B
CodeLLaMA7B, 7B-Instruct, 7B-Python, 13B, 13B-Instruct, 13B-Python, 34B, 34B-Instruct, 34B-Python
Codestral22B v0.1
Gemma2B, 1.1-2B-Instruct, 7B, 1.1-7B-Instruct
GorillaFalcon-7B-HF-v0, 7B-HF-v1, Openfunctions-v1, Openfunctions-v2
Falcon7B, 7B-Instruct, 40B, 40B-Instruct
LLaMA 27B, 7B-Chat, 7B-Coder, 13B, 13B-Chat, 70B, 70B-Chat, 70B-OASST
LLaMA 311B-Instruct, 13B-Instruct, 16B-Instruct
LLaMA Pro8B, 8B-Instruct
Med4270B
Medalpaca13B
MedicineChat, LLM
Meditron7B, 7B-Chat, 70B
Meta-LlaMA-38B, 8B-Instruct, 70B, 70B-Instruct
Mistral7B-V0.1, 7B-Instruct-v0.2, 7B-OpenOrca
MistralLite7B
Mixtral8x7B-v0.1, 8x7B-Dolphin-2.7, 8x7B-Instruct-v0.1
Neural-Chat7B-v3.3
Notus7B-v1
Notux8x7b-v1
Nous-Hermes 2Mistral-7B-DPO, Mixtral-8x7B-DPO, Mistral-8x7B-SFT
OpenChat7B-v3.5-1210
OpenCodeInterpreterDS-6.7B, DS-33B, CL-7B, CL-13B, CL-70B
OpenLLaMA3B-v2, 7B-v2, 13B-v2
Orca 27B, 13B
Phi 22.7B
Phi 3mini-4k-instruct, medium-4k-instruct, medium-128k-instruct
Python Code13B, 33B
PsyMedRP13B-v1, 20B-v1
Starling LM7B-Alpha
SOLAR10.7B-v1.0, 10.7B-instruct-v1.0
TinyLlama1.1B
Vicuna7B-v1.5, 13B-v1.5, 33B-v1.3, 33B-Coder
WizardLM2-7B, 13B-v1.2, 70B-v1.0
Zephyr3B, 7B-Alpha, 7B-Beta

可以通过提交GitHub问题来请求额外的模型。其他模型也可在Serge Models获取。

⚠️ 内存使用

如果没有足够的可用内存用于模型,LLaMA将会崩溃

💬 支持

需要帮助?加入我们的Discord

🧾 许可证

Nathan Sarrazin贡献者Serge是根据MIT许可证Apache-2.0授权的免费开源软件。

🤝 贡献

如果你发现了bug或有功能想法,欢迎提出问题或PR。

要在开发模式下运行Serge:

git clone https://github.com/serge-chat/serge.git cd serge/ docker compose -f docker-compose.dev.yml up --build

该解决方案将在端口5678上接受Python调试器会话。VSCode的示例launch.json:

{ "version": "0.2.0", "configurations": [ { "name": "远程调试", "type": "python", "request": "attach", "connect": { "host": "localhost", "port": 5678 }, "pathMappings": [ { "localRoot": "${workspaceFolder}/api", "remoteRoot": "/usr/src/app/api/" } ], "justMyCode": false } ] }

编辑推荐精选

博思AIPPT

博思AIPPT

AI一键生成PPT,就用博思AIPPT!

博思AIPPT,新一代的AI生成PPT平台,支持智能生成PPT、AI美化PPT、文本&链接生成PPT、导入Word/PDF/Markdown文档生成PPT等,内置海量精美PPT模板,涵盖商务、教育、科技等不同风格,同时针对每个页面提供多种版式,一键自适应切换,完美适配各种办公场景。

热门AI工具AI办公办公工具智能排版AI生成PPT博思AIPPT海量精品模板AI创作
潮际好麦

潮际好麦

AI赋能电商视觉革命,一站式智能商拍平台

潮际好麦深耕服装行业,是国内AI试衣效果最好的软件。使用先进AIGC能力为电商卖家批量提供优质的、低成本的商拍图。合作品牌有Shein、Lazada、安踏、百丽等65个国内外头部品牌,以及国内10万+淘宝、天猫、京东等主流平台的品牌商家,为卖家节省将近85%的出图成本,提升约3倍出图效率,让品牌能够快速上架。

iTerms

iTerms

企业专属的AI法律顾问

iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。

SimilarWeb流量提升

SimilarWeb流量提升

稳定高效的流量提升解决方案,助力品牌曝光

稳定高效的流量提升解决方案,助力品牌曝光

Sora2视频免费生成

Sora2视频免费生成

最新版Sora2模型免费使用,一键生成无水印视频

最新版Sora2模型免费使用,一键生成无水印视频

Transly

Transly

实时语音翻译/同声传译工具

Transly是一个多场景的AI大语言模型驱动的同声传译、专业翻译助手,它拥有超精准的音频识别翻译能力,几乎零延迟的使用体验和支持多国语言可以让你带它走遍全球,无论你是留学生、商务人士、韩剧美剧爱好者,还是出国游玩、多国会议、跨国追星等等,都可以满足你所有需要同传的场景需求,线上线下通用,扫除语言障碍,让全世界的语言交流不再有国界。

讯飞绘文

讯飞绘文

选题、配图、成文,一站式创作,让内容运营更高效

讯飞绘文,一个AI集成平台,支持写作、选题、配图、排版和发布。高效生成适用于各类媒体的定制内容,加速品牌传播,提升内容营销效果。

AI助手热门AI工具AI创作AI辅助写作讯飞绘文内容运营个性化文章多平台分发
TRAE编程

TRAE编程

AI辅助编程,代码自动修复

Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。

热门AI工具生产力协作转型TraeAI IDE
商汤小浣熊

商汤小浣熊

最强AI数据分析助手

小浣熊家族Raccoon,您的AI智能助手,致力于通过先进的人工智能技术,为用户提供高效、便捷的智能服务。无论是日常咨询还是专业问题解答,小浣熊都能以快速、准确的响应满足您的需求,让您的生活更加智能便捷。

imini AI

imini AI

像人一样思考的AI智能体

imini 是一款超级AI智能体,能根据人类指令,自主思考、自主完成、并且交付结果的AI智能体。

下拉加载更多