Verba: 基于Weaviate的开源RAG聊天机器人

Verba: 智能检索增强生成的开源助手

在当今信息爆炸的时代,如何快速准确地从海量数据中检索并生成有价值的信息成为了一个巨大的挑战。为了解决这个问题,Weaviate公司开发了一款名为Verba的开源聊天机器人,它基于检索增强生成(RAG)技术,为用户提供了一种智能、高效的信息处理方式。

Verba简介

Verba是一款功能强大的个人助手,它利用检索增强生成(RAG)技术来查询和交互用户的数据。无论是本地部署还是云端部署,Verba都能帮助用户解决文档相关的问题,交叉引用多个数据点,或从现有知识库中获取洞察。Verba结合了最先进的RAG技术与Weaviate的上下文感知数据库,用户可以根据个人用例选择不同的RAG框架、数据类型、分块和检索技术以及LLM提供商。

Verba演示

Verba的主要特性

Verba提供了丰富的功能,使其成为一个全面而强大的RAG聊天机器人解决方案:

多样化的模型支持: Verba支持多种模型,包括Ollama的本地模型、HuggingFace的本地嵌入模型,以及Cohere、Anthropic和OpenAI的云端模型。
广泛的嵌入支持: 除了上述模型外,Verba还支持Weaviate、SentenceTransformers和VoyageAI的嵌入模型。
多种数据源支持: Verba可以处理多种数据格式,包括PDF、CSV/XLSX、.DOCX文件,还可以从GitHub和GitLab导入文件,甚至可以通过Firecrawl抓取网页。
先进的RAG特性: Verba具备混合搜索、自动完成建议、过滤、可定制元数据、异步摄取等功能,未来还计划添加高级查询、重排序和RAG评估等特性。
多样化的分块技术: Verba支持多种文本分块技术,包括基于标记、句子、语义的分块,以及针对HTML、Markdown、代码和JSON文件的特殊分块方法。
灵活的部署选项: Verba支持通过Docker部署,前端完全可定制,还提供了3D向量查看器。
支持多种RAG库: 目前支持LangChain,未来计划支持Haystack和LlamaIndex。

Verba的工作原理

Verba的工作流程主要包括以下几个步骤:

数据导入: 用户可以通过"Import Data"功能添加各种格式的文件或URL。Verba支持多种数据源,包括本地文件、GitHub/GitLab仓库,以及网页爬取。
数据处理: Verba使用先进的分块技术将导入的数据分割成适合处理的小块。这些技术包括基于标记、句子和语义的分块,以及针对特定文件类型(如HTML、Markdown、代码文件)的专门分块方法。
向量化: 使用选定的嵌入模型将文本块转换为向量表示。Verba支持多种嵌入模型,包括来自Weaviate、Ollama、HuggingFace、Cohere、VoyageAI和OpenAI的模型。
索引和存储: 处理后的向量数据被存储在Weaviate的上下文感知数据库中,以便快速检索。
查询处理: 当用户提出问题时,Verba首先将问题转换为向量,然后在数据库中检索最相关的文本块。
生成回答: 使用选定的语言模型(如OpenAI的GPT模型或Anthropic的Claude模型)基于检索到的相关文本块生成回答。
结果展示: Verba将生成的回答连同相关的文本块一起呈现给用户,提供了答案的来源和上下文。