marqo

marqo

向量搜索引擎 ,实现文本和图像内容的矢量化处理及检索

Marqo 作为全面的端到端向量搜索引擎,不仅实现文本和图像内容的矢量化处理及检索,更支持最新机器学习模型。其简洁的API设计允许开发者轻松实行多样的语义搜索操作,且无需独立处理数据嵌入问题。Marqo 的云服务部署有效降低响应时间,同时提供可伸缩的计算资源、持续可靠的服务及全时技术支持。

Marqo向量搜索机器学习数据索引嵌入生成Github开源项目

项目介绍:Marqo

Marqo是什么?

Marqo不仅仅是一个向量数据库,它是一个为文本和图像设计的端到端向量搜索引擎。通过一个简化的API,Marqo能够开箱即用地处理向量的生成、存储和检索,开发者无需自带嵌入模型。

为什么选择Marqo?

向量相似性不足以满足向量搜索的需求。一个完整的向量搜索系统不仅需要一个数据库,还需要机器学习模型的部署和管理,对输入的预处理和转换,以及无需重新训练模型即可修改搜索行为的能力。Marqo集成了这些功能,帮助开发者轻松地将向量搜索嵌入到他们的应用中。

嵌入生成与向量搜索结合的必要性

传统的向量数据库是专注于向量相似性的单一组件,需要另外生产向量、管理机器学习模型以及对输入的协调和处理。Marqo通过提供“文档进-文档出”的方式简化了这个过程,处理文本和图像的预处理、内容嵌入、元数据存储以及推理和存储的部署。

Marqo的核心功能

  1. 先进的嵌入技术:Marqo使用了最先进的机器学习模型,可以在CPU和GPU上运行。

  2. 高效性能:嵌入保存在内存中的HNSW索引中,提供了超快的搜索速度,并支持海量文档索引的横向扩展。

  3. 文档进-文档出模式:自动处理向量生成、存储和检索,支持复杂的语义搜索查询以及搜索结果的过滤。

  4. 完整的云管理服务:提供低延迟的Marqo部署、高可用性、7x24小时支持并实现了访问控制。

快速上手

要开始使用Marqo,首先需要Docker,然后通过以下步骤即可快速进行向量搜索:

  1. 下载并运行Marqo的Docker镜像。
  2. 安装Marqo客户端。
  3. 创建索引并添加文档。
  4. 使用简单的Python代码进行搜索操作。
import marqo mq = marqo.Client(url='http://localhost:8882') mq.create_index("my-first-index", model="hf/e5-base-v2") mq.index("my-first-index").add_documents([ {"Title": "The Travels of Marco Polo", "Description": "A 13th-century travelogue describing Polo's travels"}, {"Title": "Extravehicular Mobility Unit (EMU)", "Description": "The EMU is a spacesuit that provides environmental protection, mobility, life support, and communications for astronauts", "_id": "article_591"} ], tensor_fields=["Description"]) results = mq.index("my-first-index").search(q="What is the best outfit to wear on the moon?")

多模式与跨模式搜索

Marqo支持使用CLIP模型进行多模式搜索,能够组合文本与图像,从而实现更复杂的搜索体验。例如,使用图片链接进行搜索,非常适用于需要图文配对检索的应用场景。

与其他工具的集成

Marqo与多种AI和数据处理框架进行了集成,比如Haystack、Griptape和Langchain等,通过这些集成,可以在各种NLP应用中使用Marqo作为文档存储进行搜索增强。

结语

Marqo正致力于为更广泛的开发者社区提供可访问的张量搜索解决方案。无论是构建新的应用还是集成现有系统,Marqo都为开发者提供了强大的工具和支持。更多信息请访问Marqo官网文档页面

编辑推荐精选

博思AIPPT

博思AIPPT

AI一键生成PPT,就用博思AIPPT!

博思AIPPT,新一代的AI生成PPT平台,支持智能生成PPT、AI美化PPT、文本&链接生成PPT、导入Word/PDF/Markdown文档生成PPT等,内置海量精美PPT模板,涵盖商务、教育、科技等不同风格,同时针对每个页面提供多种版式,一键自适应切换,完美适配各种办公场景。

AI办公办公工具AI工具博思AIPPTAI生成PPT智能排版海量精品模板AI创作热门
潮际好麦

潮际好麦

AI赋能电商视觉革命,一站式智能商拍平台

潮际好麦深耕服装行业,是国内AI试衣效果最好的软件。使用先进AIGC能力为电商卖家批量提供优质的、低成本的商拍图。合作品牌有Shein、Lazada、安踏、百丽等65个国内外头部品牌,以及国内10万+淘宝、天猫、京东等主流平台的品牌商家,为卖家节省将近85%的出图成本,提升约3倍出图效率,让品牌能够快速上架。

iTerms

iTerms

企业专属的AI法律顾问

iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。

SimilarWeb流量提升

SimilarWeb流量提升

稳定高效的流量提升解决方案,助力品牌曝光

稳定高效的流量提升解决方案,助力品牌曝光

Sora2视频免费生成

Sora2视频免费生成

最新版Sora2模型免费使用,一键生成无水印视频

最新版Sora2模型免费使用,一键生成无水印视频

Transly

Transly

实时语音翻译/同声传译工具

Transly是一个多场景的AI大语言模型驱动的同声传译、专业翻译助手,它拥有超精准的音频识别翻译能力,几乎零延迟的使用体验和支持多国语言可以让你带它走遍全球,无论你是留学生、商务人士、韩剧美剧爱好者,还是出国游玩、多国会议、跨国追星等等,都可以满足你所有需要同传的场景需求,线上线下通用,扫除语言障碍,让全世界的语言交流不再有国界。

讯飞绘文

讯飞绘文

选题、配图、成文,一站式创作,让内容运营更高效

讯飞绘文,一个AI集成平台,支持写作、选题、配图、排版和发布。高效生成适用于各类媒体的定制内容,加速品牌传播,提升内容营销效果。

热门AI辅助写作AI工具讯飞绘文内容运营AI创作个性化文章多平台分发AI助手
TRAE编程

TRAE编程

AI辅助编程,代码自动修复

Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。

AI工具TraeAI IDE协作生产力转型热门
商汤小浣熊

商汤小浣熊

最强AI数据分析助手

小浣熊家族Raccoon,您的AI智能助手,致力于通过先进的人工智能技术,为用户提供高效、便捷的智能服务。无论是日常咨询还是专业问题解答,小浣熊都能以快速、准确的响应满足您的需求,让您的生活更加智能便捷。

imini AI

imini AI

像人一样思考的AI智能体

imini 是一款超级AI智能体,能根据人类指令,自主思考、自主完成、并且交付结果的AI智能体。

下拉加载更多