
简便的AI/ML模型生产环境部署工具
Truss是一个用于在生产环境中轻松打包和部署AI/ML模型的工具。它具有一次编写即可在任何地方运行的特性,确保开发和生产环境的一致性。支持所有主流的Python框架,如transformers、diffusers、PyTorch和TensorFlow等,并包含快速开发反馈机制。Truss由Baseten维护,提供便捷的云端部署,通过Baseten的API密钥即可轻松实现远程部署。
Truss 是一个旨在帮助用户简化在生产环境中部署 AI/ML 模型的工具。它为模型的编写、测试、打包和部署提供了一体化的解决方案,适用于各种 Python 框架,并且无需用户花费大量时间进行 Docker 和 Kubernetes 的配置。
Truss 提供了一个在开发和生产环境中表现一致的模型服务器,用户可以在该服务器上打包和测试模型代码、模型权重以及相关依赖项。这样一来,用户只需要编写一次代码,就能在不同环境中运行,非常方便实用。
通过 Truss,开发者能够在实施模型的过程中,借助实时重载服务器获得快速反馈。Truss 内置电池式模型服务环境,大大加速了开发迭代流程,使得跳过繁琐的 Docker 和 Kubernetes 配置成为可能。
无论是流行的 transformers 和 diffusers,还是主流的 PyTorch 和 TensorFlow,甚至是高性能的 TensorRT 和 Triton,Truss 均提供了多样化的框架支持。
Truss 的安装简单快捷,用户只需在终端中执行以下命令即可:
pip install --upgrade truss
接下来,我们以一个文本分类的管道为例,演示使用 Truss 快速打包并部署模型的过程。
要开始,就在终端中输入以下命令以创建一个 Truss:
truss init text-classification
根据提示,为你的 Truss 取一个名字,例如 Text classification。然后进入新创建的目录:
cd text-classification
Truss 中最核心的文件之一是 model/model.py,在此文件中,用户需要编写一个 Model 类,提供模型与模型服务器之间的接口。
在 Model 类中,用户必须实现两个方法:
load() 用于将模型加载到服务器上,仅在服务器启动或更新时运行一次。predict() 用于处理每次服务器调用的模型推理。以下是文本分类模型的完整 model/model.py 示例:
from transformers import pipeline class Model: def __init__(self, **kwargs): self._model = None def load(self): self._model = pipeline("text-classification") def predict(self, model_input): return self._model(model_input)
在 Truss 中,另一个重要的文件是 config.yaml,用于配置模型的服务环境。首先,需要指定模型的依赖项:
requirements: - torch==2.0.1 - transformers==4.30.0
其他配置可以保持默认,无需复杂更改。
Truss 提供了由 Baseten 维护的 ML 模型生产环境。用户可以将 Baseten 用作远程主机来托管模型,未来还将支持 AWS SageMaker 等其他平台。
为了在 Baseten 上远程托管模型,需要获取一个 Baseten API 密钥。用户可以通过 注册 Baseten 账号 获取免费试用的 API 密钥。
获得 API 密钥后,用户可以通过以下命令部署模型:
truss push
用户可以通过 Baseten 的模型仪表板实时监控模型的部署状态 。
部署完成后,可以在终端调用模型进行推理:
调用命令
truss predict -d '"Truss is awesome!"'
返回结果
[ { "label": "POSITIVE", "score": 0.999873161315918 } ]
Truss 由 Baseten 支持开发,并与全球的机器学习工程师协作完成。特别感谢来自 stability.ai 的 Stephan Auerhahn 和来自 Salad Technologies 的 Daniel Sarfati 的贡献。
Truss 欢迎各界的积极贡献,有意者可以查阅我们的[贡献指南]和[行为准则]。


企业专属的AI法律顾问
iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。


稳定高效的流量提升解决方案,助力品牌曝光
稳定高效的流量提升解决方案,助力品牌曝光


最新版Sora2模型免费使用,一键生成无水印视频
最新版Sora2模型免费使用,一键生成无水印视频


实时语音翻译/同声传译工具
Transly是一个多场景的AI大语言模型驱动的同声传译、专业翻译助手,它拥有超精准的音频识别翻译能力,几乎零延迟的使用体验和支持多国语言可以让你带它走遍全球,无论你是留学生、商务人士、韩剧美剧爱好者,还是出国游玩、多国会议、跨国追星等等,都可以满足你所有需要同传的场景需求,线上线下通用,扫除语言障碍,让全世界的语言交流不再有国界。


选题、配图、成文,一站式创作,让内容运营更高效
讯飞绘文,一个AI集成平台,支持写作、选题、配图、排版和发布。高效生成适用于各类媒体的定制内容,加速品牌传播,提升内容营销效果。


AI辅助编程,代码自动修复
Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。


最强AI数据分析助手
小浣熊家族Raccoon,您的AI智能助手,致力于通过先进的人工智能技术,为用户提供高效、便捷的智能服务。无论是日常咨询还是专业问题解答,小浣熊都能以快速、准确的响应满足您的需求,让您的生活更加智能便捷。


像人一样思考的AI智能体
imini 是一款超级AI智能体,能根据人类指令,自主思考、自主完成、并且交付结果的AI智能体。


AI数字人视频创作平台
Keevx 一款开箱即用的AI数字人视频创作平台,广泛适用于电商广告、企业培训与社媒宣传,让全球企业与个人创作者无需拍摄剪辑,就能快速生成多语言、高质量的专业视频。


一站式AI创作平台
提供 AI 驱动的图片、视频生成及数字人等功能,助力创意创作
最新AI工具、AI资讯
独家AI资源、AI项目落地

微信扫一扫关注公众号