Triton推理服务器06-安装用户端软件

在前面的文章中，已经带着读者创建好Triton的模型仓、安装并执行Triton推理服务器软件，接下来就是要安装Triton用户端软件，对服务器提出推理请求（requests），才能触发服务器执行推理计算的任务。

由于用户端的功能是在向服务器提出推理需求，本身并不参与计算，因此不用考虑设备性能或者是否装载GPU设备，即便是一台最基本的Windows上网本都能使用，只要安装合适的用户端软件就可以。

为了适应更多种使用场景，Triton用户端支持C++/Python/Java/GO等通用性高的在编程语言，底层还支持HTTP/REST与gRPC通讯协议，甚至还支持SSL/TLS加密选项，以及多种在线压缩（on-wire compression）算法，内容是相当丰富并且多元化，完整的内容可以在https://github.com/triton-inference-server/client开源仓里找到，本文只先提供Python用户端的部分。

与服务器的安装方式类似，NVIDIA提供以下4种安装方式：

源代码编译：

这种方式需要从https://github.com/triton-inference-server/client下载源代码，执行步骤在https://github.com/triton-inference-server/client#build-using-cmake环节，通常会遇到的麻烦是步骤繁琐，并且出错率较高，因此并不推荐使用这个方法。

可执行文件：

Triton开发团队为使用者提供编译好的可执行文件，包括Ubuntu 20.04、Jetpack余Windows平台，可以在https://github.com/triton-inference-server/server/releases/ 上获取，每个版本都会提供对应NGC容器的版本，如下图：

Triton推理服务器06-安装用户端软件

然后到下面的“Assets”选择合适的版本：

Triton推理服务器06-安装用户端软件

以装载Jetpack 5的Orin为例，就下载tritonserver2.26.0-jetpack5.0.2.tgz(1.13GB) 压缩文件到本机上，然后解压缩到指定目录下就可以，例如${HOME}/triton目录，会生成<backends>、<bin>、<clients>、<include>、<lib>、<qa>等6个目录，用户端的可执行文件在<clients/bin>目录下，目前有将近30个终端功能。

现在要使用image_client这个最基础的识别终端软件，对qa/images/mug.jpg（如下图）这张图片进行推理。

Triton推理服务器06-安装用户端软件

请先确认Triton服务器软件已经启动并且处于等待请求的状态，现在请开启另一个命令终端，输入以下指令提交推理请求：

$ $	cd ${HOME}/triton ./clients/bin/image_client -m densenet_onnx -c 3 -s INCEPTION qa/images/mug.jpg

这道指令使用clients/bin/image_client终端，请求服务器使用densenet_onnx推理模型，对qa/images/mug.jpg（图下图）进行识别。这里的参数“-c 3”是要求识别的分类最多可以到3项，指令执行结果如下，表示正确识别图像的3个可能分类：

Triton推理服务器06-安装用户端软件

其他终端软件会在后面文章中说明。

Docker容器版用户端：

在安装Triton服务器软件一文中已经提过，可以在NGC服务器上可以找到Triton的相关镜像，其中year-xy-py3-sdk里就有提供用户端软件。这里同样在Jetson AGX Orin上用22.09-py3-sdk镜像做示范，请先执行以下指令下载这个镜像并进入这个容器：

$ $	docker pull nvcr.io/nvidia/tritonserver:22.09-py3-sdk docker run -it --rm --net=host nvcr.io/nvidia/tritonserver:22.09-py3-sdk

进入容器之后，执行以下指令进行图像推理任务：

$	./install/bin/image_client -m densenet_onnx -c 3 -s INCEPTION ./images/mug.jpg

执行结果应该会看到如下截屏的内容，表示在这里对Triton服务器提出的推理请求，得到正确的计算结果。

Triton推理服务器06-安装用户端软件

同样的，在容器内install/bin目录下也有将近30个编译好的终端可执行文件，内容与前一项压缩文件所提供的内容是一致的，在下一篇文章中进行说明。

Python版用户端：

由于Python是目前在深度学习领域中最重要的编程语言之一，NVIDIA为Triton提供可直接安装的Python库，只要执行以下指令就能轻松安装：

$	pip3 install tritonclient[all] attrdict -i https://pypi.tuna.tsinghua.edu.cn/simple

这个过程会安装以下内容：

http
grpc [ service_pb2, service_pb2_grpc, model_config_pb2]
utils [ Linux 发行版将包括 shared_memory 和 cuda_shared_memory]

如果您在前面下载第2部分的压缩文件并且解压缩，在该目录之下的clients/python里就提供30多个Triton的Python用户端脚本；如果没有下载前面的压缩文件，现在可以之下以下指令去复制Triton项目的client开源仓：

$	git clone https://github.com/triton-inference-server/client

然后在client开源仓下的src/python/examples里有30多个Triton的Python用户端脚本。

现在进到Python用户端脚本的目录里，执行以下指令：

$	python3 image_client.py -m inception_graphdef -s INCEPTION ${HOME}/triton/server/qa/images/mug.jpg

执行后会显示如下的结果：

Triton推理服务器06-安装用户端软件

得到推理的结果为“COFEE MUG”为正确的，表示Triton的Python用户端使用环境是正确的。

以上介绍4种安装Triton用户端软件的方式，本文只使用image_client这个最简单的图像分类用户端工具，另外还有几个比较重要的用户端工具，后面会有针对性的深入讲解与示范。【完】

来源：业界供稿

Triton

0赞

好文章，需要你的鼓励

Triton推理服务器06-安装用户端软件

来源：业界供稿

2023

01/03

16:56

分享

点赞

“4个9”韧性的背后，西云数据以技术与运营加速企业数字化创新

Google力推手机AI功能引发关注

Meta发布AI翻译功能，支持脸书和Instagram内容实时转换

HPE发布Nvidia Blackwell驱动的AI服务器，抢占AI市场需求

ISACA推出AI安全管理高级认证项目

谷歌推出智能体SOC系统提升安全事件响应速度

Lumen升级400GB数据中心连接基础设施助力AI发展

AI和流媒体推动，2030年面临"网络危机"

Pine64停产Pro手机转向RISC-V业务

日立Vantara将VSP One块存储扩展至Azure云平台

Finchetto光学数据包交换机：光无法存储的技术挑战与突破

Python开发者调查显示增长强劲，但基金会资金面临困境

Triton推理服务器11-模型类别与调度器(1)

Triton推理服务器10-模型并发执行

Triton推理服务器09-为服务器添加模型

Triton推理服务器08-用户端其他特性

Triton推理服务器07-image_client用户端参数

Triton推理服务器06-安装用户端软件

Triton推理服务器05-安装服务器软件

Triton推理服务器04-创建模型仓

Triton推理服务器02-功能与架构简介

Triton推理服务器01-应用概论

如果您非常迫切的想了解IT领域最新产品与技术信息，那么订阅至顶网技术邮件将是您的最佳途径之一

关于AI Agent落地，李开复强调了两件事：“价值交付”和“一把手工程”

AWS re:Inforce：费城这天不只拼进球，还拼生成式AI安全

在欧洲之门马德里，我们再次见证了SAP激活企业增长的“飞轮”

IEEE专家委员胡凝：消解AI幻觉“阴影”，洞见“超级个体”价值锚点

关注官方公众号

关注官方微博

关注官方喜马拉雅

友情链接

业界热点: