Triton v2.7.0 adds Java/Scala gRPC clients, TFServing/TorchServe perf_analyzer support, and YAML-based Model Analyzer configuration.
$ git clone --branch v2.7.0 https://github.com/triton-inference-server/server.git # already have the repo? check out this version: $ git checkout v2.7.0
- ›Extends
perf_analyzerto work with TFServing and TorchServe, enabling benchmarking across non-Triton serving backends. - ›Model Analyzer parameters and test model configurations can now be specified via a YAML configuration file.
- ›Model Analyzer now reports performance metrics for end-to-end latency and CPU memory usage.
- ›Adds example Java and Scala clients based on the gRPC-generated API.
- ›Alpha Windows release (
tritonserver2.7.0-win.zip) ships with TensorRT 7.2.2 support and a GRPC endpoint.
+1 moreshow less
- ›JetPack 4.5 release (
tritonserver2.7.0-jetpack4.5.tgz) adds support for TensorFlow 2.4.0, TensorFlow 1.15.5, TensorRT 7.1, Custom backends, ensembles, and system shared memory on Jetson.