VLM inference engine on Jetson Orin NX's SM87 architecture
Rust
1
10 commits
updated Aug 21, 2026

Iris: A Low-Latency Rust/CUDA Runtime for Vision-Language Model Inference.
Iris is built on top of Candle.
Environment: Jetson Orin NX 16 GB (SM87)
Author:
10 commits
Rust
80.8%
Cuda
11.3%
C++
7.7%
VLM inference engine on Jetson Orin NX's SM87 architecture
Rust
1
10 commits
updated Aug 21, 2026

Iris: A Low-Latency Rust/CUDA Runtime for Vision-Language Model Inference.
Iris is built on top of Candle.
Environment: Jetson Orin NX 16 GB (SM87)
Author:
10 commits
Rust
80.8%
Cuda
11.3%
C++
7.7%