Skip to content

framework

TensorRT Edge-LLM

NVIDIA's inference runtime for large language models on embedded Jetson-class hardware, covering quantized kernels, KV cache management and speculative decoding.

Known aliases

  • TensorRT Edge LLM

Relationships

No evidence-backed relationships are recorded.

Current clusters