Can someone tell me how to benchmark LLama_v2_7b model on jetson Orin AGX with different quantization methods and also how to get perplexity score
Related topics
| Topic | Replies | Views | Activity | |
|---|---|---|---|---|
| Seeking Advice on Running Quantized Large Language Models on Jetson AGX Xavier | 1 | 1320 | March 19, 2024 | |
| The token speed of qwen 2.5 vl 3b model is very lower on Jeston AGX Orin | 2 | 727 | September 22, 2025 | |
| Jetson nano 8G Run VLM Benchmark | 3 | 625 | March 5, 2025 | |
| Running llama3.3 or llama4 on Jetson AGX Orin Developer Kit (64 GB) | 7 | 1380 | May 12, 2025 | |
| Problem: slow LLM inference speed on Jetson AGX Orin 64GB | 1 | 1025 | April 8, 2025 | |
| LLaMa 2 LLMs w/ NVIDIA Jetson and textgeneration-web-ui | 86 | 26974 | May 10, 2024 | |
| Benchmarking VLM on Orin | 6 | 461 | March 2, 2026 | |
| Running LLMs with TensorRT-LLM on Nvidia Jetson AGX Orin Dev Kit | 1 | 1017 | December 8, 2024 | |
| LLM library recomendations for maximum token speeds | 11 | 1091 | March 16, 2026 | |
| Gen AI Benchmarking: LLMs and VLMs on Jetson | 4 | 286 | November 5, 2025 |