Qualcomm® AI HubAI Hub

Profile Job Results

Jobs
jp4y80vvp
Results Ready
Name
grootn15_dit
Target Device
  • Arduino VENTUNO Q
  • Ubuntu 24.04
  • Qualcomm® Dragonwing™ IQ-8275 | QCS8275
Creator
ai-hub-support@qti.qualcomm.com
Input Specs
actions: float32[1, 16, 32]
vlm_proj_keys_7: float32[1, 32, 384, 48]
vlm_proj_keys_6: float32[1, 32, 384, 48]
vlm_proj_keys_5: float32[1, 32, 384, 48]
vlm_proj_keys_4: float32[1, 32, 384, 48]
vlm_proj_keys_3: float32[1, 32, 384, 48]
vlm_proj_keys_2: float32[1, 32, 384, 48]
vlm_proj_keys_1: float32[1, 32, 384, 48]
vlm_proj_keys_0: float32[1, 32, 384, 48]
state: float32[1, 1, 64]
cross_attention_mask: float32[1, 32, 49, 384]
vlm_proj_values_0: float32[1, 32, 384, 48]
vlm_proj_values_1: float32[1, 32, 384, 48]
vlm_proj_values_2: float32[1, 32, 384, 48]
vlm_proj_values_3: float32[1, 32, 384, 48]
vlm_proj_values_4: float32[1, 32, 384, 48]
vlm_proj_values_5: float32[1, 32, 384, 48]
vlm_proj_values_6: float32[1, 32, 384, 48]
vlm_proj_values_7: float32[1, 32, 384, 48]
Completion Time
9/20/2026, 4:24:49 AM
Options
--qairt_version latest
Versions
  • QAIRT: v2.50.0.260828221209
  • QNN Backend API: 5.50.0
  • QNN Core API: 2.39.0
  • Qualcomm Linux: 24.04
  • AI Hub: aihub-2026.09.11.0
Estimated Inference Time
43.2 ms
Estimated Peak Memory Usage
38 ‑ 80 MB
Compute Units
NPU
2142
StageTimeMemory
First App Load
567 ms3‑4 MB
Subsequent App Load
480 ms3‑4 MB
Inference
43.2 ms38‑80 MB
QNNValue
context_options.htp_options.performance_modeBURST
default_graph_options.htp_options.optimizations[0].typeFINALIZE_OPTIMIZATION_FLAG
default_graph_options.htp_options.optimizations[0].value3.0
default_graph_options.htp_options.precisionFLOAT16
default_graph_options.htp_options.vtcm_size0

Sign up to run this model on a hosted Qualcomm® device!

Run on device