This article guides you through the process of sideloading models required for Procyon AI Text Generation Benchmark. Note that an active internet connection is still required to run the test.
TABLE OF CONTENTS
- Models for workload version 1.1.228
- Models for macOS version 2.1.59
- Installing the Models
- Legacy models
- Models for OpenVINO NPU 2026.2 Runtime Update (Workload 1.0.216)
- Models for OpenVINO GPU 2026.2 Runtime Update (Workload 1.0.216)
- Models for OpenVINO NPU 2026.1 Runtime Update (Workload 1.0.191)
- Models for OpenVINO GPU 2026.1 Runtime Update (Workload 1.0.191)
- Models for OpenVINO NPU 2025.4 Runtime Update (Workload 1.0.152)
- Models for Qualcomm Genie NPU Runtime (Workload 1.0.152)
- Models for OpenVINO GPU 2025.2 Runtime Update (Workload 1.0.96 & 1.0.152)
- Models for OpenVINO GPU 2025.0 Runtime Update (Workload 1.0.82)
- Models for OpenVINO Runtime (launch version, Workload 1.0.73)
Models for workload version 1.1.228
Models for GPU, ONNX Runtime
| Model | Download Link |
| Phi-3.5-mini-instruct-onnx-int4 | benchmarks.ul.com/downloads/onnxdml_Phi-3.5-mini-instruct-onnx-int4.zip |
| Mistral-7B-Instruct-v0.2-onnx-int4 | benchmarks.ul.com/downloads/onnxdml_mistral-7b-instruct-v0.2-ONNX.zip |
| Llama-3_1-8b-instruct-onnx-int4 | benchmarks.ul.com/downloads/onnxdml_llama-3_1-8b-instruct-onnx-int4.zip |
| Llama-2-13b-chat-hf-onnx-int4 | benchmarks.ul.com/downloads/onnxdml_Llama-2-13b-chat-hf-onnx-int4.zip |
Models for Intel GPUs, OpenVINO 2026.3 Runtime
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_3_1_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_3_1_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| Llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_3_1_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_3_1_Llama-2-13b-chat-hf-ov-int4.zip |
Models for AMD NPUs, ONNX VitisAI Runtime
| Model | Download Link |
| Phi-3.5-mini-instruct-int4-hybrid_prefill | benchmarks.ul.com/downloads/npu_onnxvaip_phi-3.5-mini-instruct-int4-hybrid_prefill.zip |
| Mistral-7B-Instruct-v0.2-int4-npuonly | benchmarks.ul.com/downloads/npu_onnxvaip_Mistral-7B-Instruct-v0.2-int4_npuonly.zip |
| Mistral-7B-Instruct-v0.2-int4-hybrid_prefill | benchmarks.ul.com/downloads/npu_onnxvaip_Mistral-7B-Instruct-v0.2-int4-hybrid_prefill.zip |
| Llama-3_1-8b-instruct-int4-npuonly | benchmarks.ul.com/downloads/npu_onnxvaip_Llama-3.1-8B-Instruct-int4_npuonly.zip |
| Llama-3_1-8b-instruct-int4-hybrid_prefill | benchmarks.ul.com/downloads/npu_onnxvaip_Llama-3.1-8B-Instruct-int4-hybrid_prefill.zip |
Models for Intel NPUs, OpenVINO 2026.3 Runtime
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_3_1_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_3_1_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| Llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_3_1_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_3_1_Llama-2-13b-chat-hf-ov-int4.zip |
Models for Qualcomm NPUs, Genie Runtime
| Model | Download Link |
| Phi-3.5-mini-instruct | benchmarks.ul.com/downloads/npu_qualgenie_2_43_1_Phi-3.5-mini-instruct.zip |
| Llama-3_1-8b-instruct | benchmarks.ul.com/downloads/npu_qualgenie_2_43_1_Llama-3.1-8B-Instruct.zip |
| Phi-3.5-mini-instruct (X2 Elite) | benchmarks.ul.com/downloads/npu_qualgenie_2_43_1_Phi-3.5-mini-instruct_xe2.zip |
| llama-3_1-8b-instruct (X2 Elite) | benchmarks.ul.com/downloads/npu_qualgenie_2_43_1_Llama-3.1-8B-Instruct_xe2.zip |
Models for Nvidia GPUs, llama.cpp
| Model | Download Link |
| Phi-3.5-mini-instruct | benchmarks.ul.com/downloads/llamacpp_Phi-3.5-mini-instruct.zip |
| Mistral-7B-Instruct-v0.2 | benchmarks.ul.com/downloads/llamacpp_Mistral-7B-Instruct-v0.2.zip |
| Llama-3.1-8B-Instruct | benchmarks.ul.com/downloads/llamacpp_Llama-3.1-8B-Instruct.zip |
| Llama-2-13b-chat-hf | benchmarks.ul.com/downloads/llamacpp_Llama-2-13b-chat-hf.zip |
Models for macOS version 2.1.59
Models for Apple Silicon, MLX
| Model | Download Link |
| Phi-3.5-mini-instruct | benchmarks.ul.com/downloads/mlx_0_31_2_Phi-3.5-mini-instruct_int4.zip |
| awq_Mistral-7B-Instruct-v0.2_int4 | benchmarks.ul.com/downloads/mlx_0_31_2_awq_Mistral-7B-Instruct-v0.2_int4.zip |
| awq_Llama-3.1-8B-Instruct_int4 | benchmarks.ul.com/downloads/mlx_0_31_2_awq_Llama-3.1-8B-Instruct_int4.zip |
| awq_Llama-2-13b-chat-hf_int4 | benchmarks.ul.com/downloads/mlx_0_31_2_awq_Llama-2-13b-chat-hf_int4.zip |
Installing the Models
For Windows
You may choose to download individual models or all, based on your configuration and benchmarking needs.
1. By default, the benchmark is installed in
%ProgramData%\UL\Procyon\chops\dlc\ai-textgeneration-benchmark\
2. Create a subfolder named "models", if it does not exist;
%ProgramData%\UL\Procyon\chops\dlc\ai-textgeneration-benchmark\models
3. Unzip the downloaded models and copy them over to the models folder. Note that the extracted folders should not contain the prefix "zip_". The models directory with downloaded models should look like this;

For macOS
Unzip the downloaded models and copy them over to the models folder.
/Users/Shared/Library/UL/Procyon/AITextGeneration/models
Note that the extracted folders should not contain the prefix "zip_". The models directory with the downloaded phi model should look like this;

Legacy models
Models for Intel NPUs, OpenVINO 2026.2 Runtime (Workload 1.0.216)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_2_1_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_2_1_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_2_1_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_2_1_Llama-2-13b-chat-hf-ov-int4.zip |
Models for Intel GPUs, OpenVINO 2026.2 Runtime (Workload 1.0.216)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_2_1_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_2_1_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_2_1_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_2_1_Llama-2-13b-chat-hf-ov-int4.zip |
Models for Intel GPUs, OpenVINO 2026.1 Runtime (Workload 1.0.191)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_1_0_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_1_0_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_1_0_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/openvino_2026_1_0_Llama-2-13b-chat-hf-ov-int4.zip |
Models for Intel NPUs, OpenVINO 2026.1 Runtime (Workload 1.0.191)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_1_0_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_1_0_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_1_0_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2026_1_0_Llama-2-13b-chat-hf-ov-int4.zip |
Models for OpenVINO NPU 2025.4 Runtime Update (Workload 1.0.152)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2025_4_0_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2025_4_0_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2025_4_0_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/npu_openvino_2025_4_0_Llama-2-13b-chat-hf-ov-int4.zip |
Models for Qualcomm Genie NPU Runtime (Workload 1.0.152)
| Model | Download Link |
| Phi-3.5-mini-instruct | benchmarks.ul.com/downloads/npu_qualgenie_Phi-3.5-mini-instruct.zip |
| llama-3_1-8b-instruct | benchmarks.ul.com/downloads/npu_qualgenie_Llama-3.1-8B-Instruct.zip |
Models for OpenVINO GPU 2025.2 Runtime Update (Workload 1.0.96 & 1.0.152)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_2_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_2_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_2_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_2_Llama-2-13b-chat-hf-ov-int4.zip |
Models for OpenVINO GPU 2025.0 Runtime Update (Workload 1.0.82)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_0_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_0_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_0_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/openvino_2025_0_Llama-2-13b-chat-hf-ov-int4.zip |
Models for OpenVINO Runtime (launch version, Workload 1.0.73)
| Model | Download Link |
| Phi-3.5-mini-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_Phi-3.5-mini-instruct-ov-int4.zip |
| Mistral-7B-Instruct-v0.2-ov-int4 | benchmarks.ul.com/downloads/openvino_Mistral-7B-Instruct-v0.2-ov-int4.zip |
| llama-3_1-8b-instruct-ov-int4 | benchmarks.ul.com/downloads/openvino_llama-3_1-8b-instruct-ov-int4.zip |
| Llama-2-13b-chat-hf-ov-int4 | benchmarks.ul.com/downloads/openvino_Llama-2-13b-chat-hf-ov-int4.zip |