本章节将以Qwen3-VL-4B-Instruct模型为例,为您介绍该模型的端侧运行流程。
此流程适用于量化后模型直接上板运行的场景,请您先阅读 端侧运行准备 章节做好端侧运行准备并了解模型和示例的对应关系。
vlm_demo当前仅支持读取单张图片,未来版本会支持多图输入。
在oellm_runtime目录中,VLM示例使用到的文件和文件夹如下所示:
端侧运行配置文件{model}_config.json的用户可配置参数及其说明:
| 参数名称 | 参数说明 | 可选/必选 |
|---|---|---|
model_type | 参数描述:模型类型 参数类型: string取值范围: Qwen2.5-VL,Qwen3-VL,InternVL | 必选 |
model_dir | 参数描述:板端模型存放的文件夹路径 参数类型: string | 必选 |
vit_model_file | 参数描述:vision模型文件名 参数类型: string | 必选 |
llm_model_file | 参数描述:language模型文件名 参数类型: string | 必选 |
embed_weight_file_path | 参数描述:嵌入权重文件名 参数类型: string | 必选 |
vit_bpu_core | 参数描述:vision模型使用的bpu核, 设定多个值时按照 [0,1,2,3]填写参数类型: [int] | 必选 |
prefill_bpu_core | 参数描述:language模型prefill阶段使用的bpu核, 设定多个值时按照 [0,1,2,3]填写参数类型: [int] | 必选 |
decode_bpu_core | 参数描述:language模型decode阶段使用的bpu核, 设定多个值时按照 [0,1,2,3]填写参数类型: [int] | 必选 |
vocabulary_path | 参数描述:Tokenizer配置文件路径 参数类型: string | 必选 |
其余配置参数请勿自行修改,否则会导致模型推理异常。
qwen3vl_4b_config.json参考配置示例:
示例提供运行脚本run_vlm.sh,运行指令参考:
该脚本内容如下:
可执行文件的参数信息:
会话控制指令说明:
| 指令 | 说明 |
|---|---|
<prompt> | 输入文本,提供用户prompt信息 |
/image <image_path> | 加载本地图片,会替换先前已加载图片 |
regen | 重新生成本次对话结果 |
reset | 清除缓存,用于清除已加载图像信息 |
exit | 退出程序 |
方式1. 初始化模型的同时加载图片,例如:
方式2. 在[User] <<<提示后,输入/image和本地图片路径,例如:
在[User] <<<提示后,输入文本内容即可,例如: