5. 已修复问题
D3000设备在从S3 Sleep或S4 Hibernate状态恢复过程中执行重启操作时,可能出现固件状态异常的问题。该问题已修复。
Qwen3.6系列模型与此前已适配的Qwen3.5系列模型输入shape配置不一致。该问题已修复。
使用简单数据集测试Qwen3-0.6B和Qwen3-1.7B 32K上下文模型时,可能出现测试精度较低的问题。该问题已修复。
Qwen3.5-0.8B和Qwen3.5-2B模型在推理场景下可能出现精度不符合预期的问题。该问题已修复。
ModelZoo示例模型YOLO26M存在性能下降的问题。该问题已修复。
ModelZoo示例模型GPT-OSS在特定问题输入下可能出现循环生成输出的问题。该问题已修复。
GPT-OSS模型使用4颗M50芯片进行Decode推理时,可能出现卡死的问题。该问题已修复。
Qwen3.6 Prefill模型在使用2颗M50芯片部署时,单独加载模型的程序退出时可能触发
ERROR: LeakSanitizer: detected memory leaks内存泄漏问题。该问题已修复。Qwen3.5-27B-MTP模型在配置256K上下文长度并使用2颗M50芯片进行Decode模型编译时,可能出现编译失败的问题。该问题已修复。
在双芯配置下运行Gemma4-26B-A4B模型时,推理生成数个token后可能出现输出乱码。该问题已修复。
MiniCPM-o多模态模型中的LLM子模块在输出
hidden_states时可能出现异常,表现为输出结果与参考结果的余弦相似度较低。该问题已修复。动态Resize功能在输入正确数据进行推理时,可能触发
xh2a_ipu_group_execute: group sync timeout错误,导致推理失败。该问题已修复。Qwen3.6-35B-A3B模型在配置448 x 448或896 x 896图像输入尺寸、W5A8量化精度、256K上下文长度,并使用2颗M50芯片进行Prefill推理时,可能出现卡死的问题。该问题已修复。
Qwen3.6-35B-A3B模型在W5A8量化精度的Decode配置下进行模型编译时,可能出现编译失败的问题。该问题已修复。
Qwen3-VL-8B模型在多Batch场景下,加载模型时可能失败。该问题已修复。
Qwen3.6-35B-A3B模型在W4A16量化精度配置下进行模型编译时,可能失败并返回
Build process failed.错误。该问题已修复。在LQ50 M.2 x86环境下,使用正确输入数据推理动态Resize模型时,可能返回
group sync timeout错误。该问题已修复。在LQ50 Duo设备上,使用W8A8量化的Qwen3.6-35B-A3B模型,如果上下文为256K、双M50芯片,Prefill 阶段可能出现卡死。该问题已修复。
在GPU环境下量化OpenVLA模型时,可能返回错误
RuntimeError: custom operator Slice output must not alias any inputs。该问题已修复。