ONNX Runtime中OpenVINO与DirectML执行提供器的兼容性问题解析

2025-05-13 16:40:03作者：宣利权Counsellor

microsoft/onnxruntime: 是一个用于运行各种机器学习模型的开源库。适合对机器学习和深度学习有兴趣的人，特别是在开发和部署机器学习模型时需要处理各种不同框架和算子的人。特点是支持多种机器学习框架和算子，包括 TensorFlow、PyTorch、Caffe 等，具有高性能和广泛的兼容性。

项目地址：https://gitcode.com/GitHub_Trending/on/onnxruntime

问题背景

在ONNX Runtime深度学习推理框架中，执行提供器(Execution Provider, EP)是支持不同硬件加速后端的关键组件。近期有开发者在Windows平台上构建了集成OpenVINO和DirectML(DML)两种执行提供器的ONNX Runtime 1.19.0版本，虽然构建过程顺利完成，但在实际使用中遇到了一个特殊的技术问题。

现象描述

开发者成功构建了包含OpenVINO 2024.3和DirectML的ONNX Runtime版本，并通过Python wheel包进行安装。系统能够正确识别并注册这两个执行提供器，但在尝试同时使用它们时出现了"Execution type OpenVINOExecutionProvider doesn't support memcpy"的错误。

具体表现为：

单独使用DirectML执行提供器时工作正常
OpenVINO执行提供器也能被正确识别
但当尝试在同一个推理会话(InferenceSession)中同时指定这两个提供器时，系统抛出内存拷贝(memcpy)不支持的异常

技术分析

经过深入排查，发现问题源于ONNX Runtime执行提供器的协同工作机制。虽然ONNX Runtime文档中说明可以通过优先级列表指定多个执行提供器，让系统自动选择最合适的提供器执行每个节点，但这种机制在OpenVINO和DirectML这两个特定提供器之间存在兼容性问题。

根本原因可能涉及以下几个方面：

内存管理差异：OpenVINO和DirectML可能采用了不同的内存分配和管理策略，导致在尝试在两者之间传输数据时出现不兼容
执行上下文隔离：这两个提供器可能要求完全独立的执行上下文，不能很好地共享内存资源
架构限制：早期版本中可能存在过于严格的检查机制，限制了跨提供器的内存操作

解决方案

开发者最终找到了有效的解决方法：

单独使用执行提供器：为OpenVINO和DirectML分别创建独立的推理会话

# OpenVINO专用会话
openvino_options = [{'device_type': 'GPU', 'cache_dir': 'cachedir'}]
openvino_session = onnxruntime.InferenceSession(
    "model.onnx", 
    providers=['OpenVINOExecutionProvider'],
    provider_options=openvino_options
)

# DirectML专用会话
dml_session = onnxruntime.InferenceSession(
    "model.onnx",
    providers=['DmlExecutionProvider']
)