aclmdlExecConfigAttr【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/getypedef enum { ACL_MDL_STREAM_SYNC_TIMEOUT 0, ACL_MDL_EVENT_SYNC_TIMEOUT, ACL_MDL_WORK_ADDR_PTR, ACL_MDL_WORK_SIZET, ACL_MDL_MPAIMID_SIZET, /** param reserved */ ACL_MDL_AICQOS_SIZET, /** param reserved */ ACL_MDL_AICOST_SIZET, /** param reserved */ ACL_MDL_MEC_TIMETHR_SIZET /** param reserved */ } aclmdlExecConfigAttr;表 1枚举项说明枚举项说明ACL_MDL_STREAM_SYNC_TIMEOUT在执行模型推理时控制Stream任务的超时时间。该属性值为INT32类型。取值说明如下-1表示永久等待默认永久等待。0配置具体的超时时间单位是毫秒。ACL_MDL_EVENT_SYNC_TIMEOUT在执行模型推理时控制Event任务的超时时间。该属性值为INT32类型。取值说明如下-1表示永久等待默认永久等待。0配置具体的超时时间单位是毫秒。ACL_MDL_WORK_ADDR_PTR模型所需工作内存Device上存放模型执行过程中的临时数据的指针由用户管理工作内存。一般用于模型一次加载、多并发执行的场景。如果同时配置ACL_MDL_WORK_ADDR_PTR以及aclrtStreamConfigAttr中的ACL_RT_STREAM_WORK_ADDR_PTR表示Stream上模型的工作内存则以ACL_MDL_WORK_ADDR_PTR优先。当前版本不支持该配置。ACL_MDL_WORK_SIZET模型所需工作内存的大小单位为Byte。一般用于模型一次加载、多并发执行的场景。当前版本不支持该配置。ACL_MDL_MPAIMID_SIZET预留配置。ACL_MDL_AICQOS_SIZET预留配置。ACL_MDL_AICOST_SIZET预留配置。ACL_MDL_MEC_TIMETHR_SIZET预留配置。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考