7,666
社区成员
发帖
与我相关
我的任务
分享高通 IoT 模组频繁启停 AI 推理,每次启动模型加载耗时久,有哪些常驻内存优化方案?
反复销毁、重建模型上下文会持续触发 Flash 权重加载与 DSP 初始化,是启动延迟高的核心原因。推荐优化方案:
模型上下文常驻内存:推理暂停时不释放上下文,仅休眠 DSP 算力,不彻底断电;
预留最小供电模式,避免 Hexagon DSP 完全下电;
采用信号触发推理,不销毁实例,仅暂停帧采集。
嵌入式伪代码参考:
c
运行
// 系统初始化时一次性加载模型init_ai_model();while(1){if(trigger_signal_detected()){run_inference(); // 直接调用,无需重复加载}else{dsp_enter_sleep(); // DSP休眠,保留上下文}}
注意:内存资源极度紧张的模组,可设置超时机制,长时间无任务时自动释放模型防止内存溢出。