社区
高通开发者论坛
AI PC
帖子详情
骁龙 AI PC 上部署本地大模型时,模型加载时间很长,有哪些可优化点?
难道做豆腐佬啊
2026-08-10 11:42:31
骁龙 AI PC 上部署本地大模型时,模型加载时间很长,有哪些可优化点?
...全文
15
回复
打赏
收藏
骁龙 AI PC 上部署本地大模型时,模型加载时间很长,有哪些可优化点?
骁龙 AI PC 上部署本地大模型时,模型加载时间很长,有哪些可优化点?
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
Grok 4.5本地
AI
模型
聚合工具:从环境配置到进阶应用全指南
本文详解Grok 4.5——一个开源的本地
AI
模型
聚合客户端,支持Windows、Linux、macOS及安卓平台。内容涵盖环境配置(内存/存储/GPU要求)、跨平台
部署
(
PC
端解压即用、安卓Termux方案)、
模型
选型与量化参数调优(7B/q4_k_m优先)、Open
AI
兼容API接口调用、批量处理及生产化
部署
要
点
。强调其作为本地
AI
实验平台的价值,而非官方Grok服务。
在旧安卓手机上
部署
Hermes Agent实现本地
AI
协作者
本文详解如何在旧安卓手机(Android 10~12,ARM64)上通过Termux+CLI方式本地
部署
Hermes Agent,实现离线
AI
协作者功能。核心包括:选用Termux替代APK/桌面版以规避架构兼容问题;锁定Python 3.11.9确保C扩展稳定;所有路径严格使用Termux家目录避免Scoped Storage限制;分层安装Hermes主程序、llama.cpp、whisper.cpp和playwright;精细化调优内存、线程、
模型
路径与日志;采用离线
模型
传输+符号链接提升可靠性;配置常驻服务与心跳监控保障7×24运行。
Unity Sentis推理引擎GPU与CPU后端选型:性能
优化
实战指南
本文深入解析Unity Sentis推理引擎的GPU计算着色器与CPU Burst两大后端原理、性能特征及适用场景。重
点
对比其并行能力、数据搬运开销、延迟特性与硬件依赖性,结合移动端AR、
PC
/主机游戏、边缘/WebGL三类典型场景给出决策树,并提供基准测试、数据流分析、
模型
量化与Burst
优化
等实操方法,助力开发者在真实硬件上实现
AI
推理性能最
优化
。
Unity离线语音识别实战:基于Whisper.cpp的高性能本地化集成方案
本文详解如何在Unity中集成Whisper.cpp实现高性能本地化离线语音识别,涵盖
模型
选型(Tiny/Base/Small)、跨平台
部署
(Windows/macOS/iOS/Android/WebGL)、GPU加速配置、实
时
流式识别与文件转录、移动端
优化
及常见问题排查。核心依赖C++推理引擎与Unity C#插件桥接,支持16kHz单声道
PC
M音频输入,强调隐私安全、零网络依赖与可商用特性。
多重复数群的到标准
模型
.pdf
多重复数群的到标准
模型
.pdf
高通开发者论坛
7,651
社区成员
6,396
社区内容
发帖
与我相关
我的任务
高通开发者论坛
本论坛以AI、WoS 、XR、IoT、Auto、生成式AI等核心板块组成,为开发者提供便捷及高效的学习和交流平台。 高通开发者专区主页:https://qualcomm.csdn.net/
复制链接
扫一扫
分享
社区描述
本论坛以AI、WoS 、XR、IoT、Auto、生成式AI等核心板块组成,为开发者提供便捷及高效的学习和交流平台。 高通开发者专区主页:https://qualcomm.csdn.net/
人工智能
物联网
机器学习
技术论坛(原bbs)
北京·东城区
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章