社区
机器视觉
帖子详情
使用RTX2080Ti做网络训练,GPU编译通过,但训练时报错
陈滚滚
2019-05-08 05:06:17
使用win10+Matconvnet1.25+matlab2018b+vs2015+cuda9.2+RTX2080Ti做网络训练,vl_compilenn('enableGpu', true)编译通过,但是训练的时候报错。有没有大神有解决方案?
...全文
235
1
打赏
收藏
使用RTX2080Ti做网络训练,GPU编译通过,但训练时报错
使用win10+Matconvnet1.25+matlab2018b+vs2015+cuda9.2+RTX2080Ti做网络训练,vl_compilenn('enableGpu', true)编译通过,但是训练的时候报错。有没有大神有解决方案?
复制链接
扫一扫
分享
举报
写回复
配置赞助广告
用AI写文章
1 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
陈滚滚
2019-05-08
打赏
举报
回复
https://github.com/vlfeat/matconvnet/issues/1206 是和我一样的问题,但是也没有解决……
win10 + NVIDIA GeForce RTX 2080 Ti + CUDA10.0 + cuDNN v7.6.5
win10 + NVIDIA GeForce RTX 2080 Ti + CUDA10.0 + cuDNN v7.6.5 配置教程 参考文献: 显卡驱动版本号一定要与cuda版本号想对应,要不然tensorflow运行会
报错
: https://blog.csdn.net/qxqsunshine/article/details/96901952
RTX2080ti
显卡+win10+安装Tensorf...
保姆级避坑指南:在Windows 10上用RTX 2080Ti搞定CUDA 11.x + cuDNN,再配个Anaconda环境
本文提供了一份详细的RTX 2080Ti在Windows 10上配置CUDA 11.x和cuDNN的保姆级指南,涵盖驱动安装、CUDA Toolkit配置、cuDNN验证以及Anaconda环境搭建。通过逐步指导,帮助开发者避开常见陷阱,高效完成深度学习开发环境的部署,特别适合需要利用
GPU
加速的AI项目。
VisionTrain目标检测模型
训练
:如何根据你的显卡(GTX1660Ti/
RTX2080Ti
)和数据集大小配置参数?
本文详细介绍了如何根据显卡性能(如GTX1660Ti和
RTX2080Ti
)和数据集大小配置VisionTrain目标检测模型的
训练
参数。内容包括显存管理、数据集规模与
训练
轮次的平衡、Patch尺寸选择、模型能力选择策略以及实战案例,帮助开发者优化
训练
效率与模型性能。
RTX 2080 Ti跑35B大模型:A3B量化与显存带宽优化实战
大语言模型推理并非单纯依赖高算力
GPU
,其本质是计算密度、显存带宽、量化策略与框架调度的系统性协同。INT4量化、KV Cache优化等低精度推理技术显著降低显存与带宽压力,使老旧硬件如RTX 2080 Ti在适配A3B(Adaptive Attention and Activation Bitwidth)等先进量化机制后,仍可稳定支撑35B级模型的本地部署。该方案凸显了‘带宽受限型’
GPU
在低精度场景下的独特性价比,适用于边缘推理、低成本AI开发及教育科研等对成本敏感但需强推理能力的场景。
RTX 2080 Ti 22G本地部署Qwen3.6-35B实现Token自由
大模型推理的核心瓶颈并非算力峰值,而是显存带宽与KV Cache管理效率;FP16权重加载、全量注意力计算和静态图调度会迅速耗尽消费级
GPU
资源。通过INT4量化权重、FP8 KV Cache压缩、PagedAttention分页管理和Selective Activation检查点等关键技术,可在低功耗硬件上实现高吞吐稳定推理。这类优化显著降低大模型本地化门槛,支撑私有知识库问答、代码补全、RAG增强等典型AI工程场景。本文聚焦RTX 2080 Ti 22G与Qwen3.6-35B-A3B的深度适配实践,揭
机器视觉
4,514
社区成员
15,347
社区内容
发帖
与我相关
我的任务
机器视觉
图形图像/机器视觉
复制链接
扫一扫
分享
社区描述
图形图像/机器视觉
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章