社区
CUDA高性能计算讨论
帖子详情
做图像分类的时候,loss不降
_Raymond_
2021-04-08 10:41:40
二分类。损失=In2=0.69。
五分类。损失=In5=1.60。
损失函数是交叉熵。
torch 架构。
网络是vgg 16。
试了一下网上的方法,不是权重初始化的问题。
大佬们有没有思路。
...全文
920
回复
打赏
收藏
做图像分类的时候,loss不降
二分类。损失=In2=0.69。 五分类。损失=In5=1.60。 损失函数是交叉熵。 torch 架构。 网络是vgg 16。 试了一下网上的方法,不是权重初始化的问题。 大佬们有没有思路。
复制链接
扫一扫
分享
举报
写回复
配置赞助广告
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
python 关于训练集
loss
不降
问题的经验分享
如何尽量避免这种问题的出现: 大部分情况是函数默认参数不同、或者是代码所处环境不同产生的bug 1. 使用相同的环境:系统、库的版本要一致 2. 设定固定的随机种子,可以规避一些不确定性问题 3. 在函数调用时主动填写默认参数(后续看代码也方便)
海光DCU微调实战:从环境配置到
loss
下降的完整指南
在深度学习模型微调任务中,环境配置与训练稳定性是两大核心挑战。无论是GPU还是国产加速卡,掌握从环境搭建到
loss
收敛的通用方法论至关重要。本文基于海光DCU(Deep Computing Unit)的实际微调经历,梳理了DTK工具链安装、PyTorch适配、数据加载与训练循环调试的完整链路,并针对
loss
不降
、NaN异常、显存溢出等高频问题给出排查方案。同时,结合“power
loss
自动关闭”的教训,强调了断点续训与电源策略的重要性;对于“在Windows系统装深度学习环境”的需求,也给出了WSL替代建
深度学习损失函数全解析:从MSE到Focal
Loss
的原理与应用实战
损失函数是机器学习与深度学习的核心概念,它通过量化模型预测与真实值之间的差异,为模型优化提供明确的方向。其本质是一种距离度量,在回归任务中常用均方误差(MSE)衡量数值差距,在分类任务中则通过交叉熵评估概率分布的分歧。这些基础函数构成了模型训练的通用框架。在计算机视觉等复杂场景中,进阶损失函数展现出巨大技术价值。例如,Focal
Loss
通过调制因子动态降低易分样本权重,有效缓解了目标检测中前景与背景的极端类别不平衡问题;Dice
Loss
则直接优化预测区域与真实区域的重叠度,特别适用于医学图像分割等小目标
从训练曲线读懂模型状态:train
loss
与val
loss
的实战诊断指南
本文深入解析了深度学习模型中train
loss
与val
loss
曲线的实战诊断方法,帮助开发者准确识别模型状态。通过分析过拟合、欠拟合等常见问题,提供数据增强、正则化、早停机制等解决方案,并结合实际案例展示如何优化训练过程,提升模型性能。
PyTorch CNN
图像分类
实战:从数据清洗到模型评估的完整流程
在计算机视觉领域,
图像分类
是深度学习最基础也最典型的应用方向之一。卷积神经网络(CNN)凭借局部连接与参数共享机制,成为处理图像特征提取的核心模型。然而,真正让CNN发挥效用的并非模型构建本身,而是围绕数据的工程流程。从图像预处理、数据增强到训练集与验证集的合理划分,每一步都直接影响模型泛化能力。实践表明,PyTorch框架下的图像识别项目需要打通数据加载、网络搭建、
loss
曲线解读、混淆矩阵分析与坏例排查的完整闭环。本文面向
图像分类
落地场景,系统梳理了从数据清洗到模型评估的关键环节,并讨论增量训练与环境配
CUDA高性能计算讨论
357
社区成员
615
社区内容
发帖
与我相关
我的任务
CUDA高性能计算讨论
CUDA高性能计算讨论
复制链接
扫一扫
分享
社区描述
CUDA高性能计算讨论
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章