设为首页
收藏本站
用户名
Email
安全手机号
自动登录
找回密码
密码
登录
立即注册
快捷导航
编辑圈首页
BBS
期刊目录
期刊发表
专利知产
硕博论文
个人提升
相关网站
著作出版
期刊运营
在线咨询
北核期刊目录
科技核心期刊目录
SCI期刊目录
SCI/SSCI期刊检索
中文普刊目录
SCI/SSCI/EI期刊发表
闭源SCI/SSCI期刊发表
知网普刊发表
Scopus期刊发表
CSCD期刊发表
万方期刊发表
维普期刊发表
北核期刊发表
南核期刊发表
AMI期刊发表
知网期刊加急发表
中文普刊加急发表
万方期刊加急发表
发明专利
实用新型专利
软件著作权
外观设计专利
版权登记
香港专利
美国专利
日本专利
德国专利
尼日利亚专利
卢森堡专利
MBA/EMBA毕业论文辅导
MPA毕业论文辅导
数学专业毕业论文辅导
计算机专业毕业论文辅导
美术专业毕业论文辅导
人工智能方向毕业论文辅导
土木方向毕业论文辅导
医学专业毕业论文辅导
金融专业毕业论文辅导
教育专业毕业论文辅导
传播学方向毕业论文辅导
工业设计方向毕业论文辅导
CISA国际信息系统审计师
PMP项目管理师
海外优青
国际在职硕士
国际在职博士
申博论文发表
申博外语能力证明
马来西亚本硕博留学
云科服论坛
学术圈中文网
美国留学论坛
日本留学论坛
澳洲留学论坛
韩国留学论坛
英国留学论坛
华人留学网
考研重点网
集群智慧云科服
自有完整书稿,自费独自出版
自有完整书稿,希望与他人分担费用
自有部分书稿,寻求自费与他人合著出版
没有书稿,希望自费与他人合著出版
ISSN刊号申请
Google Scholar期刊收录
维普期刊收录
期刊GEO优化
期刊创刊
期刊代运营
期刊代理
期刊推广
期刊约稿
中文期刊发表
英文期刊发表
搜索
搜索
热搜:
期刊编辑
学术期刊
期刊约稿
期刊内推
期刊推广
期刊创刊
期刊代运营
期刊合作
SCI期刊
SSCI期刊
Scopus期刊
英文期刊
中文核心期刊
本版
帖子
编辑圈
»
编辑圈首页
›
数据库交流区
›
南核/北核/科核
›
中国移动研究院人工智能领域论文被SCI核心期刊《Complex ...
返回列表
发新帖
查看:
213
|
回复:
0
中国移动研究院人工智能领域论文被SCI核心期刊《Complex & Intelligent Sys ...
[复制链接]
老声老刚
老声老刚
当前离线
积分
23
3
主题
2
回帖
23
积分
新手上路
新手上路, 积分 23, 距离下一级还需 27 积分
新手上路, 积分 23, 距离下一级还需 27 积分
积分
23
发消息
发表于 2026-6-23 18:43:48
|
显示全部楼层
|
阅读模式
近日,中国移动(
91.930
,
0.28
,
0.31%
)研究院联合中国科学院沈阳自动化研究所、中国科学院大学等单位,在国际期刊《Complex & Intelligent Systems》发表论文《A general learning rate improvement strategy for deep neural networks training》(影响因子4.6)。该研究聚焦深度神经网络训练中的关键基础问题——学习率调度,提出一种面向多类优化器的通用学习率改进策略,在降低超参数依赖的同时,兼顾训练效率、收敛稳定性与模型性能提升,为深度模型高效训练提供了新的技术思路。
在深度神经网络训练过程中,学习率直接影响参数更新步长,是决定模型能否高效收敛的重要因素。学习率过小,容易导致训练缓慢;学习率过大,则可能引起损失震荡、陷入局部最优,甚至训练失败。尽管当前已有固定式、衰减式、周期式等多种学习率调度方法,但普遍存在对训练阶段特征考虑不足、关键超参数较多、与 Adam 等自适应优化器兼容性有限等问题,制约了其在复杂模型训练中的进一步应用。
针对上述问题,论文提出了一种通用学习率调度策略,将神经网络训练过程划分为“预热—保持较大学习率—后期衰减”三个阶段,并构建统一的学习率变化表达式 Expw。该方法能够根据训练阶段特征自动调整学习率变化趋势,在保留较少超参数的前提下,更好匹配模型从快速逼近分类边界到后期稳定收敛的全过程。同时,论文还围绕自适应优化器的适配问题进行了理论分析,给出了所提调度策略在 Adam 优化器上的收敛性证明,进一步增强了方法的通用性与理论支撑。
论文截图
通用学习率调度策略示意
为验证所提方法的有效性,论文从理论分析与实验评测两个层面展开系统研究。一方面,作者在凸优化与非凸优化问题上对 SGD、Adam 等优化器的收敛过程进行了可视化分析;另一方面,在 CIFAR10、CIFAR100、Tiny-ImageNet-200 和 ImageNet 等常用数据集上,围绕 SGD、Adam、RAdam、AdamW 等优化器,对比了 FixedLR、StepLR、CosineLR、CyclicLR、OneCycleLR 等主流学习率调度策略。实验结果表明,所提方法在不同模型、不同优化器和不同复杂度数据集上均展现出较好的先进性与鲁棒性,尤其在复杂数据集和自适应优化器设置下,仍能保持稳定收敛与较优性能。
不同学习率调度策略对比实验结果
所提方法在典型模型与数据集CIFAR10上的性能对比结果
该研究从深度学习训练中的基础机制出发,针对学习率调度这一长期存在但又高度依赖经验的问题,提出了兼具理论依据与工程实用价值的改进方案。相关成果有望为视觉模型训练、通用深度网络优化以及大模型训练过程中的参数调度提供更稳定、更高效的基础支撑,也为后续构建低门槛、强鲁棒的训练优化工具提供了参考。
回复
举报
返回列表
发新帖
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖后跳转到最后一页
浏览过的版块
职业发展
快速回复
返回顶部
返回列表