百科问答小站 logo
百科问答小站 font logo



神经网络训练多个epoch,写论文的时候可以取最好的效果那一个epoch作为结果吗? 第1页

  

user avatar   rewrgf 网友的相关建议: 
      

见到paper实验里写的这种,无论他其他的部分写的多好,反正我看到了就会给打个strong reject。

因为这属于学术不端,本质上是information leaking,相当于在得到结果的时候预先使用了test set的信息。在你得到训练好的模型之前,你是不允许使用test set的任何信息的。(当然把test set accuracy 在代码里打印出来其实是可以的,但你要确保这个信息绝不参与对训练好的模型的选择)你都能在训练过程中找到”test set表现最好的那个epoch"了,这和直接把test set加入train set得到一个overfit的东西,有什么区别呢?

正确的做法是使用validation set上表现最好的那个epoch,放到test set上去看结果。


user avatar   ZhengPeng7 网友的相关建议: 
      

女王:求求题主放过我,我可不敢有什么政绩。。。




  

相关话题

  GAN(对抗生成网络)可以被用于哪些(商业或潜在商业)实际问题? 
  为何感觉“知识蒸馏”这几年没有什么成果? 
  如何解决测试中充斥着大量训练集中没见过的样本类型模型将其识别成非我族类仍然保持测试集的高精度? 
  如何评价Deepmind自监督新作BYOL? 
  如何看待Geoffrey Hinton的言论,深度学习要另起炉灶,彻底抛弃反向传播? 
  可不可以告诉我,出国读研对于申请方面该怎么准备? 
  90后学霸博导5年发表SCI论文60余篇? 
  如何评价何恺明、Ross Girshick组的自监督时空表征学习新作? 
  本科生有可能发一篇SCI的综述性paper吗? 
  如何看待百度无人车, 三千多个场景,一万多个if? 

前一个讨论
如何评价清华大学电子系大一暑假小学期总共 9 个学时的 Python 课程大作业难度?
下一个讨论
如何评价东奥决赛选手若因阳性弃权可获银牌,这规则你支持吗?





© 2024-11-08 - tinynew.org. All Rights Reserved.
© 2024-11-08 - tinynew.org. 保留所有权利