美文网首页
atawhale 零基础入门CV赛事-Task4 模型训练与验证

atawhale 零基础入门CV赛事-Task4 模型训练与验证

作者: 北洋军 | 来源:发表于2020-05-31 23:28 被阅读0次

        上一节学习了构建简单CNN的方法,这一节我们继续学习,这节课的目的是理解验证集的作用,并使用训练集和验证集完成训练,同时学会使用Pytorch环境下的模型读取和加载,并了解调参流程。  

       一个成熟合格的深度学习训练流程至少具备以下功能:     

       1.学会使用Pytorch环境下的模型读取和加载,并了解调参流程 

        2.在训练集上进行训练,并在验证集上进行验证;     

        3.模型可以保存最优的权重,并读取权重;     

        4.记录下训练集和验证集的精度,便于调参。   

在机器学习模型(特别是深度学习模型)的训练过程中,模型是非常容易过拟合的。深度学习模型在不断的训练过程中训练误差会逐渐降低,但测试误差的走势则不一定。     

在模型的训练过程中,模型只能利用训练数据来进行训练,模型并不能接触到测试集上的样本。因此模型如果将训练集学的过好,模型就会记住训练样本的细节,导致模型在测试集的泛化效果较差,这种现象称为过拟合(Overfitting)。与过拟合相对应的是欠拟合(Underfitting),即模型在训练集上的拟合效果较差。

导致模型过拟合的情况有很多种原因,其中最为常见的情况是模型复杂度(Model Complexity )太高,导致模型学习到了训练数据的方方面面,学习到了一些细枝末节的规律。     

解决上述问题最好的解决方法:构建一个与测试集尽可能分布一致的样本集(可称为验证集),在训练过程中不断验证模型在验证集上的精度,并以此控制模型的训练。     

在给定赛题后,赛题方会给定训练集和测试集两部分数据。参赛者需要在训练集上面构建模型,并在测试集上面验证模型的泛化能力。因此参赛者可以通过提交模型对测试集的预测结果,来验证自己模型的泛化能力。同时参赛方也会限制一些提交的次数限制,以此避免参赛选手“刷分”。     

在一般情况下,参赛选手也可以自己在本地划分出一个验证集出来,进行本地验证。训练集、验证集和测试集分别有不同的作用:     

训练集(Train Set):模型用于训练和调整模型参数;

验证集(Validation Set):用来验证模型精度和调整模型超参数

测试集(Test Set):验证模型的泛化能力。

因为训练集和验证集是分开的,所以模型在验证集上面的精度在一定程度上可以反映模型的泛化能力。在划分验证集的时候,需要注意验证集的分布应该与测试集尽量保持一致,不然模型在验证集上的精度就失去了指导意义。

相关文章

  • atawhale 零基础入门CV赛事-Task4 模型训练与验证

    上一节学习了构建简单CNN的方法,这一节我们继续学习,这节课的目的是理解验证集的作用,并使用训练集和验证集...

  • Datawhale 零基础入门CV赛事-Task4 模型训练与验

    学习目标 理解验证集的作用,并使用训练集和验证集完成训练 学会使用Pytorch环境下的模型读取和加载,并了解调参...

  • Datawhale 零基础入门CV赛事-Task4 模型训练与验

    4 模型训练与验证 为此本章将从构建验证集、模型训练和验证、模型保存与加载和模型调参几个部分讲解,在部分小节中将会...

  • cv街景门牌字符的赛题理解

    Datawhale 零基础入门CV赛事-Task1 赛题理解 1 赛题理解 赛题名称:零基础入门CV之街道字符识别...

  • Task01: 计算机视觉赛题理解

    零基础入门CV赛事- 街景字符编码识别 赛事报名页面 数据下载链接 来自SVHN数据集 filesizelinkm...

  • Task1 赛题理解

    1. 理解赛题背景 零基础入门系列赛事第二场 :零基础入门CV赛事之街景字符识别 典型计算机视觉识别:预测真实场景...

  • Task 4:建模调参

    Datawhale 零基础入门数据挖掘-Task4 建模调参 四、建模与调参 4.1 学习目标 了解常用的机器学习...

  • 思绪·随笔(11)

    这段时间参加了datawhale 的零基础入门CV赛事,学到了很多东西,对之前不懂的东西理解更加清晰了,就需要多参...

  • Task4 模型训练与验证

    上一章节,构造了一个简单的CNN,并进行误差损失和第一个字符预测准确率的可视化。一个成熟合格的深度学习训练流程至少...

  • Task4 模型训练与验证

    上次任务中构建了一个简单的CNN进行训练,可视化了训练过程中的误差损失和第一字符预测准确率。一个成熟合格的深度学习...

网友评论

      本文标题:atawhale 零基础入门CV赛事-Task4 模型训练与验证

      本文链接:https://www.haomeiwen.com/subject/mnldzhtx.html