基于keras中训练数据的几种方式对比(fit和fit_generator)

更新时间：2021年5月17日 13:10 点击：1916

一、train_on_batch

model.train_on_batch(batchX, batchY)

train_on_batch函数接受单批数据，执行反向传播，然后更新模型参数，该批数据的大小可以是任意的，即，它不需要提供明确的批量大小，属于精细化控制训练模型，大部分情况下我们不需要这么精细，99%情况下使用fit_generator训练方式即可，下面会介绍。

二、fit

model.fit(x_train, y_train, batch_size=32, epochs=10)

fit的方式是一次把训练数据全部加载到内存中，然后每次批处理batch_size个数据来更新模型参数，epochs就不用多介绍了。这种训练方式只适合训练数据量比较小的情况下使用。

三、fit_generator

利用Python的生成器，逐个生成数据的batch并进行训练，不占用大量内存，同时生成器与模型将并行执行以提高效率。例如，该函数允许我们在CPU上进行实时的数据提升，同时在GPU上进行模型训练

接口如下：

fit_generator(self, generator, steps_per_epoch, epochs=1, verbose=1, callbacks=None, validation_data=None, validation_steps=None, class_weight=None, max_q_size=10, workers=1, pickle_safe=False, initial_epoch=0)

generator：生成器函数

steps_per_epoch：整数，当生成器返回steps_per_epoch次数据时，计一个epoch结束，执行下一个epoch。也就是一个epoch下执行多少次batch_size。

epochs：整数，控制数据迭代的轮数，到了就结束训练。

callbacks=None, list，list中的元素为keras.callbacks.Callback对象，在训练过程中会调用list中的回调函数

举例：

def generate_arrays_from_file(path):
            while True:
                with open(path) as f:
                    for line in f:
                        # create numpy arrays of input data
                        # and labels, from each line in the file
                        x1, x2, y = process_line(line)
                        yield ({'input_1': x1, 'input_2': x2}, {'output': y})
 
model.fit_generator(generate_arrays_from_file('./my_folder'),
                            steps_per_epoch=10000, epochs=10)

补充：keras.fit_generator()属性及取值

如下所示：

fit_generator(self, generator, 
                    steps_per_epoch=None, 
                    epochs=1, 
                    verbose=1, 
                    callbacks=None, 
                    validation_data=None, 
                    validation_steps=None,  
                    class_weight=None,
                    max_queue_size=10,   
                    workers=1, 
                    use_multiprocessing=False, 
                    shuffle=True, 
                    initial_epoch=0)

通过Python generator产生一批批的数据用于训练模型。generator可以和模型并行运行，例如，可以使用CPU生成批数据同时在GPU上训练模型。

参数：

generator：一个generator或Sequence实例，为了避免在使用multiprocessing时直接复制数据。

steps_per_epoch：从generator产生的步骤的总数（样本批次总数）。通常情况下，应该等于数据集的样本数量除以批量的大小。

epochs：整数，在数据集上迭代的总数。

works：在使用基于进程的线程时，最多需要启动的进程数量。

use_multiprocessing：布尔值。当为True时，使用基于基于过程的线程。

例如：

datagen = ImageDataGenator(...)
model.fit_generator(datagen.flow(x_train, y_train,
                                 batch_size=batch_size),
                    epochs=epochs,
                    validation_data=(x_test, y_test),
                    workers=4)

以上为个人经验，希望能给大家一个参考，也希望大家多多支持猪先飞。

[!--infotagslink--]

上一篇: python实现某考试系统生成word试卷

下一篇: python一秒搭建FTP服务器

pytorch 实现冻结部分参数训练另一部分
这篇文章主要介绍了pytorch 实现冻结部分参数训练另一部分，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2021-03-27
在Keras中利用np.random.shuffle()打乱数据集实例
这篇文章主要介绍了在Keras中利用np.random.shuffle()打乱数据集实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-16
解决tensorflow训练时内存持续增加并占满的问题
今天小编就为大家分享一篇解决tensorflow训练时内存持续增加并占满的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-04-22
解决在keras中使用model.save()函数保存模型失败的问题
这篇文章主要介绍了解决在keras中使用model.save()函数保存模型失败的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-05-21
解决Pytorch修改预训练模型时遇到key不匹配的情况
这篇文章主要介绍了解决Pytorch修改预训练模型时遇到key不匹配的情况，具有很好的参考价值，希望对大家有所帮助。如有错误或未考虑完全的地方，望不吝赐教...2021-06-05
解决Keras 中加入lambda层无法正常载入模型问题
这篇文章主要介绍了解决Keras 中加入lambda层无法正常载入模型问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-17
keras.layer.input()用法说明
这篇文章主要介绍了keras.layer.input()用法说明，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-17
Pytorch训练过程出现nan的解决方式
今天小编就为大家分享一篇Pytorch训练过程出现nan的解决方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-05-02
keras的三种模型实现与区别说明
这篇文章主要介绍了keras的三种模型实现与区别说明，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-07-04
浅谈keras2 predict和fit_generator的坑
这篇文章主要介绍了浅谈keras2 predict和fit_generator的坑，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-18
完美解决TensorFlow和Keras大数据量内存溢出的问题
这篇文章主要介绍了完美解决TensorFlow和Keras大数据量内存溢出的问题，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-07-04
利用keras使用神经网络预测销量操作
这篇文章主要介绍了利用keras使用神经网络预测销量操作，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-07-08
pytorch实现对输入超过三通道的数据进行训练
今天小编就为大家分享一篇pytorch实现对输入超过三通道的数据进行训练，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-04-27
Python通过TensorFLow进行线性模型训练原理与实现方法详解
这篇文章主要介绍了Python通过TensorFLow进行线性模型训练原理与实现方法,结合实例形式详细分析了Python通过TensorFLow进行线性模型训练相关概念、算法设计与训练操作技巧,需要的朋友可以参考下...2020-04-27
使用keras实现孪生网络中的权值共享教程
这篇文章主要介绍了使用keras实现孪生网络中的权值共享教程，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-11
keras:model.compile损失函数的用法
这篇文章主要介绍了keras:model.compile损失函数的用法，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-07-02
keras输出预测值和真实值方式
这篇文章主要介绍了keras输出预测值和真实值方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-28
Pytorch根据layers的name冻结训练方式
今天小编就为大家分享一篇Pytorch根据layers的name冻结训练方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-04-30
从训练好的tensorflow模型中打印训练变量实例
今天小编就为大家分享一篇从训练好的tensorflow模型中打印训练变量实例，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-04-22
keras实现基于孪生网络的图片相似度计算方式
这篇文章主要介绍了keras实现基于孪生网络的图片相似度计算方式，具有很好的参考价值，希望对大家有所帮助。一起跟随小编过来看看吧...2020-06-12

基于keras中训练数据的几种方式对比(fit和fit_generator)

一、train_on_batch

二、fit

三、fit_generator

举例：

如下所示：

参数：

例如：

相关文章

阁下可能感兴趣的内容

推荐阅读