0

0

使用VGG16进行MNIST手写数字识别的迁移学习

霞舞

霞舞

发布时间:2025-08-19 19:24:25

|

914人浏览过

|

来源于php中文网

原创

使用vgg16进行mnist手写数字识别的迁移学习

本文档旨在指导读者使用VGG16模型进行MNIST手写数字识别的迁移学习。我们将重点介绍如何构建模型、加载预训练权重、以及解决可能遇到的GPU配置问题。通过本文,读者可以掌握利用VGG16进行图像分类任务迁移学习的基本方法,并了解如何调试TensorFlow在GPU上的运行环境。

VGG16迁移学习实现MNIST手写数字识别

迁移学习是一种强大的技术,它允许我们利用在大规模数据集上预训练的模型,并将其应用于新的、通常较小的数据集。 这可以显著减少训练时间和所需的计算资源,同时还能提高模型的性能。 在本文中,我们将使用在ImageNet数据集上预训练的VGG16模型进行MNIST手写数字识别。

数据准备

首先,我们需要加载MNIST数据集并进行预处理。MNIST数据集包含 0 到 9 的手写数字的灰度图像。 为了与 VGG16 兼容,我们需要将灰度图像转换为三通道图像,并将图像大小调整为 VGG16 期望的输入大小。

import tensorflow as tf
from tensorflow.keras.applications import VGG16
from tensorflow.keras import layers, models
import numpy as np

# 加载MNIST数据集
(x_train, y_train), (x_test, y_test) = tf.keras.datasets.mnist.load_data()

# 将灰度图像转换为三通道图像
x_train = np.stack([x_train]*3, axis=-1)
x_test = np.stack([x_test]*3, axis=-1)

# 调整图像大小为 (75, 75, 3)
img_height, img_width = 75, 75
x_train = tf.image.resize(x_train, (img_height, img_width)).numpy()
x_test = tf.image.resize(x_test, (img_height, img_width)).numpy()

# 归一化像素值
x_train = x_train / 255.0
x_test = x_test / 255.0

构建VGG16迁移学习模型

接下来,我们将创建一个基于VGG16的迁移学习模型。我们将加载预训练的VGG16模型,移除其顶层(分类层),并添加我们自己的自定义分类层。

class VGG16TransferLearning(tf.keras.Model):
  def __init__(self, base_model, models):
    super(VGG16TransferLearning, self).__init__()
    #base model
    self.base_model = base_model

   # other layers
    self.flatten = tf.keras.layers.Flatten()
    self.dense1 = tf.keras.layers.Dense(512, activation='relu')
    self.dense2 = tf.keras.layers.Dense(512, activation='relu')
    self.dense3 = tf.keras.layers.Dense(10)
    self.layers_list = [self.flatten, self.dense1, self.dense2, self.dense3]

    #instantiate the base model with other layers
    self.model = models.Sequential(
      [self.base_model, *self.layers_list]
    )

  def call(self, *args, **kwargs):
    activation_list = []
    out = args[0]

    for layer in self.model.layers:
      out = layer(out)
      activation_list.append(out)
    if kwargs.get('training', False):
      return out
    else:
      prob = tf.nn.softmax(out)
      return out, prob
# 加载预训练的VGG16模型,不包含顶层
base_model = VGG16(weights="imagenet", include_top=False, input_shape=x_train[0].shape)

# 冻结VGG16模型的权重,防止在训练过程中被修改
base_model.trainable = False

# 创建迁移学习模型
model = VGG16TransferLearning(base_model, models)

编译和训练模型

现在,我们可以编译和训练我们的迁移学习模型。

# 编译模型
model.compile(loss=tf.keras.losses.SparseCategoricalCrossentropy(),
          optimizer=tf.keras.optimizers.legacy.Adam(),
          metrics=['accuracy'])

# 训练模型
model.fit(x_train, y_train, epochs=10, validation_data=(x_test, y_test))

GPU配置问题及解决

在训练过程中,可能会遇到Kernel Restarting的问题,这通常是由于GPU配置不正确导致的。即使你的电脑配备了GPU,TensorFlow也可能无法正确识别和使用它。

AI Content Detector
AI Content Detector

Writer推出的AI内容检测工具

下载

以下是一些可能的解决方法

  1. 检查TensorFlow是否检测到GPU:

    print("Num GPUs Available: ", len(tf.config.list_physical_devices('GPU')))

    如果输出为0,则表示TensorFlow没有检测到GPU。

  2. 安装正确的CUDA和cuDNN版本: TensorFlow需要特定版本的CUDA和cuDNN才能正常使用GPU。请参考TensorFlow官方文档,安装与你的TensorFlow版本兼容的CUDA和cuDNN版本。

  3. 设置环境变量: 确保CUDA和cuDNN的路径已添加到环境变量中。

  4. 使用tf.config.experimental.set_memory_growth: 在某些情况下,TensorFlow可能无法正确分配GPU内存。可以使用以下代码限制TensorFlow使用的GPU内存量:

    gpus = tf.config.list_physical_devices('GPU')
    if gpus:
      try:
        # Currently, memory growth needs to be the same across GPUs
        for gpu in gpus:
          tf.config.experimental.set_memory_growth(gpu, True)
        logical_gpus = tf.config.list_logical_devices('GPU')
        print(len(gpus), "Physical GPUs,", len(logical_gpus), "Logical GPUs")
      except RuntimeError as e:
        # Memory growth must be set before GPUs have been initialized
        print(e)

通过以上步骤,可以解决TensorFlow无法识别GPU的问题,从而避免Kernel Restarting错误。

注意事项和总结

  • 数据预处理: 数据预处理对于迁移学习至关重要。确保你的数据格式与预训练模型的要求相匹配。
  • 冻结层: 在迁移学习中,通常会冻结预训练模型的部分或全部层,以防止过度拟合。
  • GPU配置: 确保TensorFlow正确配置并使用GPU,以加快训练速度。
  • 超参数调整: 根据你的数据集和任务,可能需要调整学习率、批大小等超参数。

通过本文,我们学习了如何使用VGG16模型进行MNIST手写数字识别的迁移学习。我们还讨论了可能遇到的GPU配置问题以及如何解决它们。 迁移学习是一种强大的技术,可以显著提高模型的性能并减少训练时间。 通过掌握本文介绍的技术,你可以将迁移学习应用于各种图像分类任务。

相关专题

更多
Python AI机器学习PyTorch教程_Python怎么用PyTorch和TensorFlow做机器学习
Python AI机器学习PyTorch教程_Python怎么用PyTorch和TensorFlow做机器学习

PyTorch 是一种用于构建深度学习模型的功能完备框架,是一种通常用于图像识别和语言处理等应用程序的机器学习。 使用Python 编写,因此对于大多数机器学习开发者而言,学习和使用起来相对简单。 PyTorch 的独特之处在于,它完全支持GPU,并且使用反向模式自动微分技术,因此可以动态修改计算图形。

20

2025.12.22

Python 深度学习框架与TensorFlow入门
Python 深度学习框架与TensorFlow入门

本专题深入讲解 Python 在深度学习与人工智能领域的应用,包括使用 TensorFlow 搭建神经网络模型、卷积神经网络(CNN)、循环神经网络(RNN)、数据预处理、模型优化与训练技巧。通过实战项目(如图像识别与文本生成),帮助学习者掌握 如何使用 TensorFlow 开发高效的深度学习模型,并将其应用于实际的 AI 问题中。

17

2026.01.07

Golang gRPC 服务开发与Protobuf实战
Golang gRPC 服务开发与Protobuf实战

本专题系统讲解 Golang 在 gRPC 服务开发中的完整实践,涵盖 Protobuf 定义与代码生成、gRPC 服务端与客户端实现、流式 RPC(Unary/Server/Client/Bidirectional)、错误处理、拦截器、中间件以及与 HTTP/REST 的对接方案。通过实际案例,帮助学习者掌握 使用 Go 构建高性能、强类型、可扩展的 RPC 服务体系,适用于微服务与内部系统通信场景。

8

2026.01.15

公务员递补名单公布时间 公务员递补要求
公务员递补名单公布时间 公务员递补要求

公务员递补名单公布时间不固定,通常在面试前,由招录单位(如国家知识产权局、海关等)发布,依据是原入围考生放弃资格,会按笔试成绩从高到低递补,递补考生需按公告要求限时确认并提交材料,及时参加面试/体检等后续环节。要求核心是按招录单位公告及时响应、提交材料(确认书、资格复审材料)并准时参加面试。

38

2026.01.15

公务员调剂条件 2026调剂公告时间
公务员调剂条件 2026调剂公告时间

(一)符合拟调剂职位所要求的资格条件。 (二)公共科目笔试成绩同时达到拟调剂职位和原报考职位的合格分数线,且考试类别相同。 拟调剂职位设置了专业科目笔试条件的,专业科目笔试成绩还须同时达到合格分数线,且考试类别相同。 (三)未进入原报考职位面试人员名单。

52

2026.01.15

国考成绩查询入口 国考分数公布时间2026
国考成绩查询入口 国考分数公布时间2026

笔试成绩查询入口已开通,考生可登录国家公务员局中央机关及其直属机构2026年度考试录用公务员专题网站http://bm.scs.gov.cn/pp/gkweb/core/web/ui/business/examResult/written_result.html,查询笔试成绩和合格分数线,点击“笔试成绩查询”按钮,凭借身份证及准考证进行查询。

10

2026.01.15

Java 桌面应用开发(JavaFX 实战)
Java 桌面应用开发(JavaFX 实战)

本专题系统讲解 Java 在桌面应用开发领域的实战应用,重点围绕 JavaFX 框架,涵盖界面布局、控件使用、事件处理、FXML、样式美化(CSS)、多线程与UI响应优化,以及桌面应用的打包与发布。通过完整示例项目,帮助学习者掌握 使用 Java 构建现代化、跨平台桌面应用程序的核心能力。

65

2026.01.14

php与html混编教程大全
php与html混编教程大全

本专题整合了php和html混编相关教程,阅读专题下面的文章了解更多详细内容。

36

2026.01.13

PHP 高性能
PHP 高性能

本专题整合了PHP高性能相关教程大全,阅读专题下面的文章了解更多详细内容。

75

2026.01.13

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Excel 教程
Excel 教程

共162课时 | 11.9万人学习

Go语言web开发--经典项目电子商城
Go语言web开发--经典项目电子商城

共23课时 | 1.2万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号