【特训营第三期 】基于PaddleClas的多场景杂草分类

P粉084495128
发布: 2025-07-24 11:38:06
原创
692人浏览过
本文介绍基于PaddleClas的多场景杂草分类研究。使用昆士兰州牧场8种杂草的17508张原位图像,经处理生成训练集(15000张)和验证集(2509张)。选用含49个卷积层和1个全连接层的ResNet50模型,通过PaddleClas训练,可边训边评并保存最优模型,还能单独评估及用存盘模型预测。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

【特训营第三期 】基于paddleclas的多场景杂草分类 - php中文网

基于PaddleClas的多场景杂草分类

一、数据集介绍

  • 选定的杂草种类是昆士兰州牧场草原的本地物种。它们包括:"Chinee apple", "Snake weed", "Lantana", "Prickly acacia", "Siam weed", "Parthenium", "Rubber vine" and "Parkinsonia". 这些图像是从昆士兰州以下地点的杂草侵扰中收集的地点收集:"Black River", "Charters Towers", "Cluden", "Douglas", "Hervey Range", "Kelso", "McKinlay" and "Paluma". 下表和图表按杂草、位置和地理分布对数据集进行了细分。
  • 【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网            
  • 【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网            
  • 此数据集的采集更加贴合在自然环境当中,注重实用性。
  • 【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网            
  • (a) 在受控实验室环境中拍摄的马缨丹叶图像。(b) 来自DeepWeeds数据集的马缨丹样本图像,原位拍摄,捕捉整个植物的真实视图。

二、模型介绍

  • 通过与多个模型的对比,最终我们选择了ResNet50模型
  • 【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网            

ResNet50

  • Resnet50 网络中包含了 49 个卷积层、一个全连接层。如图下图所示,Resnet50网络结构可以分成七个部分,第一部分不包含残差块,主要对输入进行卷积、正则化、激活函数、最大池化的计算。第二、三、四、五部分结构都包含了残差块,图 中的绿色图块不会改变残差块的尺寸,只用于改变残差块的维度。在 Resnet50 网 络 结 构 中 , 残 差 块 都 有 三 层 卷 积 , 那 网 络 总 共 有1+3×(3+4+6+3)=49个卷积层,加上最后的全连接层总共是 50 层,这也是Resnet50 名称的由来。网络的输入为 224×224×3,经过前五部分的卷积计算,输出为 7×7×2048,池化层会将其转化成一个特征向量,最后分类器会对这个特征向量进行计算并输出类别概率。
  • 【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网            

三、数据处理

解压数据集

面多多
面多多

面试鸭推出的AI面试训练平台

面多多 30
查看详情 面多多
In [ ]
!mkdir img 
!unzip /home/aistudio/data/data200134/images.zip -d /home/aistudio/img
登录后复制
   
In [3]
# 导入相关包from sklearn.utils import shuffleimport osimport pandas as pdimport numpy as npfrom PIL import Imageimport paddleimport paddle.nn as nnfrom paddle.io import Datasetimport paddle.vision.transforms as Timport paddle.nn.functional as Ffrom paddle.metric import Accuracyimport random
登录后复制
   
  • 据官方paddleclas的提示,我们需要把图像变为两个txt文件
  • train_txt,val_txt方便训练时读取数据集
In [4]
dirpath = "img"# 先得到总的txt后续再进行划分,因为要划分出验证集,所以要先打乱,因为原本是有序的def get_all_txt():
    all_list = []
    i = 0
    for root in os.listdir(dirpath):
        i = i + 1 
        
        if("0.jpg" in root):
            all_list.append(os.path.join(root)+" 0\n")        if("1.jpg" in root):
            all_list.append(os.path.join(root)+" 1\n")        if("2.jpg" in root):
            all_list.append(os.path.join(root)+" 2\n")        if("3.jpg" in root):
            all_list.append(os.path.join(root)+" 3\n")        if("4.jpg" in root):
            all_list.append(os.path.join(root)+" 4\n")        if("5.jpg" in root):
            all_list.append(os.path.join(root)+" 4\n")        if("6.jpg" in root):
            all_list.append(os.path.join(root)+" 4\n")        if("7.jpg" in root):
            all_list.append(os.path.join(root)+" 4\n")
    allstr = ''.join(all_list)
    f = open('all_list.txt','w',encoding='utf-8')
    f.write(allstr)    return all_list , i

all_list,all_lenth = get_all_txt()print(all_lenth-1) # 有意者是预测的图片,得减去
登录后复制
       
17508
登录后复制
       
In [5]
#打乱原先循序random.shuffle(all_list)
random.shuffle(all_list)
登录后复制
   
In [6]
#划分训练集和验证集train_size = int(15000)
train_list = all_list[:train_size]
val_list = all_list[train_size:]print(len(train_list))print(len(val_list))
登录后复制
       
15000
2509
登录后复制
       
In [7]
# 运行cell,生成txt train_txt = ''.join(train_list)
f_train = open('train_list.txt','w',encoding='utf-8')
f_train.write(train_txt)
f_train.close()print("train_list.txt 生成成功!")
登录后复制
       
train_list.txt 生成成功!
登录后复制
       
In [8]
# 运行cell,生成txtval_txt = ''.join(val_list)
f_val = open('val_list.txt','w',encoding='utf-8')
f_val.write(val_txt)
f_val.close()print("val_list.txt 生成成功!")
登录后复制
       
val_list.txt 生成成功!
登录后复制
       

四、模型训练

In [9]
!unzip -oq /home/aistudio/data/data98136/PaddleClas-release-2.1.zip
登录后复制
   
  • 由于使用的是相对路径,所以我们需要把生成的数据列表移动到“/home/aistudio/PaddleClas-release-2.1/dataset”
In [11]
!mv img PaddleClas-release-2.1/dataset/
!mv all_list.txt PaddleClas-release-2.1/dataset/
!mv train_list.txt PaddleClas-release-2.1/dataset/
!mv val_list.txt PaddleClas-release-2.1/dataset/
登录后复制
   
In [13]
%cd PaddleClas-release-2.1!ls
登录后复制
       
/home/aistudio/PaddleClas-release-2.1
configs  docs	      MANIFEST.in    README_cn.md      setup.py
dataset  __init__.py  paddleclas.py  README.md	       tools
deploy	 LICENSE      ppcls	     requirements.txt
登录后复制
       
  • Paddleclas为我们提供了非常多模型,我们可以根据需求自行选择,"/home/aistudio/PaddleClas-release-2.1/configs"这是配置文件所在的路径,记得修改相关配置【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网 【特训营第三期 】基于PaddleClas的多场景杂草分类 - php中文网            
In [ ]
#我们使用提前准备好的配置文件!python tools/train.py \
    -c /home/aistudio/ResNet50.yaml
登录后复制
   

五、模型评估

  • 在训练的过程中,PaddleClas就可以进行边训练边评估,并根据评估的精度值将最优模型参数存储在output/xxx/best_model目录中。 在训练结束后,可以再单独使用eval.py文件进行评估操作。 然后就可以使用存盘的模型文件进行模型预测,一般在研究阶段和比赛阶段,就是这样操作的。 在实际工业落地的时候,对速度要求更高,一般需要将存盘文件转换为推理模型,然后进行推理和部署。
In [ ]
!python tools/eval.py \
    -c /home/aistudio/ResNet50.yaml \
    -o pretrained_model="/home/aistudio/PaddleClas-release-2.1/output/ResNet50/best_model"\
    -o load_static_weights=False
登录后复制
   
  • 模型训练完成之后,可以加载训练得到的预训练模型(就是存盘文件),进行模型预测。在模型库的 tools/infer/infer.py 中提供了完整的示例,只需执行下述命令即可完成模型预测:
In [ ]
!python tools/infer/infer.py \
    -i ~/work/test \
    --model ResNet50 \
    --pretrained_model "/home/aistudio/PaddleClas-release-2.1/output/ResNet50/best_models" \
    --load_static_weights False \
    --class_num=8
登录后复制
   

以上就是【特训营第三期 】基于PaddleClas的多场景杂草分类的详细内容,更多请关注php中文网其它相关文章!

相关标签:
最佳 Windows 性能的顶级免费优化软件
最佳 Windows 性能的顶级免费优化软件

每个人都需要一台速度更快、更稳定的 PC。随着时间的推移,垃圾文件、旧注册表数据和不必要的后台进程会占用资源并降低性能。幸运的是,许多工具可以让 Windows 保持平稳运行。

下载
来源:php中文网
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
最新问题
开源免费商场系统广告
热门教程
更多>
最新下载
更多>
网站特效
网站源码
网站素材
前端模板
关于我们 免责申明 意见反馈 讲师合作 广告合作 最新更新 English
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送
PHP中文网APP
随时随地碎片化学习

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号