0

0

如何使用 os.walk() 生成包含目录结构的 UTF-8 编码文本文件

碧海醫心

碧海醫心

发布时间:2026-01-09 17:03:49

|

695人浏览过

|

来源于php中文网

原创

如何使用 os.walk() 生成包含目录结构的 UTF-8 编码文本文件

本文详解如何用 python 的 `os.walk()` 安全遍历含非 ascii 字符(如西里尔文、希腊字母)的路径,并生成正确编码的目录结构文本文件,核心在于显式指定文件写入时的 utf-8 编码。

在使用 os.walk() 生成目录结构树时,若目标路径中存在 Unicode 文件名(例如俄语、希腊语、中文等),原始代码常会抛出 UnicodeEncodeError,典型错误信息如下:

UnicodeEncodeError: 'charmap' codec can't encode characters in position 4-11: character maps to 

该异常并非源于 os.walk() 本身——Python 3 中 os.walk() 默认返回 str 类型的 Unicode 路径和文件名(内部以 UTF-8 表示),完全支持多语言字符。真正的问题出在文件写入环节:open(file_name, "w") 在未指定 encoding 参数时,会采用系统默认编码(Windows 上常为 cp1252,Linux/macOS 通常为 utf-8),而 cp1252 等传统编码无法表示绝大多数非拉丁字符,导致写入失败。

✅ 正确解法是:显式声明文件编码为 'utf-8'。修改后的健壮版本如下:

import os

def record_directory_structure(directory_path: str, file_name: str):
    # ✅ 关键修复:强制使用 UTF-8 编码写入文件
    with open(file_name, "w", encoding='utf-8') as file:
        for root, dirs, files in os.walk(directory_path):
            # 计算当前目录层级(相对于起始路径)
            level = root.replace(directory_path, '').count(os.sep)
            indent = ' ' * 4 * level
            # 写入目录名(结尾加 '/')
            file.write(f'{indent}{os.path.basename(root)}/\n')

            # 子项缩进(比目录多一级)
            subindent = ' ' * 4 * (level + 1)
            # 按字典序排序文件,提升可读性(可选)
            for f in sorted(files):
                file.write(f'{subindent}{f}\n')

? 使用示例:

Asp.net企业网站管理系统2.0 (精美实用)
Asp.net企业网站管理系统2.0 (精美实用)

漂亮的企业网站。NET2.0出来了, 本次升级修改如下: 1、优化了3层结构。 2、优化了后台管理代码,增强了安全性能。 3、增加了系统名称及关键字管理。 4、增加了系统错误日志记录,自动生成Systemlog.log日志文件。 备注:本系统采用ASP.NET 2.O+ACCESS开发,请调试的朋友安装.NET2.0运行环境! 网站内容 网站栏目包括 首页|企业简介|新闻中心|产品展示|公司展示|

下载
record_directory_structure(r"C:\my_project", "structure.txt")
# 或处理含西里尔文路径:
record_directory_structure(r"D:\Проекты\Анализ", "структура.txt")

⚠️ 注意事项:

  • 不要尝试对文件名做 encode('utf-8').decode('utf-8') 等无意义的编解码操作——这既不解决写入问题,还可能引入冗余或错误;
  • 若需兼容旧版 Python(
  • 生成的 .txt 文件可用 VS Code、Notepad++ 或现代系统记事本(启用 UTF-8 检测)正确查看,避免用老旧记事本直接打开(它可能误判编码);
  • 如需增强可读性,可对 dirs 和 files 分别排序(例如 sorted(dirs)),使输出结构更稳定。

总结:处理国际化路径的核心原则是——读取靠 os.walk() 自动 Unicode 化,写入靠 open(..., encoding='utf-8') 显式保真。一句代码修正,即可彻底规避编码陷阱。

相关专题

更多
python开发工具
python开发工具

php中文网为大家提供各种python开发工具,好的开发工具,可帮助开发者攻克编程学习中的基础障碍,理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容,供大家免费下载使用。

741

2023.06.15

python打包成可执行文件
python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章,大家可以免费的下载体验。

634

2023.07.20

python能做什么
python能做什么

python能做的有:可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

756

2023.07.25

format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

617

2023.07.31

python教程
python教程

Python已成为一门网红语言,即使是在非编程开发者当中,也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章,大家可以免费体验学习。

1259

2023.08.03

python环境变量的配置
python环境变量的配置

Python是一种流行的编程语言,被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后,我们需要配置环境变量,以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

547

2023.08.04

python eval
python eval

eval函数是Python中一个非常强大的函数,它可以将字符串作为Python代码进行执行,实现动态编程的效果。然而,由于其潜在的安全风险和性能问题,需要谨慎使用。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

577

2023.08.04

scratch和python区别
scratch和python区别

scratch和python的区别:1、scratch是一种专为初学者设计的图形化编程语言,python是一种文本编程语言;2、scratch使用的是基于积木的编程语法,python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容,供大家免费下载体验。

705

2023.08.11

c++主流开发框架汇总
c++主流开发框架汇总

本专题整合了c++开发框架推荐,阅读专题下面的文章了解更多详细内容。

3

2026.01.09

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
PostgreSQL 教程
PostgreSQL 教程

共48课时 | 6.9万人学习

Git 教程
Git 教程

共21课时 | 2.5万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号