0

0

如何在Golang中使用bufio按行读取文件_高效处理大文本

P粉602998670

P粉602998670

发布时间:2025-12-31 08:02:02

|

855人浏览过

|

来源于php中文网

原创

bufio.Scanner 是 Go 中按行读取大文本的高效方式,底层缓冲减少系统调用,默认单行上限 64KB,支持自动处理 \n 和 \r\n,需手动扩容以支持超长行,错误仅通过 scanner.Err() 获取。

如何在golang中使用bufio按行读取文件_高效处理大文本

在 Go 中用 bufio.Scanner 按行读取文件,是处理大文本最常用且高效的方式——它底层基于缓冲,避免频繁系统调用,内存占用可控,默认单行上限 64KB,适合日志、CSV、配置等场景。

使用 bufio.Scanner 安全读取大文件

bufio.Scanner标准库推荐方案,自动处理换行符(\n\r\n),无需手动切分。关键点:

  • 默认每行最大 64KB,超长会报错;如需读超长行,需调用 scanner.Buffer 手动扩容
  • 不返回错误详情(只返回 scanner.Err()),若需精确错误定位,建议搭配 bufio.Reader 使用
  • 逐行迭代,不加载全文进内存,适合 GB 级日志文件

基础用法:打开文件 + 扫描 + 处理

典型代码结构简洁清晰:

f, err := os.Open("large.log")
if err != nil {
    log.Fatal(err)
}
defer f.Close()

scanner := bufio.NewScanner(f)
for scanner.Scan() {
    line := scanner.Text() // 或 scanner.Bytes() 获取字节切片
    // 处理每一行,例如:strings.TrimSpace(line)
}
if err := scanner.Err(); err != nil {
    log.Fatal(err) // 注意检查扫描结束后的潜在错误(如 I/O 中断)
}

处理超长行或自定义分隔符

当某行超过 64KB(如单行 JSON 或 base64 内容),需提前设置缓冲区:

Contentfries
Contentfries

将长视频改造成更加引人注目的短视频

下载

立即学习go语言免费学习笔记(深入)”;

scanner := bufio.NewScanner(f)
// 扩容至最多 1MB 每行
buf := make([]byte, 0, 1*1024*1024)
scanner.Buffer(buf, 1*1024*1024)

如需按其他符号分割(比如以 | 分隔),可改用 bufio.Reader 配合 ReadStringReadBytes,但需自行处理换行和缓冲边界。

性能提示与常见避坑

  • 避免在循环内反复创建 strings.Reader 或正则对象;高频处理建议复用 regexp.Regexp
  • 若只需统计行数或简单匹配,用 scanner.Text() 足够;若后续要频繁切片/修改,考虑用 scanner.Bytes() 减少字符串分配
  • 不要用 scanner.Bytes() 后直接保存指针——下一次 Scan() 会覆盖底层缓冲,需 append([]byte{}, ...) 拷贝
  • Windows 文件含 \r\n?不用管,Scanner 自动归一化为 \nText() 返回结果不含 \r

不复杂但容易忽略细节,掌握 Scanner 的缓冲机制和错误检查方式,就能稳稳吃下几个 GB 的纯文本。

相关专题

更多
golang如何定义变量
golang如何定义变量

golang定义变量的方法:1、声明变量并赋予初始值“var age int =值”;2、声明变量但不赋初始值“var age int”;3、使用短变量声明“age :=值”等等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

174

2024.02.23

golang有哪些数据转换方法
golang有哪些数据转换方法

golang数据转换方法:1、类型转换操作符;2、类型断言;3、字符串和数字之间的转换;4、JSON序列化和反序列化;5、使用标准库进行数据转换;6、使用第三方库进行数据转换;7、自定义数据转换函数。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

224

2024.02.23

golang常用库有哪些
golang常用库有哪些

golang常用库有:1、标准库;2、字符串处理库;3、网络库;4、加密库;5、压缩库;6、xml和json解析库;7、日期和时间库;8、数据库操作库;9、文件操作库;10、图像处理库。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

335

2024.02.23

golang和python的区别是什么
golang和python的区别是什么

golang和python的区别是:1、golang是一种编译型语言,而python是一种解释型语言;2、golang天生支持并发编程,而python对并发与并行的支持相对较弱等等。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

206

2024.03.05

golang是免费的吗
golang是免费的吗

golang是免费的。golang是google开发的一种静态强类型、编译型、并发型,并具有垃圾回收功能的开源编程语言,采用bsd开源协议。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

388

2024.05.21

golang结构体相关大全
golang结构体相关大全

本专题整合了golang结构体相关大全,想了解更多内容,请阅读专题下面的文章。

193

2025.06.09

golang相关判断方法
golang相关判断方法

本专题整合了golang相关判断方法,想了解更详细的相关内容,请阅读下面的文章。

187

2025.06.10

golang数组使用方法
golang数组使用方法

本专题整合了golang数组用法,想了解更多的相关内容,请阅读专题下面的文章。

191

2025.06.17

桌面文件位置介绍
桌面文件位置介绍

本专题整合了桌面文件相关教程,阅读专题下面的文章了解更多内容。

0

2025.12.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
WEB前端教程【HTML5+CSS3+JS】
WEB前端教程【HTML5+CSS3+JS】

共101课时 | 8.1万人学习

JS进阶与BootStrap学习
JS进阶与BootStrap学习

共39课时 | 3.1万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号