PHP处理CSV文件的核心是fgetcsv和fputcsv函数,通过fopen、循环读取或写入、fclose实现流式操作,可高效处理任意大小文件;读取时需注意BOM头和编码问题,避免中文乱码,可使用mb_convert_encoding转换;fgetcsv和fputcsv自动处理含分隔符或引号的字段,支持自定义分隔符和包围符;对于大文件,应采用逐行读取和写入策略,避免内存溢出;此外,thephpleague/csv库提供面向对象的高级API,支持数据过滤、映射、分页等特性,适合复杂场景,提升开发效率与代码健壮性。

PHP处理CSV文件,无论是读取还是写入,核心都围绕着几个内置的文件操作函数,特别是
fgetcsv
fputcsv
在PHP中操作CSV文件,我们通常会使用
fopen()
fgetcsv()
fputcsv()
fclose()
读取CSV文件示例:
<?php
$filePath = 'data.csv';
$data = [];
if (($handle = fopen($filePath, 'r')) !== FALSE) {
// 尝试跳过可能存在的BOM头
$bom = fread($handle, 3);
if ($bom !== "\xEF\xBB\xBF") {
rewind($handle); // 如果没有BOM,则将文件指针重置到开头
}
while (($row = fgetcsv($handle, 1000, ',')) !== FALSE) {
// 假设CSV文件是UTF-8编码,如果不是,可能需要mb_convert_encoding
// $row = array_map('mb_convert_encoding', $row, array_fill(0, count($row), 'UTF-8'), array_fill(0, count($row), 'GBK'));
$data[] = $row;
}
fclose($handle);
}
// 此时 $data 数组中包含了CSV文件的所有行
// print_r($data);
?>写入CSV文件示例:
立即学习“PHP免费学习笔记(深入)”;
<?php
$filePath = 'output.csv';
$list = [
['姓名', '年龄', '城市'],
['张三', '30', '北京'],
['李四', '25', '上海,中国'], // 包含逗号的字段会被自动加引号
['王五', '35', '广州']
];
if (($handle = fopen($filePath, 'w')) !== FALSE) {
// 添加UTF-8 BOM,确保Excel等软件正确识别编码
fwrite($handle, "\xEF\xBB\xBF");
foreach ($list as $fields) {
fputcsv($handle, $fields);
}
fclose($handle);
}
?>fgetcsv()
fputcsv()
很多时候,我们面对的CSV文件可能不是几KB,而是几十MB甚至几个GB。这时,如果直接尝试用
file_get_contents()
memory_limit
解决之道在于流式处理。PHP的文件操作函数,尤其是
fopen()
fgetcsv()
fputcsv()
读取大型文件:
fgetcsv()
<?php
// ... (fopen 部分与之前相同)
if (($handle = fopen('large_data.csv', 'r')) !== FALSE) {
// ... (BOM 处理)
while (($row = fgetcsv($handle, 0, ',')) !== FALSE) { // 0 表示无最大行长限制
// 在这里直接处理每一行数据,例如:
// 插入数据库、进行计算、筛选等
// 不要将所有行都存入一个大数组,那样又会回到内存问题
// echo "处理行: " . implode(', ', $row) . "\n";
}
fclose($handle);
}
?>这种方式下,你的脚本内存消耗将保持在一个非常低的水平,只取决于你当前处理的逻辑以及临时变量。
写入大型文件: 同样,写入时也应该避免一次性构建一个巨大的数组再写入。而是应该逐行生成数据,然后立即通过
fputcsv()
<?php
// ... (fopen 部分与之前相同)
if (($handle = fopen('large_output.csv', 'w')) !== FALSE) {
fwrite($handle, "\xEF\xBB\xBF"); // BOM
// 假设你有大量数据需要生成并写入
for ($i = 0; $i < 1000000; $i++) {
$rowData = ["Item_$i", rand(1, 100), "Category_" . ($i % 10)];
fputcsv($handle, $rowData);
}
fclose($handle);
}
?>通过这种逐行写入的方式,你不需要在内存中保存所有待写入的数据,从而避免了内存溢出的风险。记住,流式处理是处理大文件的黄金法则。
CSV文件看似简单,但实际操作中,特殊字符、编码和分隔符常常是导致解析失败或数据错乱的罪魁祸首。我见过太多因为编码问题导致中文乱码,或者字段内容包含逗号而导致列错位的案例。
1. 编码问题:UTF-8 BOM 最常见的是UTF-8编码的CSV文件,尤其是在Windows环境下用Excel打开时,如果文件没有UTF-8 BOM(Byte Order Mark),Excel可能会将其识别为ANSI或其他编码,导致中文乱码。
fopen
\xEF\xBB\xBF
fopen
fwrite($handle, "\xEF\xBB\xBF");
此外,如果CSV文件不是UTF-8,例如是GBK,你需要在读取每一行数据后,使用
mb_convert_encoding()
iconv()
// 示例:将GBK编码的CSV内容转换为UTF-8
// $row = array_map(function($field) {
// return mb_convert_encoding($field, 'UTF-8', 'GBK');
// }, $row);2. 分隔符与包围符: CSV(Comma Separated Values)顾名思义是用逗号分隔。但实际中,也可能遇到用分号、制表符甚至其他字符分隔的情况。
fgetcsv($handle, 0, ';', '"')
fgetcsv
fputcsv
fputcsv()
fputcsv
"He said ""Hello""."
// 示例:字段内容包含逗号和双引号
$dataWithSpecialChars = [
['产品A', '描述,包含逗号', '价格 "100" 美元'],
['产品B', '另一个描述', '价格 "200" 美元']
];
// fputcsv会自动处理这些特殊情况
// fputcsv($handle, $dataWithSpecialChars[0]);
// 输出类似: "产品A","描述,包含逗号","价格 ""100"" 美元"理解这些自动处理机制,可以避免很多手动转义的麻烦,但也要确保你的输入数据格式是规范的。
虽然PHP的内置函数功能强大且高效,但在一些更复杂的场景,或者追求更高开发效率、更健壮的代码时,使用第三方库会是一个非常明智的选择。它们通常提供了更高级的抽象、更丰富的配置选项和更好的错误处理机制。
我个人比较推荐的是 thephpleague/csv
thephpleague/csv
Reader
Writer
使用 thephpleague/csv
首先,通过Composer安装:
composer require thephpleague/csv
读取CSV文件:
<?php
require 'vendor/autoload.php';
use League\Csv\Reader;
use League\Csv\Statement;
$csv = Reader::createFromPath('data.csv', 'r');
$csv->setDelimiter(','); // 设置分隔符
$csv->setHeaderOffset(0); // 将第一行作为标题行,后续数据将以关联数组形式返回
// 获取所有记录
$records = $csv->getRecords();
foreach ($records as $record) {
// $record 现在是一个关联数组,键是标题行中的字段名
// print_r($record);
}
// 或者使用Statement进行过滤、排序、分页
$stmt = (new Statement())
->offset(1) // 跳过第一行(如果setHeaderOffset(0)已设置,这里会跳过第二行数据)
->limit(10); // 只获取10行
$filteredRecords = $stmt->process($csv);
foreach ($filteredRecords as $record) {
// print_r($record);
}
?>写入CSV文件:
<?php
require 'vendor/autoload.php';
use League\Csv\Writer;
$writer = Writer::createFromPath('output_library.csv', 'w+');
$writer->setDelimiter(',');
$writer->setOutputBOM(Reader::BOM_UTF8); // 添加UTF-8 BOM
$header = ['姓名', '年龄', '城市'];
$data = [
['张三', '30', '北京'],
['李四', '25', '上海,中国'],
['王五', '35', '广州']
];
$writer->insertOne($header); // 写入标题行
$writer->insertAll($data); // 写入所有数据
// 也可以逐行写入
// foreach ($data as $row) {
// $writer->insertOne($row);
// }
?>在我看来,当项目规模较大、需要频繁且复杂地操作CSV文件时,引入
thephpleague/csv
以上就是PHP如何解析和生成CSV文件_PHP CSV文件读写操作指南的详细内容,更多请关注php中文网其它相关文章!
PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!
Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号