CSV是一种以纯文本形式存储表格数据的格式,结构简单、通用性强,几乎所有的表格软件和数据库都支持导入导出CSV。PHP在处理CSV方面提供了成熟的函数库,其中fgetcsv是读取CSV文件的核心函数。php8.5延续了php8系列对文件函数的调整思路,部分旧参数已被弃用,同时执行引擎对字符串处理更加严格,因此写法上需要注意一些细节。本文将从基本用法入手,逐步讲解读取、写入、乱码处理和大文件分批等常见场景。

一、fgetcsv的基本用法与参数说明
fgetcsv的作用是从文件指针中读取一行并进行CSV字段解析,返回一个索引数组。它的函数签名如下:
$data = fgetcsv(
resource $stream,
?int $length = null,
string $separator = ",",
string $enclosure = "\"",
string $escape = "\\"
): array|false第一个参数是由fopen打开的文件句柄。第二个参数$length在php8之前的版本用于指定每行的最大长度,而从php8.1开始这个参数已经处于弃用状态,php8.5中建议直接传null,让函数自动处理行长度。第三个参数$separator是字段分隔符,默认是逗号,如果文件是用制表符分隔的TSV文件,改成"\t"即可。第四个参数$enclosure指定字段包裹字符,通常CSV中包含逗号的字段会用双引号包裹。第五个参数$escape是转义字符,实际使用中建议保持默认,不要随意修改,否则可能导致解析结果异常。
一个最基础的读取示例:
// 打开CSV文件
$handle = fopen('data.csv', 'r');
if ($handle === false) {
die('文件打开失败');
}
// 逐行读取直到文件末尾
while (($row = fgetcsv($handle)) !== false) {
// $row 是一个索引数组,对应每一列的值
print_r($row);
}
fclose($handle);这段代码适用于绝大多数标准CSV文件。需要注意的是,fgetcsv在遇到空行时会返回一个只包含null的数组,而不是false,所以在处理包含空行的文件时要单独判断,避免把空行当成有效数据插入数据库。
二、中文乱码与BOM头的处理方法
处理CSV时最常见的坑就是中文乱码。原因在于Excel导出的CSV文件通常是GBK或者UTF-8带BOM编码,而PHP内部字符串处理默认按字节进行,网页输出一般是UTF-8,编码不一致就会出现乱码或字段开头多出不可见字符。
针对BOM头问题,可以在读取第一行时检测并去除:
$handle = fopen('data.csv', 'r');
$first = true;
while (($row = fgetcsv($handle)) !== false) {
if ($first) {
// 去除UTF-8 BOM头(三个字节 EF BB BF)
if (isset($row[0]) && strncmp($row[0], "\xEF\xBB\xBF", 3) === 0) {
$row[0] = substr($row[0], 3);
}
$first = false;
}
print_r($row);
}
fclose($handle);如果文件是GBK编码,需要在读取后调用mb_convert_encoding把每个字段转成UTF-8。这个函数在php8.5中依然稳定可用,前提是服务器启用了mbstring扩展。转换时建议逐字段处理,不要对整行implode后再转,因为GBK中某些字节序列可能与分隔符冲突,逐字段转换更安全。
function convertRow(array $row): array
{
return array_map(
fn($v) => is_string($v) ? mb_convert_encoding($v, 'UTF-8', 'GBK') : $v,
$row
);
}三、大文件分批读取与数据校验
当CSV文件达到几十万行甚至更大时,一次性读入内存会导致内存溢出。fgetcsv本身就是逐行读取的,只要配合固定批量的缓冲逻辑,就能把内存占用控制在很低的水平。常见的做法是每积累500到1000条记录就批量处理一次,比如批量插入数据库。
$handle = fopen('big_data.csv', 'r');
$batch = [];
$batchSize = 500;
$inserted = 0;
// 跳过表头行
fgetcsv($handle);
while (($row = fgetcsv($handle)) !== false) {
// 跳过空行
if (count($row) === 1 && $row[0] === null) {
continue;
}
$batch[] = [
'name' => trim($row[0] ?? ''),
'email' => trim($row[1] ?? ''),
'phone' => trim($row[2] ?? ''),
];
if (count($batch) >= $batchSize) {
// batchInsert($batch); 这里执行批量入库
$inserted += count($batch);
$batch = [];
}
}
// 处理剩余数据
if (!empty($batch)) {
// batchInsert($batch);
$inserted += count($batch);
}
fclose($handle);
echo "共处理 {$inserted} 条记录";数据校验环节也不可省略。CSV是文本文件,用户填入的内容五花八门,可能存在列错位、数字带千分位逗号、日期格式不统一等情况。建议在入库前用filter_var验证邮箱格式,用is_numeric判断数值列,对异常行记录日志并跳过,而不是直接中断整个导入任务,这样单条脏数据不会影响整体流程。
四、CSV文件的写入与导出
除了读取,写入CSV同样常用,比如把数据库查询结果导出成表格。fputcsv与fgetcsv是一对函数,参数含义基本一致,它会自动处理字段中包含逗号、换行符时的引号包裹问题,不需要手动拼接字符串。
$rows = [
['姓名', '年龄', '城市'],
['张三', 28, '北京'],
['李四', 35, '上海'],
];
$handle = fopen('export.csv', 'w');
foreach ($rows as $row) {
fputcsv($handle, $row);
}
fclose($handle);如果要导出后直接用Excel打开且包含中文,写入前记得把数据转成GBK编码,或者在输出时设置正确的Content-Type和charset头信息。对于浏览器直接下载的场景,配合header函数设置Content-Disposition即可实现点击下载,这个流程在php8.5下与之前版本没有区别。
总的来说,php8.5处理CSV文件的思路与之前版本保持一致,重点在于$length参数传null、处理好编码问题和空行判断。掌握fgetcsv与fputcsv这对组合,再配合分批处理和字段校验,就能应对绝大多数CSV导入导出的业务需求。