PHP字符编码地狱用fgets读取csv文件

2020-07-01 原文

我有一个网站,每月一次通过FTP接收CSV文件.多年来它是一个ASCII文件.现在我接受一个月的UTF-8,然后是接下来的UTF-16BE和之后一个月的UTF-16LE.也许下个月我会得到UTF-32. fgets返回UTF文件开头的字节顺序标记.如何让 PHP自动识别字符编码？我曾尝试过mb_detect_encoding,无论文件类型如何,它都会返回ASCII.我更改了代码以读取BOM并明确将字符编码放入mb_convert_encoding.这工作到最新文件,即UTF-16LE.在此文件中,它正确读取第一行,所有后续行显示为问号(“？”).我究竟做错了什么？

$fhandle = fopen( $file_in,"r" );
if ( fhandle === false )
    {
    echo "<p class=redbold>Error opening file $file_in.</p>";
    die();
    }

$i = 0;
while( ( $line = fgets( $fhandle ) ) !== false )
{
$i++;

// Detect encoding on first line. Actual text always begins with string "Document"
if ( $i == 1 )
    {
    $line_start = substr( $line,4 );
    $line_start_hex = bin2hex( $line_start );
    $utf16_start = 'fffe4400';
    $utf8_start = 'efbbbf44';
    if ( strcmp( $line_start,'Docu' ) == 0 )
        { $char_encoding = 'ASCII'; }
    elseif ( strcmp( $line_start_hex,'efbbbf44' ) == 0 )
        {
        $char_encoding = 'UTF-8';
        $line = substr( $line,3 );
        }
    elseif ( strcmp( $line_start_hex,'fffe4400' ) == 0 )
        {
        $char_encoding = 'UTF-16LE';
        $line = substr( $line,2 );
        }
    elseif ( strcmp( $line_start_hex,'feff4400' ) == 0 )
        {
        $char_encoding = 'UTF-16BE';
        $line = substr( $line,2 );
        }
    else
        {
        echo "<p class=redbold>Error,unkNown character encoding. Line =<br>",$line_start_hex,'</p>';
        require( '../footer.PHP' );
        die();
        }
    echo "<p>char_encoding = $char_encoding</p>";
    }

// Convert UTF
if ( $char_encoding != 'ASCII' )
    {
    $line = mb_convert_encoding( $line,'ASCII',$char_encoding);
    }

echo '<p>'; var_dump( $line ); echo '</p>';
}

输出：

char_encoding = UTF-16LE

string(101) "DocumentNumber,RecordedTS,Title,PageCount,City,TransTaxAccountCode,TotalTransferTax,Description,Name
"

string(83) "???????????????????????????????????????????????????????????????????????????????????"

string(88) "????????????????????????????????????????????????????????????????????????????????????????"

string(84) "????????????????????????????????????????????????????????????????????????????????????"

string(80) "????????????????????????????????????????????????????????????????????????????????"

明确传递命令和可能的编码进行检测,并使用严格的参数.也
请使用file_get_contents,如果文件是UTF-16LE,fgets会为你搞砸.

<?PHP
header( "Content-Type: text/html; charset=utf-8");
$input = file_get_contents( $file_in );

$encoding = mb_detect_encoding( $input,array(
    "UTF-8","UTF-32","UTF-32BE","UTF-32LE","UTF-16","UTF-16BE","UTF-16LE"
),TRUE );

if( $encoding !== "UTF-8" ) {
    $input = mb_convert_encoding( $input,"UTF-8",$encoding );
}
echo "<p>$encoding</p>";

foreach( explode( PHP_EOL,$input ) as $line ) {
    var_dump( $line );
}

顺序很重要,因为UTF-8和UTF-32限制性更强,UTF-16非常宽松;几乎任何随机的
偶数长度的字节是有效的UTF-16.

保留所有信息的唯一方法是将其转换为unicode编码,而不是ASCII.

PHP字符编码地狱用fgets读取csv文件的更多相关文章

ios – 我可以使用AVCaptureSession将AAC流编码到内存吗？

解决方法我最后向Apple寻求建议.似乎AVCaptureSession抓住了AAC硬件编码器,但只允许您使用它直接写入文件.您可以使用软件编码器,但您必须专门询问它而不是使用AudioConverterNew：同当然,软件编码器会占用cpu资源,但会完成工作.
ios – NSLocalizedString有时会加载字符串,而不是总是

解决方法如果您的localisable文件中有任何额外的分号,它会构建但无法进行本地化.
ios – React native error – react-native-xcode.sh:line 45：react-native：command not found命令/ bin/sh失败,退出代码127

尝试构建任何(新的或旧的)项目时出现此错误.我的节点是版本4.2.1,react-native是版本0.1.7.我看过其他有相同问题的人,所以我已经更新了本机的最新版本,但是我仍然无法通过xcode构建任何项目.解决方法要解决此问题,请使用以下步骤：>使用节点版本v4.2.1>cd进入[你的应用]/node_modules/react-native/packager>$sh./packager.s
ios – NSString cString已被弃用.什么是替代品？

我有另一个新手问题.我写了一段代码,将Nsstring转换为NSMutableData,以模拟一个webService结果.但事实证明,cString已被弃用.你可以帮我更换吗？这是我的代码解决方法>从字符串获取原始字节.>获取UTF8编码中这些字节的长度.>使用dataWithBytes：length：方法创建NSData对象.
ios4 – xcode上的奇怪错误：解析问题Unknow类型名称’plementation’

在线上：Xcode4说：错误解析问题UnkNow类型名称’plementation’之后有很多解析问题.但该项目在iPhone上工作.我真的不知道是什么…id=27对于我自己的项目,我用TextWrangler打开了违规文件,并用“Western”编码重新保存它们,到目前为止,还没有从LLVM/Clang得到任何进一步的问题.
ios – 如何删除/解码URL百分比编码？

我想要一个url并将其转换成更易读的格式.例如我有以下链接：我拿走了不必要的部分,并留下了“Sándor_Font”作为Nsstring.有没有什么方式将它转换成“SándorFont”,而不必输出每一个特殊字符的组合并替换字符串的每个部分？为了演示如何使用它,我写了以下示例代码：最后我要标签说“SándorFont”不是“Sándor_Font”.谢谢！
从iOS应用程序发送帖子到PHP脚本不工作…简单的解决方案就像

我之前已经做了好几次了但是由于某些原因我无法通过这个帖子…我尝试了设置为_POST且没有的变量的PHP脚本……当它们未设置为发布时它工作精细.这是我的iOS代码：这里是PHP的一大块,POST变量不在正确的位置？我想这对于更有经验的开发人员来说是一个相当简单的答案,感谢您的帮助！解决方法$_POST是一个数组,而不是一个函数.您需要使用方括号来访问数组索引：
xcode – XCTest一个元组

我正在尝试构建一个单元测试：但是Xcode给了我一个错误：无法使用类型的参数列表调用’XCTAssertEqual’是否有不同的方法来测试元组而不提取其成员并单独测试？解决方法XCTAssertEqual要求传递给它的两个参数是Equatable,您可以从方法签名中看到它们.注意,expression1返回T?,T必须是Equatable：但是Swifttuplesaren’tEquatable,所以你不能将它们与XCTAssertEqual一起使用.元组确实有一个==方法–它们只是不符合协议–所以你可以
ios – 如何从Core Data创建CSV文件(swift)

我正在构建一个带有核心数据的应用程序,它们显示在tableView中.现在我想将这些数据导出到CSV文件,这样我就可以在windows上的excel中打开它.我搜索了很多,但没有找到正确的答案.有人可以帮助我或给我一个良好的解释或教程的链接？
Swift字符unicode编码

1、字符在C#Object语言中，字符放在单引号(')之间，但是在swift语言中，必须把字符放在双引号之间；（1）unicode编码unicode编码可以有单字节编码，双字节编码和四字节编码，它们的表现形式是"\u{n}"，其中n为1到8个十六进制字符letandSign1:Character="&"letandSign2="\u{26}"letlamda1:Character=""letlam

随机推荐

PHP个人网站架设连环讲(一)

先下一个OmnihttpdProffesinalV2.06，装上就有PHP4beta3可以用了。PHP4给我们带来一个简单的方法，就是使用SESSION（会话）级变量。但是如果不是PHP4又该怎么办？我们可以假设某人在15分钟以内对你的网页的请求都不属于一个新的人次，这样你可以做个计数的过程存在INC里，在每一个页面引用，访客第一次进入时将访问时间送到cookie里。以后每个页面被访问时都检查cookie上次访问时间值。
PHP函数学习之PHP函数点评

PHP函数使用说明，应用举例，精简点评,希望对您学习php有所帮助
ecshop2.7.3 在php5.4下的各种错误问题处理

将方法内的函数，分拆为2个部分。这个和gd库没有一点关系，是ecshop程序的问题。会出现这种问题，不外乎就是当前会员的session或者程序对cookie的处理存在漏洞。进过本地测试，includes\modules\integrates\ecshop.php这个整合自身会员的类中没有重写integrate.php中的check_cookie()方法导致,验证cookie时返回的username为空，丢失了登录状态，在ecshop.php中重写了此方法就可以了。把他加到ecshop.php的最后面去就可
NT IIS下用ODBC连接数据库

$connection=intodbc_connect建立数据库连接，$query_string="查询记录的条件"如：$query_string="select*fromtable"用$cur=intodbc_exec检索数据库，将记录集放入$cur变量中。再用while{$var1=odbc_result;$var2=odbc_result;...}读取odbc_exec()返回的数据集$cur。最后是odbc_close关闭数据库的连接。odbc_result()函数是取当前记录的指定字段值。
PHP使用JpGraph绘制折线图操作示例【附源码下载】

这篇文章主要介绍了PHP使用JpGraph绘制折线图操作,结合实例形式分析了php使用JpGraph的相关操作技巧与注意事项,并附带源码供读者下载参考,需要的朋友可以参考下
zen_cart实现支付前生成订单的方法

这篇文章主要介绍了zen_cart实现支付前生成订单的方法,结合实例形式详细分析了zen_cart支付前生成订单的具体步骤与相关实现技巧,需要的朋友可以参考下
Thinkphp5框架实现获取数据库数据到视图的方法

这篇文章主要介绍了Thinkphp5框架实现获取数据库数据到视图的方法,涉及thinkPHP5数据库配置、读取、模型操作及视图调用相关操作技巧,需要的朋友可以参考下
PHP+jquery+CSS制作头像登录窗（仿QQ登陆）

本篇文章介绍了PHP结合jQ和CSS制作头像登录窗（仿QQ登陆），实现了类似QQ的登陆界面，很有参考价值，有需要的朋友可以了解一下。
基于win2003虚拟机中apache服务器的访问

下面小编就为大家带来一篇基于win2003虚拟机中apache服务器的访问。小编觉得挺不错的，现在就分享给大家，也给大家做个参考。一起跟随小编过来看看吧
Yii2中组件的注册与创建方法

这篇文章主要介绍了Yii2之组件的注册与创建的实现方法，非常不错，具有参考借鉴价值,需要的朋友可以参考下