perl – 如何为URL编码西里尔字符然后解码它们?
发布时间:2020-12-16 06:29:06 所属栏目:大数据 来源:网络整理
导读:我在一个页面上有一个表单: form method="POST" accept-charset="UTF-8" action="index.cgi" name="TestForm" 其中一个输入字段“search_string”可用于发送西里尔字符,如果发生这种情况,则URL字符串如下所示: search_string=%41F%2F%424+%41F%41E%414%416
我在一个页面上有一个表单:
<form method="POST" accept-charset="UTF-8" action="index.cgi" name="TestForm"> 其中一个输入字段“search_string”可用于发送西里尔字符,如果发生这种情况,则URL字符串如下所示: search_string=%41F%2F%424+%41F%41E%414%416%410%420%41A%410+%418%417+%421%412%418%41D 如何将此解码回到我发布到的页面上的原始字符串? 解决方法
正确的解决方案,包括空格:
use open ':std',':encoding(UTF-8)'; use Encode; my $escaped = '%41F%2F%424+%41F%41E%414%416%410%420%41A%410+%418%417+%421%412%418%41D'; (my $unescaped = $escaped) =~ s/+/ /g; $unescaped =~ s/%([[:xdigit:]]+)/chr hex $1/eg; print $unescaped; # П/Ф ПОДЖАРКА ИЗ СВИН 由于认识到这些是以%为前缀的Unicode代码点,因此将信用转到Renaud Bompuis. 我想补充一点,问题的编码方案非常不寻常,我以前没见过.通常人们会期望将字符串П/ФПОДЖАРКАИЗСВИН编码为П/ФПОДЖАРКАИЗСВИН,也就是说,首先将字符编码为UTF-8,然后八位字节进行百分比转义.该方案适用于Dr.Kameleon的答案. (编辑:李大同) 【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容! |