- android - RelativeLayout 背景可绘制重叠内容
- android - 如何链接 cpufeatures lib 以获取 native android 库?
- java - OnItemClickListener 不起作用,但 OnLongItemClickListener 在自定义 ListView 中起作用
- java - Android 文件转字符串
假设我想在 PHP 中存储 8 个单词的序列,并且我不想使用压缩。
因为只有 8 个单词,我可以为每个单词分配一个二进制值,然后将这些二进制值而不是 ascii 单词存储在一个文件中。
可能的二进制值是:
000, 001, 010, 011, 100, 101, 110, 111
这会更有效地解析,因为:(1) 现在每个单词的大小都相同,并且 (2) 它占用的空间少得多。
我的问题是:
我如何在 PHP 中执行此操作?我怎样才能为某物分配一个二进制值,然后将其写入文件(按照我想要的方式写入位),然后再次读回?
我想这样做的原因是为了创建一个高效的索引系统。
最佳答案
首先,如果您想压缩数据,请使用 php 内置函数,例如 gzip 扩展..
但正如您所要求的,我已经准备了一个如何在 PHP 中完成此操作的示例。它并不完美,只是一个微不足道的实现。如果我使用每个整数的第 30 位和第 32 位之间的间隙,压缩率可能会更好。也许会添加此功能...但是我使用了 32 位无符号整数来支持字节,因为它们的损失是每 32 位损失 2 位,而不是每字节损失 2 位。
首先我们准备包含关系词=>十进制数的查找表,即编码表:
<?php
// coding table
$lookupTable = array (
// 'word0' => chr(0), // reserved for 0 byte gap in last byte
'word1' => chr(1),
'word2' => chr(2),
'word3' => chr(3),
'word4' => chr(4),
'word5' => chr(5),
'word6' => chr(6),
// reserve one word for white space
' ' => chr(7)
);
然后是压缩函数:
/**
*
*/
function _3bit_compress($text, $lookupTable) {
echo 'before compression : ' . strlen($text) . ' chars', PHP_EOL;
// first step is one byte compression using the lookup table
$text = strtr($text, $lookupTable);
echo 'after one byte per word compression : ' . strlen($text) . ' chars', PHP_EOL;
$bin = ''; // the result
$carrier = 0; // 32 bit usingned int can 'carry' 10 words in 3 bit notation
for($c = 0; $c < strlen($text); $c++) {
$triplet = $c % 10;
// every 30 bits we add the 4byte unsigned integer to $bin.
// please read the manual of pack
if($triplet === 0 && $carrier !== 0) {
$bin .= pack('N', $carrier);
$carrier = 0;
}
$char = $text[$c];
$carrier <<= 3; // make space for the the next 3 bits
$carrier += ord($char); // add the next 3 bit pattern
// echo $carrier, ' added ' . ord($char), PHP_EOL;
}
$bin .= pack('N', $carrier); // don't forget the remaining bits
echo 'after 3 bit compression : ' . strlen($bin) . ' chars', PHP_EOL;
return $bin;
}
以及解压函数:
/**
*
*/
function _3_bit_uncompress($compressed, $lookupTable) {
$len = strlen($compressed);
echo 'compressed length: : ' . $len . ' chars', PHP_EOL;
$i = 0;
$tmp = '';
$text = '';
// unpack string as 4byte unsigned integer
foreach(unpack('N*', $compressed) as $carrier) {
while($i < 10) {
$code = $carrier & 7; // get the next code
// echo $carrier . ' ' . $code, PHP_EOL;
$tmp = chr($code) . $tmp;
$i++;
$carrier >>= 3; // shift forward to the next 3 bits
}
$i = 0;
$text = $text . $tmp;
$tmp = '';
}
// reverse translate from decimal codes to words
return strtr($text, array_flip($lookupTable));
}
现在是测试功能的时候了:)
$original = <<<EOF
word1 word2 word3 word4 word5 word6 word1 word3 word3 word2
EOF;
$compressed = _3bit_compress($original, $lookupTable);
$restored = _3_bit_uncompress($compressed, $lookupTable);
echo 'compressed size: ' . round(strlen($compressed) * 100 / strlen($original), 2) . '%', PHP_EOL;
echo 'Message before compression : ' . $original, PHP_EOL;
echo 'Message after decompression : ' . $restored, PHP_EOL;
这个例子应该给你:
before compression : 60 chars
after one byte per word compression : 20 chars
after 3 bit compression : 8 chars
compressed length: : 8 chars
compressed size: 13,33%
Message before compression : word1 word2 word3 word4 word5 word6 word1 word3 word3 word2
Message after decompression : word1 word2 word3 word4 word5 word6 word1 word3 word3 word2
如果我们用长词进行测试,压缩率当然会变得更好:
before compression : 112 chars
after one byte per word compression : 16 chars
after 3 bit compression : 8 chars
compressed length: : 8 chars
compressed size: 7,14%
Message before compression : wooooooooord1 wooooooooord2 wooooooooord2 wooooooooord3 wooooooooord1 wooooooooord2 wooooooooord2 wooooooooord3
Message after decompression : wooooooooord1 wooooooooord2 wooooooooord2 wooooooooord3 wooooooooord1 wooooooooord2 wooooooooord2 wooooooooord3
关于php - 在 PHP 中使用位,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/15108768/
我在 JavaScript 文件中运行 PHP,例如...... var = '';). 我需要使用 JavaScript 来扫描字符串中的 PHP 定界符(打开和关闭 PHP 的 )。 我已经知道使
我希望能够做这样的事情: php --determine-oldest-supported-php-version test.php 并得到这个输出: 7.2 也就是说,php 二进制检查 test.
我正在开发一个目前不使用任何框架的大型 php 站点。我的大问题是,随着时间的推移慢慢尝试将框架融入应用程序是否可取,例如在创建的新部件和更新的旧部件中? 比如所有的页面都是直接通过url服务的,有几
下面是我的源代码,我想在同一页面顶部的另一个 php 脚本中使用位于底部 php 脚本的变量 $r1。我需要一个简单的解决方案来解决这个问题。我想在代码中存在的更新查询中使用该变量。 $name)
我正在制作一个网站,根据不同的情况进行大量 PHP 重定向。就像这样...... header("Location: somesite.com/redirectedpage.php"); 为了安全起见
我有一个旧网站,我的 php 标签从 因为短标签已经显示出安全问题,并且在未来的版本中将不被支持。 关于php - 如何避免在 php 文件中写入
我有一个用 PHP 编写的配置文件,如下所示, 所以我想用PHP开发一个接口(interface),它可以编辑文件值,如$WEBPATH , $ACCOUNTPATH和 const值(value)观
我试图制作一个登录页面来学习基本的PHP,首先我希望我的独立PHP文件存储HTML文件的输入(带有表单),但是当我按下按钮时(触发POST到PHP脚本) )我一直收到令人不愉快的错误。 我已经搜索了S
我正在寻找一种让 PHP 以一种形式打印任意数组的方法,我可以将该数组作为赋值包含在我的(测试)代码中。 print_r 产生例如: Array ( [0] => qsr-part:1285 [1]
这个问题已经有答案了: 已关闭11 年前。 Possible Duplicate: What is the max key size for an array in PHP? 正如标题所说,我想知道
我正在寻找一种让 PHP 以一种形式打印任意数组的方法,我可以将该数组作为赋值包含在我的(测试)代码中。 print_r 产生例如: Array ( [0] => qsr-part:1285 [1]
关闭。这个问题需要多问focused 。目前不接受答案。 想要改进此问题吗?更新问题,使其仅关注一个问题 editing this post . 已关闭 9 年前。 Improve this ques
我在 MySQL 数据库中有一个表,其中存储餐厅在每个工作日和时段提供的菜单。 表结构如下: i_type i_name i_cost i_day i_start i_
我有两页。 test1.php 和 test2.php。 我想做的就是在 test1.php 上点击提交,并将 test2.php 显示在 div 中。这实际上工作正常,但我需要向 test2.php
我得到了这个代码。我想通过textarea更新mysql。我在textarea中回显我的MySQL,但我不知道如何更新它,我应该把所有东西都放进去吗,因为_GET模式没有给我任何东西,我也尝试_GET
首先,我是 php 的新手,所以我仍在努力学习。我在 Wordpress 上创建了一个表单,我想将值插入一个表(data_test 表,我已经管理了),然后从 data_test 表中获取所有列(id
我有以下函数可以清理用户或网址的输入: function SanitizeString($var) { $var=stripslashes($var); $va
我有一个 html 页面,它使用 php 文件查询数据库,然后让用户登录,否则拒绝访问。我遇到的问题是它只是重定向到 php 文件的 url,并且从不对发生的事情提供反馈。这是我第一次使用 html、
我有一个页面充满了指向 pdf 的链接,我想跟踪哪些链接被单击。我以为我可以做如下的事情,但遇到了问题: query($sql); if($result){
我正在使用 从外部文本文件加载 HTML/PHP 代码 $f = fopen($filename, "r"); while ($line = fgets($f, 4096)) { print $l
我是一名优秀的程序员,十分优秀!