UUencode 編碼，UU編碼介紹、UUencode編碼轉換原理與算法

更新時間：2016年06月04日 21:42:20 投稿：mdxy-dxy

這篇文章主要介紹了UUencode 編碼，UU編碼介紹、UUencode編碼轉換原理與算法,需要的朋友可以參考下

UUencode編碼起先用在unix網絡中，先是Unix系統(tǒng)下將二進制的資料借由uucp郵件系統(tǒng)傳輸?shù)囊粋€編碼程式，也是一種二進制到文字的編碼。不屬于MIME編碼中一員。它也是定義了用可打印字符表示二進制文字一種方法，并不是一種新的編碼集合。主要解決，二進制字符在傳輸、存儲中問題。它早期在電子郵件中使用較多，最近這些年來基本上被MIME 中Base64所取代了。E-mail中一般采用UU、MIME、BINHEX三種編碼標準! 我想，了解下這種編碼將二進制字符轉換為可打印字符實現(xiàn)思路！對我們以后做類似處理工作，應該會有很多的啟示。

UUencode編碼過程

Uuencode將輸入資料以每三個字節(jié)為單位進行編碼，如此重復進行。如果最后剩下的資料少于三個字節(jié)，不夠的部份用零補齊。這三個字節(jié)共有24個Bit，以6-bit為單位分為4個群組，每個群組以十進制來表示所出現(xiàn)的數(shù)值只會落在0到63之間。將每個數(shù)加上32，所產生的結果剛好落在ASCII字符集中可打印字符（32-空白…95-底線）的范圍之中。每60個編碼輸出（相當于45個輸入字節(jié)）將輸出為獨立的一行，每行的開頭會加上長度字符，除了最后一行之外，長度字符都應該是'M'這個ASCII字符（77=32+45），最后一行的長度字符為32+剩下的字節(jié)數(shù)目這個ASCII字符。如果是一個 0字節(jié)那它應該被轉換為0×60而不是0×20，因為（前引用'`'）優(yōu)于 0×20（空格' ‘)。

特點一：看到特點了吧，也是64字符，也是一組6位。怎么,怎么,跟我們的base64這么相似呢？是的，從這個定義中，我們確實發(fā)現(xiàn)它跟base64比起來很相似了。

特點二：它定義64字符，不用寫映射表，是通過加32轉換到可打印字符范圍中。比起base64，更為簡單！

思考問題：它的字符范圍都是可打印字符，我們會發(fā)現(xiàn)64字符集合中，有很多是特殊字符:”!”#￥%&‘（）*+='” 等等。這些字符在不同應用中，可能都有些特殊用途。因此，在使用該編碼時候，或許會出現(xiàn)一些問題。我想這也許是UUencode編碼方法，逐漸被Base64所取代的原因吧。

UUencode 64字符集

可打印字符	十進制ASCII值	uuencode 二進制表示	uuencode 十進制表示	可打印字符	十進制ASCII值	uuencode 二進制表示	uuencode 十進制表示
(space)	32	000 000	0	@	64	100 000	32
!	33	000 001	1	A	65	100 001	33
"	34	000 010	2	B	66	100 010	34
#	35	000 011	3	C	67	100 011	35
$	36	000 100	4	D	68	100 100	36
%	37	000 101	5	E	69	100 101	37
&	38	000 110	6	F	70	100 110	38
'	39	000 111	7	G	71	100 111	39
(	40	001 000	8	H	72	101 000	40
)	41	001 001	9	I	73	101 001	41
*	42	001 010	10	J	74	101 010	42
+	43	001 011	11	K	75	101 011	43
,	44	001 100	12	L	76	101 100	44
-	45	001 101	13	M	77	101 101	45
.	46	001 110	14	N	78	101 110	46
/	47	001 111	15	O	79	101 111	47
0	48	010 000	16	P	80	110 000	48
1	49	010 001	17	Q	81	110 001	49
2	50	010 010	18	R	82	110 010	50
3	51	010 011	19	S	83	110 011	51
4	52	010 100	20	T	84	110 100	52
5	53	010 101	21	U	85	110 101	53
6	54	010 110	22	V	86	110 110	54
7	55	010 111	23	W	87	110 111	55
8	56	011 000	24	X	88	111 000	56
9	57	011 001	25	Y	89	111 001	57
:	58	011 010	26	Z	90	111 010	58
;	59	011 011	27	[	91	111 011	59
<	60	011 100	28	\	92	111 100	60
=	61	011 101	29	]	93	111 101	61
>	62	011 110	30	^	94	111 110	62
?	63	011 111	31	_	95	111 111	63
				`	96	(1) 000 000	64

UUencode編碼轉換過程

原始字符	C								a								t
原始ASCII碼（十進制）	67								97								116
ASCII碼（二進制）	0	1	0	0	0	0	1	1	0	1	1	0	0	0	0	1	0	1	1	1	0	1	0	0
新的十進制數(shù)值	16						54						5						52
+32	48						86						37						84
編碼后的Uuencode字符	0						V						%						T

字符串：'Cat‘ 編碼后是：oV%T
UUencode PHP實現(xiàn)過程

編碼轉換過程，與Base64類似！下面代碼是實現(xiàn)過程，我們可以看看轉換方法！

/**
 *uuencode編碼*
 *@author 程默
 *@copyright http://blog.chacuo.net/
 *@param string $src 待處理字符串
 *@return string encode編碼完字符串
 */
function c_uu_encode($src)
{
	///每次讀取3個字節(jié)
	$lbyte = 3;
	////將原始的3個字節(jié)轉換為4個字節(jié)
	$slen=strlen($src);
	$smod = ($slen%$lbyte);
	$snum = floor($slen/$lbyte);


	$desc = array();
	
	//將剩下字節(jié)以0字節(jié)補齊
	$src = $smod===0?$src:$src.str_repeat("\0",$lbyte-$smod);
	$snum = $smod===0?$snum:$snum+1;

	for($i=0;$i<$snum;$i++)
	{
		////讀取3個字節(jié)
		$_arr = array_map('ord',str_split(substr($src,$i*$lbyte,$lbyte)));

		///計算每一個6位值
		$_dec = array();
		$_dec[]=$_arr[0]>>2;
		$_dec[]=(($_arr[0]&3)<<4)|($_arr[1]>>4);
		$_dec[]=(($_arr[1]&0xF)<<2)|($_arr[2]>>6);
		$_dec[]=$_arr[2]&63;
		
		///對每個6位值加上32，讀取ascii碼 如果6位值是0，以字符"`"代替
		foreach ($_dec as &$v)
		{
			$v = $v===0?'`':chr($v+32);
		}
		$desc = array_merge($desc,$_dec);
	}
	//return implode('',$desc);
	
	///以上代碼只是進行轉換，沒有進一步進行
	//每60個編碼輸出（相當于45個輸入字節(jié)）將輸出為獨立的一行，每行的開頭會加上長度字符，除了最后一行之外，長度字符都應該是'M'這個ASCII字符（77=32+45），最后一行的長度字符為32+剩下的字節(jié)數(shù)目這個ASCII字符。
	$abyte = 60;
	$crlf = "\r\n";
	$alen = count($desc);
	$anum = floor($alen/$abyte);
	$amod = ($alen%$abyte);
	
	$adesc = array();
	
	for ($i=0;$i<$anum;$i++)
	{
		$adesc[]='M'.implode('',array_slice($desc,$i*$abyte,$abyte)).$crlf;
	}
	
	///截取后面剩余數(shù)組長度
	if($amod!==0)
	{
		///以下計算不滿45字節(jié)編碼情況
		$adesc[]=chr($amod/4*3+32+($smod?$smod-$lbyte:$smod)).implode('',array_slice($desc,-$amod)).$crlf;
	}
	
	return implode('',$adesc);	
}

以上只是按照轉換過程，通過PHP代碼實現(xiàn)方法！目前PHP沒有UUencode轉換模塊！

該代碼轉換結果，跟使用工具轉換結果一致。我查看了線上一些轉換方法，很多結果不一致！最好，大家使用在線工具轉換前，做一下比較！沒有做過驗證的代碼，可能會給你帶來麻煩！歡迎分享你的方法！

獲取鍵盤鍵的值集合方便監(jiān)控鍵盤事件
整理的比較全的鍵盤值的集合，以后大家在開發(fā)過程中，可以直接拿來判斷。
2009-08-08
網頁報錯"Form?elements?must?have?labels"的處理方法
這篇文章主要給大家介紹了關于網頁報錯"Form?elements?must?have?labels"的處理方法,文中通過實例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下
2023-06-06
萬萬沒想到Chrome的歷史記錄竟然可以這么玩
最近遇到一個棘手的問題，需要查找含有某個關鍵字的網頁，但是通過chrome原生的歷史記錄查出來的，查到的結果并不滿意，今天小編就給大家分享一篇教程幫助大家解決Chrome歷史記錄的問題，感興趣的朋友一起看看吧
2020-10-10
redis debug環(huán)境搭建過程詳解(使用clion)
這篇文章給大家介紹redis debug環(huán)境搭建過程，使用clion，達到和調試java一樣的效果，本文給大家介紹的非常詳細，對大家的學習或工作具有一定的參考借鑒價值，需要的朋友參考下吧
2021-07-07
什么是RPC及RPC?和?HTTP?對比分析
這篇文章主要介紹了什么是RPC及RPC?和?HTTP?對比分析,需要的朋友可以參考下
2007-02-02
深入探究ChatGPT的工作原理
這篇文章主要探討了ChatGPT的工作原理，ChatGPT是基于OpenAI開發(fā)的GPT-4架構的大型語言模型，文中圖文介紹的非常詳細，感興趣的同學跟著小編一起來學習吧
2023-06-06
詳解inet_pton()和inet_ntop()函數(shù)
這篇文章主要介紹了inet_pton()和inet_ntop()函數(shù)，本文給大家介紹的非常詳細，具有一定的參考借鑒價值,需要的朋友可以參考下
2019-12-12
vscode通過Remote SSH遠程連接及離線配置的方法
這篇文章主要介紹了vscode通過Remote SSH遠程連接及離線配置的方法,本文給大家介紹的非常詳細，對大家的學習或工作具有一定的參考借鑒價值，需要的朋友可以參考下
2021-03-03
使用Visual Studio進行文件差異比較的問題小結
這篇文章主要介紹了使用Visual Studio進行文件差異比較,本文給大家介紹的非常詳細，對大家的學習或工作具有一定的參考借鑒價值，需要的朋友可以參考下
2021-07-07
解讀Base64編碼中為什么會有等號(=)問題
這篇文章主要介紹了解讀Base64編碼中為什么會有等號(=)問題，具有很好的參考價值，希望對大家有所幫助。如有錯誤或未考慮完全的地方，望不吝賜教
2023-03-03