Python使用struct处理二进制-iibull-ChinaUnix博客

牛蹄印章_VX_iibull

首页　| 　博文目录　| 　关于我

iibull

博客访问： 9673480
博文数量： 1778
博客积分： 12961
博客等级：上将
技术积分： 20371
用户组：普通用户
注册时间： 2009-01-09 11:25

个人简介

偷得浮生半桶水(半日闲), 好记性不如抄下来(烂笔头). 信息爆炸的时代, 学习是一项持续的工作.

文章分类

全部博文（1778）

TX2-NX（83）
OpenHarmony（26）
debug（374）
Python3.x（19）
AI-DeepLearning（7）
VR/AR/MR（5）
Cuda（6）
机器人（355）
GTK3 + （35）
android4.x代码分（35）
linux设备驱动第（39）
原创（50）

ER69XX项目归纳（5）
ARMLINUX技术文摘（42）

驱动（18）
Porting（73）

Delphi（12）

dotNet（13）

Meego（4）

Kernel（25）

U-BOOT（7）
代码分析（6）
移植（13）
sysfs 全接触（1）
skyeye（1）
音视频（2）
android（33）

Oracle（15）
wince（10）
linux 驱动（18）
前沿文摘（24）
GTK（11）
杂项（18）

工作（6）
日志（16）
娱乐（28）
linux 系统（46）
linux 应用（56）
armlinux（79）
未分配的博文（267）

文章存档

2025年（27）

2024年（27）

2023年（26）

2022年（112）

2021年（217）

2020年（157）

2019年（192）

2018年（81）

2017年（78）

2016年（70）

2015年（52）

2014年（40）

2013年（51）

2012年（85）

2011年（45）

2010年（231）

2009年（287）

我的朋友

相关博文

Python使用struct处理二进制

分类： Android平台

2017-12-07 19:18:04

https://www.cnblogs.com/gala/archive/2011/09/22/2184801.html

struct模块中主要有三个方法

1、

struct.pack(fmt,v1,v2,v3...) 按fmt这个格式把后面数据给封装成指定的数据

返回一个包含了v1，v2等的字节对象，数据是通过fmt格式化后的。参数必须和fmt需要格式化的完全对应起来

2、

struct.unpack(fmt,buff) 按fmt这个格式把字节流转成原组tuple

pack的逆向操作，只有一个对象也返回tuple。

3、

struct.calcsize(fmt) 计算给定的fmt格式占用多少字节的内存

根据fmt的格式，返回需要的字节大小

下面是fmt这个格式python3.4.3的说明:(如果版本有更新请查看最新的)

QQ截图20160806223854.png

如下代码

复制代码


	
	
		
		
			1
		

		
			2
		

		
			3
		

		
			4 
		

		
			5 
		

		
			6
		

		
			7 
		

		
			8
		

		
			9
		

		
			10
		

		
			11
		

		
			12
		

		
			13
		

		
			14
		

		
			15
		

		
			16 
		

		
			17
		

		
			18
		

	

	
		
	




	
	
		
		
			
			
				
			

		

		
			
			
				
			

		

		
			
			
				#视频加密 
			

			
				f = open('1.mp4', 'rb') 
			

			
				f2=open('2.mp4','wb') 
			

			
				try:
			

			
				while True:
			

			
				  data = f.read(4) 
			

			
				  if not data:
			

			
				   break 
			

			
				  #解码出一个字节为integer类型 
			

			
				  data=struct.unpack('i',data) 
			

			
				  print(data) 
			

			
				  #再把这个整形数据加1后再转成字节类型数据,保存到文件中 
			

			
				  bit=struct.pack('i',data[0]+1) 
			

			
				  print(bit) 
			

			
				  f2.write(bit) 
			

			
				finally:
			

			
				  f.close( ) 
			

			
				  f2.close()

上面示例中:

功能为把一个视频文件按每4个字节取出来转成int类型然后加1,再转成字节类型保存到文件中,实现一个简单的文件加密

解密方法同样是把上面中的加1改成减1就还原成正常的文件啦

struct.pack()的使用方法

比如我们要把一个字符串 HTTP/1.1 200 OK 转成字节流形式的数据

复制代码


	
	
		
		
			1
		

	

	
		
	




	
	
		
		
			
			
				
			

		

		
			
			
				
			

		

		
			
			
				data=struct.pack('9si2s',b'HTTP/1.1 ',200,b'OK')

9s代表9个字符,i代表是个整形,2s又是两个字符,后面的数据和前面的格式是对应的

同样转成字节流后,也需要把字节按一定的格式恩成我们想要的数据

复制代码


	
	
		
		
			1
		

	

	
		
	




	
	
		
		
			
			
				
			

		

		
			
			
				
			

		

		
			
			
				data=struct.pack('9si2s',data)

同样的，格式字符串要正确否则会出现错误

把数据转成二进制字节

复制代码


	
	
		
		
			1
		

		
			2
		

		
			3
		

		
			4
		

		
			5
		

	

	
		
	




	
	
		
		
			
			
				
			

		

		
			
			
				
			

		

		
			
			
				import struct 
			

			
				a=12.34 
			

			
				# 将a变为二进制 
			

			
				by=struct.pack('d',a) 
			

			
				print(by)

输出 b'\xaeG\xe1z\x14\xae(@'

把字节转成int数据

复制代码

	
		
		
			
			
				1
			

			
				2
			

			
				3
			

			
				4
			

		

		
			
		

	

	
		
		
			
			
				
				
					
				

			

			
				
				
					
				

			

			
				
				
					import struct 
				

				
					bs = b'\xc4\xe3\xc4\xe3' 
				

				
					st=struct.unpack('i',bs) 
				

				
					print(st)

i 代表int类型4个字节

输出(-473635900,)

复制代码

	
		
		
			
			
				1
			

			
				2
			

			
				3
			

			
				4
			

		

		
			
		

	

	
		
		
			
			
				
				
					
				

			

			
				
				
					
				

			

			
				
				
					import struct 
				

				
					bs = b'\xc4\xe3\xc4\xe3' 
				

				
					st=struct.unpack('h',bs) 
				

				
					print(st)

上面把格式写成h(short)类型占二个字节但bs是四个字节所以,这里就会报错

struct.error: unpack requires a bytes object of length 2

如果改成2h(两个short类型)这样就表示啦四个字节的格式

复制代码


	
	
		
		
			1
		

		
			2
		

		
			3
		

		
			4
		

	

	
		
	




	
	
		
		
			
			
				
			

		

		
			
			
				
			

		

		
			
			
				import struct 
			

			
				bs = b'\xc4\xe3\xc4\xe3' 
			

			
				st=struct.unpack('2h',bs) 
			

			
				print(st)

输出如下

(-7228, -7228)

有的时候需要用python处理二进制数据，比如，存取文件，socket操作时.这时候，可以使用python的struct模块来完成.可以用 struct来处理c语言中的结构体.

struct模块中最重要的三个函数是pack(), unpack(), calcsize()

pack(fmt, v1, v2, ...) 按照给定的格式(fmt)，把数据封装成字符串(实际上是类似于c结构体的字节流)

unpack(fmt, string) 按照给定的格式(fmt)解析字节流string，返回解析出来的tuple

calcsize(fmt) 计算给定的格式(fmt)占用多少字节的内存

struct中支持的格式如下表：

Format	C Type	Python	字节数
x	pad byte	no value	1
c	char	string of length 1	1
b	signed char	integer	1
B	unsigned char	integer	1
?	_Bool	bool	1
h	short	integer	2
H	unsigned short	integer	2
i	int	integer	4
I	unsigned int	integer or long	4
l	long	integer	4
L	unsigned long	long	4
q	long long	long	8
Q	unsigned long long	long	8
f	float	float	4
d	double	float	8
s	char[]	string	1
p	char[]	string	1
P	void *	long

注1.q和Q只在机器支持64位操作时有意思

注2.每个格式前可以有一个数字，表示个数

注3.s格式表示一定长度的字符串，4s表示长度为4的字符串，但是p表示的是pascal字符串

注4.P用来转换一个指针，其长度和机器字长相关

注5.最后一个可以用来表示指针类型的，占4个字节

为了同c中的结构体交换数据，还要考虑有的c或c++编译器使用了字节对齐，通常是以4个字节为单位的32位系统，故而struct根据本地机器字节顺序转换.可以用格式中的第一个字符来改变对齐方式.定义如下：

Character	Byte order	Size and alignment
@	native	native 凑够4个字节
=	native	standard 按原字节数
<	little-endian	standard 按原字节数
>	big-endian	standard 按原字节数
!	network (= big-endian)	standard 按原字节数

使用方法是放在fmt的第一个位置，就像'@5s6sif'

示例一：

比如有一个结构体

struct Header

{

unsigned short id;

char[4] tag;

unsigned int version;

unsigned int count;

}

通过socket.recv接收到了一个上面的结构体数据，存在字符串s中，现在需要把它解析出来，可以使用unpack()函数.

import struct

id, tag, version, count = struct.unpack("!H4s2I", s)

上面的格式字符串中，!表示我们要使用网络字节顺序解析，因为我们的数据是从网络中接收到的，在网络上传送的时候它是网络字节顺序的.后面的H表示一个unsigned short的id,4s表示4字节长的字符串，2I表示有两个unsigned int类型的数据.

就通过一个unpack，现在id, tag, version, count里已经保存好我们的信息了.

同样，也可以很方便的把本地数据再pack成struct格式.
id=0xc1
tag=b'abcd'
version=44
count=33

ss = struct.pack("!H4s2I", id, tag, version, count)
print(ss)
>>> b'\x00\xc1abcd\x00\x00\x00,\x00\x00\x00!'

pack函数就把id, tag, version, count按照指定的格式转换成了结构体Header，ss现在是一个字符串(实际上是类似于c结构体的字节流)，可以通过 socket.send(ss)把这个字符串发送出去.

示例二：

import struct

a=12.34

#将a变为二进制

bytes=struct.pack('i',a)

此时bytes就是一个string字符串，字符串按字节同a的二进制存储内容相同。

再进行反操作

现有二进制数据bytes，（其实就是字符串），将它反过来转换成python的数据类型：

a,=struct.unpack('i',bytes)

注意，unpack返回的是tuple

所以如果只有一个变量的话：

bytes=struct.pack('i',a)

那么，解码的时候需要这样

a,=struct.unpack('i',bytes) 或者 (a,)=struct.unpack('i',bytes)

如果直接用a=struct.unpack('i',bytes)，那么 a=(12.34,) ，是一个tuple而不是原来的浮点数了。

如果是由多个数据构成的，可以这样：

a='hello'

b='world!'

c=2

d=45.123

bytes=struct.pack('5s6sif',a,b,c,d)

此时的bytes就是二进制形式的数据了，可以直接写入文件比如 binfile.write(bytes)

然后，当我们需要时可以再读出来，bytes=binfile.read()

再通过struct.unpack()解码成python变量

a,b,c,d=struct.unpack('5s6sif',bytes)

'5s6sif'这个叫做fmt，就是格式化字符串，由数字加字符构成，5s表示占5个字符的字符串，2i，表示2个整数等等，下面是可用的字符及类型，ctype表示可以与python中的类型一一对应。

注意：二进制文件处理时会碰到的问题

我们使用处理二进制文件时，需要用如下方法

binfile=open(filepath,'rb') 读二进制文件

binfile=open(filepath,'wb') 写二进制文件

那么和binfile=open(filepath,'r')的结果到底有何不同呢？

不同之处有两个地方：

第一，使用'r'的时候如果碰到'0x1A'，就会视为文件结束，这就是EOF。使用'rb'则不存在这个问题。即，如果你用二进制写入再用文本读出的话，如果其中存在'0X1A'，就只会读出文件的一部分。使用'rb'的时候会一直读到文件末尾。

第二，对于字符串x='abc\ndef'，我们可用len(x)得到它的长度为7，\n我们称之为换行符，实际上是'0X0A'。当我们用'w'即文本方式写的时候，在windows平台上会自动将'0X0A'变成两个字符'0X0D'，'0X0A'，即文件长度实际上变成8.。当用'r'文本方式读取时，又自动的转换成原来的换行符。如果换成'wb'二进制方式来写的话，则会保持一个字符不变，读取时也是原样读取。所以如果用文本方式写入，用二进制方式读取的话，就要考虑这多出的一个字节了。'0X0D'又称回车符。linux下不会变。因为linux只使用'0X0A'来表示换行。

阅读(2950) | 评论(0) | 转发(0) |

上一篇：python + mysql + gtk

下一篇：python + GTK 界面编程

给主人留下些什么吧！~~

感谢所有关心和支持过ChinaUnix的朋友们

16024965号-6