为什么“bytes(n)”创建长度为n的字节字符串，而不是将n转换为二进制表示?

我试图在Python 3中构建这个bytes对象:

b'3\r\n'

所以我尝试了显而易见的(对我来说)，发现了一个奇怪的行为:

>>> bytes(3) + b'\r\n'
b'\x00\x00\x00\r\n'

显然:

>>> bytes(10)
b'\x00\x00\x00\x00\x00\x00\x00\x00\x00\x00'

在阅读文档时，我无法看到字节转换为什么以这种方式工作的任何指针。然而，我确实在这个Python问题中发现了一些关于向字节添加格式的令人惊讶的消息(另见Python 3字节格式化):

http://bugs.python.org/issue3982

这与bytes(int)返回零这样的奇怪情况的交互更加糟糕

and:

如果字节(int)返回该int的ASCIIfication，对我来说会更方便;但说实话，即使是一个错误也比这种行为要好。(如果我想要这种行为——我从来没有——我宁愿它是一个类方法，像“bytes.zero (n)”那样调用。)

谁能给我解释一下这种行为是怎么来的?

当前回答

你可以使用结构体的包:

In [11]: struct.pack(">I", 1)
Out[11]: '\x00\x00\x00\x01'

“>”是字节顺序(大端序)，“I”是格式字符。所以如果你想做别的事情，你可以具体一点:

In [12]: struct.pack("<H", 1)
Out[12]: '\x01\x00'

In [13]: struct.pack("B", 1)
Out[13]: '\x01'

这在python 2和python 3上都是一样的。

注意:反向操作(字节到int)可以通过unpack完成。

2014-11-14 00:25:01

其他回答

这就是它的设计方式——这是有意义的，因为通常，你会在一个可迭代对象上调用bytes，而不是单个整数:

>>> bytes([3])
b'\x03'

文档声明了这一点，以及字节的文档字符串:

>>> help(bytes)
...
bytes(int) -> bytes object of size given by the parameter initialized with null bytes

2014-01-09 10:37:38

从python 3.2开始，你可以使用to_bytes:

>>> (1024).to_bytes(2, byteorder='big')
b'\x04\x00'

def int_to_bytes(x: int) -> bytes:
    return x.to_bytes((x.bit_length() + 7) // 8, 'big')
    
def int_from_bytes(xbytes: bytes) -> int:
    return int.from_bytes(xbytes, 'big')

因此，x == int_from_bytes(int_to_bytes(x))。注意，上述编码仅适用于无符号(非负)整数。

对于有符号整数，比特长度的计算有点棘手:

def int_to_bytes(number: int) -> bytes:
    return number.to_bytes(length=(8 + (number + (number < 0)).bit_length()) // 8, byteorder='big', signed=True)

def int_from_bytes(binary_data: bytes) -> Optional[int]:
    return int.from_bytes(binary_data, byteorder='big', signed=True)

2015-05-21 13:28:45

这种行为源于这样一个事实:在Python版本3之前，bytes只是str的别名。X bytes是bytearray的不可变版本——全新的类型，不向后兼容。

2014-01-09 10:44:55

>>> chr(116).encode()
b't'

2022-08-03 11:54:19

int(包括Python2的long)可以使用以下函数转换为字节:

import codecs

def int2bytes(i):
    hex_value = '{0:x}'.format(i)
    # make length of hex_value a multiple of two
    hex_value = '0' * (len(hex_value) % 2) + hex_value
    return codecs.decode(hex_value, 'hex_codec')

反向转换可以由另一个完成:

import codecs
import six  # should be installed via 'pip install six'

long = six.integer_types[-1]

def bytes2int(b):
    return long(codecs.encode(b, 'hex_codec'), 16)

这两个函数都可以在Python2和Python3上工作。

2017-08-09 08:57:47

为什么“bytes(n)”创建长度为n的字节字符串，而不是将n转换为二进制表示?

推荐文章

最新文章

标签