1.std::vector<uint8_t>(最常用)

std::vector 是动态数组容器,搭配 uint8_t(无符号8位整数,即1字节)是存储二进制数据的首选方案,尤其适合长度不确定的二进制流(如文件内容、网络数据包)。

特点:

  • 动态大小:可随数据量自动扩容,支持 push_backresize 等操作,灵活处理变长二进制数据。
  • 连续内存:元素在内存中连续存储,可通过 data() 方法获取原始字节指针(uint8_t*),方便与 C 风格接口(如系统调用、网络函数)交互。
  • C++11 增强:支持移动语义(std::move),避免大二进制数据的拷贝开销;支持初始化列表({0x01, 0x02, 0x03})快速初始化。

适用场景:

  • 读取文件二进制内容(如图片、音频)。
  • 网络通信中的缓冲区(发送/接收字节流)。
  • 动态生成的二进制数据(如加密后的字节序列)。

示例:

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

#include <vector>

#include <cstdint>  // 包含uint8_t

int main() {

    // 存储二进制数据(例如一个简单的协议包)

    std::vector<uint8_t> binary_data = {0x01, 0x02, 0xFF, 0x00};

     

    // 动态添加数据

    binary_data.push_back(0x03);

     

    // 获取原始字节指针,用于C风格接口

    uint8_t* raw_ptr = binary_data.data();

    size_t size = binary_data.size();  // 字节数:5

    return 0;

}

2.std::array<uint8_t, N>(固定大小二进制数据)

std::array 是 C++11 新增的固定大小数组容器,适合存储长度已知且固定的二进制数据(如协议头、固定大小的校验码)。

特点:

  • 编译期固定大小:声明时需指定长度(如 std::array<uint8_t, 16> 表示16字节),内存分配在栈上(或静态区),无需动态内存管理。
  • 连续内存:同 vector,支持 data() 获取原始指针,性能优于动态数组。
  • 无额外开销:相比 vector 没有动态扩容的额外内存(如容量管理的指针),空间效率更高。

适用场景:

  • 固定格式的二进制协议头(如16字节的TCP头部部分字段)。
  • 哈希值、UUID等固定长度的二进制数据(如16字节的MD5结果)。
  • 嵌入式系统中对内存分配有严格限制的场景。

示例:

1

2

3

4

5

6

7

8

9

10

11

12

13

14

#include <array>

#include <cstdint>

int main() {

    // 存储16字节的固定二进制数据(如UUID)

    std::array<uint8_t, 16> uuid = {

        0x00, 0x11, 0x22, 0x33, 0x44, 0x55, 0x66, 0x77,

        0x88, 0x99, 0xAA, 0xBB, 0xCC, 0xDD, 0xEE, 0xFF

    };

     

    // 访问单个字节

    uint8_t first_byte = uuid[0];  // 0x00

    return 0;

}

3.std::string(兼容字符串操作的二进制数据)

std::string 本质是“字节序列容器”(C++标准未限制必须是字符串),可存储包含空字符(\0)的二进制数据,适合需要同时支持字符串操作和二进制存储的场景。

特点:

  • 兼容字符串API:可使用 substrfind 等方法处理二进制数据中的片段,方便解析包含文本标识的二进制流(如HTTP协议中的二进制附件)。
  • 连续内存:支持 data() 或 c_str() 获取字节指针(注意 c_str() 会在末尾附加 \0,但 data() 在C++11中与 c_str() 等效,需谨慎处理)。
  • 注意事项:二进制数据中的 \0 不会被视为“结束符”,size() 方法会返回真实字节数(包含 \0)。

适用场景:

  • 存储包含文本和二进制混合的数据(如邮件中的MIME附件)。
  • 需要对二进制数据进行子串查找、拼接等操作的场景。

示例:

1

2

3

4

5

6

7

8

9

10

11

12

13

#include <string>

#include <cstdint>

int main() {

    // 存储包含空字符的二进制数据

    std::string binary_str;

    binary_str += static_cast<char>(0x01);

    binary_str += static_cast<char>(0x00);  // 空字符,仍会被计入长度

    binary_str += static_cast<char>(0x02);

     

    std::cout << "长度:" << binary_str.size();  // 输出3(包含空字符)

    return 0;

}

4.std::bitset<N>(固定大小比特序列)

std::bitset 用于存储固定长度的比特(bit)序列(而非字节),适合需要精确控制每一个比特的场景(如标志位、压缩存储布尔值)。

特点:

  • 比特级操作:支持单个比特的设置(set)、清空(reset)、翻转(flip),以及批量逻辑运算(与、或、异或)。
  • 编译期固定大小:长度 N 必须是编译期常量(如 std::bitset<32> 表示32个比特)。
  • 空间高效:每个比特仅占1/8字节,比 vector<bool> 更高效(无额外指针开销)。

更多推荐