FFmpeg 深度解析:AVFrame 音视频数据存储模型与内存布局

FFmpeg 深度解析:AVFrame 音视频数据存储模型与内存布局 目录一、AVFrame 数据存放总览二、视频帧:按平面(Plane)存储1. 存储模型(以 YUV420P 为例)2. 常见像素格式对照表3. 关键陷阱三、音频帧:按通道(Channel)存储1. Planar 格式(FFmpeg 默认,性能最优)2. Packed 格式(兼容性更好)3. 核心字段4. 内存访问示例(Planar Float)四、引用计数:buf 字段的秘密1. 内存所有权2. 为什么要引用计数?3. 生命周期管理五、硬件帧:特殊的内存模型1. 硬件帧的特点2. 正确访问方式3. 常见硬件格式六、常见误区与 Debug 清单七、最佳实践总结访问视频数据分配 AVFrame 缓冲区判断是否为硬件帧八、核心结论觉得有用,就请您帮忙点赞转发收藏吧,您的鼓励是我创作的动力,多谢看官。由于能力水平有限,文中的错误或不严谨的地方在所难免,还请批评指正。摘要:AVFrame通过data、linesize和buf三个维度描述非连续内存缓冲区,而非直接拥有数据。视频数据按平面(Plane)存储,音频数据按通道(Channel)存储,linesize通常大于width以实现内存对齐。AVFrame使用引用计数(buf)管理内存生命周期,支持零拷贝和多线程访问。硬件帧需特殊处理,不可直接访问data字段。常见误区包括忽略linesize、错误释放内存等,正确做法应逐行拷贝数据并使用专用API操作硬件帧。理解AVFrame的描述符模式是掌握FFmpeg架构的关键。核心结论:AVFrame 并不“拥有”一块连续内存,它通过data[] + linesize[] + buf[]三个维度描述一个引用计数的、可能非连续的、按平面(Plane)组织的数据缓冲区。这是理解 FFmpeg 架构的基石。