AV1:帧内预测(一)

开发者福利!热门AI工具限时免费用 购周边即赠Coding Plan Lite,Claude Code、Cursor等20+工具畅享,效率翻倍! 阅读详情

​VP9支持10种帧内预测模式,包括8种角度模式和非角度模式DC、TM(True Motion)模式,AV1在其基础上进一步扩展,AV1帧内预测角度模式更细化,同时新增了部分非角度模式。

扩展的角度模式


AV1在VP9角度模式的基础上进一步扩展,VP9的8种角度模式作为基础角度,对于尺寸大于8x8的块在每种基础角度上还有6个扩展角度,

图1 AV1角度模式

扩展角度在基础角度两侧以3°为步长分布,如图1。对于8x8的块只有8个基础角度,对于大于8x8的块共有56个帧内角度模式。对于有些预测角度若指向的参考像素不在整像素位置则通过一个2抽头双线性滤波器生成参考像素,

非角度Smooth模式


AV1新增了3个smooth模式,SMOOTH_V、SMOOTH_H和SMOOTH模式。它们通过距离加权计算预测值,

图2 Smooth距离加权

图2中深绿色块代表参考像素,浅蓝色块代表需要计算的预测像素。x和y分别表示当前待预测值距左侧参考列和上方参考行的距离,三种Smooth的预测值计算方法如下:

其中w表示权值,不同尺寸块的权值定义如下:

AV1还使用PAETH_PRED模式取代TM模式,PAETH_PRED模式的预测值计算方法如下:

Recursive Intra Prediction


RIP是AV1中新提出的帧内预测模式,它的预测不仅利用了当前块相邻行/列的信息,还利用了块内部的像素信息。

(a)

(b)

图3 RIP

对于RIP模式,如图3(a)它首先将块划分为互不重叠的4x2块,然后依次计算每个4x2块的预测值,当前4x2块的预测值可用作其他4x2块做参考。

对于第一个4x2预测值的计算如图3(b),它需要用到上一行和左侧列的7个参考像素p0~p6,对于8个预测像素x0~x7计算方法如下:

其中alpha、beta、gamma是预定义参数,一共5组。可以看见每个预测值都是由7个参考像素加权得到,可以看作每个预测值都是由参考像素被7抽头滤波器处理得到,预定义的5组参数如下:

对于其他4x2块预测值计算按同样方式进行,它们的参考像素可能是块内其他4x2块的预测值,这样便充分利用了同一块内相邻像素的相关性。

Chroma Predicted from Luma


CfL是利用亮度重建像素预测色度像素,CfL类似有VVC中的CCLM和AVS3中的TSCMP,它在亮度和色度间构建一个线性关系,如下式,通过这个线性关系利用亮度重建像素预测色度。

Pred_uv = alpha * AC + DC

图4 CfL过程

CfL过程如图4,首先对于420或422视频格式需要将重建的亮度分量下采样到和色度同样的大小,然后需要去除亮度中的DC信息只保留AC信息,其中DC信息即亮度像素的均值,将亮度重建值减去它们的均值即可得到对应的AC信息。然后将亮度AC乘以缩放因子alpha最后加上色度的DC信息便得到色度的预测值。这里alpha需要在码流中传输到解码端,色度的DC值由intra DC模式计算得到。

相关语法元素:

cfl_alpha_signs :包含U和V的alpha的符号信息。具体值的含义如下表。

cfl_alpha_signsName of signUName of signV
0CFL_SIGN_ZEROCFL_SIGN_NEG
1CFL_SIGN_ZEROCFL_SIGN_POS
2CFL_SIGN_NEGCFL_SIGN_ZERO
3CFL_SIGN_NEGCFL_SIGN_NEG
4CFL_SIGN_NEGCFL_SIGN_ZERO
5CFL_SIGN_POSCFL_SIGN_POS
6CFL_SIGN_POSCFL_SIGN_NEG
7CFL_SIGN_POSCFL_SIGN_POS

cfl_alpha_u :U分量alpha的绝对值。

cfl_alpha_v:V分量alpha的绝对值。

266中预测完整过程的总结         做了段时间内,感觉对预测的理解有加深了些,今天来给预测做个总结,也相当于巩固记忆啦。        相比起来,预测真的是属于视频编码中最简单的模块了,内容也超级少,感觉最近内有点难做,性能提升都很少,第十次会议大部分的提案的性能都不高,而且大部分提案都集中于滤波,双向预测和多参考行预测块。       预测的基本思想就是利用相邻像素的相关性去除空间冗... 阅读详情

相关推荐

【视频编解码-05】预测编码详解-预测

定义 预测编码最基本的思想是不直接对信号进行编码,而是用前信号对当前信号做出预测,对当前信号与预测值的差值进行编码传送。 为什么要用差值来编码呢? 举个例子,假设图片是4x4,且没个像素点都是255,那么对255进行二进制编码至少需要8位,如果我们假设预测值是255,那么差值就是255-255=0,那么仅仅对0进行编码位即可,这样就大大减少了码元的个数。 什么是预测呢? 预测的目的就是使用比完整少很多的数据来表示当前的。 为什么可以进行预测呢? 般的,相邻像素的亮度和色度值经常是非

春秋繁露 3792

AV1编码标准整体概述

那时VP8是这家公司的编解码器,谷歌收购On2后做的第件事就是将它原封不动地开源出去,使它成为款免专利费的编解码器。在VP9成功之后,又开始研发VP10,即VP9的下代。但是同时期,在线视频交付领域中占据重要地位的很多其他公司也对该项目产生了兴趣,这些公司包括Netflix、亚马逊、Facebook(现已更名为Meta)和微软等。之后,谷歌不再将VP10作为WebM项目的部分,而是创立个行业联盟。AV1的发展前景应该会比较好,主流的互联网及硬件厂家都在参与其中。

Wu_qz的博客 3346

AV1 概括性论文《An Overview of Core Coding Tools in the AV1 Video Codec》学习

HEVC因为专利的问题直没达到AVC的高度,但是AVC已经服役20年,还能再服役20年吗?众大佬(公司)为改善现状,起提出了AV1标准。AV1主打点就是免知识产权费,最近在国内国外已经越来越火。作为已经不年轻的码农也深感更新知识的重要性,因此就从今天开始系统性地学习AV1这个编码标准吧,期间也在博客上分享些自己的心得,方面作为记录,另方面抛砖引玉,希望有同好能共同...

mmzx9318的博客 2386

你知道h.265吧?但关于AV1编码格式你也来了解下吗?

总的来说,H.265由于较早推出,已经得到了广泛的硬件支持,而AV1作为个较新的标准,正在迅速赢得硬件制造商的支持。随着更多的设备开始原生支持AV1,加上其免版税的优势,预计AV1将在未来几年内在硬件支持方面取得显著进展。这对于推动AV1成为下代主流视频编码标准具有重要意义。个视频压制小组,应该如何在av1和h265之间做出选择?个视频压制小组在决定使用AV1还是H.265(HEVC)作为视频编码格式时,需要考虑多个因素。

cybozu的博客 1万+

Bilibili支持了AV1编码,关于AV1编码你知道吗?

AV1编码的编码速度比H.264和HEVC编码要慢得多,这是由于AV1编码使用了更复杂的算法,以及更多的计算资源。其次,AV1编码的编码效率也不是很高。AV1编码的编码效率比H.264和HEVC编码要低得多,这是由于AV1编码使用了更复杂的算法,以及更多的计算资源。AV1编码的许可证比H.264和HEVC编码要复杂得多,这是由于AV1编码使用了更复杂的算法,以及更多的计算资源。总的来说,AV1编码拥有更高的编码效率、更低的码率、更容易的软件实现、更好的跨平台性和更高的编码质量,可以满足视频编码的各种需求。

qq_45984664的博客 2万+

AV1预测)参考管理

那ref_frame_idx[LAST_FRAME]=5 就表示DPB 下标为5的位置上存在的(ref_frame_map[5])就是当前的LAST_FRAME。ref_frame_idx的值有2种传输方式,当frame_refs_short_signaling=0的时候,所有的参考值都是显示传递的,也就是直接通过码流读取到的,当frame_refs_short_signaling=1的时候,只有last_frame_idx和gold_fame_idx是显示传递的,其他参考值则是通过计算得到的。

Dillon2015的博客 2906

[AV1] DC Intra Prediction

返回目录 [AV1] DC Intra Prediction

轻舞飞扬 1156

解密VP9:开源视频压缩技术如何实现文件体积减半

在流媒体与在线视频蓬勃发展的今天,视频压缩技术成为提升用户体验的关键因素。VP9作为新代开源视频编码标准,通过创新的算法设计和智能压缩策略,在保持视频质量的同时显著降低带宽需求。本文将从技术原理、实战应用、行业案例到未来趋势,全面解析VP9如何重塑视频压缩领域的技术格局,为WebM视频优化和带宽节省方案提供完整解决方案。 ## 、技术解析:VP9编码的底层工作原理 ### 为什么主流浏览器

gitblog_00860的博客 576

[AV1] AV1技术专栏(停止更新)

这个专栏是我花了半年的时间阅读libav1,SVT-AV1以及dav1d的源码后摸索总结出来的AV1技能树,希望能帮助到你的AV1编解码器的学习。

轻舞飞扬 4万+

[AV1] AV1 预测

这篇博客主要对AV1预测编码部分的代码进行分析。 AV1同其他标准样,预测是为了生成当前块的预测器(Predictor),然后把当前块像素值与预测器的差值传递给编码器的下个阶段。 在AV1的参考软件libaom-av1中,预测从函数 av1_predict_intra_block_facade() 开始。 //AV1 预测起始函数 void av1_predict_intra_block_facade(const AV1_COMMON* cm, MACROBLOCKD* xd, int p

轻舞飞扬 2050

AV1 编码标准预测技术概述

AV1 编码标准预测技术详细说明

世界那么大,我想去看看~【随心更新,看世界去了😄】 4101

AV1预测(二)

其中blkWh =w+h,d是角度差值,如果pAngle90且haveLeft=1,d=abs(pAngle-180)。2 * h : h ) - 1 )防止超出图像下边界。如果上方和左侧相邻像素都有效,AboveRow[ -1 ]=CurrFrame[ plane ][ y-1 ][ x-1 ]。否则,如果上方相邻像素有效AboveRow[ -1 ]=CurrFrame[ plane ][ y-1 ][ x ]。

Dillon2015的博客 1905

AV1 编码标准中预测技术概述

AV1 编码标准中预测技术详细说明

世界那么大,我想去看看~【随心更新,看世界去了😄】 2482

AV1编码技术详解

AV1,目前业界最新的开源视频编码格式,对标专利费昂贵的H.265。它由思科、谷歌、网飞、亚马逊、苹果、Facebook、英特尔、微软、Mozilla等组成的开放媒体联盟(Alliance for Open Media,简称AOMedia)开发。而当前中文资料较少,IEEE篇论文:An Overview of Core Coding Tools in the AV1 Video Codec AV1种新兴的开源、版权免费的视频压缩格式,由开放媒体联盟(AOMedia)行业联盟于2018年初联合开发并最

FeelTouch Labs 4万+

libaom 源码分析:AV1预测 CfL 模式

libaom 源码分析:AV1预测 CfL 模式

世界那么大,我想去看看~【随心更新,看世界去了😄】 1447

AV1编码技术分析

av1种新兴的开源、版权免费的视频压缩格式,由开放媒体联盟(AOMedia)行业联盟于2018年初联合开发并最终定稿。AV1开发的主要目标是在当前的编解码器基础上获得可观的压缩率提升,同时确保解码的复杂性和硬件的实际可行性。本文简要介绍了AV1中的关键编码技术,并与VP9和HEVC进行了初步的压缩性能比较。 索引:视频压缩,AV1,开放媒体联盟,开源视频编码 、引言 在过去的十年里,智能设备...

静影沉璧 4万+

AV1编码标准-算法描述

AV1编码标准 本文档介绍了相关编解码器中包含的编码工具的技术方面。本文档不是相关编解码器的规范。相反,它总结了针对新开发人员的编码工具的突出功能。 缩略语 CfL: Chroma from Luma IntraBC: Intra block copy LCU: Largest coding unit OBMC: Overlapped Block Motion Compensation CDEF: Constrained Directional Enhancement Filter 块划分

BigDream123的博客 1万+

libaom 源码分析:AV1 预测模式 Paeth 模式

libaom 源码分析:AV1 预测模式 Paeth 模式

世界那么大,我想去看看~【随心更新,看世界去了😄】 1375

libaom 源码分析:AV1 内非方向预测模式

libaom 源码分析:AV1 内非方向预测模式

世界那么大,我想去看看~【随心更新,看世界去了😄】 880
上一篇: AV1:编码块划分
下一篇: AV1:帧内预测(二)
Dillon2015
博客等级 码龄11年 1069粉丝 274原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值