[PDF] GB/T 25724-2017 - 自动发货. 英文版
| 标准号码 | 美元 | 购买PDF | 工期 | 标准名称(英文版) |
| GB/T 25724-2017 | 1205 | GB/T 25724-2017 | 9秒内发货PDF | 公共安全视频监控数字视音频编解码技术要求 |
| 基本信息 | |
|---|---|
| 标准编号 | GB/T 25724-2017 (GB/T25724-2017) |
| 中文名称 | 公共安全视频监控数字视音频编解码技术要求 |
| 英文名称 | Technical specifications for surveillance video and audio coding |
| 行业 | 国家标准 (推荐) |
| 中标分类 | A91 |
| 国际标准分类 | 13.310 |
| 字数估计 | 314,369 |
| 发布日期 | 2017-03-09 |
| 实施日期 | 2017-06-01 |
| 旧标准 (被替代) | GB/T 25724-2010 |
| 标准依据 | National Standard Notice No. 5 of 2017 |
| 发布机构 | 中华人民共和国国家质量监督检验检疫总局、中国国家标准化管理委员会 |
GB/T 25724-2017: 公共安全视频监控数字视音频编解码技术要求
GB/T 25724-2017 英文名称: Technical specifications for surveillance video and audio coding
ICS 13.310
A91
中华人民共和国国家标准
代替GB/T 25724-2010
公共安全视频监控数字视音频
编解码技术要求
1 范围
本标准规定了公共安全视频监控应用的数字视音频压缩编码的解码过程。
本标准适用于公共安全领域的视音频实时压缩、传输、播放和存储等业务,其他需要视音频编解码
的领域也可参考采用。
2 规范性引用文件
下列文件对于本文件的应用是必不可少的。凡是注日期的引用文件,仅注日期的版本适用于本文
件。凡是不注日期的引用文件,其最新版本(包括所有的修改单)适用于本文件。
3 术语、定义和缩略语
3.1 术语和定义
下列术语和定义适用于本文件。
3.1.1AL单元 NALunit
一个语法结构,包含后续数据的类型指示和所包含的字节数,数据以RBSP形式出现,必要时其中
还包括散布的防伪字节。
3.1.2NAL单元流 NALunitstream
由NAL单元组成的序列。
3.1.3保留 reserved
某些语法元素的特定取值。
注:供中国安全防范监控数字视音频编解码技术标准工作组将来使用。符合本标准的比特流不应使用这些值,但
是这些值将来可能在本标准的扩展版本中用到。
3.1.4闭环基音搜索 closed-looppitchsearch
用于从加权输入信号和长时预测滤波器状态估计基音延迟。也称为自适应码书搜索。
3.1.5比特流 bitstream
由编码视音频及其相关数据构成的比特序列。比特流既可用来表示 NAL单元流,也可表示字节流。
3.1.6变换系数 transformcoefficient
频率域的标量,与解码过程的反变换部分中一个特定的一维或二维频率索引相关联的系数。
一个与特定二维频率索引相关联的整数量值,解码过程中用于计算变换系数的值。
3.1.8编码过程 encodingprocess
产生符合本标准的比特流的过程,本标准对视频编码过程不做规定。
3.1.9编码器 encoder
实现编码过程的实体,包括软件及硬件。
3.1.10编码片 tile
一个矩形区域内部按照光栅扫描顺序排列的整数个树形编码单元。
3.1.11编码视频序列 codedvideosequence
按照解码顺序排列的IDR图像和紧随其后的零个或多个非IDR图像组成的图像序列。
3.1.12编码图像 codedpicture
一幅图像的编码表示。
注:符合本标准的一个编码图像为一个编码帧。
3.1.13编码图像缓存区 codedpicturebuffer
一个先入先出缓存区,其存储方式按解码顺序排列。
3.1.14编码帧 codedframe
一个帧的编码表示。
3.1.15残差 residual
样点或数据元素预测值与解码值之间的差值。
3.1.16参考索引 referenceindex
参考图像的索引。
3.1.17参考图像 referencepicture
对解码顺序上后续图像的解码过程进行帧间预测的样点图像。
3.1.18参考帧 referenceframe
一个标记为参考图像的帧,用于解码过程中的帧间预测。
3.1.19参数 parameter
序列参数集、图像参数集或安全参数集中的一个语法元素。参数也用于量化参数一词中。
3.1.20层 layer
没有分支等级关系中的一组句法结构。高层包含低层。编码层指编码图像序列层、图像层、编码片
层和编码单元层。对于可伸缩性视频编码图像,不同层的图像具有不同的可伸缩性(如不同的空间分辨)。
3.1.21代数码书 algebraiccodebook
脉冲幅度和位置组成的一个集合。通过码字索引k按照一定的规则得到第k个激励码矢量的脉冲幅度和位置。
3.1.22档次 profile
本标准中的一个特定语法子集。
将逆滤波器传输函数A(z)分解为一个偶对称和一个奇对称多项式函数,指示该函数在单位圆上
的根。用于线性预测系数的变换。
3.1.24二进制位 bin
二进制位串中的1比特。
3.1.25二进制位串 binstring
一串二进制位。二进制位串为二值化的语法元素值的二进制表示。
3.1.26二值化 binarization
语法元素所有可能值与一组二进制位串之间的唯一映射。
3.1.27反变换 inversetransform
将变换系数矩阵转换为空域样点矩阵的过程。
一个字节,其值等于0x03,可能在NAL单元中出现。防伪字节的出现可以保证在NAL单元的后
续字节对齐的字节流中不会含有起始码前缀。
3.1.29非参考图像 non-referencepicture
不用于对任何其他图像进行帧间编码的图像。
3.1.30分量 component
图像的三个样点矩阵(一个亮度矩阵,两个色度矩阵)中的一个矩阵或矩阵中的单个样点。
在音频部分,也指矢量中的元素或信号中的某些频率成分。
利用共振峰处的噪声掩蔽特性,在共振峰区域分配比较大的失真,来减少峰谷主观感觉噪声的滤波。
3.1.32功率谱 powerspectrum
信号通过傅立叶变换后得到幅度谱的平方。
3.1.33光栅扫描 rasterscan
矩形二维图像到一维图像的映射过程,一维图像的第一组值来自于二维图像最上边一行的从左到
右扫描,然后依次是第二行、第三行等等。对于图像每行(由上到下)都是从左到右扫描的。
3.1.34后向预测 backwardprediction
使用显示顺序上在后的解码图像中的样点对当前图像中的样点进行预测。
3.1.35划分 partitioning
将一个集合分为子集的过程。集合中的每个元素属于且只属于某一个子集。
3.1.36基本层图像 baselayerpicture
不需要参考其他图像层信息即可以解码的图像。
3.1.37级别 level
本标准中的一个特定档次中的参数取值的限定集合。一个档次可以包含一个或多个级别。对所有
档次定义了一组相同的级别,不同档次的每个级别大部分特性都是通用的。对于一个独立的实现,在一
定的约束条件下,可以支持多个级别。
一幅帧内解码图像。IDR图像解码之后,解码顺序上所有后续的编码图像都可以不用根据任何在
IDR图像之前解码的图像来进行帧间预测解码。每个编码视频序列的第一幅图像为IDR图像。
一个假设的解码器模型,规定了对于符合本标准的NAL单元流或字节流的可变性的约束。
3.1.40解码过程 decodingprocess
读入编码的比特流后产生解码图像或者音频数据的过程。
3.1.41解码器 decoder
实现解码过程的实体,包括软件及硬件。
3.1.42解码顺序 decodingorder
解码过程中处理语法元素的顺序。
3.1.43解码图像 decodedpicture
通过解码一幅编码图像得到的图像。符合本标准的一幅解码图像应是一个解码帧。
3.1.44解码图像缓存区 decodedpicturebuffer
保存解码图像的存储空间,用于附录A中规定的预测参考、输出重排序或输出延时等。
3.1.45开环基音搜索 open-looppitchsearch
直接从加权输入信号中估计最优基音延迟的过程。开环基音搜索简化了基音分析,并且将闭环基
音搜索限定在开环基音搜索的延迟值附近。
3.1.46可伸缩性视频编码 scalablevideocoding
编码序列中的图像具有一定的可伸缩性。具有可伸缩性的图像通常包含基本层图像和增强层图像。
3.1.47块 block视频信号空间中的一个M×N(M 列N 行)的样点矩阵,或者一个M×N 的变换系数矩阵。
音频信号空间的一个一维矢量。
3.1.48亮度 luma
一个样点矩阵或单个样点,用于描述信号的单色表示。亮度所用符号为Y。
解码过程中对变换系数幅值进行反量化时使用的参数。
3.1.50零输入响应 zeroinputresponse
滤波器当前输入为零时,由过去输入而产生的输出。
3.1.51美尔 mel
一种非线性的频率刻度,根据主观音高进行划分。
用FFT将时域信号转化到频域,对其对数能量谱依照 Mel刻度分布的三角滤波器组进行卷积,对
各个滤波器的输出构成的向量进行DCT得到的系数,即美尔频率倒谱系数。
音频编码器的采样频率,范围为12800Hz~38400Hz,采用Fs 表示。
3.1.54逆滤波器 inversefilter
去除信号短时相关性的滤波器。
3.1.55频率索引 frequencyindex
与解码过程中反变换之前的变换系数相关的一维或二维索引。
3.1.56起始码前缀 startcodeprefix
字节流中唯一等于0x000001的3个字节的序列,作为每个NAL单元的前缀。解码器可以利用起
始码前缀的位置来确定一个新的NAL单元的开始和前一个NAL单元的结束。NAL单元中通过加入
防伪字节来防止假冒的起始码前缀出现。
3.1.57前向预测 forwardprediction
使用显示顺序上在前的解码图像中的样点对当前图像中的样点进行预测。
3.1.58色度 chroma
一个样点矩阵或单个样点,用于描述代表两个相对于基色的色差信号中的一个。色度所用符号为Cb和Cr。
一种熵编码方法,根据概率模型对二进制位进行编码,产生比特流。
根据语音的声学特征识别该段语音所对应的说话人的过程。
3.1.61数据比特串 stringofdatabits
语法元素的若干比特位的序列,出现在原始字节序列负载中原始字节序列负载截止位之前。在
SODB中,最左边的比特位表示第一位即最高位,最右边的比特位表示最后一位即最低位。
使用显示顺序上在前及在后的解码图像中的样点对当前图像中的样点进行预测。
3.1.63树形编码单元 codingtreeunit
一个N×N 的亮度样点块和相应的两个色度样点块。
3.1.64图像 picture
源、编码或重构的图像数据的通称。符合本标准的一幅图像指一帧。
3.1.65图像参数集 pictureparameterset
一个语法结构,包含应用于一个或多个编码图像的语法元素。
3.1.66维纳滤波器 wienerfilter
根据最小均方误差准则,即滤波器的输出信号与期望信号之差的均方值最小,计算得到的最佳线性滤波器。
3.1.67线性预测系数 LPcoefficients
短时预测滤波器系数,也称为LPC系数。
3.1.68序列参数集 sequenceparameterset
一个语法结构,包含应用于一个或多个完整编码视频序列的语法元素。
3.1.69音频超帧 audiosuperframe
由若干音频帧组成,目前本标准规定音频超帧中只包含一个音频帧。
3.1.70音频子帧 audiosubframe
音频帧的一部分,在Fs/2采样频率下,由64个样点构成的数据块。
3.1.71预测 prediction
使用预测值来提供当前解码的样点值或数据元素的估计。
3.1.72预测值 predictor
以前解码的样点值或数据元素的线性组合。
3.1.73语法结构 syntaxstructure
零个或多个语法元素按照规定顺序一起出现在比特流中。
3.1.74语法元素 syntaxelement
比特流中表示数据的元素。
3.1.75语......
英文网页English: GB/T 25724-2017
相关标准: GB/T 28181|GB/T 47478.1|GB/T 31458|GB/T 28181|GB/T 25724-2017|GB/T 25724|