Zbiór danych do analizy jakości transmisji głosowej VoIP
收藏资源简介:
Zbiór danych przeznaczony do analizy jakości transmisji głosowej VoIP. Dane zostały wykorzystane do badań wpływu różnych czynników np. zastosowanych kodekeków, transkodowania, zakłóceń tj. utraty pakietów, opóźnień, zmiany kolejności pakietów oraz ograniczeń przepływności na zrozumiałość mowy. Badania obejmują różne scenariusze zakłóceń sieciowych, w tym utratę pakietów, opóźnienia, zmianę kolejności pakietów oraz kombinacje tych zjawisk. Dane zostały pozyskane w laboratorium testowym łączności zbudownego w ramach projektu badawczo rozwojowego. Zbiór obejmuje przechwycone strumienie RTP w sieciach Ethernet/IPv4 w formacie PCAP/PCAPNG oraz odpowiadające im rejestracje sygnałów mowy w postaci plików WAV. Dane posłużyły do obliczeń miar jakości mowy STOI i ESTOI oraz do wyznaczania pochodnych ocen MOS. W ramach zbioru udostępniono również skrypty analityczne w języku Python, umożliwiające reprodukcję wyników badań. Próbki mowy stanowią neutralne komunikaty testowe bez kontekstu osobistego, uniemożliwiające identyfikacji mówcy i nie zawierające danych osobowych. W ramach projektu prowadzono badania obejmujące m.in.: – porównanie jakości transmisji mowy dla różnych kodeków (L16, G.711u_Law, G.711a_Law, G722, G.729, Opus), – analizę wpływu obciążenia sieci na jakość VoIP, – ocenę degradacji sygnału wynikającej z wielokrotnego transkodowania, – badania jakości mowy w środowiskach o zwiększonych zakłóceniach (w tym transmisja HF). Publicznie udostępniony zestaw danych obejmuje podzbiór eksperymentów przeznaczonych do reprodukcji analiz jakościowych. Zbiór danych obejmuje: – przechwycone pakiety RTP w sieciach Ethernet/IPv4 (PCAP), – rejestracje sygnałów mowy w postaci plików WAV, – dane wykorzystane do obliczeń miar STOI/ESTOI oraz pochodnych MOS. Dane zostały wytworzone w ramach projektu badawczo-rozwojowego o nr POIR.01.02.00-00-0010/18 finansowanego przez Narodowe Centrum Badań i Rozwoju i mogą być sukcesywnie uzupełniane o kolejne eksperymenty.
本数据集用于语音互联网协议(Voice over Internet Protocol,VoIP)传输质量分析。本数据集已被用于研究各类因素对语音可懂度的影响,包括所采用的编解码器、转码操作,以及丢包、时延、数据包乱序、带宽限制等网络干扰因素。 本次研究涵盖各类网络干扰场景,包括丢包、时延、数据包乱序以及上述干扰的组合场景。 本数据集采集自依托某研发项目搭建的通信测试实验室。数据集包含以太网/IPv4(Ethernet/IPv4)网络环境下捕获的实时传输协议(Real-time Transport Protocol,RTP)流,存储格式为PCAP/PCAPNG,同时配套对应语音信号的波形音频文件(Waveform Audio File Format,WAV)。数据集可用于计算语音质量指标短时客观可懂度(Short-Time Objective Intelligibility,STOI)与扩展短时客观可懂度(Extended Short-Time Objective Intelligibility,ESTOI),并推导得到平均意见得分(Mean Opinion Score,MOS)衍生评分。数据集还附带Python语言编写的分析脚本,可复现本次研究的实验结果。语音样本均为无个人语境的中性测试语句,无法识别说话者身份,且不包含任何个人敏感信息。 该研发项目开展的研究内容包括: - 对比不同编解码器(L16、G.711μ律、G.711A律、G.722、G.729、Opus)下的语音传输质量; - 分析网络负载对VoIP语音质量的影响; - 评估多次转码导致的信号劣化; - 评估高干扰环境(包括短波(High Frequency,HF)传输场景)下的语音质量。 本次公开发布的数据集仅包含部分实验数据,用于复现相关质量分析实验。 该公开数据集包含以下内容: - 以太网/IPv4网络环境下捕获的RTP数据包(PCAP格式); - 语音信号录制文件(WAV格式); - 用于计算STOI/ESTOI指标及MOS衍生评分的相关数据。 本数据集依托编号为POIR.01.02.00-00-0010/18的研发项目制作,该项目由波兰国家研究与发展中心资助,且后续可陆续补充新的实验数据。



