gpt4 book ai didi

ios - 检测音频文件中的低频音调

转载 作者:塔克拉玛干 更新时间:2023-11-02 08:16:03 26 4
gpt4 key购买 nike

我知道这个问题已被问过数百次...但我对我的结果感到沮丧,所以我想再问一遍。在深入研究 fft 之前,我需要弄清楚这个简单的任务。

我需要检测音频文件中的 20 赫兹音调。如图所示,我自己插入了 20hz 音调。 (可以是任何频率,只要听者听不到,所以我想我应该选择 20hz 到 50hz 左右的频率)

enter image description here

关于音频文件的信息。

afinfo 1.m4a 
File: 1.m4a
File type ID: adts
Num Tracks: 1
----
Data format: 1 ch, 22050 Hz, 'aac ' (0x00000000) 0 bits/channel, 0 bytes/packet, 1024 frames/packet, 0 bytes/frame
Channel layout: Mono
estimated duration: 8.634043 sec
audio bytes: 42416
audio packets: 219
bit rate: 33364 bits per second
packet size upper bound: 768
maximum packet size: 319
audio data file offset: 0
optimized
format list:
[ 0] format: 1 ch, 22050 Hz, 'aac ' (0x00000000) 0 bits/channel, 0 bytes/packet, 1024 frames/packet, 0 bytes/frame
Channel layout: Mono
----

我遵循了这三个教程,并想出了一个读取音频缓冲区并为我提供 fft double 值的工作代码。

http://blog.bjornroche.com/2012/07/frequency-detection-using-fft-aka-pitch.html
https://github.com/alexbw/iPhoneFFT
How do I obtain the frequencies of each value in an FFT?

我读取数据如下

// If there's more packets, read them
inCompleteAQBuffer->mAudioDataByteSize = numBytes;
CheckError(AudioQueueEnqueueBuffer(inAQ,
inCompleteAQBuffer,
(sound->packetDescs?nPackets:0),
sound->packetDescs),
"couldn't enqueue buffer");
sound->packetPosition += nPackets;


int numFrequencies=2048;
int kNumFFTWindows=10;

SInt16 *testBuffer = (SInt16*)inCompleteAQBuffer->mAudioData; //Read data from buffer...!

OouraFFT *myFFT = [[OouraFFT alloc] initForSignalsOfLength:numFrequencies*2 andNumWindows:kNumFFTWindows];
for(long i=0; i<myFFT.dataLength; i++)
{
myFFT.inputData[i] = (double)testBuffer[i];

}
[myFFT calculateWelchPeriodogramWithNewSignalSegment];
for (int i=0;i<myFFT.dataLength/2;i++) {
NSLog(@"the spectrum data %d is %f ",i,myFFT.spectrumData[i]);
}

和我的输出日志类似

Everything checks out for 4096 samples of data
Set up all values, about to init window type 2
the spectrum data 0 is 42449.823771
the spectrum data 1 is 39561.024361
.
.
.
.
the spectrum data 2047 is -42859933071799162597786649755206634193030992632381393031503716729604050285238471034480950745056828418192654328314899253768124076782117157451993697900895932215179138987660717342012863875797337184571512678648234639360.000000

我知道我还没有计算幅度,但我怎样才能检测到声音中有 20 赫兹?我需要学习 Goertzel 算法吗?

最佳答案

有很多方法可以传达信息,这些信息被插入到一些预先存在的波浪模式中,然后从中检索出来。输入的信息可以改变振幅(振幅调制)或频率(频率调制)等。你有策略吗?请注意,您希望传达的信息密度可能会受到调制频率等因素的影响(较高的频率自然可以传达更多信息,因为它每秒可以解析更多次变化)。

如果发送方和接收方都有源音频(引用),则可以使用另一种方法。在这种情况下,接收器可以在引用音频和实际接收到的音频之间进行区分,以解析出传输的额外信息。对此的一种变体是让发送方发送 ~~same~~ 音频两次,首先发送引用未触及的音频,然后发送该相同引用音频的调制版本,这样接收方就可以听到这两个音频之间的差异 ~~same ~~ 剪辑以解决嵌入的音频。

回到你原来的问题......如果发送者和接收者有协议(protocol)......说一段时间 X 发送引用纯 20 Hz 音调,然后是另一个时间段 X,20 Hz 音调由你调制输入信息以改变其幅度或频率...然后只需重复此模式...在接收端,他们只是在每对时间段之间进行差异以解析您的调制信息...为此可以使用源音频不能有低于某个频率的任何音调,比如 100 Hz(如果需要,你可以删除这样的频带)只是为了消除源音频的干扰......你没有提到你想要传输什么样的数据......如果它的声音你首先会需要拉伸(stretch)它实际上将其频率范围从 1 kHz 范围降低到您的低 20 Hz 范围......一旦差异结果在接收端可用,您然后挤压这条曲线以将其恢复到 1kHz 的正常语音范围...也许工作比你有时间 f或者但这可能只是工作...真正的 AM/FM radio 使用调制在兆赫兹载波频率上发送语音,因此它可以工作

关于ios - 检测音频文件中的低频音调,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/28903510/

26 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com