ios - 检测音频文件中的低频音调

我知道这个问题已被问过数百次...但我对我的结果感到沮丧，所以我想再问一遍。在深入研究 fft 之前，我需要弄清楚这个简单的任务。

我需要检测音频文件中的 20 赫兹音调。如图所示，我自己插入了 20hz 音调。 (可以是任何频率，只要听者听不到，所以我想我应该选择 20hz 到 50hz 左右的频率)

enter image description here

关于音频文件的信息。

afinfo 1.m4a 
File:           1.m4a
File type ID:   adts
Num Tracks:     1
----
Data format:     1 ch,  22050 Hz, 'aac ' (0x00000000) 0 bits/channel, 0 bytes/packet, 1024 frames/packet, 0 bytes/frame
Channel layout: Mono
estimated duration: 8.634043 sec
audio bytes: 42416
audio packets: 219
bit rate: 33364 bits per second
packet size upper bound: 768
maximum packet size: 319
audio data file offset: 0
optimized
format list:
[ 0] format:      1 ch,  22050 Hz, 'aac ' (0x00000000) 0 bits/channel, 0 bytes/packet, 1024 frames/packet, 0 bytes/frame
Channel layout: Mono
----

我遵循了这三个教程，并想出了一个读取音频缓冲区并为我提供 fft double 值的工作代码。

http://blog.bjornroche.com/2012/07/frequency-detection-using-fft-aka-pitch.html
https://github.com/alexbw/iPhoneFFT
How do I obtain the frequencies of each value in an FFT?

我读取数据如下

// If there's more packets, read them
        inCompleteAQBuffer->mAudioDataByteSize = numBytes;
        CheckError(AudioQueueEnqueueBuffer(inAQ,
                                           inCompleteAQBuffer,
                                           (sound->packetDescs?nPackets:0),
                                           sound->packetDescs),
                   "couldn't enqueue buffer");
        sound->packetPosition += nPackets;


        int numFrequencies=2048;
        int kNumFFTWindows=10;

        SInt16 *testBuffer = (SInt16*)inCompleteAQBuffer->mAudioData; //Read data from buffer...!

        OouraFFT *myFFT = [[OouraFFT alloc] initForSignalsOfLength:numFrequencies*2 andNumWindows:kNumFFTWindows];
        for(long i=0; i<myFFT.dataLength; i++)
        {
            myFFT.inputData[i] = (double)testBuffer[i];

        }
        [myFFT calculateWelchPeriodogramWithNewSignalSegment];
        for (int i=0;i<myFFT.dataLength/2;i++) {
            NSLog(@"the spectrum data %d is  %f ",i,myFFT.spectrumData[i]);
}

和我的输出日志类似

Everything checks out for 4096 samples of data
Set up all values, about to init window type 2
the spectrum data 0 is  42449.823771 
the spectrum data 1 is  39561.024361 
.
.
.
.
the spectrum data 2047 is  -42859933071799162597786649755206634193030992632381393031503716729604050285238471034480950745056828418192654328314899253768124076782117157451993697900895932215179138987660717342012863875797337184571512678648234639360.000000

我知道我还没有计算幅度，但我怎样才能检测到声音中有 20 赫兹？我需要学习 Goertzel 算法吗？

最佳答案

有很多方法可以传达信息，这些信息被插入到一些预先存在的波浪模式中，然后从中检索出来。输入的信息可以改变振幅(振幅调制)或频率(频率调制)等。你有策略吗？请注意，您希望传达的信息密度可能会受到调制频率等因素的影响(较高的频率自然可以传达更多信息，因为它每秒可以解析更多次变化)。

如果发送方和接收方都有源音频(引用)，则可以使用另一种方法。在这种情况下，接收器可以在引用音频和实际接收到的音频之间进行区分，以解析出传输的额外信息。对此的一种变体是让发送方发送 ~~same~~ 音频两次，首先发送引用未触及的音频，然后发送该相同引用音频的调制版本，这样接收方就可以听到这两个音频之间的差异 ~~same ~~ 剪辑以解决嵌入的音频。

回到你原来的问题......如果发送者和接收者有协议(protocol)......说一段时间 X 发送引用纯 20 Hz 音调，然后是另一个时间段 X，20 Hz 音调由你调制输入信息以改变其幅度或频率...然后只需重复此模式...在接收端，他们只是在每对时间段之间进行差异以解析您的调制信息...为此可以使用源音频不能有低于某个频率的任何音调，比如 100 Hz(如果需要，你可以删除这样的频带)只是为了消除源音频的干扰......你没有提到你想要传输什么样的数据......如果它的声音你首先会需要拉伸(stretch)它实际上将其频率范围从 1 kHz 范围降低到您的低 20 Hz 范围......一旦差异结果在接收端可用，您然后挤压这条曲线以将其恢复到 1kHz 的正常语音范围...也许工作比你有时间 f或者但这可能只是工作...真正的 AM/FM radio 使用调制在兆赫兹载波频率上发送语音，因此它可以工作

关于ios - 检测音频文件中的低频音调，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/28903510/

ios - 检测音频文件中的低频音调

上一篇：ios - 拒绝访问具有相同 IAM、Cognito 和权限配置的新存储桶

下一篇：iOS7 - 调整多行标签的字体大小以适合其框架