- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我知道有很多关于从 FFT 中找到音高的主题,并且我已经对从时域 -> 频域转换数据样本的整个过程有了不错的理解,但是仍然有一些领域(可能更高级) 我有点坚持。
我将逐步完成我当前的流程,希望有人可以帮助我了解我哪里出错了!
在开始之前,我在这里使用的示例是我在 Logic 中创建的 Wav 文件,它只是 中的钢琴预设。一个秤 ,从 开始 key A4 ,它只是每半个小节向上移动刻度(A4、B4、C#5、D5...),总共 4 秒 在 120 bpm .如果有帮助,这里是 wav 的链接:[a https://www.dropbox.com/s/zq1u9aylh5cwlmm/PianoA4_120.wav?dl=0]
第一步:
我解析出元数据和实际的样本数据。
元数据:
channels => 2,
sample_rate => 44100,
byte_rate => 176400,
bits_per_sample => 16,
data_chunk_size => 705600,
data => ...
第二步:
由于有 2 个 channel ,我有一个左右数组,里面装满了相应的样本数据,然后将它们中的每一个都放在 FFT 上。每个 FFT 的结果给出了给定频率的幅度和相位
第三步:
我现在需要找到每个 FFT 的最大值。我通过找到真实/复杂结果的所有大小然后找到最大值来做到这一点。我正在使用 Matlab 来帮助我,所以我运行 max(abs(fft(data)))
.我从找到每个 FFT 的最大值中得到的值是 1275.6 和 1084.0 .
第四步:
从它们各自的 FFT 中找到这些最大值的索引,然后在映射的频域值的索引处找到频率。这给了我 1177.0赫兹和 1177.5赫兹 .
这就是我困惑的地方!我绘制了时域图并查看了如何发现音高为 A4 只需查看周期并知道 A4 的周期是多少,但我试图了解如何通过 FFT 得出相同的结论。任何帮助/指向我的地方将不胜感激!
最佳答案
A4 通常为 440Hz。我的猜测是你已经检测到 440Hz 的 3 次谐波并且有一个错误。
以下是对您正在使用的步骤的一些观察:
第2步:
对两个 channel 进行分析可能没有任何收获。通过将两者相加转换为单声道信号
第 3 步:
这不适用于可靠的复音信号(或者就此而言,真实世界的单声道乐器信号),此外,对于单声道信号,在某些情况下来自两个相邻箱的功率具有相同的值 - 这是因为每个箱是带通滤波器在其频率响应中具有指数尾。恰好位于两个频带中间的信号对两者的贡献相同,并且在实际信号的情况下,尽管是主要频率,但两个频带都可能具有频谱中的最高能量:请记住,谐波将存在并且可能很大。另请注意,对于某些真实世界的乐器声音,从根本上说,它们甚至可能没有分音的最高能量。
FFT 的相位分量提供了许多表明跨频带信号的线索。
第4步:
您正在找到具有最高能量的 FFT bin 的中心频率。由于音阶是以 2 为底的对数,这对于较高频率来说是合理的近似值,但在低频下,即使您使用大型 FFT(在这种情况下,您会消耗大量 CPU 周期并丢失时间分辨率)。
为了做得更好,您可以使用 Short-time Fourier Transform并利用
i) 来自 FFT 数据的连续窗口的相位 (Phi)
ii) 并且 F = dPhi/dt
由此您可以获得非常准确的结果。
关于Matlab - 更好地理解 FFT 并找到 Pitch,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/27208622/
据我所知,根本不为元素呈现 HTML,或添加 display:none,似乎具有完全相同的行为:两者都使元素消失并且不与 HTML 交互。 我正在尝试禁用和隐藏一个复选框。所以HTML的总量很小;我无
我刚刚读了Android Architecture Tutorial: Developing an App with a Background Service (using IPC) .基本上是 让服
我有两个查询具有相同的结果,现在我想知道哪个查询更优化? 在选择中: select t1.*, sum(t2.value) as total_votes from table1 t1 left joi
有人告诉我,对于 I/O 绑定(bind)的应用程序,非阻塞 I/O 会更好。对于 CPU 密集型应用程序,阻塞 I/O 会好得多。我找不到这种说法的原因。试过谷歌,但很少有文章只是触及这个话题而没有
我有一个算法可以在数字列表中寻找好的对。一个好的配对被认为是索引 i 小于 j 且 arr[i] 1: # Finding the mid of the array
我有一个算法可以在数字列表中寻找好的对。一个好的配对被认为是索引 i 小于 j 且 arr[i] 1: # Finding the mid of the array
我从 API 收到一个 json,我需要解析并修改一个属性值。问题是,我收到的 json 数据的嵌套结构不一致,我无法控制它。 这将禁止我指定在特定深度(如 parsedJson.children[0
我有 451 个城市的坐标。现在我想计算每个城市之间的距离,然后根据该距离对一些结果进行排序。现在我有两个选择: 我可以运行一个循环来计算每个可能的城市组合的距离并将它们存储到一个表中,这将产生大约
对于返回相同结果的不同查询,我有两个查询计划我想知道是否有人可以告诉我哪个“更好”,以及为什么。 SELECT * FROM bids order by (select ranking from us
关闭。这个问题需要更多focused .它目前不接受答案。 想改进这个问题吗? 更新问题,使其只关注一个问题 editing this post . 关闭 7 年前。 Improve this qu
我有一个二维数组。我需要尽可能快地对其执行一些操作(函数每秒将被调用十几次,所以让它变得高效会很好)。 现在,假设我想获取元素 A[i][j],简单地使用 A[i][j] 在速度上有什么不同吗和 *(
在声明或使用字符串的代码中,我通常会看到开发人员这样声明它: string randomString = @"C:\Random\RandomFolder\ThisFile.xml"; 代替: str
这个问题在这里已经有了答案: 关闭 10 年前。 Possible Duplicate: Why don't CSS resets use '*' to cover all elements? 我正
如果我有一个包含许多重复项的 python 列表,并且我想遍历每个项目,而不是重复项,最好使用一个集合(如 set(mylist),或者找到另一种方法来创建没有重复的列表?我想只是循环遍历列表并检查重
在阅读常量接口(interface)反模式时,我发现没有实例的最终常量类比常量接口(interface)更好。 请解释一下怎么做? public interface ConstIfc { publ
我正在查看我继承的一些旧代码,我真的不喜欢某些地方的风格。我真的不喜欢它的外观的一件事是: bool func() { bool ret = true; ret &= test1();
关闭。这个问题是opinion-based 。目前不接受答案。 想要改进这个问题吗?更新问题,以便 editing this post 可以用事实和引文来回答它。 . 已关闭 4 年前。 Improv
我经常发现自己试图使用 boost/QT 信号解耦对象。实现这一点的简单方法是针对我要通信的每个具体类型,创建一个新的信号和插槽签名并连接所有相关对象。这导致了访问者模式,理想情况下我想发出一个访问者
我正在 https://docs.oracle.com/javase/tutorial/java/javaOO/lambdaexpressions.html 上阅读有关 lambda 的内容 在方法
public List getInts() { List xs = new ArrayList(); xs.add(1); // return Collections.unmo
我是一名优秀的程序员,十分优秀!