恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

FMA|完整音乐分析数据集,106,574 首曲目与 917 GiB CC 音频

  • 首页
  • 资讯中心
  • /
  • FMA|完整音乐分析数据集,106,574 首曲目与 917 GiB CC 音频

相关资讯

AI Skill 全面介绍:从概念到实战应用 2026/8/25 23:15:41
拼多多#PDD#2027届#秋招#最后一天啦 2026/8/25 23:10:41
2026全国网站建设公司量化指南:精选十家北京网站制作公司推荐,满足全景需求 2026/8/25 23:10:41

最新资讯

具身智能精密装配赛上位机开发:TCP通讯、协议解析与实时调度实战指南
缓存穿透、击穿与雪崩:原理、区别与Spring Boot+Redis实战解决方案
免费AI大模型调教指南:打造专属网文写作助手
Hermes接入团队协作后,我推翻了三个效率假设
Python random 模块常用函数详解:从入门到实战
FlinkSQL 处理 binlog:changelog 的三种处理方式

今日推荐

Python random 模块常用函数详解:从入门到实战
Hermes接入团队协作后,我推翻了三个效率假设
免费AI大模型调教指南:打造专属网文写作助手

本周热门

Nextcloud 桌面客户端:把同步交给它,你只管改文件
如何将 HTML 转成 Word 文档且格式不丢失?html-to-docx 使用教程
Anki 批量操作卡片完整指南:一次搞定上千张,不再逐张修改

本月精选

如何用DamaiHelper实现演唱会门票的智能自动化抢购:完整技术解决方案指南
第4篇:59 倍性能差距的索引瓶颈定位——一次教科书级的全表扫描调优
终极歌词批量下载神器:5分钟解决离线音乐库歌词同步难题

FMA|完整音乐分析数据集,106,574 首曲目与 917 GiB CC 音频

发布时间:2026/8/25 23:15:41
FMA|完整音乐分析数据集,106,574 首曲目与 917 GiB CC 音频 FMA完整音乐分析数据集106,574 首曲目与 917 GiB CC 音频【免费下载链接】fmaFMA: A Dataset For Music Analysis项目地址: https://gitcode.com/gh_mirrors/fm/fmaFMA 是一个开源音乐分析数据集收录 106,574 首 Creative Commons 授权的曲目、161 个流派标签和预计算音频特征。你在训练音频模型时缺数据它一次给齐。FMA 音乐分析数据集解决什么麻烦想训练音频模型先得弄到一批来路干净的音频自己收集的话版权没法保证。只有 1,000 首、8 个标签的老数据集模型一上就过拟合那 8 个流派。特征提取也是座大山自己用 librosa 跑 10 万首曲目的特征光处理就要好几天。能力速览能力一句话说明≤15字典型场景CC 授权音频106,574 首343 天时长流派识别、音频模型训练预计算特征librosa 提取即用跳过特征工程直接建模分层流派标签161 个流派带父子关系粗粒度分类、多标签任务元数据与标签艺术家、专辑、播放量、简介推荐系统、多模态特征官方切分与基线train/val/test 附基线与社区论文对比数字最短上手路径git clone https://gitcode.com/gh_mirrors/fm/fma cd fma pip install -r requirements.txt然后在data/目录下载并解压fma_metadata.zip342 MiB和fma_small.zip7.2 GiB下载命令和 sha1 校验脚本都写在 README.md 里照抄即可。再在仓库根目录的.env里把AUDIO_DIR指向解压后的音频目录就可以跑第一个 cellimport utils tracks utils.load(data/fma_metadata/tracks.csv) features utils.load(data/fma_metadata/features.csv) print(tracks[track, genre_top].value_counts().head())立刻能看到曲目数最多的流派和对应特征。音频共四种规格从小到大fma_small7.2 GiB—— 8,000 首 30 秒片段8 个平衡流派适合快速验证fma_medium22 GiB—— 25,000 首 30 秒片段16 个流派适合中等规模实验fma_large93 GiB—— 106,574 首 30 秒片段161 个流派适合全流派研究fma_full879 GiB—— 完整长度音频适合全长序列建模三个真实用法跑通流派识别基线想知道现有数据和方法能到什么水平先跑官方基线模型。make baselines.ipynb它会分别用音频和特征训练两组基线并给出准确率。验证音频加载链路写训练管线之前先确认第一首曲子的路径和波形加载没问题。import os import utils path utils.get_audio_path(os.environ[AUDIO_DIR], 2) y utils.LibrosaLoader().load(path)查看流派层级顶层分类只需要少数顶层流派时先看清父子结构再决定怎么归并标签。import utils from utils import Genres genres utils.load(data/fma_metadata/genres.csv) print(Genres(genres).find_roots())踩坑清单unzip 解压到尾部报 unsupported compression 错。换 7zip 解压不放心就用 README 里的 sha1 先校验压缩包是否完整。pip install -r requirements.txt 报错提示指向 numpy 或 resampy。先执行pip install numpy1.12.1再装 requirements官方 README 明确这是绕过 resampy 的安装问题。在 Python 3.10 以上环境tensorflow 1.0.1、librosa 0.5.0 这类老版本装不上。用 Python 3.6 开独立环境conda create -n fma python3.6如果只用元数据和特征也可以直接拿新版 pandas 读 csv绕开整套老依赖。下一步usage.ipynb加载数据、训练与评测模型的完整流程analysis.ipynb探索元数据、特征与流派层级分布baselines.ipynb流派识别基线数字进阶方向用 fma_large 的 30 秒片段预训练音频表示模型再微调下游任务clone 下来解压 fma_small你手里就是 8,000 首带流派标签的音频。【免费下载链接】fmaFMA: A Dataset For Music Analysis项目地址: https://gitcode.com/gh_mirrors/fm/fma创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号