5 月 30 日消息,俄罗斯搜索引擎巨头 Yandex 昨日发布了世界上最大的音乐推荐系统开源数据集 Yambda,包含 47.9 亿条匿名用户的交互数据,旨在帮助开发者创建智能音乐服务。
Yandex 在十个月内收集了近 2800 万 Yandex Music 月度用户的数据,具体为用户与 939 万首歌曲的 47.9 亿次交互,数据集包括听众对歌曲好恶的关键反馈,所有交互都带有时间戳以提高准确度。
Yambda 在 Hugging Face 提供三种大小的数据集供自由下载:Yambda-5B(来自 100 万名用户的行为)、Yambda-500M(10 万用户)和 Yambda-50M(1 万用户)。其中规模最大的5B 数据集至少需要 85 GB 存储空间。
相关文章
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读
2025-05-311阅读