一、背景
- 人工智能发展背景:数据、算法和算力是人工智能发展的三大要素,近年来大语言模型、轻量化深度学习技术、训练芯片和推断芯片等技术创新加速,知识计算、人工智能与科学研究融合等成为重要探索方向。
- AI音乐生成的研究价值:AI音乐生成在理论及应用方面具有重要研究价值,近年来学术研究发展趋势显示,音乐学、多音乐学、心理学(脑、语言)、智能生成、设计学等领域的研究热度持续上升。
- AI音乐生成发展历程:从1960年的有限状态机和随机矩阵作曲,到1993年的交互式遗传算法作曲,再到2016年至今的深度学习技术作曲,AI音乐生成经历了漫长的发展历程。
- 音乐创作核心流程:音乐创作包括作词作曲、编曲配器、智能润色和后期制作等环节,AI技术可以协助简化作曲流程。
- AI音乐生成三大模块工作输出评估:包括噪音度评估、愉悦度评估和相似度评估,评估方法包括机器评估和人类评估。
- 音乐的数据表示:包括符号表示(如MIDI、Piano-roll)、图像表示和自然语言表示等。
- AI音乐生成的数据表示:包括音频表示、符号表示和视觉表示等,常用的数据集包括MuseData、LMD(LPD)、Million Song Dataset等。
- AI音乐生成技术路线:包括音乐分轨、特效音生成、音乐结构分析、音乐情感识别等环节。
- AI音乐生成评估:包括噪音度评估、愉悦度评估、相似度评估和图灵测试等,评估指标包括Qmax值、self-repetition特征、self-Similarity特征等。
- 国内外音乐生成工具:包括城市夜、Jaey豆、天天音、含MIDI/分轨、梦人含MIDI/分轨、中、豆包音乐、Suno等,音乐生成效率比传统作曲高100倍以上。
- 悟韵(WuYun)AI交互式智能作曲系统:支持AI音乐创作、编辑和润色,具有多轨音乐编辑和播放功能。
- 口语描述到音乐全链路生成Demo:通过用户文本描述输入,可以生成包含歌词、旋律、歌声合成和伴奏的音乐作品。
- ME and Al is ok:实现音乐与人工智能共创,通过混合智能和结构化知识,进行同步决策和动态写作。
二、AI音乐的三种方式
- 情感共鸣的音乐内容需求:AI音乐生成需要重视知识融入、认知拓展和情感共鸣,实现音乐共创的愿景。
- AI音乐生成融合:融合丰富协作策略、融合AI反馈、认知模型引入优化、理解即时协作、先验知识嵌入、AI计算多元思维和同步创意等。
- 理解:ReLyMe系统通过融入词曲创作知识,实现歌词-旋律的和谐生成,音调、节奏和结构知识的消融实验证明了三者的相互制衡关系。
- 反馈:SongDriver系统通过二脑并行机制,解决实时人机协作难题,提升伴奏的同步性和听感质量。
- 融合:视觉设计直观高效地展示信息,通过色彩、光影、色调、情绪、风格、节奏等元素,调动用户的情感和记忆。
三、音乐疗愈
- 助眠场景个性化助眠音乐生成:通过睡眠情况分析、助眠方案调整、音乐风格控制和音乐情感选择等,定制个性化助眠音乐。
- Heartbeats研究:通过音乐对运动热身的积极影响,结合智能心率手环和深度神经网络,实现个性化调节心率。
- REMAST实时情感改编模型:通过音乐情感识别模型与特征融合方式,实现实时情感改编,增强音乐的情感信息。
四、结论
- 智能音乐生成:AI音乐生成不是盗取灵感的窃贼,而是打开潘多拉魔盒的普罗米修斯,通过结构化音乐数据、音乐审美、情感、音乐库、作曲原理、规则、音乐心理学等,实现人“人”共创。
- 音乐智能:智能音乐生成推动了音乐智能的发展,改变了音乐理论与教学的认知范式,实现了认知创作、数据驱动和人机协作。