1. Meta将于2024年第一季度发布LLaMA3。
这意味着DeWave方法的性能受限于预训练语言模型的质量和能力。如果预训练语言模型不够准确或不具备广泛的语言理解能力,可能会影响到DeWave方法的翻译性能。
这种氛围,也顺势带起了玩家的情绪。在#我的蛋仔年度报告##和蛋仔一起跨年#这些话题里,可以看到不少玩家剪辑的短视频。里面不仅有人回忆这一年在蛋仔中参与的活动,也有人记录自己参加的线下活动、收集的游戏周边;不过更多的,还是过去一年中,和朋友们一起玩蛋仔的各种瞬间。
除了可以从文字生成音乐外,它还支持图像、视频和音频生成音乐,并且还可以编辑已有的音乐。该项目利用了MERT等编码器进行音乐理解,ViT进行图像理解,ViViT进行视频理解,并使用MusicGen/AudioLDM2模型作为音乐生成模型(音乐解码器)。用户可以轻松移除或替换特定乐器,调整音乐的节奏和速度。这使得用户能够创造出符合其独特创意的音乐作品。