阿里AI项目DreamTalk开源
慕江南创始人周大帅认为,50-55岁用户是视频号最具消费力的用户群体,视频号核心用户以60后、70后为主,80后为辅,基本都在35岁以上。“慕江南以卖丝巾起家,和视频号用户非常契合。”
除了可以从文字生成音乐外,它还支持图像、视频和音频生成音乐,并且还可以编辑已有的音乐。该项目利用了MERT等编码器进行音乐理解,ViT进行图像理解,ViViT进行视频理解,并使用MusicGen/AudioLDM2模型作为音乐生成模型(音乐解码器)。用户可以轻松移除或替换特定乐器,调整音乐的节奏和速度。这使得用户能够创造出符合其独特创意的音乐作品。
模型下载地址:https://huggingface.co/damo-vilab/dreamtalk
站长之家(ChinaZ.com) 1月3日 消息:据36氪消息,斑头雁智能科技是一家人工智能公司,由原钉钉副总裁张毅(花名陶钧)创立。