
音潮是由自由量级(运营主体音潮滴现(上海)智能科技有限公司)打造的国产 AI 写歌与作曲平台,基于团队从零到一全链路自研的音乐大模型构建,并已通过国家网信办生成式 AI 服务备案。平台专注中文语义与情绪写歌:一句话、一张照片甚至一段哼唱,都能在 15 秒到 1 分钟内变成带专业人声与高音质编曲的完整歌曲,slogan 是「用音乐传递美好瞬间」。
功能速览
一句话成歌
输入一句主题或歌词思路,AI 自动完成作词、作曲、演唱,另有适配短视频的片段模式
图片写歌
上传照片,AI 识别画面情绪与氛围,生成贴合场景的旋律与人声
多模态输入
文字、图片、音频、哼唱皆可作为灵感来源,模型统一理解多模态输入
音潮 Studio
歌词创作、音乐生成、人声分离、音频改编、封面生成等 9 大 AI 工具集成的工作坊
可视化编曲
多维音色控制与实时编辑,生成后仍可逐项调整再创作
全平台覆盖
iOS、Android、Web 全平台可用,手机记灵感、网页端深创作
自研音乐大模型
音潮的底座是自由量级自研的Diffusion Transformer(DiT)音乐大模型,具备多模态表征与高保真重建能力,可生成具有自然宽度与深度的立体声音频,并使用国产算力训练,迭代节奏自主可控。模型已迭代到 V4.0:能精准理解风格、乐器与情绪,把「温暖、律动、愉悦」这类中文情绪关键词深度绑定到曲风与配器上;人声可指定唱法,乐器可细化奏法,此前 V3.0 引入的双轨建模与多阶段强化学习,让模型学会了哼唱、转音、气声等细腻演唱技巧。
这个模型也经受过大场面检验:音潮曾亮相 WAIC 2025 世界人工智能大会,并承担大会主题曲的创作。
创作方式
音潮把输入门槛压到最低,提供三类入口。文字写歌是最直接的路径:描述主题、情绪、想要的曲风,模型按中文语义理解后成曲,媒体实测「三分钟打造专属 BGM」;图片写歌面向有画面感的用户,婚礼照片、旅行随拍、宠物截图都能成为创作素材,AI 从画面读出情绪再谱曲;音频输入支持上传旋律或哼唱片段,由模型延展成完整作品。生成一首完整歌曲通常在 15 秒到 1 分钟之间,短视频创作者还可以用片段模式只产出副歌或桥段。
音潮 Studio
除单点生成外,网页端提供「音潮 Studio」创作工坊,把创作全流程的工具收进一处:
| 工具 | 用途 |
|---|---|
| 歌词创作 | AI 辅助写词,按主题与情绪产出歌词 |
| 音乐生成 | 多模态输入生成完整歌曲或片段 |
| 人声分离 | 把歌曲拆成人声与伴奏,便于翻唱与二创 |
| 音频改编 | 对已有作品做风格与结构上的再创作 |
| 封面生成 | 为歌曲自动生成封面视觉 |
配合可视化编曲与多维音色控制,生成结果可以实时编辑调整,而不是「一锤子买卖」。
产品优势
放在国产 AI 音乐赛道里,音潮的差异点有四。其一是全链路自研:模型、算力、训练全部自主,不受海外模型接口与政策掣肘,还通过了国家生成式 AI 备案,商业使用更安心;其二是中文语感:从语义理解到情绪表达都针对中文优化,量子位、知乎等渠道的评测认为其 V4.0 在中文复杂提示词理解上已具备对垒 Suno 的实力;其三是演唱细节:哼唱、转音、气声等技巧让 AI 人声不再是「电子味」;其四是工具链完整:从写词、生成、拆轨到改编、封面,Studio 一站式覆盖。
适用场景
| 人群/场景 | 典型用法 |
|---|---|
| 短视频创作者 | 片段模式产出副歌 BGM,图片写歌让素材即配乐 |
| 活动与品牌方 | 定制主题曲、宣传片配乐,快速出多版小样比稿 |
| 情绪记录爱好者 | 把日常瞬间写成歌,用音乐记录生活 |
| 想翻唱改编的用户 | 人声分离拿干净伴奏,音频改编换风格重制 |
| 零基础音乐爱好者 | 一句话起步,靠可视化编曲逐步学做完整作品 |
常见问题
两者定位相近,音潮的优势在中文:复杂中文提示词理解、华语歌词韵脚与演唱语感都针对中文优化;量子位等媒体评测认为其 V4.0 在中文场景已可正面挑战 Suno。Suno 则在英文曲风积累与全球社区上更成熟,可按创作语言选择。