当前位置：首页 » 资讯 » 新科技 » 正文

Stable Audio 2.5企业级音频生成AI模型发布，号称“3分钟曲目2 秒钟完成”

IP属地中国·北京 编辑：赵静 IT之家 时间：2025-09-15 08:11:23

IT之家 9 月 14 日消息，Stability AI 现已正式发布企业级音频生成模型 Stable Audio 2.5，相对上一代主要围绕音频细节、生成速度方面进行提升，号称“仅需 2 秒钟即可创建 3 分钟音频曲目”。
据介绍，Stable Audio 2.5 的核心改进集中在音乐生成能力方面，号称生成结果更加贴合实际编曲逻辑，可呈现前奏、发展与结尾等完整多段式结构。同时新模型对提示词的理解更为准确，尤其在情绪描述和音乐风格词汇的把握上，响应更符合预期。
此外，新版模型还显著改进了音频生成速度，Stability AI 称这主要得益于研发团队提出的后训练方法 ARC（IT之家注：Adversarial Relativistic-Contrastive），这一技术通过结合相对式对抗训练与对比判别器，加速扩散模型的生成过程，可在保证音轨质量的同时显著降低 GPU 推理耗时，从而实现 2 秒钟生成长达 3 分钟的音频内容。
除此之外，Stable Audio 2.5 还新增了音频修补能力，用户可以导入自己的音频文件，并指定“延展位置”，模型即可根据音频前后内容及整体曲风，将音频一键“延长”，特别适合剪辑等场景。
目前，Stable Audio 2.5 已可通过 StableAudio 官网直接试用，同时支持本地化部署。不过官方规定，用户上传的音频文件不得包含受版权保护的内容，StableAudio 网站将利用自带的内容识别系统进行检测，以确保不侵犯他人版权。

标签：音频模型内容用户方面曲目逻辑能力编曲实际 音乐风格 训练方法 音轨场景词汇团队质量剪辑情绪音乐结果速度曲风前奏规定官方整体自带网站利用秒钟细节

免责声明：本网信息来自于互联网，目的在于传递更多信息，并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益，请及时联系我们，本站将会在24小时内处理完毕。

同类资讯

中信建投：国内模型崛起多模态场景反超关注算力、云产业等高景气方向

著名互联网专家叶军受聘联合国世界AI科学院执行院长

SpaceX、OpenAI 加速上市全球科技龙头开启千亿级融资潮

美国怀疑ASML EUV光刻机偷偷流入中国号称有证据但拒绝公开

Meta员工士气跌至20年谷底！内部直播当众开骂，CTO承认AI重组糟糕透顶

微信AI来了？微信正灰度测试AI助手“小微”

全站最新

中信建投：国内模型崛起多模态场景反超关注算力、云产业等高景气方向

著名互联网专家叶军受聘联合国世界AI科学院执行院长

SpaceX、OpenAI 加速上市全球科技龙头开启千亿级融资潮

美国怀疑ASML EUV光刻机偷偷流入中国号称有证据但拒绝公开

热门推荐

中信建投：国内模型崛起多模态场景反超关注算力、云产业等高景气方向

著名互联网专家叶军受聘联合国世界AI科学院执行院长

SpaceX、OpenAI 加速上市全球科技龙头开启千亿级融资潮

美国怀疑ASML EUV光刻机偷偷流入中国号称有证据但拒绝公开

Meta员工士气跌至20年谷底！内部直播当众开骂，CTO承认AI重组糟糕透顶

微信AI来了？微信正灰度测试AI助手“小微”

追觅大调整！人员优化比例12%，补偿0.5N～N+1

2nm工艺还是不太行三星S26实测发热降频仍比骁龙严重

中国全固态电池关键材料新进展循环350次容量保持率仍达84.2%

紧追奥迪和凯迪！比亚迪进F1，还要再迈三道坎？

微信AI助手上线？腾讯客服回应

断钨：没想到这一拳，日本这么痛

五个CEO在讲台上，没人敢说“会好起来”

豆包首战618，不如董宇辉

扒遍了iOS 27后，我发现折叠iPhone已经悄悄“官宣”了