Stable Audio 2.5 企业级音频生成 AI 模型发布，号称“3 分钟曲目 2 秒钟完成”

时间：2025-12-14 21:23

9 月 14 日消息，Stability AI 现已正式发布企业级音频生成模型 Stable Audio 2 5，相对上一代主要围绕音频细节、生成速度方面进行提升，号称“仅需 2 秒钟即可创建 3

9 月 14 日消息，Stability AI 现已正式发布企业级音频生成模型 Stable Audio 2.5，相对上一代主要围绕音频细节、生成速度方面进行提升，号称“仅需 2 秒钟即可创建 3 分钟音频曲目”。

据介绍，Stable Audio 2.5 的核心改进集中在音乐生成能力方面，号称生成结果更加贴合实际编曲逻辑，可呈现前奏、发展与结尾等完整多段式结构。同时新模型对提示词的理解更为准确，尤其在情绪描述和音乐风格词汇的把握上，响应更符合预期。

此外，新版模型还显著改进了音频生成速度，Stability AI 称这主要得益于研发团队提出的后训练方法 ARC（注：Adversarial Relativistic-Contrastive），这一技术通过结合相对式对抗训练与对比判别器，加速扩散模型的生成过程，可在保证音轨质量的同时显著降低 GPU 推理耗时，从而实现 2 秒钟生成长达 3 分钟的音频内容。

除此之外，Stable Audio 2.5 还新增了音频修补能力，用户可以导入自己的音频文件，并指定“延展位置”，模型即可根据音频前后内容及整体曲风，将音频一键“延长”，特别适合剪辑等场景。

目前，Stable Audio 2.5 已可通过 StableAudio 正式直接试用，同时支持本地化部署。不过最新规定，用户上传的音频文件不得包含受版权保护的内容，StableAudio 将利用自带的内容识别系统进行检测，以确保不侵犯他人版权。

来源：https://www.ithome.com/0/882/894.htm

Stable Audio 2 5 Stability AI

上一篇4049 元起科沃斯 T80S 扫拖一体机器人首销：24800Pa 吸力、恒压活水 2.0 洗地技术 下一篇2025 年拍照手机 TOP5：vivo 新品以 2 亿像素长焦成首推

本站内容用于信息整理与展示，如有侵权或内容问题请及时联系处理。

同类最新

继续查看同栏目最近更新的文章。

科技数码 · 2026-07-25

罗福莉入选新一届35岁以下科技创新35人中国区名单

2025年《麻省理工科技评论》“35岁以下科技创新35人”中国区名单在上海发布，罗福莉、姚顺宇等入选。罗福莉推动大模型从“能聊天”走向“能干活”，探索智能体演进；姚顺宇建立非厄米拓扑能带理论。本届AI+机器人领域入选者占四成。

科技数码 · 2026-07-25

美国科技巨头为AI投资年内裁员近14万人

美国科技巨头年内裁员近14万人，同时计划在AI基础设施上投入7250亿美元。裁员主要目的为AI投资腾出资金并纠正疫情期间过度招聘，市场对AI相关裁员反应负面，而AI初创公司正加速扩招，形成对比。

科技数码 · 2026-07-25

位AI Infra高管复盘WAIC：暴力美学触顶后求变？

WAIC2026上，AIInfra行业关注点从算力规模转向推理效率与Token产出。Agent驱动Token消耗激增，AI工厂与Token工厂成为关键载体。效率竞争取代规模竞赛，玩家分层加速，具备全栈优化能力的头部厂商优势凸显。

科技数码 · 2026-07-25

显卡厂商封仓引发涨价玩家面临高价购买

显卡市场，恐怕又要迎来一波涨价潮了。过去两年，不少玩家咬咬牙买下的高价显卡，如今回头看，竟然成了抄底。但问题在于，硬件市场每一次涨价，最终买单的永远还是玩家。业内消息显示，GDDR7显存价格出现了明显上涨，单颗2GB显存价格上涨接近20美元。按8GB显存规格计算，一张显卡的显存成本或将增加约542

科技数码 · 2026-07-25

OpenAI加入签署AI开源模型公开信，组织达35家

7月25日，微软、英伟达等25家美国公司联署公开信支持开放权重AI模型，随后签署方增至35家，新增包括OpenAI等。开放权重模型可下载、修改、运行，能扩大创新、强化竞争并降低风险，避免AI收益集中于少数巨头。