5月12日,英伟达与麻省理工学院(MIT)联合推出Audio-SDS,这是一种基于文本条件的音频扩散模型扩展技术。研究人员首次将Score Distillation Sampling(SDS)技术应用于音频领域,无需依赖大规模特定数据集,即可实现FM合成器参数校准、物理冲击音合成及音源分离三大任务。Audio-SDS结合了预训练模型的生成能力与参数化音频表示,能通过高级文本提示调整相关参数。实验显示,该技术在主观听觉测试和多项客观指标上表现优异。尽管如此,模型覆盖范围、潜在伪影及优化敏感性等问题仍待解决。这项技术突破了传统音频生成模型的局限,为AI音效生成提供了新方向。
原文链接
本文链接:https://kx.umi6.com/article/18519.html
转载请注明文章出处
相关推荐
换一换
Adobe 推出全新 AI 影视制作工具,可制作音效、模仿视频画面构图
2025-07-17 22:30:42
GLM 5.3 更强却更难用了?我们让它和 5.2 做了同一个北京城市驾驶游戏
2026-09-01 16:59:26
中美AI竞赛白热化!黄仁勋、马斯克罕见同声:过度监管AI就是在帮中国赢
2026-09-04 19:37:22
3秒出片比播放还快,MiniMax打开了AI视频的实时商业化路径
2026-09-01 20:55:02
刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代
2026-09-04 06:01:21
20ms把PDF变成Markdown!开源OCR神器快了近300倍
2026-08-29 21:19:09
神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光
2026-09-03 10:17:05
Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!
2026-09-01 16:54:15
AQuA:让量化研究 Agent 持续进化,也让回测结果经得起检验
2026-08-31 11:34:56
OpenAI买几万台Mac搞强化训练!英伟达的活被苹果抢了
2026-08-31 11:38:31
我国首个相关国标今起实施!整治AI客服已读乱回 转人工终于不难了
2026-09-01 01:08:21
58同城姚劲波:AI转型不能假手他人 企业家必须亲自驾驭AI
2026-09-06 13:58:43
新版GPT Image 2.5已经能伪造GPT-6发布会了
2026-09-04 07:02:39
767 文章
944724 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47