英伟达推出新AI模型Fugatto，可修改并生成新声音

您现在的位置：首页吾爱首码网英伟达推出新AI模型Fugatto，可修改并生成新声音

英伟达推出新AI模型Fugatto，可修改并生成新声音

吾爱首码网 2024-11-26 吾爱首码网 161 次浏览 4个评论

英伟达(NVDA.US)推出了一款用于生成音乐和音频的新型人工智能(AI)模型，旨在为制作音乐、电影和视频游戏的人们提供服务。

根据英伟达的说法，这款模型名为Fugatto(Foundational Generative Audio Transformer Opus)，可以使用任何文本和音频文件来生成或修改音乐和声音。

例如，该模型可以根据文本提示创建音乐片段，从现有歌曲中删除或添加乐器，改变声音中的口音或情绪，甚至发出从未听过的声音。

英伟达应用音频研究经理、管弦乐队指挥兼作曲家Rafael Valle表示：“我们希望创建一个能像人类一样理解和产生声音的模型。”

英伟达指出，广告代理商可以使用Fugatto快速定位多个地区的现有广告，并在配音中加入不同的口音和情感。此外，视频游戏开发者可以使用人工智能模型修改游戏中预先录制的资产，以适应用户在玩游戏时不断变化的动作。

推荐阅读：

首批FX原型车开发测试阶段正式启动法拉第未来涨逾12%

Fugatto可以使小号发出狗吠声或萨克斯管发出喵喵声。该公司补充说，通过微调和少量的歌唱数据，研究人员发现它可以处理未经预先训练的任务，比如从文本中生成高质量的歌声。

英伟达表示，Fugatto的完整版本使用了25亿个参数，并在包含32个Nvidia H100 Tensor Core GPU的Nvidia DGX系统上进行了训练。该模型的整体工作耗时一年多。

Fugatto可能会与Runway等初创公司以及 Meta Platforms(META.US)等大公司的类似技术展开竞争。10月，Meta 发布了名为Movie Gen的人工智能模型，该模型可以根据用户提示创建逼真的视频和音频剪辑。

今年 2 月，ChatGPT制造商OpenAI推出了Sora，它可以根据文本指令创建逼真且富有想象力的场景。这家由微软(MSFT.US)支持的公司尚未向公众发布文本转视频模型。

你可能想看：

百度网盘推出“超能画布”：一键生成创意大片身临其境

西班牙推出新财政方案将银行税率上调至最高7%

麦当劳推出新款美国超值菜单延续低价路线以刺激增长

芝加哥期权交易所（CBOE）将推出新的比特币指数期权，以现金结算

AI眼镜：国产AI眼镜公司预计2025Q1推出产品，原因是在等待国产交互型多模态大模型

华尔街准备推出新一代加密货币相关ETF 迎合各类投资者口味

美国回应俄罗斯修改核学说：没理由因此调整核态势

韩国11月出口回暖，特朗普贸易政策成新忧虑

平安系余宏接棒张晓宇拟任友邦人寿CEO，5年开设8家省级分公司，友邦版图扩张亟待人才输入

Truist：生成式AI将为基础设施和网络安全领域带来机遇上调CrowdStrike等目标价

转载请注明来自吾爱首码网，本文标题：《英伟达推出新AI模型Fugatto，可修改并生成新声音》

吾爱首码网 3698篇文章站点微博

每一天，每一秒，你所做的决定都会改变你的人生！

Top