Adobe 于8月20日发布博文,宣布其创意 AI 工作室 Adobe Firefly 平台迎来重大更新,正式扩充了三项音频生成功能。此次更新旨在将 AI 创作能力从视觉扩展到听觉领域,让用户能在同一个工作区内完成从画面到声音的全流程创作。
更新的核心是三项全新的 AI 音频工具,目前已面向所有用户开放:
- 生成音乐(Generate Music):该功能由 Adobe 自研的 Firefly Music Model 驱动。用户可以根据视频的时长和所需的氛围,让 AI 生成相应的原创音乐曲目。Adobe 特别强调,生成的音乐具备商业使用安全性,并提供通用授权,这对于内容创作者来说是个重要的保障。
- 生成配音(Generate Speech):此功能支持两种模型——Adobe 自研的 Firefly Speech Model 以及来自 ElevenLabs 的模型。用户只需输入文本脚本,即可将其转换为语音配音,并可对声音、语速和情绪进行调节,适用于制作旁白、教程讲解等场景。
- 生成音效(Generate Sound Effects):由 Firefly Audio Model 驱动,该功能能够根据视频内容中的具体动作、节奏和整体氛围,生成定制化的音效,为视频内容增添细节和真实感。
Adobe 在博文中提到,推出这些功能的目的是让用户能够在一个统一的环境中完成音乐、旁白和音效的创作。这解决了以往创作者需要在多个应用、浏览器标签页和不同的 AI 模型之间来回切换的痛点,适用于社交内容、直播日志、短片、产品教程和播客片段等多种创作场景。
这三项新功能的加入,使得 Firefly 从此前以图像和视频生成为主的工具,演变为一个更加综合的 AI 创意内容平台。它直接将音频生成能力嵌入到创作者已有的 Adobe 工作流中,有望进一步提升内容制作的效率,尤其是在短视频和自媒体内容蓬勃发展的当下。




