面向视频创作者、游戏开发者与学生,新能力可由文字或视频制作5秒至5分钟的可商用配乐,并生成自然旁白与场景音效,同时接入多家模型供应商。
8月21日,Adobe公布Firefly新增一套音频生成能力,包括生成音乐、生成语音和生成音效。上述工具部署在Firefly桌面端与移动网页端,将配乐、旁白及音效制作嵌入视频编辑流程,为视频创作者、游戏开发者和学生提供可直接使用的素材来源。
音乐生成接受文字提示或视频上传两种输入,系统会解析画面内容、情绪走向、节奏与总时长,再输出匹配片段的曲目。用户可按情绪、风格、用途、能量和节拍调节方向,并把长度控制在5秒至5分钟之间,一次生成得到4个可选版本。语音部分负责把脚本转成自然旁白,兼容Adobe Firefly语音模型与ElevenLabs模型,表现力和发音可通过标签修正。音效部分则可读取文字描述或一段录音作为参照,产出贴合画面动作、节奏与氛围的声音元素。
在商用层面,Adobe称生成曲目属于免版税授权,公司不主张对音乐本身的所有权,个人社交发布和商业广告项目均可采用,商用时也不依赖额外订阅。现阶段功能免费开放,付费档位会提高产出额度并扩大模型范围。音乐能够以WAV形式导出,也能并入视频文件,并可在Creative Cloud各工具中调取;生成音乐还会被附上内容凭证,便于追踪来源。生态侧,Firefly接入Gemini Omni Flash,此前已引入Runway Aleph2.0和Kling2.0,组合内包含Google、Kling AI、Luma AI、OpenAI、Runway与Adobe自研模型。Adobe与伯克利音乐学院提供的调查数据显示,100%的受访视频创作者、音乐人和营销人员都会在视频里放入音乐,32.7%已经使用AI生成音乐,43.2%把法律与版权风险视为主要障碍,38.9%则将授权费用列入核心顾虑。