Adobe正式推出Firefly音频生成工具,包括“生成音乐”“生成语音”和“生成音效”,用户可直接在Firefly桌面及移动Web应用中创建商业安全的音频内容,进一步将AI音频能力融入视频创作流程。
Adobe与伯克利音乐学院近期调查显示,100%的受访视频创作者、音乐人和营销人员会在视频中使用音乐,其中32.7%已使用AI生成音乐;43.2%将法律及版权风险、38.9%将授权费用视为主要障碍。

针对这些痛点,Firefly“生成音乐”可根据视频内容、氛围、节奏和时长生成原创且完全授权的音乐,并提供4个方案供用户编辑选择。Adobe表示,生成内容无需额外订阅即可用于商业作品。
“生成语音”可将脚本转换为自然旁白,支持Adobe Firefly语音模型及ElevenLabs模型,并可通过表现力、发音等标签调整语音效果;“生成音效”则支持文本提示或录制声音作为参考,生成与画面动作、节奏和氛围匹配的音效。
与此同时,Adobe继续扩展Firefly第三方模型生态,新增Gemini Omni Flash,可结合视频、音频和图像进行内容创作。此前Firefly已加入Runway Aleph2.0和Kling2.0,目前模型阵容涵盖Google、Kling AI、Luma AI、OpenAI、Runway及Adobe自有模型。Adobe正通过整合多模型与多模态音视频能力,进一步完善Firefly一站式AI创作工作流。
Adobe发布Firefly自定义模型功能,用户可用自有素材训练专属AI模型,实现品牌调性的精准控制,推动AI绘画从随机创作迈向精准定制。
Adobe升级AI服务,Firefly订阅用户现可无限量生成图像和视频,并整合Google、GPT、Runway等外部顶尖模型,功能全面升级。
Adobe 为 Firefly 平台引入 OpenAI 的 GPT-Image1.5 模型,并推出限时激励:1月15日前,Pro 和 Premium 订阅用户可无限量使用该模型生成图片。此举显示 Adobe 正从单一模型转向构建多模态 AI 生态。
谷歌将AI音频功能融入教育,推出基于Gemini模型的播客风格音频课生成工具。教师只需输入主题或大纲,即可自动创建结构清晰、富有感染力的音频内容,帮助学生通过听觉深化理解,尤其迎合Z世代对播客的偏好。
配音演员穆雪婷发现自己的声音被AI克隆,未经许可用于亚马逊纪录片旁白。这一事件揭示了AI语音克隆技术被滥用的现实,声音版权遭侵犯却维权困难,引发对技术伦理与声音版权的关注。

关注 “悠AI” 更多干货技巧行业动态