- 月流量
- 0
- 产品收费
- 免费
- 收录时间
- 2025-12-18
- 更新时间
- 2026-07-06
01产品定位
SAM Audio 面向需要从混合声场中提取特定声音的创作者和研究人员。它将文本、视频画面与时间范围作为分割依据,减少仅依赖波形定位声源的操作。
工具可用于处理音频和视频素材,目标可以是人声、乐器、环境音或其他可描述的声音。它更适合作为后期制作和音频分析流程中的分离环节,而不是完整的剪辑或混音工作站。
02主要功能
文本提示分离:输入“狗叫声”“吉他独奏”“掌声”等自然语言描述,指定需要提取的声音。
视觉点击引导:处理视频时点击画面中的人物、车辆等物体,依据画面对象辅助定位其声音。
时间段指定:标记具体起止时间,限制需要处理的素材范围。
目标声源范围较广,除人声和乐器外,也可用于环境声、机械声等声音类型的提取。
03适用场景
视频后期中,可从复杂环境声里提取对白、特定音效或物体相关声音,辅助剪辑和重新编排。
音乐制作和混音场景中,可尝试从成品音乐中分离人声或乐器声,为采样、二次创作和重新混音提供素材。
播客、有声书及音频研究中,可用于提取目标声源、分析混合录音,或为语音增强等相关应用准备输入素材。
04使用注意事项
开始处理前,应尽量使用清晰、具体的文字描述,并准确选择视频对象或时间范围。目标声源与其他声音高度重叠时,分离结果可能出现背景残留、目标声音缺失或串音。
因此,输出内容需要通过耳听和波形检查进行复核,必要时还要结合降噪、均衡、剪辑等后期处理。对于需要发布的成片或正式音乐项目,建议保留原始素材并进行人工质量确认。
© 免责声明:鉴于域名具有时效性,指向的网站内容可能发生变更。AIEZZ对呈现的第三方网站不可控,无法承担任何责任。请自行判断内容风险。



用户评价0