KJNodes/audiogenerated
Sound Reactive(SoundReactive)
此节点通过浏览器获取音频输入,并允许用户设定一个特定的频率范围(赫兹)来聚焦分析。
Sound Reactive
sound_level
sound_level_int
sound_level
1.00
start_range_hz
150
end_range_hz
2000
multiplier
1.00
smoothing_factor
0.50
normalize
KJNodes
Sound Reactive 节点通过浏览器获取音频输入,并允许用户设定一个特定的频率范围(赫兹)来聚焦分析。
此节点是一个音频响应工具,能将实时音频输入的音量水平转换为可供其他节点使用的数值信号。其核心功能是捕捉并处理来自浏览器麦克风的音频数据,生成一个动态变化的浮点数和整数输出,从而将声音的强度变化融入到图像生成工作流中。
节点功能
此节点通过浏览器获取音频输入,并允许用户设定一个特定的频率范围(赫兹)来聚焦分析。它会对原始音频信号应用平滑处理以减少突变,并可选择对输出值进行归一化。最终,节点输出两个值:一个精确的浮点数和一个取整后的整数,两者都代表了处理后的音频强度。
节点参数说明 - Sound Reactive
控制参数 (Parameters)
| 参数名称 | 数据类型 | 必填 | 默认值 | 取值范围/选项 | 说明 |
|---|---|---|---|---|---|
sound_level | FLOAT | 是 | 1.0 | 0.0 - 99999 (步长: 0.01) | sound_level(输入参数):手动设置音量值。当有音频输入时,可通过浏览器麦克风覆盖此值。 |
start_range_hz | INT | 是 | 150 | 0 - 9999 (步长: 1) | start_range_hz(输入参数):设定要分析的音频频率范围的起始值(单位赫兹)。可配置范围从 0 到 9999,步长为 1。 |
end_range_hz | INT | 是 | 2000 | 0 - 9999 (步长: 1) | end_range_hz(输入参数):设定要分析的音频频率范围的结束值(单位赫兹)。可配置范围从 0 到 9999,步长为 1。 |
multiplier | FLOAT | 是 | 1.0 | 0.01 - 99999 (步长: 0.01) | multiplier(输入参数):对处理后的音量值进行整体缩放的比例因子。取值范围从 0.01 到 99999,调整步长为 0.01。 |
smoothing_factor | FLOAT | 是 | 0.5 | 0.0 - 1.0 (步长: 0.01) | smoothing_factor(输入参数):控制音量值变化的平滑程度,避免输出剧烈波动。取值范围在 0.0 到 1.0 之间,步长为 0.01。 |
normalize | BOOLEAN | 是 | False | - | normalize(输入参数):一个布尔开关,当开启时,会将音量值除以 255 进行归一化处理。 |
输出 (Output)
| 参数名称 | 数据类型 | 说明 |
|---|---|---|
| sound_level | FLOAT | sound_level(输出参数):输出经过处理后的最终音量值,为浮点数格式。 |
| sound_level_int | INT | sound_level_int(输出参数):将最终音量值转换为整数后的输出。 |
使用场景
此节点非常适合用于创建与音乐或环境声音实时联动的动态视觉内容。例如,在实时扩散(realtime diffusion)工作流中,可以将节点的输出连接到提示词强度或噪波偏移等参数上,使得已生成的图像能随着音乐的节奏或音量大小而产生视觉上的变化和响应。
注意事项
使用此节点需要授予浏览器麦克风访问权限,并且其效果依赖于音频输入的质量和稳定性。它主要设计用于需要实时音频反馈的自动化或交互式场景,在静态图像批处理生成工作流中可能不是必需。
Sound Reactive 节点源码链接
Sound Reactive 节点来自 ComfyUI-KJNodes 节点包。
评论
使用 GitHub 登录后即可参与讨论。