输入
注意:
seconds 值会四舍五入到最近的音频帧,并限制在至少 1 帧、最多 MAX_AUDIO_FRAMES 帧的范围内,因此实际潜在长度可能与输入的确切值略有差异。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
77e6a69702a837c958c2954bba061c979152f034bc7774a5b6c97ea8d57bda4bDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
此节点为 MiniMax Music3 模型创建一个空的(零填充)潜在音频张量。
| 参数 | 描述 | 数据类型 | 是否必填 | 范围 |
|---|---|---|---|---|
seconds | 音频潜在的时长(秒)(默认:120.0)。该值将转换为音频帧,并限制在模型支持的时长范围内。 | FLOAT | 是 | 0.04 到模型最大值(MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND),步长 0.04 |
batch_size | 单批次生成的音频潜在数量(默认:1)。 | INT | 是 | 1 到 4096 |
seconds 值会四舍五入到最近的音频帧,并限制在至少 1 帧、最多 MAX_AUDIO_FRAMES 帧的范围内,因此实际潜在长度可能与输入的确切值略有差异。
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
LATENT | 形状为 (batch_size, 128, latent_length) 的零填充音频潜在张量。包含将样本标记为音频数据的元数据,时间下采样率为 512。 | LATENT |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
77e6a69702a837c958c2954bba061c979152f034bc7774a5b6c97ea8d57bda4b