Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.034 — 2026-08-07
NEWS 约 1 分钟

音效生成塞进8GB显存

Scenema Audio接入ComfyUI并量化至8GB显存,让表演式配音更容易在消费级显卡上本地运行。

IMAGE — r/LocalLLaMA 日榜

给短片配音时,你可以直接写“愤怒”“悲伤”,或在台词中插入“[轻声发笑]”“[声音哽咽]”,让 AI 在指定位置演出来。Scenema Audio 现在被做成了 ComfyUI 原生自定义节点——ComfyUI 是一套用连线节点编排生成式 AI 流程的图形工具。这意味着创作者能把表演式语音生成接进已有的本地制作流程;还可提供一小段参考录音,用 zero-shot voice cloning(零样本声音克隆)保持指定音色。

这次最实用的变化是量化:用较低精度保存模型参数,以减少 VRAM(显卡存放模型和计算结果的高速内存)占用。作者称,原先的全精度版本太重,如今最低可在 8GB 显存上运行,并已在 RTX 3070 和 RTX 4090 上完成端到端测试,生成速度最高可达实时的两倍。代价并未消失:首次仍要下载约 30GB 权重;部分随机种子会产生重复或乱码,因此它更适合“多生成几次、挑最好的一条、再剪辑”的后期流程。量化是否带来音质损失,供稿没有披露独立对比结果。


供稿材料 SOURCES — 1

← 返回 2026-08-07 · 开源板块