Veda ускоряет расчёты внимания: вместо того чтобы считать связи между всеми участками видео, система с помощью предсказателя выбирает важные и пропускает остальные. Предсказатель весит 275 МБ и не меняет веса модели — это не LoRA. Поэтому Veda можно складывать с PDD и SageAttention.
Автор проверил ускоритель в ComfyUI на A40: сделал 18 роликов MiniMax H3 в трёх сценах, с настройками 20 шагов, PDD 8 и PDD 4. Каждый ролик — вертикальный, 672×1216 и 8 секунд. Один шаг генерации текста в видео ускорился с 35,5 до 19,6 секунды, а генерации по референсному изображению — с 36,9 до 21,3 секунды. Время всего ролика сократилось в 1,4–1,7 раза: например, PDD 8 — с 5,8 до 3,7 минуты.
Особенно интересно сочетание PDD 8 и Veda: ролик занял 219 секунд — почти столько же, сколько PDD 4 без Veda, 205 секунд. При этом стандартный режим PDD 8 сохраняется. По расчётам автора, цена генерации такого ролика на A40 падает примерно с $0,047 до $0,030. Но ускорение не бесплатное по качеству: даже с тем же seed меняются композиция и свет, а мелкие детали вроде клавиш могут прорисовываться хуже.
Для запуска нужен ComfyUI 0.38.0 или новее: узел Veda Sparse Attention (MiniMax H3) ставится после загрузки LoRA, перед Guider или сэмплером. В тесте настройки оставили стандартными. На разрешении автора Veda считал около 17% внимания вместо ожидаемых 10% — параметры обучения предсказателя рассчитаны на другие размеры и длительности. Код узла распространяется по MIT, сам предсказатель — по лицензии MiniMax H3 Community. Думаю, ускоритель стоит проверить на своих сценах: скорость заметная, но с мелочью пока есть вопросы.
Главное
- Veda ускоряет отдельный шаг примерно в 1,7–1,8 раза; целый ролик — в 1,4–1,7 раза.
- Совместим с PDD и SageAttention, потому что не меняет веса модели.
- Проверен на A40: 8-секундные ролики в 672×1216, всего 18 генераций.
- С тем же seed результат может отличаться; мелкие детали иногда теряют чёткость.
- Нужен ComfyUI 0.38.0+ и узел Veda Sparse Attention (MiniMax H3).
Источникnote #動画生成AI

