Нейронавт | Нейросети в творчестве 6837

0:44

Опубликован код ReCamMaster, модели для изменения траектории камеры в видео.
Родную модель t2v использовать нельзя, но они прикрутили Wan2.1

Обещают онлайн сервис, новости ждем на сайте Kling

Код
Воркфлоу
Видеотуториал

#cameracontrol #novelview #video2video #stabilization #workflow #tutorial

2.0K views08:25

2.1K views08:53

Новый драйвер Nvidia 576.02 может сжечь вашу видеокарту

Я просто паникер, поэтому сам не проверял

Новый драйвер Nvidia перестает обновлять данные с датчика температуры и не включает кулер даже при максимальной нагрузке

Безопасные версии драйверов:
для серий 30xx и 40xx - 566.36
для 50xx - 572.83

#news #driver #gpu #лучшеперебздетьчемнедобздеть

2.2K viewsedited 12:13

0:03

0:06

0:06

FramePack LoRa

Экспериментальная попытка прикрутить лору к FramePack. Последний основан на Hunyuan, поэтому попытка не бессмысленная.

Автор обучил лору на китайских боевиках 70-х

Первое видео - оригинальное видео

Второе - попытка воспроизвести резкое панорамирование оригинальным FramePack

Третье - FramePack с лорой

Похоже, что их можно подружить

Форк FramePack с поддержкой лоры
—————————————

Кстати, в FramePack можно разбивать промпт по тайкодам

1) в сборке от Neurogen
2) в FramePack Studio

#prompting #image2video #lora

1.7K views13:29

FLUX.1-dev-ControlNet-Union-Pro-2.0-fp8

Квантизованная версия универсального контролнета для #flux

civitai/workflow

#controlnet #conditioning @text2image #image2image #workflow

2.3K views15:16

1:39

Media is too big

MAGI-1

Новый видеогенератор длинных видео в опенсорсе
Две модели: 24B и 1.5B. Последняя вероятно запустится на RTX 4090

Попробовать можно онлайн, там насыпают кредитов

Попробовать
Веса
Код

#text2video #image2video

1.8K views09:14

1:29

Media is too big

Vidu Q1

Обновка видеогенератора

1080p
Обещают четкую картинку, кинематографичные переходы, звуковые эффекты синхронизированные с видео

При регистрации нового аккаунта с промокодом VIDUQ1
дают 100 приветственных кредитов (мне дали 180 😕).

А за лайк видео в твиттере можно выиграть 600 кредитов и что-то там еще

[update] после трех генераций требует подписку

#text2video #image2video #video2sound #sfx

Please open Telegram to view this post

VIEW IN TELEGRAM

1.8K viewsedited 09:36

VisualCloze: A Universal Image Generation Framework via Visual In-Context Learning

Это Flux Fill обученный на матрицах входных изображений.

Получает на вход матрицу картинок, например 2 ряда, 2 столбца и понимает какую задачу надо выполнить. Задач можно придумать много от переноса стиля до смены времени года и генерации технических карт.

Разрешение входных изображений в матрицах при обучении 384x384 пикселя

Много примеров на гитхабе и в демоспейсе

Очень интересно какое применение вы ему найдете?

Поломал голову пока понял что он делает и как это описать. Теперь не знаю какие теги придумать.
В коментах подсказывают что это близнец In-Context-LoRA

Код
Демо
HF

#referencing #image2image #conditioning #text2image

2.1K viewsedited 11:37

1:11

DIA

Голосовая модель 1.6B параметров от Nari Labs.
Создана командой из 2 человек.
Послушайте как она умеет в эмоции в сравнении с Elevenlabs и Cesame

Есть управление эмоциями и тоном через входное аудио. Модель умеет создавать смех, кашель, прочищение горла и т.д.

Код
Демо
Демо 2
Колаб
Записаться в вейтлист более мощной модели

#tts #text2speech

1.9K views14:11

0:07

0:31