Нейронавт | Нейросети в творчестве

3:57

Calligrapher: Freestyle Text Image Customization

Генерация и редактирование надписей на изображении.

Умеет брать образец стиля и шрифта с картинки, и туда же вписывать новый текст.

В основе - FLUX.1-Fill-dev

Напомнило инструмент Textify из 2023. Порадуемся прогрессу за это время

Код
HF

#text2font #font #referencing #text2image

1.2K views09:12

3:22

Describe Anything: Detailed Localized Image and Video Captioning (DAM)

Модель от NVIDIA генерирует подробные описания для заданных областей на изображениях и видео

Код
Демо

#captioning #image2text #video2text

1.2K views10:13

Please open Telegram to view this post

VIEW IN TELEGRAM

1.2K viewsedited 11:14

5:41

Media is too big

ThinkSound

Модель от Tongyi Lab (авторов InspireMusic и много чего еще) создаёт реалистичный звук для видео. Архитектура - цепочка рассуждений (#CoT). Необычно для генерилки звука, да? Скоро достижения языковых моделей будут везде, к этому все идет.

Модель сначала генерирует общий звуковой фон, затем улучшает качество звука конкретных объектов на экране и, наконец, редактирует всё это по текстовым указаниям пользователя

Код
Демо

Спасибо @p0lygon

#Video2sfx #foley #sfx #audioediting #video2audio #text2sfx

1.2K viewsedited 13:38

Немного побаиваюсь сообщить вам что теперь вы можете предлагать новости к публикации на этом канале. Да, там можно предлагать оплату звёздами 🌠 но можно и бесплатно.

Я пока не обещаю ничего. Хотя если новость актуальная, по теме канала и со ссылками, я могу захотеть ее опубликовать

#news

Please open Telegram to view this post

VIEW IN TELEGRAM

Please open Telegram to view this post

VIEW IN TELEGRAM

1.0K views14:22

Агент flowith NEO открыли для всех.

Причем в природе существуют некие инвайт-коды, по которым можно получить 3000 кредитов. Но их быстро разбирают. Я повбивал с десяток найденных и все уже протухшие, дальше надоело.

Для входа мне понадобился ВПН

#agent

1.1K views15:23

Агент flowith NEO открыли для всех. Причем в природе существуют некие инвайт-коды, по которым можно получить 3000 кредитов. Но их быстро разбирают. Я повбивал с десяток найденных и все уже протухшие, дальше надоело. Для входа мне понадобился ВПН #agent

[UPDATE 2] еще инвайты от @quatt1

YC53EVB3
PNT4CF20
I39YSNGB
G08UPCOG
H4XCX4RX

Налетай, инвайты для Flowith (одноразовые, кто успел того и тапки). Действуют только для новых аккаунтов.
Благодарности отправляйте @LarisaDi

7ZY424V3
C6HU1XOI
EWF847Q1
RKD5WW9P
7L99LZER

Ну и от меня немножк

S0IQLH34
V2E90VRX
58U1SRMH
JZXHMYCT
CO49YVQX
QVDVRU4A

[update] еще от @BrianMItro

NO2DOG8T
CNT0R7Y2
LO35QRSF
LS94R37H
AOL73YNE
S2S8HUA5
U2FH6SQ5

#giveaway #agent

994 viewsedited 16:14

Kwai Keye-VL

Модель хорошо понимает короткие видео. Keye-VL имеет 8 миллиардов параметров и умеет обрабатывать информацию из видео и текста

Код
Демо
Веса

#vlm #video2text

656 views06:01

0:31

Higgsfield Soul Inpaint

Хиггсфилд жжет. Прикрутили к картинкогенератору Soul инпейнт

#inpainting

604 viewsedited 06:40

0:38

Depth Anything At Any Condition (DepthAnything-AC)

Генератор глубины изображения. Работает в различных условиях, включая изменения освещения, снег-дождь. Успешно справляется когда есть искажения, вызванные сенсорами.

Представляет собой зафантюненный DepthAnything-V2

Код
Демо
Веса

#video2depth #depth #image2depth

528 views07:10

2:01

FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model

Морфинг (плавное перетекание) одного заданного кадра в другой за 30 секунд. Полагаю, можно использовать как интерполятор кадров

В 10X ~ 50X быстрее существующих методов, #SOTA в морфинге

Код

#frameinterpolation #morphing

441 viewsedited 07:41

0:42