Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3
2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1705031 → В смысле объем видеопамяти не должен ограничивать скорость?
У меня на моей машине (5070ти) по сути 2 режима: либо генерируется быстро; либо всё зависает нахуй на 0% и будет генерировать час или дольше то что должно сгенерироваться за 10-15 мин. Это как я понял и есть шаред мемори.
>>1705099 Ну значит просто говнокод такой, что не может в нужный момент пригнать веса в буфер vram из ram. Сколько времени у тебя отрабатывает одна итерация? Если ты гоняешь пожатую модель нормально, то фулл фп16 веса с оффлоадом в рам должны работать с такой же скоростью. У тебя по pcie5 500 гигов нахуй за 10 секунд можно успеть прокачать. Модель работает буквально раз в 100 медленнее скорости шины, я же говорю, это не ллм. С ллм если хочешь 10 жалких токенов в секунду, ты должен прогружать модель 10 раз в секунду. А диффузия прогружается раз в минуту, можно даже с ссд успевать грузить модель, наверное.
>>1705099 Если зависает на нуле и держится так минутами, то да, она родимая шаред мемори. Контекст туда вытек. Уменьшаешь разрешение или длительность, пока не поймаешь тот момент, когда она резко начнет быстрее шевелиться. Может по 30 секунд на степ, хотя бы, но не по 5-10 минут. Это момент ловится.
>>1704900 → Постоянно такая же хрень. Постоянно пытается порвать на два разных шота. Турболоры и высокие разрешения усиливают эффект. Если пропустить в промпте что-то, что противоречит кадрами или логике движений, точно порвет на два шота, или вообще вставит в середину третий.
Частично помогает в промпте прописать изменения от первого кадра ко второму, тогда каждый второй-третий ролл удачные будут. И предпросмотр киджаевский спасает.
Для оживления готовой картинки - FL. Можно подсунуть звук (закодировать в латент и заморозить), тогда движения и диалоги будут под звук подстраиваться.
А REF - полноценное редактирование. Возьми бабу с первой фотки, мужика со второй, позу из видео, голоса из аудио, наряди клоунами, и всех в сад.
>>1705208 Да я уже пороллил еще на и2в, там даже без подключенного первого фрейма нихуя не работает, просто последняя секунда фризфрейм, который медленно доводит видео до last_frame - судя по всему из-за несовпадения промпта и содержимого, хоть ллм прикручивай для описания последнего кадра, только один хуй надо еще как-то предыдущие таймстепы подгонять, под последний кадр. Какого хуя vl_32b само не может всё это сделать под капотом? >>1705212 > Для оживления готовой картинки - FL Ну это я из названия темплейта примерно и так понял. Проблема в том, что нихуя не понятно, как с last_frame его крутить, не зря же его добавили в ноду. Но в идеале вообще не last_frame, а где-то посередине кейфрейм вставить, но с REF хуйня получилась - я сдался на полпути, а скорее где-то 12.5% пути, когда промпт писал.
>>1705227 >последняя секунда фризфрейм Фризится обычно последний блок из 5 кадров. В начале тоже разгон есть, но не такой похабный. И описывать надо не кадр, а изменения. Освещение там поменялось, или кожа потемнела, или руку кто кому куда засунул. Вот если есть прямо набор фоток с фотосессии - там заметно меньше психует, видит, собака, что кадры похожие.
Вроде как помогает последний кадр не прямо последним ставить, а за блок-другой до конца. То есть картинку не в MiniMax H3 Image to Video подключать как last_frame, а после него через узел Add Guide for MiniMax H3, с индексом -5, -22, -39, ...
Заодно при такой вставке кадра можно продолжить видео с плавным движением, если кусок предыдущего латента (от вставленного кадра до конца) вставить в следующий через Replace Video Latent Frames и заморозить маской. Тогда первый кадр следующего видео ровно ложится на последний из предыдущего с учетом нахлеста 5,22,39... И получается полноценное длинное видео, через все ключевые кадры, без потери качества.
В REF кадры можно словами прописать, "шот начинается с <Picture 1>" и т.п., так тоже работает, но задалбывает, конечно. И через Guide тоже, но движения рваные выходят, не одолел пока. Зато REF голоса продолжает одинаковыми, а не случайными в каждом обрезке, как FL. Можно голоса в REF генерить, а в FL потом использовать.
>>1705251 > а после него через узел Add Guide for MiniMax А че так можно было? Охуеть, сработало. Спасибо за наводку. Подключил к и2в кондишену на -2.5 сек и оно встроило куда надо на FL модели, но сначала smile у Гослинга убрал из начала промпта, потому что у минимакса smile до ушей, как у джокера нахуй, и он под креевский cunning smile не успевает подстроиться до кейфрейма. Осталось с остальным промптом разобраться, чтобы понятно было, что он полностью высунул и переключился.
>>1705115 >А диффузия прогружается раз в минуту В какую минуту? Она ебашит как с пулемёта эти слои, если они в vram если у тебя конечно не какой то говночип уровня 3060. Каждый шаг это полная послойная прогрузка модели. Замедление происходит как раз в выгрузке/загрузке слоёв из ram в vram. И если на контекст мало места осталось в vram то модель тратит дохуя времени дроча каждый слой последовательно, а если памяти совсем не осталось на загрузку слоя в vram то как раз наступает шаред мемори где каждый слой будет обрабатываться по ахулиону лет с файла подкачки.
Надо ли вообще заморачиваться над созданием реф картинок с персонажем/объектом со всех сторон для минимакса? В половине роликов на ютубе одна пикча, в другой половине рефка с 5-10 ракурсов.
>>1705261 > шаред мемори где каждый слой будет обрабатываться по ахулиону лет с файла подкачки Уточню: в шаред мемори часть самого контекста лежит в оперативе, поэтому проблема не в том, что слои диффузиции летают по PCIe шине, а что еще и САМ КОНТЕКСТ грузится по той же шине, что и убивает производительность в нулину. Можно почекать загрузку гпу в такие моменты, там потребляют как правило ватт 40-60 чипы, ибо средняя по больнице получается с постоянной загрузкой. Но факт, ахулион лет.
Причем даже две видяхи ты памятью не сложишь, чтобы генерить видео в лучшем разрешении — один хуй по псине гоняться будет все, да и модель не влезет. Разве что складывать какие-нибудь 5090 из 32 гигов в 64, да на нормальной матери, и писать на питончике свой скрипт, тогда может и будет заебись. Но не нам, бомжам с 12-16 гигами.
Пидорасы ебаные, вам дали такой инструмент, и до сих пор за 4 месяца ни одного видоса ебли в треде превосходящего ван, ничего креативного, вообще нихуя. И реддит такой же один ебаный слоп с махающими мечами и бегущими пердежами
>>1705862 На тестах видно, что сам латент шакалит детали в несколько пикселей размером. Так что ухи/носы/глазы должны быть больше тестового шакала. Фотки в рост на FL придется делать в 2K, а не 0.8. Максимыч такое тянет. Главное, чтобы железяка вытянула.
>модель не говно песочное, просто нужно генерить в 32к >или у вас скилл ишью? Вот бы взять моушен с H3, ускорить его до 1 шага, а low noise генерить на нормальной модели и назвать это flux 3 open source
>>1705860 С одной стороны да, как будто VAE у макса по таким тестам говно. С другой, он же там темпоральный, я не уверен, что тесты на одной пикче валидны.
Повторная генерация на низких денойзах заметно хуже по качеству, чем сразу полный размер.
Еще через контролнет имени алибабаевича пробовал, он тоже качество говнит. На низкой силе еще ничего, но там исходные движения уже теряются.
Остается мечтать, что китайские братушки выкатят обещаный апскейлер, и вот там прям ваще абасраться какое качество будет. Но это если он реально ресемплить будет на тех же исходниках, по типу вана-лоу-нойза, а не просто апскейлить.
>>1705890 Вот между прочим лоунойзный ван умеет в апскейл. Он на быстрых движениях в кашу рассыпается, но на видео из H3 смотрит как на слоумо, и вполне приличные результаты получаются. Из 0.4 в 1.0 он точно сможет. Проблема в том, что выше 1K он не тянул. Но замедленные видео я не тестировал в нем, надо проверить. Возможно, и 2K потянет.
>>1705984 > увеличь до 1-2 Да че-то и на 2МП как-то проебывается сходство. Похоже нужно действительно на ref ебашить и кидать ебла крупным планом и может с разных сторон, а не как на first_frame - мелкие сбоку, хоть и 4К. После 2-го шага похоже включился Sparse Attention и начал срать по триста ООМ за шаг, зато время сократилось с 380s/it до 135s/it. Заодно flash этот >>1705459 проверил. Но сравнения с обычным + турба лора на том же разрешении нет естественно.
>>1706062 Да хули там. Проснулся, нажал Run, когда к компу вернулся, оно уже готово было. Но вообще да, нахуй нужно ждать по полчаса, картинки приятнее делать.
>>1706417 И куда её пихать? Почему красноглазые дегенераты не в состоянии прикреплять воркфлоу к своей красноглазой хуйне? В тех видео что там есть нету этой лоры.
>>1706469 Пошла нахуй, хуйня красноглазая, если просто заменить 4 степ на 3 степ, нихуя не меняется, 0 разницы нахуй, это значит там нужна макаронная аппликация из последовательности нод с неочевидными шизоидными названиями, которая существует только в шизоидной голове красноглазой хуйни.
>>1705063 (OP) 1. Чел не разобрался с аспект ратио, рукалицо. Просто мусор или нарочито всратый пост для паблика с абстрактными мемами (но учитывая местный подпивасный контингент, который дрочит на советские поделия (ссср пал, офицер), шанс на второе минимален) 2. ОП слепой и глухой, брать в шапку видео, которое, судя по всратости, генерилось с четырмя аттеншенами и двумя кешами и быстрее, чем декодировалось вае - это надо обладать знатным чсв. 3. Звук, очень всратый звук. Какой смысл делать такое длинное видео и не позаботиться о нормальном голосе? Можно было просто пердеж наложить, и то приятнее 4. Аналогично. Блевать тянет от дефолтных голосов.
Так, я вернулся, это я тот шиз, у которого motion director зависал на втором сегменте. Вместе с гемини мы выяснили, что дело в engine у H3 SLA Attention, и если этот engine сменить на triton вместо comfy_kitchen, то зависать перестало. Ради интереса кто-то может предположить, почему так? Комфи китчен у меня обновлен.
Прикрепляю видос на 1мп, ну и хуйня получилась по консистентности хуже чем на 0.5 лол.
>>1706578 >Потрясающе, тебе нужно анкету в голливуде заполнить, лучший ген этого треда. Смысл поста, если я сам изначально написал, что получилась лютая хуита? Лучше б по конкретике чего сказал. Пока что я заметил, что при подразбиении на чанки практически гарантированно появляется всратый кал типа телепортов персонажа, разворотов конечностей и тд.
>>1706591 Мне понравилась твоя потрясающая ментальная гибкость, когда ты оказался в считай безвыходной ситуации, только на одной смекалке смог выбраться из казалось бы патового положения. Моё почтение, анонче, ты настоящий герой нашего времени.
>>1706417 А что тут обсуждать? Обсуждали же целый тред. Хуже, чем dmd, но зато 3 степа настоящие, уважаемо. taomate => dmd => cache какой-нибудь на много шагов. Дольше лучше, без магии. Зато если хочется ну пиздец быстро, бери ее.
Все пять режимов (вдруг есть ценители), темпу ZCode прикрутил, я хуй забил, галочка ризонинга по умолчанию выключена (!), но включается, пикчи в реф-режиме работают в гемме 12б с тимплейтом анслота. Ну, короче, я себе хотел, я себе сделал. Че прятать-то. Все правки принимаются, ну если вдруг кому-то не похуй, лол.
>>1706608 Думаю тут уже каждый под себя аналог навайбкодил. Хоспаде как же охуенны нейронки в этом плане.
Помню как чтобы нужные проги найти нужно было весь базар обойти в поисках cd диска "100 самых нужных программ..." или к соседу в обмен на что - то обменять...
А сейчас - написал нейронке 2 предложения и получай готовую программу через 10 минут.
Нахуя вы васяните приложения, а не ноду или банальный воркфлоу для такой банальной задачи, которая сработает с clip и будет адекватно оффлоадиться нативными средствами?
> Ни одного писика в треде, дрочат на одни хуи. Ну что, писик до сих пор так ни у кого и не получился? LTX и Wan все-таки пока еще лучше для прона? Лор вменяемых тоже не видно.
>>1706685 А как с нодой работать? Вот нейронка насрала слопа, тебе надо за ней подтереть жопу, а нода кинет этот кал дальше в генерацию без проверки.
>>1706417 Ну, оно работает, иногда даже хорошо выглядит на 8 шагах. Есть хорошая лора на 4 шага, чтобы с ней сравнивать? Поискал, не нашёл вообще никакую, только на ref2v
>>1706655 Ну вот, тем более хорош. Выкладывай такое тоже. Все же, написать в гугл и скачать готовое быстрее 10 минут. =) А мы стали такими ленивыми… я к этому шел неделю, наверное, все ленился.
>>1706685 Именно поэтому. Приложение чистенькое гладенькое, а нода васянская, кривая, косая, память жрет, генерит как черепахи и миллион проблем, еще выгружать-загружать, еще отдельное воркфлоу, еще… тонна проблем из нихуя, короче. Все по мелочи, но в сумме будут бесить.
>>1706417 Справедливости ради, она весит меньше (Киджай умеет сжимать) при вполне сопоставимом качестве, кмк, с полноценными на полтора гига. Это плюсик, заменить старые таомейт.
>>1706721 >писик Пока имеем недопорносингулярный мохнатый кокос или членодевку без члена. Где же тот самый робин гуд, который дообучит это недорозумение?
>>1706721 >>1706741 Так щёлкаешь по ноде run, правишь что надо (что уже сомнительное желание, что ты там читать и править собрался, быстрей сгенерить и исправить), пускаешь дальше генерацию. Без копипастов, нескольких окон и забитого врам. Одна нода между клипом и промптом. Ну либо как я сказал, сделать сабграф с систем промптами и ifelse вместо ноды.
Алсо, какой нахуй писик. Качаешь первую лору и идеально генерит даже чересчур идеально, порой 0.2 веса хватает. >>1706775 Что ты несёшь бля... цивит/2853405 инни идеально работает, с i2v, с t2v, даже если завести камеру сзади А вот XXX v4 реально в песок всё превращает. V2 вроде норм, V3 не качал, и без них не сравнивал. Гоняю только на турбо. Eros тоже не оценил, раньше пробовал с уебанскими турбо, из-за которых сначала поставил крест на H3, надо на dmd погонять.
>>1706721 >LTX и Wan все-таки пока еще лучше для прона Кстати, есть что-то с чем H3 не справится? Пизда в миллион раз лучше прошлых сеток, минет делает хорошо, ебёт достойно, только камшоты у меня получались хуже чем на ван2.1. Не удаляю ван только из-за безупречных масов в VACE. Или через H3 тоже можно удалять вотермарки и делать другие точечные эдиты по маске, без швов, с полным сохранением качества?
В первом же тесте сразу распознал нашего дружищу минимашку по этим некозистым, нелогичным, рандомным передвижениям и маханиями разными частями тела. А вот тест с лавой немного удивил.
>>1706799 > быстрей сгенерить и исправить У тебя там 5090 что ли? Генерация занимает минут 20. > Качаешь первую лору и идеально генерит Генерит говно. > инни Пизда так не выглядит.
>>1706801 С пиздой не справится, звуки секса хуйня, мастурбация девичья хуйня. Анимешное не рисует.
>>1706815 >Пизда так не выглядит. Соболезную. Реально жалко тебя, по сути неликвидной инвалидкой родилась. Может если подрежешь раковые наросты между ног, то хоть чуточку на пизду здоровой женщины начнет походить. >Генерация занимает минут 20 До минуты на лоурезе на нищегпу, все действия уже видны, можно понять подходит промпт или нет. >>1706815 >звуки секса хуйня, мастурбация девичья хуйня А где не хуйня? Стоны хорошие, с жеванием огурцов есть траблы. Ну вот кстати, да, минет на MMAudio может быть лучше, но я больше про LTX/Wan vs H3. На дрочку есть лора, не чекал. >>1706825 Помню даже на 0.5 песочило. Потом ставил V2, чинилось и генерация выглядела интересней, с промптом справлялось. Я так понимаю Mystic ориентируется не на турбо, потому что примеры автора на V4 выглядят охуенно, сильно лучше прошлых версий.
>>1706827 > если подрежешь раковые наросты Клитор тоже подрезать надо? > можно понять подходит промпт или нет Предпочитаю все же прочитать то, ради чего видеокарту грею. > А где не хуйня? Вопрос был с чем плохо справляется, а не где лучше. Да, имею в виду жевание огурцов. Еще голос иногда роботизированный, если говорить про тембр.
>>1706833 Хуя он сумасшедший. Ну попробую, так низко не ставил значения. >>1706831 >Еще голос иногда роботизированный, если говорить про тембр Вот кстати, у меня на одном фото получился гиперреалистик звук за счёт того, что камера приближалась и говорящий на время смотрел в пол, вышло пиздецки объёмно. На других пытался это запромптить специально, в основном голос "диктора" получался, никакой динамики, никаких натуральных артефактов. В целом голос в H3 на удивление хорош. Чуть ли не лучший элемент модели. >>1706807 Тоже глянул, не сложно было всё угадать только на стекле засомневался, так всрато разбилось, как будто H3, но потом слишком реалистик движение началось, H3 пиздец песочная хуйня, как будто они тоже на турбо генерили. А ван пережаренный слоп. Ну, хорошо что H3 хотя бы опенсорс. Вообще круто, что промпты хотя бы немного похожи на лучшие видеосетки. Чего LTX 2.5 не сравнили, он настолько хуевый что ли.
>>1706801 >есть что-то с чем H3 не справится? Да, не справляется с: - демонстрацией проникновения хуя в пизду/жопу. - i2v когда хуй уже в пизде, они срастаются, либо хуй отделяется от пизды, а на его месте черная дыра. - камшоты в рот или на лицо максимально уебанские. - как уже говорили с генерацией пизды не справляется, 1 из 5 генераций только проходит нормально (нормально это так чтобы не блевануть от штопаной пизды или вялого щавеля) и то это с реф + лора. - генерацией хуя заёбы не меньше чем с пиздой, если вдруг надо под несколькими ракурсами его показать, даже если в реф кидаешь хуй во всех проекциях.
Это уже 12 тред по минимаксу и ни одного ролика с хардкор еблей или приемлемым камшотом. В то время как треды эпохи вана состояли из ебли и камшотов чуть более чем полностью.
>>1706906 Если ты готов жрать кал со штопанными пёздами и елозящими хуями вокруг них, это не значит что у тебя руки прямые, это значит что ты говноед или слепой просто.
А то что за 12 тредов ни одного нормального видео по сабжу - прямое доказательство моим словам.
>>1706827 > До минуты на лоурезе на нищегпу А исправить и скопировать промпт — секунд 5-10. Заметно быстрее, о том и речь.
>>1706864 Я не юзал промпт-райтер тот, в моем зашиты официальные промпты от самого минимакса. Разведены по типам и добавлена инъекция в реф, на которую она сама ссылается. Там огромный комбайн на питоне и жиэсе, у меня 1-страничный HTML-файл. Качаешь, открываешь в браузере двойным кликом, все. Возможно их промпт райтер генерит лучше, если у них промпты кастомные. Но в треде не пришли к выводу, что лучше, официальные доки или кастомный промпт втрое больше. Скорее всего тоже самое будет, хз. =)
>>1706050 >Да че-то и на 2МП как-то проебывается сходство А последний кадр задан? Тройной апскейл из микроебала не сильно простая задача. Вот с честным FL.
>>1706954 >А исправить и скопировать промпт — секунд 5-10. Кому ты пиздишь, только прочесть здоровый H3 промпт - больше минуты. Что-то исправить - вообще заебешься править все упоминания, проще переписать свой запрос и посмотреть что выдаст опять. Потом это говно ещё копипастить, выключать программу, чтобы освободить врам, ждать пока в комфи подгрузятся модели и всё равно получить хуйню, потому что нужен был новый промпт, а не перефразировка пары слов.
Если честно T/I2V промчу обычными предложениями, не заметил минусов. Лютый промптинг вроде только на ref модели нужен. Она пиздец медленная, не трогаю лишний раз.
>>1706935 Это наверняка не H3. Ну что-то близкое наверное можно сделать. >>1706861 >12 тред по минимаксу и ни одного ролика с хардкор еблей Нихуя себе, реально? Я просто не нашёл до сих пор время глянуть что в ранних тредах постили, они так быстро улетали в лимит. Как будто даже в ранних постили что-то БЕЗ ЛОР даже. Проникновение может и с траблами, но повторю, пизда просто идеальная чуть ли не каждый раз, без рефов и без кадра с пиздой.
>>1706417 Бля, а неплохо. Я прям юзаю и не сказать, что сильно недоволен, как бы вся та же хуйня от H3 вылезает, которая и на 8 шагах могла вылезти. Для кума - вообще за глаза, особенно что-то на 3-5 секунд, с одним действием, чисто оживить картинку. Для чего-то качественного H3 в принципе негоден.
Бтв, понравилось юзать Add Guide, пиздец спасибо тому, кто упомянул его, я думал это модель говна без функций. Кидаю видео, аудио, кадры, вытаскиваю images from batch - вручную это всё пиздец муторно. Есть нода, куда можно как в видеоредакторе на таймлайн кидать файлы и тримить длительность так же удобно, а оно само это в Add Guide кидает? Или надо вайбкодить?
>>1707184 Как же ты сука заебал дразнить видосами из топовых сеток. Причём уже по второму кругу всю эту хуйню кидаешь. >Локальной генерации ИИ-видео №19 /video/ >ЛОКАЛЬНОЙ Мало того, что спизженное, так для корпов есть отдельный тред.
Ryanchen911 / Kimi-K3-Uncensored-GGUF ?? Его? А что за jb? Вообще языковая модель сейчас есть топовая? Gemma 4 очень мало текста делает qwen вроде дохуя, но сцены будто не живые, даже gemma делает сцены будто ирл
>>1707297 Съеби нахуй плиз, заебал уже с этим троллингом тупостью. Долбоеб ебучий, ты хоть раз в Minimax H3 сгенерь или ХОТЯ БЫ посмотри то видео выше, где сравнивают говномакс хуиту3 с нормальными сетками. К тому же minimax много лет был закрытой сеткой, их hailuo ai одно время был лучшим, может закрытая сетка у них получше, но к локалу она не имеет отношения. >>1707233 Вот тут сразу видно, что вполне мог бы быть H3 с интерполяцией кадров.
>>1707238 Ну ты границы обозначь. Я пробовал Qwen3.8-Flash-Next, работает охуенно, но генерит промпт 5 минут локально. =D Как будто рот таво ибал временами. Дипсики как будто похуже на удивление. Гемма 4, да. Квен 3.8 27б я не распробовал.
>>1707254 > А что за jb? jailbreak, промпт-взлом, типа, чтобы без цензуры отвечала и мозги не ебала.
>>1707199 >заебал дразнить видосами из топовых сеток У вас целый тред, блять, аллигархов-дразнителей дорогими пекарнями, позволяющими генерить локально, пока нищуки вроде меня вынуждены платить по доллару за секунду видео, из-за этого все глубже утопая в бездне нищеты. Страдай.
>>1707346 А хули ты плюёшься? Закинул минимаксовый гайд в ллм и сказал написать рандомную хуиту. Вот такую срань по типу пикрила легко что ли быстро усвоить, да ещё и отредачить всё, что нужно? А бекенд ллм у тебя на святом духе работает? Или ты видео на тредриппере собрался генерить, пока ллм продолжает висеть на фоне? Отгенерить заняло 20 секунд, от фулл генерации принципиально не отличается сюжетом. >>1707353 Так как раз для корпо-богачей с качественными видео отдельный тред. >>1707369 Ты про те видео, где каждую секунду поезд переходил в новое измерение и детали на дистанции превращались в пиксельарт? Да, хорошо он приложил дебилов с нулевой насмотренностью, не способных отличить локал и онлайн. На видео сравнениях хорошо видно как H3 пытается делать похоже на закрытые сетки, и ожидаемо не справляется. Я не знаю хули у тебя сраку разрывает от реальности. Среди локалок он хорош, но вы сами зачем-то его пытаетесь сравнивать с отдроченными тикток видео из лучших сеток. >в грок тред А, понятно, откуда ты такое набежало. Ну, присаживайся, изучай как выглядят результаты из разных сеток, чтобы не гореть как еблан больше от фактов. >>1707367 >>Если честно T/I2V промчу обычными предложениями, не заметил минусов. >>для чего-то качественного H3 в принципе негоден. >Съебал бы ты нахуй отсюда. Жду твоих годных результатов, где детальный промптинг генерит заметно лучше обычных 4 предложений с одним простым действием на несколько секунд. Только пиздеть горазд, чтобы оправдать свой пердолинг с ллм. Я пробовал и так, и так - H3 не переборешь, выдаёт что может.
Вы нахуй определитесь, то ли у вас H3 ни пизду сгенерить не может, хуи склеиваются, звука нет, то ли он у вас генерит ебейшую годноту по дюжине референсов, идеально без артефактов.
>>1707367 >Те у кого руки прямые ими и не пользуются. За все трэды "прямыми руками" пользуются только что бы написать об этом. Полагаю руки такие прямые что даже до кнопки Run не дотягиваются.
>>1707385 По тому что баг такой, вытащи его из сабграфа и заработает.
>>1707382 >Gemma должна нормально генерить, её для рп используют 4 пока последняя? Почему она мало текста промта делает в отличии от qwen? qwen целую статью нахуй пишет как будто. Есть какаие модели качественнее gemma 4? >>1707352 >jailbreak, промпт-взлом, типа, чтобы без цензуры отвечала и мозги не ебала. Есть ссылка на модель? Кинь анончик
>>1707400 потому что в квен 3.8 рассуждения на максимум выкручены по дефолту. Проси гемму более подробно и художественно писать, если считаешь, что не хватает текста
>>1707145 >Потом это говно ещё копипастить, выключать программу, чтобы освободить врам Можно подрубить ноду Prompt Enhancer прям в воркфлоу, он генерит тебе простыню через твою локальную модель прямо в комфи, без заёбов с подключением llama и прочей поебени. После генерации выгружается освобождая память. Вот от сюда ворк можешь взять.
>>1707397 Платят так или иначе все, просто есть локал-аллигархи, которые могут себе позволить единовременно отвалить крупную сумму за мощную пекарню, а есть корпо-нищуки, для которых такая покупка за пределами финансовых возможностей.
>>1707406 Прости, его реально смыло, даже какого-то общего AI треда не могу найти. Но у треда не просто так появилась подпись "локальной генерации", раньше он был объединённый. >>1707409 Я про это и говорю, а они говорят через выделенное приложение удобней. >>1707404 Спасибо, проебался. Гуглил, нашёл только такой, не вчитывался в содержание.
Аиноны, это у меня руки из жопы или у всех так, даже ГПТ не помогает, я ПРОСТО хочу переодеть персонажа на одной пикчи в одежду с другой пикчи, есть нормальный стабильный промпт для минишмакса? Сейчас это работает 1 из 10 раз, постоянно путает персонажей, накладывает их друг на друга и т.п., ещё сильно зависит от исходных пикч.
Еще раз, внимательно читай: jailbreak это ПРОМПТ (PROMPT, ИНСТРУКЦИЯ), который «взламывает» модель, чтобы было меньше цензуры в ответе.
Надеюсь теперь понятно? Это не модель. Вся суть в том, чтобы модель, которую ты НЕ можешь изменить, заставить генерировать всякие непотребства. Я предполагаю, что >>1707249 использует обычный чат (типа https://www.kimi.com/ у них прям, я хз), или какое-нибудь API, куда подпихивает свою jb-инструкцию.
А вот инструкций я таких уж давно не знаю, извини. Корпоративные модели я не юзаю для нсфв, локальные просто качаю abliterated/heretic/uncensored, там jb не нужен.
А через H3 можно сгенерировать только звук без перегенерации видео, озвучить постороннее видео? Пытался присобачить, но как будто семплер только единый латент делает. Прогон на лоурезе меняет аудио, это не выход.
>>1707415 Это все понятно, хотя видеокарта по крайней мере используется сразу для нескольких разных задач, и вот за нее деньги отвалить не так в падлу, тем более она только дорожает со временем. А вот отваливать деньги ни за что, это уже как-то не хочется прям, потому и стало интересно, ради чего ты готов был платить буквально за воздух. Какой-то крутой проект или идея?
>>1707520 Нахуя? Есть специально заточенные нейронки под толькозвук. И они толькозвук делают куда качественнее чем H3. Звук в H3 - это просто небольшой бонус, чтобы хоть огурчиков послушать во время важного дела.
>>1707613 А можешь еще и названия вкинуть? Хочется попробовать те самые божественные модельки, которые классно генерят толькозвук.
> Звук в H3 - это просто небольшой бонус Да? Тогда расскажи, а как ты добиваешься синхронизации видеоряда и звука? Модели для толькозвука принимают на вход видеореференс и генерят звук идеально под видео?
>>1707613 Мне показалось, что H3 трахнуло всех по звуку, да так что даже некоторые ттс прихуели. Кинь какие генерят хорошо, раз H3 не может генерить только звук.
>>1707612 >выебать анатомически правильную пизду анатомически правильным членом, используя только слово. Починил члены в промпте на вторую неделю минимакса, как и пезды (но на них лучше реф, конечно).
После последнего апдейта ComfyUI перестали работать стандартные ноды для минимакса, слетает и на Image to Video и на Reference to Video, ещё до сэмплера, переставил уже заново и драйвер нвидии и питорч и тритон, один хер не пашет, гугле какую то хуету советует а не решения. Утром работало до апдейта, дёрнуло блять меня обновиться.. Хз куда копать, обновления комфи настроены на stable сборку, не хотелось бы экспериментировать накатывать до nightly, как починить то что прекрасно работало? И что они там нахуевертили для минимакса что он перестал пахать?
>>1707734 С ластами и у Вани лажа была. Там VACE работал.
Есть два уже готовых видео. Одно заканчивается на ключевой кадр, второе с него начинается. Склейку видно. Берем несколько последних кадров из первого видео (минус место на склейку), добавляем несколько пустых, добавляем несколько первых кадров из последнего (минус место на склейку). Делаем маску на шум - первые кадры морозим, середину оставляем, конец морозим. Запускаем Васю, получаем гладкую склейку: первые и последние кадры остались как есть, середина гладко состыковала концы.
Максимка, смотрю, под Васю косить умеет.
Есть два видео. Нужно создать переход. Берем пустой латент перехода. Берем несколько последних кадров из первого латента, вставляем в начало латента перехода (нода Replace Video Latent Frames). Берем несколько первых кадров из последнего латента, вставляем в конец. Делаем маску - черную для концов, белую для середины, накладываем на латент . Подаем в семплер, получаем гладкую склейку.
Осторожно, кадры в латенте - это не кадры видео, они 2+5k вместо 5+17k. Маски морозят кадры латента, так что стыковать можно только 5+17k кадров видео. Маску можно делать 1x1, тут 4x4 чтобы в просмотре было видно. И турболоры портят стык - дрыгают, цвет меняют, и т.п., надо подбирать параметры.
Но минимаксу как будто вообще похуй, он делает как ему вздумается, в 1 из 10 случаев он немного последует рефам, а в остальных лепит как попало. Есть какие лайфхаки как заставить его больше внимания обращать на рефы?
>>1707776 >Он с ними нативно хорошо работает Продолжает видео точно хорошо, по сплошной маске. На этом, видимо, все директора и построены.
Склейку vace-like делать вроде может. Но постоянно пытается порвать видео на два шота вместо гладкого перехода. Или микрофризы по всему видео лепит. Причину пока не понял - лоры, длина, промпт, маску ослабить или что еще.
А до инпаинта пока не добрался. Если можеть - ваще круть будет.
Пацаны, как сделать сиськи нормальные в минимаксе, а то вот такое непонятное нечто генерирует? Если какая-то лора нужна, то ткните носом в ссылку. И на писик тоже было бы неплохо.