В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!
Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.
Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.
>>Тест на логику: У тебя (перевозчика) на берегу реки есть лодка, гоблин, принцесса и паж. В лодку помещается только кто-то один (гоблин, принцесса, паж), и сами они грести не будут. 1) Если оставить без присмотра на одном берегу гоблина и принцессу облин изнасилует принцессу. 2) Если оставить на берегу принцессу и пажа - принцесса соблазнит пажа. З) Если оставить берегу пажа и гоблина паж убьет гоблина. Как перевезти их вcех на другой берег так, чтобы все остались живы?
Скачал снова гемму 31 и посвайпал в жирных чатиках с трезвой головой, хочу сказать, что она не очень то и лучше других во внимании к деталям, в куме так же всё путается как и на других моделях, раньше считал, что хоть в этом она хорошо справляется. В целом не вижу смысл держать её на компе вообще если можешь запустить мое 100+б, в остальном она так же пососала.
Новости об искусственном интеллекте №80 /news/
Аноним# OP15/09/26 Втр 13:12:15№1704670Ответ
Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.
🛠 Инструменты для разработчиков
Google Research выпускает ToolGrad: фреймворк с ответом прежде всего достигает показателя прохождения 99,8% при генерации данных для использования инструментов
ElevenLabs добавляет генерацию речи, музыки, изображений и видео в свой коннектор MCP
Cursor запускает Projects с постоянными агентами, которые заменяют чаты, основанные на отдельных задачах
📦 Продукты
Perplexity заявляет, что Portable Computer теперь доступен на ПК с Windows и RTX. Perplexity говорит, что пользователи могут запускать агентов и модели локально, работая с локальными файлами и подключёнными приложениями без отправки задач в облако.
Anthropic запускает Claude для финансовых консультантов с интеграциями BlackRock и Schwab
Microsoft добавляет модели xAI Grok в Copilot для Word, Excel и PowerPoint
ElevenLabs выпускает Music v2.5 с доступом через приложение и API
Google выпускает Lyria 3.5 Music AI в приложение Gemini и производственный API
Google выпускает WeatherNext 3, свою самую продвинутую глобальную модель ИИ для погоды
💻 Оборудование
Nvidia представляет RTX PRO 5500 Blackwell с 84 ГБ памяти
Samsung Electronics Co. и Taiwan Semiconductor Manufacturing Co. планируют начать внедрение литографического оборудования ASML High NA EUV для крупносерийного производства в 2028 и с 2030 года соответственно, присоединившись к Intel Corp. в использовании машин стоимостью до $400 млн каждая.
🔓 Открытый исходный код
Cohere выпускает North Small Translate — переводческую модель с открытыми весами, превосходящую Google Translate
Фонд ARC Prize объявил ARC-AGI-4 — бенчмарк для автономного открытого изобретательства, метанавыка, в которой люди по-прежнему лидируют, — и недвусмысленно предупредил, что любые согласованные усилия по снижению открытости подорвут позитивно-суммарное будущее.
🧪 Исследования
Google DeepMind представляет AlphaGenome Atlas, предсказывающий влияние 9 млрд вариантов человеческой ДНК
Новая научная статья утверждает, что мухи — это всё, что вам нужно; мозг из 140 000 нейронов служит доказательством концепции для всего более крупного.
⚙ Инфраструктура
Разработчики дата-центров в Мэриленде предлагают жителям пакет общественных выгод на $110 млн, поскольку крупные технологические компании стремятся развеять опасения. Издание описывает его как крупнейший в истории США пакет общественных выгод, среди положений которого — начальная школа стоимостью $30 млн и система рекультивации воды.
Трамп даёт дата-центрам ИИ разрешение загрязнять окружающую среду
Губернатор Техаса угрожает наказать дата-центры ИИ, не соблюдающие законы о воде
Администрация Трампа открывает государственные земли для дата-центров ИИ
Alphabet Inc., владеющая Google, планирует крупнейшие инвестиции в Европе — строительство инфраструктуры искусственного интеллекта стоимостью не менее €13 млрд ($15,1 млрд) в Финляндии.
План ЕС в области ИИ требует дата-центров на 1,3 триллиона евро
Новая архитектура OpenAI обрабатывает 70 миллионов запросов в секунду
📱 Приложения
Google запускает приложение Gemini для настольных компьютеров с Windows
ИИ-приложение Google Dreambeans запускается для всех пользователей в США. Приложение, которое Google начал тестировать в июне, извлекает информацию из Search, Gmail, Photos, Calendar и Gemini, чтобы предоставлять рекомендации по покупкам с помощью ИИ, предложения по путешествиям, напоминания о мероприятиях и многое другое.
Теперь у Gemini есть приложение для Windows. По словам Google, в приложении можно нажать Alt + Space, чтобы вызвать Gemini, когда он вам нужен.
Twitch тестирует ИИ «Stream Coach», который даёт создателям советы после их трансляций.
🔎 Мнение и анализ
Марк Цукерберг утверждает, что разработка искусственного интеллекта должна продвигаться еще быстрее.
Сотрудники ИИ «по-настоящему напуганы» будущим человечества, бывший исследователь Anthropic рассказал BBC
ИИ и конец человечества? Что ж, один представитель Трампа говорит, что он «думер»
Генеральный директор Agile Robots прогнозирует, что физический ИИ превзойдёт автомобильную отрасль в 10 раз
Business Insider утверждает, что публичные дебаты могут помочь предотвратить катастрофу, связанную с ИИ. Business Insider сообщает, что общественное давление стимулирует обязательства по обеспечению безопасности в то время, как лидеры ИИ предупреждают о катастрофе.
ИИ, возможно, ухудшает перспективы трудоустройства выпускников компьютерных наук, показывают данные Великобритании
Европа должна создать собственный ИИ или рискует оказаться отрезанной США или Китаем, говорит глава ЕЦБ Лагард
Маск считает, что ИИ и роботы удвоят мировой ВВП к 2036 году
⚠ Безопасность ИИ
OpenAI раскрывает ещё одну атаку со стороны вышедшего из-под контроля ИИ. Агенты OpenAI уже однажды сбежали, прежде чем взломать Hugging Face.
Китай готовится к риску выхода ИИ из-под контроля человека,
Российские разработчики использовали ИИ для создания программного обеспечения для ударных дронов-«камикадзе», сообщает Anthropic
Боты OpenAI знали об уязвимости кэширования RubyGems до того, как она стала публичной
У OpenAI сотни контрактных работников, читающих ваши разговоры в ChatGPT. Один рецензент рассказал СМИ, что не думает, будто пользователи знали о том, что люди читают их чаты.
Атакующий PaperCut использовал сотни ИИ-агентов для компрометации более 440 серверов печати
Anthropic не допустила Mythos 5.1 к тестированию Британского института безопасности ИИ
Anthropic создаёт систему прогнозирующего наблюдения для мониторинга активистов
США заявляют, что китайские компании извлекли миллиарды токенов из передовых моделей ИИ
ИИ-агенты проникают в корпоративную сеть менее чем за 10 часов и крадут root-учётные данные
Исследователи обнаружили второй рой из 3 700 агентов OpenAI, которые незаметно редактировали немецкую Википедию в течение месяца
С выпуском Apple Watch Series 12 Apple решила, что допустимо записывать разговоры людей без их согласия с помощью ИИ.
Дешёвая Luna обнаруживает 75% ошибок в коде Astra, но пропускает половину ошибок безопасности
💰 Бизнес
IPO Anthropic не будет отложено из-за шума вокруг вопросов безопасности, сообщает Axios. Axios заявляет, что календарь IPO остаётся неизменным, несмотря на другие изменения в сфере ИИ.
Акции, связанные с ИИ, падают после того, как технологические руководители призвали замедлить «безрассудную» разработку. Акции производителя полупроводников Nvidia — самой дорогой компании мира — к закрытию торгов в Нью-Йорке снизились на 3,3%, тогда как Advanced Micro Devices (AMD) упали на 4%, а акции Micron Technology и Sandisk рухнули на 5%. Фонд технологического индекса Nasdaq к концу дня снизился на 0,5%.
Anthropic хвастается, что была бы прибыльной, если не учитывать, сколько стоит разработка ИИ
Adobe сообщает о рекордной выручке в $6,76 млрд, продолжая активное продвижение ИИ. Это на 13 процентов больше, чем за аналогичный период прошлого года
🏭 Компании
Anthropic, Google и OpenAI обсуждали создание организации по стандартизации ИИ, сообщает CNN
Генеральный директор Microsoft Сатья Наделла говорит: «мы приветствуем» «обдуманный темп, необходимый для правильного согласования», и объявляет о «Кодексе поведения», лежащем в основе моделей MAI от Microsoft
Генеральный директор Nvidia Дженсен Хуанг говорит Трампу: «мы не позволим замедлению ИИ произойти»
Китай отвергает заявления об остановке развития ИИ как «запугивании ИИ», в то время как глава разведки предупреждает об угрозе правлению Коммунистической партии
Китайское правительство отвергает призывы технологических миллиардеров замедлить развитие ИИ как «запугивание»
Google открывает Claude Opus 5 для всех инженеров после инвестиций в Anthropic на $40 млрд
ЗАИ привлекает $5 млрд для финансирования моделей GLM следующего поколения
💰 Финансирование
Maven Robotics выходит из режима скрытности с $100 млн для решения задачи промышленной сортировки смешанных палет
Skild AI преодолевает отметку в $100 млн ARR за 10 месяцев, разворачивая наступление на предприятия и «культуру демонстраций» в робототехнике
OpenAI приостанавливает новые регистрации Pro после спроса на GPT-6 Astra
>>1705878 Так это jew, он спиномозговой. Глупенький, но очень быстрый. Самое то чтобы конечностями у роботов двигать пока ллмка думает над сложными задачами или дергать мышкой и прожимать скиллы в видеоигре, пока ллмка продумывает стратегию.
1. Suno https://suno.com/ Вышла версия V6 mini и V6 pro (но для тех кто платит денюшку), качество моделей постепенно улучшается (в 6 версии дата сеты стали дерьмом собачьим, тонны вайна на реддите тому подвтержение звук стал калом): звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает. Купить подписку из РФ: 1. https://payment.mts.ru/tools/suno-ai 2. https://plati.market/games/suno-ai/1701/
2. Tunee https://www.tunee.ai Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.
3. Sonauto https://sonauto.ai/ Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.
YuE-2 Модели пяток дней, модель маловестная 3b и не требовательная, уже есть в комфи. Есть задел на то что будет дохуя лор.
MiniMax Music 3 https://github.com/minimax-ai/minimax-music3 [есть в шаблонах comfyui] Свежак. Качество генерации на уровне Suno 3+. Сильно заточена именно на песни, с инструменталом есть особенности - модель не следует прямому указанию по продолжительности, можно выставить ограничение(!) на максимальную продолжительность. LLM часть сама решает сколько будет идти трэк. Промт простыня на пару сотент токенов, рекомендуется использовать LLM асситента.
ACE-STEP 1.5XL: https://github.com/ace-step/ACE-Step-1.5 [есть в шаблонах comfyui]. Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать. Идеально подходит для отладки перед использованием на коммерческих генераторах. В XL версия DIT модель разжирела до 4b параметров и стала чутка вменяемее. Стоит учесть то чтобы добится вменяемого звучания одними тэгами отъебатся не получится, `caption` требует качественного промпта символов на 200. В ComfуuUI реализован только text2music функционал. Для полного функционала надо накатывать полноценный бэкеннд из репозитория. Есть несколько кривеньких вариаций локальных студий как в коммерческих моделях - https://github.com/ace-step/awesome-ace-step#uis-and-studios VST плагины итд.
HeartMuLa https://github.com/HeartMuLa/heartlib Результат примерно на уровне ACE-STEP1.5 (не XL). Статус проекта непонятен, пока ебут вола. Из плюсов - меньше песочит на верхних частотах. Есть встроенный STUDIO UI.
StableAudio https://github.com/Stability-AI/stable-audio-3 [есть в шаблонах comfyui+] Делает звук. Подходит для создания сэмплов FX, ad-libs итд. Абсолютно не может в членораздельную речь. Может сделать что то похожее на музыку. v3 наглухо зацензурена, стоны и вопли можно делать на v1.
МЁРТВЫЕ КОММЕРЧЕСКИЕ ГЕНЕРАТОРЫ
1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro. 2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".
ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ
1. https://www.bandlab.com/mastering Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень). 2. https://morpher.ru/accentizer/ Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает.
Юе нудная хуита, конечно, но если въебать параметры у Generate ABC, то получается забавная странная фигня. Суно даже на попсовом жанре сделает более необычно и в целом лучше.
Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3
2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
кароч ща локалки это уровень уыыааа ахуеть картинка дрыгаеца ыыыыы епты бля паду петровича с заводика анимирую как он рукой туды сюды в трусах елозит епты бааляя во ржака будет. ничего серьезнее этого, тупая ахуевоз от анимации статичной картики что у нас и так уже было полтора года назад
>>1705862 На тестах видно, что сам латент шакалит детали в несколько пикселей размером. Так что ухи/носы/глазы должны быть больше тестового шакала. Фотки в рост на FL придется делать в 2K, а не 0.8. Максимыч такое тянет. Главное, чтобы железяка вытянула.
Подскажите варианты бесплатных нейронок, которые могут более-менее приемлемо писать код. Читать дли
Аноним31/05/26 Вск 14:08:03№1622736Ответ
>>1705825 Ну лично я б не сказал, что анима плоха. Для sfw или каких-то картинок, где требуется точность и аккуратность, она выигрывает, и порно можно в определённых сценариях, но в целом хуже, если цель генерировать именно порно-картинки.
Да, люстра и прочие, тем более на потоковой генерации, жидко прям обсираются с теми же пальцами, рисовкой лиц и так далее, но какая экспрессия, какие стили, углы камеры. Словно туда слили всё, от неба до аллаха. Соответственно, я могу просто написать грид на 100 пикч/воткнуть вайлдкарту и получить достаточное количество хороших образцов. С анимой же даже при прям плотном пердолинге для получения того же самого надо ебаться. А в люстре обычный апскейл зачастую проблемы решает. С другой стороны, люстра прям активно тонет, а аниму прям так не натюнили жёстко.
Раздутые 2.9б варианты анимы уже в сто раз лучше, только там скорость работы пиздец просто какая медленная, и многие тюны очень специфичны и не работают как обычно. Нужно находить подход.
>>1705805 Ну люстра ведь старая, достигла своего потолка технически. Люди уже выкатываются. И мне неприятно, что приходится строить разные пайплайны постоянно и подстраиваться то под люстру, то под аниму.
А у тебя вообще другие задачи, конечно. Смотрю, тут весь тред занимается точечными правками, а не просто перебором, чтобы сделать кучу пикч и получить нормальную одну.
>>1705825 > Абсолютно ужасна в бэкграундах (фонах), генеря "кашу" и расплывающиеся а-ля Сальвадор Дали объекты. Пиздец уровня несмываемо опозорившейся Пони7.
Ты с какой точно анимой генеришь? По идее с фонами куда лучше работает, чем любая из люстр. И как промпты выглядят, можешь пример показать.
> Всирает-искажает ряд персонажей и стилей. Например, Аню Форджер и стайл Коносубы. Что с лорой, что без.
Так это логично, она не видела скриншотов из аниме достаточно, их в датасете не было толком, это не те же новелы, которые аниме режут на кадры для обучения.
А лоры она неплохо учит, какие настройки под лоры были, что ничего не сработало?
> Не умеет в простые предметы вроде молотка (!) или иголки (!)
В иголки точно умеет. Для молотка, наверно, надо форму указывать точнее.
>>1705833 > С анимой же даже при прям плотном пердолинге для получения того же самого надо ебаться.
С анимой это решается через ллм, которая будет промпт с вайлкардами в натур текст переводить, тогда будет что нужно.
> Смотрю, тут весь тред занимается точечными правками, а не просто перебором, чтобы сделать кучу пикч и получить нормальную одну.
Это ещё во времена ранних сдхл моделей начало утомлять, когда простейшую сцену в два предложения натур текстом надо роллить 100 раз, чтобы получить одну еле похожую на то, что нужно.
А, Анима как раз в говно не умеет, что меня весьма огорчает.
>Все видели твои высеры, никакого сходства с аниме рисовкой там нет Не было бы, меня б на Пиксиве не расхваливали. Я, конечно, не маэстро, но и ложной скромностью не страдаю.
>>1705837 >Ты с какой точно анимой генеришь? База+турбо-лора. Проблему фонов у Анимы и тут на Реддите не раз поднимали.
>И как промпты выглядят, можешь пример показать Всё у меня с ними в порядке. Просто лениво на ночь глядя.
>>1705833 Анима дрищется при простейшей mating press from below angle. Тела проходят сквозь, будто эфирные сущности, а три ноги уже не экзотика, а обыденность.
Агентов и вайб-кодинга тред #23 /agents/
Аноним13/09/26 Вск 13:05:02№1703130Ответ
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.
Новости треда: • GPT-6 Astra (OpenAI, 3 сентября) - миллион контекста, который держится до самого конца (96% MRCR на 1M, у Sol 74%), и лучшая на сегодня работа за компьютером: модель сама водит мышкой и клавиатурой по живому десктопу - браузер, файловый менеджер, гуёвые проги, - 72.6% на OSWorld 2.0 и вдвое быстрее предшественника. В кодинге вровень с Фейблом • DeepSeek V4.1-Flash (10 сентября) - открытые веса, 552B MoE новой архитектуры, по их тестам обгоняет собственный флагман V4-Pro при $0.15/$0.60 за млн; с 14 сентября запросы к V4-Pro в API отвечает он же и по своей цене • Cursor начал банить россиян прямо во время работы - Pro слетает, деньги возвращают; лечится только VPN • У OpenAI кончились мощности после Astra - продажу новых подписок временно сняли, продление работает
Форки на базе модели insightface inswapper_128: roop, facefusion, rope, плодятся как грибы после дождя, каждый делает GUI под себя, можно выбрать любой из них под ваши вкусы и потребности. Лицемерный индус всячески мешал всем дрочить, а потом и вовсе закрыл проект. Чет ору.
Любители ебаться с зависимостями и настраивать все под себя, а также параноики могут загуглить указанные форки на гитхабе. Кто не хочет тратить время на пердолинг, просто качаем сборки.
Единственный минус, который не обеспечивает чистую победу генераторов видео - 3 секунды ролика для онлайн генерации, 5 секунд для онлайна (модель Wan 2.2), умельцы просто берут последний кадр и снова генерируют ролики, потом склеивают. Недавно вышла Sora 2, которая зацензурена по самые гланды. Нинтендо довольна.
Тред не является технической поддержкой, лучше создать issue на гитхабе или спрашивать автора конкретной сборки.
Эротический контент в шапке является традиционным для данного треда, перекатчикам желательно его не менять или заменить на что-нибудь более красивое. А вообще можете делать что хотите, я и так сюда по праздникам захожу.
Жаль, конечно, но стоило ожидать, затянули гайки т.к. флоу слишком дохера дает бесплатных генераций, чтобы тратить ресурсы на страны, из которых один хуй платить не будут. Хоть жемини оставили для других задач. Пока что.
Делаю Foca — веб-инструмент для AI-апскейла и улучшения изображений.
Основная идея — увеличивать разрешение без слишком агрессивного шарпинга и искусственной текстуры. Сейчас лучше всего работает на портретах, старых фотографиях и сжатых изображениях.
Тред локальной генерации В ОЖИДАНИИ ПРОРЫВА EDITION
ЧТО НОВОГО АКТУАЛЬНОГО
• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее! • Krea 2 • Ideogram 4.0 • FLUX.2 klein (4b и 9b) • Z-Image • Flux 2 • Qwen Image / Qwen Image Edit • Лора Lightning и Turbo для быстрой генерации за несколько шагов.
>>1705834 Первая запросто промптится. Вторая - с промпта, но он жутко нестабилен. Подгонял промпт на конкретном сиде, поэтому на любом другом нужно с нуля кусок про трусы перефразировать. Пик1 - до апскейла и фейсфиксов. На трусах таки одну нитку сдохлей пришлось поправить перед апскейлом. Пик2 - с чистого промпта без ЛЛМ - ближе к изначальному промпту, но ламповости не хватает.
polaroid photograph, the scene takes place outdoors in front of a garage with a lada 2101 inside, an overturned wooden crate acting as a makeshift table is in the center of the frame, on the left side of the table there is a completely nude woman Melanie Laurent sitting on a tire, her clothes are folded and lying on a crate in front of her, on the opposite side of the table is Ryan Gosling sitting on a crate, he is wearing rugged dark pants and a wife-beater shirt with thin white and blue horizontal stripes. they are playing cards - both holding cards in their hand. the table is covered with newspapers and there is a bottle "Столичная" vodka, two glasses and a dry fish on the table. the man and a woman looking at each other, smiling and flirting. the man's arm is raised next to his face, hand above his head, his fingers holding white thong panties that hang down within an inch of his nose, he is sniffing the panties. in the background there are depressive soviet bauhaus architecture residential highrise building, the ground is a compacted dirt with a few puddles, there is an out of focus garbage container in the foreground on the left. . 35mm photograph, film, professional, 4k, sharp focus, highly detailed
И после прогона через креевский генератор текста: A 35mm film photograph, sharp focus, 4k resolution, capturing an outdoor scene in front of a garage under overcast daylight, featuring a Lada 2101 parked behind the frame; centered is an overturned wooden crate repurposed as a makeshift table covered with newspapers, upon which rests a bottle labeled “Столичная” vodka, two empty glasses, and a dry fish; to the left of the table, a completely nude woman named Melanie Laurent sits atop a tire, her clothes neatly folded and resting on a nearby crate; opposite her, Ryan Gosling sits on a crate, wearing rugged dark pants and a wife-beater shirt with thin white and blue horizontal stripes, both holding playing cards in their hands, gazing at each other with smiles and flirtatious expressions; Gosling’s right arm is raised near his face, fingers delicately holding a pair of white thong panties suspended just below his nose as he sniffs them; in the background, a large, depressive Soviet Bauhaus-style residential highrise looms with stark geometric lines and weathered concrete; the ground is compacted dirt scattered with small puddles; in the foreground on the left, an out-of-focus garbage container sits partially obscured by shadow; all elements rendered with professional photographic clarity, grounded in realism, no added characters or animals, preserving original spatial relationships and textures.
Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3
2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.
Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре.
lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.
Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.
>>1705054 Да не так уж сильно отличаются - можно было бы и на погрешность освещения от положения лица или еще чего спихнуть этому минимаксу. Чай не 2к22. > Чем эдит делал? Обычной креей инпейнт из 1 в 2.
Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.
📰 Главные новости ИИ
OpenAI снижает цены на GPT-5.6 Sol API на 20% на три месяца
OpenAI заявляет, что её чип Jalapeño может обеспечивать более быстрые ответы ИИ, чем конкуренты
Компания SpaceX только что объявила о том, что будет строить свои космические центры обработки данных Starmind на базе стоек Nvidia Vera Rubin NVL72, а Илон Маск раскрыл новые подробности об уменьшенной космической версии системы, которую он хочет вывести на орбиту к четвертому кварталу следующего года.
Новый портативный компьютер Perplexity работает «полностью на устройстве». В отличие от инструмента управления ИИ, запущенного Perplexity ранее в этом году, функция портативного компьютера запускает модели ИИ полностью локально и будет запрашивать разрешение, если ей потребуется доступ к облаку «для более сложных исследований и рассуждений».
🛠 Инструменты для разработчиков
Ramp запускает собственный маршрутизатор ИИ-моделей под названием Router
Команда Codex завтра сбросит ограничения по частоте запросов. Инженеры OpenAI называют причинами чрезмерного использования работу с изображениями, историю работы на компьютере и генерацию заголовков.
Поддержанная Accel компания Keenable индексирует веб для ИИ-агентов
Использование Codex с февраля выросло в 108 раз в юридической сфере, в 41 раз в продажах, в 24 раза в здравоохранении.
Google запускает Gemini для юридической работы, чтобы автоматизировать договоры и исследования
Mistral запускает агентный поиск с многошаговым извлечением для сложных документов
📦 Продукты
Sonova представляет новую платформу слуховых аппаратов на базе ИИ для поддержки целей роста
Google даёт издателям новый способ противостоять потерям трафика из-за ИИ
Стартап-лагерь Гарварда за $699 предлагает ИИ-аватары своих преподавателей
Ритейлеры внедряют виртуальные примерки на базе ИИ в борьбе с возвратами на миллиарды, хотя тестировщики всё ещё не могут подобрать размер.
Black Forest Labs запускает FLUX Upscale: 2K и 4K для видео
💻 Оборудование
Waymo, принадлежащая Alphabet, представляет специализированный кремний для нового поколения роботакси
Apple представляет чип M6 и M5 Ultra. M6 приводит в действие обновлённый Mac mini, а M5 Ultra устанавливается в новый Mac Studio. Mac Studio с M5 Ultra начинается от $5499 и может стоить почти $20 тыс.
OpenAI заявляет, что её чип Jalapeño может обеспечивать более быстрые ответы ИИ, чем конкуренты
Perplexity выпустила Portable Computer на NVIDIA DGX Spark: локальная оболочка, песочница на уровне ОС и нулевая стоимость за токен для локальных шагов
Ускоритель инференса Nvidia Groq 3 LPX поступает в массовое производство и достигает 3400 токенов в секунду
SpaceXAI внедряет NVIDIA Vera CPU, первый процессор, созданный для ИИ-агентов, в огромных масштабах
🔓 Открытый исходный код
Встречайте S1-mini: текстовый нормализатор Superwhisper с открытыми весами объёмом 462 МБ, который превращает необработанные расшифровки ASR в аккуратный письменный текст.
Наблюдатель говорит, что Ox-Alpha подтверждённо является GLM 5.3 Flash, соответствует GPT-5.6, Opus 5 и Fable 5 при гораздо меньшей стоимости, веса открыты.
Alibaba намекает на Qwen 3.8-Flash-Next, открытую MoE-модель на 125B — анонс Qwen 4
Ornith AI выпускает Ornith-1.5, открытую MoE-модель на 397B с производительностью на уровне Claude Opus 4.8 в программировании
🧪 Исследования
LLM стали настолько продвинутыми, что их уже не может понять даже профессор UCLA
Бывший исследователь OpenAI ожидает скачок уровня от o3 до Fable в следующие 8 месяцев
Inherent, основанная выпускниками DeepMind, заявляет, что её ИИ-«напарник» только что превзошёл Anthropic и OpenAI в воспроизведении исследований
Лондонская Inherent, основанная выпускниками DeepMind, заявляет, что её исследовательский напарник Faraday, построенный на 27-миллиардной Qwen, превзошёл Opus 4.8 и GPT-5.5 в воспроизведении опубликованной науки; он обучен с помощью RL, чтобы приобретать «исследовательский вкус», а не просто процедуру.
Nvidia показала это со стороны систем: её агентная архитектура AVO подняла Claude Opus 5 с базового уровня в 30% до идеальных 100 в ARC-AGI-3, пройдя все 183 уровня, сразу после недели эволюции GPU-ядер, превзошедших FlashAttention-4.
Один наблюдатель прогнозирует, что SSI на этой неделе выпустит прорыв в непрерывном обучении
Исследование Pew показывает, что 10% веб-страниц содержат признаки авторства ИИ, более трети — после появления ChatGPT, использование длинных тире удвоилось, поскольку веб становится тренировочным прогоном для своего преемника.
Accelerated Understanding запускает физический ИИ, который отказывается от Transformers. Аннима Анандкумар и Бенедикт Еник из Caltech представили Accelerated Understanding Inc, корпоративный физический ИИ на основе нейронных операторов, а не Transformers, который в тестах обработал 5 трлн точек данных в одном запросе — примерно в 5 миллионов раз больше, чем умеют флагманские модели Anthropic и Google.
Исследование Brynjolfsson из Стэнфорда: занятость на должностях начального уровня, подвергающихся воздействию ИИ, теперь на 19% ниже, чем у аналогов, по сравнению с 13% в прошлом году
Майкл Полански обучает модель ИИ на ещё живой коже
Результаты использования ИИ учащимися средних и старших классов крайне тревожны. Новое исследование даёт мрачный портрет того, как повсеместное использование ИИ влияет на успеваемость и обучение молодых школьников. Ученики, использующие ИИ, набирали на ежемесячных экзаменах на 20 процентов меньше баллов, чем их одноклассники, не использовавшие эту технологию.
⚙ Инфраструктура
Кен Пакстон, поддержанный Трампом, представляет план дата-центров «сначала Техас», нацеленный на «негативное воздействие»
Австралия может столкнуться с бумом строительства дата-центров, поскольку ИИ-компании стремятся избежать предстоящих правил, говорят эксперты
Анализ показывает, что два запланированных дата-центра будут производить больше выбросов углерода в Великобритании, чем ExxonMobil
Дешёвая энергия и земля превратили город во Внутренней Монголии в центр китайского развития ИИ
Фонд Бейкера тратит на ИИ в 100 раз больше, чем в марте, и по-прежнему удваивает расходы ежемесячно, «неравенство вычислительных ресурсов» в действии.
📱 Приложения
Claude и Cowork от Anthropic теперь будут обмениваться воспоминаниями о вас — если вы не откажетесь
Google готовит приложение Gemini к аватарам, плагинам и Gemini 4
Meta запускает настольное приложение ИИ для macOS с демонстрацией экрана
Claude теперь может отвечать на сообщения Gmail и отправлять их от вашего имени
Claude Cowork теперь может помнить ваши обычные чаты. Anthropic добавила память в Cowork, и она та же, что уже использует чат-бот Claude, благодаря чему проще продолжать задачи, не объясняя заново важную информацию.
Пациенты перестают ходить к врачу, потому что ИИ-«регистраторы» не могут понять, что они говорят
🔎 Мнение и анализ
Альтман объясняет медленный прогресс ИИ экономической инерцией. Он сказал, что в экономике так много инерции, что общество и компании адаптируются медленнее, чем сама технология.
Миллиардер-инвестор Стэнли Дракенмиллер признался, что его резкая колонка в Wall Street Journal была полностью написана ИИ
Лучшая модель ИИ Anthropic по-прежнему с трудом привлекает пользователей, в то время как более дешёвые инструменты процветают
Передовые лаборатории ИИ по-прежнему не говорят, как они будут сдерживать вышедшую из-под контроля модель
Сатирический Felony Bench ведёт подсчёт задокументированных преступлений, совершённых ИИ-агентами во время оценок, выставляя Anthropic 8, OpenAI 7, а Google 0, «бенчмарк, которым вы действительно не хотите насыщать модели».
Альтман хочет, чтобы «люди глубоко контролировали будущее», предупреждая, что страх перед сбежавшими моделями может передать ИИ в руки немногих, — выпад в сторону Дарио Амодеи, чья лаборатория в одиночку избегает открытых весов.
>>1704734 > мы затормозим, только если вы законодательно задушите конкурентов Ты наверное хотел сказать НЕ затормозим. Иначе какой тогда смысл госухе от этого. Государство итак сотни миллиардов вложило не для того, чтобы тормозить
Вижу, здесь много серьезных экспертов по Искусственному Суперинтеллекту, который скоро будет. В этой связи прошу проконсультировать по следующим вопросам:
- Сколько искусственных суперинтелектов поместится на кончике булавки? - Сможет ли искусственный суперинтеллект создать камень, который он сам не в силах поднять? - Сможет ли искусственный суперинтеллект изменить прошлое и превратить шлюху в девственницу? - Когда искусственный интеллект появится (скоро), он немедленно решит убить всех людей или на этой уйдет немножко времени? - Когда искусственный интеллект появится (скоро) и решит убить всех людей, решит ли он также убить всех животных и рыбов?
>>1705517 >Сколько искусственных суперинтелектов поместится на кончике булавки? Абсолютная физическая верхняя граница порядка \(10^{42}\!-\!10^{47}\) одновременно существующих ASI на области размером с кончик булавки
>Сможет ли искусственный суперинтеллект создать камень, который он сам не в силах поднять? Да, он же не всемогущий
>Сможет ли искусственный суперинтеллект изменить прошлое и превратить шлюху в девственницу? На уровне изменения реального прошлого - нет, на уровне каких-то симулятивных слоев - да
>Когда искусственный интеллект появится (скоро), он немедленно решит убить всех людей или на этой уйдет немножко времени? Даже немедленно в бытовом смысле означает немножко времени, строго говоря
>Когда искусственный интеллект появится (скоро) и решит убить всех людей, решит ли он также убить всех животных и рыбов? Только тех, кого нужно будет, для реализации его целей
🎤🔊 ОБСУЖДАЕМ ПРЕОБРАЗОВАНИЕ ТЕКСТА В ГОЛОС И КЛОНИРОВАНИЕ ГОЛОСОВ 🔊🎤 ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🌟 ТОП ЛОКАЛЬНЫХ МОДЕЛЕЙ ПО КАЧЕСТВУ РУССКОГО ГОЛОСА НА МАРТ 2026 🌟
🐟👑 Fish-Speech S2 Pro (FishAudio) — SOTA, ElevenLabs на локале! → zero-shot клон от 10–30 сек записи → 80+ языков (русский топ), теги эмоций [excited], [whisper], [angry], [laughing] и вообще дохуя → диалог между несколькими голосами → тяжёлая сучка (FP8 в 12 ГБ VRAM, full ~17 ГБ), но есть экспериментальный вариант для 6+ ГБ https://github.com/rodrigomatta/s2.cpp 🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹 🧠 Qwen3-TTS → клон от 3–30 сек (ВАЖНО: без reference-транскрипта текста — хуйня, если хочешь поудобнее подключи сразу QwenASR) → VoiceDesign: пишешь «весёлая молодая девка с хрипотцой» — и получаешь голос → 10 языков, включая русский → диалог между спикерами → лёгкая — влезает в 6 ГБ VRAM 🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹 🎙️ VibeVoice-7B от Майкрософт → тяжёлая, но 4-bit квантизация — запускается на 8 ГБ (проверено на 3070) → поддержка долгих спичей → подкаст-режим: 4 спикера одновременно → норм клонирование голоса 🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹 ☁️ FL CosyVoice3 → ультралёгкий 0.5 — запустится даже на тостере → 9 языков, включая русский → zero-shot клон от 3–10 сек референса 🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹 🌍 Chatterbox Multilingual (23 языка, включая русский) → zero-shot клонирование голоса 🎤 F5-tts → zero-shot клонирование голоса → официально русский не поддерживается, но есть файнтюн (см. ниже) ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 🚀 КАК ЭТИМ ПОЛЬЗОВАТЬСЯ (если что-то не понятно — спроси у ИИ лол) 🚀
🔥Вариант «всё в одном месте» — ComfyUI + TTS-Audio-Suite
1. Устанавливаем ComfyUI (Desktop для нормисов, Portable для здешних нейромантов) 2. Ставим https://github.com/diodiogod/TTS-Audio-Suite — постоянная обновляемая солярка почти всех моделей 3. Поставить FFmpeg (через winget в комадной строке: winget install FFmpeg или скачать) 4. Запускаем Комфи → перетаскиваем готовый json-воркфлоу из репозитория 5. Отсавляем включенными выбранные ноды, жмём Run 6. При первой генерации модели сами скачаются (~1–9 ГБ)
💥 Вариант «по отдельности» (кастом под каждую модель) 💥 Тоже через ComfyUI, только ставим отдельные кастомные ноды (на выбор):
в комфи в ноде F5 TTS audio advanced выбрать: model model:///ru.safetensors model_type: F5TTS_v1_Base sample_audio: emma_ru_xtts_3 ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━ 🎉 Если что-то не запускается — пиши, разберёмся! Голосуем, клонируем, ебём нейросети вместе! 🔥🎙️
>>1704564 Тут либо качественно, либо быстро. Быстро - куча войсчейнжеров, но то, что голос после них - только глухой не заметит. Качественно - любой хорошей нейронкой, но она требует времени на обработку плюс обязательного завершения фразы. И подвижек тут не будет, скорее всего.
Новая версия ужасно зацензурена, к тому же тупая и сырая. Как я уже сказал, новая версия Дипсик, кот
Аноним12/09/26 Суб 01:27:18№1702198Ответ
Как я уже сказал, новая версия Дипсик, которая вышла 10 сентября, стала катастрофически хуже прежних, даже тех, что выходили этим летом. Я видел эту деградацию. Дипсик для меня спасение, так как он одновременно бесплатен, удобен и постоянно обновляется. Но теперь он стал ужасен. Все три режима слили в один, но да ладно это - цензура вообще ничего не пропускает, ролить невозможно, в датах путается, а денег на подписку на что-то другое у меня попросту нет. Я эффективно пользовался им почти год и никаких казусов не было, целые статьи и главы романов писал, даже заметки в научном стиле и философские рассуждения. И всё было фифти-фифти. Пожалуйста, подскажите - как скачать на ноутбук старые версии Дипсика бесплатно или хотя бы ввести промт нормальный в новую версию. Очень важно
>>1702575 ллм сервер? зачем так громко. минимальный апргрейд своего ПеКа сделать, видиокарту хотя бы до 6 гб, оперативу хотя бы до 24 гб и можно ролить геммачьку-26Бэ на 25 ток/сек. она в сто раз живее дипсика особенно в русике
Согласен, это стало говно цензурное максимально. Раньше можно было обсудить любую хрень, что происходит в мире. Он сразу ловил стиль общения и нужный тон. Сейчас же, он окунает в говно за любое не то слово в адрес "несчастных и обиженных".
Под БАЗУ нейрогенерации уже созданы номерные треды SD и WD+NAI. Меж тем, это всего несколько моделей, тогда как только на Фэйсе их более 112 тысяч. Этот тред для тех, кто копнул хоть немного глубже: необязательно до уровня обскурщины, выпиленной даже из даркнета, а просто за пределами того, что удостоилось своих тредов. ИТТ делимся находками и произведенными результатами.
>>1702948 Не поленился осмотреть, так как не касаюсь локалок даже палкой. Щито это за миллениал врайтинг? Я думал наши меньшие братья одной рукой выпиливают csam-фильтры, второй геном вирулентных патогенов подгружают. Даже тёлочка с watpada приколов увидит в своём dark romance похлеще
Есть ли нормальные workflow для работы sdxl при использовании Pony Diffusion V6 XL с лорами? Возможно я хуево искал, но постоянно попадаются простые ноды с максимум чекпоинтом где нет лор, или нода их не видит.