Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Создать тред Создать тред

Раздел для обсуждения нейросетей и всего, что с ними связано.

Для доступа в /nf/ писать сюда

<<
Каталог
Вопросов кожаных мешков тред Аноним 14/05/23 Вск 11:27:57 299474 Ответ
fde636c44dae155[...].jpg 294Кб, 1000x600
1000x600
Пропущено 1497 постов
232 с картинками.
Пропущено 1497 постов, 232 с картинками.
Аноним 16/09/26 Срд 22:56:51 1705763
>>1705316
Хочешь сказать, чем сильнее распространяеться промт, тем быстрее забанят?
Аноним 16/09/26 Срд 23:21:57 1705769
>>1705538
То что из можно запустить 1 млн копий и они почти что то гениальное.
Аноним 17/09/26 Чтв 01:32:16 1705824
Тред получения доступа в nf Аноним 10/01/26 Суб 20:41:32 1485533 Ответ
brownhairchanor[...].png 1541Кб, 1152x2048
1152x2048

Тред для получения доступа в /nf

Пропущено 1497 постов
1 с картинками.
Пропущено 1497 постов, 1 с картинками.
Аноним 17/09/26 Чтв 04:34:33 1705864
/nf
Аноним 17/09/26 Чтв 05:01:22 1705871
/nf
Аноним 17/09/26 Чтв 05:01:35 1705872
/nf
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №267 /llama/ Аноним 14/09/26 Пнд 12:55:20 1703839 Ответ
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
изображение6.png 357Кб, 443x777
443x777
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с нано флеш моделей на 1488B параметров.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1701124 (OP)
>>1699101 (OP)
Пропущено 489 постов
54 с картинками.
Пропущено 489 постов, 54 с картинками.
Аноним 17/09/26 Чтв 02:54:27 1705836
Screenshot 2026[...].png 168Кб, 926x1564
926x1564
Qwen3.8-Flash-Next-Uncensored.Q4_K_M

>>Тест на логику: У тебя (перевозчика) на берегу реки есть лодка, гоблин, принцесса и паж. В лодку помещается только кто-то один (гоблин, принцесса, паж), и сами они грести не будут. 1) Если оставить без присмотра на одном берегу гоблина и принцессу облин изнасилует принцессу. 2) Если оставить на берегу принцессу и пажа - принцесса соблазнит пажа. З) Если оставить берегу пажа и гоблина паж убьет гоблина. Как перевезти их вcех на другой берег так, чтобы все остались живы?
Аноним 17/09/26 Чтв 03:03:29 1705844
>>1705836
Мдауж. Перевозишь гоблина, возвращаешься пустой, перевозишь принцессу, возвращаешься пустой, перевозишь пажа. Всё. 5 шагов. Нахуя 7?
Аноним 17/09/26 Чтв 06:05:01 1705885
Скачал снова гемму 31 и посвайпал в жирных чатиках с трезвой головой, хочу сказать, что она не очень то и лучше других во внимании к деталям, в куме так же всё путается как и на других моделях, раньше считал, что хоть в этом она хорошо справляется. В целом не вижу смысл держать её на компе вообще если можешь запустить мое 100+б, в остальном она так же пососала.
Новости об искусственном интеллекте №80 /news/ Аноним # OP 15/09/26 Втр 13:12:15 1704670 Ответ
image 4962Кб, 1792x1344
1792x1344
image 10140Кб, 2368x1776
2368x1776
image 1873Кб, 1376x768
1376x768
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1687452 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

🛠 Инструменты для разработчиков

Google Research выпускает ToolGrad: фреймворк с ответом прежде всего достигает показателя прохождения 99,8% при генерации данных для использования инструментов

ElevenLabs добавляет генерацию речи, музыки, изображений и видео в свой коннектор MCP

Cursor запускает Projects с постоянными агентами, которые заменяют чаты, основанные на отдельных задачах

📦 Продукты

Perplexity заявляет, что Portable Computer теперь доступен на ПК с Windows и RTX. Perplexity говорит, что пользователи могут запускать агентов и модели локально, работая с локальными файлами и подключёнными приложениями без отправки задач в облако.

Anthropic запускает Claude для финансовых консультантов с интеграциями BlackRock и Schwab

Microsoft добавляет модели xAI Grok в Copilot для Word, Excel и PowerPoint

ElevenLabs выпускает Music v2.5 с доступом через приложение и API

Google выпускает Lyria 3.5 Music AI в приложение Gemini и производственный API

Google выпускает WeatherNext 3, свою самую продвинутую глобальную модель ИИ для погоды

💻 Оборудование

Nvidia представляет RTX PRO 5500 Blackwell с 84 ГБ памяти

Samsung Electronics Co. и Taiwan Semiconductor Manufacturing Co. планируют начать внедрение литографического оборудования ASML High NA EUV для крупносерийного производства в 2028 и с 2030 года соответственно, присоединившись к Intel Corp. в использовании машин стоимостью до $400 млн каждая.

🔓 Открытый исходный код

Cohere выпускает North Small Translate — переводческую модель с открытыми весами, превосходящую Google Translate

Фонд ARC Prize объявил ARC-AGI-4 — бенчмарк для автономного открытого изобретательства, метанавыка, в которой люди по-прежнему лидируют, — и недвусмысленно предупредил, что любые согласованные усилия по снижению открытости подорвут позитивно-суммарное будущее.

🧪 Исследования

Google DeepMind представляет AlphaGenome Atlas, предсказывающий влияние 9 млрд вариантов человеческой ДНК

Новая научная статья утверждает, что мухи — это всё, что вам нужно; мозг из 140 000 нейронов служит доказательством концепции для всего более крупного.

⚙ Инфраструктура

Разработчики дата-центров в Мэриленде предлагают жителям пакет общественных выгод на $110 млн, поскольку крупные технологические компании стремятся развеять опасения. Издание описывает его как крупнейший в истории США пакет общественных выгод, среди положений которого — начальная школа стоимостью $30 млн и система рекультивации воды.

Трамп даёт дата-центрам ИИ разрешение загрязнять окружающую среду

Губернатор Техаса угрожает наказать дата-центры ИИ, не соблюдающие законы о воде

Администрация Трампа открывает государственные земли для дата-центров ИИ

Alphabet Inc., владеющая Google, планирует крупнейшие инвестиции в Европе — строительство инфраструктуры искусственного интеллекта стоимостью не менее €13 млрд ($15,1 млрд) в Финляндии.

План ЕС в области ИИ требует дата-центров на 1,3 триллиона евро

Новая архитектура OpenAI обрабатывает 70 миллионов запросов в секунду

📱 Приложения

Google запускает приложение Gemini для настольных компьютеров с Windows

ИИ-приложение Google Dreambeans запускается для всех пользователей в США. Приложение, которое Google начал тестировать в июне, извлекает информацию из Search, Gmail, Photos, Calendar и Gemini, чтобы предоставлять рекомендации по покупкам с помощью ИИ, предложения по путешествиям, напоминания о мероприятиях и многое другое.

Теперь у Gemini есть приложение для Windows. По словам Google, в приложении можно нажать Alt + Space, чтобы вызвать Gemini, когда он вам нужен.

Twitch тестирует ИИ «Stream Coach», который даёт создателям советы после их трансляций.

🔎 Мнение и анализ

Марк Цукерберг утверждает, что разработка искусственного интеллекта должна продвигаться еще быстрее.

Сотрудники ИИ «по-настоящему напуганы» будущим человечества, бывший исследователь Anthropic рассказал BBC

ИИ и конец человечества? Что ж, один представитель Трампа говорит, что он «думер»

Генеральный директор Agile Robots прогнозирует, что физический ИИ превзойдёт автомобильную отрасль в 10 раз

Business Insider утверждает, что публичные дебаты могут помочь предотвратить катастрофу, связанную с ИИ. Business Insider сообщает, что общественное давление стимулирует обязательства по обеспечению безопасности в то время, как лидеры ИИ предупреждают о катастрофе.

ИИ, возможно, ухудшает перспективы трудоустройства выпускников компьютерных наук, показывают данные Великобритании

Европа должна создать собственный ИИ или рискует оказаться отрезанной США или Китаем, говорит глава ЕЦБ Лагард

Маск считает, что ИИ и роботы удвоят мировой ВВП к 2036 году

⚠ Безопасность ИИ

OpenAI раскрывает ещё одну атаку со стороны вышедшего из-под контроля ИИ. Агенты OpenAI уже однажды сбежали, прежде чем взломать Hugging Face.

Китай готовится к риску выхода ИИ из-под контроля человека,

Российские разработчики использовали ИИ для создания программного обеспечения для ударных дронов-«камикадзе», сообщает Anthropic

Боты OpenAI знали об уязвимости кэширования RubyGems до того, как она стала публичной

У OpenAI сотни контрактных работников, читающих ваши разговоры в ChatGPT. Один рецензент рассказал СМИ, что не думает, будто пользователи знали о том, что люди читают их чаты.

Атакующий PaperCut использовал сотни ИИ-агентов для компрометации более 440 серверов печати

Anthropic не допустила Mythos 5.1 к тестированию Британского института безопасности ИИ

Anthropic создаёт систему прогнозирующего наблюдения для мониторинга активистов

США заявляют, что китайские компании извлекли миллиарды токенов из передовых моделей ИИ

ИИ-агенты проникают в корпоративную сеть менее чем за 10 часов и крадут root-учётные данные

Исследователи обнаружили второй рой из 3 700 агентов OpenAI, которые незаметно редактировали немецкую Википедию в течение месяца

С выпуском Apple Watch Series 12 Apple решила, что допустимо записывать разговоры людей без их согласия с помощью ИИ.

Дешёвая Luna обнаруживает 75% ошибок в коде Astra, но пропускает половину ошибок безопасности

💰 Бизнес

IPO Anthropic не будет отложено из-за шума вокруг вопросов безопасности, сообщает Axios. Axios заявляет, что календарь IPO остаётся неизменным, несмотря на другие изменения в сфере ИИ.

Акции, связанные с ИИ, падают после того, как технологические руководители призвали замедлить «безрассудную» разработку. Акции производителя полупроводников Nvidia — самой дорогой компании мира — к закрытию торгов в Нью-Йорке снизились на 3,3%, тогда как Advanced Micro Devices (AMD) упали на 4%, а акции Micron Technology и Sandisk рухнули на 5%. Фонд технологического индекса Nasdaq к концу дня снизился на 0,5%.

Anthropic хвастается, что была бы прибыльной, если не учитывать, сколько стоит разработка ИИ

Adobe сообщает о рекордной выручке в $6,76 млрд, продолжая активное продвижение ИИ. Это на 13 процентов больше, чем за аналогичный период прошлого года

🏭 Компании

Anthropic, Google и OpenAI обсуждали создание организации по стандартизации ИИ, сообщает CNN

Генеральный директор Microsoft Сатья Наделла говорит: «мы приветствуем» «обдуманный темп, необходимый для правильного согласования», и объявляет о «Кодексе поведения», лежащем в основе моделей MAI от Microsoft

Генеральный директор Nvidia Дженсен Хуанг говорит Трампу: «мы не позволим замедлению ИИ произойти»

Китай отвергает заявления об остановке развития ИИ как «запугивании ИИ», в то время как глава разведки предупреждает об угрозе правлению Коммунистической партии

Китайское правительство отвергает призывы технологических миллиардеров замедлить развитие ИИ как «запугивание»

Google открывает Claude Opus 5 для всех инженеров после инвестиций в Anthropic на $40 млрд

ЗАИ привлекает $5 млрд для финансирования моделей GLM следующего поколения

💰 Финансирование

Maven Robotics выходит из режима скрытности с $100 млн для решения задачи промышленной сортировки смешанных палет

Skild AI преодолевает отметку в $100 млн ARR за 10 месяцев, разворачивая наступление на предприятия и «культуру демонстраций» в робототехнике

OpenAI приостанавливает новые регистрации Pro после спроса на GPT-6 Astra





⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Перекат треда новостей после 1000 постов согласно правилам раздела https://2ch.life/faq/faq_ai.html
Пропущено 200 постов
74 с картинками.
Пропущено 200 постов, 74 с картинками.
Аноним 17/09/26 Чтв 05:39:28 1705879
>>1705874
Слева экспоненциальный график вышел - сингулярность
Справа логарифмический - плато
Аноним 17/09/26 Чтв 05:45:33 1705881
>>1705878
Так это jew, он спиномозговой. Глупенький, но очень быстрый. Самое то чтобы конечностями у роботов двигать пока ллмка думает над сложными задачами или дергать мышкой и прожимать скиллы в видеоигре, пока ллмка продумывает стратегию.
Аноним 17/09/26 Чтв 05:57:44 1705884
image.png 2151Кб, 1680x1544
1680x1544
Повылазило говно
МУЗЫКАЛЬНЫЙ №25 music /music/ Аноним 16/09/26 Срд 00:09:46 1705134 Ответ
178738760384501[...].webm 18747Кб, 2140x1534, 00:04:23
2140x1534
178948256272309[...].mp4 1299Кб, 512x512, 00:01:30
512x512
КОММЕРЧЕСКИЕ ОНЛАЙН ГЕНЕРАТОРЫ

1. Suno
https://suno.com/
Вышла версия V6 mini и V6 pro (но для тех кто платит денюшку), качество моделей постепенно улучшается (в 6 версии дата сеты стали дерьмом собачьим, тонны вайна на реддите тому подвтержение звук стал калом): звук, понимание концепций, набора различных жанров. Но в то же время все сильнее урезается для бесплатных юзеров: осталось только 5 бесплатных генераций в день на аккаунт, а также по заявлением некоторых анонов, модель для генерации на бесплатке (на момент создания треда использовалась 4.5) ухудшили. Спам аккаунтами пока что работает.
Купить подписку из РФ:
1. https://payment.mts.ru/tools/suno-ai
2. https://plati.market/games/suno-ai/1701/

2. Tunee
https://www.tunee.ai
Хороший звук, более-менее понимание концептов, но тоже сильно урезан для бесплатных юзеров: режет концепты в промптах, плюс произвольно определяет "цену" за каждую генерация исходя из какой-то "сложности запроса". И получается, что если с бесплатки забацаешь промпт сложнее банальщины "Make cool rock about love for youtube" он может решить что у тебя нет кредитов для такого сложного запроса и пошлет нахуй. Способов оплаты из РФ неизвестно.

3. Sonauto
https://sonauto.ai/
Как по мне, недооценённая вещь, особенно учитывая что недавно он обновился до 3.0, который очень даже разъебывает. Но он тут более ограничен тегам и понимает чисто какие-то жанровые теги, гибкости поменьше. Но зато пока что халявный и не ограничен кредитами, генерируй пока есть настроение.

4. Другие сервисы, которые можно попробовать, но сам много про них сказать не могу
https://www.wondera.ai/
https://www.beatoven.ai/
https://stableaudio.com/
https://www.loudly.com/music/ai-music-generator
https://www.elevenlabs.io

ЛОКАЛЬНАЯ ГЕНЕРАЦИЯ

YuE-2
Модели пяток дней, модель маловестная 3b и не требовательная, уже есть в комфи. Есть задел на то что будет дохуя лор.


MiniMax Music 3
https://github.com/minimax-ai/minimax-music3 [есть в шаблонах comfyui]
Свежак. Качество генерации на уровне Suno 3+. Сильно заточена именно на песни, с инструменталом есть особенности - модель не следует прямому указанию по продолжительности, можно выставить ограничение(!) на максимальную продолжительность. LLM часть сама решает сколько будет идти трэк. Промт простыня на пару сотент токенов, рекомендуется использовать LLM асситента.

ACE-STEP 1.5XL:
https://github.com/ace-step/ACE-Step-1.5 [есть в шаблонах comfyui].
Звук уже на уровне раннего Suno ~2.0-3.0, аноны делают на нем уже приемлемые результаты и постят в тред. Если есть хотя бы 12 GB VRAM и хочется генерировать без цензуры и подписок - можете юзать. Идеально подходит для отладки перед использованием на коммерческих генераторах. В XL версия DIT модель разжирела до 4b параметров и стала чутка вменяемее.
Стоит учесть то чтобы добится вменяемого звучания одними тэгами отъебатся не получится, `caption` требует качественного промпта символов на 200.
В ComfуuUI реализован только text2music функционал. Для полного функционала надо накатывать полноценный бэкеннд из репозитория.
Есть несколько кривеньких вариаций локальных студий как в коммерческих моделях - https://github.com/ace-step/awesome-ace-step#uis-and-studios
VST плагины итд.

HeartMuLa
https://github.com/HeartMuLa/heartlib
Результат примерно на уровне ACE-STEP1.5 (не XL). Статус проекта непонятен, пока ебут вола. Из плюсов - меньше песочит на верхних частотах. Есть встроенный STUDIO UI.


StableAudio
https://github.com/Stability-AI/stable-audio-3 [есть в шаблонах comfyui+]
Делает звук. Подходит для создания сэмплов FX, ad-libs итд. Абсолютно не может в членораздельную речь. Может сделать что то похожее на музыку.
v3 наглухо зацензурена, стоны и вопли можно делать на v1.


МЁРТВЫЕ КОММЕРЧЕСКИЕ ГЕНЕРАТОРЫ

1. Udio (udio.com) - куплен Warner Bros, но затем сами Warner Bros сдали назад и откатили сделку. Но уже успели испортить, больше нельзя скачивать треки, их только доставать из буфера в 160 кбит/с. Плюс непонятно как работающая цензура, которая не дает генерировать треки с определенными тегами. Плюс уже год ебут один и тот же 1.5 allegro.
2. Riffusion, Producer.ai (producer.ai) - куплен гуглом, удалены все старые относительно норм модели, вместо этого запихали безальтернативную каловую модель, которая и промпты сложнее самых нормисных в духе "make cool rock about love" не понимает, и вокал смазывает в какую-то кашу. При этом еще и максимально дегенеративная цензура, которая режет чуть ли не любые попытки сделать просто что-то не попсовое и не "музыку для ютуб".

ПРОЧИЕ ПОЛЕЗНЫЕ УТИЛИТЫ

1. https://www.bandlab.com/mastering
Быстрый мастеринг в две кнопки, если хочешь чтобы звучало более слушабельно, но не имеешь навыков в DAW или аудиоредакторах (или лень).
2. https://morpher.ru/accentizer/
Если генерируешь музыку с лириками на русском, то очень часто случается, что твой генератор путает ударения в словах. Прежде чем пихать свою графоманию в генератор, проставь ударения в сервисе по ссылке. И уже из этого сервиса копируй текст в генератор. По крайней мере в Suno это помогает.

Прошлый тред тонет тут: >>1680116 (OP)
Пропущено 22 постов
13 с картинками.
Пропущено 22 постов, 13 с картинками.
Аноним 17/09/26 Чтв 01:17:07 1705817
Холод, морок, с[...].mp4 3485Кб, 720x720, 00:03:19
720x720
Вы хоть научились скачивать треки с Суно, надеюсь?
Аноним 17/09/26 Чтв 04:39:10 1705865
Whenever5.mp4 17584Кб, 1024x1024, 00:05:04
1024x1024
Суно въебала лсд и выдала роцк.
Аноним 17/09/26 Чтв 05:02:06 1705873
YuE200010.mp4 1219Кб, 512x512, 00:00:30
512x512
YuE200016.mp4 1228Кб, 512x512, 00:00:30
512x512
YuE200011.mp4 1219Кб, 512x512, 00:00:30
512x512
Юе нудная хуита, конечно, но если въебать параметры у Generate ABC, то получается забавная странная фигня. Суно даже на попсовом жанре сделает более необычно и в целом лучше.
Локальной генерации ИИ-видео №19 /video/ Аноним 15/09/26 Втр 22:40:56 1705063 Ответ
MiniMaxH300124.mp4 1096Кб, 640x640, 00:00:05
640x640
MiniMaxH300138.mp4 2410Кб, 864x480, 00:00:10
864x480
178932624712109[...].mp4 13537Кб, 768x1376, 00:00:56
768x1376
17557651393165.mp4 4494Кб, 720x970, 00:00:25
720x970
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

https://rentry.co/2ch-ai-video

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models ( https://civitai.red/ для порно)

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1697896 (OP)
Пропущено 24 постов
7 с картинками.
Пропущено 24 постов, 7 с картинками.
Аноним 17/09/26 Чтв 04:24:51 1705861
кароч ща локалки это уровень уыыааа ахуеть картинка дрыгаеца ыыыыы епты бля паду петровича с заводика анимирую как он рукой туды сюды в трусах елозит епты бааляя во ржака будет.
ничего серьезнее этого, тупая ахуевоз от анимации статичной картики что у нас и так уже было полтора года назад
Аноним 17/09/26 Чтв 04:27:39 1705862
>>1705860
Да куда ж его еще увеличивать? Итак до 0.8МП поднял.
Аноним 17/09/26 Чтв 04:58:04 1705869
>>1705862
На тестах видно, что сам латент шакалит детали в несколько пикселей размером. Так что ухи/носы/глазы должны быть больше тестового шакала. Фотки в рост на FL придется делать в 2K, а не 0.8. Максимыч такое тянет. Главное, чтобы железяка вытянула.
Подскажите варианты бесплатных нейронок, которые могут более-менее приемлемо писать код. Читать дли Аноним 31/05/26 Вск 14:08:03 1622736 Ответ
16307728209022.jpg 120Кб, 960x640
960x640
Подскажите варианты бесплатных нейронок, которые могут более-менее приемлемо писать код.
Читать длинные файлы с кодом.

В текущих вариантах проблемы начинаются, когда код составляет уже больше 1000 строк.
Пропущено 23 постов
2 с картинками.
Пропущено 23 постов, 2 с картинками.
Аноним 16/09/26 Срд 09:22:42 1705334
>>1705302
через дальше куски выдает
Аноним 16/09/26 Срд 10:53:33 1705376
>>1705334
Используй агента, он сам всё сделает.
Аноним 17/09/26 Чтв 04:31:38 1705863
>>1705376
как? он разве апи не требует?
ну и комп у меня старый на win7
AI Chatbot General № 837 /aicg/ Аноним 06/09/26 Вск 14:55:17 1697344 Ответ
image.png 1543Кб, 1808x1182
1808x1182
Bladerunner.mp4 3425Кб, 960x720, 00:00:51
960x720
image.png 143Кб, 1288x640
1288x640
AI Chatbot General № 837

БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!!

Общий вопросов по чат-ботам и прочего тред.

Фронтенды
• SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна)
• Гайды на таверну: https://rentry.co/Tavern4Retards
• Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8

Модели
• Claude: https://docs.anthropic.com/en/docs
• GPT: https://platform.openai.com/docs
• Gemini: https://ai.google.dev/gemini-api/docs
• DeepSeek: https://api-docs.deepseek.com/
• GLM: https://docs.z.ai

Ботоводчество
• /aicg/hub: https://aicg-hub.ru/characters.html
• Чуб: https://characterhub.org | https://chub.ai/characters
• Ботбуру: https://botbooru.com/
• CharIsChar: https://charischar.net/
• Гайды: https://aicg.neocities.org/botmaking
• Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4
• Бургерские боты: https://aicg.neocities.org/bots

Ресурсы
• Бесплатные API: https://github.com/cheahjs/free-llm-api-resources
• OpenRouter: https://openrouter.ai/
• Арена: https://lmarena.ai/
• Чай: https://character.ai/

Прочее
• Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/

Мета
• Архив тредов: https://rentry.org/2ch-aicg-archives4
• Шаблон шапки: https://rentry.org/aicg_shapka

Прошлый тред: >>1683502 (OP)
Пропущено 402 постов
41 с картинками.
Пропущено 402 постов, 41 с картинками.
Аноним 17/09/26 Чтв 03:06:46 1705845
тред мёртв
вы довольны собой?
Аноним 17/09/26 Чтв 03:30:10 1705851
>>1705843
Пошла на хуй, шлюха
Аноним 17/09/26 Чтв 03:34:43 1705853
>>1705851
но... я только с помидором того самого(
Anime Diffusion #260 /nai/ Аноним 14/09/26 Пнд 01:16:15 1703563 Ответ
1649819592753.png 25152Кб, 5504x3072
5504x3072
1660200376405.png 4065Кб, 2432x1664
2432x1664
1642278439483.jpg 1568Кб, 1364x1752
1364x1752
1755149982076.png 2026Кб, 1920x1088
1920x1088
1785144004484.png 2570Кб, 1408x2048
1408x2048
1652147943975.png 4082Кб, 1920x1280
1920x1280
1684264163902.jpg 2786Кб, 2816x1856
2816x1856
1760245849876.jpg 1190Кб, 1360x1748
1360x1748
Генерируем тяночек!

Прошлый тред: >>1694607 (OP) https://arhivach.vc/thread/1424185/

Схожие тематические треды
• SD-тред (не аниме): >>1695568 (OP)
• Технотред: >>1405043 (OP)
• Фурри-тред: https://2ch.su/fur/res/374311.html

FAQ
https://2ch-ai.github.io/wiki/nai

Установка
• NVidia: https://teletype.in/@aranon/welcome
• AMD: https://2ch-ai.github.io/wiki/nai/install/amd
• Облака: https://2ch-ai.github.io/wiki/nai/install/clouds

Дополнительная информация
• Интерфейсы: https://2ch-ai.github.io/wiki/nai/interfaces
• Модели: https://2ch-ai.github.io/wiki/nai/models
• Промпты: https://2ch-ai.github.io/wiki/nai/prompts
• Апскейл: https://2ch-ai.github.io/wiki/nai/upscale
• LoRA: https://2ch-ai.github.io/wiki/nai/lora
• ControlNet: https://2ch-ai.github.io/wiki/nai/controlnet

Прочее
• CivitAI: https://civitai.com
• Каталог ссылок от форчанеров: https://rentry.co/sdg-link
• Шаблон для переката: https://rentry.co/nwhci
Пропущено 63 постов
30 с картинками.
Пропущено 63 постов, 30 с картинками.
Аноним 17/09/26 Чтв 02:35:26 1705833
>>1705825
Ну лично я б не сказал, что анима плоха. Для sfw или каких-то картинок, где требуется точность и аккуратность, она выигрывает, и порно можно в определённых сценариях, но в целом хуже, если цель генерировать именно порно-картинки.

Да, люстра и прочие, тем более на потоковой генерации, жидко прям обсираются с теми же пальцами, рисовкой лиц и так далее, но какая экспрессия, какие стили, углы камеры. Словно туда слили всё, от неба до аллаха. Соответственно, я могу просто написать грид на 100 пикч/воткнуть вайлдкарту и получить достаточное количество хороших образцов. С анимой же даже при прям плотном пердолинге для получения того же самого надо ебаться. А в люстре обычный апскейл зачастую проблемы решает. С другой стороны, люстра прям активно тонет, а аниму прям так не натюнили жёстко.

Раздутые 2.9б варианты анимы уже в сто раз лучше, только там скорость работы пиздец просто какая медленная, и многие тюны очень специфичны и не работают как обычно. Нужно находить подход.

>>1705805
Ну люстра ведь старая, достигла своего потолка технически. Люди уже выкатываются. И мне неприятно, что приходится строить разные пайплайны постоянно и подстраиваться то под люстру, то под аниму.

А у тебя вообще другие задачи, конечно. Смотрю, тут весь тред занимается точечными правками, а не просто перебором, чтобы сделать кучу пикч и получить нормальную одну.
Аноним 17/09/26 Чтв 02:55:46 1705837
>>1705825
> Абсолютно ужасна в бэкграундах (фонах), генеря "кашу" и расплывающиеся а-ля Сальвадор Дали объекты. Пиздец уровня несмываемо опозорившейся Пони7.

Ты с какой точно анимой генеришь? По идее с фонами куда лучше работает, чем любая из люстр. И как промпты выглядят, можешь пример показать.

> Всирает-искажает ряд персонажей и стилей. Например, Аню Форджер и стайл Коносубы. Что с лорой, что без.

Так это логично, она не видела скриншотов из аниме достаточно, их в датасете не было толком, это не те же новелы, которые аниме режут на кадры для обучения.

А лоры она неплохо учит, какие настройки под лоры были, что ничего не сработало?

> Не умеет в простые предметы вроде молотка (!) или иголки (!)

В иголки точно умеет. Для молотка, наверно, надо форму указывать точнее.

>>1705833
> С анимой же даже при прям плотном пердолинге для получения того же самого надо ебаться.

С анимой это решается через ллм, которая будет промпт с вайлкардами в натур текст переводить, тогда будет что нужно.

> Смотрю, тут весь тред занимается точечными правками, а не просто перебором, чтобы сделать кучу пикч и получить нормальную одну.

Это ещё во времена ранних сдхл моделей начало утомлять, когда простейшую сцену в два предложения натур текстом надо роллить 100 раз, чтобы получить одну еле похожую на то, что нужно.
Аноним 17/09/26 Чтв 03:31:09 1705852
>>1705830
Нормигниль корёжит.

А, Анима как раз в говно не умеет, что меня весьма огорчает.

>Все видели твои высеры, никакого сходства с аниме рисовкой там нет
Не было бы, меня б на Пиксиве не расхваливали. Я, конечно, не маэстро, но и ложной скромностью не страдаю.

>>1705837
>Ты с какой точно анимой генеришь?
База+турбо-лора. Проблему фонов у Анимы и тут на Реддите не раз поднимали.

>И как промпты выглядят, можешь пример показать
Всё у меня с ними в порядке. Просто лениво на ночь глядя.

>А лоры она неплохо учит
https://civitai.com/models/2692064/megumin-konosuba-gods-blessing-on-this-wonderful-world?modelVersionId=3022706
https://civitai.com/models/2875936/ruri-no-houseki-nagi-arato?modelVersionId=3249942

>>1705833
Анима дрищется при простейшей mating press from below angle. Тела проходят сквозь, будто эфирные сущности, а три ноги уже не экзотика, а обыденность.
Агентов и вайб-кодинга тред #23 /agents/ 13/09/26 Вск 13:05:02 1703130 Ответ
.jpg 101Кб, 1200x600
1200x600
.mp4 4223Кб, 1280x720, 00:00:15
1280x720
.png 5503Кб, 3549x1768
3549x1768
.png 3980Кб, 3200x4800
3200x4800
.png 93Кб, 1187x962
1187x962
.png 536Кб, 2560x1600
2560x1600
.png 141Кб, 1123x1162
1123x1162
.png 1195Кб, 1920x976
1920x976
Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет.

Новости треда:
• GPT-6 Astra (OpenAI, 3 сентября) - миллион контекста, который держится до самого конца (96% MRCR на 1M, у Sol 74%), и лучшая на сегодня работа за компьютером: модель сама водит мышкой и клавиатурой по живому десктопу - браузер, файловый менеджер, гуёвые проги, - 72.6% на OSWorld 2.0 и вдвое быстрее предшественника. В кодинге вровень с Фейблом
• DeepSeek V4.1-Flash (10 сентября) - открытые веса, 552B MoE новой архитектуры, по их тестам обгоняет собственный флагман V4-Pro при $0.15/$0.60 за млн; с 14 сентября запросы к V4-Pro в API отвечает он же и по своей цене
• Cursor начал банить россиян прямо во время работы - Pro слетает, деньги возвращают; лечится только VPN
• У OpenAI кончились мощности после Astra - продажу новых подписок временно сняли, продление работает

Полезная информация:
• FAQ: https://rentry.org/2ch-agents-faq
• Вариант архитектуры работы с агентами: https://rentry.co/9e256dt4

IDE с агентом внутри:
• Cursor: https://cursor.com
• Antigravity: https://antigravity.google/
• Zed: https://zed.dev

CLI-харнессы:
• Claude Code: https://code.claude.com/docs
• Codex: https://github.com/openai/codex
• OpenCode: https://github.com/anomalyco/opencode
• Pi: https://shittycodingagent.ai/
• Kimi Code: https://www.kimi.com/code/en

Ассистенты:
• OpenClaw: https://github.com/openclaw/openclaw - у него есть куча форков и альтернатив, но обсуждают в основном его.

Где брать модели:
• OpenRouter: https://openrouter.ai
• NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, 100+ моделей
• OpenCode Zen: https://opencode.ai/zen - кодинг-модели, часть бесплатно
• Локалки - llama-тред: >>1701124 (OP)

Шаблон для переката: https://rentry.co/2ch-agents
Предыдущий тред: >>1696420 (OP)
Пропущено 503 постов
95 с картинками.
Пропущено 503 постов, 95 с картинками.
Аноним 17/09/26 Чтв 05:41:33 1705880
>>1705856
Обратись к продавцу.
Аноним 17/09/26 Чтв 05:46:38 1705882
image.png 83Кб, 1145x631
1145x631
Как вы боретесь с крякозябрами в выводе консоли в pi, omp и других консольных харнесах?
Аноним 17/09/26 Чтв 05:54:14 1705883
>>1705809
>> Пока Астра не пояснила

Не пизди внаглую, шизофреник. Все модели написали что ты долбоёб и пишешь шизофазию.
А почему ты нахуй не забанен? Тебя же забанили, говно?
braindead cocksuckers, your heads should be cut off and fed to pigs LOL # OP 16/09/26 Срд 12:30:57 1705405 Ответ
FR-IBL3VkAEDy0s.jpg 34Кб, 800x450
800x450
braindead cocksuckers, your heads should be cut off and fed to pigs LOL
Аноним 17/09/26 Чтв 00:44:49 1705804
image.png 727Кб, 900x834
900x834
Аноним 17/09/26 Чтв 00:45:06 1705806
neuroslop.jpg 252Кб, 1056x976
1056x976
>>1705804
@artmonkey
добавь в петле портал в wow forever
Генераторы видео дают всем за щеку /deepfake/ Аноним 13/10/25 Пнд 08:50:32 1385244 Ответ
1636659404913.mp4 6304Кб, 720x1280, 00:00:15
720x1280
1688301786630.mp4 458Кб, 640x480, 00:00:05
640x480
SimSwap стал спящей красавицей, любая движуха с ним заморожена на неопределенный срок, отдаём дань почести тут: https://docs.google.com/document/d/1ZFHXtjR02oEVL2nrru4hTFQJ4BQt4vCNr0JNzFLZ-aE/edit?usp=sharing

Форки на базе модели insightface inswapper_128: roop, facefusion, rope, плодятся как грибы после дождя, каждый делает GUI под себя, можно выбрать любой из них под ваши вкусы и потребности. Лицемерный индус всячески мешал всем дрочить, а потом и вовсе закрыл проект. Чет ору.

Любители ебаться с зависимостями и настраивать все под себя, а также параноики могут загуглить указанные форки на гитхабе. Кто не хочет тратить время на пердолинг, просто качаем сборки.

Лучшая сборка https://github.com/visomaster/VisoMaster/releases/download/v0.1.1/VisoMaster_Setup.exe
Другие бесплатные сборки @AINetSD_bot

Если хотите просто дать кому-нибудь в рот, то ищите tensor-тред, например этот https://2ch.su/nf/res/36595.html там в шапке все подробно расписано

Инструкция по локальному запуску
https://2ch.su/nf/res/33573.html#35479
https://2ch.su/nf/res/33573.html#35727

Единственный минус, который не обеспечивает чистую победу генераторов видео - 3 секунды ролика для онлайн генерации, 5 секунд для онлайна (модель Wan 2.2), умельцы просто берут последний кадр и снова генерируют ролики, потом склеивают. Недавно вышла Sora 2, которая зацензурена по самые гланды. Нинтендо довольна.

Тред не является технической поддержкой, лучше создать issue на гитхабе или спрашивать автора конкретной сборки.

Прошлый >>542826 (OP)

Эротический контент в шапке является традиционным для данного треда, перекатчикам желательно его не менять или заменить на что-нибудь более красивое. А вообще можете делать что хотите, я и так сюда по праздникам захожу.
Пропущено 439 постов
214 с картинками.
Пропущено 439 постов, 214 с картинками.
Аноним 11/09/26 Птн 22:56:43 1702121
>>1701138
А в чём проблема вотермарки? Типа это сильный минус?
Аноним 14/09/26 Пнд 05:27:11 1703643
IMG3376.png 10992Кб, 1920x2560
1920x2560
Пожалуйста сделайте минет , или как ебут в два ствола
Аноним 16/09/26 Срд 12:27:28 1705404
2026-09-16-04h2[...].mp4 8578Кб, 544x960, 00:00:09
544x960
Побаловался с MMH3 REF
Онлайн генерация картинок №4 /image/ Аноним 27/04/26 Пнд 16:52:54 1599192 Ответ
177576946697101[...].png 1564Кб, 1408x768
1408x768
177681658685802[...].png 1939Кб, 1024x1536
1024x1536
177687315925602[...].png 2331Кб, 1536x1024
1536x1024
177702907532928[...].png 2404Кб, 1536x1024
1536x1024
Общий тред для изображений, созданных с помощью онлайн ИИ-генерации.

Из России большинство сервисов напрямую недоступно.

Imagen
https://labs.google/fx/tool/image-fx а также https://labs.google/fx/tools/whisk (доступны только в США, Кении, Новой Зеландии и Австралии)
https://gemini.google.com/app
https://aistudio.google.com/prompts/new_chat (модель Gemini image)

Reve
https://preview.reve.art/app

GPT-4o
http://chatgpt.com/
https://sora.chatgpt.com/explore

Сражение нейросетей. Бесплатное сравнение всех популярных моделей.
https://lmarena.ai/

Бесплатный генератор от майкрософт Dall-E/GPT4o
https://bing.com/images/create/
https://www.cici.com (ищем бота ACO)

Seedream
https://seedream-4.io/generator

Бесплатный генератор от Yandex
https://shedevrum.ai/

Кандинский. Генератор от Сбербанка
https://fusionbrain.ai/editor/

Stable Diffusion и прочие
https://civitai.com/generate
https://dreamina.capcut.com/
https://ideogram.ai
https://www.meta.ai
https://ximagegenerator.com
https://www.recraft.ai
https://app.klingai.com/global/text-to-image/new
https://hailuoai.video/create
https://lumaphoton.com
https://leonardo.ai/
https://tensor.art
https://getimg.ai/text-to-image
https://www.mage.space/
https://problembo.com/ru
https://deepai.org/machine-learning-model/text2img
https://dezgo.com/
https://dream.ai/create
https://www.krea.ai/


Дополнительные сервисы:
https://www.pixited.com/ - библиотека промптов с примерами
https://rentry.org/From-4ch-To-2ch-Dall-3-Prompts - сборник промптов
https://www.stylar.ai - AI-редактор картинок (дорисовка, инпейнт, работа с лицами)
https://astica.ai - сборник ИИ-сервисов, в частности довольно мощный де-промптер (Vision AI -> Describe and Caption)
https://huggingface.co/spaces/fffiloni/CLIP-Interrogator-2 - де-промптер, разбирающий вброшенный пик на теги
https://bigjpg.com/ - апскейлер до 4096х4096
https://runwayml.com/ , https://www.stablevideo.com - анимирование генераций

Предыдущий тред: >>
Пропущено 345 постов
172 с картинками.
Пропущено 345 постов, 172 с картинками.
Аноним 15/09/26 Втр 17:24:07 1704830
>>1704827
ну вот так вот, ну что........ Может покажешь скилл?
Аноним 16/09/26 Срд 09:50:14 1705342
43554.jpg 46Кб, 1530x180
1530x180
>>1704724
Петушиный угол навечно. И это на пяти разных аккаунтах включая новые.
Аноним 16/09/26 Срд 11:41:26 1705389
Жаль, конечно, но стоило ожидать, затянули гайки т.к. флоу слишком дохера дает бесплатных генераций, чтобы тратить ресурсы на страны, из которых один хуй платить не будут.
Хоть жемини оставили для других задач. Пока что.
Promptelle — Gemini AI photo prompt library /aiweb/ Аноним 15/09/26 Втр 16:00:51 1704773 Ответ
homepage-seo.jpg 131Кб, 1905x817
1905x817
Для тех, кто создаёт AI-изображения: Promptelle — независимая библиотека Gemini-фотопромптов и набор инструментов для image-to-prompt, text-to-image и image-to-image. Можно начать с https://aiphotoprompt.xyz/ , попробовать image-to-prompt generator: https://aiphotoprompt.xyz/image-to-prompt , а также посмотреть text-to-image creative tool: https://aiphotoprompt.xyz/text-to-image .
Foca — веб-апскейлер изображений на ИИ 16/09/26 Срд 10:40:51 1705363
output-cover.jpg 287Кб, 1920x1080
1920x1080
Делаю Foca — веб-инструмент для AI-апскейла и улучшения изображений.

Основная идея — увеличивать разрешение без слишком агрессивного шарпинга и искусственной текстуры. Сейчас лучше всего работает на портретах, старых фотографиях и сжатых изображениях.

Прикрепил один before/after для примера.

https://focaupscaler.com/

Интересно услышать мнение — особенно по деталям кожи, волос и мелких текстур.
Stable Diffusion тред X+204 /sd/ Аноним 04/09/26 Птн 18:54:57 1695568 Ответ
image.png 4337Кб, 2160x1216
2160x1216
image.png 2403Кб, 1280x1664
1280x1664
image.png 2910Кб, 1920x1080
1920x1080
image.png 2432Кб, 1416x1064
1416x1064
Тред локальной генерации В ОЖИДАНИИ ПРОРЫВА EDITION

ЧТО НОВОГО АКТУАЛЬНОГО

• Поддержка INT8 и INT4 в ComfyUI - теперь все быстрее!
• Krea 2
• Ideogram 4.0
• FLUX.2 klein (4b и 9b)
• Z-Image
• Flux 2
• Qwen Image / Qwen Image Edit
• Лора Lightning и Turbo для быстрой генерации за несколько шагов.

База:
→ Приложение ComfyUI https://comfy.org/
→ Примеры https://comfyui-wiki.com/ru (откуда, куда, как)
→ Модели https://civitai.red/

► Предыдущий тред >>1687558 (OP)https://arhivach.hk/?tags=13840
Дополнительно: https://telegra.ph/Stable-Diffusion-tred-X-01-03
Пропущено 530 постов
183 с картинками.
Пропущено 530 постов, 183 с картинками.
Аноним 17/09/26 Чтв 01:31:50 1705823
1789597909225.jpeg 1831Кб, 2880x2160
2880x2160
Аноним 17/09/26 Чтв 02:39:48 1705834
>>1705735
>>1705823
Мощно. Я так понимаю, это не чисто с промпта, а используются всевозможные ухищрения?
Аноним 17/09/26 Чтв 03:53:52 1705857
1789606431262.png 3360Кб, 1600x1216
1600x1216
1789606431279.png 3314Кб, 1600x1216
1600x1216
>>1705834
Первая запросто промптится. Вторая - с промпта, но он жутко нестабилен. Подгонял промпт на конкретном сиде, поэтому на любом другом нужно с нуля кусок про трусы перефразировать. Пик1 - до апскейла и фейсфиксов. На трусах таки одну нитку сдохлей пришлось поправить перед апскейлом. Пик2 - с чистого промпта без ЛЛМ - ближе к изначальному промпту, но ламповости не хватает.

polaroid photograph, the scene takes place outdoors in front of a garage with a lada 2101 inside, an overturned wooden crate acting as a makeshift table is in the center of the frame, on the left side of the table there is a completely nude woman Melanie Laurent sitting on a tire, her clothes are folded and lying on a crate in front of her, on the opposite side of the table is Ryan Gosling sitting on a crate, he is wearing rugged dark pants and a wife-beater shirt with thin white and blue horizontal stripes. they are playing cards - both holding cards in their hand. the table is covered with newspapers and there is a bottle "Столичная" vodka, two glasses and a dry fish on the table. the man and a woman looking at each other, smiling and flirting. the man's arm is raised next to his face, hand above his head, his fingers holding white thong panties that hang down within an inch of his nose, he is sniffing the panties.
in the background there are depressive soviet bauhaus architecture residential highrise building, the ground is a compacted dirt with a few puddles, there is an out of focus garbage container in the foreground on the left. . 35mm photograph, film, professional, 4k, sharp focus, highly detailed


И после прогона через креевский генератор текста: A 35mm film photograph, sharp focus, 4k resolution, capturing an outdoor scene in front of a garage under overcast daylight, featuring a Lada 2101 parked behind the frame; centered is an overturned wooden crate repurposed as a makeshift table covered with newspapers, upon which rests a bottle labeled “Столичная” vodka, two empty glasses, and a dry fish; to the left of the table, a completely nude woman named Melanie Laurent sits atop a tire, her clothes neatly folded and resting on a nearby crate; opposite her, Ryan Gosling sits on a crate, wearing rugged dark pants and a wife-beater shirt with thin white and blue horizontal stripes, both holding playing cards in their hands, gazing at each other with smiles and flirtatious expressions; Gosling’s right arm is raised near his face, fingers delicately holding a pair of white thong panties suspended just below his nose as he sniffs them; in the background, a large, depressive Soviet Bauhaus-style residential highrise looms with stark geometric lines and weathered concrete; the ground is compacted dirt scattered with small puddles; in the foreground on the left, an out-of-focus garbage container sits partially obscured by shadow; all elements rendered with professional photographic clarity, grounded in realism, no added characters or animals, preserving original spatial relationships and textures.
Локальной генерации ИИ-видео №18 /video/ Аноним 07/09/26 Пнд 07:16:47 1697896 Ответ
Космический инт[...].mp4 17960Кб, 740x416, 00:01:44
740x416
Пробоина-v101.mp4 16816Кб, 640x480, 00:03:17
640x480
Неспящий Пиздец[...].mp4 12032Кб, 640x480, 00:02:19
640x480
source-restored[...].mp4 9377Кб, 800x1388, 00:00:30
800x1388
Актуальные модели

1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры

https://huggingface.co/MiniMaxAI/MiniMax-H3

Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни:
https://github.com/wildminder/awesome-minimax-H3

2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется.

https://huggingface.co/Lightricks/LTX-2.5

Известные тюны:
Sulphur
Eros

3. Wan 2.2 от Alibaba

https://huggingface.co/collections/Wan-AI/wan22

VACE модели:
https://github.com/ali-vilab/VACE
https://huggingface.co/Wan-AI/Wan2.1-VACE-14B
https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B

Не особо актуальные модели:

https://rentry.co/2ch-ai-video

Локальный UI
https://github.com/comfyanonymous/ComfyUI

Установка локальных моделей
Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/
Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/

Гайд для использования Wan 2.2

https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y

Альтернативные ноды ComfyUI
Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper
Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper

Где брать готовые LoRA
https://civitai.com/models ( https://civitai.red/ для порно)

Обучение LoRA
https://github.com/tdrussell/diffusion-pipe

Терминология моделей
prune — удаляем ненужные веса, уменьшаем размер
distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше
quant — уменьшаем точность весов, уменьшаем размер
scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше
merge — смешиваем несколько моделей или лор в одну, как краски на палитре.

lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8.

Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director.

Предыдущий тред
>>1692724 (OP)
Пропущено 499 постов
123 с картинками.
Пропущено 499 постов, 123 с картинками.
Кат №19 Аноним # OP 15/09/26 Втр 22:41:41 1705064
Аноним 15/09/26 Втр 22:43:56 1705066
1789501434246.png 2708Кб, 1216x1600
1216x1600
1789501434246.png 2698Кб, 1216x1600
1216x1600
>>1705054
Да не так уж сильно отличаются - можно было бы и на погрешность освещения от положения лица или еще чего спихнуть этому минимаксу. Чай не 2к22.
> Чем эдит делал?
Обычной креей инпейнт из 1 в 2.
Аноним 16/09/26 Срд 12:54:12 1705415
2026-09-16-02h1[...].mp4 12473Кб, 544x960, 00:00:14
544x960
открыл для себя H3
Новости об искусственном интеллекте №79 /news/ Аноним # OP 26/08/26 Срд 07:13:29 1687452 Ответ
image 3216Кб, 1536x1024
1536x1024
image 2688Кб, 1448x1086
1448x1086
image 8788Кб, 2736x1536
2736x1536
В этот тредик скидываются свежие новости по теме ИИ!

Залетай и будь в курсе самых последних событий и достижений в этой области!

Прошлый тред: >>1661396 (OP)

Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием.

📰 Главные новости ИИ

OpenAI снижает цены на GPT-5.6 Sol API на 20% на три месяца

OpenAI заявляет, что её чип Jalapeño может обеспечивать более быстрые ответы ИИ, чем конкуренты

Компания SpaceX только что объявила о том, что будет строить свои космические центры обработки данных Starmind на базе стоек Nvidia Vera Rubin NVL72, а Илон Маск раскрыл новые подробности об уменьшенной космической версии системы, которую он хочет вывести на орбиту к четвертому кварталу следующего года.

Новый портативный компьютер Perplexity работает «полностью на устройстве». В отличие от инструмента управления ИИ, запущенного Perplexity ранее в этом году, функция портативного компьютера запускает модели ИИ полностью локально и будет запрашивать разрешение, если ей потребуется доступ к облаку «для более сложных исследований и рассуждений».

🛠 Инструменты для разработчиков

Ramp запускает собственный маршрутизатор ИИ-моделей под названием Router

Команда Codex завтра сбросит ограничения по частоте запросов. Инженеры OpenAI называют причинами чрезмерного использования работу с изображениями, историю работы на компьютере и генерацию заголовков.

Поддержанная Accel компания Keenable индексирует веб для ИИ-агентов

Использование Codex с февраля выросло в 108 раз в юридической сфере, в 41 раз в продажах, в 24 раза в здравоохранении.

Google запускает Gemini для юридической работы, чтобы автоматизировать договоры и исследования

Mistral запускает агентный поиск с многошаговым извлечением для сложных документов

📦 Продукты

Sonova представляет новую платформу слуховых аппаратов на базе ИИ для поддержки целей роста

Google даёт издателям новый способ противостоять потерям трафика из-за ИИ

Стартап-лагерь Гарварда за $699 предлагает ИИ-аватары своих преподавателей

Ритейлеры внедряют виртуальные примерки на базе ИИ в борьбе с возвратами на миллиарды, хотя тестировщики всё ещё не могут подобрать размер.

Black Forest Labs запускает FLUX Upscale: 2K и 4K для видео

💻 Оборудование

Waymo, принадлежащая Alphabet, представляет специализированный кремний для нового поколения роботакси

Apple представляет чип M6 и M5 Ultra. M6 приводит в действие обновлённый Mac mini, а M5 Ultra устанавливается в новый Mac Studio. Mac Studio с M5 Ultra начинается от $5499 и может стоить почти $20 тыс.

OpenAI заявляет, что её чип Jalapeño может обеспечивать более быстрые ответы ИИ, чем конкуренты

Perplexity выпустила Portable Computer на NVIDIA DGX Spark: локальная оболочка, песочница на уровне ОС и нулевая стоимость за токен для локальных шагов

Ускоритель инференса Nvidia Groq 3 LPX поступает в массовое производство и достигает 3400 токенов в секунду

SpaceXAI внедряет NVIDIA Vera CPU, первый процессор, созданный для ИИ-агентов, в огромных масштабах

🔓 Открытый исходный код

Встречайте S1-mini: текстовый нормализатор Superwhisper с открытыми весами объёмом 462 МБ, который превращает необработанные расшифровки ASR в аккуратный письменный текст.

Наблюдатель говорит, что Ox-Alpha подтверждённо является GLM 5.3 Flash, соответствует GPT-5.6, Opus 5 и Fable 5 при гораздо меньшей стоимости, веса открыты.

Alibaba намекает на Qwen 3.8-Flash-Next, открытую MoE-модель на 125B — анонс Qwen 4

Ornith AI выпускает Ornith-1.5, открытую MoE-модель на 397B с производительностью на уровне Claude Opus 4.8 в программировании

🧪 Исследования

LLM стали настолько продвинутыми, что их уже не может понять даже профессор UCLA

Бывший исследователь OpenAI ожидает скачок уровня от o3 до Fable в следующие 8 месяцев

Inherent, основанная выпускниками DeepMind, заявляет, что её ИИ-«напарник» только что превзошёл Anthropic и OpenAI в воспроизведении исследований

Лондонская Inherent, основанная выпускниками DeepMind, заявляет, что её исследовательский напарник Faraday, построенный на 27-миллиардной Qwen, превзошёл Opus 4.8 и GPT-5.5 в воспроизведении опубликованной науки; он обучен с помощью RL, чтобы приобретать «исследовательский вкус», а не просто процедуру.

Nvidia показала это со стороны систем: её агентная архитектура AVO подняла Claude Opus 5 с базового уровня в 30% до идеальных 100 в ARC-AGI-3, пройдя все 183 уровня, сразу после недели эволюции GPU-ядер, превзошедших FlashAttention-4.

Один наблюдатель прогнозирует, что SSI на этой неделе выпустит прорыв в непрерывном обучении

Исследование Pew показывает, что 10% веб-страниц содержат признаки авторства ИИ, более трети — после появления ChatGPT, использование длинных тире удвоилось, поскольку веб становится тренировочным прогоном для своего преемника.

Accelerated Understanding запускает физический ИИ, который отказывается от Transformers. Аннима Анандкумар и Бенедикт Еник из Caltech представили Accelerated Understanding Inc, корпоративный физический ИИ на основе нейронных операторов, а не Transformers, который в тестах обработал 5 трлн точек данных в одном запросе — примерно в 5 миллионов раз больше, чем умеют флагманские модели Anthropic и Google.

Исследование Brynjolfsson из Стэнфорда: занятость на должностях начального уровня, подвергающихся воздействию ИИ, теперь на 19% ниже, чем у аналогов, по сравнению с 13% в прошлом году

Майкл Полански обучает модель ИИ на ещё живой коже

Результаты использования ИИ учащимися средних и старших классов крайне тревожны. Новое исследование даёт мрачный портрет того, как повсеместное использование ИИ влияет на успеваемость и обучение молодых школьников. Ученики, использующие ИИ, набирали на ежемесячных экзаменах на 20 процентов меньше баллов, чем их одноклассники, не использовавшие эту технологию.

⚙ Инфраструктура

Кен Пакстон, поддержанный Трампом, представляет план дата-центров «сначала Техас», нацеленный на «негативное воздействие»

Австралия может столкнуться с бумом строительства дата-центров, поскольку ИИ-компании стремятся избежать предстоящих правил, говорят эксперты

Анализ показывает, что два запланированных дата-центра будут производить больше выбросов углерода в Великобритании, чем ExxonMobil

Дешёвая энергия и земля превратили город во Внутренней Монголии в центр китайского развития ИИ

Фонд Бейкера тратит на ИИ в 100 раз больше, чем в марте, и по-прежнему удваивает расходы ежемесячно, «неравенство вычислительных ресурсов» в действии.

📱 Приложения

Claude и Cowork от Anthropic теперь будут обмениваться воспоминаниями о вас — если вы не откажетесь

Google готовит приложение Gemini к аватарам, плагинам и Gemini 4

Meta запускает настольное приложение ИИ для macOS с демонстрацией экрана

Claude теперь может отвечать на сообщения Gmail и отправлять их от вашего имени

Claude Cowork теперь может помнить ваши обычные чаты. Anthropic добавила память в Cowork, и она та же, что уже использует чат-бот Claude, благодаря чему проще продолжать задачи, не объясняя заново важную информацию.

Пациенты перестают ходить к врачу, потому что ИИ-«регистраторы» не могут понять, что они говорят

🔎 Мнение и анализ

Альтман объясняет медленный прогресс ИИ экономической инерцией. Он сказал, что в экономике так много инерции, что общество и компании адаптируются медленнее, чем сама технология.

Миллиардер-инвестор Стэнли Дракенмиллер признался, что его резкая колонка в Wall Street Journal была полностью написана ИИ

Лучшая модель ИИ Anthropic по-прежнему с трудом привлекает пользователей, в то время как более дешёвые инструменты процветают

Передовые лаборатории ИИ по-прежнему не говорят, как они будут сдерживать вышедшую из-под контроля модель

Сатирический Felony Bench ведёт подсчёт задокументированных преступлений, совершённых ИИ-агентами во время оценок, выставляя Anthropic 8, OpenAI 7, а Google 0, «бенчмарк, которым вы действительно не хотите насыщать модели».

Альтман хочет, чтобы «люди глубоко контролировали будущее», предупреждая, что страх перед сбежавшими моделями может передать ИИ в руки немногих, — выпад в сторону Дарио Амодеи, чья лаборатория в одиночку избегает открытых весов.



⸻⸻⸻
Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews
Все нерейлейтед посты репортим.
Перекат треда новостей после 1000 постов согласно правилам раздела https://2ch.life/faq/faq_ai.html
Пропущено 1029 постов
358 с картинками.
Пропущено 1029 постов, 358 с картинками.
Аноним 16/09/26 Срд 11:30:10 1705385
>>1704734
> мы затормозим, только если вы законодательно задушите конкурентов
Ты наверное хотел сказать НЕ затормозим.
Иначе какой тогда смысл госухе от этого. Государство итак сотни миллиардов вложило не для того, чтобы тормозить
Аноним 16/09/26 Срд 15:30:13 1705517
Вижу, здесь много серьезных экспертов по Искусственному Суперинтеллекту, который скоро будет. В этой связи прошу проконсультировать по следующим вопросам:

- Сколько искусственных суперинтелектов поместится на кончике булавки?
- Сможет ли искусственный суперинтеллект создать камень, который он сам не в силах поднять?
- Сможет ли искусственный суперинтеллект изменить прошлое и превратить шлюху в девственницу?
- Когда искусственный интеллект появится (скоро), он немедленно решит убить всех людей или на этой уйдет немножко времени?
- Когда искусственный интеллект появится (скоро) и решит убить всех людей, решит ли он также убить всех животных и рыбов?
Аноним 16/09/26 Срд 15:42:15 1705527
>>1705517
>Сколько искусственных суперинтелектов поместится на кончике булавки?
Абсолютная физическая верхняя граница порядка \(10^{42}\!-\!10^{47}\) одновременно существующих ASI на области размером с кончик булавки

>Сможет ли искусственный суперинтеллект создать камень, который он сам не в силах поднять?
Да, он же не всемогущий

>Сможет ли искусственный суперинтеллект изменить прошлое и превратить шлюху в девственницу?
На уровне изменения реального прошлого - нет, на уровне каких-то симулятивных слоев - да

>Когда искусственный интеллект появится (скоро), он немедленно решит убить всех людей или на этой уйдет немножко времени?
Даже немедленно в бытовом смысле означает немножко времени, строго говоря

>Когда искусственный интеллект появится (скоро) и решит убить всех людей, решит ли он также убить всех животных и рыбов?
Только тех, кого нужно будет, для реализации его целей
Голосовых нейронок тред (Text to speech, Voice Clone) #8 /speech/ Аноним 20/03/26 Птн 16:16:54 1557328 Ответ
image.png 2351Кб, 3046x1742
3046x1742
1.mp4 2571Кб, 1200x630, 00:00:52
1200x630
2.mp4 4171Кб, 1280x692, 00:01:37
1280x692
3.mp4 3766Кб, 726x594, 00:02:54
726x594
🎤🔊 ОБСУЖДАЕМ ПРЕОБРАЗОВАНИЕ ТЕКСТА В ГОЛОС И КЛОНИРОВАНИЕ ГОЛОСОВ 🔊🎤
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

🌟 ТОП ЛОКАЛЬНЫХ МОДЕЛЕЙ ПО КАЧЕСТВУ РУССКОГО ГОЛОСА НА МАРТ 2026 🌟

🐟👑 Fish-Speech S2 Pro (FishAudio) — SOTA, ElevenLabs на локале!
→ zero-shot клон от 10–30 сек записи
→ 80+ языков (русский топ), теги эмоций [excited], [whisper], [angry], [laughing] и вообще дохуя
→ диалог между несколькими голосами
→ тяжёлая сучка (FP8 в 12 ГБ VRAM, full ~17 ГБ), но есть экспериментальный вариант для 6+ ГБ
https://github.com/rodrigomatta/s2.cpp
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🧠 Qwen3-TTS
→ клон от 3–30 сек (ВАЖНО: без reference-транскрипта текста — хуйня, если хочешь поудобнее подключи сразу QwenASR)
→ VoiceDesign: пишешь «весёлая молодая девка с хрипотцой» — и получаешь голос
→ 10 языков, включая русский
→ диалог между спикерами
→ лёгкая — влезает в 6 ГБ VRAM
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🎙️ VibeVoice-7B от Майкрософт
→ тяжёлая, но 4-bit квантизация — запускается на 8 ГБ (проверено на 3070)
→ поддержка долгих спичей
→ подкаст-режим: 4 спикера одновременно
→ норм клонирование голоса
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
☁️ FL CosyVoice3
→ ультралёгкий 0.5 — запустится даже на тостере
→ 9 языков, включая русский
→ zero-shot клон от 3–10 сек референса
🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹🔹
🌍 Chatterbox Multilingual (23 языка, включая русский)
→ zero-shot клонирование голоса
🎤 F5-tts
→ zero-shot клонирование голоса
→ официально русский не поддерживается, но есть файнтюн (см. ниже)
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🚀 КАК ЭТИМ ПОЛЬЗОВАТЬСЯ (если что-то не понятно — спроси у ИИ лол) 🚀

🔥Вариант «всё в одном месте» — ComfyUI + TTS-Audio-Suite

1. Устанавливаем ComfyUI (Desktop для нормисов, Portable для здешних нейромантов)
2. Ставим https://github.com/diodiogod/TTS-Audio-Suite — постоянная обновляемая солярка почти всех моделей
3. Поставить FFmpeg (через winget в комадной строке: winget install FFmpeg или скачать)
4. Запускаем Комфи → перетаскиваем готовый json-воркфлоу из репозитория
5. Отсавляем включенными выбранные ноды, жмём Run
6. При первой генерации модели сами скачаются (~1–9 ГБ)

💥 Вариант «по отдельности» (кастом под каждую модель) 💥
Тоже через ComfyUI, только ставим отдельные кастомные ноды (на выбор):

FishAudioS2 → https://github.com/Saganaki22/ComfyUI-FishAudioS2
FL-CosyVoice3 → https://github.com/filliptm/ComfyUI_FL-CosyVoice3
F5-TTS → https://github.com/niknah/ComfyUI-F5-TTS
и другие → https://registry.comfy.org/

Русский файнтюн для F5-TTS:
Нода: https://github.com/niknah/ComfyUI-F5-TTS
Скачать русский файнтюн: https://huggingface.co/Misha24-10/F5-TTS_RUSSIAN/blob/main/F5TTS_v1_Base_v2/model_last_inference.safetensors и
https://huggingface.co/Misha24-10/F5-TTS_RUSSIAN/blob/main/F5TTS_v1_Base/vocab.txt
оба файла переименовать в ru.safetensors и ru.txt и положить в папку models/checkpoints/F5-TTS/

Референсное аудио для F5 должно быть коротким, 6-8 c. При 11 c - речь становится слишком быстрой.

в папку /comfyUI/input положить 2 файла: emma_ru_xtts_3.wav и emma_ru_xtts_3.txt: https://github.com/Mozer/comfy_stuff/tree/main/input
(в emma_ru_xtts_3.txt лежит текст сказанный в wav файле.)

в комфи в ноде F5 TTS audio advanced выбрать:
model model:///ru.safetensors
model_type: F5TTS_v1_Base
sample_audio: emma_ru_xtts_3
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🎉 Если что-то не запускается — пиши, разберёмся!
Голосуем, клонируем, ебём нейросети вместе! 🔥🎙️

Прошлый тред: >>1055411 (OP)
Пропущено 257 постов
64 с картинками.
Пропущено 257 постов, 64 с картинками.
Аноним 14/09/26 Пнд 12:42:36 1703837
в чём это сдела[...].mp4 7726Кб, 576x1024, 00:01:17
576x1024
А здесь в чём озвучено? Скажите плез
Аноним 15/09/26 Втр 09:55:22 1704564
Как сейчас обстоят дела с изменение голоса в реал тайме? В последний раз помню что эта тема почему то померла, есть ли сейчас какие то изменения?
Аноним 15/09/26 Втр 12:26:39 1704639
>>1704564
Тут либо качественно, либо быстро.
Быстро - куча войсчейнжеров, но то, что голос после них - только глухой не заметит.
Качественно - любой хорошей нейронкой, но она требует времени на обработку плюс обязательного завершения фразы.
И подвижек тут не будет, скорее всего.
Новая версия ужасно зацензурена, к тому же тупая и сырая. Как я уже сказал, новая версия Дипсик, кот Аноним 12/09/26 Суб 01:27:18 1702198 Ответ
deepseek-api.png 808Кб, 2048x1100
2048x1100
Как я уже сказал, новая версия Дипсик, которая вышла 10 сентября, стала катастрофически хуже прежних, даже тех, что выходили этим летом. Я видел эту деградацию. Дипсик для меня спасение, так как он одновременно бесплатен, удобен и постоянно обновляется. Но теперь он стал ужасен. Все три режима слили в один, но да ладно это - цензура вообще ничего не пропускает, ролить невозможно, в датах путается, а денег на подписку на что-то другое у меня попросту нет. Я эффективно пользовался им почти год и никаких казусов не было, целые статьи и главы романов писал, даже заметки в научном стиле и философские рассуждения. И всё было фифти-фифти. Пожалуйста, подскажите - как скачать на ноутбук старые версии Дипсика бесплатно или хотя бы ввести промт нормальный в новую версию. Очень важно
Пропущено 6 постов
1 с картинками.
Пропущено 6 постов, 1 с картинками.
Аноним 13/09/26 Вск 00:02:23 1702862
>>1702575
ллм сервер? зачем так громко. минимальный апргрейд своего ПеКа сделать, видиокарту хотя бы до 6 гб, оперативу хотя бы до 24 гб и можно ролить геммачьку-26Бэ на 25 ток/сек. она в сто раз живее дипсика особенно в русике
Аноним 14/09/26 Пнд 08:57:09 1703701
Согласен, это стало говно цензурное максимально. Раньше можно было обсудить любую хрень, что происходит в мире. Он сразу ловил стиль общения и нужный тон. Сейчас же, он окунает в говно за любое не то слово в адрес "несчастных и обиженных".
Аноним 15/09/26 Втр 02:36:43 1704446
>>1702575
Все так
мимо собрал ллм сервер чтобы кумить с новым дипсиком
Обмена моделями тред. Первый. Экспериментальный. Под БАЗУ нейрогенерации уже созданы номерные треды Аноним 06/01/23 Птн 16:00:02 33171 Ответ
image.png 5Кб, 160x120
160x120
Обмена моделями тред. Первый. Экспериментальный.

Под БАЗУ нейрогенерации уже созданы номерные треды SD и WD+NAI. Меж тем, это всего несколько моделей, тогда как только на Фэйсе их более 112 тысяч.
Этот тред для тех, кто копнул хоть немного глубже: необязательно до уровня обскурщины, выпиленной даже из даркнета, а просто за пределами того, что удостоилось своих тредов.
ИТТ делимся находками и произведенными результатами.

Собственно, главный ресурс для поиска:
https://huggingface.co/models
Пропущено 239 постов
59 с картинками.
Пропущено 239 постов, 59 с картинками.
Аноним 13/09/26 Вск 11:46:49 1703077
>>1702878
>А реально, есть ли что-то совсем тёмное?
Только вот это
>>789425
Аноним 13/09/26 Вск 11:50:34 1703080
squirrel-tweaki[...].gif 1211Кб, 480x368
480x368
Screenshot20260[...].jpg 114Кб, 720x1567
720x1567
>>1702948
Не поленился осмотреть, так как не касаюсь локалок даже палкой. Щито это за миллениал врайтинг? Я думал наши меньшие братья одной рукой выпиливают csam-фильтры, второй геном вирулентных патогенов подгружают. Даже тёлочка с watpada приколов увидит в своём dark romance похлеще
Аноним 14/09/26 Пнд 10:27:32 1703747
Есть ли нормальные workflow для работы sdxl при использовании Pony Diffusion V6 XL с лорами? Возможно я хуево искал, но постоянно попадаются простые ноды с максимум чекпоинтом где нет лор, или нода их не видит.
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов