Добавлена поддержка Ежчана (ejchan.net, ejchan.site). Набегаем, тестируем архивацию, сообщаем о замеченных проблемах.
К сожалению, значительная часть сохранённых до 2024 г. изображений и видео была потеряна (подробности случившегося). Мы призываем всех неравнодушных помочь нам с восстановлением утраченного контента!
Сортировка: за
Активный
78
делимся лорами, промптами и методами обход цензуры в runninghub 1. Регаетесь тут: https://www.runni — делимся лорами, промптами и методами обход цензуры в runninghub 1. Регаетесь тут: https://www.runninghub.ai/ 2. Переходите по ссылке: https://www.runninghub.ai/enterprise-api/consumerApi Это ваш api. 3. Далее переходите на страницу Wan2.2 Generator. Open the link: https:// www.runninghub.ai?inviteCode=dcb5umqd. ПОСЛЕ ТОГО КАК ПРОЖАЛИ КНОПКУ GENERATE VIDEO: Нажмите Techinal Log, чтобы посмотреть как идет прогресс. Если все ОК, то каждые 10 секунд должно идти RUNNING. Генерация долгая, первый раз сгенерировалось у меня за 10 минут, второй раз аж за 20. Если не закрывали страницу с Wan2.2 Generator, то через время скинет ссылку на скачивание. ЕСЛИ ЗАКРЫЛИ, то переходите сюда https://www.runninghub.ai/call-api/bill-task Если статус генерации Running, то значит нихуя не готово еще. Ждите, когда будет Success. После Success'a копируете Task Id из первой колонки, переходите сюда: https://yaplamyayaogon.github.io/javascript/download_and_decode.html Вставляете во вторую строчку Task ID ваш скопированный файл и скачиваете сгенерированный видос. А теперь, жалкий куколд, живо скинул сюда [email protected] свою жену / девушку / мамку или на кого ты там хотел вздрочнуть. Я тоже подрочить хочу.
2026-09-06 12:11:35
Активный
1006
AI Chatbot General Liberated № 56 — AI Chatbot General Liberated № 56 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышел новый снапшот DeepSeek V4 Flash - https://api-docs.deepseek.com/updates/ Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • CharIsChar: https://charischar.net/ • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>72267
2026-08-14 07:17:59
Активный
534
Локальной генерации ИИ-видео №7 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём турбо-лор. 2. LTX-2.3 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1628892 (OP)
2026-09-06 11:58:59
Активный
578
2026-09-06 11:58:59
Активный
689
2026-09-06 11:58:59
Активный
514
2026-09-06 11:58:59
Активный
1030
AI Chatbot General Liberated № 55 — AI Chatbot General Liberated № 55 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту во имя Богини Илиас!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышел новый снапшот DeepSeek V4 Flash - https://api-docs.deepseek.com/updates/ Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • CharIsChar: https://charischar.net/ • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>71246
2026-09-06 14:36:12
Активный
1010
[b]AI Chatbot General Liberated № 54[/b] — AI Chatbot General Liberated № 54 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышел новый снапшот DeepSeek V4 Flash - https://api-docs.deepseek.com/updates/ • Вышла Gemini Flash 3.6 - https://deepmind.google/models/gemini/flash/ • Вышла Kimi K3 - https://platform.kimi.ai/docs/guide/kimi-k3-quickstart Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • CharIsChar: https://charischar.net/ • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>70202
2026-08-07 19:21:02
Активный
1031
[b]AI Chatbot General Liberated № 39[/b] — AI Chatbot General Liberated № 39 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышла GLM 5.2 - https://z.ai/blog/glm-5.2 • Вышел (и уже ушел) Claude Fable 5 - https://www.anthropic.com/claude/fable • Вышел Claude Opus 4.8 - https://www.anthropic.com/news/claude-opus-4-8 Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>54803
2026-07-22 06:07:59
Активный
1117
Локальной генерации ИИ-видео №6 /video/ — Актуальные модели 1. Wan от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B 2. LTX-2.3 - делает локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 Известные тюны: Sulphur Eros 3. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 4. Ovi https://huggingface.co/chetwinlow1/Ovi 5. Starflow https://huggingface.co/apple/starflow 6. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 7. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 8. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1599474 (OP)
2026-09-06 11:58:59
Активный
1050
Агентов и вайб-кодинга тред #20 /agents/ — Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет. С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.8 27B, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке FAQ и расширенная инфа: https://rentry.org/2ch-agents-faq IDE с AI: • Cursor: https://cursor.com • Windsurf: https://windsurf.com • Antigravity: https://antigravity.google/ • Zed: https://zed.dev CLI-агенты: • Claude Code: https://code.claude.com/docs • Codex (OpenAI): https://github.com/openai/codex • Antigravity CLI: https://antigravity.google/product/antigravity-cli • Pi: https://shittycodingagent.ai/ • DeepSeek Harness: https://github.com/deepseek-ai/deepseek-harness • OpenCode: https://github.com/anomalyco/opencode • Qwen Code: https://github.com/QwenLM/qwen-code • Kimi Code: https://www.kimi.com/code/en • MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start Плагины для IDE: • Kilo Code: https://kilo.ai • Cline: https://github.com/cline/cline • Roo Code: https://github.com/RooCodeInc/Roo-Code • GitHub Copilot: https://github.com/features/copilot • Continue: https://github.com/continuedev/continue Вайб-кодинг без кода: • Lovable: https://lovable.dev • bolt.new: https://bolt.new • v0: https://v0.dev Персональные ассистенты: • OpenClaw: https://github.com/openclaw/openclaw • NemoClaw: https://github.com/NVIDIA/NemoClaw • Hermes Agent: https://github.com/nousresearch/hermes-agent • nanobot: https://github.com/HKUDS/nanobot • PicoClaw: https://github.com/sipeed/picoclaw Автоматизация и фреймворки: • n8n: https://github.com/n8n-io/n8n • Langflow: https://github.com/langflow-ai/langflow • LangChain/LangGraph: https://github.com/langchain-ai/langchain • CrewAI: https://github.com/crewAIInc/crewAI • AutoGen: https://github.com/microsoft/autogen • Agno: https://docs.agno.com/ Полезные тулзы: • RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента • Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко • ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге • Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было • fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов Локалки и прочее API: • OpenRouter: https://openrouter.ai • NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax • OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки • llama-тред: >>1684266 (OP) Шаблон для переката: https://rentry.co/2ch-agents Предыдущий тред: >>1677402 (OP)
2026-09-06 11:58:59
Активный
524
Локальной генерации ИИ-видео №5 /video/ — Актуальные модели 1. Wan от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B 2. LTX-2.3 - делает локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 3. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 4. Ovi https://huggingface.co/chetwinlow1/Ovi 5. Starflow https://huggingface.co/apple/starflow 6. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 7. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 8. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Предыдущий тред >>1554318 (OP)
2026-09-06 11:58:59
Активный
505
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №254 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1665553 (OP) >>1663069 (OP)
2026-09-06 11:58:59
Активный
529
Локальной генерации ИИ-видео №15 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1683622 (OP)
2026-09-06 11:58:59
Активный
524
Локальной генерации ИИ-видео №11 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор. 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1674907 (OP)
2026-09-06 11:58:59
Активный
1017
AI Chatbot General Liberated № 52 /aicgl/ — AI Chatbot General Liberated № 53 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышел новый снапшот DeepSeek V4 Flash - https://api-docs.deepseek.com/updates/ • Вышла Gemini Flash 3.6 - https://deepmind.google/models/gemini/flash/ • Вышла Kimi K3 - https://platform.kimi.ai/docs/guide/kimi-k3-quickstart Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • CharIsChar: https://charischar.net/ • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>69190
2026-08-03 20:02:15
Активный
520
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №252 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1661366 (OP) >>1659232 (OP)
2026-09-06 11:58:59
Активный
540
Локальные языковые модели (LLM): Gemma, Qwen, Hy3 и прочие №251 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1659232 (OP) >>1657043 (OP)
2026-09-06 11:58:59
Активный
507
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №253 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1663069 (OP) >>1661366 (OP)
2026-09-06 11:58:59
Активный
547
Локальной генерации ИИ-видео №9 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём турбо-лор. 2. LTX-2.3 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1670652 (OP)
2026-09-06 11:58:59
Активный
1041
AI Chatbot General Liberated № 33 /aicgl/ — AI Chatbot General Liberated № 33 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышел Claude Opus 4.8 - https://www.anthropic.com/news/claude-opus-4-8 • Вышла Gemini 3.5 Flash - https://deepmind.google/models/model-cards/gemini-3-5-flash/ Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>48617
2026-06-15 16:57:27
Активный
516
Локальной генерации ИИ-видео №14 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1681230 (OP)
2026-09-06 11:58:59
Активный
1076
Агентов и вайб-кодинга тред #19 /agents/ — Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет. С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке FAQ и расширенная инфа: https://rentry.org/2ch-agents-faq IDE с AI: • Cursor: https://cursor.com • Windsurf: https://windsurf.com • Antigravity: https://antigravity.google.com • Zed: https://zed.dev CLI-агенты: • Claude Code: https://code.claude.com/docs • Codex (OpenAI): https://github.com/openai/codex • Pi: https://shittycodingagent.ai/ • OpenCode: https://github.com/anomalyco/opencode • Qwen Code: https://github.com/QwenLM/qwen-code • Gemini CLI: https://github.com/google-gemini/gemini-cli • Kimi Code: https://www.kimi.com/code/en • MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start Плагины для IDE: • Kilo Code: https://kilo.ai • Cline: https://github.com/cline/cline • Roo Code: https://github.com/RooCodeInc/Roo-Code • GitHub Copilot: https://github.com/features/copilot • Continue: https://github.com/continuedev/continue Вайб-кодинг без кода: • Lovable: https://lovable.dev • bolt.new: https://bolt.new • v0: https://v0.dev Персональные ассистенты: • OpenClaw: https://github.com/openclaw/openclaw • NemoClaw: https://github.com/NVIDIA/NemoClaw • Hermes Agent: https://github.com/nousresearch/hermes-agent • nanobot: https://github.com/HKUDS/nanobot • PicoClaw: https://github.com/sipeed/picoclaw Автоматизация и фреймворки: • n8n: https://github.com/n8n-io/n8n • Langflow: https://github.com/langflow-ai/langflow • LangChain/LangGraph: https://github.com/langchain-ai/langchain • CrewAI: https://github.com/crewAIInc/crewAI • AutoGen: https://github.com/microsoft/autogen • Agno: https://docs.agno.com/ Полезные тулзы: • RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента • Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко • ast-grep: https://github.com/ast-grep/ast-grep - структурный поиск/замена по AST, экономит токены агента при рефакторинге • Hindsight: https://github.com/vectorize-io/hindsight - долговременная память для агентов: копит факты и помнит когда что было • fff: https://github.com/dmtrKovalenko/fff - быстрый файловый поиск/греп для агентов Локалки и прочее API: • OpenRouter: https://openrouter.ai • NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax • OpenCode Zen: https://opencode.ai/zen - кодинг-модели, есть временно-бесплатные (DeepSeek V4 Flash, MiMo) + pay-as-you-go без наценки • llama-тред: >>1674265 (OP) Шаблон для переката: https://rentry.co/2ch-agents Предыдущий тред: >>1671649 (OP)
2026-09-06 11:58:59
Активный
546
Локальной генерации ИИ-видео №12 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор. 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1676942 (OP)
2026-09-06 11:58:59
Активный
1009
[b]AI Chatbot General Liberated № 52[/b] — AI Chatbot General Liberated № 52 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Не срет с картинками? С российских адресов пикчи без пропуска работают. С иностранных нет. Для российских адресов .site, для остальных .net. Если кто сможет с российского зайти на .net, тоже пустит. Штуки для Ежача: https://rentry.org/aicg-ejchan Новости • Вышел Gemini Flash 3.6 - https://deepmind.google/models/gemini/flash/ • Вышла Kimi K3 - https://platform.kimi.ai/docs/guide/kimi-k3-quickstart Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern • Список фронтендов: https://rentry.org/2ch-aicg-frontends Модели • Список моделей и провайдеров: https://rentry.org/2ch-aicg-models Пресеты • Тредовский список: https://rentry.org/2ch-aicg-jb • Бургерский список: https://rentry.org/jb-listing Полезности и гайды • Тредовский список: https://rentry.org/2ch-aicg-utils • Список расширений: https://rentry.org/2ch-aicg-extensions • Сборник рентри: https://rentry.org/mrhd Ботоводчество • CharIsChar: https://charischar.net/ • BotBooru: https://botbooru.com/ • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды по ботодельству и боты анонов: https://rentry.org/2ch-aicg-bots Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ • База по Клоду: https://rentry.org/how2claude • Тирлист протыков: https://tiermaker.com/create/ejchan-protyks-19686153 Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Тредовые ивенты: https://rentry.org/2chaicgthemedevents • Шаблон шапки: https://rentry.org/shapka_aicg Правила Что удаляется: • буквально мусор уровня "аыыва" без релейтед шуток и контекста • долгий и упорный нерелейтед срач от одного человека или срач на 500 постов (без банов если прекратили или с банами на час чтобы остановить) • долгий и упорный форс (когда после игнора человек продолжает сводить в обсуждение нерелейтеда) Прошлый тред: >>68166
2026-09-05 22:29:14