Добавлена поддержка Ежчана (ejchan.net, ejchan.site). Набегаем, тестируем архивацию, сообщаем о замеченных проблемах.
К сожалению, значительная часть сохранённых до 2024 г. изображений и видео была потеряна (подробности случившегося). Мы призываем всех неравнодушных помочь нам с восстановлением утраченного контента!
Сортировка: за
Активный
609
Локальной генерации ИИ-видео №8 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём турбо-лор. 2. LTX-2.3 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1668832 (OP)
2026-09-09 12:17:02
Активный
593
Локальной генерации ИИ-видео №10 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор. 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1672944 (OP)
2026-09-09 12:17:02
Активный
582
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №260 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1684266 (OP) >>1681448 (OP)
2026-09-09 12:17:02
Активный
578
2026-09-09 12:17:02
Активный
576
2026-09-09 12:17:02
Активный
550
Локальной генерации ИИ-видео №13 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1678667 (OP)
2026-09-09 12:17:02
Активный
547
Локальной генерации ИИ-видео №9 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём турбо-лор. 2. LTX-2.3 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1670652 (OP)
2026-09-09 12:17:02
Активный
546
Локальной генерации ИИ-видео №12 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор. 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1676942 (OP)
2026-09-09 12:17:02
Активный
539
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №256 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1671563 (OP) >>1668203 (OP)
2026-09-09 12:17:02
Активный
534
Локальной генерации ИИ-видео №7 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём турбо-лор. 2. LTX-2.3 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1628892 (OP)
2026-09-09 12:17:02
Активный
533
Новости об искусственном интеллекте №76 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1632174 (OP) Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием. ???? Последний обзор ИИ новостей: ???? Главные новости ИИ OpenAI выпускает модели GPT 5.6 Sol Ultra, Sol, GPT 5.6 Terra и GPT 5.6 Luna в ограниченный показ. Лучшая из моделей приближается к уровню Mythos по показателям. Публикация моделей для всех по обещаниям OpenAI в ближайшие недели. ???? Инструменты для разработчиков - Google делает Interactions API интерфейсом по умолчанию для моделей и агентов Gemini - Chrome DevTools позволяет ИИ-агентам анализировать состояние приложений. Теперь ваши приложения и фреймворки могут предоставлять ИИ-агентам прямой доступ к своему внутреннему состоянию. - NVIDIA представила BioNeMo Agent Toolkit, который предоставляет ИИ-агентам вызываемые инструменты для наук о жизни. ???? Продукты - Gemini в Chrome теперь может видеть именно то, на что вы смотрите на экране - Google тестирует голосовой ввод и Magic Pointer в настольной версии Gemini. Приложение Google Gemini тестирует общесистемный голосовой ввод, отслеживание курсора и возможное связывание устройств. ???? Оборудование - OpenAI и Broadcom представили чип для инференса, оптимизированный под большие языковые модели. - IBM представила чипы с техпроцессом менее 1 нанометра, 0,7-нм узел "nanostack", вмещающий почти 100 миллиардов транзисторов на площади ногтевой пластины, обещая повышение эффективности до 70% в течение пяти лет. - Память — это новая нефть, поскольку Micron стала королем маржи в технологическом секторе с рекордным показателем 84,9 процента, опубликовав рекордную выручку и рыночную капитализацию в триллион долларов на фоне 7-кратного роста объемов данных, и отметив, что человекоподобный робот вмещает в десять раз больше памяти, чем автомобиль. - Инференс становится кастомным, поскольку Qualcomm купила Modular, чтобы бросить вызов CUDA, и представила свой процессор Dragonfly C1000, сделав Meta своим первым клиентом. ???? Открытый исходный код - DeepReinforce выпускает Ornith-1.0: семейство моделей для написания кода с открытым исходным кодом, которое обучается собственным вспомогательным структурам обучения с подкреплением. По бенчам догнал и местами обогнал Opus 4.8. - Linux Foundation и 20 технологических гигантов запускают Akrites для устранения уязвимостей в открытом исходном коде до того, как начнутся атаки с использованием ИИ - Krea 2 открывает исходный код передовой модели преобразования текста в изображение. ???? Исследования - Ученые впервые записали активность отдельных нейронов в мозге билингвов и обнаружили, что мозг не переводит слова, а вместо этого делает нечто очень похожее на изоморфизм векторного пространства в больших языковых моделях - Исследования платформы для онлайн-монтажа видео Kapwing показали, что почти 60% видео в TikTok представляют собой ИИ-мусор, и то же самое справедливо для 21% видео на YouTube - Новый бенчмарк показывает, насколько плохо ИИ справляется с реальным интеллектуальным трудом. Даже лучшая модель ИИ терпит неудачу в реалистичных задачах интеллектуального труда, полностью решая лишь 3 процента заданий. - Un-0 от Unconventional AI генерирует изображения на смоделированной решетке связанных осцилляторов Курамото — физическом субстрате, стремящемся к 1000-кратному повышению энергоэффективности при сохранении качества, с которым были запущены ведущие генераторы изображений. - Анализ 1604 вакансий в шести китайских лабораториях показал, что они по-прежнему полагаются на Nvidia, параллельно создавая отечественные чипы и центры обработки данных, нанимая инженеров с опытом работы в три раза меньшим, чем требуют американские лаборатории. - Илон Маск говорит, что Neuralink может попытаться осуществить телепатию между мозгами через латентное пространство в этом году. - Сэм Альтман выплачивал людям по 1000 долларов в месяц в течение 3 лет. Некоммерческая организация Альтмана OpenResearch провела крупнейшее на сегодняшний день в США исследование так называемого безусловного базового дохода. - OpenAI опубликовала разбор практического примера, показывающий, как GPT-5 Pro помогает иммунологу Дери Унутмаз вернуться к разгадке трехлетней тайны, связанной с Т-клетками. ⚙ Инфраструктура - Подавляющее большинство избирателей — как демократов, так и республиканцев — поддерживают мораторий на строительство центров обработки данных для ИИ - Это часть третьей волны инфляции, расходящейся от центров обработки данных ИИ до счетов за электричество, и Тим Кук называет этот скачок непохожим ни на что за четыре десятилетия. - Поддерживаемая NVIDIA компания Eco Wave Power планирует запитать центр обработки данных от океанских волн. Eco Wave Power, участник инициативы Sustainable Futures в рамках программы для стартапов NVIDIA Inception, разрабатывает технологию — работающую на базе ИИ-инфраструктуры и цифровых двойников NVIDIA — которая преобразует энергию океанских волн в чистую электроэнергию с использованием существующей морской инфраструктуры. ???? Приложения - Согласно документам, Meta планирует выпустить приложение для рынка прогнозов на базе ИИ. ???? Мнение и анализ - Исследователи из Graphistry также предположили, что GLM-5.2 может быть «нелегальной дистилляцией как GPT-5.5, так и Opus 4.8» — заявление, которое, если оно соответствует действительности, может помочь объяснить, как китайские модели стремительно сокращают разрыв с американскими конкурентами. - Я встретился с ведущими экспертами по ИИ в Китае. Они тоже в панике. Гонка вооружений ИИ между Китаем и США вызывает у исследователей с обеих сторон опасения по поводу «момента Чернобыля». - Билл Гёрли из Benchmark Capital задается вопросом, почему общий искусственный интеллект может вылечить рак, но не может обнаружить дистилляцию модели в реальном времени - Брайан Роэммел называет раны, нанесенные ИИ-индустрии и экономике США, самонанесенными, предсказывая, что веса моделей класса Mythos и OpenAI-6 станут бесплатными и открытыми через восемь месяцев. - Бывший сотрудник OpenAI предупреждает об ИИ-апокалипсисе в 2027 году. Вскоре машины могут начать считать нас досадной помехой. Бывший сотрудник OpenAI Даниэль Кокотайло ожидает появления искусственного суперинтеллекта уже в следующем году. ⚠ Безопасность ИИ - Новая модель с открытым исходным кодом из Китая усиливает угрозу ИИ-взлома. Два независимых исследования безопасности, проведенные Graphistry и Semgrep, показали, что GLM-5.2 демонстрирует результаты наравне с ведущими американскими моделями в бенчмарках по расследованию киберинцидентов и обнаружению уязвимостей. - Хакеры уже обсуждают на русскоязычных форумах, насколько легко взломать GLM-5.2 для выполнения хакерских задач, сообщил Axios Джейсон Бейкер, управляющий консультант по безопасности в GuidePoint Security. - Anthropic обвиняет Alibaba в кампании по «наглому» и «незаконному» извлечению возможностей ИИ. Anthropic заявляет, что Alibaba украла 29 миллионов диалогов с Claude - Исследователи в области безопасности выявили множество вредоносных навыков на маркетплейсе для экосистемы OpenClaw, которые могут красть учетные данные, обходить проверки безопасности и осуществлять другую новую вредоносную деятельность ради финансовой выгоды злоумышленника. - Рохит Кришнан предупреждает, что неавторизованные китайские реселлеры, предлагающие доступ к API Claude с большими скидками, могут совершать мошенничество с подменой модели. Реселлеры якобы подменяют Claude Opus на GLM или DeepSeek. ???? Бизнес - Компании спешно принимают меры, чтобы не дать сотрудникам исчерпать бюджеты на ИИ мелкими задачами. ???? Компании - Сооснователь Anthropic раскрыл, что ИИ сократил двухмесячную задачу по перетасовке данных до одной недели: «Не думаю, что кто-то этого упустит. - АНБ потеряло доступ к Mythos на фоне спора с Anthropic - DeepSeek планирует массовый найм на фоне эскалации войны за ИИ-таланты в Китае. ИИ-резюме: DeepSeek заявила, что значительно расширит штат инженеров, стремясь удвоить численность сотрудников после получения нового финансирования, поскольку меняет стратегию в сторону более тяжелых моделей ИИ. ⸻⸻⸻ Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews Все нерейлейтед посты репортим.
2026-09-09 12:17:02
Активный
531
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №264 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1694457 (OP) >>1692081 (OP)
2026-09-09 12:17:02
Активный
530
Локальной генерации ИИ-видео №16 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1685560 (OP)
2026-09-09 12:17:02
Активный
529
Локальной генерации ИИ-видео №15 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1683622 (OP)
2026-09-09 12:17:02
Активный
525
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №258 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1678431 (OP) >>1674265 (OP)
2026-09-09 12:17:02
Активный
524
Локальной генерации ИИ-видео №11 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Ждём фикса турбо-лор. 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1674907 (OP)
2026-09-09 12:17:02
Активный
524
Локальной генерации ИИ-видео №5 /video/ — Актуальные модели 1. Wan от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B 2. LTX-2.3 - делает локальную генерацию грейт агейн. Подходят лоры от 2.0 https://huggingface.co/Lightricks/LTX-2.3 3. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 4. Ovi https://huggingface.co/chetwinlow1/Ovi 5. Starflow https://huggingface.co/apple/starflow 6. MAGI-1 от Sand AI https://sand.ai/magi https://github.com/SandAI-org/MAGI-1 7. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 8. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Предыдущий тред >>1554318 (OP)
2026-09-09 12:17:02
Активный
523
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №262 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1689903 (OP) >>1687604 (OP)
2026-09-09 12:17:02
Активный
522
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №257 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1674265 (OP) >>1671563 (OP)
2026-09-09 12:17:02
Активный
522
2026-09-09 12:17:02
Активный
516
Локальной генерации ИИ-видео №14 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1681230 (OP)
2026-09-09 12:17:02
Активный
514
Локальной генерации ИИ-видео №17 /video/ — Актуальные модели 1. MiniMax-H3 от MiniMax - Качество корпоратов на вашем ПК без цензуры https://huggingface.co/MiniMaxAI/MiniMax-H3 Принимает на вход тексты, пикчи, звук, видео и может делать с ними всякое. Неофициально умеет генерить/редачить пикчи. Absolute Cinema. Набор полезных ссылок на все случаи жизни: https://github.com/wildminder/awesome-minimax-H3 2. LTX-2.5 - обещает сделать локальную генерацию грейт агейн. Подходят лоры от 2.0, то есть архитектура нихуя не меняется. https://huggingface.co/Lightricks/LTX-2.5 Известные тюны: Sulphur Eros 3. Wan 2.2 от Alibaba https://huggingface.co/collections/Wan-AI/wan22 VACE модели: https://github.com/ali-vilab/VACE https://huggingface.co/Wan-AI/Wan2.1-VACE-14B https://huggingface.co/Wan-AI/Wan2.1-VACE-1.3B Не особо актуальные модели: 4. Hunyuan от Tencent https://huggingface.co/tencent/HunyuanVideo-1.5 5. Ovi https://huggingface.co/chetwinlow1/Ovi 6. Starflow https://huggingface.co/apple/starflow 7. MAGI-2-preview от Sand AI https://sand.ai/magi https://huggingface.co/sand-ai/MAGI-2-preview 8. LongCat-Video https://github.com/meituan-longcat/LongCat-Video https://huggingface.co/meituan-longcat/LongCat-Video https://meituan-longcat.github.io/LongCat-Video/ 9. MOVA https://github.com/OpenMOSS/MOVA Локальный UI https://github.com/comfyanonymous/ComfyUI Установка локальных моделей Wan 2.2: https://comfyanonymous.github.io/ComfyUI_examples/wan22/ Wan 2.1: https://comfyanonymous.github.io/ComfyUI_examples/wan/ Hunyuan Video (осторожно, ссылки в туторе на предыдущую модель): https://comfyanonymous.github.io/ComfyUI_examples/hunyuan_video/ Гайд для использования Wan 2.2 https://alidocs.dingtalk.com/i/nodes/EpGBa2Lm8aZxe5myC99MelA2WgN7R35y Альтернативные ноды ComfyUI Hunyuan Video: https://github.com/kijai/ComfyUI-HunyuanVideoWrapper Wan: https://github.com/kijai/ComfyUI-WanVideoWrapper Где брать готовые LoRA https://civitai.com/models Обучение LoRA https://github.com/tdrussell/diffusion-pipe Терминология моделей prune — удаляем ненужные веса, уменьшаем размер distill — берем модель побольше, обучаем на ее результатах модель поменьше, итоговый размер меньше quant — уменьшаем точность весов, уменьшаем размер scale — квантуем чуть толще, чем обычный fp8, чтобы качество было чуть лучше, уменьшение чуть меньше, чем у обычного квантования, но качество лучше merge — смешиваем несколько моделей или лор в одну, как краски на палитре. lightning/fast/turbo — а вот это уже просто название конкретных лор или моделей, которые обучены генерировать видео на малом количестве шагов, они от разных авторов и называться могут как угодно, хоть sonic, хоть sapogi skorohody, главное, что они позволяют не за 20 шагов генерить, а за 2-3-4-6-8. Кейворды для дополнительных вещей: SVI, RuneXX, LTX Director. Предыдущий тред >>1689364 (OP)
2026-09-10 19:33:28
Активный
514
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №259 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Гайд для новичков: https://rentry.org/2ch-llama-inference Инструменты для запуска на десктопах: • llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen • TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai Универсальные десктопные фронтенды: • SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern • Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine • Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Поставщики локальных моделей: • Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models • Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth Рейтинги и списки локальных моделей: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Готовые карточки для таверны: • Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com • Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai • Архив карточек, удадённых с chub: https://gottasaveemall.github.io/ Официальные документации к инструментам: • llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md • koboldcpp: https://github.com/LostRuins/koboldcpp/wiki • SillyTavern: https://docs.sillytavern.app/usage/quick-start Дополнительные ссылки: • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1681448 (OP) >>1678431 (OP)
2026-09-09 12:17:02
Активный
514
2026-09-09 12:17:02
Активный
512
AI Chatbot General № 836 /aicg/ — AI Chatbot General № 836 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна) • Гайды на таверну: https://rentry.co/Tavern4Retards • Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8 Модели • Claude: https://docs.anthropic.com/en/docs • GPT: https://platform.openai.com/docs • Gemini: https://ai.google.dev/gemini-api/docs • DeepSeek: https://api-docs.deepseek.com/ • GLM: https://docs.z.ai Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • Чуб: https://characterhub.org | https://chub.ai/characters • Ботбуру: https://botbooru.com/ • CharIsChar: https://charischar.net/ • Гайды: https://aicg.neocities.org/botmaking • Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4 • Бургерские боты: https://aicg.neocities.org/bots Ресурсы • Бесплатные API: https://github.com/cheahjs/free-llm-api-resources • OpenRouter: https://openrouter.ai/ • Арена: https://lmarena.ai/ • Чай: https://character.ai/ Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Шаблон шапки: https://rentry.org/aicg_shapka Прошлый тред: >>1675923 (OP)
2026-09-09 12:17:02