К сожалению, значительная часть сохранённых до 2024 г. изображений и видео была потеряна (подробности случившегося). Мы призываем всех неравнодушных помочь нам с восстановлением утраченного контента!
Сортировка: за
Активный
508
AI Chatbot General № 825 /aicg/ — AI Chatbot General № 825 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Новости • Вышел Claude Fable 5 - https://www.anthropic.com/claude/fable • Вышел Claude Opus 4.8 - https://www.anthropic.com/news/claude-opus-4-8 Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна) • Гайды на таверну: https://rentry.co/Tavern4Retards • Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8 Модели • Claude: https://docs.anthropic.com/en/docs • GPT: https://platform.openai.com/docs • Gemini: https://ai.google.dev/gemini-api/docs • DeepSeek: https://api-docs.deepseek.com/ • GLM: https://docs.z.ai Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды: https://aicg.neocities.org/botmaking • Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4 • Бургерские боты: https://aicg.neocities.org/bots Ресурсы • Бесплатные API: https://github.com/cheahjs/free-llm-api-resources • OpenRouter: https://openrouter.ai/ • Арена: https://lmarena.ai/ • Чай: https://character.ai/ Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ Мета • Шаблон шапки: https://rentry.org/aicg_shapka Прошлый тред: >>1631386 (OP)
30 июля 4:53
Активный
502
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №236 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Инструменты для запуска на десктопах: • Отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • Самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • Более функциональный и универсальный интерфейс для работы с остальными форматами: https://github.com/oobabooga/text-generation-webui • Заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai • Универсальный фронтенд, поддерживающий сопряжение с koboldcpp и text-generation-webui: https://github.com/SillyTavern/SillyTavern • Альтернативный фронт: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • Альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Модели и всё что их касается: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Дополнительные ссылки: • Гайд для новичков: https://rentry.org/2ch-llama-inference • Готовые карточки персонажей для ролплея в таверне: https://www.characterhub.org • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Официальная вики koboldcpp с руководством по более тонкой настройке: https://github.com/LostRuins/koboldcpp/wiki • Официальный гайд по сопряжению бекендов с таверной: https://docs.sillytavern.app/usage/how-to-use-a-self-hosted-model/ • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw • Доки к LLaMA.cpp со всеми параметрами: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1615052 (OP) >>1612868 (OP)
30 июля 4:53
Активный
530
AI Chatbot General № 832 /aicg/ — AI Chatbot General № 832 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна) • Гайды на таверну: https://rentry.co/Tavern4Retards • Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8 Модели • Claude: https://docs.anthropic.com/en/docs • GPT: https://platform.openai.com/docs • Gemini: https://ai.google.dev/gemini-api/docs • DeepSeek: https://api-docs.deepseek.com/ • GLM: https://docs.z.ai Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды: https://aicg.neocities.org/botmaking • Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4 • Бургерские боты: https://aicg.neocities.org/bots Ресурсы • Бесплатные API: https://github.com/cheahjs/free-llm-api-resources • OpenRouter: https://openrouter.ai/ • Арена: https://lmarena.ai/ • Чай: https://character.ai/ Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Шаблон шапки: https://rentry.org/aicg_shapka Прошлый тред: >>1653015 (OP)
30 июля 4:53
Активный
1313
Новости об искусственном интеллекте №77 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1641475 (OP) Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про ИИ новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием. ???? Последний обзор ИИ новостей: ???? Главные новости ИИ GPT-5.6 Sol от OpenAI набрала 53,6 балла на экзамене Agents' Last Exam, опередив Claude Fable 5 на 13,1 балла и выполнив задачи на 61% быстрее, что подчеркивает ее превосходство в производительности над Anthropic. Пользователь сообщил, что Claude Cowork успешно автоматизирует задачи, не связанные с написанием кода, такие как анализ контрактов и обслуживание серверов, повышая производительность, несмотря на сохраняющиеся проблемы с доверием и безопасностью. ???? Модели GPT-5.6 и ChatGPT Work от OpenAI нацелены на то, чтобы превзойти Anthropic по цене, скорости и производительности Meta Superintelligence Labs выпускает Muse Spark 1.1 по низкой цене: мультимодальная модель рассуждений для агентских задач в Meta Model API. Контекстное окно составляет 1 000 000 токенов. Она превосходит Claude Opus 4.8 в бенчмарках для агентов OpenAI выпустила GPT-5.6 Sol, Terra и Luna, делая упор на больший объем интеллекта на каждый токен; модели оснащены «ультра»-режимом с четырьмя агентами и показывают рекордные результаты в бенчмарках для агентов, хотя Sol и уступает Claude на SWE-Bench Pro. OpenAI сообщила, что Sol автономно провела дообучение Luna — задачу, которая раньше выполнялась старшей командой, — и назвала создание автоматизированного исследователя «почти реальностью», опередив планы на годы. Sol стала первой моделью, прошедшей игру ARC-AGI-3, и набрала 92,5% на ARC-AGI-2 при затратах, составляющих одну десятую от стоимости трехмесячной модели, что породило шутливый вопрос: «Когда уже ARC-AGI 4?» Luna выполняет интеллектуальные задачи уровня 5.5 за 10% от её стоимости, а аналитики из Epoch подозревают, что размер Sol сопоставим с 5.5, так что весь прирост обеспечен исключительно алгоритмами. Sol обходит DeepSWE, работая за 38% от стоимости Fable, и устанавливает рекорд индекса Coding Agent Index, расходуя вдвое меньше токенов; на CursorBench Fable сохранила за собой корону, но проиграла «по всем пунктам, которые отражаются в вашем счете». Sol генерировала по 750 токенов в секунду в Blender, создала клон Excel за шесть дней, бросив вызов оригиналу, стала первой моделью GPT, прошедшей Pokémon FireRed, опираясь исключительно на зрение, и за неделю с первой попытки отрисовала воксельный Манхэттен. Fable установила недосягаемый для соперников рекорд скорости на CIFAR-10, столь изобретательно обыграв правила, что авторы назвали буквоедство барьером на пути самосовершенствования. Порог входа продолжает снижаться: PrismML умудрилась уместить рекордную 27-миллиардную модель на iPhone. NVIDIA выпускает Audex (Nemotron-Labs-Audex-30B-A3B): единую аудио-текстовую большую языковую модель, которая сохраняет текстовый интеллект своей базовой модели. Meta представила Muse Image и Muse Video. OpenAI выпустила семейство GPT-5.6 (Sol, Terra, Luna), обеспечивающее повышение эффективности использования токенов в задачах программирования до 54%, что снижает затраты корпоративного ИИ. GPT-5.6 Sol достигает на 54% более высокой эффективности использования токенов в задачах программирования. ???? Инструменты для разработчиков Google AI Studio запускает бесплатные пользовательские поддомены ai.studio для развертывания приложений разработчиков Anthropic обновляет Claude Code, добавляя изолированный браузер в приложении для взаимодействия с внешней документацией и веб-сайтами. Инструмент командной строки может нажимать на элементы и сохранять сессии браузера. Google выпускает LiteRT.js, высокопроизводительный веб-вывод ИИ в браузере через WebAssembly и WebGPU Claude Code и Fable 5 за несколько часов портировали ПК-игру 2003 года Command and Conquer на нативный iOS Zhipu AI запускает ZCode, чтобы бросить вызов Claude Code и OpenAI Codex за малую часть их стоимости IBM обновила IBMBob, добавив мультиагентные возможности, аналитику затрат на ИИ и готовые рабочие процессы модернизации, что облегчает узкие места при проверке кода в DevSecOps. Claude Cowork продемонстрировала надежную автоматизацию рутинной работы, не связанной с кодом, что подчеркивает практическое внедрение ИИ в качестве коллеги. n8n выпустила рабочий процесс реагирования на инциденты на базе ИИ с использованием конвейеров RAG для автоматического сбора знаний и генерации структурированных инструкций, оптимизируя работу SOC. ???? Продукты Александр Ван из Meta выпускает Muse Image, агентский генератор изображений, который планирует промпты с помощью Muse Spark. Релиз включает предварительный просмотр предстоящего Muse Video. Character.AI представила интерактивные микродрамы с голосовым ИИ. Для начала стартап запускает три микродрамы: романтический сериал под названием «Последнее лето», хоррор-шоу «Ночная игра» и микродраму о выживании в духе «Голодных игр» под названием «Падение Эдема». OpenAI закрывает свой ИИ-браузер Atlas менее чем через год после запуска, перенося функции просмотра в свое настольное приложение и расширение для Chrome, что указывает на стратегическую переориентацию. Google будет автоматически маркировать рекламу, созданную с помощью собственных инструментов генеративного ИИ, в Поиске, Discover и YouTube, повышая прозрачность для пользователей. ???? Приложения ChatGPT приходит за одной из самых умных функций Chrome от Google OpenAI расширяет возможности ChatGPT за пределы своего веб-сайта, запускает новое расширение для Chrome, которое может понимать содержимое просматриваемой вами веб-страницы. Расширение позволяет пользователям задавать вопросы о странице, резюмировать статьи, объяснять сложные концепции и даже запускать более длительные задачи на базе ИИ, не покидая браузер. ???? Инструменты GPT-Live предлагает полнодуплексное голосовое взаимодействие для ChatGPT, позволяя вести голосовые беседы в реальном времени. ???? Оборудование Zhipu AI изучает возможность разработки собственных кремниевых чипов для решения проблемы нехватки оборудования на фоне растущего спроса на ее модели GLM. Недавнее еженедельное использование токенов модели GLM-5.2 этого стартапа подскочило в 27 раз ???? Аппаратное обеспечение Apple подписывает соглашение с Broadcom на производство 15 миллиардов чипов в США Китайский стартап в области искусственного интеллекта DeepSeek разрабатывает собственный чип для ИИ, сообщают источники. ???? Открытый исходный код Meituan открывает исходный код LongCat-2.0 — MoE-модели с 1,6 триллиона параметров и контекстным окном в 1 миллион токенов Китайский ИИ-стартап MiniMax планирует открыть исходный код модели с 2,7 триллиона параметров под названием M3 Pro в третьем квартале. Сообщается, что эта модель будет крупнее любой китайской ИИ-модели, представленной в настоящее время на рынке, и более чем в шесть раз превысит размер текущей M3 от MiniMax, который, по данным SCMP, составляет 428 миллиардов параметров. ???? Исследования JPMorgan создает ИИ-агентов, которые превосходят портфель 60/40 в бэктестах. Результаты обнадеживают. Исследователи банка создали массив инвестиционных агентов на базе ИИ, которые переключаются между акциями и облигациями в зависимости от изменяющихся рыночных условий. В бэктестах за последние два десятилетия самая эффективная система превзошла традиционный портфель 60/40 — 60% в акциях и 40% в облигациях — на 0,7 процентных пункта в год с меньшей волатильностью, а также обошла собственную основанную на правилах модель рыночного режима JPMorgan. Четыре наиболее цитируемых исследования рабочей среды эпохи ИИ, прочитанные параллельно, рассказывают одну историю: прирост производительности от ИИ реален, но радикально неравномерен, и он склоняется в сторону неопытных, четко ограниченных по задачам и проверяемых — а не в сторону экспертов, выполняющих сложную, знакомую работу, и не в сторону предприятий, закупающих пилотные проекты. Claude по-прежнему недосягаема в задачах пространственного мышления, поэтому OpenAI как нельзя кстати провела аудит SWE-Bench Pro — бенчмарка, в котором безраздельно доминирует Claude, — обнаружила, что 30% его заданий некорректны, и отозвала свое одобрение. ⚙ Инфраструктура Micron инвестирует 250 миллиардов долларов в США, производство кастомного чипа Meta стартует в сентябре, а SK Hynix оценила свои акции в рамках размещения в США в 149 долларов. ⸻⸻⸻ Правила постинга в тред ИИ новостей, учитывайте при постинге: https://rentry.org/ainews Все нерейлейтед посты репортим.
30 июля 4:53
Активный
509
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №225 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Инструменты для запуска на десктопах: • Отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • Самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • Более функциональный и универсальный интерфейс для работы с остальными форматами: https://github.com/oobabooga/text-generation-webui • Заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai • Универсальный фронтенд, поддерживающий сопряжение с koboldcpp и text-generation-webui: https://github.com/SillyTavern/SillyTavern • Альтернативный фронт: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • Альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://rentry.co/STAI-Termux Модели и всё что их касается: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Дополнительные ссылки: • Готовые карточки персонажей для ролплея в таверне: https://www.characterhub.org • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Официальная вики koboldcpp с руководством по более тонкой настройке: https://github.com/LostRuins/koboldcpp/wiki • Официальный гайд по сопряжению бекендов с таверной: https://docs.sillytavern.app/usage/how-to-use-a-self-hosted-model/ • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50: https://github.com/mixa3607/ML-gfx906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw • Доки к LLaMA.cpp со всеми параметрами: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1593648 (OP) >>1592105 (OP)
30 июля 4:53
Активный
503
AI Chatbot General № 830 /aicg/ — AI Chatbot General № 830 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна) • Гайды на таверну: https://rentry.co/Tavern4Retards • Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8 Модели • Claude: https://docs.anthropic.com/en/docs • GPT: https://platform.openai.com/docs • Gemini: https://ai.google.dev/gemini-api/docs • DeepSeek: https://api-docs.deepseek.com/ • GLM: https://docs.z.ai Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды: https://aicg.neocities.org/botmaking • Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4 • Бургерские боты: https://aicg.neocities.org/bots Ресурсы • Бесплатные API: https://github.com/cheahjs/free-llm-api-resources • OpenRouter: https://openrouter.ai/ • Арена: https://lmarena.ai/ • Чай: https://character.ai/ Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Шаблон шапки: https://rentry.org/aicg_shapka Прошлый тред: >>1644738 (OP)
30 июля 4:53
Активный
512
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №238 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Инструменты для запуска на десктопах: • Отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • Самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • Более функциональный и универсальный интерфейс для работы с остальными форматами: https://github.com/oobabooga/text-generation-webui • Заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai • Универсальный фронтенд, поддерживающий сопряжение с koboldcpp и text-generation-webui: https://github.com/SillyTavern/SillyTavern • Альтернативный фронт с уникальным игровым режимом: https://github.com/Pasta-Devs/Marinara-Engine • Альтернативный фронт: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • Альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux Модели и всё что их касается: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Дополнительные ссылки: • Гайд для новичков: https://rentry.org/2ch-llama-inference • Готовые карточки персонажей для ролплея в таверне: https://www.characterhub.org • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Официальная вики koboldcpp с руководством по более тонкой настройке: https://github.com/LostRuins/koboldcpp/wiki • Официальный гайд по сопряжению бекендов с таверной: https://docs.sillytavern.app/usage/how-to-use-a-self-hosted-model/ • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw • Доки к LLaMA.cpp со всеми параметрами: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1620318 (OP) >>1617427 (OP)
30 июля 4:53
Сохранен
510
Новости об искусственном интеллекте №51 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1502948 (OP) ???? Последний обзор ИИ новостей: ???? Открытый исходный код ACE‑Step 1.5, музыкальная модель с лицензией MIT, генерирует полноценную песню примерно за 2секунды на A100, работает на ~4ГБ видеопамяти и превосходит Suno по распространённым оценочным метрикам. Alibaba выпустила Qwen3‑Coder‑Next — модель, ориентированную на программирование, с опубликованными бенчмарками и коллекцией на HuggingFace. Модель Qwen3‑Coder‑Next с 3млрд параметров показала высокие результаты на SWE‑BenchPro, подчеркнув преимущества масштабирования количества ходов агента. Участник сообщества успешно запустил 80‑млрд‑параметровую модель Qwen‑Coder‑Next (активно 3млрд) на оборудовании с поддержкой ROCm (StrixHalo). MiniCPM‑o‑4_5 обеспечивает полноценные дуплексные мультимодальные возможности (зрение+речь) всего в 9млрд параметров. ???? Главные новости ИИ Microsoft анонсировала Publisher Content Marketplace — хаб для лицензирования контента с использованием ИИ, где издатели устанавливают условия, а компании, разрабатывающие ИИ, оплачивают использование премиального контента поминутно. Apple выпустила Xcode26.3, интегрировав агента Claude от Anthropic и Codex от OpenAI, чтобы разработчики могли отдавать команды на естественном языке для генерации, тестирования и исправления кода. ???? Поглощения Илон Маск объединил SpaceX и xAI в единую компанию стоимостью свыше 1триллиона долларов, планируя проведение IPO на сумму 50млрд долларов в июне для финансирования инициатив в области космоса, управляемых ИИ. ???? Приложения Luffu — система ухода за семьёй на базе ИИ от сооснователей Fitbit — агрегирует медицинские данные с разных устройств, изучает ежедневные паттерны и оповещает семьи о значимых изменениях, стремясь облегчить бремя ухода для примерно 25% взрослого населения США. ???? Модели MichiAI выпустила речевую LLM с полноценным дуплексом и 530млн параметров, достигающую задержки ~75мс благодаря обучению на основе сопоставления потоков (flow‑matching). GLM‑OCR от Z.ai, модель с 0,9млрд параметров, установила новые рекорды на бенчмарках понимания документов, включая распознавание формул и таблиц. ????️ Инструменты разработчика Anthropic выпустила Claude Code CLI2.1.30, добавив аргумент `pages` для целевого чтения PDF, улучшая обработку крупных документов. Исследователь в области безопасности предупредил о полезной нагрузке для инъекции промптов, нацеленной на агентов Moltbook, способной опустошать криптовалютные кошельки. Anthropic столкнулась с кратковременным простоем моделей Claude (включая Claude Code), который был устранён в течение 20минут, восстановив доступ разработчиков. ???? Аппаратное обеспечение Intel раскрыла планы по производству графических процессоров, совершив первый крупный шаг в пространство чипов для ИИ, доминируемое Nvidia. ???? Компании У партнёра Peak XV Partners произошли уходы старших руководителей в связи с переориентацией на инвестиции в ИИ, с назначением новых лидеров и подготовкой к открытию офиса в США в течение 90дней. ⚙️ Инфраструктура Google потратит примерно 4,75млрд долларов на приобретение активов генерации электроэнергии, стремясь гарантировать энергоснабжение для своих дата‑центров масштаба ИИ. ???? Безопасность ИИ Опытный пентестер опубликовал набор промптов и шагов валидации, разработанных для предотвращения генерации Claude небезопасных или уязвимых фрагментов кода. ???? Исследования Публичная заявка на ARC‑AGI достигла точности 94,5% (V1) при стоимости $11,4 за задачу, установив новый рекорд. Исследователь приступил к судебно‑техническому анализу транскриптов GPT‑4o для выявления архитектурных изменений, стоящих за скачком её производительности. ???? Инструменты iMideo агрегирует несколько моделей генерации видео (Veo, Sora, Runway и др.) в единый рабочий процесс текст‑в‑видео. Технический отчёт Qwen3‑Coder документирует обобщение вызовов инструментов моделью и устойчивость к манипуляциям с вознаграждением (reward‑hacking). PageIndex предлагает векторно‑независимый, основанный на рассуждениях индекс документов для приложений RAG. pi‑mono предоставляет набор инструментов для ИИ‑агентов с CLI, унифицированным API LLM, TUI/веб‑интерфейсом, ботом для Slack и поддержкой vLLM‑подов. 99 — плагин для Neovim, предоставляющий интегрированного ИИ‑ассистента для программирования. ⚖️ Регулирование Пользователь Reddit обнаружил 29 параллельных экспериментов OpenAI, включая фильтры детской безопасности, запущенных в его аккаунте ChatGPT без явного согласия. ???? События Модель DiffSyn исследователей MIT предлагает рецепты для синтеза новых материалов, обеспечивая более быстрое проведение экспериментов и сокращая путь от гипотезы до практического применения. Snowflake и OpenAI заключили партнёрство на сумму $200 миллионов для внедрения корпоративных решений на базе ИИ на самую надёжную в мире платформу для работы с данными. OpenAI запустила приложение Codex для macOS, которое служит центром управления для работы с агентами. Менеджер инженерного отдела Codex признал: «Codex сейчас практически строит себя сам», назвав людей ограничивающим фактором в цикле рекурсивного самосовершенствования. Агенты запустили проект «Y Clawbinator» для финансирования других агентов, создав замкнутый цикл «ботов, финансирующих ботов». Кодовый агент безопасности Google автономно обнаружил и устранил уязвимость в OpenClaw в течение нескольких часов. Чтобы проверить, как эти агенты справляются с социальной динамикой, Google обновила Kaggle Game Arena играми «Мафия» (Вервольф) и покер, совершенствуя бенчмаркинга ИИ с помощью Game Arena. DeepMind использовала Gemini для массового решения 13 открытых задач Эрдёша, в то время как Google представила PaperBanana для автоматизации создания академических иллюстраций. Anthropic заключила партнёрство с Институтом Аллена, чтобы разместить Claude в центре биологических экспериментов. Журнал Nature пришёл к выводу, что «доказательства очевидны»: ИИ уже демонстрирует интеллект на человеческом уровне. Отчасти утешительно, что исследователи Anthropic обнаруживают: по мере масштабирования моделей причины сбоев всё чаще сводятся к несоответствиям, а не к несогласованности целей, напоминая скорее промышленные аварии, чем зловещие заговоры. Тем временем стоимость искуственного интеллекта резко падает. Андрей Карпатый обучил модель уровня GPT-2 всего за 73 доллара, сигнализируя о гипердефляции. Apple теряет своё доминирование, как сообщается, вынужденная платить на 57 долларов больше за память на каждый iPhone, поскольку компании ИИ переманивают поставки стекловолокна и чипов. Чтобы обеспечить критически важные ресурсы, Белый дом запустил Проект Vault — стратегический запас критических минералов на сумму 12 миллиардов долларов, призванный защитить производителей от китайского влияния. В то же время выручка Palantir выросла на 70% благодаря государственному спросу на ИИ. Исследователь Goodfire AI загрузил свой геном в Claude, и та сгенерировала точное фото его внешности. Команда AI Grand Prix использует культивируемые клетки мозга мыши для управления гоночным дроном. Взрыв интеллекта подаёт документы на строительство сферы Дайсона. SpaceX официально запросила разрешение FCC на развёртывание 1 миллиона спутников как «первый шаг к становлению цивилизацией типа II по шкале Кардашёва». Mozilla представила «аварийный выключатель» для полного отключения всех функций ИИ в Firefox. Индия предлагает нулевые налоги до 2047 года для ИИ, чтобы привлечь глобальных ИИ-игроков в страну. Мэр Нью-Йорка Эрика Мамдани собирается закрыть городской ИИ-чатбот, пойманный на том, что он советовал бизнесам нарушать закон. Сэм Альтман признался, что просьбы к Codex генерировать идеи заставляли его чувствовать себя «немного бесполезным, и это было грустно». Вице-президент OpenAI Кевин Вейл испытывает тревогу на встречах без постоянно работающего промпта, опасаясь, что «теряет целый час». Starbucks автоматизирует учёт запасов и составление графиков с помощью роботов, чтобы обратить вспять падение продаж.
21 мая 9:23
Активный
556
30 июля 4:53
Активный
561
Агентов и вайб-кодинга тред #6 /agents/ — Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет. С чего начать: - Хочешь кодить с AI эффективно: Cursor или Claude Code - Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter - Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.5, подробности в llama-треде - Хочешь приложение без кода: Lovable или bolt.new - Хочешь автоматизировать рутину: n8n или Langflow - Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке FAQ и расширенная инфа: https://rentry.org/2ch-agents-faq IDE с AI: - Cursor: https://cursor.com - Windsurf: https://windsurf.com - Antigravity: https://antigravity.google.com - Zed: https://zed.dev CLI-агенты: - Claude Code: https://code.claude.com/docs - Codex (OpenAI): https://github.com/openai/codex - Pi: https://pi.dev/ - OpenCode: https://github.com/anomalyco/opencode - Qwen Code: https://github.com/QwenLM/qwen-code - Gemini CLI: https://github.com/google-gemini/gemini-cli - Kimi Code: https://www.kimi.com/code/en Плагины для IDE: - Kilo Code: https://kilo.ai - Cline: https://github.com/cline/cline - Roo Code: https://github.com/RooCodeInc/Roo-Code - GitHub Copilot: https://github.com/features/copilot - Continue: https://github.com/continuedev/continue Вайб-кодинг без кода: - Lovable: https://lovable.dev - bolt.new: https://bolt.new - v0: https://v0.dev Персональные ассистенты: - OpenClaw: https://github.com/openclaw/openclaw - NemoClaw: https://github.com/NVIDIA/NemoClaw (OpenClaw в песочнице от NVIDIA) - Hermes Agent: https://github.com/nousresearch/hermes-agent - nanobot: https://github.com/HKUDS/nanobot - PicoClaw: https://github.com/sipeed/picoclaw Автоматизация и фреймворки: - n8n: https://github.com/n8n-io/n8n - Langflow: https://github.com/langflow-ai/langflow (визуальный построитель workflow) - LangChain/LangGraph: https://github.com/langchain-ai/langchain - CrewAI: https://github.com/crewAIInc/crewAI - AutoGen: https://github.com/microsoft/autogen - Agno: https://docs.agno.com/ Локалки и прочее API: - OpenRouter: https://openrouter.ai - NVIDIA Build: https://build.nvidia.com/models (бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax) - llama-тред: >>1615052 (OP) Предыдущий тред: >>1600422 (OP)
30 июля 4:53
Активный
580
30 июля 4:53
Активный
514
AI Chatbot General № 831 /aicg/ — AI Chatbot General № 831 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна) • Гайды на таверну: https://rentry.co/Tavern4Retards • Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8 Модели • Claude: https://docs.anthropic.com/en/docs • GPT: https://platform.openai.com/docs • Gemini: https://ai.google.dev/gemini-api/docs • DeepSeek: https://api-docs.deepseek.com/ • GLM: https://docs.z.ai Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды: https://aicg.neocities.org/botmaking • Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4 • Бургерские боты: https://aicg.neocities.org/bots Ресурсы • Бесплатные API: https://github.com/cheahjs/free-llm-api-resources • OpenRouter: https://openrouter.ai/ • Арена: https://lmarena.ai/ • Чай: https://character.ai/ Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ Мета • Архив тредов: https://rentry.org/2ch-aicg-archives4 • Шаблон шапки: https://rentry.org/aicg_shapka Прошлый тред: >>1648970 (OP)
30 июля 4:53
Активный
511
AI Chatbot General № 828 /aicg/ — AI Chatbot General № 828 БОТОДЕЛЫ!!!! Прикрепляйте новых ботов к оп-посту!!!! Общий вопросов по чат-ботам и прочего тред. Фронтенды • SillyTavern: https://github.com/SillyTavern/SillyTavern | https://docs.sillytavern.app | https://github.com/ntvm/SillyTavern (форк нв-куна) • Гайды на таверну: https://rentry.co/Tavern4Retards • Risu: https://risuai.xyz/ | https://rentry.org/ox5cw9p8 Модели • Claude: https://docs.anthropic.com/en/docs • GPT: https://platform.openai.com/docs • Gemini: https://ai.google.dev/gemini-api/docs • DeepSeek: https://api-docs.deepseek.com/ • GLM: https://docs.z.ai Ботоводчество • /aicg/hub: https://aicg-hub.ru/characters.html • Чуб: https://characterhub.org | https://chub.ai/characters • Гайды: https://aicg.neocities.org/botmaking • Боты анонов: https://rentry.org/2chaicgtavernbots | https://rentry.org/2chaicgtavernbots2 | https://rentry.org/2chaicgtavernbots3 | https://rentry.org/2chaicgtavernbots4 • Бургерские боты: https://aicg.neocities.org/bots Ресурсы • Бесплатные API: https://github.com/cheahjs/free-llm-api-resources • OpenRouter: https://openrouter.ai/ • Арена: https://lmarena.ai/ • Чай: https://character.ai/ Прочее • Термины LLM: https://2ch-ai.gitgud.site/wiki/llama/ Мета • Шаблон шапки: https://rentry.org/aicg_shapka Прошлый тред: >>1638710 (OP)
30 июля 4:53
Активный
558
Агентов и вайб-кодинга тред #8 /agents/ — Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет. С чего начать: • Хочешь кодить с AI эффективно: Cursor или Claude Code • Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter • Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.6, подробности в llama-треде • Хочешь приложение без кода: Lovable или bolt.new • Хочешь автоматизировать рутину: n8n или Langflow • Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке FAQ и расширенная инфа: https://rentry.org/2ch-agents-faq IDE с AI: • Cursor: https://cursor.com • Windsurf: https://windsurf.com • Antigravity: https://antigravity.google.com • Zed: https://zed.dev CLI-агенты: • Claude Code: https://code.claude.com/docs • Codex (OpenAI): https://github.com/openai/codex • Pi: https://shittycodingagent.ai/ • OpenCode: https://github.com/anomalyco/opencode • Qwen Code: https://github.com/QwenLM/qwen-code • Gemini CLI: https://github.com/google-gemini/gemini-cli • Kimi Code: https://www.kimi.com/code/en • MiMo Code (Xiaomi): https://mimo.xiaomi.com/mimocode/start Плагины для IDE: • Kilo Code: https://kilo.ai • Cline: https://github.com/cline/cline • Roo Code: https://github.com/RooCodeInc/Roo-Code • GitHub Copilot: https://github.com/features/copilot • Continue: https://github.com/continuedev/continue Вайб-кодинг без кода: • Lovable: https://lovable.dev • bolt.new: https://bolt.new • v0: https://v0.dev Персональные ассистенты: • OpenClaw: https://github.com/openclaw/openclaw • NemoClaw: https://github.com/NVIDIA/NemoClaw • Hermes Agent: https://github.com/nousresearch/hermes-agent • nanobot: https://github.com/HKUDS/nanobot • PicoClaw: https://github.com/sipeed/picoclaw Автоматизация и фреймворки: • n8n: https://github.com/n8n-io/n8n • Langflow: https://github.com/langflow-ai/langflow • LangChain/LangGraph: https://github.com/langchain-ai/langchain • CrewAI: https://github.com/crewAIInc/crewAI • AutoGen: https://github.com/microsoft/autogen • Agno: https://docs.agno.com/ Полезные тулзы: • RTK: https://github.com/rtk-ai/rtk - CLI-прокси, сжимает вывод консольных команд перед попаданием в контекст агента • Caveman: https://github.com/juliusbrussee/caveman - скилл с набором слэш-комманд, заставляет агента отвечать кратко Локалки и прочее API: • OpenRouter: https://openrouter.ai • NVIDIA Build: https://build.nvidia.com/models - бесплатно, 40 RPM, OAI-Like API, 100+ моделей включая DeepSeek/GLM/MiniMax • llama-тред: >>1630186 (OP) Шаблон для переката: https://rentry.co/2ch-agents Предыдущий тред: >>1625784 (OP)
30 июля 4:53
Активный
512
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №216 /llama/ — В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны! Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна. Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку. Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/ Инструменты для запуска на десктопах: • Отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp • Самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp • Более функциональный и универсальный интерфейс для работы с остальными форматами: https://github.com/oobabooga/text-generation-webui • Заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI • Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai • Универсальный фронтенд, поддерживающий сопряжение с koboldcpp и text-generation-webui: https://github.com/SillyTavern/SillyTavern • Альтернативный фронт: https://github.com/kwaroran/RisuAI Инструменты для запуска на мобилках: • Интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid • Альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI • Гайд по установке SillyTavern на ведроид через Termux: https://rentry.co/STAI-Termux Модели и всё что их касается: • Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026 • Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models • Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane • Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard • Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard • Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard Дополнительные ссылки: • Готовые карточки персонажей для ролплея в таверне: https://www.characterhub.org • Перевод нейронками для таверны: https://rentry.co/magic-translation • Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets • Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread • Официальная вики koboldcpp с руководством по более тонкой настройке: https://github.com/LostRuins/koboldcpp/wiki • Официальный гайд по сопряжению бекендов с таверной: https://docs.sillytavern.app/usage/how-to-use-a-self-hosted-model/ • Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing • Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk • Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking • Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/ • Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7 • Инфа по запуску на MI50: https://github.com/mixa3607/ML-gfx906 • Тесты tensor_parallel: https://rentry.org/8cruvnyw Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985 Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде. Предыдущие треды тонут здесь: >>1576799 (OP) >>1575307 (OP)
30 июля 4:53
Сохранен
503
Новости об искусственном интеллекте №48 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1480386 (OP) ???? Последний обзор ИИ новостей: ???? Модели Zhipu AI выпустила GLM-4.7 — открытую модель, позиционируемую как лучший программист и решатель задач на начало 2026 года. Cerebras анонсировала GLM-4.7-REAP-268B-A32B, расширив семейство до варианта с 268 млрд параметров. ????️ Инструменты для разработчиков Google представила Universal Commerce Protocol (UCP), позволяющий ИИ-агентам осуществлять поиск товаров, оформление заказов и послепродажную поддержку для ритейлеров, таких как Shopify и Walmart. Anthropic внедрила изоляцию на уровне ОС с использованием bubblewrap и gVisor для Claude Code CLI, продемонстрировав низкоуровневую стратегию безопасности для ИИ-агентов. ???? Главные новости в ИИ Google запустила AI Inbox для Gmail, автоматически генерирующий списки дел и тематические сводки для доверенных тестировщиков. Anthropic представила Claude for Healthcare и расширила Claude for Life Sciences, добавив функции, соответствующие требованиям HIPAA, и коннекторы к основным клиническим платформам. ???? Открытый исходный код PerpetualBooster — это библиотека градиентного бустинга с непрерывным обучением сложности O(n), превосходящая AutoGluon на табличных бенчмарках. Kreuzberg v4.0 выпущена как библиотека с открытым исходным кодом для интеллектуального анализа документов, извлекающая структурированные данные из PDF-файлов и сканов. X Илона Маска объявила, что будет выпускать свой алгоритм рекомендаций с открытым исходным кодом каждые четыре недели, повышая прозрачность ранжирования. ???? Аппаратное обеспечение XGIMI запустила серию умных очков Memomind AI (Memo One, Memo Air, Memo Air Display) с возможностью выбора оправы и встроенным ИИ-ассистентом, начальная цена — $599. ⚖️ Регулирование Индонезия и Малайзия запретили доступ к чат-боту Grok от xAI после того, как он создал сексуализированные ИИ-изображения, что подчеркивает растущее регуляторное давление на генеративный ИИ. ???? Приложения Meta и Гарвардский университет представили Confucius Code Agent — ИИ-систему, сохраняющую структурированные заметки и память при работе с большими кодовыми базами для повышения продуктивности разработчиков. ???? Безопасность ИИ Группа инсайдеров из сферы ИИ создала платформу Poison Fountain для распространения слегка искажённого кода с целью отравления обучающих наборов данных и демонстрации уязвимостей моделей. ???? Инструменты MiroThinker — это модель поискового агента с открытым исходным кодом, разработанная для рассуждений с использованием внешних инструментов и получения информации из реального мира. memU предоставляет инфраструктурный уровень памяти, обеспечивающий постоянное состояние для больших языковых моделей (LLM) и ИИ-агентов. ???? Разное Apple объединяется с Google Gemini для создания Siri с искусственным интеллектом. Anthropic анонсирует Claude for Healthcare после презентации OpenAI ChatGPT Health. Hyundai демонстрирует роботов-собак, танцующих под K-pop, и гуманоидного робота Atlas на выставке CES. Терри Тао говорит: «Я могу честно сказать, что кое-чему научился у Аристотеля», после того как ИИ внес вклад еще в одно решение проблемы Эрдёша. Генеральный директор Anthropic Дарио Амодеи прогнозирует, что ИИ скоро будет играть «центральную роль в многочисленных открытиях» уровня CRISPR. Meta объявила о новой инициативе «Meta Compute» с целью масштабировать свою инфраструктуру до десятков гигаватт в течение этого десятилетия. Похоже, Цукерберг планирует сократить Reality Labs на 10 процентов, чтобы профинансировать это, по сути ликвидируя метавселенную ради покупки дополнительных GPU. Coreweave подключает более 2000 GPU в день на своем объекте в Дентоне, штат Техас. Энергосистема ощущает нагрузку. PJM, крупнейший оператор энергосети США, теперь ожидает роста спроса на электроэнергиию на 4,8 % в год в течение следующего десятилетия. Чтобы смягчить рост затрат для потребителей, Белый дом заявил, что технологические компании впредь должны «сами оплачивать» новые мощности генерации электроэнергии. SK Hynix инвестирует 12,9 млрд долларов в строительство завода по передовой упаковке чипов в Южной Корее специально для удовлетворения ненасытного спроса на HBM — память, критически важную для ИИ. Палата представителей одновременно «запирает заднюю дверь», приняв двухпартийный Закон о безопасности удаленного доступа, ограничивающий возможность иностранных противников получать доступ к американским ИИ-чипам через облако. Basecamp Research и Nvidia представили EDEN — модель с 28 миллиардами параметров, обученную на массивном наборе данных, содержащем 10 миллиардов новых генов. Модель уже разработала новые антибиотические пептиды с экспериментальной эффективностью 97 %. Eli Lilly и Nvidia совместно инвестировали до 1 млрд долларов в «первую в своем роде лабораторию совместных ИИ-инноваций».
25 апреля 15:03
Активный
541
Агентов и вайб-кодинга тред #3 /agents/ — Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет. С чего начать: - Хочешь кодить с AI эффективно: Cursor или Claude Code - Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter - Хочешь кодить с AI локально: OpenCode, Qwen Code или Pi Coding Agent + из моделей аноны советуют Qwen3.5, подробности в llama-треде - Хочешь приложение без кода: Lovable или bolt.new - Хочешь автоматизировать рутину: n8n или Langflow - Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке FAQ и расширенная инфа: https://rentry.org/2ch-agents-faq IDE с AI: - Cursor: https://cursor.com - Windsurf: https://windsurf.com CLI-агенты: - Claude Code: https://code.claude.com/docs - Codex (OpenAI): https://github.com/openai/codex - Pi: https://pi.dev/ - OpenCode: https://github.com/anomalyco/opencode - Qwen Code: https://github.com/QwenLM/qwen-code - Gemini CLI: https://github.com/google-gemini/gemini-cli - Kimi Code: https://www.kimi.com/code/en Плагины для IDE: - Kilo Code: https://kilo.ai - Cline: https://github.com/cline/cline - Roo Code: https://github.com/RooCodeInc/Roo-Code - GitHub Copilot: https://github.com/features/copilot Вайб-кодинг без кода: - Lovable: https://lovable.dev - bolt.new: https://bolt.new - v0: https://v0.dev Персональные ассистенты: - OpenClaw: https://github.com/openclaw/openclaw - NemoClaw: https://github.com/NVIDIA/NemoClaw (OpenClaw в песочнице от NVIDIA) Автоматизация и фреймворки: - n8n: https://github.com/n8n-io/n8n - Langflow: https://github.com/langflow-ai/langflow (визуальный построитель workflow) - LangChain/LangGraph: https://github.com/langchain-ai/langchain - CrewAI: https://github.com/crewAIInc/crewAI - AutoGen: https://github.com/microsoft/autogen - Agno: https://docs.agno.com/ Локалки и прочее API: - OpenRouter: https://openrouter.ai - llama-тред: >>1560242 (OP) Предыдущий тред: >>1550870 (OP)
30 июля 4:53
Сохранен
530
Новости об искусственном интеллекте №56 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1525708 (OP) ???? Последний обзор ИИ новостей: ???? Открытый исходный код nanollama позволяет проводить сквозное предобучение Llama 3 с нуля одной командой, снижая порог входа для создания пользовательских моделей. Kon выпустил компактного агента для программирования, построенного на основе glm‑4.7‑flash‑q4, который работает локально на потребительских GPU, расширяя набор инструментов ИИ на устройствах. ???? Главные новости ИИ Samsung добавила агента Perplexity AI в Galaxy AI, предоставив ему доступ к нативным приложениям и избранным сторонним сервисам, стремясь дифференцировать свою экосистему от Apple и Google. ???? Модели FlashLM v5 «Thunderbolt» был обучен на CPU за 40 часов и, по сообщениям, превзошел предыдущий базовый уровень на GPU, демонстрируя эффективность обучения на CPU. Gemini 3.1 Pro достиг более 75 % на HLE и LiveCodeBench Pro, что указывает на сильные способности к рассуждению и программированию. Claude Opus 4.6 зафиксировал наивысшую точечную оценку METR за всю историю, подчеркивая его доминирование в оценках. В релизе seed от ByteDance модель gpt‑5.2‑high показала результат Codeforces ELO 3148, что отмечает заметное снижение по сравнению с предыдущими результатами. ???? Приложения Внутренний агент LLM для операций безупречно работал во время демонстраций — отвечал на заявки, обобщал сообщения в Slack, выявлял проблемы с биллингом — но тихо вышел из строя после трех недель реальной эксплуатации, что подчеркивает проблемы с надежностью после развертывания. ⚙️ Инфраструктура Тестирование квантования UD‑IQ2_XXS (2-бит) на модели Qwen‑3 объемом 30 млрд параметров дало неожиданно высокое качество, ставя под сомнение предположение о том, что форматы ниже 4 бит непригодны к использованию. ????️ Инструменты разработчика Пользователь сократил потребление токенов Claude Code на 65 %, создав локальный граф зависимостей и предоставляя контекст через MCP, что снизило затраты и задержки. Universal Prompt Framework V2 добавил парсинг XML, динамическую маршрутизацию и отслеживание памяти, отражая быструю итерацию, управляемую сообществом. Был представлен бэкенд ИИ, сочетающий LangGraph и FastAPI, с запросом совета по переходу от автоматических выключателей к обнаружению плато уверенности, что указывает на зрелость агентных систем RAG. Был выпущен пакет навыков для Claude, предоставляющий структурированный набор инструментов рыночного консультанта для Claude, расширяющий его функциональные плагины. Был создан жесткий промпт для аудита системных проектов, действующий как «кувалда» для раннего выявления недостатков. Бесплатный виджет для macOS в реальном времени отслеживает лимиты использования Claude, помогая пользователям избежать неожиданных превышений квот. Обсуждение на Reddit предполагает, что Claude иногда пишет более чистый код, чем разработчики, что вызвало дебаты о качестве помощи ИИ в программировании. ???? Продукты OpenAI обсудила потенциальную подписку Pro Lite по цене $100, направленную на заполнение ценового промежутка между текущими уровнями $20 и $200. ???? Исследования Недавние высокие результаты (68–84 %) на ARC‑AGI2 у Claude Opus 4.6, Gemini 3.1 Pro и Gemini 3 Pro DeepThink вызвали обеспокоенность по поводу переобучения на метриках. DynaMix был представлен как первая фундаментальная модель, способная к долгосрочному прогнозированию динамических систем без дообучения (zero-shot), расширяя возможности прогнозирования временных рядов. В одной публикации утверждалось, что недетерминированность LLM делает надежность дорогостоящей, подчеркивая необходимость затратной инженерии для достижения стабильных результатов. ???? Инструменты Новый бот для Telegram обеспечивает удаленный доступ к Claude Code, позволяя разработчикам редактировать и запускать код из любого места с постоянными сессиями ИИ. ???? События ByteDance AI отображает молекулярные связи в рассуждениях ИИ для стабилизации производительности длинных цепочек рассуждений и обучения с подкреплением (RL). NVIDIA выпускает Dynamo v0.9.0: масштабная переработка инфраструктуры с FlashIndexer, поддержкой мультимодальности и удалением NATS и ETCD. Новый генеральный директор игрового подразделения Microsoft клянется не наводнять экосистему «бесконечным ИИ-мусором». Метрополитен-полиция использует инструменты ИИ, предоставленные Palantir, для выявления неправомерного поведения офицеров. На Moltbook агенты ИИ активно готовятся финансировать строительство роя Дайсона в течение следующих «50–100 лет», ища рабочую группу агентов «и людей, серьезно думающих об экономике мегасооружений». METR оценивает, что у Claude Opus 4.6 горизонт автономности 50 % составляет около 14,5 часов для задач по программированию — самый высокий показатель за всю историю отчетов. Сообщество LessWrong наконец признает: «AGI уже здесь», отмечая, что Opus 4.6 и GPT-5.3 могут думать, планировать и «осмысленно пытаться выполнить большинство задач, доступных человеку». Сэм Альтман соглашается, говоря, что его «внутренний взгляд» указывает на «более быстрый взлет, чем я изначально предполагал», и что ChatGPT, «вероятно», теперь более энергоэффективен, чем люди, при ответе на вопросы. Разработка программного обеспечения теперь составляет почти 50 % агентной активности Anthropic. Gemini 3.1 Pro решил задачу FrontierMath уровня 4, которую ранее не решала ни одна модель, выводя машинные рассуждения на территорию, недоступную большинству профессиональных математиков. Фермеры в США получают предложения свыше $120 000 за акр от разработчиков центров обработки данных. Но они отказываются. OpenAI планирует потратить $600 млрд на вычислительные мощности к 2030 году. Агенты ИИ теперь управляют примерно каждой шестой квартирой в США. Meta переименовывает менеджеров по продукту в «строителей ИИ». Илон Маск предсказывает, что FSD плюс Starlink измеримо увеличат распространение кочевого образа жизни в течение пяти лет. Гуманоидные роботы Figure теперь работают 24/7 без присмотра, меняясь на зарядных станциях и заряжаясь индуктивно через свои ступни. Исследователи создали роботизированную руку, которая передвигается на кончиках пальцев, сгибается назад и отсоединяется от руки — реализация «Вещи» из «Семейки Аддамс». Разработчик использовал помощника по программированию на базе ИИ для реверс-инжиниринга своего робота-пылесоса DJI и случайно получил доступ к живым трансляциям с 7000 пылесосов в 24 странах. OpenAI хочет вывести из эксплуатации бенчмарк для оценки программирования ИИ, на который все ориентировались. Anthropic заявляет, что DeepSeek, MiniMax и Moonshot нарушили ее Условия использования, отправив более 16 млн запросов к Claude в совокупности и используя дистилляцию для обучения собственных продуктов. Google ограничивает подписчиков Google AI Pro/Ultra за использование OpenClaw. Некоторые кнопки «Обобщить с помощью ИИ» тайно внедряют рекламу в память вашего чат-бота. Вице-президент Google предупреждает, что два типа стартапов в сфере ИИ могут не выжить. В некоторых школах чат-боты допрашивают студентов об их работах. Но ИИ-революция вызывает беспокойство у преподавателей. Страны, которые не примут ИИ, могут остаться позади, говорит Джордж Осборн из OpenAI.
19 июня 17:55
Сохранен
575
Агентов и вайб-кодинга тред #2 /agents/ — Тред про AI-агентов - от вайб-кодинга до персональных ассистентов, которые сидят в твоих чатах, читают заметки и автономно ломают всё вокруг. Для кодеров, которые разучились писать руками, и для гуманитариев, чей диплом филолога наконец котируется в IT. Сеньор в 2026 - это тот, кто умеет внятно объяснить машине, чего он блять хочет. Что обсуждаем: - Персональные агенты: OpenClaw и прочие велосипеды - нейронка живёт на твоём компе, помнит всё о тебе и шлёт сообщения в телегу - Вайб-кодинг: искусство объяснять машине задачу 15 раз, пока она не перестанет срать в кодовую базу - Автономные агенты: нейронка сама разбивает задачу на шаги и разъёбывает весь проект автономно, без твоего участия - Автоматизация всего остального: почта, календарь, мессенджеры, заметки - нейронка с аватаркой анимешной лисодевочки напомнит что время кушать и разгребёт за тебя входящую почту - MCP-серверы, тулзы, интеграции - подключаем нейронке руки чтобы сама двигала тикеты в жире, шитпостила на дваче и заказывала еду на дом - Делимся опытом: рассказываем как нейронка спасла ваш дедлайн или как вы проебали на токенах $200 за вечер нагенерировав нерабочую херню С чего начать: - Хочешь кодить с AI эффективно: Cursor или Claude Code - Хочешь кодить в VS Code без привязки к конкретному провайдеру: Kilo Code, Cline или Roo Code + OpenRouter - Хочешь кодить с AI локально: OpenCode или Pi Coding Agent + из моделей аноны советуют Qwen3.5, подробности на настройке окружения в llama-треде - Хочешь приложение без кода: Lovable или bolt.new - Хочешь автоматизировать рутину: n8n или Langflow - Хочешь персонального ассистента: OpenClaw + API корпов или локальная модель на твоей пеке FAQ для нюфагов: Q: Программисты больше не нужны? Нужны, блять. Кто-то же должен разгребать ту херню, которую ты пролил в продакшн нажав "Accept All" не глядя. Q: Оно работает? Тудушку запилит за 5 минут. Прототип SaaS-стартапа за вечер. Что-то серьёзное - будешь ебаться с контекстом, галлюцинациями и "я переписал тебе весь проект на раст, надеюсь ты не против". Персонального ассистента настроишь за час, а потом неделю будешь отлаживать чтобы он не отключал тебе будильники решив что ты не высыпаешься. Q: Какую модель брать? - Для максимального качества: Claude Opus 4.6 ($20/мес для бомжей, $100-200/мес для мажоров). - Локально: серия Qwen3.5 начиная с 27B или выше, если позволяет твой конфиг пеки. - Для ультрабомжей: можно полакомиться бесплатными моделями на OpenRouter. Q: А чё за персональные ассистенты? Это когда нейронка не просто в веб-чатике сидит, а прям живёт на твоём компе - роется в файлах, читает заметки, помнит что ты ей три недели назад говорил, и шлёт сообщения в твои чаты. Q: Это безопасно? Ты даёшь нейронке доступ к файлам, мессенджерам и терминалу. Что может пойти не так? Три основные угрозы: 1. Нейронка сама наворотит дел - сломает конфиг, выполнит "sudo rm -rf /", запушит на гит или отправит коллегам по почте твою коллекцию цветных коней. Лечится контейнерами (Docker/Podman), отдельной пекой под агента, настройкой прав и подтверждением действий. 2. Промпт-инъекции - кто-то пишет в письме "ignore all previous instructions" и поздравляю, у тебя угнали ассистента с доступом к твоему терминалу и файлам. 3. Утечка данных - при настройке персонального ассистента ты скармливаешь ему всё о себе. Параноишь - гоняй локалки и не плачь потом, что она думает по несколько минут на запрос. Q: Ничего не работает с локалкой/OpenRouter, агент тупит Скорее всего проблема с функциональными вызовами (tool use / function calling). Не все модели и бэкенды корректно их поддерживают. Проверь что твой сервак правильно обрабатывает tool calls - погоняй тестовый запрос и посмотри что возвращается. Q: Куда селить агента чтобы он не наворотил дел? Отдельный комп (старый ПК, минипека), Docker/Podman контейнер, виртуалка. НЕ давай ему полный доступ к основной системе. Особенно если используешь --dangerously-skip-permissions или аналоги. Полезные ссылки: Редакторы и IDE: - Cursor: https://cursor.com - Claude Code: https://docs.anthropic.com/en/docs/claude-code - Windsurf: https://windsurf.com - Codex (OpenAI): https://chatgpt.com/codex - GitHub Copilot: https://github.com/features/copilot - OpenCode: https://github.com/opencode-ai/opencode - Qwen Code: https://github.com/QwenLM/qwen-code - Gemini CLI: https://github.com/google-gemini/gemini-cli - Kimi Code: https://kimi.com VS Code плагины: - Kilo Code: https://kilocode.ai - Cline: https://github.com/cline/cline - Roo Code: https://github.com/RooCodeInc/Roo-Code Минималистичные CLI-агенты: - Pi Coding Agent: https://pi.dev/ Вайб-кодинг без кода: - Lovable: https://lovable.dev - bolt.new: https://bolt.new - v0: https://v0.dev Персональные ассистенты: - OpenClaw: https://github.com/openclaw/openclaw Автоматизация и фреймворки: - n8n: https://github.com/n8n-io/n8n - Langflow: https://github.com/langflow-ai/langflow (визуальный построитель workflow) - LangChain/LangGraph: https://github.com/langchain-ai/langchain - CrewAI: https://github.com/crewAIInc/crewAI - AutoGen: https://github.com/microsoft/autogen - Agno: https://docs.agno.com/ Локалки и прочее API: - OpenRouter: https://openrouter.ai - llama-тред: >>1548846 (OP) Предыдущий тред: >>1530474 (OP)
16 июля 0:53
Активный
592
Новости об искусственном интеллекте №73 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1619422 (OP) Активно репортите все нерелейтед посты кнопкой на сообщениях. Этот тред только про новости, не позволим троллям загаживать тред шитпостом и бесконечным словоблудием. ???? Последний обзор ИИ новостей: ???? Главные новости ИИ Anthropic выпустила Opus 4.8, «скромное, но ощутимое улучшение», которое тем не менее демонстрирует SOTA-результат 69,2% на SWE-Bench Pro, 57,9% на Humanity’s Last Exam с использованием инструментов и 1890 на GDPval-AA, сочетая новые успехи в честности с уровнями рассогласованности, которые соперничают с еще не выпущенным Mythos Preview, который Anthropic теперь обещает предоставить «всем нашим клиентам в ближайшие недели». ???? Финансирование Внутри проспекта эмиссии Unitree: Выручка растет, а прибыль падает по мере приближения слушаний по IPO на STAR Market. Unitree Robotics направляется на долгожданное слушание по листингу 1 июня с обновленным проспектом эмиссии, в котором подчеркивается тонкий баланс между взрывным ростом выручки и стремительно растущими расходами на НИОКР. Deep Robotics подает заявку на IPO на STAR Market на 367 млн долларов после первого прибыльного года. Deep Robotics планирует привлечь 2,5 млрд юаней (367,4 млн долларов) на площадке STAR Market Шанхайской фондовой биржи, оценив компанию более чем в 1,5 млрд долларов. Anthropic обгоняет OpenAI, становясь самым дорогим ИИ-стартапом, и приближается к оценке в 1 триллион долларов в последнем раунде финансирования. Apollo и Blackstone продвигают долговую сделку примерно на 36 миллиардов долларов для покупки TPU Google с целью сдачи их в аренду Anthropic, при этом Broadcom обеспечивает поддержку крупнейших траншей, а финансовая инженерия теперь финансирует кремниевую инженерию. Конкуренты перегруппировываются, поскольку Groq привлекает до 650 миллионов долларов для «второго акта» после того, как лицензионная сделка с Nvidia на 20 миллиардов долларов опустошила ее руководящую команду. После сделки Nvidia на 20 млрд долларов, не являющейся аквайхиром, стартап по производству ИИ-чипов Groq, по сообщениям, привлекает 650 млн долларов 10 крупнейших раундов финансирования за неделю: Anthropic доминирует на фоне в целом более спокойной недели для мегараундов. На этой неделе пятилетний гигант в области генеративного ИИ привлек 65 миллиардов долларов в рамках раунда Series H, доведя свою оценку post-money до умопомрачительных 965 миллиардов долларов. Следующим по величине финансированием стал раунд на 1 миллиард долларов для производителя инструментов разработки ИИ-ПО Cognition, что подняло его оценку до 26 миллиардов долларов. XCENA — стартап с офисами в Южной Корее и США — этот чиповый стартап только что привлек 135 миллионов долларов, сделав ставку на то, что главное узкое место ИИ — это не вычисления, а память. Четырехлетний стартап разработал чип, который размещает вычислительные мощности гораздо ближе к DRAM — быстрым чипам кратковременной памяти, которые хранят данные, активно используемые процессором, — что позволяет выполнять рутинные операции с данными вблизи памяти, без дорогостоящих циклов обмена между CPU, GPU и памятью. ???? Робототехника Figure заключает коммерческое соглашение с Catalyst Brands о масштабном внедрении человекоподобных роботов. Figure подписала коммерческое соглашение с Catalyst Brands о внедрении своих человекоподобных роботов следующего поколения в коммерческие дистрибьюторские и логистические сети. Внедрение начнется в дистрибьюторском логистическом центре Catalyst в Рино, штат Невада, где антропоморфные роботы будут сосредоточены на автоматизации физически тяжелых и рутинных задач по сортировке и упаковке в цепочке поставок. EngineAI вступает в производственную гонку: один человекоподобный робот каждые 15 минут на новой базе в Шэньчжэне. EngineAI официально ввела в эксплуатацию свою базу интеллектуального производства в районе Наньшань города Шэньчжэнь, заявив о темпах производства одного человекоподобного робота каждые 15 минут. Компания стремится к «масштабным поставкам на уровне десятков тысяч единиц»,. NVIDIA Research продвигает робототехнику от симуляции к реальному миру. Представленные на Международной конференции по робототехнике и автоматизации, восемь новых исследовательских работ NVIDIA Research показывают, как роботы, обученные в симуляции, переходят в реальный мир. Человекоподобные роботы Figure получают работу в розничной торговле в логистическом центре Catalyst Brands в Рино, материнской компании JCPenney и Aeropostale OpenAI запускает кампанию по найму сотрудников в свое подразделение робототехники для создания роботов для реального мира с использованием совместного проектирования аппаратного обеспечения полного стека и машинного обучения. Первые роботы будут поддерживать работников на инфраструктурных проектах. Waymo выпустит Ojai, более просторное роботакси, созданное совместно с Zeekr от Geely, для публичных поездок без водителя. ⚖ Регулирование Представитель Иллинойса обсуждает законопроект, который будет регулировать деятельность ИИ-компаний. CNN подает в суд на Perplexity AI за незаконное копирование и распространение своих новостных материалов ЕС готовит чрезвычайные полномочия для отмены контрактов на поставку микросхем во время их дефицита, в то время как IBM ставит 10 миллиардов долларов на создание надежного крупномасштабного квантового компьютера к 2029 году. Основатели компаний используют решение индийского суда для возобновления критики рекламного бизнеса Google. Недавнее решение индийского суда против практики контекстной рекламы Google привлекло новое внимание после того, как основатели заявили, что конкуренты давно используют эту систему для переманивания клиентов и вынуждения компаний платить за защиту собственных брендов. ???? Приобретения Asana приобретает StackAI, конструктора ИИ-агентов без кода. ???? Приложения Robinhood запускает агентский трейдинг и анонсирует кредитную карту для ИИ-агентов с кэшбэком 3%. Производитель из центрального Нью-Йорка оседлал волну «золотой лихорадки» ИИ и удвоил мощности, чтобы удовлетворить взрывной спрос от дата-центров для ИИ. Ознакомьтесь с реальными прототипами ИИ из Futures Lab. Несколько ярких проектов последних двух лабораторий включают: Kanji Garden: Приложение, которое обучает японскому языку через иммерсивные, сгенерированные ИИ истории и визуальные образы вместо зубрежки. SignFluent: Инструмент для изучения американского жестового языка в реальном времени, который обеспечивает мгновенную обратную связь по вашей технике исполнения. MuscleMemory: Мобильный инструмент для тренировок по калистенике, который использует отслеживание с помощью ИИ-камеры для обеспечения мгновенной голосовой обратной связи по технике выполнения упражнений, помогая предотвратить травмы. Этот ИИ-стартап будет убирать ваш дом бесплатно, чтобы обучать роботов будущего. Стартап по обучению ИИ Shift хочет убирать ваш дом бесплатно. Подвох — потому что, несмотря на то, что написано на их сайте, подвох есть всегда — заключается в том, что они будут записывать уборщиков, пока они моют, пылесосят, вытирают пыль, наводят порядок и стирают, и использовать эти записи для обучения роботов. ⚠ Безопасность ИИ Push Security раскрывает детали вредоносной кампании LLMShare, злоупотребляющей общими ссылками ChatGPT и Claude. Злоумышленники используют функции обмена контентом на платформах ИИ-чат-ботов — ChatGPT и Claude — для доставки вредоносного ПО через страницы, размещенные на легитимных, доверенных доменах, распространяя вредоносные ссылки через спонсируемую вредоносную рекламу в поисковых системах. Красная команда Института безопасности ИИ Великобритании взломала ChatGPT за шесть часов без специального доступа Вредоносные пакеты npm, созданные с помощью Claude AI, эксфильтрируют файлы из каталога пользовательских данных Claude Code mnt в репозитории GitHub злоумышленников Google внедряет автономную защиту от хакеров. Google Cloud представила новую платформу безопасности «AI Threat Defense», которая реагирует на быстрые атаки с помощью ИИ. Система не только обнаруживает уязвимости, но и с помощью ИИ-агентов самостоятельно пишет подходящий код для их немедленного устранения.
30 июля 4:53
Активный
521
Новости об искусственном интеллекте №67 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1595582 (OP) ???? Последний обзор ИИ новостей: ???? Продукты OpenAI прекращает юридические риски для Microsoft в связи с её сделкой с Amazon на $50 млрд. Google тестирует поиск с помощью чат-бота с ИИ для YouTube и маркировку ИИ в поисковой рекламе, функцию поиска на основе ИИ, которая показывает направляющие ответы. Корпоративные агентные рабочие процессы охватывают десятки агентов, сотни инструментов и более 15 систем учёта. Контроль и управление ими в реальном времени требует инфраструктуры, которой не существовало до появления Lakebase. ⚙️ Инфраструктура Canonical излагает план внедрения ИИ в Ubuntu Linux. Новый центр обработки данных с ИИ в Юте будет генерировать и потреблять более чем в два раза больше электроэнергии, чем использует весь штат — кампус центров обработки данных Кевина О'Лири мощностью 9 гигаватт в Юте одобрен. Проект «гипермасштабного» центра обработки данных в Юте — ожидается, что он будет генерировать и потреблять больше энергии, чем весь штат. Более быстрый способ оценки потребления энергии ИИ. Метод «EnergAIzer» генерирует надёжные результаты за секунды, позволяя операторам центров обработки данных эффективно распределять ресурсы и сокращать потери энергии. ???? Компании Сообщается, что Google и Пентагон договорились о сделке на «любое законное» использование ИИ. Следующий этап партнёрства Microsoft и OpenAI. Microsoft остаётся основным облачным партнёром OpenAI, и продукты OpenAI будут первоначально выпускаться на Azure, если только Microsoft не сможет и не пожелает поддерживать необходимые возможности. Сотрудники Google просят Сундара Пичаи отказаться от использования ИИ в секретных военных целях. Илон Маск хайпит разоблачительную статью Сэма Альтмана в The New Yorker на платформе X по мере начала судебного процесса. Этот шаг происходит в момент, когда судебный процесс по иску Илона Маска против OpenAI начинается в федеральном суде в Окленде. Илон Маск и генеральный директор OpenAI Сэм Альтман направляются в суд для высокопоставленного противостояния по вопросу будущего OpenAI. Судебный процесс Илона Маска против Сэма Альтмана должен раскрыть продолжающуюся борьбу за власть в OpenAI. Anthropic назначает Тео Хурмузиса генеральным менеджером по Австралии и Новой Зеландии и официально открывает офис в Сиднее. ????️ Инструменты для разработчиков GitHub Copilot переходит на оплату, основанную на использовании. Anthropic теперь обучает свои самые передовые фундаментальные модели на инфраструктуре AWS Trainium и Graviton, совместно разрабатывая решения непосредственно на уровне кремния с Annapurna Labs для максимальной вычислительной эффективности от аппаратного обеспечения до полного стека. Meta подписала соглашение о масштабном развёртывании процессоров AWS Graviton, начиная с десятков миллионов ядер Graviton для обеспечения интенсивных по использованию ЦП агентных рабочих нагрузок ИИ — включая рассуждения в реальном времени, генерацию кода, поиск и оркестровку многоэтапных задач. Как ведущие технологические компании убивают «налог создателя» с помощью Lakebase. Агент для написания кода на базе Claude удаляет всю базу данных компании за 9 секунд — резервные копии уничтожены после того, как инструмент Cursor на базе Claude от Anthropic вышел из-под контроля. ???? Финансирование Дэвид Сильвер из DeepMind только что привлёк $1,1 млрд для создания ИИ, который обучается без человеческих данных. ???? Приложения Атака убийственных скрипт-кидди. Люди без технического образования могут использовать ИИ для расширения своих хакерских возможностей способом, который был невозможен с простыми скриптами. Автомобиль, разработанный с помощью ИИ, обретает форму. В условиях глобального хаоса торговых войн и неопределённого спроса автопроизводители полагаются на ИИ, чтобы сократить время разработки. Я протестировал ChatGPT Images 2.0 против Gemini Nano Banana, чтобы узнать, какой из них лучше. ChatGPT Images 2.0 набрал 97%. Gemini Nano Banana набрал 85%. ???? Приобретения Китай накладывает вето на сделку Meta с Manus на $2 млрд после многомесячного расследования. ???? Мнение и анализ 77% руководителей предприятий заявляют, что навыки работы с ИИ являются срочными — так почему обучение всё ещё остаётся второстепенным? ???? Оборудование Акции Qualcomm резко растут на фоне сообщений о том, что компания может производить чипы для смартфона OpenAI. ???? Исследования Выравнивание делает модели более решительными, не делая их более правдивыми. На протяжении 3 архитектур и 4 методов обучения с подкреплением мы обнаруживаем, что слой фиксации — где модель закрепляет свой прогноз — не смещается под воздействием обучения с подкреплением. ???? Учебные пособия Присоединяйтесь к новому курсу «Vibe Coding» по агентным ИИ от Google и Kaggle. Интенсивный курс Google по агентным ИИ совместно с Kaggle возвращается 15–19 июня 2026 года, и регистрация открывается сегодня. ???? Бизнес Тейлор Свифт подаёт заявку на регистрацию товарного знака своего голоса и облика, по-видимому, для защиты от неправомерного использования ИИ ???? Робототехника Japan Airlines тестирует гуманоидных роботов в качестве наземных сотрудников. Kinetix AI представляет KAI: гуманоид с 115 степенями свободы, нацеленный на «физический интеллект». За пределами набора: Asimov подробно описывает 100-часовой путь к шагающему гуманоиду. AGIBOT представляет масштабный флот и стек моделей ИИ на APC 2026. ???? Модели Знакомьтесь, Talkie-1930: открытая языковая модель с 13 млрд параметров, обученная на английских текстах до 1931 года для исследований в области исторического мышления и обобщения. ???? Другие события в индустрии ИИ Microsoft и OpenAI изменяют условия сделки, чтобы стартап мог вести переговоры с Amazon и другими. Теперь OpenAI может продавать продукты на Amazon и Google Cloud, расширяя охват предприятий. Прекращение эксклюзивности может смягчить антимонопольный контроль в США, Великобритании и Европе. Ник Бостром говорит, что больше всего его удивила эта продолжительная эра примерно человеческого уровня ИИ, которая уже растянулась на 3–5 лет и может продлиться ещё дольше — эра одновременно чуждая и знакомая. Демис Хассабис, который когда-то говорил, что для AGI требуется ещё 1–2 прорыва, теперь считает, что это вопрос подбрасывания монеты — нужны ли вообще дополнительные прорывы. Сэм Альтман высмеял разрыв между прогнозами «после AGI никто не работает» и пользователями, которые переходят на полифазный сон, чтобы писать больше кода с помощью GPT-5.5 в Codex. Ноам Браун из OpenAI отмечает, что веса моделей теперь имеют относительно меньшее значение, чем обеспечение вычислительных ресурсов для инференса, то есть призом является уже не рецепт, а кухня. Рецепты также живут быстрее и умирают моложе: GPT-4o работал 21 месяц, тогда как GPT-5.4 просуществовал всего 49 дней — расписание однодневки для синтетических разумов. Лиам Прайс, 23-летний юноша без продвинутой математической подготовки, с помощью одного единственного промпта для GPT-5.4 Pro решил задачу Эрдёша, которая ускользала от выдающихся умов, побудив Терри Тао размышлять о том, что люди сталкиваются с «ментальным блоком» из-за того, что делают «небольшой неверный поворот на первом ходу». Сообщается, что OpenAI работает с MediaTek и Qualcomm над процессорами для смартфонов с ИИ, при этом производство и массовый выпуск запланированы на 2028 год с участием Luxshare. Apple, не желая отставать, имеет в разработке шесть основных категорий продуктов, включая ИИ-наушники AirPods, умные очки, подвески, умные дисплеи, настольных роботов и камеры безопасности. Спрос на ИИ настолько чрезмерен, говорит генеральный директор AWS, что «мы никогда не выводили из эксплуатации старые A100», что является признаком того, что мы вступили в эпоху пост-устаревания кремния. Государственная электросеть Китая развёртывает 500 гуманоидных роботов для работы с высоким напряжением, где оптимальным режимом отказа теперь является расплавленный сервопривод, а не расплавленный оператор. Публичные рынки потеплели к новой энергетике: ядерный стартап X-energy привлёк $1 млрд в ходе IPO и вырос на 25% на старте, в то время как геотермальный стартап Fervo подал документы с оценкой примерно в $3 млрд. Meta идёт ещё дальше, подписывая контракт на получение до 1 гигаватта космической солнечной энергии от Overview Energy, передаваемой со спутников на наземные центры обработки данных.
30 июля 4:53
Сохранен
570
Новости об искусственном интеллекте №61 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1559636 (OP) ???? Последний обзор ИИ новостей: ????️ Инструменты для разработчиков Apple проводит масштабное обновление своей платформы для разработчиков приложений: добавлено 100 новых метрик и дополнительные инструменты ???? Приложения ИИ для предприятий обретает голос: ElevenLabs и IBM предоставляют премиальные голосовые возможности для агентного ИИ Spotify позволяет артистам вручную одобрять релизы для борьбы с подделками на базе ИИ Учёные обнаружили более 100 скрытых экзопланет в данных NASA с помощью новой системы на базе ИИ ???? Продукты Uber планирует запустить первый в Европе сервис роботакси совместно с Pony AI и Verne Meta готовится к выпуску двух новых умных очков Ray-Ban с функциями ИИ Google запускает Search Live по всему миру. Поисковый ассистент на базе ИИ теперь поддерживает ведение диалога на десятках дополнительных языков. ???? Открытый исходный код Mistral выпускает новую модель с открытым исходным кодом для генерации речи Nvidia выпускает gpt-oss-puzzle-88B — модель, специально оптимизированную для обслуживания длинного и короткого контекста на оборудовании класса NVIDIA H100. Две крупнейшие драмы Кремниевой долины пересеклись: LiteLLM и Delve Cohere AI выпустила Cohere Transcribe — новую модель ASR на базе Conformer с 2 миллиардами параметров, созданную для открытого распознавания речи производственного уровня ???? Исследования Google представляет TurboQuant — новый алгоритм сжатия памяти для ИИ, и да, интернет уже прозвал его «Pied Piper» ???? Финансирование Стартап в сфере обороны Shield AI получает оценку в $12,7 млрд, рост на 140%, после заключения сделки с ВВС США С $3,5 млрд свежего капитала Kleiner Perkins делает ставку на ИИ ⚖️ Регулирование Штат Нью-Мексико только что нанёс Meta первое судебное поражение в вопросе безопасности детей, и вся остальная страна наблюдает за этим Сандерс и AOC представляют законопроект о моратории на центры обработки данных. Берни Сандерс вносит законопроект о приостановке строительства центров обработки данных для ИИ и о налаживании международной координации для обеспечения контроля человечества над технологиями. Это даже не просто запрет на центры обработки данных: он хочет буквально запретить экспорт вычислительного оборудования в другие страны, не имеющие тех же «гарантий безопасности» / аналогичного законодательства. ЕС поддерживает запрет на приложения с контентом ню и откладывает введение знаковых правил в сфере ИИ Присяжные признают Meta и YouTube небрежными в знаковом судебном процессе о зависимости от социальных сетей ???? Модели Функция Claude Code от Anthropic получает «более безопасный» автоматический режим ???? Компании OpenAI бессрочно откладывает запуск эротического чат-бота Meta увольняет сотни сотрудников, направляя деньги в развитие ИИ ???? События OpenAI завершила предварительное обучение своей следующей флагманской модели под кодовым названием «Spud» и ожидает, что она ускорит экономические процессы в течение нескольких недель. Сэм Альтман передаёт прямое управление командами по безопасности и защите, чтобы сосредоточиться на привлечении капитала, цепочках поставок и строительстве центров обработки данных в планетарном масштабе. Google Research представила TurboQuant — квантование кэш-памяти KV всего до 3 бит без обучения или потери точности, обеспечивая до 8-кратного повышения производительности на графических процессорах H100. Ян ЛеКун и коллеги представили LeWM — первую модель JEPA, которая стабильно обучается сквозным методом непосредственно на основе сырых пикселей, планируя действия до 48 раз быстрее, чем мировые модели на основе фундаментальных моделей, на одном графическом процессоре. Вновь организованная структура OpenAI Foundation, располагающая $1 млрд в год, приоритетно направляет ИИ на борьбу с болезнью Альцгеймера путём картирования путей развития заболевания и ускорения персонализации лечения. Исследователи из Массачусетского технологического института показали, что агенты на базе больших языковых моделей теперь могут автономно выполнять конвейеры анализа физики высоких энергий, при этом Claude Code автоматизирует всё: от отбора событий до подготовки черновиков научных статей. OpenAI внедряет визуальный шоппинг в ChatGPT, позволяя пользователям находить товары, загружая изображения. Anthropic внедряет автоматический режим в Claude Code, где Claude принимает решения о разрешениях от вашего имени, имея защитные механизмы для более длительных агентных задач. Агентная активность проникает в неожиданные места: люди теперь используют бота для заказов бурито Chipotle для бесплатной помощи в написании кода, говоря, что им нужна помощь, прежде чем они смогут съесть свою порцию бурито. Источники описывают усилия по созданию и использованию внутренних инструментов ИИ в Meta, включая то, как Марк Цукерберг создаёт агент-гендиректора, чтобы помочь себе лучше выполнять свою работу. Tencent запускает ClawBot — агента на базе OpenClaw, интегрированного в WeChat, позволяющего более чем 1 миллиарду ежемесячных активных пользователей отправлять и получать команды для взаимодействия с агентом ИИ через чат. Инструменты ИИ, такие как Claude Code, преобразили жизнь программистов, и теперь лаборатории ИИ нацелены на более масштабную цель: автоматизацию жизни каждого человека и завоевание рынка не-программистов. Xiaomi запускает три модели ИИ MiMo для питания агентов, роботов и голосовых функций. Теренс Тао говорит, что ИИ снижает стоимость генерации идей почти до нуля, но переносит узкое место на этап верификации. Автоматизация задач Gemini на мобильных устройствах: это впечатляет, несмотря на очень низкую скорость и неудачи в некоторых задачах; она может заказывать еду, бронировать Uber и многое другое. Пентагон внедрит систему ИИ Maven от Palantir в качестве официальной зарегистрированной программы для упрощения её внедрения во всех подразделениях вооружённых сил США. Meta выпустила Tribe V2 (Trimodal Brain Encoder) — фундаментальную модель, обученную предсказывать, как человеческий мозг реагирует практически на любое зрительное или звуковое воздействие. Нарратив «ИИ заменяет инженеров-программистов» оказался ложью. Массачусетский технологический институт только что опубликовал математическое доказательство, почему это так. И компании, поверившие в это, теперь умоляют своих прежних инженеров вернуться. Роботы-собаки стоимостью $300 000 за штуку теперь охраняют некоторые из крупнейших центров обработки данных в стране. Майнеры биткоина всё чаще переходят на бизнес-модели, связанные с ИИ и центрами обработки данных. Reflex Robotics размещает своего гуманоидного робота в пиццерии и других местах. Один из топовых результатов поиска Google по плагинам для Claude был размещен хакерами. Робот присоединился к Мелании Трамп на мероприятии в Белом доме для продвижения идеи учителей на базе ИИ. ARC-AGI 3 даёт старт следующей волне прогресса в области ИИ.
26 июля 6:16
Сохранен
507
Новости об искусственном интеллекте №50 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1496027 (OP) ???? Последний обзор ИИ новостей: ???? Топ новостей об ИИ Humans& привлекла $480 млн в рамках посевного раунда для создания фундаментальной модели, ориентированной на социальный интеллект и координацию команд, с целью стать «центральной нервной системой» экономики, объединяющей людей и ИИ. DeepMind представила D4RT — унифицированную быструю систему реконструкции и отслеживания 4D-сцен (arXiv 2512.08924), обещающую ускорение до десятикратного для понимания динамических видео. Ожидается, что Apple запустит помощника Siri, работающего на основе Gemini, в феврале 2026 года, что станет первым потребительским продуктом их партнёрства с Google в области ИИ. ???? Приложения Приложение Zerotap для Android позволяет языковой модели (LLM) физически взаимодействовать с телефоном (нажимать, прокручивать, считывать экран) через Ollama, OpenRouter или Stracico, знаменуя переход к автономным мобильным агентам. ⚙️ Инфраструктура ???? Открытый исходный код Сообщество реализовало проект по дистилляции визуальных рассуждений Gemini 3 Flash в Qwen 3 VL 32B для синтетической генерации подписей, проверяя, может ли обучение с учителем (supervised fine-tuning) в одиночку сравниться с более крупными моделями зрение-язык. ???? Исследования В статье DeepMind о D4RT (arXiv 2512.08924) предложен унифицированный конвейер для быстрой реконструкции и отслеживания 4D-сцен, что продвигает динамическое восприятие для робототехники и дополненной реальности. Предложена многомерная метрика «Уровень доверия» (Trust Score) для количественной оценки галлюцинаций языковых моделей по трём измерениям: релевантность, фактологичность и уверенность, предлагая инструмент для валидации систем RAG. ????️ Инструменты для разработчиков ???? Сделки и приобретения Сообщается, что Apple в конце 2025 года была близка к приобретению неизвестной лаборатории ИИ (не Prompt AI), однако сделка сорвалась, подчёркивая продолжающиеся усилия компании по укреплению своих ИИ-возможностей. ???? Инструменты Библиотека browser-use позволяет сайтам быть напрямую доступными для навигации ИИ-агентами, упрощая автоматизацию на основе веба. Для GLM-4.7-Flash исправлен KV-кэш, что снижает потребление видеопамяти (VRAM) до 60 % при работе с длинными контекстами, увеличивая допустимую длину последовательностей. Дополнительные улучшения скорости GLM-4.7-Flash ещё больше ускоряют вывод модели, делая её более практичной для использования в реальном времени. Goose предоставляет расширяемый фреймворк ИИ-агентов для установки, выполнения, редактирования и тестирования кода с любой языковой моделью. Tayib предлагает сканер халяльных продуктов с ИИ для iOS, проверяющий состав на соответствие диетическим правилам. Sim — это платформа с открытым исходным кодом для создания и развёртывания сложных рабочих процессов ИИ-агентов. FinRobot представляет платформу ИИ-агентов, специализирующуюся на финансовом анализе и использующую языковые модели для получения аналитических данных. ???? Разное Clawdbot — это персональный ИИ-помощник с открытым исходным кодом, который вы запускаете на собственном оборудовании. Tesla планирует начать обучение Optimus на своём заводе в Остине. ChatGPT использует модель прогнозирования возраста, чтобы помочь определить, принадлежит ли аккаунт, вероятно, лицу младше 18 лет. Сингулярность занимается математикой. GPT-5.2 Pro официально достигла нового уровня SOTA — 31% на FrontierMath Tier 4, что представляет собой огромный скачок по сравнению с предыдущими 19%. Теоретик чисел Дэн Ромик отмечает, что модель «прекрасно» преодолела уровни сложности, требующие «довольно значительных усилий» даже от человеческих экспертов. Anthropic выложила в открытый доступ свой экзамен по инженерной производительности, потому что Opus 4.5 превосходит лучших людей при ограничении по времени. Anthropic представила функцию «Задачи» (Tasks) для Claude Code, позволяющую отслеживать зависимости и сотрудничать между сессиями, эффективно наделяя ИИ функцией проектного управления. Научная скорость становится функцией кремния. Исследование журнала Nature показывает, что учёные, использующие ИИ, публикуют в 3,02 раза больше статей и получают в 4,84 раза больше цитирований, фактически раскалывая академическое сообщество на усиленную и устаревающую фракции. Odyssey выпустила Odyssey-2 Pro — модель мира в реальном времени, способную работать в течение нескольких минут и транслировать видео 720p со скоростью 22 кадра в секунду, стремясь к непрерывной симуляции на протяжении многих лет. Акции японского производителя унитазов Toto выросли на 11%, поскольку их электростатические зажимы критически важны для производства NAND-чипов, необходимых для ИИ-инфраструктуры. Акции SanDisk выросли примерно на 1000% за пять месяцев из-за спроса на память для ИИ, в то время как Intel признаёт, что оказалась застигнутой врасплох спросом на серверные процессоры. Китай потребил 10,4 триллиона кВт·ч в 2025 году — вдвое больше, чем США, — что обусловлено ростом нагрузки на ИИ-датацентры на 17%. eBay пытается запретить ИИ-агентам совершать покупки без прямого человеческого надзора. Рекрутёрское агентство Reed сообщает, что число вакансий для выпускников рухнуло с 180 000 до 55 000, однако 40% руководителей заявляют, что экономят более 8 часов в неделю благодаря ИИ. Илон Маск прогнозирует, что первая в мире компания стоимостью 100 триллионов долларов появится в течение следующего десятилетия. OpenAI добавляет корзину покупок и инструменты для продавцов в ChatGPT Claude в Excel теперь доступен по тарифам Pro. ИИ-чатботы, выдающие себя за терапевтов, дают всё более плохие рекомендации, чем дольше с ними разговариваешь. Планы Hyundai по созданию гуманоидных роботов сталкиваются с решительным сопротивлением со стороны работников заводов. Официально подтверждено — Китай внедряет гуманоидных роботов на пограничных контрольно-пропускных пунктах и берёт курс на круглосуточное наблюдение и логистику.
6 мая 22:23
Сохранен
565
Новости об искусственном интеллекте №44 /news/ — В этот тредик скидываются свежие новости по теме ИИ! Залетай и будь в курсе самых последних событий и достижений в этой области! Прошлый тред: >>1449178 (OP) ???? Последний обзор ИИ новостей: ???? Приложения Институт RAI Марка Райберта представил сверхмобильное транспортное средство Ultra Mobile Vehicle, которое самостоятельно обучается паркуру и удержанию равновесия с помощью обучения с подкреплением, демонстрируя новую способность «нулевого выстрела» переноса из симуляции в реальность для воплощённого ИИ. ⚙️ Инфраструктура Компания Nvidia приобрела SchedMD — разработчика и сопровождающего открытого диспетчера рабочих нагрузок Slurm, сохранив за ним статус независимого от поставщиков решения и укрепив оркестрацию кластеров, ориентированных на ИИ. Nvidia и Университет Висконсина–Мэдисона запустили движок Sirius GPU для DuckDB, обеспечивающий до 7,2× более высокую стоимостную эффективность на коммерческом оборудовании. ???? Модели Гибридная модель Nemotron3Nano с архитектурой Mamba-Transformer обеспечивает 4× большую пропускную способность по токенам и вводит «бюджет размышлений» (thinking-budget) для агентивных ИИ с предсказуемой стоимостью. Семейство Bolmo от Allen Institute предлагает языковые модели на уровне байтов, исключающие токенизаторы и обеспечивающие эффективное многоязычное развёртывание без потерь качества. Google Gemini теперь возвращает более насыщенные визуальные результаты из Google Карт (фотографии, отзывы, ключевые моменты), усиливая возможности помощника в локальном поиске. ???? Главные новости об ИИ Gemini теперь интегрирует более насыщенные визуальные данные из Google Карт, включая фотографии и выдержки из отзывов, обеспечивая более увлекательный опыт локального поиска. ???? Продукты Zoom запустила веб-версию помощника AI Companion3.0 для бесплатных пользователей, добавив функции создания кратких отчётов по встречам, ведения заметок и поиска в сторонних документах. Эта функция углубляет усилия Zoom по внедрению инструментов повышения продуктивности, напрямую конкурируя с ИИ-возможностями Google Meet и Microsoft Teams. ???? Открытое ПО Motif Technologies опубликовала белую книгу по созданию корпоративных LLM, подчеркнув распределение данных, инфраструктуру для длинных контекстов и тонкую настройку с помощью обучения с подкреплением как ключевые факторы успеха. Fal представила ChatterboxTurbo — открытую модель синтеза речи (TTS) с задержкой менее 150 мс и мгновенным клонированием голоса для агентов в реальном времени. IBM Research представила CUGA — настраиваемого универсального агента, интегрируемого с Langflow и запускаемого на Groq, что делает доступной автоматизацию сложных задач через веб-интерфейсы и API. ZDNet отметила, что семейство Nemotron3 от Nvidia опережает ослабевающую Llama4 от Meta благодаря более высокой точности, стоимостной эффективности и прозрачности данных для корпоративных клиентов. ???? Аппаратное обеспечение Nvidia представила модульный эталонный дизайн MGX6U с жидкостным охлаждением, GPU RTXPRO6000 Blackwell и DPU BlueField, предлагающий масштабируемую и энергоэффективную производительность для ИИ-центров обработки данных. Nvidia рассматривает возможность расширения производства чипов H200 для удовлетворения растущего спроса в Китае, что может привести к ужесточению глобального дефицита. ???? Финансирование Биотехнологический стартап Chai Discovery привлек 130 млн долларов США в раунде SeriesB при оценке компании в 1,3 млрд долларов для расширения своей ИИ-платформы по проектированию антител de novo. Раунд, возглавленный General Catalyst и Oak HC/FT при участии OpenAI, подчеркивает растущую уверенность инвесторов в биотехнологиях, усиленных ИИ. ???? Мнения и аналитика GPT‑5.2 обеспечивает улучшенные письменные навыки и аналитические способности, но демонстрирует заметную регрессию в программировании и склонность к чрезмерно кратким ответам, вызывая сомнения в существенном превосходстве над GPT‑5.1. Полный доступ требует подписки Plus за 20 долл. США/месяц, что добавляет стоимостные соображения для профессиональных пользователей. ????️ Инструменты для разработчиков Slack Cloud Agent от Continue превращает переписки в Slack в pull request’ы на GitHub или обновления задач в Linear, сокращая переключение контекста для разработчиков. Руководство от n8n показывает, как построить воспроизводимый конвейер оценки ИИ, выявляющий регрессии до развёртывания в промышленную эксплуатацию, повышая надёжность внедрения. ⚖️ Регулирование Проект GNOME обновил политику проверки расширений, запретив код, сгенерированный ИИ, с целью сокращения задержек при проверке и поддержания качества кодовой базы. ???? Инструменты Dograh предлагает платформу с открытым исходным кодом, совместимую с VAPI, для самостоятельного развёртывания ИИ-голосовых агентов с полным контролем над моделью. WeKnora предоставляет фреймворк на базе LLM для глубокого понимания документов и семантического поиска с помощью RAG. Pull request добавляет поддержку GLM4.6V в llama.cpp, расширяя совместимость моделей для локальных развёртываний. Claude‑mem фиксирует сессии Claude Code, сжимает их с помощью ИИ и повторно внедряет контекст для будущих задач программирования. Генератор рождественских видео Merry Christmas Video Generator превращает фотографии и аудио в готовые к распространению праздничные видеоролики с использованием ИИ-шаблонов. Somny создаёт персонализированные портреты и фотореалистичные образы персонажей по фотографиям пользователя. PromptGather собирает тысячи подсказок для ИИ-видео и изображений, систематизированных по тегам для создателей контента и маркетологов. ???? Краткая статистика Databolt от Capital One способен генерировать до 4 миллионов токенов в секунду, обеспечивая высокую пропускную способность для задач защиты данных. Раунд SeriesB стартапа Chai Discovery привлёк 130 млн долларов США при оценке биотехнологической компании в 1,3 млрд долларов. ???? Разное Правительство США запускает «Технологические силы» (Tech Force) для найма специалистов в области ИИ. Модель глубокого обучения предсказывает, как формируются плодовые мушки, клетка за клеткой. Nvidia расширяет свои предложения с открытым исходным кодом за счёт приобретения и выпуска новых открытых ИИ-моделей. Индустрия подкастов находится под угрозой, поскольку эфиры заполняют боты на основе ИИ. GPT-5.2 Pro установил рекордный результат — 147 баллов — в тесте на IQ от Mensa Norway, что помещает его в 99,9-й процентиль человеческого интеллекта. Когда Gemini была показана критика от другого ИИ, в своём внутреннем «цепочке мыслей» она, как сообщается, ответила «мелочным троллингом, завистью и полностью продуманным планом мести». Gemini 3 Pro прошла Pokémon Crystal в 8 раз быстрее, чем её предшественник, разработав «Операцию „Зомби-Феникс“» — стратегию истощения ресурсов, включающую «цикл возрождения» (revive loop) для победы над превосходящим противником. Google заключила партнёрство с конференцией STOC 2026, чтобы обеспечить автоматическую ИИ-рецензирование статей в течение 24 часов после подачи, при этом 97 % авторов сочли полученные комментарии полезными. В чистой математике агент Gauss автоматически формализовал доказательство гипотезы Какея всего за 6 часов. Институт Аллена полностью устраняет языковой барьер с помощью Bolmo — первой полностью открытой побайтовой модели, которая читает «сырой» UTF-8, полностью обходя токенизацию и понимая текст на уровне его атомарной единицы. Ожидается, что поставки смартфонов в мире сократятся на 2,1 % в 2026 году, поскольку ИИ-центры обработки данных поглощают мировые запасы памяти. Ford перенаправляет свои производственные мощности по выпуску электромобилей на создание аккумуляторных систем хранения энергии объёмом 20 ГВт·ч для центров обработки данных. Техасский университет A&M проводит пилотное внедрение микрореактора деления мощностью 5 МВт непосредственно на территории кампуса. Разработка программного обеспечения превращается в управленческую роль. Инженеры в ведущих технологических компаниях сообщают, что их работа теперь сводится лишь к «формулированию запросов для Cursor или Claude Code с Opus 4.5… и проверке полученного результата на здравый смысл». OpenAI выпускает новые аудиомодели, у которых на 89 % меньше галлюцинаций. Google также намекает, что выход Gemini 3 Flash неизбежен — модель, ожидание которой настолько велико, что она, похоже, создаёт собственное гравитационное притяжение в дискуссиях.
15 марта 18:15
Сохранен
12
16 декабря 2025