gram news
Дрессировщик Нейросетей channel avatar

Дрессировщик Нейросетей

@ai_handler

ИИ-агенты и автоматизация под реальные задачи. YouTube: youtube.com/@HandlerAI Консультации и сотрудничество: @Flytoo

ProjectsRUAI

8,730subscribers

Open the Channel

Latest posts

  • Дрессировщик Нейросетей

    22 Sept, 18:20

    forwarded from @markettwits

    🇺🇸#ии #трамп Трамп дал распоряжение переименовать ИИ в "СИ" (Супер-Интеллект) — AXIOSTRUMP ORDERS AI REBRAND AS "SUPER INTELLIGENCE"
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    891215Open in Telegram
  • Дрессировщик Нейросетей

    22 Sept, 18:20

    Не смог удержаться, чтобы не перепостить )
  • Дрессировщик Нейросетей

    19 Sept, 04:09

    НАКОНЕЦ-ТО ОДИН ФАЙЛ ПРАВИЛ ВМЕСТО ДВУХ.Часто бывает, что в проекте работают и Клод код, и Кодекс. А значит лежат два файла с правилами: CLAUDE.md для одного, AGENTS.md для второго. И правки в одном приходится синхронизировать с другим. Забыли - агенты пошли по разным инструкциям.Антропики наконец приняли общий стандарт. С версии 2.1.277 Клод код умеет читать AGENTS.md - тот самый общий формат, который уже понимают все остальные. Так и написано в чейнджлоге.Работает так. Клод сначала ищет CLAUDE.md. Нашёл - читает его и в AGENTS.md даже не заглядывает. Не нашёл - читает AGENTS.md.То есть файлы не складываются вместе. Хотите один на всех - CLAUDE.md надо удалить. Переключается в /config, раздел Project instructions. На Bedrock, Vertex и Foundry пока не завезли.Сам AGENTS.md живёт в 60 тысячах опенсорсных проектов, его читают Кодекс, Курсор, Gemini CLI, Copilot, Windsurf, Devin.
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    2,850181482Open in Telegram
  • Дрессировщик Нейросетей

    17 Sept, 15:59

    АМОДЕИ ЗОВЁТ ПРИТОРМОЗИТЬ ПРОГРЕСС, А НОВЫЙ ОПУС УЖЕ НЕДЕЛЮ КРУТИТСЯ У НАС В ТЕРМИНАЛЕВ прошлом посте я разбирал, как Амодеи призвал осознанно замедлить рост возможностей моделей. Было это в субботу. Ровно с той же субботы мой Opus в Claude Code работает как другая модель.Заметил не только я. В нашем чате спросили: «opus 5 последнее время поменялся, поумнел что ли». Я ответил, что есть такое, похоже на скрытый ап и скоро будет официальная версия.В тот же день в X пошли слухи про Opus 5.2, а к 15 сентября разработчики начали ловить в Claude Code бэкенд-идентификатор новой версии. Официально Anthropic молчит: ни карточки модели, ни поста, ни цены.Сначала я думал, что это просто подкрутили старый Opus. Потому что пользоваться им было буквально невозможно, я об этом уже писал. В роли исполнителя он меня за месяц измотал по двум причинам. - Переусложнял и делал то, о чём не просили.
    TelegramДрессировщик НейросетейЯ БОЛЬШЕ НЕ ПОНИМАЮ, ЧТО ДЕЛАЕТ МОЙ АГЕНТ. А ЭТО ЕЩЁ СЛАБАЯ ВЕРСИЯ Раньше, когда на выходе получалась ерунда, я думал «модель тупит». Теперь ставлю задачу Астре или Фэйблу 5.1 и всё чаще ловлю себя на другой мысли. Это не он сделал неправильно. Это я не…
    2,82013422Open in Telegram
  • Дрессировщик Нейросетей

    14 Sept, 05:40

    Я БОЛЬШЕ НЕ ПОНИМАЮ, ЧТО ДЕЛАЕТ МОЙ АГЕНТ. А ЭТО ЕЩЁ СЛАБАЯ ВЕРСИЯРаньше, когда на выходе получалась ерунда, я думал «модель тупит». Теперь ставлю задачу Астре или Фэйблу 5.1 и всё чаще ловлю себя на другой мысли. Это не он сделал неправильно. Это я не смог с ним договориться.Разница тут огромная. Галюны на месте, овер-инжиниринг на месте, иногда уезжает вообще не туда. Но когда разбираешь, почему вышло не так, упираешься в свою постановку, а не в его мозги. Сижу и смотрю на его работу как ребёнок на взрослого.Наружу при этом лаборатории отдают не самое сильное. Mythos весной показали всем, а потрогать дали избранным по списку. То есть я упираюсь в границу своего понимания на модели, которая внутри компании считается вчерашней.И вот на этом фоне случился прецедент, которого не было ни разу. В субботу Амодеи написал, что пора осознанно замедлить рост возможностей моделей. Через
    TechCrunchAnthropic debuts preview of powerful new AI model Mythos in new cybersecurity initiative | TechCrunchThe new model will be used by a small number of high-profile companies to engage in defensive cybersecurity work.
    3,890231763Open in Telegram
  • Дрессировщик Нейросетей

    5 Sept, 05:08

    ЖИВЁМ В УДИВИТЕЛЬНОЕ ВРЕМЯ.Строю террасу у дома. Казалось бы - доски, лаги, лиственница, при чём тут ИИ.Скинул Fable 5.1 размеры фундамента, попросил проект. Получил рабочую документацию - раскладку настила, ведомость лаг, нагрузки, схему сдвоения досок и точный расход материалов. Её так и отдал строителям в работу.3D-визуализацию сделала только что вышедшая GPT-6 Astra - по тем же фото недостроенной террасы. Сумерки, тёплый свет, подсветка ступеней, можно менять ракурс и время суток.По ощущениям Astra очень похожа на Fable. В чём именно она сильнее - пока не скажу, надо тестировать. Но одно заметил сразу: в сравнении с прошлой Sol она общается как нормальный человек - по-русски чисто и задачу понимает с лёту. Две конкурирующие модели, и обе сделали работу, которую год назад я заказывал бы людям - за деньги и с неделей ожидания.Мы недооцениваем момент. Это уже не «спроси у
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик НейросетейImage from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    5,350582713Open in Telegram
  • Дрессировщик Нейросетей

    2 Sept, 09:41

    FABLE 5.1 ТОЛЬКО ВЫШЕЛ - И Я СРАЗУ ЗАПУСТИЛ ЕГО ПЕРЕДЕЛЫВАТЬ СВОЙ HARNESSFable 5.1 вышел вчера. Я сразу посадил его за мою же систему - попросил разобрать, как я работаю, и предложить, что переделать в моём harness.Всё свежее, толком ещё не обкатал: ниже пока рекомендации, а не проверенные временем правила. Но толковые, поэтому делюсь уже сейчас.В прошлый раз я показывал вам и плагин, и свой CLAUDE.md - сегодня свежие версии обоих. Плагин - senior-fableОткуда всё это. Fable прочитал свою же системную карточку на 212 страниц, гайд Anthropic по миграции на новые модели и мои транскрипты Claude Code за 30 дней - там скрипт посчитал токены по моделям и ролям. Ещё сходил в issues репозитория Claude Code и на Hacker News проверить, один ли я мучаюсь с Opus 5.Так что ниже смесь из того, что пишет сама Anthropic, и того, что видно по моим цифрам.1. Не гонять модель на максимальном
    5,260file22141241Open in Telegram
  • Дрессировщик Нейросетей

    20 Aug, 10:51

    РАСШИРЕНИЕ ДЛЯ NOTEBOOKLM ТЕПЕРЬ В МАГАЗИНЕ CHROMEПомните видео, где я автоматизировал NotebookLM? Оно собрало 177 тысяч просмотров. Расширение из того видео - Add to NotebookLM - раньше ставили вручную через режим разработчика. Теперь оно в Chrome Web Store: установка в два клика, обновления прилетают сами.Что умеет: • Любую страницу в нотбук одним кликом - или целиком как PDF со всем содержимым • YouTube: добавить видео, плейлист или все видео с канала, вытащить комментарии как источник • Массовый импорт ссылок и всех открытых вкладок сразу • Синхронизация с Google Drive - Docs и Sheets прямо из шапки NotebookLM • Несколько аккаунтов, тёмная тема, русский и английский интерфейсКод открытый, бесплатно.Просьба. В поиске магазина пока вылезают чужие копии, а не оригинал. Если пользуетесь - зайдите и поставьте звезду. Оценки и установки поднимут настоящее расширение наверх, и его
    GoogleAdd to NotebookLM: YouTube & Web Importer - Chrome Web Store100% free, no limits. Bulk import YouTube videos, playlists, comments and web pages to NotebookLM. No premium tier, no account.
    5,7206243163Open in Telegram
  • Дрессировщик Нейросетей

    14 Aug, 03:23

    УПРАВЛЕНИЕ АГЕНТАМИ - ЭТО УПРАВЛЕНИЕ ЛЮДЬМИЧем дольше работаю с агентами, тем сильнее дежавю. Всё, что заставляет агента работать, придумали задолго до нейросетей - для людей. И все классические ошибки менеджмента агенты повторяют один в один, только быстрее и дешевле.Собрал несколько , где совпадает точь-в-точь.• Микроменеджмент. Кажется, машине можно навесить 100 условий, она же справится. Получается наоборот: чем длиннее список, тем быстрее исполнитель его теряет. И человек, и агент. Три условия, которые можно проверить, выигрывают у десяти, которые проверить нечем.• Запреты с причиной. Голый запрет держится ровно до первого нового случая. Запрет с причиной исполнитель переносит сам. «Туда не ходи, сюда ходи, а то снег башка попадёт - совсем мёртвый будешь». С агентом ровно так же. Да и родители знают давно: «не трогай» не работает, а «не трогай - горячо» работает.• Проверка
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    6,10036322051Open in Telegram
  • Дрессировщик Нейросетей

    11 Aug, 06:45

    КАК СТАВИТЬ ЗАДАЧУ АГЕНТУ, ЕСЛИ ТЫ НЕ ПРОГРАММИСТЯ не пишу код. Но задачи агенту ставлю каждый день - и они выполняются. Секрет не в программировании. Секрет в том, КАК сформулировать.Есть подход из разработки - BDD (разработка на основе поведения). Звучит страшно, а суть детская: описываешь не КАК делать, а ЧТО должно получиться и КАК ты поймёшь, что готово.Две вещи, которые ты обязан дать: • Цель - что хочу на выходе. • Критерий готовности - как я пойму, что это оно. Всё, что между - забота агента. Не твоя. И описываешь ты это как поведение: «когда вот так - тогда вот это». Не пожелание в пустоту, а конкретный сценарий.Бытовой пример. Ремонт в ванной. Ты же не диктуешь плиточнику, под каким углом держать шпатель. Ты говоришь: «плитка вот такая, ровно, без зазоров, чтоб вода не стояла». Это цель и критерий. КАК он это сделает - его работа.С агентом так же. Скажешь «сделай
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    5,270441241Open in Telegram
  • Дрессировщик Нейросетей

    29 Jul, 17:13edited

    OPUS 5 Я ТАК И НЕ РАСКУСИЛ - НО КАК ПОМОЩНИК ОН ОГОНЬНаконец плотно потестил Opus 5. И честно - до конца я его так и не понял. Промтить его надо иначе, чем прошлые модели. Он конкретнее и молчаливее. Похож на GPT: даёшь задачу - идёт до конца, не бросает на полпути. Скажет пару слов и, как Fable, молча уходит работать.Что зацепило - доводит дело до конца. Раньше модель могла встать на середине: мол, дальше сам. Этот докручивает всё до рабочего результата, включая мелочи, которые раньше приходилось выпрашивать отдельно. И проверяет себя сам. Настолько, что Anthropic официально советуют убрать из инструкций «проверь свою работу» - иначе он гоняет проверку по второму кругу, а платишь за это ты. Сам я держу его на high .Так как моими основными моделями стали Fable5 и Opus 5, под них я решил переделать свой конвейер .В прошлом посте я переписывал свой CLAUDE.md под свежие
    GitHubGitHub - AndyShaman/senior-fable: Tech-lead orchestration for Claude Code — the top-tier model (Fable) keeps architecture & decisions…Tech-lead orchestration for Claude Code — the top-tier model (Fable) keeps architecture & decisions, cheap subagents (Sonnet/Opus) do the routine and the digging. Save tokens without losing...
    6,070251712Open in Telegram
  • Дрессировщик Нейросетей

    25 Jul, 07:09edited

    ВЫШЕЛ OPUS 5. А Я ВМЕСТО ТЕСТОВ ПОЛЕЗ ПЕРЕПИСЫВАТЬ СВОЙ CLAUDE.md.У меня правило: вышла новая модель - сначала пересмотри свой харнес. И начинать с главного файла, глобального CLAUDE.md. Он грузится в каждой сессии, любая ошибка в нём умножается на всю работу.Anthropic тут сам дал сигнал. Thariq из команды Claude Code показал (пост): для Opus 5 они выпилили 80%+ системного промпта - и эвалы не просели. Старые модели надо было связывать правилами. Новые от этих правил тупеют. Главная боль - когда инструкции в одном запросе спорят между собой, и модель тратит силы на разруливание вместо задачи.Что я сделал у себя: • Прогнал /doctor прямо в Claude Code - команда сама проходит по скиллам, MCP и CLAUDE.md и предлагает, что выкинуть. • Попросил модель сверить мои правила с её системным промптом - и она сама показала, где моё правило с ней спорит, а где просто дублирует. Конфликты я
    7,060file411392Open in Telegram
  • Дрессировщик Нейросетей

    24 Jul, 06:54edited

    ГОЛОСОМ. НА РУССКОМ. И ОНО РЕАЛЬНО ДЕЛАЕТ ДЕЛА.Включил на телефоне голосовой режим Claude - русский уже есть. Пока в бете, голос один, зовут «Звонкий». Поговорил. И это вам не «болталка», как у остальных. 23 июля Anthropic докрутил главное: голос теперь ходит в подключённые приложения - Gmail, Календарь, Google Docs, Slack, Notion, Canva. Голосом просишь перенести встречу или набросать письмо - и он идёт и делает. Крутится уже не на быстром Haiku, а на старших Opus и Sonnet. Модель выбираете сами, отдельной кнопкой.И вот тут фишка. Под капотом теперь умная агентская модель - та, что умеет строить цепочки действий, как Claude Code. Только голосом. Говоришь задачу, а он сам раскладывает её на шаги: сходить в почту, глянуть календарь, набросать ответ - и выполняет по порядку. Бесплатный план - Haiku и один коннектор. Платный - все модели и все ваши подключения.Соль - в сравнении. Chat
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    6,47029161121Open in Telegram
  • Дрессировщик Нейросетей

    21 Jul, 18:01edited

    БЕЗ ШУМА И ПОМПЫ GOOGLE ВЫКАТИЛ ТРИ МОДЕЛИВсе ждали чего-то громкого. А они по-тихому обновили всю Flash-линейку. • Gemini 3.6 Flash Лошадка под код и агентов. На выходе жрёт на 17% меньше токенов. • Gemini 3.5 Flash-Lite Самая быстрая и дешёвая. 350 токенов в секунду. • Gemini 3.5 Flash Cyber Ищет и чинит дыры в коде. Пока по пилоту для своих.Честно? Куда это применять - без понятия. Я гоняю Gemini в чате. Задаю непонятные мне вопросы, получаю ответы. Плюс нанобанана на картинки. Всё, на этом применение и кончается. Да, и ещё, забыл. По видео YouTube тоже вопросы задаю - нативно поддерживают.А ведь даже китайцы веселее. Тот же свежий Kimi K3 смотрится интереснее, чем то, куда катится Google.Так куда их пристраивать в реальной жизни? И ждёте ли вы вообще чего-то от новых Flash - или это уже гонка ради гонки?
    6,6402573Open in Telegram
  • Дрессировщик Нейросетей

    12 Jul, 06:04edited

    КАК ОТДАТЬ ЛИЧНЫЙ TELEGRAM АГЕНТУ И НЕ СЛИТЬ АККАУНТИИ-агентами мы пользуемся давно - работа, код, рутина. Но личный Telegram, где лежит вся память (кто, что и кому обещал), отдать агенту боязно. И не зря.Единственный способ был - юзербот. А он логинится в аккаунт КАК ВЫ, через session string. Это не ключ от бота, а ключ от всего аккаунта. Отсюда два страха, оба реальные:• Бан. Telegram банит за автоматизацию через MTProto, а за что именно - не скажет никто. И тогда улетает личный аккаунт целиком: годы переписки, контакты, привязанные сервисы. Апелляция - как повезёт, чаще мимо. • Угон. Утёк session string - и чужой уже читает вашу личку и пишет от вашего имени. Двухфакторка не спасёт: она стоит на входе, а сессия уже авторизована.Так вот, выход есть, и я на нём живу. Официальный Business API - Telegram сам, легально, по вашему разрешению отдаёт боту ваши личные чаты. Никакого
    GitHubGitHub - AndyShaman/telegram-business-bridge: Connect any AI agent to your personal Telegram via the official Business API — no…Connect any AI agent to your personal Telegram via the official Business API — no userbot, no ban risk, no Premium. Agent reads & searches full history, drafts replies; every reply waits fo...
    7,93057181521Open in Telegram
  • Дрессировщик Нейросетей

    9 Jul, 17:10

    ВЫШЛО ПРОДОЛЖЕНИЕ ГЛАВНОГО БЕСТСЕЛЛЕРА ПРО ИИПомните AI 2027? Тот самый сценарий с датами, который все обсуждали. Та же команда (Eli Lifland, экс-OpenAI) выкатила продолжение - AI 2040: Plan A. На этот раз не «как мы все умрём», а «как выжить».Если кому-то лень читать целиком - вот кратко.Суть: пять сценариев, как США могут (или не могут) ответить на приход суперинтеллекта.• Plan A - Договориться (их фаворит). США и Китай в 2029 соглашаются не гнать гонку. Всё AI-исследование открыто, десятки компаний идут вровень и медленно, взаимное сдерживание через контроль над вычислениями. Суперинтеллект откладывают аж до 2040. Сами называют это «наименее плохим планом из тех, что знаем». • Plan B - Воевать с Китаем. Вместо сделки жёсткое противостояние. • Plan C - Спустить фору. США профукивают своё технологическое преимущество. • Plan D - Гнать до сверхинтеллекта. Текущая траектория без
    AI 2040AI 2040: Plan AA detailed forecast and recommendation for how the US, China and the rest of the world should navigate superintelligence.
    5,580179321Open in Telegram
  • Дрессировщик Нейросетей

    9 Jul, 06:43

    СЕГОДНЯ ВСЁ ВНЕЗАПНО РАБОТАЕТБывают дни, когда обновления не бесят, а радуют. Сегодня прям такой.• Grok 4.5 - свежий, по SuperGrok дают пощупать 7 дней бесплатно. Работает неожиданно хорошо, похоже, сказывается покупка Cursor. Не демо-огрызок, а полноценный режим. • Live 1, голосовой от OpenAI. Включил и сначала выпал: говоришь почти как с живым человеком. Не роботное «чем могу помочь», а нормальный диалог. Меня, честно, подзаморозило. • На подходе GPT-5.6 - обещают сегодня.Осталось, чтобы Anthropic в честь такого дня ещё и лимиты сбросили. Вот тогда будет совсем праздник.А вы уже щупали Grok 4.5 или голосовой режим? Делитесь, как ощущения.
    x.aiIntroducing Grok 4.5Grok 4.5 is SpaceXAI's smartest model built for coding, agentic tasks, and knowledge work.
    4,950211Open in Telegram
  • Дрессировщик Нейросетей

    7 Jul, 07:12

    УСПЕЙТЕ ВЫЖАТЬ ИЗ FABLE МАКСИМУМ - ПОКА ОН ПО ПОДПИСКЕСегодня последний день, когда Fable доступен по подписке. Если ещё не гоняли - потратьте его с толком. Не на очередную фичу, а на аудит того, как вы вообще работаете с агентами.И тут смысл шире, чем сам Fable. Ваш харнес - хуки, скиллы, память, CLAUDE.md - остаётся с вами, а модель под ним меняется. Так что оптимизируете вы не «под конкретную модель», а свой рабочий контур в принципе. Он переживёт и эту модель, и следующую. А сильная модель для такого аудита - как раз повод успеть, пока она в доступе.Fable отлично тянет эту мета-задачу. Глубины рассуждения хватает, чтобы не просто прочитать конфиги, а выцепить неочевидное: какие вопросы вы задаёте по десять раз (значит, это должно жить в CLAUDE.md или памяти), на что постоянно жмёте «разрешить» (кандидаты в allowlist), какие скиллы мертвы, где дорогая модель жжётся на мелочах.
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    5,930359811Open in Telegram
  • Дрессировщик Нейросетей

    2 Jul, 11:49

    FABLE 5 - КАК СЕНЬОР, КОТОРЫЙ ТОЧНО ЗНАЕТ, ЧЕГО ТЫ ХОЧЕШЬПогонял Fable 5 и честно - на другие модели уже почти не смотрю. Как будто рядом сидит умный чел, который понимает тебя с полуслова.Понимает задачу. Задаёт вопросы по делу. Сам замечает попутные мелочи и говорит о них. Держит фокус.Минус тоже есть. Он слишком самостоятельный. Иногда сам себе задаёт вопрос, ответа не ждёт и едет дальше. Поэтому с ним работаешь не так, как с Opus или GPT-5.5 - надо сразу обозначить, где он решает сам, а где ждёт меня.И ещё: на сложных задачах Fable быстро ест токены. Это и была одна из причин, почему я сделал плагин.Собрал небольшой плагин для Claude Code - senior-fable. Смысл простой: дорогая модель думает, дешёвые делают.• Fable - за главного: разбить задачу, архитектура, спорные решения, собрать всё вместе. • Рутину (тесты, boilerplate, переименования) отдаёт дешёвому Sonnet. • Долгие
    GitHubGitHub - AndyShaman/senior-fable: Tech-lead orchestration for Claude Code — the top-tier model (Fable) keeps architecture & decisions…Tech-lead orchestration for Claude Code — the top-tier model (Fable) keeps architecture & decisions, cheap subagents (Sonnet/Opus) do the routine and the digging. Save tokens without losing...
    6,74049191111Open in Telegram
  • Дрессировщик Нейросетей

    1 Jul, 08:21edited

    ВСЕ ГОВОРЯТ ПРО КОД, А GOOGLE ТИХО ЛЕЗЕТ ВАМ В ТЕЛЕФОНСмотрю ленту за последний месяц - сплошь код. Claude Code, Codex, Cursor, кто у кого отыграл процент на бенчмарке. А Google за этим шумом без фанфар выкатил кучу бытовых штук, которыми пользуешься каждый день. Коротко о том, что нового:• Nano Banana 2 Lite - картинки за пару секунд и вдвое дешевле старшей. Для «накидать двадцать вариантов и выбрать один». У меня генерация давно на Google, так что прям в кассу. • Gemini Omni Flash - монтаж видео обычным текстом: «убери фон, сделай темнее» - и готово. То, за что раньше платили монтажёру. • Auto Browse в Chrome на Android - браузер не просто отвечает на вопросы, а сам делает: проходит оформление заказа, заполняет формы, отменяет подписки. Перед оплатой переспрашивает. • Голос в Gmail и Docs - надиктовал, а оно нашло нужные письма или собрало документ из потока мыслей. Ни буквы
    Image from a post by Дрессировщик НейросетейImage from a post by Дрессировщик Нейросетей
    5,7001814Open in Telegram