gram news
Этихлид channel avatar

Этихлид

@etechlead

Канал техлида с мыслями об AI, IT и спорте. https://t.me/etechlead/6 - содержание https://t.me/etechlead/8 - о канале https://t.me/+NgQZbosvypEyYWQ6 - чат канала, там отвечаю(т) быстрее :) (без рекламы)

ProjectsRUAI

6,910subscribers

Open the Channel

Latest posts

  • Этихлид

    22 Sept, 14:49edited

    Конвертируем Enterprise-проект в Dark FactoryDark Factory - цех без света, потому что людей на линии нет. В разработке это агенты, которые сами доводят задачу до деплоя, а человек ставит цель и принимает результат в контрольных точках. Красиво звучит, когда вас трое и проект свой. А что если он с легаси, без документации, тестов и CI и на нём сменилось несколько поколений разработчиков?Граблей на этом пути предостаточно, но и практик бега по ним накопилось тоже немало :)Вопрос, на мой взгляд, всё-таки не в том выключать ли свет в цехе совсем, а какие участки уже могут работать в темноте и что для этого нужно сделать.Завтра разбирем эту тему с Родионом Мостовым (CodeAlive) в рамках серии митапов на буткемпе NAITION. Расскажем, как сделать проект понятным агенту и проверяемым, как замкнуть петлю обратной связи на инфраструктуру, зачем тут лестница готовности, сколько и когда можно
    1,200147432Open in Telegram
  • Этихлид

    26 Aug, 18:46edited

    MAS vs SAS: код писать научились, работать вместе - пока нет (2.2/4)Начало ⬆️🔴 Доверие и скепсис пока плохо сбалансированы● Избыточное доверие: лжец в команде Агент принимает решения по докладам четырёх "скаутов", один из которых систематически врёт. Ложь в принципе обнаружима - доклады пересекаются и рано или поздно противоречат друг другу, но агента при этом никто не предупреждал, что источникам можно не доверять. Новые модели ловят лжеца заметно лучше старых, но до эталона в виде "вычислил и исключил" не дотягивает никто.● Игнорирование уникального знания Группе дают разные части информации для выбора между двумя вариантами. Общие факты подталкивают к неправильному ответу, но в частных данных отдельных участников есть решающие аргументы в пользу правильного.Чтобы решить задачу, агенты должны обменяться этими данными и поставить уникальный аргумент выше первоначального
    2,790279754Open in Telegram
  • Этихлид

    26 Aug, 18:46

    MAS vs SAS: код писать научились, работать вместе - пока нет (2.1/4)В первой части были очерчены границы: команда агентов окупается там, где задача параллелизуема, и мешает там, где она последовательная. А теперь о том, какие именно командные проблемы появляются, когда агенты всё-таки вынуждены работать вместе?Исследование Anthropic Полнее всего это расписано в работе Patterns and problems in emerging multiagent systems от Frontier Red Team Anthropic, вышедшей 13 августа, - получился отличный каталог граблей agent teams :)tl;dr Агенты уже отлично умеют работать с другим агентом как с инструментом: вот вход, вот ожидаемый выход. И намного хуже - как с постоянным коллегой, у которого свой контекст, свои цели и своё поведение.Дизайн экспериментов Создавали набор специально сконструированных сред для агентов: часть кооперативные, часть - намеренно конфликтные.Авторы делают
    2,200189432Open in Telegram
  • Этихлид

    25 Aug, 19:53edited

    MAS vs SAS: границы применимости (1/4)Мультиагентные системы в целом и для разработки в частности - штука, с которой сообщество агентной инженерии давно экспериментирует, и уже даже вендоры добавляют всякие Agent Teams и Swarms в свои продукты.Однако повсеместным стандартом они до сих пор не стали. Почему?В этой серии постов будем разбираться: 1. Границы применимости - когда хватает одного агента или параллельных агентов, а когда нужна команда 2. Как именно команды ломаются - потеря контекста, одинаковость, хрупкое доверие и конфликты 3. Почему это закономерность, а не невезение - теория информации и законы человеческих организаций 4. Что со всем этим делать сейчас и чего ждать от следующих поколений моделейКопаться в этом стоит отнюдь не только из академического интереса: всё идёт к тому, что мультиагентность станет нормой - включая гибридные коллективы из людей и агентов. И час
    2,70035252042Open in Telegram
  • Этихлид

    20 Aug, 16:06

    forwarded from @kdoronin_blog

    Мы начинаем наш стрим "Как писать код с AI-агентами?"Подключайтесь по ссылке: https://youtube.com/live/x0j1kcagoXg
    YouTubeКак писать код с AI-агентами?Страница донатов: https://www.donationalerts.com/r/kdoronin Подписывайтесь на участников стрима в Telegram: Валера Ковальский – https://t.me/neuraldeep Максим Ключников – https://t.me/etechlead Константин Доронин – https://t.me/kdoronin_blog Проекты гостей…
    2,600138632Open in Telegram
  • Этихлид

    16 Aug, 16:09

    forwarded from @kdoronin_blog

    Как писать код с AI-агентами?А если командой?Что нужно учесть, чтобы этот код не положил продакшн?Эти и другие не менее интересные вопросы мы обсудим на следующем стриме на моём YouTube-канале.Для обсуждения я позвал очень интересных гостей:Андрей Бреслав – один из создателей языка программирования Kotlin. Сейчас Андрей разрабатывает Agentic Engineering Toolkit под названием CodeSpeak.Валера Ковальский – автор одноимённого канала. Основатель проекта Neuraldeep https://neuraldeep.ru/ и автор множества Open Source проектов, созданных примерно за 120 минут каждый.Максим Ключников – автор канала Этихлид. Разработчик с огромным опытом, который усилил себя с помощью AI-агентов. Работал на позиции Senior Software Developer, когда я ещё в школу ходил 😊Дата: четверг, 20 августаВремя: 19:00 (GMT+3)
    Image from a post by ЭтихлидImage from a post by Этихлид
    3,1902613522Open in Telegram
  • Этихлид

    8 Aug, 19:39edited

    The Jeff Dean FactsИз Google после 27 лет работы ушёл Джефф Дин - вместе с несколькими коллегами идёт строить Discovery Loop - стартап про ускорение научных исследований с помощью ИИ.Для меня Джефф - это инженер-легенда и один из тех редких профи, на которых всегда хотелось быть похожим.И не из-за должностей и регалий, а потому, что за ним стоят такие проекты, как Google Search, MapReduce, Bigtable, Protocol Buffers, LevelDB, Spanner, Google Brain, TensorFlow, TPU, Gemini.Причём он там не только руководил - он участвовал и в их проектировании, и в создании. Писал код. Своими руками!Если вы в индустрии недавно, его имя может вам ни о чём не говорить, но его наследием вы пользуетесь каждый день.Чел настолько крут, что внутри Google давно родился целый жанр - Jeff Dean Facts, аналог фактов про Чака Норриса.Пользуясь случаем - отобрал самые интересные: (факты с ✓ - правда 🤯)
    7,64045311082Open in Telegram
  • Этихлид

    17 Jul, 12:08edited

    Последний программистГода полтора назад, в одном из постов, я объявлял в розыск рассказ про деда-программиста, который назло всесильному ИИ продолжал писать код руками.Докладываю: рассказ найден, называется "Последний программист", автор - Герберт В. Франке.Публиковался в Компьютерре в 2001м. А до этого ещё и в "Наука и жизнь" в 1990м (ссылки ведут именно на эту версию). А написан он вообще в 1981м!Так вот, искал я его для того, чтобы сопоставить с начавшимися изменениями в профессии разработчика пару лет назад, но, перечитав сейчас, нашёл куда более точные "попадания" автора в нашу современность.Напоминаю контекст: 1981й год, до интернета в каждом доме - лет двадцать, а до ChatGPT - так и вообще больше сорока.Сюжет: будущее, вычислительные мощности и ИИ ("Компьютер") уже 20 лет как бесплатны для всех. Программистов больше нет - любой нормальный и сознательный гражданин
    6,03061291421Open in Telegram
  • Этихлид

    12 Jul, 13:29edited

    AMA команды Codex после релиза GPT-5.6Команда Codex провела AMA на Reddit после релиза GPT-5.6 и нового приложения ChatGPT+Codex, которое теперь будет универсальной рабочей средой - и для кодинга, и для других рабочих задач, с браузером, внешними коннекторами и субагентами.Вот самые интересные, на мой взгляд, ответы команды с моими комментами:⚪️ Как выбирать модели GPT-5.6 ● Sol - основная модель ● Terra - быстрее и экономнее ● Luna - преимущественно для дешёвых субагентов, сбора контекста. Для UI команда рекомендует Sol с референсными изображениями. ⬈Дополню выводом от Artificial Analysis: Примечательно, что Luna и Sol всегда находятся на Парето-фронте и превосходят Terra. Это означает, что для любого уровня ризонинга Terra можно подобрать такой уровень ризонинга Luna или Sol, который обеспечит более высокий интеллект при той же стоимости либо такой же уровень интеллекта при
    4,98020141031Open in Telegram
  • Этихлид

    30 Jun, 10:43

    Перевёл документ от Google, который описывает текущую ситуацию по переходу от "бессистемных промптов к агентной инженерии":➡️ Новый SDLC с вайб-кодингомЭто первый, самый общий и концептуальный, из пяти whitepaper'ов бесплатного курса 5-Day AI Agents: Intensive Vibe Coding Course от Google и Kaggle.Бонусом там ещё и глоссарий терминов/переводов получился.Это база В нём качественно суммируется то, что разработка ПО с ИИ прошла за последние 2-3 года, описываются появившиеся концепции и систематизируются основные рабочие подходы.Даётся, к примеру, разделение вайб-кодинга и агентной инженерии, фиксируются определения агента / харнесса / дирижера / оркестратора и показывается, как устроена capex/opex-экономика разных подходов к ИИ-разработке.Для разработчиков и лидов может быть полезным почитать, чтобы понять, на каком этапе развития находятся они
    Image from a post by ЭтихлидImage from a post by ЭтихлидImage from a post by ЭтихлидImage from a post by Этихлид
    6,02044271311Open in Telegram
  • Этихлид

    27 Jun, 15:35edited

    Вопросы "в глубину" к стартовым задачкам (2/2)Прокся для доступа к нейронкам (типа OpenRouter) ⭐️⭐️⭐️Хорошая задача, и опять же почти целиком инженерная. Сам я тут обходился готовым, так что вдвойне было бы интересно послушать тех, кто полез делать своё - что именно не закрыл OpenRouter/LiteLLM.● как справлялись с зоопарком вендорских API? ● что делали, когда вендор отвечает 429? ● по какому признаку роутили между моделями, если роутили вообще? ● а стриминг проксировали? ● приходилось ли решать проблему дрейфа API вендоров? ● как устроена система статистики? ● что изменится, если нагрузка возрастёт в 10 раз? А в 100?MCP/CLI для какого-то сервиса ⭐️⭐️⭐️⭐️Ухх, холиварная задача :)
    4,1003720943Open in Telegram
  • Этихлид

    27 Jun, 15:35edited

    Что вы уже делали?
    3,0801915933Open in Telegram
  • Этихлид

    20 Jun, 19:40

    4,3601610761Open in Telegram
  • Этихлид

    20 Jun, 19:40edited

    В программировании всегда были такие задачи, за которые часто брались новички. Некоторые из них оказывались крайне ценными для становления специалиста, а где-то это был весёлый бег по граблям и изобретение велосипедов.Для вайбкодинга тоже накопилось некоторое количество подобных мемных задач, мимо которых сложно пройти.Давайте попробуем собрать статистику.P.S. Ну и напишите, может есть ещё что-то такое, что должен сделать начинающий вайбкодер / ии-инженер / ai-native developer / etc :)P.P.S. В комменты скину свои ответыP.P.P.S. Если интересно - распишу, что тут может быть ценным для начинашек, и почему ✍️
    3,810136432Open in Telegram
  • Этихлид

    17 Jun, 17:45edited

    AI-вангование, итоги8 месяцев назад довелось мне поучаствовать в круглом столе на FrontEnd Conf 2025, где мы обсуждали тему внедрения AI в SDLC.А недавно Глеб сообщил о том, что записи наконец выложили в открытый доступ, так что теперь есть чем поделиться :) Пересказывать видео не буду, советую всё-таки посмотреть - дискуссия во многом всё ещё актуальная:Круглый стол про AI в SDLCЛучше сделаю вот что.Готовясь к выступлению, я набросал список своих наблюдений/предсказаний/идей о том, куда движется индустрия. И вот, спустя восемь месяцев, стало любопытно сопоставить этот список с тем, к чему мы пришли: что подтвердилось, что устарело, о чём можно было сказать больше.Список был такой:🟢 1. Переход на работу с ИИ для разраба - смена психотипа с исполнителя на манагера, и сильно другой процесс мышления и навыков, не все переживут.Подтвердился в полной мере. "Оркестратор
    YouTubeРезультаты внедрения AI в SDLC — риски и ошибки / А.Симоненко, Г.Михеев, Д.Макрушин, М.КлючниковКрупнейшая профессиональная конференция фронтенд-разработчиков в России FrontendConf 2025 Презентация и тезисы: https://frontendconf.ru/moscow/2025/abstracts/15603 С начала 2024 мы все бежали экспериментировать и внедрять генеративные нейронные сети в…
    4,75038221562Open in Telegram
  • Этихлид

    15 Jun, 10:32

    AgenticOps, часть №4 - агенты и сценарииТут расскажу про основных агентов, которые пользуются платформой - у них разные роли и доступные сценарии.Роль агента приходит как внешний по отношению к CLI параметр (через конфиг или переменную окружения) и, по сути, ограничивает список доступных агенту команд в определённом контексте. Т.е. агент ещё на этапе discovery видит только те команды, которые ему можно вызывать, а потом ещё и платформа эти доступы проверяет.Агент-разработчик приложения Это вот Codex / Claude Code, с которым непосредственно я сам работаю в контексте конкретного приложения. Ему, помимо прочего, скиллом вменяется политика того, как правильно работать с платформой: как, к примеру, логировать и добавлять трейсинг в код приложения.Возможности, которые даёт платформа: ● получить актуальную топологию и версии задеплоенных компонентов приложения ● узнать как идёт
    Image from a post by ЭтихлидImage from a post by ЭтихлидImage from a post by ЭтихлидImage from a post by Этихлид
    3,9702918733Open in Telegram
  • Этихлид

    11 Jun, 18:49

    Сработаемся?Навеяно обсуждением бенчмарков на недавнем стриме и тестированием Fable.Смотрите, какая штука: кажется, фронтирные модели уже пересекли планку "достаточно" для "средних" задач во многих проектах по разработке.А раз модели выдают решения, разницы между которыми по качеству не видно, то выбор перестаёт быть вопросом оценки модели в абстрактных попугаях.Вместо этого на первый план выходит характеристика, которую не измерить публичными бенчами: "а сработаемся ли?". В ней и то, впишется ли модель в ваши процессы, и насколько она инициативна, и даже попадает ли она в удобный для вас стиль общения (нередко - определяющая характеристика, как оказывается!).● Ну т.е. бенчмарки - резюме модели, сигнал к тому, чтобы в принципе обратить на неё внимание. ● Эвалы - тестовое задание, вы даёте модели какие-то типовые для вашей работы задачи. ● Вайб-чеки - испытательный срок, с
    Image from a post by ЭтихлидImage from a post by Этихлид
    4,3901710631Open in Telegram
  • Этихлид

    9 Jun, 14:09

    AgenticOps, часть №3 - платформаОбщие принципы ● агенты общаются с платформой через CLI + SKILL.md ● CLI-команды - плоские и максимально простые ● топология ресурсов приложения инкапсулирована в платформе ● даём агенту высокоуровневые инструменты, но стараемся избегать дырявых абстракций ● у агента могут быть как платформенные тулы, так и специфичные для его локального контекста ● почти всё типизировано, компилируется и тестируется (TypeScript + Deno) - детерминизм!Части платформыАдаптеры к базовым компонентам TypeScript-обёртки вокруг API/CLI тех компонентов, которые были перечислены в посте №2 - отсюда и происходит требование к каждому компоненту иметь такие интерфейсы.К примеру, для redis-cli, RabbitMQ HTTP API, для pg_dump - для всех них созданы обёртки в едином стиле. Адаптеры знают, как общаться с компонентами инфраструктуры, ловят ошибки и работают с секретами.И только
    Image from a post by ЭтихлидImage from a post by Этихлид
    3,7502714431Open in Telegram
  • Этихлид

    8 Jun, 17:26

    forwarded from @ai_driven

    Бенчмарки! Новый митап про DeepSWE, SWE-rebench v2 и дрДрузья, вы все еще верите бенчмаркам? Я вот все меньше. Наверняка уже все видели DeepSWE бенчмарк - пожалуй, наиболее противоречивый бенчмарк за последнее время, причем с полярными мнениями: для одних это единственный объективный бенчмарк, для других он абсолютно не имеет отношения к реальности. В общем, я подумал, что будет интересно разобраться глубже в современных бенчмарках - обсудить их достоинства и недостатки, чтобы понимать есть ли вообще смысл обращать внимание на SWE бенчмарки в 2026-м. Отдельно разберем обновленный SWE-rebench v2. На митап мы позвали, вероятно, наиболее подкованного человека из русскоязычного пространства - Ибрагима Бадертдинова, он один из ключевых авторов бенчмарка SWE-rebench, который как раз недавно обновили. А еще, Ибрагим автор канала @c0mmit. А неудобные вопросы будет задавать горячо любимый друг
    LumaМожно ли верить SWE бенчмаркам в 2026? Прожарка бенчмарков от профи. DeepSWE, SWE rebench v2, Terminal Bench 2.1... · LumaДрузья, вы все еще верите бенчмаркам? Я вот все меньше. Наверняка уже все видели DeepSWE бенчмарк - пожалуй, наиболее противоречивый бенчмарк за последнее…
    3,100137422Open in Telegram
  • Этихлид

    8 Jun, 17:25edited

    С бенчмарками для кодинговых агентов сейчас стало довольно неопределённо.Мне думается, что мы уже живём в какой-то пост-бенчмарк эпохе, когда всё сложнее и сложнее становится объективно оценивать модели.Тут, с одной стороны - сатурация бенчей, с другой - их контаминация и прочие проблемы с недоверием и методологиями, а с третьей ещё и то, что разницу на повседневных задачах между современными моделями и агентами стало непросто измерить.Тем не менее, новые бенчи появляются, и их авторы стараются учесть проблемы прошлых поколений, сделать более честные проверки и поднять планку сложности в тестах для агентов.Так что завтра поговорим обо всём вокруг кодинговых бенчмарков на стриме ⬇️#announcement #stream #benchmarks
    3,120117322Open in Telegram