gram news
Стать специалистом по машинному обучению channel avatar

Стать специалистом по машинному обучению

@tobeanmlspecialist

Канал о машинном обучении для людей Учусь разбираться в терминах ML вместе с вами. Для разбора теории приглашаю профессионалов. Подкаст: https://mlpodcast.mave.digital С вопросами и предложениями пишите @kmsint

ProjectsRUAI

10,900subscribers

Open the Channel

Latest posts

  • Стать специалистом по машинному обучению

    21 Sept, 16:55

    Неделю назад я был на deep tech night - конференции Яндекса о технологических вызовах в эпоху AI, про анонс которой писал ранее. С уверенностью могу отметить, что это был один из лучших подобных ивентов года. И по плотности материала и по общению с умными людьми. Много старых приятных знакомств актуализировались.Мне понравились разные доклады, и про каждый я мог бы написать подобный пост. Меня, впрочем, как наверняка и многих, очень зацепило выступление Мо Гавдата (ex-Chief Business Officer Google X). Причём не столько фактическим наполнением - для тех, кто следит за развитием агентных систем, Мо не сказал ничего радикально нового, - сколько уровнем работы с аудиторией. Это было особенно видно по Q&A-сессии, когда зрители один за другим отмечали, что речь получилась impressive. Очень содержательным был и доклад про автономный транспорт - подробный рассказ о том, как строится стек
    6814311Open in Telegram
  • Стать специалистом по машинному обучению

    19 Sept, 10:22

    Image from a post by Стать специалистом по машинному обучениюImage from a post by Стать специалистом по машинному обучению
    1,110155411Open in Telegram
  • Стать специалистом по машинному обучению

    19 Sept, 09:29

    Го
    Image from a post by Стать специалистом по машинному обучениюImage from a post by Стать специалистом по машинному обучению
    1,16013511Open in Telegram
  • Стать специалистом по машинному обучению

    14 Sept, 13:00

    Таким образом, мержу по-прежнему всё сам, кроме контрактов. Хочется иметь возможность успеть вклиниться как тот самый man in the loop, если появится точечная необходимость. И код смотреть совсем тоже не перестал - смотрю периодически, в целом. Если глаз за что-то зацепится, мы это обговорим с агентом и закрепим принятые решения правилом.Поживём в таком сетапе, посмотрю насколько стало удобнее и не появились ли новые проблемы.
    1,770321Open in Telegram
  • Стать специалистом по машинному обучению

    14 Sept, 13:00edited

    Последнее время перестал смотреть глазами на код, который пишут агенты. Хотел написать, что "Не из лени, а просто арифметика перестала сходиться", но, если честно, то и из лени тоже. За последнюю неделю в семь репозиториев одного из проектов влилось 157 пулл-реквестов, - больше двадцати в день (у нас правило "один PR = один логический шаг, с тестами в том же PR", поэтому они мелкие, но их много). Вычитывая каждый, я стал тем самым боттлнеком - пока я читаю диф одной сессии, три-четыре других простаивают.Поэтому ориентируюсь теперь не на свои глаза, а на обвязку, которую мы вокруг процесса строили последние месяцы. Слоёв несколько, и они ловят разное:• CI на каждый PR - на своём железе, 5–11 минут: проверка типов, три линтера, проверка форматирования, отдельный линтер доступности, 321 файл юнит-тестов, сборка и бюджет размера бандла. Отдельным шагом CI выкачивает канон контрактов из
    1,56043211Open in Telegram
  • Стать специалистом по машинному обучению

    10 Sept, 19:36

    Image from a post by Стать специалистом по машинному обучениюImage from a post by Стать специалистом по машинному обучению
    2,0601822Open in Telegram
  • Стать специалистом по машинному обучению

    10 Sept, 19:36

    Image from a post by Стать специалистом по машинному обучениюImage from a post by Стать специалистом по машинному обучению
  • Стать специалистом по машинному обучению

    8 Sept, 14:11

    В этом году уже в третий раз буду гостем Practical ML Conf в Москве. Приглашаю и вас присоединяться. В программе особенно отметил два доклада про инференс.Владислав Носивской, руководитель группы инференса LLM в Yandex AI Studio, разберёт, чем агентский трафик отличается от обычных запросов к моделям. На примере публичных трасс, бенчмарков и опыта Yandex AI Studio он покажет, как снижать стоимость инференса: выбирать схему параллелизма, маршрутизировать запросы с учётом KV-кеша, разделять prefill и decode и использовать спекулятивное декодирование.Александр Мисевич, руководитель Group of Efficient Runtime & Inference в AI Platform & Copilot Т-Банка, посмотрит на ту же задачу шире и расскажет, какие инженерные решения помогают превратить LLM и другие сложные AI-модели в доступный инструмент для бизнеса.Ну, а за что я ещё люблю подобные мероприятия - это нетворкинг. В Москве
    Practical ML Conf 2026Хардовая конференция для экспертов и практиков. Здесь будет всё о практическом применении ML: технические доклады ведущих специалистов отрасли, инженерные мастер-классы и много нетворкинга. Обсудим, как извлечь из машинного обучения реальную пользу для бизнеса.
    2,0402211Open in Telegram
  • Стать специалистом по машинному обучению

    4 Sept, 12:08

    Опираясь на полученный опыт, вот, что могу посоветовать тем, кто задумывается о работе через несколько параллельных сессий. Не давайте им общее рабочее дерево - пусть каждая заводят свой worktree с первого дня. Как выяснилось - это одна команда и git предоставляет возможность из коробки. Пройдитесь по всему, что делится помимо файлов - порты, кэши, папки зависимостей, соседние чекауты, временные файлы с фиксированными именами - и разведите заранее. Относитесь к обходным путям, которые надо помнить, как к долгу с процентами - каждая новая сессия про него не знает и обязательно вляпается. И то, что должно соблюдаться всегда, выносите из инструкций в гард (предохранитель), который не даст сделать неправильно.
    2,270114211Open in Telegram
  • Стать специалистом по машинному обучению

    4 Sept, 12:07

    Первым выстрелил порт. Браузерные тесты поднимают дев-сервер и ходят в него, а playwright умеет переиспользовать уже запущенный сервер, если на нужном адресе кто-то отвечает. Само по себе это удобно и у меня включено до сих пор. Проблема была в адресе - сервер поднимался на обычном порту разработки, одном и том же для всех чекаутов. И прогон, запущенный из worktree, преспокойно тестировал приложение из главного чекаута, другой ветки. Он сообщил о дефекте, который в этой самой ветке был уже починен. Полчаса ушло на разбор несуществующего бага. Починка стала такой - каждому свой порт, а дев-серверу - флаг --strictPort (это флаг Vite, не Playwright), чтобы занятый порт означал ошибку, а не тихий переход на следующий свободный. Занятый порт должен кричать (сейчас на этом слове вдруг осознал, что понахватался терминологии от агентов, раньше я бы и представить не мог, что закрытый порт может
    1,9404221Open in Telegram
  • Стать специалистом по машинному обучению

    4 Sept, 12:07

    Первое, что мы сделали - ввели новые правила. Перед созданием ветки смотреть git status, чтобы не унаследовать чужое. Перед каждым коммитом проверять, на какой ветке стоит HEAD. Правила хорошие, они и сейчас в силе. Но по-настоящему проблему они не решают. Между проверкой и действием всегда есть окно. Агент посмотрел git status, увидел чистое дерево, начал работу, а через двадцать минут соседняя сессия сделала свой checkout. Дисциплина уменьшает вероятность, но не устраняет причину, что дерево одно, а писателей несколько.Настоящее решение оказалось встроено в Git и называется worktree. Век живи - век учись, как говорится, даже не знал до этого момента о такой фиче гита.git worktree add _wt/задача-сессии-N -b ветка-сессии-N origin/masterОна создаёт ещё одно рабочее дерево того же репозитория - в подпапке _wt/задача-сессии-N, с полным набором файлов проекта и, главное, со своим
    1,10051Open in Telegram
  • Стать специалистом по машинному обучению

    4 Sept, 12:06

    Ломается так. Сессия А создаёт ветку и какое-то время правит файлы. Сессия Б в этот момент домержила свой PR и делает то, что положено делать после мержа - переключается на мастер и подтягивает свежую версию. Она не сделала ничего неправильного, это рутинная уборка. Git её пустил, потому что незакоммиченные правки сессии А не мешали переключению - те файлы одинаково выглядели на обеих ветках, и Git спокойно перенёс изменения за собой (если бы они конфликтовали, checkout бы отказал, и вся история пошла бы иначе). Но дерево-то одно на двоих. HEAD, стоявший на ветке сессии А, теперь стоит на мастере. Сессия А об этом не узнает никак: она не выполняла команд, ей никто ничего не сообщил, у неё в чате по-прежнему написано "создал ветку feature/…".Затем сессия А делает git commit. Коммит всегда ложится туда, куда указывает HEAD, а HEAD в этот момент на мастере. Локальный мастер уезжает
    98651Open in Telegram
  • Стать специалистом по машинному обучению

    4 Sept, 12:06

    Изначально, выстраивая свою работу с кодинг-ИИ-ассистентами, я работал очень последовательно - небольшими срезами и не больше одного PR на репозиторий за раз. И при этом моя любовь к микросервисам позволяла распараллелить работу, потому что для каждого отдельного микросервиса я завожу отдельный репозиторий. Также я обычно держу отдельный реп с контрактами и документацией, с которым сверяются остальные. Работа была выстроена так, что сначала всегда идут сверки с контрактами и если контракты затрагиваются - в первую очередь приводятся в нужное состояние они, а только потом идут изменения в сервисах, ложащиеся на изменившиеся контракты.Но потом я стал замечать, что мне не хватает такого разделения. Например, фронт требует намного больше итераций правок, чем бэк. Сервис для работы с разными вендорами LLM-ок иногда требует расширения доступного пула как поставщиков, так и моделей, и
    1,240441Open in Telegram
  • Стать специалистом по машинному обучению

    1 Sept, 09:58

    ↔️ Быстрый офер в Яндекс для ML- или DL-инженеровПриглашаем специалистов с опытом от 2 лет в доменных областях NLP, CV, RecSys и Classic ML на Weekend Offer ML 12–13 сентября.Это один из наймовых ивентов Яндекса: вы сможете пройти все ключевые этапы онлайн и без долгих пауз.Как всё устроено:⚪️до 4 сентября — регистрация; ⚪️12 сентября — всего две технические секции; ⚪️13 сентября — финальные интервью с командами.Если хотите работать в одной из команд Яндекса — R&D, Алиса и Умные устройства, Поиск с Алисой AI, Независимый Ecom, Рекламные технологии Яндекса — регистрируйтесь!🔛 Подробности и полезные ссылки на сайте. После регистрации с вами свяжется рекрутер и расскажет все детали.
    Image from a post by Стать специалистом по машинному обучениюImage from a post by Стать специалистом по машинному обучению
    1,940553111Open in Telegram
  • Стать специалистом по машинному обучению

    31 Aug, 16:40edited

    Поэтому следующая ступень ритуала звучит так: после мутации убедись, что прогон вообще состоялся и упало именно то, что должно. Смотреть нужно не только на "0 failed", а на количество собранных тестов и на имя красного. Ноль упавших при неверном пути к тестам и ноль упавших, потому что всё работает - в консоли выглядят одинаково.Выводы из опыта:Первое. Каждый гард проверять мутацией. Сломать то, что он охраняет, убедиться, что красный именно он и именно по той причине, и потом вернуть как было. Иногда, чтобы не терять связь с проектом, слепо доверяя тому, что происходит, я беру какой-нибудь рандомный тест из проекта и разбираю его вместе с Клодом, типа, для чего он, что ловит, как проверяется, что ловит именно это и т.п.Второе. Смотреть на число собранных тестов, а не только на отсутствие упавших. Ошибка сборки, неверный путь, не поднявшееся окружение - всё это может выглядеть как
    2,0209221Open in Telegram
  • Стать специалистом по машинному обучению

    31 Aug, 16:40edited

    Есть особый сорт дефекта, который появляется часто тогда, когда код и тесты к нему пишет один и тот же агент. Это известная проблема, которую я уже несколько раз упоминал и даже писал, что Claude с ней разобрался самостоятельно. Проблема называется "тест, который не может упасть". Он зелёный, он в CI, он выглядит как проверка, но если сломать то, что он охраняет, он останется зелёным. И вы об этом не узнаете, потому что узнать об этом теперь можно только одним способом - известным в народе тестированием продом.Claude после соответствующих моих докапываний поделился почему так: причина, говорит, в том, что тест он пишет из того же понимания, из того же контекста, что и код, впрочем, как и мы до появления хорошей насмотренности на то, какими тесты вообще должны быть. Если агент решил, что значение приходит вот отсюда, то и код напишет так, и проверять будет там же, подгоняя решение под
    1,670731Open in Telegram
  • Стать специалистом по машинному обучению

    29 Aug, 16:24

    Программирую, не приходя в сознание. Так вот как китайская комната, оказывается, работает.
    2,0201463332Open in Telegram
  • Стать специалистом по машинному обучению

    24 Aug, 14:43

    Опыт посещения недавних митапов снова напомнил, что пока никакая автоматизация не заменяет живого общения. Обсуждения актуальных вопросов с увлечёнными людьми и возможность обменяться парой фраз со спикерами в перерыве - дорогого стоит. Поэтому с удовольствием рассказываю про возвращение Data Dojo - встречи ML-комьюнити, которая в этом году пройдет 9 сентября в Санкт-Петербурге.В прошлом году я уже был на Data Dojo в Москве и делился впечатлениями. Мне понравилось мероприятие, и я планирую быть и на этом. Тогда доклады, общение с командами, отвечающими за разные ML-направления, заряд оптимизма от студентов самых продвинутых ВУЗов страны, нетворкинг и разные зоны активности, включая игровые автоматы с играми 80-90-х годов оставили очень приятное ощущение. Уезжал, как я тогда написал, со спокойной уверенностью, что всё идёт своим чередом и что люди-специалисты нужны не меньше, а то и
    Image from a post by Стать специалистом по машинному обучениюImage from a post by Стать специалистом по машинному обучению
    2,690421Open in Telegram
  • Стать специалистом по машинному обучению

    21 Aug, 11:26

    Кажется, я понимаю, что могли чувствовать люди-компьютеры, занимавшиеся математическими вычислениями на бумаге, когда их постепенно начали заменять компьютерами железными. Да, стало быстрее, да стало точнее и надёжнее, но тот самый кайф от работы карандашом, быстрыми прикидками в голове порядка получающихся значений, ощущение того, что ты чувствуешь цифры кончиками пальцев - всё это стало уходить. Кому-то, конечно, эти изменения были исключительно в радость, так как счёт на бумаге был скучной рабочей рутиной, лишённой творчества. Но, уверен, были и те, кому такие размеренные действия доставляли удовольствие, а железные машины лишали ощущения власти над числами.Я уже несколько месяцев, как и многие из вас, не пишу код руками. Сейчас я выстраиваю процессы автоматического написания кода так, чтобы проекты со временем не разваливались, не гнили и не источали неприятный запах. Чтобы как не
    2,8702283221Open in Telegram
  • Стать специалистом по машинному обучению

    13 Aug, 11:51

    Помните, ещё недавно многие жаловались на то, что модели пишут такие тесты, которые их код всегда пройдёт, даже если он проблемный?Теперь агенты не просто пишут тесты, но и проверяют их на то, ловят ли они то, что должны через ломание кода. Это пришло из коробки, я такому не учил. Проверяю иногда тесты и понимаю, что я во многих случаях вряд ли написал бы лучше.Всё больше верю в рекомендацию периодически обнулять все правила и смотреть на то, как изменилось поведение системы. Получается, мировые best practices доезжают автоматически на каждой итерации улучшения агентов.
    3,180196531Open in Telegram