Latest posts

DLStories
24 Sept, 21:26
А ещё я только что получила письмо от одного из своих научников, которое начиналось вот так =DСо мной до этого подробного не происходило, я только мемы про это читала


DLStories
24 Sept, 20:55edited
ICLR submissions be like (Из твиттера)Одна из этих мусорок будет моей)) Сейчас причешу ещё чуть получше и повешу ленточку (читай: сделаю красивую картинку с методом), и гордо отправлю вниз по течению.Вообще, если честно, уже мало понимаю, есть ли смысл в AI конференциях, и можно ли всё ещё считать публикацию на А/А знаком качества. Сабмитов — тонна, сделать хорошо выглядящую статью с AI агентами уже довольно просто, и при этом половину анализов и выводов в статье автор может просто не понимать (мне кажется, в одной из статей, которую я ревьюила на NeurIPS, так и было). Ревью процесс тоже оочень такой себе, и очень часто тоже делается агентами, что, мне кажется, делает его ещё более рандомным, чем это было раньшеНемного обидно даже: только начало получаться делать рисерч и писать статьи, и теперь вот =/При этом делать хороший качественный рисерч всё ещё можно, конечно. Но не уверена, что связка "принято на ICLR/ICML/... -> достаточно хорошее" всё ещё верна
DLStories
16 Sept, 12:47
Я начала использовать кодинговых агентов (вроде Codex/Claude Code) в марте 2026 года. Первые 3–4 месяца я применяла их в основном для запуска новых экспериментов на базе уже имевшегося у меня кода рисерч проектов, который я полностью написала сама или с соавторами. Это получалось довольно хорошо: агенты отлично справляются с масштабированием экспериментов, а проверять их работу в таких случаях довольно просто, и это в итоге сэкономило мне массу усилий. Но недавно я начала пробовать использовать Claude Code для новых проектов, попросив его написать много нового кода, используя внешние GitHub репо только как ориентиры, добавив сверху новой логики и датасетов. Агент весьма уверенно заявлял, что написал код и запустил эксперименты. Но когда я решила проверить этот код, то там обнаружились ряд проблем с методологией и выбором гиперпараметров, причем некоторые из них выявились только через
DLStories
15 Sept, 12:07
Что делать, если базу в Data Science уже собрал?Можно продолжать учиться. А можно за год получить опыт внутри большой DS-команды и вырасти до уверенного мидла.Для этого Авито набирает участников в Data Science Bootcamp — оплачиваемую программу для будущих DS-инженеров.Ты будешь работать над продуктовыми задачами, развивать AI-решения и фичи, которые доходят до релиза, и сможешь выбрать направление: классический ML, CV или NLP/LLM.Плюс — наставник, кураторы, DS-комьюнити, обучение, зарплата и корпоративная техника.Если хочешь провести следующий год именно так, подавай заявку до 20 сентября: https://clck.ru/3Vq6zQ #промо


DLStories
14 Sept, 21:49
На основной конференции ECCV я презентовала статью EquiSteer: Cross-Attention Steering Towards a Fairer Text-Guided Image Generation. Эта статья — в некотором смысле продолжение статьи CASteer, а точнее, практическое ее применение к задаче debiasing of diffusion models. Честно говоря, мне самой эта статья не очень нравится: она чисто эмпирическая, про практическое применение, а я уже стремлюсь делать более фундаментальный рисерч. Но делала я эту статью изначально еще в октябре 2025 года, когда не знала, примут ли две другие статьи на ICLR/ICML, а для хорошего диссера хотелось иметь несколько публикаций на A/A. Я понимала, что идея EquiSteer с высокой вероятностью заработает и получится нормальная статья, поэтому решила таки ее сделать. Но в итоге две двугие статьи приняли, и теперь у меня аж 4 статьи на A/A для диссера, что, в принципе, довольно приятно)Кроме этого, EquiSteer и



DLStories
10 Sept, 20:46
Я, Борис @boris_again и какой-то рандомный чел проф из Оксфорда. Вот так вот выглядит конфа ECCV, на которой все мы и встретилисьЗавтра на конфе у меня будет постер по статье EquiSteer: Cross-Attention Steering Towards a Fairer Text-Guided Image Generation. Статья про debiasing диффузионок с помощью стиринг векторов. Если вы на ECCV, приходите завтра посмотреть на меня, мою статью и моего научника в постерную сессию ExHall #221 в 4:00 p.m.



DLStories
10 Sept, 10:51
Открыт набор на осенний семестр Deep Learning SchoolDLS — онлайн-школа, где мы учим deep learning с нуля и до продвинутого уровня. Школа полностью бесплатная, но можно купить доппакет с менторской поддержкой и допвебинарами. Подробнее — на нашем сайте.Особенность DLS в том, что мы даем много практики (теория при этом тоже есть, разумеется, и немало). Вам предстоит много практических домашних заданий и самостоятельный итоговый проект в конце семестра, которые будет не стыдно показывать на собеседованиях. Больше информации об организации курса и программы обучения можно найти тут.С этого семестра у курса уже 4 части. Переходите по ссылкам ниже, чтобы зарегистрироваться: - Часть 1: основы DL и computer vision. Регистрация тут. - Часть 2: Natural Language Processing. Начинаем с эмбеддингов и RNN, заканчиваем LLM, GPT, их современными применениями, дистилляцией и interpretability.dls.samcs.ruDeep Learning SchoolОнлайн-школа по искусственному интеллекту
DLStories
8 Sept, 12:38
В мае я писала, что меня позвали в программный комитет Practical ML Conf. С тех пор мы просмотрели очень много заявок на доклады и выбрали из них те, которые попадут на конференцию. А сейчас уже вместе с авторами готовим их к конференции)На сайте уже есть программа. Мы старались выбирать самые содержательные и технически нетривиальные доклады.В итоге из самого, на мой взгляд, интересного: • World models для роботов. Спикер — из Nvidia, где руководит созданием нейросетей для стека автономных беспилотных автомобилей • Обучение Alice AI LLM — как хорошо сделать так, чтобы LLM одновременно обладала фактическими знаниями, работала с длинным контекстом, разбиралась в отдельных предметных областях, решала задачи, следовала инструкциям и сохраняла нужный стиль общения. Как завести для этого всего reward модели, и как возникает reward hacking • Agentic Vision: как улучшить пространственное
DLStories
1 Sept, 16:25edited
В июне, перед тем как уехать на ICML, а потом на подготовку к IOAI, я была учеником на школе ARENA (Alignment Research Engineer Accelerator). Это что-то вроде технической программы по AI Safety. Как я писала выше, я занимаюсь AI interpretability, что довольно
DLStories
10 Aug, 13:02
В июне, перед тем как уехать на ICML, а потом на подготовку к IOAI, я была учеником на школе ARENA (Alignment Research Engineer Accelerator). Это что-то вроде технической программы по AI Safety. Как я писала выше, я занимаюсь AI interpretability, что довольно сильно связано с AI Safety. Поэтому я пошла на ARENA, чтобы получше понять, что там происходит внутри AI Safety коммьюнити, познакомиться с людьми, которые делают рисерч по теме interpretability, и, возможно, найти себе fellowship или работу.В итоге у меня сложилось довольно неоднозначное впечатление про коммьюнити AI Safety, но об этом как-нибудь потом. Пока что хотела написать вот о чем: ARENA длилась 5 недель, и в последнюю неделю мы в парах делали небольшие рисерч проекты. В итоге у меня и моего коллеги проект получился достаточно хорошим, с явными результатами, и поэтому мы решили немного его доделать и написать статью на


DLStories
7 Aug, 14:50
7 золота, 1 бронза и абсолютное 1 место у Артема Горохова 🎉Новость: https://cu.ru/tpost/4ib9ed5o01-shkolnaya-sbornaya-rossii-tretii-god-pod




DLStories
6 Aug, 15:29
В последнее время количество хороших новых статей растет огромными темпами, и уследить за всем интересным даже в пределах одной области становится супер сложно.Я уже перестала пытаться, честно. Даже на ICLR/ICML, где я недавно была, количество потенциально интересных мне статей было слишком большим, чтобы нормально все просмотреть и со всеми пообщаться (и еще успеть у своих постеров постоять). Из-за этого еще более полезными становятся мероприятия, где умные люди выделяют из нового ресерча главное, структурируют и подают в доступной форме.13 августа Яндекс проводит ML Global Recap H1 2026 — мероприятие, где эксперты разберут несколько важных тем из мирового ML за первую половину года. Акцент будет на идеи, которые уже начинают менять индустрию.В программе — нетворкинг, дискуссии и доклады руководителей разных команд Яндекса: • Tabular DL — про это расскажет Артём Бабенко,
DLStories
6 Aug, 14:37
forwarded from @aguschin_ai
Паблик ЛБ. Ждём приват!https://ioai.artix.tech/ioai_2026_estimations.html
DLStories
3 Aug, 07:44
Опа (Мы уже сказали детям, что с них налог)
DLStories
2 Aug, 09:04
forwarded from @sefixsheesh
AGI
DLStories
1 Aug, 16:27
Последние три недели я провела в Москве на сборах перед межнаром IOAI, а сегодня мы прилетели в Астану на сам межнар. Основные индивидуальные туры будут 4 и 6 августа, а пока что, как видите, фоткаемся и бегаем от комаров (они тут очень жёсткие)


DLStories
15 Jul, 18:54
В итоге рекорд из 10 попыток — 9.6 секунд на сборку. Среднее значение — что-то вроде 78-80 поворотов/10 секунд на сборку. Для каждой попытки из зала вызывался человек, который либо кнопками вручную, либо с помощью случайного генератора (либо и так, и так) запутывал мегаминкс, затем полученный стейт подавался на вход алгоритму, который искал решение, и затем это решение реализовывалось роботом.На видео: 1) Как человек собирает мегаминкс (тут сборка за минуту 40 секунд) 2) Как работает пайплайн 3) Одна из 10 попыток сборки: запутывает мегаминкс тут Леша Колегов — один из членов сборной этого года на IOAI (собственно, мы приехали смотреть на мегаминксы с ребятами из команды, с которыми у нас сейчас сборы перед IOAI в Москве)
DLStories
15 Jul, 14:41edited
Я тут несколько раз писала про применения AI в математике, и, в частности, про проект CayleyPy, в котором применяют AI для поиска путей в графах Кэли с огромным числом вершин. Напомню, что их статья про поиск путей в графе кубика Рубика получила Sptlight на



DLStories
7 Jul, 12:15
- я и постер (забыла попросить кого-то сфоткать) - я, постер и мой бывший коллега из российского Huawei - афтепати с коллегами после




DLStories
7 Jul, 02:45edited
Я на ICML в Сеуле, и тут на main conference аж две мои статьи, чем я очень горжусь! Но и это еще не все, еще две статьи — на MechInterp воркшопе, который будет 10 числа. И сегодня уже через пару часов буду стоять у постера одной из статей (если мне его таки распечатали))), поэтому приходите в HALL A #2606 в первую постерную сессию посмотреть на меня и помочь толпой сделать вид что статья популярна, хахСтатья: MidSteer: Optimal Affine Framework for Steering Generative Models (arxiv link) Это — вторая моя статья по теме representation engineering, и первая попытка уйти от чисто эмпирического рукомахательного рисерча и сделать что-то более математически/теоретически обоснованное. История такая: как я писала раньше, первой моей статьей по этой теме была CASteer — steering-метод для удаления концептов из активаций диффузионной модели. В CASteer стиринг для удаления применяется довольно
Related Channels
Other channels in the same section of the catalogue.
