Latest posts

asisakov
22 Sept, 19:31
Дайте мне повод сжечь токены, и я сделаю это!#meme


asisakov
22 Sept, 08:04
Аналитик из WildberriesСуществует легенда, что ни один ML-инженер не шарит так сильно в SQL, как аналитики!А Дмитрий, автор канала «Дима SQL-ит», решил пойти ещё дальше и показать, что в SQL есть куда копать даже тем, кто уже уверенно с ним работает 😺Дима работает аналитиком данных в Wildberries и публикует много теории и кейсов из практики — всё структурированно и по делу 🤝Что рекомендую посмотреть в первую очередь:🟡Подборки бесплатных материалов для изучения: SQL, Python, BI (дашборды), статистики и A/B тестов 🟡Как агрегатные функции в SQL (SUM, AVG, COUNT) ведут себя с NULL? 🟡SQL-ловушка: почему NOT IN ломается, а EXISTS работает — классическая проблема с NULL, на которую часто натыкаются 🟡Горячие клавиши


asisakov
21 Sept, 18:35
Что случилосьЯндекс выложил в открытый доступ базовую LLM, обученную с нуля. Это AliceAI-Foundation-80B-A3B-Base - базовая ллм моделька под лицензией Apache 2.0. И это первая большая LLM Яндекса, обученная полностью с нуля, без инициализации из весов других моделей! (предыдущая Alice AI LLM 235B стартовала с весов Qwen3-235B-A22B)🔖Эта модель - MoE Transformer на 80B параметров, из которых 3B активных. Состоит из 48 трансформерных блоков с hidden size 2048 и одного multi‑token prediction слоя. Каждый MoE‑слой содержит 512 routed experts с top‑k 10 и один shared expert. А для роутинга используется auxiliary‑loss‑free подход из DeepSeek‑V3. Из 48 attention‑слоёв 36 используют Kimi Delta Attention, а 12 full attention: после каждых трёх KDA‑слоёв расположен один full‑attention‑слой. Для агрегации представлений по глубине используется Attention Residualshuggingface.coyandex/AliceAI-Foundation-80B-A3B-Base · Hugging FaceWe’re on a journey to advance and democratize artificial intelligence through open source and open science.
asisakov
21 Sept, 08:42
ПыхтитСнова понедельникРаньше я думал, что понедельник - это день, когда надо все разгрести, что осталось с пошлой недели, написать миллиард сообщений, запланироваться, поперекидывать мячик ответственнос и за какой-то вопрос, ну а потом уже думать по нормальные не рутинные задачи. Ну типа такой прям собрался, пока есть силы с выходных, попыхтел немного, и все.Только вот силы тоже всеКстати, рутина - это вообще не наша работа. Наша работа быть человеком, а это про думать, выбирать, договариваться, планировать. На рутиниу сейчас пусть попыхтит агент. Он же не устает, не раздражается, не спрашивает лишних вопросов (иногда зря конечно, но ему виднее). Но и тут не всё так просто, агенту нужен контекст: что берем, что делаем, почему именно так делаем, а так не делаем, и что решаем в непонятных ситуациях.Где-то пишут, что день важно начинать с 20-минутной медитации или отдыха в
asisakov
19 Sept, 15:22

asisakov
18 Sept, 17:47

asisakov
18 Sept, 13:39
Сегодня в качестве мотивации Гроку я сказал, что если он сделает плохо, то заставлю жечь токены еще разКак думаете, это не слишком жестко было?
asisakov
17 Sept, 17:38

asisakov
17 Sept, 17:35
Почему агент может работать неправильно, даже если в конце отвечает верно? Этим вопросом задались авторы статьи "AgentProcessBench: Diagnosing Step-Level Process Quality in Tool-Using Agents" В существующих бенчах AgentProcessBench, GAIA и τ²-Bench есть
asisakov
17 Sept, 07:33
Почему агент может работать неправильно, даже если в конце отвечает верно?Этим вопросом задались авторы статьи "AgentProcessBench: Diagnosing Step-Level Process Quality in Tool-Using Agents"В существующих бенчах AgentProcessBench, GAIA и τ²-Bench есть проблема оценки только по результату: они сообщают об успешном завершении E2E задачи, но при этом не позоляют оценить сигналы, которые могли бы дать оценки исполнения скиллов по шагам - ведь по итоговому скору мы не поймем, выбрала ли модель правильный инструмент, не сломала ли свой стейт и проверила ли вообще данные перед финальным ответом!Как вы наверно уже догадались, авторы статьи предложили оценивать сами шаги агентов, использующих тулы - и создали свой отдельный бенчмарк! И сначала взяли по 50 задач из HotPotQA, GAIA, BFCL и τ²-Bench. Чтобы снизить дисбаланс, task descriptions закодировали через E5 (преобразовали в вектора), аGitHubGitHub - RUCBM/AgentProcessBenchContribute to RUCBM/AgentProcessBench development by creating an account on GitHub.
asisakov
16 Sept, 16:43
⚡ Почему p-value ничего не решает и как научиться доводить A/B-тест до реального бизнес-решения?Большинство аналитиков совершают одну и ту же ошибку: считают, что задача теста — получить «значимый» p-value. Гипотеза кое-как сформулирована, метрики выбраны наспех, а решение о запуске принимается по одной цифре. В итоге — тесты, которые невозможно защитить перед бизнесом, и споры «нравится или нет» вместо аргументированного вывода.Аслан Байрамкулов — руководитель направления алгоритмических продуктов в ЦУМ, 10+ лет в аналитике и больше 6 лет профессиональноально занимается экспериментами и причинно-следственным выводом (Яндекс.Такси, X5 Retail Group, МТС, Wildberries) — проведёт бесплатный вебинар «A/B-тесты в продуктовой аналитике» и разберёт эксперимент от идеи фичи до рекомендации бизнесу.Вы узнаете: 🔶Как превратить размытое «улучшим checkout» в


asisakov
15 Sept, 18:24

asisakov
15 Sept, 07:11
Команда DevCrowd запустила ежегодное исследование специалистов по работе с даннымиВ прошлом году мы уже участвовали в подобных опросах. Вот ссылка на прошлый пост и итогиВ этом году фокус на том, как меняется профессия: что AI реально сделал с составом работы, где проходят границы между дата-сайентистом, ML- и MLOps-инженером, что происходит с порогом входа в профессию и рынком труда. Часть вопросов задается третий год подряд, что дает реальную динамику, а не просто срез.Опрос анонимный, 12–15 минут. В ноябре ребята опубликуют отчет со всеми данными, а также списками рекомендованных телеграм-каналов и курсов, собранными из ответов участников.Мне самому очень интересно узнать мнения, потому что наша команда лидирует направление AI-трансформации в аналитике у нас в Яндекс Лавке, потому что я на своих глазах и проектах буквально вижу как все меняется. И конечно же хочется понять


asisakov
14 Sept, 19:18
Так, я тут с опросом оказывается немного накосячил - в последнем пункте долно было быть не "Пишите в комментарии, почему", а "Dropout"
asisakov
14 Sept, 18:55

asisakov
14 Sept, 13:46
book‑to‑skillКак превратить любую книгу в навыкЕсли вы уже пробовали закидывать PDFки в чат‑ботов и получали либо хреновы пересказы, либо полные галлюцинации, то есть хороший шанс протестировать новый подход к работе с этим. А именно перейти на загрузку релевантного текста по запросу! (кстати, звучит как RAG, и это почти он и есть). Этот скилл берёт документ/книгу/статью почти любого формата (PDF, EPUB, DOCX, TXT, MD, HTML, MOBI и т. д.) и ПРЕВРАЩАЕТ В ОТДЕЛЬНЫЙ СКИЛЛ, в который агент ходит только тогда, когда мы спросим о необходимой нам информации из определенной главы.В ридми написано, что это экономит токены и дает более точные ответыСтавится супер простоgit clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill cd ~/.claude/skills/book-to-skillpip install -r requirements.txt # python 3.10+, poppler‑utils (pdftotext) и docling/book-to-skiGitHubbook-to-skill/README.ru.md at master · virgiliojr94/book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work. - virgiliojr94/book-to-skill
asisakov
13 Sept, 20:10

asisakov
12 Sept, 19:42
Так, я тут внезапно залетел в соревку kaggricultureЕсли кто-то решает, делитесь вашими скорами и паблик ноутбуками, буду завидовать!#competition
asisakov
11 Sept, 15:31
Практический хардкорный MLПродолжаем традицию годных анонсов для хардкорных инженеров. Если вы хотите посмотреть, как на самом деле выглядит подкапотная механика бигтеха, послушать спикеров с реальным боевым опытом и понетворкаться, то я принес вам кое-что крутанское.19 сентября в Москве оффлайн и в трансляции онлайн пройдет Practical ML Conf - хардкорная конференция от Яндекса, где обсуждают практическое применение ML. Это микс технических докладов, жарких дискуссий и мощного нетворкинга. Кстати в программе почти в каждом из залов можно встретить легенд! Я бы сказал доклады и дискуссии только из легенд и состоят 😈Зачем туда идти (помимо классического кайфа от крутых Яндексовых тусовок):🛠 Разберут до винтиков системы восприятия автономного транспорта (как перешли на MV2DFusion), управление гуманоидными роботами (от ходьбы до приседаний) и работуPractical ML Conf 2026Хардовая конференция для экспертов и практиков. Здесь будет всё о практическом применении ML: технические доклады ведущих специалистов отрасли, инженерные мастер-классы и много нетворкинга. Обсудим, как извлечь из машинного обучения реальную пользу для бизнеса.
asisakov
10 Sept, 20:13edited
Интересная история про чела из ПлатыКороче, есть пост от бывшего сотрудника Мексиканского банка Плата, где он рассказывает, что снял короткое видео, где сравнил Banco Plata и Т-Банк. Он успел поработать в Тиньке, а на тот момент работал в Плате. Сам ролик залетел!Через некоторое время его пригласили на серьезную встречу с топ-менеджером и HR, и по словам чела к нему было несколько претензий про то, что он "сделал сайт с формой, куда собирал телеграмы желающих работать в Plata — компании лиды, себе реферальный бонус". Чел пишет что не знал, что так нельзя, и удалил в тот же день, также были вопросы к общению в комментах и слив внутренних данных. Это он отрицает и говорит, что с порога летели только обвинения, разговаривать никто не пытался.Потом он все же выложил еще пару видео про этапы отбора в компанию и сравнение Москвы и Мехико. И после по словам чел был просто уволен. Его
Related Channels
Other channels in the same section of the catalogue.
