gram news
Аватар канала Complete AI

Complete AI

@complete_ai

Меня зовут Андрей Кузнецов Руковожу управлением в Sber AI, построил успешную лабораторию FusionBrain в AIRI, один из основателей Kandinsky, к.т.н., 15+ лет опыта в Computer Vision, выступаю с лекциями и пишу о событиях в AI и ML

ПроектыRUНейросети

7,860подписчиков

Открыть канал

Последние посты

  • Complete AI

    17 сент., 09:02

    AI + разработка — Senior-разработчиков ждут в Ozon TechВ компании развивается новое направление, команда, которая будет строить платформу для создания и запуска AI-агентов. Предстоит работать не над одним AI-продуктом, а над инфраструктурой для агентских систем от SDK и инструментов до оркестрации, observability и evaluation.Ребята в поисках Senior-разработчиков. Можно приходить с любым стеком — Go будет основным, но на интервью разрешают использовать привычный язык. Go можно спокойно освоить уже после выхода: команда поможет с переходом.Откликнуться
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    1,170421Открыть в Telegram
  • Complete AI

    7 сент., 15:16

    Мы выложили программу Practical ML Conf 2026Я уже не первый год состою в программном комитете конференции, помогал отбирать доклады. Из того, что сам точно не пропущу:➡️ Антон Разжигаев из AIRI в онлайне разберёт, что находится внутри Ouroboros, как устроена петля самоулучшения агента и какие грабли встретились по дороге. Про Ouroboros я здесь уже писал, поэтому особенно интересно послушать от Антона лично)➡️ Данил Кашин из Яндекса расскажет про Agentic Vision: как научить VLM рассуждать, строить план и использовать внешние инструменты. Будут visual reasoning, OCR, детекторы, поиск и исполняемый код➡️ Александр Куцаков из GigaChat расскажет про temporal grounding для длинных аудиозаписей: как научить Audio LLM понимать не только что произошло, но и когда именно. Внутри
    2,11010632Открыть в Telegram
  • Complete AI

    5 сент., 07:37

    переслано из @data_analysis_ml

    Утекли предполагаемые бенчмарки Gemini 4 - цифры выглядят безумно 🤯В сети разошлась таблица с прогнозируемыми результатами Gemini 4:- 99,9%+ — ARC-AGI-3 - 99,1% — FrontierMath Tier 4 v2 - 72,8% — Terminal-Bench Science 0.1 - 70,2% — HealthBench Professional - 62,3% — Terminal-Bench 4.0 - 48,7% — AutomationBench - 98,6% — BenchCADВ этой таблице Gemini 4 опережает GPT-6 Astra и Fable 5.1 на всех перечисленных тестах. Особенно сильный скачок якобы приходится на математику, scientific reasoning, работу в терминале и agentic-задачи.Сам Gemini 4 реален: Google уже подтвердил, что запустил для него свой «самый амбициозный pre-training run» на сегодняшний день.
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,11011831Открыть в Telegram
  • Complete AI

    20 авг., 08:07

    17 сентября в Москве пройдёт AI R&D DAY — конференция для исследователей, разработчиков, руководителей R&D-команд и специалистов, которые создают и внедряют передовые решения на основе искусственного интеллекта, где я буду выступать с лекцией «Автономный универсальный агент для повышения эффективности сотрудников Сбера».В центре программы — NextGenAI, проект, который исследует новые вызовы и формирует образ будущего ИИ.Вас ждут 22 доклада в рамках двух треков. Поговорим о:🔘новых подходах к созданию и обучению моделей 🔘системах, которые одновременно работают с текстом, изображениями, звуком и другими типами данных 🔘развитии голосовых технологий 🔘оценке качества AI-решений 🔘внедрении технологий в реальные продуктыУ
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    3,1401565Открыть в Telegram
  • Complete AI

    20 авг., 06:47

    переслано из @tired_glebmikheev

    Сегодня вечером мы вместе с Денисом Макрушиным встретимся на стриме и разгоним базу про безопасность в нашем новом дивном мире агентов.Обсудим потенциальные векторы атаки, как обезопаситься от них и контролировать агентов после внедрения. Будет одинаково полезно и для тех кто делает агентов, и тех, кто использует их для разработкиПрисоединяйтесь
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,360431Открыть в Telegram
  • Complete AI

    14 авг., 12:46изменён

    🔥 GLM-5.3 от Z.ai — главное за 30 секунд:Чистый post-training. Та же базовая модель —GLM-5.2 — все улучшения получены только масштабированием RL на длинных агентных задачах (фреймворк slime + SAO)Сильнейшая open-weight модель для кода. +50% на внутреннем Z.ai Code Bench; Terminal Bench 3.0: 28.3 (было 4.6); DeepSWE v1.1: 66.9 (было 46.2). На TB 2.1 (88.2) вплотную к Fable 5 и GPT-5.6 Sol.Эмерджентные способности в кибербезопасности — главный сюрприз. Модель сама начала выстраивать полные цепочки эксплуатации уязвимостей. CyberGym 84.5% — #1 среди всех моделей; ExploitBench удвоился (24→54). В реальных проектах нашла 2 436 уязвимостей в 269 OSS-проектах, включая баги возрастом до 40 лет.Веса будут открыты через 2 недели после завершения safety-аудита и hardeningЧестное позиционирование на бенчмарках. Z.ai прямо показывают, где отстают от closed frontier (Fable 5, GPT-5.6 Sol)
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    3,4901473Открыть в Telegram
  • Complete AI

    12 авг., 13:02изменён

    🐍 Сегодня мы выпустили ГигаАгентаРасскажу, что мы построили и почему это важно.ГигаАгент — это автономный универсальный ИИ-агент на базе Ouroboros, который переписывает свой собственный код через reviewed self-evolution. Буквально: редактирует рантайм, коммитит через multi-model review gate, рестартится на новой версии. Если сломался — откатывается. Если совсем плохо — /panic.Это результат синергии, которая редко случается в индустрии: исследовательская команда лаборатории FusionBrain AIRI отвечала за архитектуру агента и самоэволюцию, фреймворк и научный фундамент, а инженерная команда в Сбере — за продуктовую обвязку, инфраструктуру и адаптацию под бизнес-сценарии и enterprise-ограничения. Когда исследователи и инженеры работают как одна команда, получается отличная синергия:🏆 SOTA на трёх бенчмарках разом: — Terminal-Bench 2.1: 86.97% (предыдущий лучший — 83.8%) — OSWorld-Ve
    3,75034138422Открыть в Telegram
  • Complete AI

    11 авг., 10:37

    ⚡️ Диффузионные языковые модели: что в них работает, а что вызывает вопросыВыложили большой разбор dLLM — результат совместной работы нескольких команд: «Интерпретируемый ИИ» лаборатории FusionBrain, «Основы генеративного ИИ» Института AIRI (@Ivan_Oseledets) и «Генеративная поэзия» Сергея Маркова (@oulenspiegel_channel) SberAI.tldr: год возились с диффузионными языковыми моделями — воспроизводили чужие методы, обучали свои, ускоряли инференс. Разобрали за вас целое поле и рассказываем, что уже стоит брать, а куда пока лучше не вкладывать время.Для тех, кто не в теме: dLLM генерируют текст не по одному токену слева направо, а параллельно, раскрывая замаскированные позиции по всей последовательности. Отсюда обещание кратного ускорения — но на практике всё упирается в KV-кэш, который в классической диффузии нормально не работает.Мы разобрали три подхода — и вот что у нас получилось:
    6,1402252Открыть в Telegram
  • Complete AI

    7 авг., 05:30

    Alibaba, что ты делаешь? Прекрати!12.08 нас ждёт большой залив весов в опенсурсе. Приятно, что для простых смертных дают дистиллированную версию на 27B параметров💪
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,9203493Открыть в Telegram
  • Complete AI

    6 авг., 15:12

    переслано из @timeforcv

    Курс по Visual GenAI от Yandex Research и ШАДАвторы CV Time не только пишут обзоры статей о компьютерном зрении, но и создают обучающие курсы.Сегодня делимся курсом ШАДа «Генеративные модели в компьютерном зрении», который ведёт Дмитрий Баранчук, руководитель группы GenAI в Yandex Research, вместе с праймовой командой исследователей в этой области.Будет полезно тем, у кого есть базовые знания по генеративкам и желание разобраться глубже:• в теории диффузионных моделей, эффективных методах их обучения и семплирования; • в новых гибридных моделях на основе диффузии для генерации изображений, видео и 3D.У курса есть открытый GitHub-репозиторий, где можно найти слайды, записи лекций и семинаров, а также домашние задания.CV Time
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,37022108Открыть в Telegram
  • Complete AI

    6 авг., 12:22

    переслано из @kulibinai

    https://x.com/HuggingApps/status/2085283988524937463HuggingFace еще сделали красивую визуализацию CADENA для поста в твиттере
    X (formerly Twitter)Hugging Apps (@HuggingApps) on Xevery 3D mesh is kind of a compiled binary: printable, usable, but frozen. you can't just "make this hole 2mm wider" Cadena is just out to fix this, a decompiler of 3D meshes - converting it into…
    2,2801031Открыть в Telegram
  • Complete AI

    5 авг., 12:10

    Отличный результат для опенсурса на бенчмарке по восстановлению кода frontend’а по изображению или скриншоту💪Сделал скрипт парсинга сайта, прошелся по страницам, заскриншотил и велкам - копия сайта уже готова:)
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,5101073Открыть в Telegram
  • Complete AI

    4 авг., 14:28изменён

    ⚡️CADENA: Stepwise CAD Reverse Engineering Новое решение от Лаборатории FusionBrain, группы Пространственного интеллекта Института AIRI и команды Sber AI 🚀Релиз в нашей линейке моделей для реверс-инжиниринга деталей!tldr: Перешли на пошаговое предсказание — модель стала гибче, качество выросло, и чем сложнее датасет, тем больше отрыв. Плюс собрали CADENA-Bench: 3396 реальных механических деталей, разбитых по категориям ЕСКД, чтобы можно было оценивать готовность к практике для отдельных типов деталей.Постановка задачи для тех, кто пока про нее не слышал: по скану физической детали восстановить её CAD-модель — дерево построений, которое инженер может править и по которому деталь можно произвести. Последовательность CAD-операций пишется питоновским кодом, так что фактически это mesh2code.Наши прошлые модели предсказывали всю последовательность разом и потому наследовали
    2,310видео19852Открыть в Telegram
  • Complete AI

    3 авг., 06:44изменён

    Ну вот и Qwen 3.8 пожаловал💪— Автономный кодинг: более 10 дней саморазвивающейся разработки - от пустой папки до готового к эксплуатации продукта без вмешательства человека; полная история проекта доступна на GitHub: https://github.com/qwen-code-dev-bot/oh-my-cli— Работает в пром задачах: готовые решения production уровня для сотен задач— Высокий уровень долгосрочного планирования: автономное планирование на системном уровне с адаптивным обучением по принципу замкнутого цикла, обеспечивающее выполнение 500+ итераций оптимизации дизайна чипов и разработку стратегии на год в e-com— Нативная мультимодальность: vision как непрерывный контур обратной связи для планирования, выполнения задач и самокоррекции
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
  • Complete AI

    31 июл., 19:52

    переслано из @abstractdl

    Ouroboros теперь SOTA на Terminal Bench, OSWorld и CL-benchМой любимый агентный луп на чистом питоне доэволюционорал до состояния лучшего харнесса для кодинга! На главных бенчмарках он теперь обходит Codex, Claude code, Cursor и Hermes.Выходит, что в рисёрче, в computer use, в работе через терминал и в задачах на кодинг — уроборос сейчас является лучшим агентом. Так что с этого момента всю разработку и исследования я веду только через уробороса.Для полной воспроизводимости результатов. Весь код, скрипты, трейсы я выложил в открытый доступ.Напоминаю: лицензия MIT. Так что спокойно ломайте, форкайте, проверяйте трейсы, пишите что я где наврал. И кидайте issues и PR-ы! Все постараемся с уроборосом принять😋P.S. Кошмар какие дорогие агентные бенчи. Прогнать весь набор стоит как квартиру купить (это не шутка!!)GitHub, Хабр, установочники
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,02917138211Открыть в Telegram
  • Complete AI

    28 июл., 20:20изменён

    Вдруг вчера кому-то было мало инсайтов про K3, предлагаю ещё такой коротенький почитать😉https://sebastianraschka.com/blog/2026/kimi-k3-architecture-notes.html
    Sebastian Raschka, PhDKimi K3 Architecture NotesShort architecture note on Kimi K3, including LatentMoE, Kimi Delta Attention, Attention Residuals, NoPE, multimodality, and inference-efficiency choices.
  • Complete AI

    28 июл., 17:01

    🤖 Ищем менеджера проектов в ИИ-стройкуМы — SberAI, команда, которая строит будущее строительства с помощью искусственного интеллекта. Совмещаем исследования и реальное применение: автоматизируем анализ и составление строительной документации, извлекаем данные из BIM-моделей, создаём генеративные решения для архитектуры и дизайна. Ищем человека, который сведёт воедино науку, продукт и стройку.Чем предстоит заниматься → Управлять проектами от идеи до внедрения: планировать сроки, ресурсы, риски и зависимости → Синхронизировать усилия исследователей (DS, ML-инженеров) и продуктовой команды — переводить научные разработки в рабочие решения → Работать с заказчиками из строительной отрасли: понимать их процессы, формализовывать требования, контролировать качество поставки → Вести проектную документацию и обеспечивать прозрачность для всех стейкхолдеров → Анализировать рынок строительных
    3,180129621Открыть в Telegram
  • Complete AI

    27 июл., 17:11

    Интегрально инсайты из K3: 2.78Т параметров, 896 экспертов, 1M контекст. Под капотом — системная оптимизация на каждом уровне стека:1️⃣ SiTU-GLU — замена SwiGLU с мягким насыщением активаций. Именно это позволило безопасно масштабировать sparsity до 56× (16 из 896 экспертов). Без этого приёма модель бы просто взорвалась2️⃣ Quantile Balancing — балансировка нагрузки экспертов за один forward pass через квантили. Полностью убрали auxiliary loss, как следствие чище градиенты, быстрее сходимость3️⃣ MoonViT-V2 — vision encoder обучен с нуля через next-token prediction. Контрастивный pre-training (SigLIP/CLIP) оказался нестабильным при joint optimization4️⃣ AgentENV — microVM-песочницы вместо контейнеров для RL. Firecracker VM: checkpoint за 133ms, resume за 49ms, memory overcommit 6.5×51.2 млн sandbox'ов за тренинг5️⃣ MoonEP — expert parallelism с доказуемой верхней границей
    2,4901331Открыть в Telegram
  • Complete AI

    27 июл., 16:32

    И техрепорт вдогонку https://github.com/MoonshotAI/Kimi-K3/blob/main/k3_tech_report.pdf
    Иллюстрация к посту канала Complete AIИллюстрация к посту канала Complete AI
    2,550931Открыть в Telegram
  • Complete AI

    27 июл., 15:28

    Kimi как обещали зарелизили в опенсурс веса своей самой крупной модели K3 - 2.8T параметров🔥Осталось домашний комп чуть обновить и можно тестироватьhttps://huggingface.co/moonshotai/Kimi-K3
    huggingface.comoonshotai/Kimi-K3 · Hugging FaceWe’re on a journey to advance and democratize artificial intelligence through open source and open science.
    2,7802895Открыть в Telegram