Latest posts

GigaDev — разработка GigaChat
10 Sept, 07:18edited
🧠 GigaChat 3.5 Reasoning — первая в России открытая модель с рассуждениямиВыкладываем в open source первую модель GigaChat с полноценным рассуждением. В основе — 432B-A28B MoE. После SFT мы обучили с помощью online RL шесть экспертов по разным направлениям: от математики и кода до агентов, диалога и следования инструкциям. Затем собрали их в одну модель через on-policy distillation: ученик генерирует ответ сам, а эксперт нужного домена оценивает каждый его токен, так что ничего из выученного в RL не теряется.Что получилось по сравнению с GigaChat 3.5 Instant: 🔘SWE-Verified: 43 → 65 🔘AIME-2026: 67 → 92 🔘IFBench: 44 → 77Рассуждения заметно усилили кодовые и базовые агентные навыки: модель вышла в паритет с сильнейшими открытыми и закрытыми моделями


GigaDev — разработка GigaChat
25 Aug, 11:59
💵 GigaEmbeddings: новая линейка моделей от 480M до MoE-флагмана 10B-A1.8BМы обновили всю линейку GigaEmbeddings и выкладываем в open source сразу три модели — 480M, 3B и 10B-A1.8B. Они стали сильнее на английском языке и особенно в задачах с кодом, получили поддержку vLLM и SGLang и подходят для разных требований к качеству и производительности.Что внутри:🔘GigaEmbeddings 10B-A1.8B — новый MoE-флагман с 10B общих и всего 1.8B активных параметров; 🔘GigaEmbeddings 3B — универсальная модель с большим приростом на английском языке и в задачах с кодом; 🔘 GigaEmbeddings 480M — компактная модель для высоконагруженного поиска и сценариев, где особенно важны скорость и стоимость инференса; 🔘 Поддержка vLLM и SGLang для


GigaDev — разработка GigaChat
27 Jul, 17:33
💚Хотите познакомиться с командой GigaChat лично?Встречаемся 29 июля!Никаких докладов и презентаций — просто неформальный вечер на летней веранде: живое общение с коллегами по индустрии, обмен опытом и болями, новые знакомства.Со стороны GigaChat будут лидеры команд Text, Data, Multimodal и Inference.Участие бесплатное, но нужна регистрация ⬅️Ждём всех! 🎉


GigaDev — разработка GigaChat
14 Jul, 07:03
GigaChat Audio и GigaAM Multilingual: новые Open Source модели с поддержкой длинного контекста и языков СНГ 🔥Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество существующих открытых моделей резко деградирует на low-resource языках и длинных контекстахМы решили исправить обе проблемы и выкладываем в открытый доступ сразу две большие работы: расширенную версию GigaAM и новую GigaChat Audio с поддержкой длинных контекстов. Ценность обеих моделей и предложенных методов уже подтвердило научное сообщество — наши статьи приняли на главную мировую конференцию по речевым технологиям Interspeech 2026GigaAM Multilingual Расширение нашей SOTA-модели распознавания речи на казахский, киргизский, узбекский и английский 🔘 Self-supervised Audio Encoder (240M /


GigaDev — разработка GigaChat
6 Jul, 10:56
💵 GigaChat 3.5 Ultra: меньше, быстрее, сильнееСегодня мы выкладываем в open source GigaChat 3.5 Ultra — новую 432B-модель под MIT-лицензией. Это первый в open source гибрид GatedDeltaNet и MLA, доведённый до сотен миллиардов параметров, — с собственным рецептом обучения, который мы собирали больше чем в 1500 экспериментах. Модель выросла в коде, математике, агентных сценариях и на аренах — и при этом стала на 40% меньше, чем GigaChat 3.1 Ultra.Что внутри:🔘Собственная гибридная архитектура MLA + GatedDeltaNet с придуманной нами уникальной стабилизирующей обвязкой, без которой такой гибрид на этом масштабе просто не обучается; 🔘Gated Attention — модель может локально приглушать слишком сильный сигнал из attention-слоя; 🔘GatedNorm — нормализация с



GigaDev — разработка GigaChat
2 Jul, 10:24
💵 GFusion: как мы обучали диффузионную LLM в GigaChat«А что, если LLM будет генерировать не строго по одному токену слева направо, а сразу блок текста?»Именно эту идею мы проверяли в проекте GFusion — диффузионной языковой модели на базе GigaChat3-10B-A1.8B-base.Отдельно хочется отметить, что этот проект начал и довёл до релиза стажер команды GigaChat Pretrain. Он прошёл весь путь от идеи и первых экспериментов до обучения модели, оптимизаций, поддержки в inference runtime и публикации в open source.Почему это интересно?Классические LLM генерируют текст авторегрессионно: каждый следующий токен зависит от всех предыдущих. Это устоявшийся подход, но шаги генерации модели выполняются строго последовательно.В то же время диффузионная LLM берёт частично замаскированный блок и постепенно восстанавливает токены внутри него. За один forward passGitHub[DLLM] Add GFusion and EBSampling by perkyfever · Pull Request #29776 · sgl-project/sglangMotivation This PR adds support for a new diffusion LLM (dLLM) model and a new dLLM decoding algorithm. GFusion (ai-sage/GFusion-10B-A1.8B) is a Mixture-of-Experts diffusion language model built on...
GigaDev — разработка GigaChat
17 Jun, 19:19
💵Deep Research как управляемый runtime вокруг instruct-модели«Просто дать LLM доступ к интернету и ждать глубокого исследования — плохая идея». Это ключевой вывод команды, которая разработала комплексный research-конвейер на основе instruct-модели.Почему обычный подход модель + поиск работает недостаточно эффективно? Потому что модель легко теряет исходные ограничения, смешивает факты с собственными выводами и делает преждевременные заключения.Какие инженерные решения применили?Мы зафиксировали последовательность шагов и роли в исследовательском конвейере, но при этом у LLM осталось достаточно свободы для принятия локальных решений:🔘Brief: фиксирует исходный запрос и предотвращает его искажения. 🔘Scout: предварительная разведка темы перед детальным планированием.
GigaDev — разработка GigaChat
2 Apr, 16:50edited
💵 Tool calling для GigaChat 3.1 в open-source инструментахВместе с релизом GigaChat 3.1 Ultra и Lightning мы добавили поддержку tool calling в основные опенсорсные инференс-движки:— vLLM (>=0.18.2rc0) — SGLang (>=0.5.9) — llama.cpp (>=b8457)Для vLLM и SGLang достаточно поднять сервер с --tool-call-parser gigachat3 — после этого работает стандартный /v1/chat/completions с описанием tools. В llama.cpp tool calling поддерживается нативно, без дополнительных аргументов.vLLM vllm serve ai-sage/GigaChat3.1-10B-A1.8B \ --port 8000 --dtype auto \ --enable-auto-tool-choice \ --tool-call-parser gigachat3SGLang python -m sglang.launch_server \ --model-path ai-sage/GigaChat3.1-10B-A1.8B \ --host 0.0.0.0 --port 8000 --dtype auto \


GigaDev — разработка GigaChat
24 Mar, 15:28edited
🏃♂️ GigaChat 3.1 Ultra & Lightning: большое обновление открытых моделейВ ноябре мы открыли preview-версии GigaChat 3 Ultra и Lightning. С тех пор серьёзно доработали и модели, и весь пайплайн — высокие результаты на аренах, улучшенный function calling, решённая проблема циклов, DPO в нативном FP8, найденный и зарепорченный баг в SGLang при dp > 1. Сегодня выпускаем обновлённые GigaChat 3.1 Ultra и GigaChat 3.1 Lightning в опенсорс под MIT лицензией!GigaChat 3.1 Ultra 🔘 702B параметров (36B активных на токен) 🔘 По нашим замерам обходит non-reasoning Qwen3-235B-A22B и DeepSeek-V3-0324 в математике и general reasoning 🔘 Существенный прирост качества по сравнению с ноябрьским preview — как в метриках, так и в реальных диалогах


GigaDev — разработка GigaChat
27 Dec 2025, 17:30
Салют, Гига! Мы выкатили программу на 10 декабря — она уже лежит на сайте. У нас два зала. В большом — основные релизы, архитектуры, истории изнутри и постерная сессия с командами. В малом — почти непрерывный техно-контент на весь день. Получилось очень
GigaDev — разработка GigaChat
12 Dec 2025, 09:20
⚡️ GigaChat 3 Lightning в GGUF: максимум скорости для локального запускаМы подготовили три официальные сборки модели. Теперь вы можете выбрать оптимальный баланс между скоростью и качеством под ваше железо: 🔘bf16 - Максимальное качество и стабильность. 🔘q8_0 - Золотая середина: отличное качество при меньшем потреблении памяти. 🔘q6_k - Оптимально для ноутбуков и домашних ПК: высокая скорость и экономия памяти без заметного снижения качества генерации.💻 Function CallingМы расширяем поддержку функционала в популярных инструментах: 🔘vLLM: Официально появится в следующем релизе >0.12.0. Уже сейчас работает в dev-сборке (от коммита 21bb323) с флагом --tool-call-parser gigachat3.
GigaDev — разработка GigaChat
10 Dec 2025, 10:50
Уже в 14:00 начинаем Салют, Гига! Всех зарегистрировавшихся ждём на площадке, а онлайн можно подключиться через сайт.



GigaDev — разработка GigaChat
8 Dec 2025, 09:40
Что слышит умная колонка?➡️ ХабрGiga — это не только ML инженеры, но еще и другие специалисты, в том числе эксперты по цифровой обработке сигналов: из плохого звука тяжело извлечь что-то полезное. Команда VQE (Voice Quality Enhancement) поделилась на Хабре решением нестандартной задачи: как оценить качество акустической системы для задачи распознавания речи, не обучая модели?В статье: 🔘 звуковой тракт с точки зрения модуля VQE; 🔘 взаимосвязь коэффициента нелинейных искажений звука (THD+N) и других показателей; 🔘 методика по измерению этих показателей; 🔘 их корреляция с метрикой качества распознавания голосовых команд; 🔘 а также много-много формул.Результат: на любой стадии
GigaDev — разработка GigaChat
4 Dec 2025, 12:00
GigaAM-v3 на Хабре➡️ ХабрСпешим поделиться постом о создании GigaAM-v3!В статье много технических деталей для специалистов: 🔘 Распределение данных по доменам 🔘 Эксперименты с масштабирование модели по параметрам 🔘 Сравнение токенизаторов 🔘 Анализ ошибок end-to-end моделей 🔘 LLM-as-a-judge для распознавания речиПо пути к релизу GigaAM-v3 ворвалась в top trending ASR-моделей на HuggingFace, обогнав свежий релиз OmniLingual ASR 🚀👉 Приходите на «Салют, Гига!» — там вы сможете вживую пообщаться с разработчиками GigaAM, задать вопросы по статье, узнать детали обучения мультиязычного GigaAM Max и обсудить, как мы модифицировали HuBERT-CTC для использования в GigaChat Audio.
GigaDev — разработка GigaChat
2 Dec 2025, 16:56
Салют, Гига!Мы выкатили программу на 10 декабря — она уже лежит на сайте.У нас два зала. В большом — основные релизы, архитектуры, истории изнутри и постерная сессия с командами.В малом — почти непрерывный техно-контент на весь день. Получилось очень плотно и качественно.Участие бесплатное, но по регистрации. Можно прийти офлайн в Москве или подключиться онлайн.Увидимся в ГигаГороде!


GigaDev — разработка GigaChat
23 Nov 2025, 15:49edited
🤖 Хотите больше информации про наши последние релизы?10 декабря на «Салют, Гига!» мы подробно расскажем, что сделали за этот год в командах GigaChat, Kandinsky и GigaData (платформы для управления данными, аналитики и поиска в контексте ИИ-моделей и сервисов). От архитектур и метрик до подходов, решений и планов на будущее.Будут доклады от инженеров, разборы под капотом, постерная сессия с командами и возможность задать любые технические вопросы тем, кто эти модели создаёт.Мы делаем формат максимально полезным для тех, кто работает с ML, данными, исследовательскими пайплайнами или инфраструктурой.Присоединяйтесь офлайн или онлайн, участие бесплатное. ➡️Вот ссылка на регистрацию.Будем рады видеть всех 10 декабря.
GigaDev — разработка GigaChat
21 Nov 2025, 15:53
🏆 GigaChat 3 Ultra Preview & Lightning: открытые MoE-модели нового поколенияВ этом году мы уже радовали вас новой линейкой GigaChat 2, добавлением Reasoning в наш Web (giga.chat), опенсорсом GigaChat Lite и Giga-Embeddings и первым местом на бенчмарке ruMTEB.Что нового в этот раз? Впервые в России обучены MoE-модели такого масштаба полностью с нуля — без зависимости от зарубежных весов. Обучение огромных MoE-модели требует не только колоссальных вычислительных ресурсов, но и решения множества инженерных вызовов: от нестабильности вычислений с плавающей точкой до оптимизации межузловой коммуникации и балансировки нагрузки между экспертами.Поэтому сегодня мы открываем веса двух флагманских MoE-моделей — GigaChat 3 Ultra Preview (702B-A36B) и GigaChat 3 Lightning (10B-A1.8B) — полностью доступных сообществу с лицензией для коммерческого использования.


GigaDev — разработка GigaChat
21 Nov 2025, 09:12
📆Делимся секретами про наш новый синтез речиУ нас случился релиз GigaTTS. Это наша новая модель синтеза, под капотом у нее GigaChat 3b, свой токенизатор речи, адаптер к LLM и всего 30к часов данных.Метрики космические: новая модель нравится людям в 2-4 раза чаще старой, а по естественности она почти всегда живее. Написали подробный технический обзор на Хабр.Фичи нового синтеза 🔘Естественная freespeech подача, неотличимая от живого человека 🔘Специальные голоса телефонных операторов – таких голосов нет ни у кого 🔘Клонирование голосов, обогнали 11labs instant vc по похожести 🔘Озвучивание текстов бесконечной длины без потери контекста (multiturn режим синтеза) 🔘Инструктивный синтез,


GigaDev — разработка GigaChat
20 Nov 2025, 10:43
GigaAM-v3: новый уровень качества, пунктуация, нормализация➡️ GitHub | HuggingFace | GitVerseВ прошлом году мы открыли семейство моделей GigaAM, после чего значительно улучшили качество благодаря подходу HuBERT-CTC во второй версии. Основными запросами сообщества оставались поддержка пунктуации в наших моделях, а также улучшение на сложных срезах данных. Сегодня мы рады представить следующий большой релиз — GigaAM-v3.Что публикуем 🔘GigaAM-v3 — foundation audio encoder (база для дообучения). 🔘GigaAM-v3-CTC — улучшенная CTC модель распознавания, быстрый инференс 🔘GigaAM-v3-RNNT — улучшенная RNNT модель распознавания, лучшее качество 🔘GigaAM-v3-e2e-CTC — распознавание с пунктуацией и нормализацией, быстрый инференс


GigaDev — разработка GigaChat
7 Nov 2025, 07:55edited
One Day Offer в GigaChat Audio 📅 15 ноября 2025, онлайн ➡️ регистрацияПеред нашей платформой стоят амбициозные вызовы, а также запуски новых продуктов. Поэтому мы усиливаем core команды опытными Deep Learning инженерами и Data Science специалистами. Приглашаем вас на One Day Offer уже в следующую субботу! Там вы сможете познакомиться с командами и получить оффер всего за 2 технические секции + финальное интервью.Над какими вызовами предстоит работать: — нативное понимание видео в GigaChat — масштабирование предобучения Audio Foundation Model — end-to-end модель для real-time speech-to-speech диалога — ASR в новых доменах, LLM-based ASR — агентные системы и LLM-пайплайны для системы речевой аналитики — on-device multimodal LLMДо встречи на One Day Offer! ➡️ регистрация

Related Channels
Other channels in the same section of the catalogue.
