Последние посты

Библиотека баз данных
17 сент., 09:06
🔥 Mozilla выпустила 91-страничный отчёт о состоянии open-weight AI — и главный вывод: открытые модели уже примерно в 4 месяцах от frontier.По данным отчёта:- 8 из 10 самых используемых моделей на OpenRouter по августовскому token volume — open-weight - 7 из них созданы в Китае - DeepSeek первой среди открытых моделей вышла на первое место OpenRouter по weekly requests - open-модели используют 79% разработчиков, но до production доходят только 51% внедрений против 63% у закрытых - capability gap с закрытым frontier сейчас измеряется буквально несколькими пунктамиЭкономика при этом очень странная.Open-модели уже забирают огромную долю usage, но в более раннем окне измерений получали лишь около 4% model-layer revenue. Одна из причин - цена: закрытые модели обходились примерно в 6× дороже при близком уровне возможностей.Ещё интереснее DeepSeek: крупный прирост качества компания



Библиотека баз данных
8 сент., 11:34
🐳 Почему localhost не работает в DockerПриложение подключалось к PostgreSQL на компьютере. Перенесли его в контейнер, оставили localhost:5432 - получили Connection refused.Одна из возможных причин: теперь этот адрес ведёт внутрь контейнера с приложением. Если PostgreSQL работает отдельно, приложение ищет базу не там.Наруто и его клон сидят в разных комнатах. Для каждого «здесь» означает свою комнату. В обычной изолированной сети Docker похожая история: у каждого контейнера свой localhost.Если база в соседнем контейнереВ общей сети Docker Compose сервисы доступны по именам. Если сервис PostgreSQL называется db, настройки приложения могут выглядеть так:DB_HOST=db DB_PORT=5432Названия переменных зависят от приложения. Здесь важны адрес db и порт, который слушает PostgreSQL внутри контейнера.Даже если у базы настроено:ports:
Библиотека баз данных
16 авг., 14:15
Полный инженерный курс по AI-агентам на русском: от tool calling до productionКурс инженерный, а не обзорный. Здесь почти нет рассуждений о том, «изменит ли ИИ мир», зато есть: минимальные работающие реализации каждого механизма, лабораторные с критериями приёмки, шаблоны для копирования, чек-листы перед релизом, каталог антипаттернов и набор бенчмарков, по которым можно честно сравнить две версии своего агента.Качество агента почти никогда не упирается в модель. Оно упирается в инженерию вокруг модели: как описаны инструменты, что попадает в контекст, где стоят проверки, что происходит при третьей подряд ошибке и сколько это стоит за тысячу запусков. Модель - двигатель. Курс -про всё остальное в автомобиле.https://github.com/justxor/Aiagentsfullcourse


Библиотека баз данных
25 июл., 10:25
Бесплатный учебник по геометрии на целый университетский курс 📐Euclidean Plane and its Relatives Антона Петрунина, профессора Penn State, можно легально скачать бесплатно. Книга рассчитана примерно на один семестр и строит геометрию строго через определения, аксиомы и доказательства.Внутри:евклидова геометрия: треугольники, подобие, параллельность; инверсивная геометрия; гиперболическая и нейтральная геометрия; аффинная, проективная и сферическая геометрии; комплексные координаты, построения и площади.Автор специально сделал книгу минималистичной и достаточно строгой, предполагая, что читатель уже знаком с матанализом, вещественными числами и непрерывностью. Учебник распространяется по лицензии CC BY-SA.Скачать книгу бесплатно: https://arxiv.org/pdf/1302.1630v19


Библиотека баз данных
23 июл., 12:03
переслано из @sqlhub
SQL-совет: сравнивайте NULL через IS NOT DISTINCT FROMОбычное сравнение ломается на NULL:SELECT NULL = NULL; -- NULLПоэтому условие:WHERE old_value = new_valueне считает два NULL равными.В PostgreSQL используйте:WHERE old_value IS NOT DISTINCT FROM new_valueОператор работает как безопасный аналог =:1 IS NOT DISTINCT FROM 1 -- true
Библиотека баз данных
23 июл., 10:04
Команда GigaChat зовёт на вечеринку для AI-разработчиков и исследователей 🎉29 июля, Сбер.Среда, пространство «Оригинал» (м. «Курская», ул. Земляной Вал, 9А)Без докладов, презентаций и официальных дискуссий – только общение с коллегами по индустрии, обсуждение рабочих задач и болей, новые знакомства и летний вечер на веранде.Регистрация и подробностиНадеемся на хорошую погоду 🥳 До встречи!


Библиотека баз данных
4 июн., 15:10
NVIDIA выкатила Nemotron 3 Ultra - открытую frontier-модель для агентов, которые работают долго, а не просто отвечают на один промпт и забывают контекст.Ставка здесь не на красивые бенчмарки общего рассуждения, а на длинные агентные цепочки: планирование, вызов инструментов, работа с кодом, исследование документов и enterprise-сценарии, где задача тянется через десятки шагов.Именно там обычно ломается экономика агентов. Каждый шаг - новый инференс. Чем длиннее траектория, тем выше задержка и итоговая стоимость. В демо это почти не видно, а в проде быстро превращается в главный счёт.Поэтому самые интересные цифры у Nemotron 3 Ultra связаны с эффективностью:- до 5x быстрее инференс - до 30% дешевле на агентных задачах - фокус на длинных рабочих сессиях - открытая модель для команд, которым важен контроль над весамиДля продакшен-агентов это бьёт в больное место. Важен не только
Библиотека баз данных
27 мая, 16:04
переслано из @ai_machinelearning_big_data
🐟 Sakana AI выкатили DiffusionBlocks - способ обучать нейросеть по одному блоку за раз, не держа в памяти всю модель целиком. Работу приняли на ICLR 2026.При обычном обучении градиенты проходят через весь граф, а память под активации растёт вместе с глубиной модели. DiffusionBlocks предлагает разрезать сеть на отдельные блоки и обучать каждый независимо.Каждому блоку дают свою локальную задачу: сдвинуть представление чуть ближе к целевому состоянию, чем это сделал предыдущий блок. Формально это похоже на один шаг диффузионного процесса, поэтому каждый блок оптимизирует собственный лосс и не зависит от соседних блоков.Главный плюс - память. Для тренировки нужна память под один блок, а не под всю сеть целиком.Авторы проверили подход на разных архитектурах:- ViT - DiT - masked diffusion - авторегрессионные трансформеры - recurrent-depth /
Библиотека баз данных
26 мая, 15:05
⚡Когда аналитика разнесена по отдельным системам, бизнес долго ждет данные и платит за лишние кластеры, ETL и серверы.🐘Postgres Pro AXE — аналитическая СУБД от Postgres Professional на знакомом PostgreSQL. Ускоряет доставку аналитики и снижает TCO на хранение и обработку данных.✔️До 20 раз быстрее Greenplum На сложных запросах в тестах ClickBench, TPC-H и TPC-DS.✔️До 10 раз меньше ресурсов При сопоставимой нагрузке с MPP-аналогами.✔️Аналитика ближе к рабочим данным Postgres Pro AXE работает как отдельная аналитическая СУБД или расширяет Postgres Pro Enterprise аналитическими возможностями на существующих узлах.✔️Быстрый старт для команды Знакомый PostgreSQL снижает порог входа для администраторов и разработчиков.✔️Свобода хранения и BI Локальный сервер, сетевая шара или S3. Данные — в формате Parquet.🔗Приходите 28 мая на бесплатный вебинар: покажем, как построить
Библиотека баз данных
22 мая, 16:58
переслано из @ai_machinelearning_big_data
✔️ Antigravity втрое повысил лимитыВарун Мохан, участник команды разработки Google Antigravity и бывший основатель Windsurf, объявил в сети X о пересмотре правил использования моделей Gemini на платформе.По его словам, лимиты запросов для всех платных тарифов Gemini увеличиваются втрое на постоянной основе, а недельные квоты пользователей Antigravity будут сброшены и начислены заново. Изменения уже вступили в силу.Сообщение стало реакцией на критику со стороны разработчиков, недовольных функциональными ограничениями платформы и высоким расходом ресурсов при работе с ней.Мохан признал, что команда допустила ошибки при принятии ряда решений, и пообещал внимательнее учитывать обратную связь сообщества при дальнейшей доработке продукта.@ai_machinelearning_big_data#news #ai #ml


Библиотека баз данных
12 мая, 09:08
переслано из @ai_machinelearning_big_data
✔️ OpenAI закроет возможность файнтюна своих моделей к началу 2027 годаКомпания уведомила разработчиков о закрытии платформы самостоятельного дообучения своих моделей. Для новых клиентов возможность запускать тренировки уже заблокирована, а с 6 января 2027 года отключение затронет всех. Инференс существующих кастомных моделей сохранится вплоть до полного вывода их базовых версий из эксплуатации.Компания смещает фокус с модификации весов на RAG, промпт-инжиниринг и оркестрацию. Консолидация логики внутри экосистемы OpenAI упростит управление обновлениями и биллингом. Тем, кто использовал дообучение для адаптации под узкие ниши, придется пересматривать архитектуру. startupfortune.com✔️ В Google DeepMind появился директор по экономике AGIПрофессор Чикагского университета Алекс Имас перешел в Google DeepMind на
Библиотека баз данных
11 мая, 11:48
🖥 На Stepik обновили курс «C# с нуля до профи»Представьте: через четыре месяца вы открываете чужой .NET-проект и читаете его как книгу.IServiceCollection не вызывает ступора. async Task<IActionResult> пишется на автомате. Вы точно знаете, почему EF Core сгенерировал именно такой SQL - и как переписать запрос, чтобы он летал.Это не фантазия. Это результат после 16 модулей, в которых каждая концепция объясняется через код и закрепляется практикой.ООП, SOLID, LINQ, async/await, DI, EF Core, ASP.NET Core, Docker, Kubernetes - всё, что казалось магией, станет рабочим инструментом.А бонусом - портфолио проектов: от CLI-утилит и REST API до собственного SaaS с multi-tenancy, JWT и деплоем в Kubernetes под TLS.Скидка - 58% доступна 48 часов: https://stepik.org/a/282984/


Библиотека баз данных
10 мая, 15:10
🖥 Cовет по SQL-тестам: тестируйте не только результат запроса, а его инварианты.Обычно SQL проверяют так:SELECT FROM orders WHERE status = 'paid';И потом сравнивают: «вернулись нужные строки или нет».Но в реальных системах чаще ломается не сам happy path, а скрытые свойства данных.Например, для отчёта по заказам тест должен проверять не только конкретные строки, а правила:-- сумма по пользователям должна совпадать с общей суммой WITH by_user AS ( SELECT user_id, SUM(amount) AS total FROM orders WHERE status = 'paid' GROUP BY user_id ), overall AS (
Библиотека баз данных
8 апр., 16:10изменён
✔️ 10 книг, чтобы наконец понять, как реально работают LLM (2026)Большинство просто дергают API Мало кто понимает, что происходит внутриЕсли хочешь перейти из «пользователя» в «инженера» — вот база1. Deep Learning https://deeplearningbook.org Библия нейросетей - backprop, архитектуры, вся база2. Artificial Intelligence: A Modern Approach https://aima.cs.berkeley.edu Фундаментальный взгляд на AI как систему3. Speech and Language Processing https://web.stanford.edu/~jurafsky/slp3/ NLP, трансформеры и язык - максимально глубоко4. Machine Learning: A Probabilistic Perspective


Библиотека баз данных
6 апр., 08:34
🚀 Claude Cowork: 90% возможностей, о которых вы не зналиБольшинство людей открывают Claude Desktop, задают вопрос, получают ответ и закрывают приложение. На следующий день повторяют то же самое. И так неделями, не понимая, почему ничего толком не меняется в их продуктивности.Проблема в том, что так используется от силы 10% того, на что способен Claude Cowork. Остальные 90% просто игнорируются. Давайте разберемся, что именно вы упускаете.Что такое Claude Cowork на самом деле Это не просто чат-интерфейс. Это десктопный ИИ, который умеет читать ваши файлы, подключаться к приложениям, запоминать ваши рабочие процессы и запускать задачи по расписанию, пока вы спите. Разница между тем, как большинство людей его используют, и тем, как он задуман, колоссальная.Четыре вещи раскрывают весь потенциал: файл claude.md, навыки (skills), коннекторы и запланированные задачи. Большинство


Библиотека баз данных
27 мар., 08:15
переслано из @ai_machinelearning_big_data
✔️ Google представила голосовую модель Gemini 3.1 Flash Live.Модель превосходит 2.5 Flash Native Audio по скорости отклика и тоньше распознает акустические нюансы, темп и высоту голоса. Важным техническим улучшением стала способность эффективно фильтровать фоновый шум. Модель уже доступна через Gemini Live API в платформе Google AI Studio.Gemini 3.1 Flash Live лучше справляется с вызовом внешних инструментов и строго следует системным инструкциям. Модель не выходит за установленные рамки при неожиданных поворотах диалога и поддерживает мультимодальное общение на 90+ языках в реальном времени.Новинка ляжет в основу потребительских сервисов Gemini Live и Search Live. Общение с ИИ станет более плавным: сократится количество неловких пауз, а контекст беседы будет удерживаться в 2 раза дольше. Параллельно с релизом модели Google делает Search Live
Библиотека баз данных
17 мар., 08:12
1.5 млн разговоров с Claude показали тревожную правду об ИИhttps://uproger.com/1-5-mln-razgovorov-s-claude-pokazali-trevozhnuyu-pravdu-ob-ii/


Библиотека баз данных
16 мар., 17:01

Библиотека баз данных
6 мар., 07:39

Библиотека баз данных
16 февр., 09:08
переслано из @ai_machinelearning_big_data
🌟 Zvec: встраиваемая векторная база данных для RAG без внешних сервисов.Alibaba открыла исходный код Zvec - встраиваемой векторной СУБД, которую авторы называют «SQLite для векторных баз данных».Проект заточен на локальные RAG-пайплайны, семантический поиск и агентские сценарии на ноутбуках, мобильных устройствах или другом edge-железе.Идея в том, что разворачивать отдельный сервер ради векторного поиска и фильтрации по метаданным избыточно. Zvec встраивается в процесс Python-приложения и не требует ни отдельного демона, ни сетевых вызовов.Существующие решения не подходят для маломощных устройств: Faiss дает только ANN-индекс без скалярного хранилища и крэш-рекавери; DuckDB-VSS ограничен в опциях индексирования; Milvus и облачные векторные хранилища требуют сеть.Под капотом - Proxima, векторный движок продакшен-уровня, который Alibaba сама



