gram news
Tuzov AI Lab channel avatar

Tuzov AI Lab

@tuzov_ai_lab

Заметки инженера про AI / LLM: актуальные новости, эксперименты, кейсы, мысли. Автор: @ntuzov Общаемся в AI Dev Club: https://t.me/+NMh-DL73ibFkMWEy

ProjectsRUAI

4,480subscribers

Open the Channel

Latest posts

  • Tuzov AI Lab

    22 Sept, 18:09

    forwarded from @seeallochnaya

    А вот и OpenAI: встречайте GPT-6 Sol и Luna.— обе модели ровно в 2 раза дешевле, чем их 5.6-версии. — общаться должны так же понятно и без жаргона, как Astra — и... всё. Sol не лучше Astra (а во многом и хуже, в отличии от пары Fable <-> Opus), но сильно дешевле, и всё ещё лучше Sol 5.6. Поэтому модель может стать основной рабочей лошадкой, сохраняя ваши лимиты.
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI LabImage from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    1,05010754Open in Telegram
  • Tuzov AI Lab

    22 Sept, 17:58edited

    🔸 Claude Opus 5.5 — вышелAnthropic выкатили Opus 5.5, доступен уже везде.Главный тезис: по большинству задач модель на уровне Fable 5.1, а на типичных задачах обходится на 40% дешевле, чем Opus 5.Интересно, что по агентному кодингу Opus 5.5 обгоняет и Fable 5.1, а не просто догоняет. На мой взгляд, это даже вполне ожидаемо.Цена снизилась:- $4/$20 за миллион токенов (было $5/$25) - Чтение из кэша — $0.20 (было $0.50), минус 60%. Для длинных агентных сессий это как раз самая заметная статья расходов - Fast mode — $8/$40, до 2.5x быстрее. Есть в Claude Code и на Claude PlatformЧто ещё интересного:- Отвечает на 30% быстрее Opus 5. Ранние тестеры пишут про экономию токенов на 40–60% на сложных задачах- Ответы стали короче и понятнее. Обещают, что важное теперь идёт первым, и агент льёт меньше воды
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    1,27016104Open in Telegram
  • Tuzov AI Lab

    14 Sept, 11:10

    forwarded from @tenfoundation

    https://youtu.be/Q16vWElGT_I?si=26x-pZ9GUC-ytod4
    YouTubeOpenAI украли решение задачи тысячелетия? Что такое уравнение Навье - Стокса? | Влад ТенТайпспейс медиа: https://t.me/typespace Тайпспейс бот: https://t.me/TypespaceBot Влад Тен с канала Тайпспейс буднично рассказывает, как ИИ от OpenAI решил математическую задачу тысячилетия. Погодите, а может он не решил задачу, а украл? Вы узнаете, что на…
    2,840223Open in Telegram
  • Tuzov AI Lab

    9 Sept, 14:42edited

    Наверное, мне стоило как-то прокомментировать тот факт, что в OpenAI решили недавно проблему Навье-Стокса, раз уж я по образованию статфизик, и это моя профильная, в некотором смысле, тема...Но я уже устал удивляться таким вещам. Если тема не затухнет в ближайшие дни / недели, и это будет кому-то интересно, могу сделать разбор — что это вообще за проблема такая, и в чём суть. Так хоть молодость вспомню 👍Да и вообще, эту проблему уже давно решили у нас в Казахстане! Ну, почти...UPD: формально проблема не считается решённой, пока решение не пройдёт все проверки. Насколько я знаю, для этого должно пройти не менее двух лет. Так что, заголовки в стиле "решили!", это просто упрощение или непонимание (в моём случае — упрощение). Может, и не решили, как было с Отелбаевым.
    4,760451341Open in Telegram
  • Tuzov AI Lab

    9 Sept, 11:37

    Fable 5.1 vs GPT Astra? Мой опыт и сравнение Я недавно запустил платформу для своих авторских гайдов по Go. Кое-где мне не хватило тематических рамок проекта, и я решил на том же движке запустить ещё одну платформу — с гайдами на более общие темы. Я сейчас
  • Tuzov AI Lab

    9 Sept, 10:10edited

    Fable 5.1 vs GPT Astra? Мой опыт и сравнениеЯ недавно запустил платформу для своих авторских гайдов по Go. Кое-где мне не хватило тематических рамок проекта, и я решил на том же движке запустить ещё одну платформу — с гайдами на более общие темы.Я сейчас занят очередной статьёй, поэтому подготовку нового проекта полностью делегировал новым мощным моделям от Антропиков и OpenAI. Промты дал идентичные — показал где взять движок, где смотреть доки, где смотреть пример проекта (go guides) и т.п. Модели должны проработать дизайн, айдентику, структуру контента (рубрики, категории, теги), контент план (по моим черновым наработкам) и прочие уникальные для проекта вещи.Обе модели работали на своих максимальных эффортах, токенов я не жалел. Основная сессия выступала оркестратором, а всю "грязную" работу выполняли агенты на тех моделях и эффортах, которые выбирал оркестратор.ИтогFable
    4,1402193Open in Telegram
  • Tuzov AI Lab

    1 Sept, 19:26edited

    ☀️ Вы наверняка уже в курсе, но — вышел новый Fable 5.1https://www.anthropic.com/claude-fable-and-mythos-5-1Как всегда — быстрее, выше, сильнее. Буду активно пользоваться, если вдруг замечу разницу, поделюсь в отдельном посте.
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    4,790276Open in Telegram
  • Tuzov AI Lab

    24 Jul, 18:22edited

    🔸 Opus 5 — как Fable, но дешевле https://www.anthropic.com/news/claude-opus-5 Anthropic выкатили Opus 5. Доступен везде уже сегодня. Нам обещают, что он вплотную подошёл к Fable 5 — но за половину её цены. При этом сам стоит столько же, сколько Opus 4.8:
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    7,26033841Open in Telegram
  • Tuzov AI Lab

    24 Jul, 17:36

    🔸 Opus 5 — как Fable, но дешевлеhttps://www.anthropic.com/news/claude-opus-5Anthropic выкатили Opus 5. Доступен везде уже сегодня.Нам обещают, что он вплотную подошёл к Fable 5 — но за половину её цены. При этом сам стоит столько же, сколько Opus 4.8: те же $5/$25 за миллион токенов.Цена не выросла, а по словам «доверенных партнёров» — «это самый большой скачок в линейке Opus со времён 4.5». Из цифр: на Frontier-Bench обгоняет всех и больше чем вдвое перекрывает Opus 4.8, а на ARC-AGI 3 (это про решение новых, незнакомых задач) — втрое выше ближайшего конкурента.Но главный акцент релиза не на сырых бенчмарках, а на том, что модель стала заметно лучше соображать и проверять себя.Пара примеров из тестов:- Новому Опусу дали чертёж детали, нужно написать код, который соберёт по нему 3D-модель. Но это был жестокий пранк! Модели отключили зрение
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    5,4602210Open in Telegram
  • Tuzov AI Lab

    24 Jul, 17:02

    Ну привет 👍https://www.anthropic.com/news/claude-opus-5
    AnthropicIntroducing Claude Opus 5Opus 5 is a step change improvement for the Opus tier powering long-running agents while delivering improvements in coding and professional work.
    3,730286Open in Telegram
  • Tuzov AI Lab

    20 Jul, 11:53edited

    6,020291865Open in Telegram
  • Tuzov AI Lab

    18 Jul, 16:52edited

    В последнее время вижу много восторженных отзывов про новый Kimi K3. Мол, он лучше Фэйбла и GPT Sol вместе взятых, да ещё и дешевле 👍Кто-то уже пробовал? Поделитесь опытом, как вам. Особенно в сравнении с Клодом / Кодексом. Стоит брать ещё одну подписку за $100-200? 😐
    5,610125Open in Telegram
  • Tuzov AI Lab

    18 Jul, 07:52edited

    Делайте ваши ставки 👍
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    5,900551663Open in Telegram
  • Tuzov AI Lab

    12 Jul, 21:22

    🔸 ❤️🔵 Антропики и OpenAI конкурируют, мы получаем плюшки Codex: в очередной раз сбросили лимиты (они уже несколько раз так сделали после выхода GPT-5.6) и временно убрали 5-часовой лимит. Claude: продлили доступ к Fable до 19 июля и увеличили недельные лимиты
    7,570521Open in Telegram
  • Tuzov AI Lab

    12 Jul, 21:19

    🔸 ❤️🔵 Антропики и OpenAI конкурируют, мы получаем плюшкиCodex: в очередной раз сбросили лимиты (они уже несколько раз так сделали после выхода GPT-5.6) и временно убрали 5-часовой лимит.Claude: продлили доступ к Fable до 19 июля и увеличили недельные лимиты Claude Code на 50% до этой даты.Идите и делайте дела (с)
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    6,780421754Open in Telegram
  • Tuzov AI Lab

    11 Jul, 20:30edited

    Ещё одно удобное применение Клода — зачем скидывать скучные чеклисты в pdf, если можно сделать вот так? 👍https://labs.tuzov.dev/trek-kit/Готовлюсь к походу в горы, сделал такой вот чеклист-гайд. Моего времени на разработку потрачено примерно ноль (только написание стартового промта, плюс мелкие правки).Время я тратил только на составление списка и вычитку рекомендаций от Клода — он поресёрчил и дополнил меня и гида всяким полезным.К слову, как же удобно, когда можно на каждый чих запустить агента-ресёрчера в фоне, прямо из основной сессии: а точно ли вот эта штука нужна? Какая погода на маршруте в этом время? Рекомендацию по выбору вон той штуки и т.п.В какое удивительное время живём.. 🦄И это ещё одна причина, почему мне сложно будет отказаться от Клода в пользу GPT — у него даже в 5.6 с дизайном заметно
    labs.tuzov.devЧто взять на 3 979 метров и что оставить домаЧеклист снаряжения для семидневного траверса Заилийского Алатау: 72 км, набор 6 047 м, перевал Туристов 3 979 м. 24 критичных пункта — и 18, которые брать не нужно.
    5,820351712Open in Telegram
  • Tuzov AI Lab

    9 Jul, 18:21edited

    А вот нормальную работу с субагентами в Кодекс так и не завезли, похоже.. У меня уже руки набиты на работу с Клод Кодом — делегирование подзадач агентам на правильных моделях (я знаю, что доверить Опусу, что Фэйблу, что Соннету, а иногда даже Хайку).Кроме того, недавно я выяснил, что в Кодексе есть даже ограничение на количество одновременно работающих субагентов, и их довольно мало. Ну и он очень неохотно их запускает, только по прямому запросу пользователя.Похоже, выход GPT-5.6, это прекрасный повод наконец-то освоить pi.dev
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    5,05019103Open in Telegram
  • Tuzov AI Lab

    7 Jul, 17:54edited

    Можете ложиться спать, Fable с нами до 12 июляОбратите внимание: сколько дней до 12.07? Правильно, всего 5. А когда сбросятся лимиты, потраченные недавно? Примерно через неделю. У меня две подписки на Клода — у одной сброс будет 11-го, у другой 13-го. Так что, это продление мало что даёт, на самом деле. Дата выбрана не просто так 👍————Гонка AI сейчас поинтересней, чем остросюжетные блокбастеры:1. Антропики просят остановить развитие ИИ и просят зарегулировать нишу 2. Выпускают "ультрамощную" модель, подсаживая нас на эту иглу 3. Их "зарегулировали", как они и просили, модель забрали.. 4. ... Модель вернули! Но обещают снова забрать 7 июля (исключить из подписки). Однако, запрос на рынке уже есть, они сами его создали! 5. OpenAI собираются занять созданную и освободившуюся нишу, намекая, что GPT-5.6 Sol будет также хорош, как и Fable / Mythos (я
    Image from a post by Tuzov AI LabImage from a post by Tuzov AI Lab
    4,76051642Open in Telegram
  • Tuzov AI Lab

    7 Jul, 15:20

    ⚡️ Лайфхак: контролируем лимиты ClaudeСкользящее 5-часовое окно может застать врасплох: оно стартует только с вашего первого сообщения.
    4,4909433Open in Telegram
  • Tuzov AI Lab

    7 Jul, 12:18

    Reuters: Пекин рассматривает возможность ограничения доступа зарубежных стран к лучшим китайским ИИ-моделям. По словам трех источников, знакомых с ходом обсуждений, китайские власти в течение последнего месяца проводили встречи с ведущими технологическими