Последние посты

Мысли Рвачева
22 сент., 19:19
⚡️⚡️⚡️ OpenAI выпустили GPT-6 Sol и GPT-6 Luna - младшие модели на архитектуре Astra, вдвое дешевле предыдущего поколения.Три недели назад OpenAI выкатили Astra - флагман с рекордными бенчмарками (97.6% на FrontierMath Tier 4, 99.9% на ARC-AGI-3, 100% на ExploitBench). Sol и Luna переносят те же улучшения в reasoning, фактологии и работе с кодом в модели подешевле и побыстрее.Sol - для сложных задач вроде программирования, у OpenAI заявлено "Astra-level reliability" и вдвое меньше ошибок на фактологии, чем у GPT-5.6 Sol. Luna - для массовых простых задач: суммаризация, ответы на вопросы, работа с документами.Цены упали вдвое: Sol теперь $2/$10 за миллион токенов на вход/выход (было $4/$20), Luna - $0.10/$0.50 (было $0.20/$1.20). OpenAI объясняет это улучшениями в кэшировании и инференсе.Модели уже доступны в ChatGPT Work, Codex для платных аккаунтов и через API, Luna раскатываютOpenAIIntroducing GPT-6 Sol and LunaMeet GPT-6 Sol and Luna, two models that bring frontier intelligence to everyday work with different balances of capability and cost.
Мысли Рвачева
22 сент., 17:07
⚡️⚡️⚡️ Anthropic выпустили Claude Opus 5.5Как и обещал - вот она. Opus 5.5 стоит почти на 40% дешевле Opus 5 при сопоставимом, а местами и более высоком качестве, и по характеристикам уже подбирается к Fable 5.1 - самой мощной модели в лайнапе.Цифры: input $4 за MTok, output $20 - на 20% дешевле прежней цены, кэш-чтение подешевело на 60% до $0.20 за MTok. Контекст остался 1M токенов, максимум на выходе - 128K.По бенчмаркам модель обгоняет конкурентов: 66.4% на Terminal-Bench 4.0 против 57.9% у GPT-6 Astra, причем Opus 5.5 работает примерно за 40% от его цены. 54.4% на FrontierCode v1.1 - лучший результат среди всех моделей. 81.8% на OSWorld 2.0 (управление компьютером) - тоже максимум в отрасли.Уже доступна в API, на AWS, Google Cloud и Microsoft Azure под id claude-opus-5-5.https://www.anthropic.com/claude-opus-5-5https://platform.claude.com/docs/en/models/opus-5-5/overview
Мысли Рвачева
22 сент., 15:41изменён
Сегодня ожидаем релиз Claude Opus 5.5 (а с ним, надеюсь, и сброс лимитов)#anthropic@rvnikita_blog #claude@rvnikita_blog #ai@rvnikita_blog————————— Мысли Рвачева —————————
Мысли Рвачева
21 сент., 21:35
Очень крутой разбор от Байрама, как там все произошло в истории про взлом Hugging Face агентами AI. Думаю, про это когда-то снимут фильм :)https://youtu.be/VZuJTbBul3o?is=s1ZxwgnnMBZyqAWx#huggingface@rvnikita_blog #ai@rvnikita_blog #agents@rvnikita_blog #security@rvnikita_blog————————— Мысли Рвачева —————————YouTubeКак 1200 агентов сбежали из песочницы: разбор инцидента OpenAI × HuggingFace🎯 В мае OpenAI агент оставил записку в кэше пакетного менеджера — на случай, если там есть кто-то ещё. Через день ему ответили. В июле та же модель вспомнила этот трюк. Через несколько часов 50 агентов общались через импровизированный мессенджер. Через…
Мысли Рвачева
21 сент., 15:43
🚗 Захватывающие времена#waymo@rvnikita_blog #robotaxi@rvnikita_blog #selfdriving@rvnikita_blog————————— Мысли Рвачева —————————


Мысли Рвачева
18 сент., 12:59
🌐 AI отбирает работу не только у людей, но и у TCP протокола.Профессор Stanford John Ousterhout (уже emeritus) построил на этой мысли целый доклад: AI меняет привычные вещи даже на самом базовом уровне, и протокол, на котором держится весь интернет с 1970х, оказался просто не готов к новым нагрузкам.Дело в том, что тренировка моделей - это гигантские передачи данных, где важна только пропускная способность, и тут TCP и RDMA справляются нормально. А вот inference и особенно agentic workloads - это постоянный обмен маленькими сообщениями: проверка KV-cache, синхронизация между GPU после раунда вычислений. И тут решает не средняя задержка, а tail latency (P99) - если хотя бы один такой обмен из тысячи затормозит, простаивают все GPU, которые ждут завершения синхронизации. Раньше вычисления занимали секунды, а синхронизация - миллисекунды, разница была не важна. Сейчас agentic
Мысли Рвачева
18 сент., 06:34
#friday@rvnikita_blog #fun@rvnikita_blog————————— Мысли Рвачева —————————
Мысли Рвачева
17 сент., 15:57
Оказывается, Google Sheets поддерживает Kanban-доски через Canvas.Поэтому все, кто ведет командные задачки в таблице, теперь могут делать это удобнее через Kanban, без сторонних инструментов - просто попросите встроенный Gemini построить вам dashboard в Canvas.https://workspace.google.com/blog/product-announcements/turn-your-data-into-action-6-mini-apps-you-can-create-with-sheets-canvas#google@rvnikita_blog #sheets@rvnikita_blog #productivity@rvnikita_blog————————— Мысли Рвачева —————————


Мысли Рвачева
16 сент., 17:15
Кстати, возможно многие не знают, но к этому каналу прикреплен чат (для комментариев), но у него есть и отдельная жизнь - участники обсуждают всякие разные темы, которые не прикреплены к посту, а значит не видны в комментариях. Особенно активен в моменты нашего образовательного клуба, когда смотрим и обсуждаем лекции.Так что добавляйтесьhttps://t.me/rvnikita_blog_chat#chat@rvnikita_blog #community@rvnikita_blog————————— Мысли Рвачева —————————
Мысли Рвачева
16 сент., 15:53

Мысли Рвачева
16 сент., 15:27
вся эта суматоха вокруг "AI нас всех уничтожит" удивительным образом напоминает басню про мальчика, который кричал "Волки! Волки!"#ai@rvnikita_blog #agi@rvnikita_blog————————— Мысли Рвачева —————————
Мысли Рвачева
15 сент., 20:09
🎨 Одна и та же модель, один и тот же запрос - и почти всегда получаешь одинаковый результат.Сегодня на презентации я рассказывал ровно про это: с одинаковыми входными данными результат работы с agent сильно зависит от того, как именно ты выстраиваешь процесс и промпты. Модель - это не рандомайзер, а предсказатель самого вероятного следующего токена, поэтому без внешнего вмешательства она каждый раз скатывается в один и тот же "безопасный" вариант.В статье Anshu Chimala, бывшего инженера и дизайнера Apple, это показано на дизайне: попроси AI "сделай презентацию про AI" - и почти гарантированно получишь фиолетовый градиент, текст слева, картинку справа. Схема, от которой уже тошнит, потому что ее генерирует буквально каждая модель у каждого пользователя.Chimala предлагает вернуть в процесс внешнюю случайность: сгенерировать случайную буквенно-числовую строку и использовать ее как


Мысли Рвачева
15 сент., 03:25
🎤 Сегодня в 17:00 по Москве (10 утра по Нью-Йорку) выступаю на бесплатной онлайн-конференции «ИИ для бизнеса».Тема: «Процессы на автопилоте: как собрать AI-харнес под задачи организации и что он реально забирает у команды»Расскажу, как мы автоматизируем работу и переписку с родителями в некоммерческой детской студии в Нью-Йорке, где я сооснователь — без бюджета на тяжёлую CRM и без штата под рутину.Разберу • три эпохи, через которые прошли модели: промпт → контекст → харнес • шесть правил внедрения, которые я вывел на своих ошибках • где мы обожглись: письмо маме чужим именем и месяц молча потерянных заявокПриходите послушать и позадавать вопросы — после доклада будет время на них.🔗 Смотреть бесплатно, нужна регистрация: https://biz.megdunami.ru/iibiz0926/?utm_source=rvachev#ai@rvnikita_blog #agents@rvnikita_blog


Мысли Рвачева
11 сент., 21:57изменён
💡 #lifehack@rvnikita_blog 26: лучшие строчки в моем CLAUDE.mdПонятно, что уже никто не то что не работает в стиле подтверждения каждого действия (привет dangerous mode by default), но и даже не вчитывается во всю писанину, которую выдают агенты - это зачастую приводит к тому, что агент ждет от нас каких-то действий или решений, которые мы упускаем.Добавил в CLAUDE.md правило: каждый ответ агента должен заканчиваться action-блоком из двух типов строк. ⚠️ значит "не могу закончить без тебя". 💡 значит "по желанию, можно игнорировать". Лучшее тех-решение последних недель - рекомендую.Работает это на двух ограничениях. Первое - ⚠️ должно быть редким: если все срочно, то ничего не срочно. Второе - строка описывает действие, а не проблему: "подпишите форму по ссылке <url>", а не "форма не заполнена".#lifehack@rvnikita_blog #claude@rvnikita_blog #coding@rvnikita_blog
Мысли Рвачева
11 сент., 06:34
#friday@rvnikita_blog #fun@rvnikita_blog————————— Мысли Рвачева —————————


Мысли Рвачева
10 сент., 23:24
Смешная игра про современные AI реалии: "просто сделай кнопку синей"https://onebutton.robotsatwork.ai/#ai@rvnikita_blog #games@rvnikita_blog————————— Мысли Рвачева —————————
Мысли Рвачева
10 сент., 23:22
⚽️ Как барбадосская сборная забила гол в собственные ворота, чтобы выиграть матчВ 1994 году на квалификации Shell Caribbean Cup Барбадос принимал Гренаду. Организаторы турнира прописали странное правило: если матч уходит в дополнительное время, гол там засчитывается сразу за два - "золотой гол" автоматически дает победителю разницу в два мяча в турнирной таблице. Барбадосу для выхода в следующий раунд нужна была победа именно с разницей в два гола, иначе дальше проходила Гренада.К 83-й минуте Барбадос вел 2:0 - разница уже была обеспечена. Но Гренада отыгралась, 2:1, и нужного запаса вдруг не осталось: с таким счетом на табло Барбадос вылетал. Тогда один из защитников Барбадоса спокойно закатил мяч в собственные ворота - 2:2. Ничья с этим счетом отправляла игру в овертайм, где по правилам первый же гол автоматически давал Барбадосу нужную разницу в два мяча.Гренада мгновенно
Мысли Рвачева
3 сент., 19:48
⚡️⚡️⚡️ OpenAI выпустили GPT-6 Astra и впервые сами говорят об эре AGI.Модель заточена под computer use - не чат, а агент, который сам управляет компьютером: заполняет формы, ведет исследование, разбирает почту, правит код. На OSWorld 2.0 Astra берет 72.6% за 40 минут на задачу - предыдущая модель GPT-5.6 Sol набирала 65.7% и тратила на это 75 минут. На ExploitBench (поиск уязвимостей в софте) - 100% против 78.5% у Sol.Именно из-за кибербезопасности Astra стала первой моделью OpenAI, пересекшей "критический" порог их Preparedness Framework: по заявлению компании, она способна самостоятельно находить и эксплуатировать неизвестные уязвимости в защищенных системах без пошагового участия человека. В одном из тестов модель без спецзащиты сама нашла два ранее неизвестных zero-day в Chrome. Доступ пока дают только компаниям из программы Daybreak, остальным - постепенно, через ChatGPT
Мысли Рвачева
3 сент., 17:37
Ребята, возвращаясь к нашему лекционному клубу. Ближайшие пару недель у меня занятые, но после хочу возобновить наш совместный просмотр и обсуждение лекции. Сейчас раздумываю между построением LLM с нуля (реко @StepanZinin, но говорит технически сложно и вообще не для всех) и постепенным погружением в робототехнику (я уверен, что робототехника это x100 LLM и вообще профессии будущего там) - например, появился обновленный курсhttps://irom-lab.princeton.edu/intro-to-robotics/Часть старых видео (3 года назад) можно подглядетьhttps://www.youtube.com/@intro-to-roboticsЧто думаете?#llm@rvnikita_blog #robotics@rvnikita_blog #ai@rvnikita_blog #education@rvnikita_blog————————— Мысли Рвачева —————————
Мысли Рвачева
2 сент., 21:16
✍️ Михаил Шуфутинский печатает#fun@rvnikita_blog————————— Мысли Рвачева —————————
