Latest posts

Андруша пишет код
6 Aug, 09:34
Уже почти месяц прошел после взлома моделями OpenAI – HuggingFace. Спустя это время каждая уважающая себя лаборатория сказали, что они тоже могут взламывать! Антропик, Кими, и Цукерберг недавноНо, после спора с @XaveScor в чате про то, где была память, как хранились данные, я покопался в деталях всех отчетов, чтобы ответить на эти вопросы.А также, на заголовки, которые пишут – модели стали думать, модели живые и т.д!Ответы тут https://mysummit.school/blog/ai-agent-vzlom-hugging-face/А спойлеры: • Модели не сами решили пойти взламывать мир. Им сказали это делать инженеры, как и @XaveScor утверждал • Модель не столь умна, сколь упорна. За 4 дня были сделаны тысячи различных попыток, чтобы осуществить атаку. И только меньше 100 действий оказались успешными (0.3%)Описал простым языком, без технических деталейmysummit.schoolИИ-агент взломал Hugging Face: 17 600 попыток и один успех | mysummit.school - Практический блог об ИИ в менеджментеАвтономный ИИ-агент взломал Hugging Face: 17 600 попыток, одна удачная цепочка и ноль команд от человека. Разбор без фантастики – и выводы для менеджера.
Андруша пишет код
28 Jul, 22:14edited
https://t.me/denissexy/11581Знаете, меня очень сильно удивляет вопрос: какого чёрта подобные новости описывают всякую фигню по типу "ой, модель проэксплуатировала уязвимость, потом повысила права ..." и прочую фигню полнейшую.Ну уязвимость и уязвимость. А вот главное: то что атака длилась 3 дня - просто мимоходом пишут. МОДЕЛЬ РАБОТАЛА 3 ДНЯ. Т.е. где-то хранился процесс, где-то была память. Деталей об этом 0.Но зато 100500 мегабайт шизы о том как там привелегии повышались. Ещё 10 мегабайт как в интернет ходила Ещё мегабайт о том как заметала следы.Я уверен что она ещё и мимоходом онлифанс создала, чтобы денег заработать и арендовать телефонную линию и заскамить людей по телефону в северной Корее.Но как она работала 3 дня и сохраняла память? Да кому это интересно? Вон, мы сняли тикток об этой истории. Ещё и Майкла Бея наняли, чтобы всё взрывалось и пердело радугойTelegramDenis Sexy ITВот пересказ этой истории по версии Hugging Face, много тех-терминов – но без них не перескахать Если коротко – агент OpenAI на новой модели не стал решать тест по кибербезопасности, а решил просто украсть ответы и украл 🗿 Таймлайн: 📔 9 июля – агент проходит…
Андруша пишет код
28 Jul, 19:28edited
Антропик: китайцы дистилируют наши модели, надо забанить их Опенаи: китайцы дистилируют наши модели, но не баньте их Гугл: https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/tuning/distillationUPD: ой, страница куда-то делась. Теперь тута https://web.archive.org/web/20260728173925/https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/tuning/distillation


Андруша пишет код
26 Jul, 06:31edited
При разработке сервисов, кмк, стоит думать не только о том как офигенно можно всё сделать, но и об юнит экономике. Потому что когда ты даёшь пользователям безлимитный доступ за какую-то ограниченную фиксированную денюжку, к примеру, 20$ в месяц, то надо делать так, чтобы пользователь не потратил эти 20$ на работу сервиса.Вчера я выкатил контекстуальный перевод субтитров в @eyespoken. Единственный способ сделать это нормально - это через ЛЛМ, так как мне нужно иметь немного особый формат перевода. Пример на скриншоте(Внутрь английского текста запихиваем фразу на русском).И тут вопрос по поводу того какую модель использовать. Я решил попробовать пойти во все тяжкие и заэкономить по-максимуму: взять deepseek-v4-flash без ризонинга. И это получается вполне дешево(около 0.005 доллара за запрос) и быстро(1-1.5с).Однако я довольно большая скряга, поэтому решил побыть ещё и немного


Андруша пишет код
25 Jul, 05:38
Хроники @eyespoken продолжаются.Что может быть проще чем сделать перевод текста с одного сверхпопулярного человеческого языка на другой?(с английского на русский) Закинул в буквально любую ЛЛМку(даже в gpt oss 20b) и получил перевод. Вроде всё просто.Но когда я внедрил перевод к себе(кликнул на слово - увидел +- умный перевод) - оказалось, что не всё так просто: 1. Модели жудко медленные. Если будет 60-70t/s в среднем - это уже хорошо 2. Модели думают ОООООООООООчень много. Даже 300 токенов ризонинга при скорости в 80t/s - это около 4 секунд ожидания ТОЛЬКО на ризонинге. 3. Многие модели в принципе не дают отключать ризонинг(антропик, кими, опенаи, гпт привет). А low(там где он есть) - это минимум 1000(ТЫСЯЧЯ!!) токенов на ризонинг. 4. И в такой ситуации даже церебрас с их 500t/s не спасает, так как 1000 токенов(low у gpt oss 120b) - это всё равно 2 секунды.Славься дипсик, которыйOpenAI DevelopersStructured model outputs | OpenAI APIUnderstand how to ensure model responses follow specific JSON Schema you define.
Андруша пишет код
23 Jul, 07:51
Я никогда не понимал на кой чёрт нужны все эти тесты в стиле "смотри, новая гопота смогла сделать земной шар, а кими не может". Потому что это настолько оторванно от реальности, что я даже хз что это показывает.Но сегодня я проникся: Я делаю сервис по изучению иностранных языков @eyespoken и, увы, пришёл к тому, что мне надо обучать свою модель, так как всё что есть в опенсорсе, увы, не справляется с разметкой субтитров. И тут, увы, я столкнулся с тем, что просто не существует на рынке нормальной тулзы для разметки текста. Причём в формате, который мне нужен. Потому что читать json'ы глазами, даже форматированные, в случае разметки тупо невозможно. Нужен интерфейс.И тут гопота 5.6 Sol(mid) зашла как по маслу. Промпт был бквально такой "мне нужен интерфейс, чтобы руками размечать данные для моей модели". И через 25% недельного лимита(на подписке за 100$) был сделан весьма приятный, а


Андруша пишет код
15 Jul, 04:34
Телеграм редко когда добавляет что-то полезное, в отличии от новых кончающих баклажанов, последние пару лет, но текущая фича походу вполне норм.Создавайте сообщества и в списке чатов смотрите на стрелки вниз. За ними может оказаться достаточное количество материалов от интересных для вас личностейP.S. Если создали сообщество, то первым делом идите в его настройки и отключите разрешение добавлять в сообщество чаты неадминам. А то вам быстро туда фигни накидают


Андруша пишет код
15 Jul, 04:00

Андруша пишет код
12 Jul, 13:58
Хочу чутка похвастаться/порекламировать сервис, который я сейчас разрабатываю.Очень кратко тут в тексте, подробно же в прикреплённом видео.ТЛДР: сервис изучения иностранных языков с помощью нейросетей(надо же инвестиции поднимать(нет))1. у нас есть ютуб с отличной рекомендательной системой и контентом на любой вкус и возраст 2. нейронки позволили очень быстро размечать текст(субтитры) на якорьки в виде грамматики, переводов и прочей фигни, которая позволяет запоминать языковые конструкции. Даже если ты не запомнишь сразу, то ты будешь видеть один и тот же якорёк 5, 10, 20 и более раз. И даже если ты такой как Андруша, то ты всё равно запомнишь эту конструкцию и будешь понимать как её применять тупо из своей практики(интересных тебе видосиков с ютуба) 3. Чтобы ты не читерил и не читал сабы 24/7, то мы тебе их показывать не будем. Если ты понимаешь, что не понимаешь что говорится в


Андруша пишет код
10 Jul, 05:27edited
Тут очень громкой новостью за последний месяц было переписывание достаточно крупного проекта с Zig на Rust в 90%-автоматизированном режиме.https://bun.com/blog/bun-in-rust ТЛДР: старый код был плохой, Zig не подходил, а вот с переписыванием на раст стало всё лучше, быстрее, бинарь меньше и вообще все красавчики. И ваабще я всё сделал сам, гоняя 64 клод кода параллельно, потратив 200к баксов в токенах Однако есть нюанс: с момента переписывания до релиза прошёл примерно месяц(релиз на дату опубликования поста всё ещё не произошёл). Тихой сапой чот кодовую базу лечили руками и ногамиТак же есть ответка как это видят со стороны Zig'а: https://andrewkelley.me/post/my-thoughts-bun-rust-rewrite.html ТЛДР: да там вапще говнокодеры, делают фигак-фигак и в продакшен и вообще спасибо что теперь не давите на нас своим авторитетом, скатертью дорога.Без шуток советую прочитать оба текста. Они


Андруша пишет код
19 Jun, 12:55
Не задумывались для кого делаются все эти мелкие локальные модели размерами 4b-70b, которые вы типа можете запускать на своих машинках? Тип, если запустить модельку у себя, подключить в какой-то CLine и попробовать написать код, то получится полная шляпа. А если учесть цену на подписку на решения от openai, антропика или дипсика, то окажется, что локальные решения ещё и экономически неоправданы.Но всё меняется в тот момент, когда ты делаешь какой-нибудь сервис по обработке текста. К примеру, поисковую систему по решениям судов. Да, можно пользоваться большими моделями, но учитывая их ценник, ты скорее обанкротишься, чем найдёшь людей, которые готовы будут тебе платить.Если вы глянете в спецификацию openai протокола, то увидите любопытное поле text_format. Или же так называемый structured output. Он сейчас есть буквально у всех провайдеров



Андруша пишет код
16 Jun, 18:01

Андруша пишет код
16 Jun, 08:22
Какое-то время назад я решил сделать свого агента по типу codex или opencode. Просто потому что "ну я то умный и могу сделать лучше и всё такое".Только было желание попробовать делать не просто агент, а провести эксперимент: что если максимально выкинуть все тулы, mcp и минимизировать системный промпт. Оставить только bash и заставить модель взаимодействовать через уже стандартные linux утилиты: sed, grep и прочие.В итоге оказалось, что модели(gpt 5.3+, glm 5+) вполне неплохо работают на уже имеющихся знаниях о командах линукса. Причём модели openai даже дают приоритет для rg(по сравнению с grep) и добавляют свою псевдо-cli тулу apply-patch для эффективного редактирования, так как у линукса ничего в стоке нет для этого.И даже более: модели уже знают о наличии gh(github), tea(gitea), playwright-cli(понятно кто). Причём если для gpt 5.3 приходилось иметь довольно развёрнутый skill сdocs.tessl.ioProve a skill works using evaluation | Tessl DocsGenerate scenarios, run an evaluation, and read the score difference to see whether a skill actually changes what an agent produces.
Андруша пишет код
11 Jun, 05:10
Я сейчас пилю небольшой проектик по изучению иностранных языков(всё же надо пользоваться хайпом ЛЛМок и всем таким) на основе разных видеоисточников(youtube, netflix, etc). И основная фишка - это показ сабов только тогда, когда пользователю непонятен тот или иной кусок видео(короч, comprehensible input на стероидах). И человек учится просто смотря интересный ему контент.И если с нетфликсом примерно понятно что делать - там сабы стабильны и количество сериалов не такое большое, то с ютубом начинатся проблемы - ты не можешь прекешировать абсолютно все триллионы видео, которые там есть и загружаются каждый день. И поэтому было решено: надо дебажить ютуб и вытаскивать существующие сабы из веба.И тут начинается проблема: инструментов для того, чтобы делать это удобно тупо нет. Vitest - он имеет browser mode, но он работает исключительно со своим веб интерфейсом и не позволяет его


Андруша пишет код
3 Apr, 23:23edited
Итак, прошло около 3-4 месяцев с момента как Антропик попытался заблокировать использование их подписки неофициальными клиентами. И мне кажется, что прошло достаточно времени, чтобы подвести итоги такого решения. Всем провайдерам кроме большой четвёрки пофигу


Андруша пишет код
31 Mar, 21:16
удалил(-а) Вас из группы
Андруша пишет код
30 Mar, 07:02edited
Итак, прошло около 3-4 месяцев с момента как Антропик попытался заблокировать использование их подписки неофициальными клиентами. И мне кажется, что прошло достаточно времени, чтобы подвести итоги такого решения.Всем провайдерам кроме большой четвёрки пофигу на то где вы используете их ключи. GML, Kimi, Cerebras и прочие китайцы с европейцами позволяют платить им подписку и не заморачиваться с этим.В январе, когда произошла блокировка антропика, на помощь к опенкоду пришли, внезапно, openAI и Microsoft: OpenAI: https://x.com/opencode/status/2009805930377167233 Microsoft: https://x.com/opencode/status/2011790750543983072 А так как можно использовать подписки в опенкоде, значит их можно использовать буквально везде. Прикинуться опенкодом не составляет труда + весь код в опенсорсе. По этой же причине как минимум подписки openai попали в cLine/rooCode и прочие сторонние агентыАнтропикX (formerly Twitter)OpenCode (@opencode) on X
Андруша пишет код
6 Mar, 07:55
Если вам кажется, что в мире ничего не происходит интересного кроме ИИ, то это, слава богу, не так: https://httptoolkit.com/blog/dictionary-compression-performance-zstd-brotli/ТЛДР: если сжимать по-умному, опираясь что можно переиспользовать то уже скачано, то трафик можно снизить ооочень сильно. А так - в остальном только ИИ и происходитHttptoolkitDictionary Compression is finally here, and it's ridiculously goodDictionary compression could completely change how applications send data over the web. It's recently gained broad support, and offers absurd real-world...
Андруша пишет код
8 Feb, 11:50
Наконец-то [Company] дропнул [Product] для [OS/Job] это начало конца для привычных [Role]. Теперь всю [Job] можно делать с помощью [Product] на [Value] эффективнее и даже в фоне. Я абсолютно уверен, эпоха знакомых нам [Roles] окончена, и наступила эпоха [Product].Claude Code DocsSpeed up responses with fast mode - Claude Code DocsGet faster Opus responses in Claude Code by toggling fast mode.
Андруша пишет код
7 Feb, 06:51
Вокруг меня в последние пару-тройку месяцев идёт огромное нахваливание модели opus от Anthropic и я сломался и занёс 200$ ребятам и попробовать что из себя представляют их решения. Так же у меня пылилась подписка от openai, которую я использовал исключительно для веба, но которая пригодилась и тут.Если вы пропустили драму с opencode, около месяца назад, то по итогам - OpenAI разрешила использовать свою подписку в любых кодинг агентах - Anthropic напротив начала бороться с тем, чтобы её подписку люди использовали вне claude codeВ итоге это плавно привело к тому, что последний месяц я сравниваю решения от этих двух провайдеров в своей работе. Текущее состояние: - 95% моих задач: анализ бекенд кода, написание кода на фронтенде и всякие аналитические задачки - 95% взаимодействия моего с агентами - это составление подробного плана, который потом может выполняться кем угодно, включая
Related Channels
Other channels in the same section of the catalogue.
