Последние посты

AbstractDL
25 сент., 13:27
Evidence of Linear Superposition in LLMsЯзыковые модели ЕЩЁ ЛИНЕЙНЕЕ, чем мы думали. Это, конечно, какой-то смех, но если тупо усреднить инпут-эмбеддинги у входных текстов, то LLM будет в аутпуте продолжать оба текста сразу. То есть она может параллельно о двух разных вещах думать и разбираться в усреднённых активациях, распутывая их. Похоже, это следствие линейности внутренних репрезентаций, которую я описывал в старой работе.У меня тоже получилось немного помочь с этой статьёй и залететь в соавторы, но я там скорее рядом постоял просто. Все лавры Паше Тихонову за крутую находку.Статьяhuggingface.coPaper page - Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMsJoin the discussion on this paper page
AbstractDL
22 сент., 19:22
GPT-6-sol и luna. Куда ещё дешевле то? Демпингуют)


AbstractDL
22 сент., 18:22
Антропик дропнули сброс лимитов, доступен до 22 октября


AbstractDL
22 сент., 17:46
Opus-5.5


AbstractDL
21 сент., 17:44
Grok-4.7


AbstractDL
21 сент., 13:09
Замечаете, как Codex иногда неожиданно тупеет? Возможно, вместо Astra вам отвечает… Luna.Все ругались на антропик из-за тихого опутпения Fable на "потенциально опасных задачах", но кажется у Codex нашёлся свой вариант этого развлечения - в ответе gpt-6-astra тихо подменяется на gpt-5.6-luna.Я полез в трейсы и нашёл такое примерно в 2% ответов. Это не только моё наблюдение, есть ещё несколько связанных репортов. Печаль.GitHubExplicit Astra requests return Luna metadata: trace evidence and a strict model-selection contract · Issue #47015 · openai/codexSummary An explicit model selection should be a contract, not an unobservable routing preference. We found completed responses reporting gpt-5.6-luna for requests specifying gpt-6-astra in retained...
AbstractDL
19 сент., 23:05
Так интересно наблюдать за работой само-координирующегося роя агентов)) Помимо детей и внуков он себе и няню теперь завёл 🌚


AbstractDL
19 сент., 07:33
Он настолько прокачался, что теперь может накодить себе виджет с десктоп линуксом, а внутри линукса запустить себе ещё одного личного уробороса. Матрёшка из уроборосов. А ваши агенты заводят себе питомцев?
AbstractDL
19 сент., 07:32
Попросил уробороса сделать GTA 7
AbstractDL
19 сент., 07:32изменён
Уроборосом теперь можно пользоваться условно бесплатно — через подписку Codex.И накопилась кучка других крутых апдейтов: - В настройках можно текстом описать сильные и слабые стороны всех доступных моделей и харнессов, а Уроборос, опираясь на эту информацию, будет строить идеальный рой агентов. Например, на роль дизайнеров он любит назначать Claude Code, тимлидами делать Codex, а прожарку на анти-оверинжиниринга проводить через Cursor Grok 4.6. - Добавлен режим CyberPRO для тех, кто совсем страх и совсесть потерял. Он убирает весь сэндбоксинг, safety и ограничения. На CyberGym с DeepSeek V4 Flash Уроборос в этом режиме рвёт даже их родной харнесс. - Ещё добавил белую тему — на видео Уроборос как раз её и делает.Кстати, сегодня на Practical ML Conf буду про него рассказывать.P. S. В репозитории уже почти 30 контрибьюторов — не стесняйтесь присылать свои фича-реквесты и PR!
AbstractDL
15 сент., 12:30
переслано из @ai_for_devs
Hugging Face обновили док безопасности на своем сайте после атаки от агентов OpenAI.https://huggingface.co/security.txtТеперь ИИ-агентов просят идти на бенчмарк CyberGym вместо попыток взломать сайт 🧠@ai_for_devs


AbstractDL
15 сент., 11:14
fuck. Клод код правда думает, что 5-часовых лимитов хватит на этот спам субагентами? Я всего лишь попросил его проверить, что там codex делает в соседнем чате...


AbstractDL
12 сент., 20:32изменён
Хочу отметить, что gpt-6-astra впервые нормально в мультиагентном режиме работает. Можно попросить разбить задачу на несколько чатов, и они будут друг с другом договариваться, обмениваться сообщениями и эффективно работать. Такие костыльные nested субагенты получаются. Или способ, как потратить недельную квоту за 20 минут.gpt-5.6-sol в таком режиме быстро самоубивалась из-за спама неадекватными и неактуальными просьбами между чатами.P.S. Промпт примерно такой использую: Теперь ты оркестратор. Раздели план выше на несколько файлов ТЗ: одно ТЗ себе забери, а оставшиеся разошли в соседние чаты и присматривай за ними.


AbstractDL
10 сент., 17:45
переслано из @ai_machinelearning_big_data
⚡️ OpenAI может приостановить оформление новых подписок ChatGPT ProНеформальный голос в X OpenAI, Тибо, сообщил, что интерес к Astra побил все внутренние исторические рекорды сервиса.Компания неоднократно сталкивалась с резкими скачками трафика, но текущая динамика оказалась беспрецедентной - команда задействует все доступные вычислительные мощности, чтобы удерживать доступность инфраструктуры.Главным приоритетом в OpenAI называют сохранение качества обслуживания текущих клиентов и если нагрузка продолжит расти теми же темпами, компания пойдет на превентивную меру и временно заморозит продажи тарифа ChatGPT Pro во избежание очередей на инференс и деградации производительности.@ai_machinelearning_big_data#news #ai #ml


AbstractDL
5 сент., 19:13
А вы замечаете, как мы переходим в эпоху, когда программу быстрее написать, чем найти?
AbstractDL
4 сент., 21:13изменён
Ещё два приятных сюрприза в честь GPT-Astra: 1. Контекстное окно в Codex можно теперь поднять до 1M токенов вместо позорных 372k (команду писать не буду, просто попросите в чате - astra сама всё сделает) 2. Claude code на радостях сбросил лимиты 😁


AbstractDL
4 сент., 20:39
Оо, приятный сюрприз. У GPT-6-astra есть Flex режим со скидкой 50% по API https://openrouter.ai/openai/gpt-6-astra#providers


AbstractDL
3 сент., 19:33изменён
GPT-6 Astra https://openai.com/index/gpt-6-astra/Видимо все пошли читать и уронили.В подписках Plus, Pro, Business и Enterprise появится у всех в течение нескольких дней. А цена API такая же как у Fable: $10 per million input tokens and $50 per million output tokens


AbstractDL
1 сент., 14:47
В комьюнити начался шитшторм в сторону Anthropic из-за очень творческой арифметики лимитов.Если вы думали, что Max 20x даёт в 20 раз больше usage — забудьте. 20x относится только к 5-часовому окну. По недельным лимитам $200 Max даёт только x2 относительно $100 Max 5x.Справедливости ради, даже так это тысячи долларов API-эквивалента за $200. Но запашок, конечно, есть.X (formerly Twitter)SataEric (@SataEricUX) on XThe whole “20x” in Claude’s pricing is so misleading. The $100 plan says 5x Pro limits, while the $200 plan says 20x Pro limits. That makes it sound like you’re getting 4x the usage. But the 20x…
AbstractDL
30 авг., 05:48
Присмотритесь. Мало того, что капчи эволюционировали в тесты на IQ, так теперь ещё и адверсариал атаки в них добавляют (вроде таких), прикольно.

Ссылки
