Latest posts

ElKornacio
22 Sept, 19:20
👀👀👀P.S. за данные спасибо Этихлид!


ElKornacio
22 Sept, 18:06edited
GPT-6 Sol / GPT-6 Lunaа вот и ответочка от OpenAI подъехала.выкатывают постепенно, у кого-то в UI уже отображается. и GPT-6 Sol, и Luna в 2 раза дешевле GPT-5.6 Sol и Luna.в целом, если смотреть на бенчи - рост в качестве довольно спокойный (скажем, на DeepSWE Sol-6 даже чутка уступает Sol-5.6), но вот именно показатель cost per task упал радикально - модели стали сильно эффективнее.ждём, когда вслед за этим ещё сильнее подрежут лимиты 🙂


ElKornacio
22 Sept, 17:03edited
а между тем, Opus 5.5судя по карточке - бенчи вроде даже повыше Fable 5.1, при этом цена даже ниже предыдущего опуса.а ещё Anthropic теперь тоже отсыпают ресеты 🙂


ElKornacio
21 Sept, 08:29
это вам за то, что не молитесь 🙂https://x.com/xanderwow_a/status/2101800791795274106?s=46&t=KhsQE0WFk-djFF2q8zsBPw
ElKornacio
20 Sept, 12:46
астра - ок сол - топ луна - вполне ок на простых prompt-to-action задачкахтерра - какой-то псиоп, господипрости. как будто эта модель существует, чтобы мы иногда могли понастольгировать и осознать, какой большой путь модели прошли за эти года. я не знаю, что за 0.1b-1bit там под капотом, но я не смог найти вообще никакого процесса, где терра была бы полезна и работала хорошо
ElKornacio
18 Sept, 12:21edited
и ещё, вот вам полезный промпт, запустить в ночь пятницы, чисто на ctrl-c / ctrl-v:проверь все мои TS проекты на предмет: 1. для форматирования и линтинга используется oxfmt/oxlint 2. для билдов используется incremental esbuild 3. для typechecking используется TS7 (tsgo)для всех где не используется - составь детальный и подробный план перехода - проверь, какие зависимости надо обновить, чтобы ts7 завёлся, какие eslint rules / formatter rules надо адаптировать под Ox, и так далее.обязательно сделай тестовые замеры - сколько операции занимают сейчас, и сколько они будут занимать после перехода (evidence-based, сними мертики с временных папок).подготовь в отдельной ветке или worktree (если они юзаются в этом проекте) готовый переход на oxfmt/oxlint/esbuild/ts7, убедись что всё круто работает, и презентуй мне на ревьюпосле чего выгреби весь кеш со всех установленных на моём компе
ElKornacio
18 Sept, 12:02
и ресетом и не пахнет... 😼—на самом деле, это чёт начинает превращаться в серьёзную проблему. начал серьёзно экспериментировать с всякими вариантами экономии, всякими оркестрациями субагентов, да и даже расчехлил давно забытый персональный ключ от openrouter, deepseek flash тестить... 🧐


ElKornacio
17 Sept, 14:20
https://typesafe.ai/довольно интересная игрушка. чуваки отказались от человеко-читаемого текста в ответах в пользу исключительно структурированной информации + сделали по сути generic classifier вместо классической llm (то есть текст оно вам не напишет, как и код, но сверх-быстро принимать решения уровня "в какую категорию это попадает" может).сравнения с LLM в скорости довольно лукавые, но концептуально - очень интересная штука, потому что, по ощущениям, особенно в производственных агентных воркфлоу (а не просто day-to-day usage), 95% задач, которые решает агент - это либо буквально классификации, либо они могут быть сведены к цепочке классификаций. а обучать собственные классифаеры многим (всем) вообще не хочется, и так в воркфлоу появляются какие-нибудь 0.5b-модели с structured output уровня { result: boolean } или { category: ECategoryEnum }в общем, в вейтлист записался, будетtypesafe.aiHome - TypeSafe AITypeSafe AI is an AI lab building machine-native intelligence infrastructure for automation, designed to make decisions within software. Try our first System One Model, Jev, in early access.
ElKornacio
16 Sept, 08:10
forwarded from @neuralshit
Мне нравится, что он 3 источника как минимум приложил


ElKornacio
15 Sept, 17:25edited
господа, крик души / запрос во вселеннуюхочу забыть про дроч с Шенгеном на 3+ года, за < $10k хз как, какой-нибудь волшебный номад в low-tier стране или юрлицо в ЕС открыть и себя туда устроить, или поступить на языковые курсы в noname университет, или какой-нибудь лайфхак уровня "Франция даёт визы на 10 лет в афганском посольстве между 4 и 6 часами утра по средам", или какие ещё там в принципе существуют визовые программы и фокусы. если знаете проверенные темки - буду признателен за рекомендацию.P.S. гражданин РФ, резидент Сербии, белый доход подходящий под все номадные программы есть P.P.S. ах да - жить при этом в ЕС на постоянке не хочу
ElKornacio
11 Sept, 08:46
в общем, окончательно откатился с gpt-6 на 5.6 во всех флоу. удивительное комбо overpromise-underdelivery. computer use сильно прокачался, в остальном - ппц. и вот беспрерывно подгонять его задолбало ужасно. если 5.6 делает лишнее в 2 случаях из 10, то 6 не делает нужного в 5 случаях из 10, крайне неудобно.ещё и новые 200-баксовые подписки не дают из-за этого, уф.
ElKornacio
10 Sept, 19:30
https://www.anthropic.com/threat-intelligence-report-september-2026интересная статья, в которой антропики довольно открыто описывают, как они без решений суда, следствий и прочей юридической волокиты копаются в переписках разных групп людей под эгидой борьбы с киберпреступностьюгде описаны как вполне очевидно преступные сценарии, так и выглядящие довольно нейтральными (типа zero-day discovery loop)лично у меня вызывает крайне отторгающее ощущение, что некоторая "Threat Intelligence team" внутри антропика читает и изучает все переписки, какие хочет 😕AnthropicCountering misuse of AI: September 2026 / AnthropicCase studies from threat actors disrupted between December 2025 and August 2026 across seven areas of harm, from cyber operations to biological misuse.
ElKornacio
10 Sept, 19:02
https://x.com/humansand/status/2098115046438215791сегодня Humans& релизнули модель, которая реалистично симулирует поведение настоящих людей - как они общаются и взаимодействуют 🙂наконец можно генерить тексты, от которых не веет нейрослопом на самом деле, это очень круто - если оно может генерить behavioral patterns, которые хотя бы отдалённо близки к распределениям и статистикам реальных людей - то это прямая дорога к симуляциям реакций людей на что-то, в огромных масштабах, без, собственно, участия людейсделать 1000 вариантов лендинга и заранее прогнать симуляцию, чтобы предсказать, какая конвертит лучше или вообще юзать это как скоринг-модель для RL или генетических алгоритмов (по сути, fitness-функция, которая умеет оценить, насколько какая-то вещь "человечна").в общем, оч интересно 👀X (formerly Twitter)humans& (@humansand) on XFor AI to work with us, it needs to understand us Today, we're introducing Persimmon, the first large-scale model designed to realistically simulate how people talk and interact
ElKornacio
10 Sept, 16:10
господа, запрос во вселеннуюхочу найти какую-нибудь подписку с умеренной ценой (типа ~$50), и почти бесконечным запасом токенов на условно тупых моделях не прям тупых-тупых, а что-то типа luna/terra чисто под песочницу для каких-нибудь безумных игр в формате /goal и работы 24-7швырять туда какие-нибудь самые отлетевшие идеи и задачи на тест, и чтобы не сильно дорогая модель сутками их тарабанила до бесконечности.знаете что-нибудь такое? мне кажется, тот же openai за $200 вполне потянул бы luna на 24/7 держать, но $200 чутка жалко, хочется подешевле
ElKornacio
9 Sept, 10:48edited
почему Сэм Альтман не сможет вылечить себе рак?по следам прошлого поста складывается ощущение что "можно швырнуть много миллионов долларов в компьют, поднять 100000 агентов и они решат любую задачу" или "AGI сводит решение любых задач к вопросу доступности компьюта и цены".я вот лежал-размышлял на тему "если завтра у Сэма Альтмана обнаружат рак - сможет ли он поднять 100.000 агентов чтобы они за неделю нашли лекарство?", и простой ответ - нет. представьте, что вы ищете ответ на какой-то вопрос про реальность, к примеру "какая комбинация молекул в пробирке вылечит рак такого типа". и вот есть спектр, где с одной стороны:- полное отсутствие интеллекта aka полный перебор всех существующих вариантов классические "бесконечные мартышки перебирающие кнопки в попытке написать Войну и Мир". отсутствие оптимизации перебора вообще.а с другой:- абсолютный интеллект aka сразу выбор
ElKornacio
8 Sept, 23:44
оч интересная история: https://t.me/airamongush/186TelegramАйра Монгуш — AI, tech & mathВ математике и AI сейчас происходит невероятный поворот. (Правда, думаю до сингулярности еще несколько менее доступных проблем тысячелетия остались). Сорри за англ.цитаты, их много. Примерно 12 месяцев два математика, Tristan Buckmaster, профессор математики…
ElKornacio
7 Sept, 15:49
шо, ребята, permanent underclass is coming for us?
ElKornacio
3 Sept, 18:35edited
шо, ребята, permanent underclass is coming for us?


ElKornacio
3 Sept, 16:58
👀


ElKornacio
25 Aug, 18:14edited
а у вас было такое, что агенты упарываются и творят херню? 🙂(нет, это не начало моего нового стендапа) короче, иногда, выбрав определённое направление решения задачи (особенно в исследованиях и экспериментах) агент закапывается очень глубоко, и ему не хватает какой-то рефлексии типа "ох, чета мы кажется уже упоролись и делаем дичь. вернусь на пару шагов назад и подумаю, нет ли здесь другого решения".скажем, у меня пару дней назад агент тестил десктопное приложение, эмуляцией кликов мыши (по CDP). и стал жаловаться, мол, кнопка не кликается - click-евент не ловится. он полчаса копался в драйвере CDP, решил что это баг драйвера, и стал переписывать всё моё приложение, чтобы кнопки умели реагировать не только на click, но и на pointerup. поймал упыря за руку в последний момент. сказал "дурень, дичь не неси, CDP перепроверь" - и вот чудо, оказывается он
Related Channels
Other channels in the same section of the catalogue.
