gram news
ElKornacio channel avatar

ElKornacio

@elkornacio

Авторский канал про технологии и бизнес. Тут матерятся (и дают качественную аналитику). @sewald

ProjectsRUTech

14,500subscribers

Open the Channel

Latest posts

  • ElKornacio

    22 Sept, 19:20

    👀👀👀P.S. за данные спасибо Этихлид!
    Image from a post by ElKornacioImage from a post by ElKornacio
    1,490641Open in Telegram
  • ElKornacio

    22 Sept, 18:06edited

    GPT-6 Sol / GPT-6 Lunaа вот и ответочка от OpenAI подъехала.выкатывают постепенно, у кого-то в UI уже отображается. и GPT-6 Sol, и Luna в 2 раза дешевле GPT-5.6 Sol и Luna.в целом, если смотреть на бенчи - рост в качестве довольно спокойный (скажем, на DeepSWE Sol-6 даже чутка уступает Sol-5.6), но вот именно показатель cost per task упал радикально - модели стали сильно эффективнее.ждём, когда вслед за этим ещё сильнее подрежут лимиты 🙂
    Image from a post by ElKornacioImage from a post by ElKornacio
    4,3802754221Open in Telegram
  • ElKornacio

    22 Sept, 17:03edited

    а между тем, Opus 5.5судя по карточке - бенчи вроде даже повыше Fable 5.1, при этом цена даже ниже предыдущего опуса.а ещё Anthropic теперь тоже отсыпают ресеты 🙂
    Image from a post by ElKornacioImage from a post by ElKornacio
    2,87023762Open in Telegram
  • ElKornacio

    21 Sept, 08:29

    это вам за то, что не молитесь 🙂https://x.com/xanderwow_a/status/2101800791795274106?s=46&t=KhsQE0WFk-djFF2q8zsBPw
    4,290video571210822Open in Telegram
  • ElKornacio

    20 Sept, 12:46

    астра - ок сол - топ луна - вполне ок на простых prompt-to-action задачкахтерра - какой-то псиоп, господипрости. как будто эта модель существует, чтобы мы иногда могли понастольгировать и осознать, какой большой путь модели прошли за эти года. я не знаю, что за 0.1b-1bit там под капотом, но я не смог найти вообще никакого процесса, где терра была бы полезна и работала хорошо
    4,500191612332Open in Telegram
  • ElKornacio

    18 Sept, 12:21edited

    и ещё, вот вам полезный промпт, запустить в ночь пятницы, чисто на ctrl-c / ctrl-v:проверь все мои TS проекты на предмет: 1. для форматирования и линтинга используется oxfmt/oxlint 2. для билдов используется incremental esbuild 3. для typechecking используется TS7 (tsgo)для всех где не используется - составь детальный и подробный план перехода - проверь, какие зависимости надо обновить, чтобы ts7 завёлся, какие eslint rules / formatter rules надо адаптировать под Ox, и так далее.обязательно сделай тестовые замеры - сколько операции занимают сейчас, и сколько они будут занимать после перехода (evidence-based, сними мертики с временных папок).подготовь в отдельной ветке или worktree (если они юзаются в этом проекте) готовый переход на oxfmt/oxlint/esbuild/ts7, убедись что всё круто работает, и презентуй мне на ревьюпосле чего выгреби весь кеш со всех установленных на моём компе
    5,6601571110665Open in Telegram
  • ElKornacio

    18 Sept, 12:02

    и ресетом и не пахнет... 😼—на самом деле, это чёт начинает превращаться в серьёзную проблему. начал серьёзно экспериментировать с всякими вариантами экономии, всякими оркестрациями субагентов, да и даже расчехлил давно забытый персональный ключ от openrouter, deepseek flash тестить... 🧐
    Image from a post by ElKornacioImage from a post by ElKornacio
    4,6003314321Open in Telegram
  • ElKornacio

    17 Sept, 14:20

    https://typesafe.ai/довольно интересная игрушка. чуваки отказались от человеко-читаемого текста в ответах в пользу исключительно структурированной информации + сделали по сути generic classifier вместо классической llm (то есть текст оно вам не напишет, как и код, но сверх-быстро принимать решения уровня "в какую категорию это попадает" может).сравнения с LLM в скорости довольно лукавые, но концептуально - очень интересная штука, потому что, по ощущениям, особенно в производственных агентных воркфлоу (а не просто day-to-day usage), 95% задач, которые решает агент - это либо буквально классификации, либо они могут быть сведены к цепочке классификаций. а обучать собственные классифаеры многим (всем) вообще не хочется, и так в воркфлоу появляются какие-нибудь 0.5b-модели с structured output уровня { result: boolean } или { category: ECategoryEnum }в общем, в вейтлист записался, будет
    typesafe.aiHome - TypeSafe AITypeSafe AI is an AI lab building machine-native intelligence infrastructure for automation, designed to make decisions within software. Try our first System One Model, Jev, in early access.
    5,1301594211Open in Telegram
  • ElKornacio

    16 Sept, 08:10

    forwarded from @neuralshit

    Мне нравится, что он 3 источника как минимум приложил
    Image from a post by ElKornacioImage from a post by ElKornacio
    4,78019015432Open in Telegram
  • ElKornacio

    15 Sept, 17:25edited

    господа, крик души / запрос во вселеннуюхочу забыть про дроч с Шенгеном на 3+ года, за < $10k хз как, какой-нибудь волшебный номад в low-tier стране или юрлицо в ЕС открыть и себя туда устроить, или поступить на языковые курсы в noname университет, или какой-нибудь лайфхак уровня "Франция даёт визы на 10 лет в афганском посольстве между 4 и 6 часами утра по средам", или какие ещё там в принципе существуют визовые программы и фокусы. если знаете проверенные темки - буду признателен за рекомендацию.P.S. гражданин РФ, резидент Сербии, белый доход подходящий под все номадные программы есть P.P.S. ах да - жить при этом в ЕС на постоянке не хочу
    5,620262215113Open in Telegram
  • ElKornacio

    11 Sept, 08:46

    в общем, окончательно откатился с gpt-6 на 5.6 во всех флоу. удивительное комбо overpromise-underdelivery. computer use сильно прокачался, в остальном - ппц. и вот беспрерывно подгонять его задолбало ужасно. если 5.6 делает лишнее в 2 случаях из 10, то 6 не делает нужного в 5 случаях из 10, крайне неудобно.ещё и новые 200-баксовые подписки не дают из-за этого, уф.
    7,71044207421Open in Telegram
  • ElKornacio

    10 Sept, 19:30

    https://www.anthropic.com/threat-intelligence-report-september-2026интересная статья, в которой антропики довольно открыто описывают, как они без решений суда, следствий и прочей юридической волокиты копаются в переписках разных групп людей под эгидой борьбы с киберпреступностьюгде описаны как вполне очевидно преступные сценарии, так и выглядящие довольно нейтральными (типа zero-day discovery loop)лично у меня вызывает крайне отторгающее ощущение, что некоторая "Threat Intelligence team" внутри антропика читает и изучает все переписки, какие хочет 😕
    AnthropicCountering misuse of AI: September 2026 / AnthropicCase studies from threat actors disrupted between December 2025 and August 2026 across seven areas of harm, from cyber operations to biological misuse.
    7,88017127541Open in Telegram
  • ElKornacio

    10 Sept, 19:02

    https://x.com/humansand/status/2098115046438215791сегодня Humans& релизнули модель, которая реалистично симулирует поведение настоящих людей - как они общаются и взаимодействуют 🙂наконец можно генерить тексты, от которых не веет нейрослопом на самом деле, это очень круто - если оно может генерить behavioral patterns, которые хотя бы отдалённо близки к распределениям и статистикам реальных людей - то это прямая дорога к симуляциям реакций людей на что-то, в огромных масштабах, без, собственно, участия людейсделать 1000 вариантов лендинга и заранее прогнать симуляцию, чтобы предсказать, какая конвертит лучше или вообще юзать это как скоринг-модель для RL или генетических алгоритмов (по сути, fitness-функция, которая умеет оценить, насколько какая-то вещь "человечна").в общем, оч интересно 👀
    X (formerly Twitter)humans& (@humansand) on XFor AI to work with us, it needs to understand us Today, we're introducing Persimmon, the first large-scale model designed to realistically simulate how people talk and interact
    10,90014941Open in Telegram
  • ElKornacio

    10 Sept, 16:10

    господа, запрос во вселеннуюхочу найти какую-нибудь подписку с умеренной ценой (типа ~$50), и почти бесконечным запасом токенов на условно тупых моделях не прям тупых-тупых, а что-то типа luna/terra чисто под песочницу для каких-нибудь безумных игр в формате /goal и работы 24-7швырять туда какие-нибудь самые отлетевшие идеи и задачи на тест, и чтобы не сильно дорогая модель сутками их тарабанила до бесконечности.знаете что-нибудь такое? мне кажется, тот же openai за $200 вполне потянул бы luna на 24/7 держать, но $200 чутка жалко, хочется подешевле
    6,62087Open in Telegram
  • ElKornacio

    9 Sept, 10:48edited

    почему Сэм Альтман не сможет вылечить себе рак?по следам прошлого поста складывается ощущение что "можно швырнуть много миллионов долларов в компьют, поднять 100000 агентов и они решат любую задачу" или "AGI сводит решение любых задач к вопросу доступности компьюта и цены".я вот лежал-размышлял на тему "если завтра у Сэма Альтмана обнаружат рак - сможет ли он поднять 100.000 агентов чтобы они за неделю нашли лекарство?", и простой ответ - нет. представьте, что вы ищете ответ на какой-то вопрос про реальность, к примеру "какая комбинация молекул в пробирке вылечит рак такого типа". и вот есть спектр, где с одной стороны:- полное отсутствие интеллекта aka полный перебор всех существующих вариантов классические "бесконечные мартышки перебирающие кнопки в попытке написать Войну и Мир". отсутствие оптимизации перебора вообще.а с другой:- абсолютный интеллект aka сразу выбор
    6,580521910432Open in Telegram
  • ElKornacio

    8 Sept, 23:44

    оч интересная история: https://t.me/airamongush/186
    TelegramАйра Монгуш — AI, tech & mathВ математике и AI сейчас происходит невероятный поворот. (Правда, думаю до сингулярности еще несколько менее доступных проблем тысячелетия остались). Сорри за англ.цитаты, их много. Примерно 12 месяцев два математика, Tristan Buckmaster, профессор математики…
    6,4801431Open in Telegram
  • ElKornacio

    7 Sept, 15:49

    шо, ребята, permanent underclass is coming for us?
    7,440554215954Open in Telegram
  • ElKornacio

    3 Sept, 18:35edited

    шо, ребята, permanent underclass is coming for us?
    Image from a post by ElKornacioImage from a post by ElKornacio
    8,95034181053Open in Telegram
  • ElKornacio

    3 Sept, 16:58

    👀
    Image from a post by ElKornacioImage from a post by ElKornacio
    8,8702413842Open in Telegram
  • ElKornacio

    25 Aug, 18:14edited

    а у вас было такое, что агенты упарываются и творят херню? 🙂(нет, это не начало моего нового стендапа) короче, иногда, выбрав определённое направление решения задачи (особенно в исследованиях и экспериментах) агент закапывается очень глубоко, и ему не хватает какой-то рефлексии типа "ох, чета мы кажется уже упоролись и делаем дичь. вернусь на пару шагов назад и подумаю, нет ли здесь другого решения".скажем, у меня пару дней назад агент тестил десктопное приложение, эмуляцией кликов мыши (по CDP). и стал жаловаться, мол, кнопка не кликается - click-евент не ловится. он полчаса копался в драйвере CDP, решил что это баг драйвера, и стал переписывать всё моё приложение, чтобы кнопки умели реагировать не только на click, но и на pointerup. поймал упыря за руку в последний момент. сказал "дурень, дичь не неси, CDP перепроверь" - и вот чудо, оказывается он
    12,50013631121222Open in Telegram