gram news
Аватар канала ElKornacio

ElKornacio

@elkornacio

Авторский канал про технологии и бизнес. Тут матерятся (и дают качественную аналитику). @sewald

ПроектыRUТехнологии

14,500подписчиков

Открыть канал

Последние посты

  • ElKornacio

    22 сент., 19:20

    👀👀👀P.S. за данные спасибо Этихлид!
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    1,490641Открыть в Telegram
  • ElKornacio

    22 сент., 18:06изменён

    GPT-6 Sol / GPT-6 Lunaа вот и ответочка от OpenAI подъехала.выкатывают постепенно, у кого-то в UI уже отображается. и GPT-6 Sol, и Luna в 2 раза дешевле GPT-5.6 Sol и Luna.в целом, если смотреть на бенчи - рост в качестве довольно спокойный (скажем, на DeepSWE Sol-6 даже чутка уступает Sol-5.6), но вот именно показатель cost per task упал радикально - модели стали сильно эффективнее.ждём, когда вслед за этим ещё сильнее подрежут лимиты 🙂
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    4,3802754221Открыть в Telegram
  • ElKornacio

    22 сент., 17:03изменён

    а между тем, Opus 5.5судя по карточке - бенчи вроде даже повыше Fable 5.1, при этом цена даже ниже предыдущего опуса.а ещё Anthropic теперь тоже отсыпают ресеты 🙂
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    2,87023762Открыть в Telegram
  • ElKornacio

    21 сент., 08:29

    это вам за то, что не молитесь 🙂https://x.com/xanderwow_a/status/2101800791795274106?s=46&t=KhsQE0WFk-djFF2q8zsBPw
    4,290видео571210822Открыть в Telegram
  • ElKornacio

    20 сент., 12:46

    астра - ок сол - топ луна - вполне ок на простых prompt-to-action задачкахтерра - какой-то псиоп, господипрости. как будто эта модель существует, чтобы мы иногда могли понастольгировать и осознать, какой большой путь модели прошли за эти года. я не знаю, что за 0.1b-1bit там под капотом, но я не смог найти вообще никакого процесса, где терра была бы полезна и работала хорошо
    4,500191612332Открыть в Telegram
  • ElKornacio

    18 сент., 12:21изменён

    и ещё, вот вам полезный промпт, запустить в ночь пятницы, чисто на ctrl-c / ctrl-v:проверь все мои TS проекты на предмет: 1. для форматирования и линтинга используется oxfmt/oxlint 2. для билдов используется incremental esbuild 3. для typechecking используется TS7 (tsgo)для всех где не используется - составь детальный и подробный план перехода - проверь, какие зависимости надо обновить, чтобы ts7 завёлся, какие eslint rules / formatter rules надо адаптировать под Ox, и так далее.обязательно сделай тестовые замеры - сколько операции занимают сейчас, и сколько они будут занимать после перехода (evidence-based, сними мертики с временных папок).подготовь в отдельной ветке или worktree (если они юзаются в этом проекте) готовый переход на oxfmt/oxlint/esbuild/ts7, убедись что всё круто работает, и презентуй мне на ревьюпосле чего выгреби весь кеш со всех установленных на моём компе
    5,6601571110665Открыть в Telegram
  • ElKornacio

    18 сент., 12:02

    и ресетом и не пахнет... 😼—на самом деле, это чёт начинает превращаться в серьёзную проблему. начал серьёзно экспериментировать с всякими вариантами экономии, всякими оркестрациями субагентов, да и даже расчехлил давно забытый персональный ключ от openrouter, deepseek flash тестить... 🧐
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    4,6003314321Открыть в Telegram
  • ElKornacio

    17 сент., 14:20

    https://typesafe.ai/довольно интересная игрушка. чуваки отказались от человеко-читаемого текста в ответах в пользу исключительно структурированной информации + сделали по сути generic classifier вместо классической llm (то есть текст оно вам не напишет, как и код, но сверх-быстро принимать решения уровня "в какую категорию это попадает" может).сравнения с LLM в скорости довольно лукавые, но концептуально - очень интересная штука, потому что, по ощущениям, особенно в производственных агентных воркфлоу (а не просто day-to-day usage), 95% задач, которые решает агент - это либо буквально классификации, либо они могут быть сведены к цепочке классификаций. а обучать собственные классифаеры многим (всем) вообще не хочется, и так в воркфлоу появляются какие-нибудь 0.5b-модели с structured output уровня { result: boolean } или { category: ECategoryEnum }в общем, в вейтлист записался, будет
    typesafe.aiHome - TypeSafe AITypeSafe AI is an AI lab building machine-native intelligence infrastructure for automation, designed to make decisions within software. Try our first System One Model, Jev, in early access.
    5,1301594211Открыть в Telegram
  • ElKornacio

    16 сент., 08:10

    переслано из @neuralshit

    Мне нравится, что он 3 источника как минимум приложил
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    4,78019015432Открыть в Telegram
  • ElKornacio

    15 сент., 17:25изменён

    господа, крик души / запрос во вселеннуюхочу забыть про дроч с Шенгеном на 3+ года, за < $10k хз как, какой-нибудь волшебный номад в low-tier стране или юрлицо в ЕС открыть и себя туда устроить, или поступить на языковые курсы в noname университет, или какой-нибудь лайфхак уровня "Франция даёт визы на 10 лет в афганском посольстве между 4 и 6 часами утра по средам", или какие ещё там в принципе существуют визовые программы и фокусы. если знаете проверенные темки - буду признателен за рекомендацию.P.S. гражданин РФ, резидент Сербии, белый доход подходящий под все номадные программы есть P.P.S. ах да - жить при этом в ЕС на постоянке не хочу
    5,620262215113Открыть в Telegram
  • ElKornacio

    11 сент., 08:46

    в общем, окончательно откатился с gpt-6 на 5.6 во всех флоу. удивительное комбо overpromise-underdelivery. computer use сильно прокачался, в остальном - ппц. и вот беспрерывно подгонять его задолбало ужасно. если 5.6 делает лишнее в 2 случаях из 10, то 6 не делает нужного в 5 случаях из 10, крайне неудобно.ещё и новые 200-баксовые подписки не дают из-за этого, уф.
    7,71044207421Открыть в Telegram
  • ElKornacio

    10 сент., 19:30

    https://www.anthropic.com/threat-intelligence-report-september-2026интересная статья, в которой антропики довольно открыто описывают, как они без решений суда, следствий и прочей юридической волокиты копаются в переписках разных групп людей под эгидой борьбы с киберпреступностьюгде описаны как вполне очевидно преступные сценарии, так и выглядящие довольно нейтральными (типа zero-day discovery loop)лично у меня вызывает крайне отторгающее ощущение, что некоторая "Threat Intelligence team" внутри антропика читает и изучает все переписки, какие хочет 😕
    AnthropicCountering misuse of AI: September 2026 / AnthropicCase studies from threat actors disrupted between December 2025 and August 2026 across seven areas of harm, from cyber operations to biological misuse.
    7,88017127541Открыть в Telegram
  • ElKornacio

    10 сент., 19:02

    https://x.com/humansand/status/2098115046438215791сегодня Humans& релизнули модель, которая реалистично симулирует поведение настоящих людей - как они общаются и взаимодействуют 🙂наконец можно генерить тексты, от которых не веет нейрослопом на самом деле, это очень круто - если оно может генерить behavioral patterns, которые хотя бы отдалённо близки к распределениям и статистикам реальных людей - то это прямая дорога к симуляциям реакций людей на что-то, в огромных масштабах, без, собственно, участия людейсделать 1000 вариантов лендинга и заранее прогнать симуляцию, чтобы предсказать, какая конвертит лучше или вообще юзать это как скоринг-модель для RL или генетических алгоритмов (по сути, fitness-функция, которая умеет оценить, насколько какая-то вещь "человечна").в общем, оч интересно 👀
    X (formerly Twitter)humans& (@humansand) on XFor AI to work with us, it needs to understand us Today, we're introducing Persimmon, the first large-scale model designed to realistically simulate how people talk and interact
    10,90014941Открыть в Telegram
  • ElKornacio

    10 сент., 16:10

    господа, запрос во вселеннуюхочу найти какую-нибудь подписку с умеренной ценой (типа ~$50), и почти бесконечным запасом токенов на условно тупых моделях не прям тупых-тупых, а что-то типа luna/terra чисто под песочницу для каких-нибудь безумных игр в формате /goal и работы 24-7швырять туда какие-нибудь самые отлетевшие идеи и задачи на тест, и чтобы не сильно дорогая модель сутками их тарабанила до бесконечности.знаете что-нибудь такое? мне кажется, тот же openai за $200 вполне потянул бы luna на 24/7 держать, но $200 чутка жалко, хочется подешевле
  • ElKornacio

    9 сент., 10:48изменён

    почему Сэм Альтман не сможет вылечить себе рак?по следам прошлого поста складывается ощущение что "можно швырнуть много миллионов долларов в компьют, поднять 100000 агентов и они решат любую задачу" или "AGI сводит решение любых задач к вопросу доступности компьюта и цены".я вот лежал-размышлял на тему "если завтра у Сэма Альтмана обнаружат рак - сможет ли он поднять 100.000 агентов чтобы они за неделю нашли лекарство?", и простой ответ - нет. представьте, что вы ищете ответ на какой-то вопрос про реальность, к примеру "какая комбинация молекул в пробирке вылечит рак такого типа". и вот есть спектр, где с одной стороны:- полное отсутствие интеллекта aka полный перебор всех существующих вариантов классические "бесконечные мартышки перебирающие кнопки в попытке написать Войну и Мир". отсутствие оптимизации перебора вообще.а с другой:- абсолютный интеллект aka сразу выбор
    6,580521910432Открыть в Telegram
  • ElKornacio

    8 сент., 23:44

    оч интересная история: https://t.me/airamongush/186
    TelegramАйра Монгуш — AI, tech & mathВ математике и AI сейчас происходит невероятный поворот. (Правда, думаю до сингулярности еще несколько менее доступных проблем тысячелетия остались). Сорри за англ.цитаты, их много. Примерно 12 месяцев два математика, Tristan Buckmaster, профессор математики…
    6,4801431Открыть в Telegram
  • ElKornacio

    7 сент., 15:49

    шо, ребята, permanent underclass is coming for us?
    7,440554215954Открыть в Telegram
  • ElKornacio

    3 сент., 18:35изменён

    шо, ребята, permanent underclass is coming for us?
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    8,95034181053Открыть в Telegram
  • ElKornacio

    3 сент., 16:58

    👀
    Иллюстрация к посту канала ElKornacioИллюстрация к посту канала ElKornacio
    8,8702413842Открыть в Telegram
  • ElKornacio

    25 авг., 18:14изменён

    а у вас было такое, что агенты упарываются и творят херню? 🙂(нет, это не начало моего нового стендапа) короче, иногда, выбрав определённое направление решения задачи (особенно в исследованиях и экспериментах) агент закапывается очень глубоко, и ему не хватает какой-то рефлексии типа "ох, чета мы кажется уже упоролись и делаем дичь. вернусь на пару шагов назад и подумаю, нет ли здесь другого решения".скажем, у меня пару дней назад агент тестил десктопное приложение, эмуляцией кликов мыши (по CDP). и стал жаловаться, мол, кнопка не кликается - click-евент не ловится. он полчаса копался в драйвере CDP, решил что это баг драйвера, и стал переписывать всё моё приложение, чтобы кнопки умели реагировать не только на click, но и на pointerup. поймал упыря за руку в последний момент. сказал "дурень, дичь не неси, CDP перепроверь" - и вот чудо, оказывается он
    12,50013631121222Открыть в Telegram