gram news
Machinelearning channel avatar

Machinelearning

@ai_machinelearning_big_data

Погружаемся в машинное обучение и Data Science Показываем как запускать любые LLm на пальцах. По всем вопросам - @haarrp @itchannels_telegram -🔥best channels Реестр РКН: clck.ru/3Fmqri

ProjectsRUAI

282,000subscribers

Open the Channel

Latest posts

  • Machinelearning

    23 Sept, 20:43edited

    🧬 Claude обнаружил ранее неописанную ферментную систему с повторами ДНК, напоминающими CRISPR, сообщает Anthropic.Около 950 агентов работали 21 час и использовали 210 млн токенов. Они исследовали более 200 тысяч обратных транскриптаз - ферментов, копирующих РНК в ДНК, - выделили 3500 потенциальных систем и отобрали 20 наиболее интересных.Один агент заметил необычные повторяющиеся последовательности рядом с геном фермента.Находку назвали ART - array-associated reverse transcriptases. Она встречается преимущественно у бактериофагов - вирусов, заражающих бактерии.Сам фермент был известен ранее. Claude выявил связанные с ним повторы и дополнительный белок, которые вместе образуют отдельную систему. Учёные провели первые лабораторные эксперименты: оказалось, что из массива повторов образуются разные короткие РНК.Функция ART пока неизвестна, а возможность использовать её для редактирования генома ещё предстоит исследовать.Поиск и анализ выполняли агенты, лабораторную работу - люди. Результаты опубликованы в препринте.https://www.anthropic.com/news/claude-discovers-novel-enzyme-system@ai_machinelearning_big_data#claude #anthropic
    6,450video801917111Open in Telegram
  • Machinelearning

    23 Sept, 18:15

    🌟 Limite 1B Violetto: специализированная математическая модельСтартап Paradigma опубликовал свою первую модель, Limite Violetto на 1 млрд параметров с контекстом до 131 тысячи токенов, рассчитанную только на решение математических задач.Violetto разработана с максимально упрощенной настройкой инструкций, чтобы опровергнуть предположение о необходимости внедрения моделей в вспомогательный интерфейс для их эффективной работы. Поэтому она отвечает в один ход (задача на входе, решение на выходе) и ведёт себя не как чат-бот.На вопросы вне математики модель часто переосмысляет их как математическую задачу.Например, на просьбу простыми словами объяснить фотосинтез она начала рассуждать о том, как клетка делится на две, а те снова делятся.Вторая модель, Limite Value Model решения оценивает. Она получает задачу и предложенное решение и для каждого токена ответа выдаёт оценку того, насколько рассуждение до этой точки ведёт к верному ответу.С ней можно ранжировать несколько кандидатов или использовать модель в обучении с подкреплением.Авторы предупреждают, что это регрессионные оценки и доказательства модель не проверяет. На полном контексте ей хватает 7,5 Гб видеопамяти.🟡ТестыЧасть цифр конкурентов Paradigma взяла из их карточек или с MathArena.На AIME 2026 Violetto набрала 94,01%. Такой же результат показывают Nemotron 3 Super, Qwen3.5 9B и VibeThinker 3B.На BeyondAIME у Violetto 74,25% против 70% у MUSE-Glimmer-30B.Запустить модель пока можно только через плагин Paradigma для vLLM 0.26.0 на Linux с видеокартой NVIDIA и драйвером с поддержкой CUDA 13.0. Поддержку Transformers обещают позже.📌Лицензирование: Apache 2.0🟡Блогпост 🟡Веса 🖥Github@ai_machinelearning_big_data#AI #ML #SLM #Violetto #Paradigma
    Image from a post by MachinelearningImage from a post by Machinelearning
    10,200271333Open in Telegram
  • Machinelearning

    23 Sept, 17:03

    🔝 Прокачайтесь на GoCloud Tech 202615 октября Cloud․ru снова собирает ИТ-специалистов, чтобы вместе обсудить, как строить платформы и сервисы в эпоху ИИ. В программе — хардовые доклады про инфру, разработку, данные и ML, технозоны, воркшопы, карьерная лаборатория и много нетворкинга.📍 Где и когда: Встречаемся 15 октября офлайн в Москве или на онлайн-трансляции.Успейте зарегистрироваться
    10,800video1165222Open in Telegram
  • Machinelearning

    23 Sept, 14:38

    ✔️ OpenAI расширила Academy до 14 курсовOpenAI добавила в свою образовательную платформу курсы для разработчиков, руководителей, преподавателей и студентов вузов.Вместе с уже существовавшим направлением Apply AI at Work каталог теперь разделён на четыре трека по ролям, всего 14 курсов.Каждый курс заканчивается экзаменом из 10–20 вопросов, которые случайно выбираются из банка в 50 заданий.Кто наберёт минимум 80%, получает ачивку OpenAI Academy, которую выдаёт и хранит платформа Accredible. За все курсы и экзамены трека, где это предусмотрено, выдают сертификат об окончании.Ни цифровая ачивка, ни сертификат не считаются профессиональной сертификацией.При провале экзамен можно пересдать с новым набором вопросов, а сам курс можно просто пройти без сдачи экзамена.🟢Apply AI at Work из трёх курсов учит ставить ChatGPT задачу, давать контекст, проверять ответы и превращать удачные приёмы в повторяемые процессы. Затем слушатели поручают работу агентам и расставляют контрольные точки для проверки человеком.🟢Build with AI – самый большой трек, восемь курсов: работа с Codex на всём цикле разработки и продукты на OpenAI API, от проектирования решения и оценки качества до агентов, поиска нужной информации и эксплуатации в продакшене.🟢Lead AI Adoption пока состоит из одного курса AI Leadership. Слушатели привязывают ИИ-инициативу к приоритетам бизнеса, распределяют ответственность, задают правила и собирают первую версию стратегии и дорожной карты внедрения.🟠AI for Educators учит планировать занятия и составлять задания и контрольные.🟠AI for College Students учит собирать учебный план, распределять роли в групповом проекте и готовиться к собеседованиям.Для компаний есть руководство по внедрению курсов - как представить их сотрудникам, вовлечь руководителей и отслеживать прогресс.@ai_machinelearning_big_data#news #ai #ml
    Image from a post by MachinelearningImage from a post by Machinelearning
    13,300191041Open in Telegram
  • Machinelearning

    23 Sept, 13:31

    Рынок ИИ смещается от отдельных ML-инструментов к horizontal AI — универсальным агентам, которые могут выполнять цепочки задач в разработке, аналитике, маркетинге и других функциях. Об этом в интервью «Ведомостям» рассказал руководитель Yandex Cloud Григорий Атрепьев.⚙️ Ключевой фактор масштабирования таких сценариев — стоимость инференса. За год серверное оборудование подорожало в 2–5 раз, но оптимизация моделей и инфраструктуры продолжила снижать стоимость их использования. В Yandex AI Studio средняя выручка на один и тот же объём токенов за год снизилась примерно в 6 раз. Для отдельных Flash-моделей разница со сравнимыми решениями годичной давности достигает 14 раз. Например, 5000 токенов в Alice AI LLM Flash обходятся примерно в 0,425 руб. против 6 руб. в YandexGPT 5 Pro.📈 Более дешёвый инференс позволяет прогонять через модели больше операций при том же бюджете. Это уже отражается на объёме потребления: за первые 8 месяцев 2026 года коммерческое использование Yandex AI Studio превысило 1,1 трлн токенов — примерно в 400–500 раз больше, чем за аналогичный период 2024 года. При этом средняя выручка на тот же объём токенов за год сократилась примерно в 6 раз.🌐 Параллельно меняется модельный стек. В Yandex AI Studio растёт использование китайских моделей, но в первом полугодии 2026 года 54% токенов приходилось на собственные модели «Яндекса». Компания продолжает обучать модели с нуля на собственных архитектурах и весах и недавно открыла исходники двух моделей — Alice AI Search Pretrain и Alice AI LLM Foundation. Подробнее о стоимости инференса, горизонтальных агентах, модельном стеке и развитии корпоративного ИИ — в интервью «Ведомостям».
    Image from a post by MachinelearningImage from a post by Machinelearning
    13,500322411511Open in Telegram
  • Machinelearning

    23 Sept, 12:34

    📱 Qwen представила Qwen Intelligence - набор ИИ-агентов для смартфонов.В основе три агента:Mobile Planner Agent - разбивает сложные задачи на шаги и координирует выполнение. Mobile-Use Agent - выполняет действия в приложениях через API, а при необходимости переключается на GUI. На MobileWorld — 82.1%, на MobileWorld-Real — 92.2%. Mobile Creative Agent — превращает короткий запрос в готовый визуальный контент; заявленная генерация изображения - около 3 секунд.Qwen также открывает набор мобильных бенчмарков: MobilePA-Bench, MobileWorld, MobileWorld-Real и MobileWorld-Safety — для проверки планирования, работы между приложениями, реальных устройств и безопасности.Один агент планирует, второй действует, третий создаёт контент - прямо на смартфоне.🔗 Learn more about the agents: - Qwen Intelligence official website: https://qwenintelligence.com - Mobile Planner Agent: https://github.com/Tongyi-MAI/Qwen-Planner-Agent - Mobile-Use Agent: https://tongyi-mai.github.io/Qwen-UI-Agent/ - Mobile Creative Agent: https://arxiv.org/abs/2608.16887🔗 Explore our open benchmark suite: - MobilePA-Bench: https://tongyi-mai.github.io/MobilePA-Bench/ - MobileWorld (GitHub): https://github.com/Tongyi-MAI/MobileWorld - Leaderboard: https://tongyi-mai.github.io/MobileWorld/#leaderboard@ai_machinelearning_big_data#qwen #mobile
    Image from a post by MachinelearningImage from a post by MachinelearningImage from a post by MachinelearningImage from a post by Machinelearning
    14,5006930132Open in Telegram
  • Machinelearning

    23 Sept, 10:10

    ✔️ OpenAI начала работать с независимым советом математиковКомпания будет советоваться с консультативной группой по математике и ИИ, которую сами математики создали при Институте перспективных исследований.Поводом послужила новая модель - по словам OpenAI, она решила задачу тысячелетия об уравнениях Навье–Стокса и больше сотни давних открытых проблем. Вторая причина – открытое письмо математиков, которые критикуют решение открытых проблем как способ мерить ИИ.Среди девяти участников группы – лауреаты Филдсовской премии Тимоти Гауэрс, Мартин Хайрер и Эдвард Виттен. Совет поможет оценивать значимость результатов модели, решать, как их публиковать, и следить за академическими стандартами.Участники не получают денег от OpenAI, сами меняют состав и могут публично критиковать компанию. openai.com✔️ Tencent выпустила Hy Image 3.5 PreviewКоманда Hunyuan выпустила предварительную версию Hy Image 3.5 для профессиональной графики. Модель генерирует изображения по тексту и по референсам (до пяти за раз), редактирует их в несколько раундов с сохранением контекста и точнее рендерит мелкие шрифты и вёрстку. Разрешение – до 2K.В слепом сравнении, которое провели дизайнеры самой Tencent, модель сравнялась с Seedream 5.0 Pro и немного обошла Nano Banana Pro и Qwen-Image-3.0 Pro.Модель уже встроена в продукты Tencent и доступна в Tencent Cloud API, где 2K-изображение стоит 0,15 юаня. hy.tencent.com✔️ Hugging Face наняла создателя oMLXХостинг-провайдер взял в штат Джуна Кима, автора oMLX – локального сервера инференса для Mac на Apple Silicon. Через его API с моделями на компьютере работают Cursor, Claude Code и OpenClaw. Теперь Ким занимается проектом на полную ставку.oMLX остаётся в прежнем репозитории под Apache 2.0 и руководит им по-прежнему Ким. Hugging Face будет обкатывать на нём новые идеи для MLX, удачные наработки передавать в mlx-lm и mlx-vlm и быстрее переносить модели из Transformers на MLX. huggingface.co✔️ Horowitz Andreessen открывает академию для молодых разработчиковВенчурный фонд запускает Horowitz Andreessen Academy – школу в Сан-Франциско для выпускников старших классов и студентов первых курсов, которые делают ИИ-продукты. Академия – отдельная коммерческая компания, она привлекла 42 млн долларов от a16z и частных инвесторов, из них 35 млн вложил сам фонд.Каждый студент получит вычислительные кредиты на 50 тысяч долларов. Среди преподавателей – Сэм Альтман и основатель Figma Дилан Филд. Партнёры-основатели – Anduril, Anthropic, Coinbase, Google, Nvidia, OpenAI, Palantir, Replit и Stripe, которые рассчитывают нанимать выпускников академии.Первый набор, около 50 человек, стартует осенью 2027 года, для них первый год учёбы будет бесплатным. С 2028 года академия планирует двухлетнюю программу с оплатой на уровне элитного частного вуза. Аккредитации пока нет, диплома академия не выдаёт. wsj.com✔️ В ElevenLabs Studio добавили ассистента для сборки видеоElevenLabs выпустила видеоредактор Studio 4.0 со встроенным ИИ-монтажером и сквозной генерацией медиа. Движок переписан для стабильного скраббинга в тяжелых многослойных проектах.
    13,600video44143211Open in Telegram
  • Machinelearning

    23 Sept, 09:03

    Многие компании уже запускают ИИ-проекты, но далеко не все доводят их до результата. Для этого нужен руководитель, который понимает и бизнес, и разработкуВзять на себя такую роль может менеджер проектов, IT-специалист, аналитик или исследователь. Нужно только разобраться, как устроены ИИ-проекты изнутри. Этому учат на курсе «Руководитель проектов в области ИИ» от МФТИ и Нетологии.Что внутри: 🎓 106 акад. часов от МФТИ: жизненный цикл ИИ-систем, машинное обучение, методики снижения рисков; ⚙️ 36 акад. часов практики от Нетологии: командный MVP-проект и прототипы на LLM в Langflow без кода; 👥 вебинары с экспертами, ответы на сложные вопросы и полностью дистанционное обучение, чтобы было легче совмещать с работой.В итоге у вас будет документ от МФТИ и Нетологии и проект, который можно показать руководству. 💳 Есть рассрочка, оплата за счёт работодателя и налоговый вычет. А до 30 сентября действует скидка 10 000 рублей по промокоду AIMFTI.Записаться на курсРеклама. ООО "Нетология" ОГРН 1207700135884 Erid: 2VSb5ybG7Cv
    Image from a post by MachinelearningImage from a post by Machinelearning
    14,7003076552Open in Telegram
  • Machinelearning

    22 Sept, 18:16edited

    ⚡️OpenAI выпустила GPT-6 Sol и GPT-6 LunaСемейство GPT-6 расширилось сразу двумя новыми моделями — Sol и Luna.Обе построены на наработках GPT-6 Astra, но рассчитаны на более быстрые и дешёвые сценарии работы в масштабе.Главное:- GPT-6 Sol — более мощная рабочая модель для сложных задач. - GPT-6 Luna — более быстрая и экономичная версия для массовых запросов и автоматизаций. - OpenAI отдельно оптимизировала кэширование и inference. - API для Sol и Luna стал на 50% дешевле по сравнению с промо-ценами GPT-5.6. - На AutomationBench новые модели заметно улучшают соотношение качество / стоимость относительно GPT-5.6.Теперь линейка выглядит так:GPT-6 Astra — максимум возможностей GPT-6 Sol — сильная модель для серьёзной повседневной работы GPT-6 Luna — скорость, масштаб и низкая стоимость
    Image from a post by MachinelearningImage from a post by Machinelearning
    9,6606332982Open in Telegram
  • Machinelearning

    22 Sept, 16:33

    🚀 Anthropic представила Claude Opus 5.5Новая флагманская модель стала сильнее Opus 5, при этом работает быстрее и дешевле.Что изменилось:- сильнее в агентном программировании, computer use и knowledge work - лучше справляется с длинными задачами и большими кодовыми базами - ответы стали короче и естественнее - улучшена устойчивость к prompt injection - Anthropic заявляет примерно на 40% более низкую стоимость на типичных задачах и более чем на 30% более быструю генерациюИз примеров: - один из ранних тестеров провёл миграцию 680 000 строк кода менее чем за день - в тесте Anthropic модель переписала HAProxy с C на Rust за 9,5 часаЦена API: - $4 / 1M входных токенов - $20 / 1M выходных токенов - $0,20 / 1M токенов при чтении кеша
    Image from a post by MachinelearningImage from a post by Machinelearning
    15,7006828181474Open in Telegram
  • Machinelearning

    22 Sept, 15:36

    🌟 Samsone: открытые аудиоязыковые модели для смартфоновSamsung опубликовали Samsone - семейство из трёх небольших аудиоязыковых моделей для работы на мобильных устройствах: Samsone-99M, Samsone-134M и Samsone-356M.Проект будет участвовать в конференции Interspeech 2026, которая пройдет с 27 сентября по 1 октября в Сиднее.Модели принимают один или несколько аудиофрагментов вместе с текстовым запросом и отвечают текстом: описывают звук, отвечают на вопросы о записи, сравнивают клипы между собой.Заявлено понимание речи, музыки и звуки окружения. Отвечают модели только по-английски и строчными буквами - ради экономии параметров оставили в обучающих текстах только строчные символы ASCII и вычистили из словаря редкие токены.Авторы предупреждают, что после дообучения на аудиовопросах модели теряют общие языковые навыки, так что это точечный
    Image from a post by MachinelearningImage from a post by MachinelearningImage from a post by Machinelearning
    12,500301610774Open in Telegram
  • Machinelearning

    22 Sept, 14:24edited

    🙂 Яндекс открыл LLM, обученную с нуля: модель обгоняет решение NVIDIA в кодеAlice AI Foundation LLM обучена на данных Яндекса без инициализации чужими открытыми весами. Претрейн распространяется под лицензией Apache 2.0, что позволяет использовать решение в коммерческих и исследовательских целях, дообучая под свои задачи.Модель — экспериментальная ступень на пути к единой рассуждающей модели (ЕРМ): на ней Яндекс проверяет архитектурные решения, а сама ЕРМ станет основой агентных возможностей Алисы AI.🟡 АрхитектураМодель построена на MoE: из 80 млрд параметров в моменте активны только 3 млрд. Она уже прошла основной этап обучения, поэтому её можно использовать как основу для собственных проектов.🟡 КачествоПо данным тестов:🟢 в написании кода
    Image from a post by MachinelearningImage from a post by Machinelearning
    11,6001151116126168Open in Telegram
  • Machinelearning

    22 Sept, 12:05

    ✔️ США предложили Китаю горячую линию для инцидентов с ИИМинистр финансов США обсудил с вице-премьером Китая создание диалога по ИИ и механизма взаимного оповещения. Стороны будут предупреждать друг друга об инцидентах с ИИ, которые угрожают национальной безопасности.Что именно считать таким инцидентом, пока не ясно. Агентство Синьхуа подтвердило, что вопросы ИИ обсуждались, но не сообщило, принял ли Пекин предложение. Тему дополнительно разовьют президент США и Председатель КНР на саммите в Вашингтоне на этой неделе. apnews.com✔️ Anthropic, OpenAI, Google и SpaceXAI обвинили в картельном сговореПодписчики ИИ-сервисов подали коллективный иск против четырёх компаний в федеральный суд Калифорнии. Поводом стало эссе гендиректора Anthropic Дарио Амодеи с призывом ограничить темпы неконтролируемого развития ИИ. Идею
    12,200video27121054Open in Telegram
  • Machinelearning

    22 Sept, 11:01

    Почему одни ИИ-агенты помогают разработчикам экономить время, а другие требуют постоянной доработки? При создании агентных систем важно не только подключить LLM, но и правильно организовать логику работы агентов.На открытом уроке 1 октября в 20:00 МСК разберем, как навыки агента (agent skills) помогают ускорить создание ИИ-агентов, стандартизировать их логику и повторно использовать готовые решения. Вы узнаете, какие ИИ-инструменты помогают разработчикам быстрее собирать агентные системы и как применять эти подходы на практике.Урок пройдет в преддверие старта курса «Разработка ИИ-агентов». Занятие подойдет разработчикам, ИИ-инженерам и техническим специалистам, которые создают агентные решения и хотят повысить скорость и качество разработки.Научитесь создавать более предсказуемые ИИ-агенты и тратить меньше времени на рутинную реализацию: https://otus.pw/mJsM/?erid=2W5zFJZtwNHРекл
    Image from a post by MachinelearningImage from a post by Machinelearning
    13,40027136644Open in Telegram
  • Machinelearning

    22 Sept, 09:20

    🌟 Jina AI улучшила DeepSeek-OCRjina-ocr-v1 - 3B модель для разбора документов на английском и китайском языках, рассчитанная под локальный запуск на недорогих системах.Модель принимает скан, фотографию или PDF и на выходе выдаёт Markdown с поддержкой LaTeX.Кроме полной транскрипции она распознаёт отдельные таблицы и формулы, подписывает изображения, отвечает на вопросы по документу и извлекает ключевые поля.🟡АрхитектураDeepSeek-OCR с визуальным энкодером DeepEncoder на 380 млн параметров, который сжимает страницу до 256 визуальных токенов и при необходимости добавляет до девяти фрагментов по 100 токенов. Декодер - смесь экспертов на 3 млрд общих и 570 млн активных параметров.Вклад Jina - спекулятивное декодирование FastMTP, где один общий блок предлагает три токена вперёд, а декодер принимает самую длинную
    Image from a post by MachinelearningImage from a post by MachinelearningImage from a post by MachinelearningImage from a post by Machinelearning
    14,1007514944Open in Telegram
  • Machinelearning

    22 Sept, 09:05edited

    🚨 Alibaba представила один из самых агрессивных планов развития ИИГлавное:• Qwen 4 уже обучается • Qwen 4.5 и Qwen 5 планируют масштабировать до 5–10 трлн параметров • Qwen исследует рекурсивное самоулучшение: модели находят слабости, проектируют эксперименты и создают данные для следующего обучения • M890 уже запускает модели крупнее 2 трлн параметров • кластеры на новых V900 смогут объединять до 500 000 ускорителей • мощность глобальных дата-центров Alibaba Cloud должна превысить 20 ГВт к 2032 годуЗапуск массового производства V900 перенесли с III квартала на I квартал 2027 года. По словам главы Alibaba Эдди Ву, в будущем объём машинного «мышления» может превысить человеческий в 1000 раз.https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/
    Image from a post by MachinelearningImage from a post by Machinelearning
    13,40092591412107Open in Telegram
  • Machinelearning

    22 Sept, 08:04

    Один вечер — много возможностей! ⚡️25 сентября у тебя будет шанс познакомиться сразу с четырьмя технологическими командами, которые строят GigaChat изнутри: от данных и поиска до платформы AI-агентов и backend-сервисов массового продукта.Ты сможешь заглянуть в текущие проекты Сбера, понетворкать, а еще — обменяться контактами с лидерами ключевых backend-команд GigaChatРегистрируйся по ссылке — встречаемся 25 сентября в 19:00 по адресу: Москва, «Оригинал», Земляной Вал, 9А!
    Image from a post by MachinelearningImage from a post by Machinelearning
    13,900301911653Open in Telegram
  • Machinelearning

    22 Sept, 07:14

    🌟 Xiaomi выпустила MiMo-V2.6 Pro и FlashXiaomi закончила обучение серии MiMo-V2.6 и опубликовала веса флагманской Pro и облегчённой Flash.Обе модели омнимодальные, то есть принимают текст, изображения, видео и аудио.Рассчитаны на агентные задачи, кодинг, автоматизацию рабочих процессов, управление компьютером, кибербезопасность, генерацию 3D-объектов, воплощенное моделирование, создание музыки, научные и математические исследования.🟡АрхитектураУ Pro 1,02 трлн параметров, из них 42 млрд активных, и 384 эксперта.У Flash 309 млрд параметров, 15 млрд активных и 256 экспертов.На каждый токен в обеих моделях работают восемь экспертов. Большая часть слоёв использует внимание со скользящим окном в 128 токенов, остальные – глобальное внимание: у Pro так устроены 60 слоёв из 70, у Flash 39 из 48.Визуальный энкодер
    Image from a post by MachinelearningImage from a post by Machinelearning
    15,50040351514139Open in Telegram
  • Machinelearning

    21 Sept, 16:04

    💊 Больше ИИ в больницах - ниже смертность?На графике медицинские учреждения с более активным использованием ИИ показывают меньшую смертность. Но здесь важно не путать корреляцию с причинностью.Возможно, дело не только в технологиях. Лучше финансируемые клиники обычно имеют больше сотрудников, современное оборудование и одновременно чаще внедряют ИИ. На результат также могут влиять диагнозы, возраст и тяжесть состояния пациентов.Чтобы говорить о реальном эффекте ИИ, исследование должно учитывать все эти различия.Врачи тратят огромное количество времени на документацию и бюрократию. ИИ-агенты могут заполнять документы, структурировать историю болезни, готовить выписки и проверять данные.Возможно, первая медицинская революция ИИ произойдёт в освобождении врачей от рутины.https://x.com/Hedgeye/status/2101658383971762407
    Image from a post by MachinelearningImage from a post by Machinelearning
    18,1006035181133Open in Telegram
  • Machinelearning

    21 Sept, 05:55

    ⚡️ StepFun анонсировала флагманскую модель Step 5 PreviewМодель построена на архитектуре MoE и спроектирована как инструмент для длительных агентских задач, разработки ПО и сложной аналитики.На борту 600 млрд параметров (активных 27 млрд), контекстное окно 1 миллион токенов и поддержка мультимодальности.StepFun заверяет, что модель способна непрерывно выполнять автономные задачи на протяжении 24 часов, используя обратную связь для итераций и может выполнять весь спектр кодинг-задач - от создания веб-приложений до оптимизации GPU-ядер и работы с аппаратным обеспечением.Помимо кодинга, модель компетентна в финансовом и корпоративном анализе, где критически важна верификация фактов и формул: Step 5 умеет агрегировать массивы данных из сотен сетевых источников и формировать детализированные отчеты со строгой структурой.Модель уже можно
    Image from a post by MachinelearningImage from a post by Machinelearning
    19,100524115311Open in Telegram