Latest posts

местный датасасер
21 Sept, 19:23
forwarded from @senior_augur
Долго думал стоит ли, но всё-таки напишу пост насчёт Jev. Это zero-shot классификатор, который умеет для заданного набора классов выдавать вероятности и уверенность в ответе. Умеет сразу в несколько параллельных вопросов.Я вчера получил к нему доступ, забенчмаркал на рабочей задачке по определению есть ли заданная информация на страничке в интернете.По качеству Gemini 3.5 Flash Lite < Jev ≈ GLM 5.3 Flash no effort < GLM 5.3 Flash low effort. GLM 5.3 Flash брал у Baseten.По цене Jev в 3 раза дешевле GLM 5.3 Flash: 25 центов за 1000 страничек vs 75 центов.По скорости в 4 раза быстрее GLM 5.3 Flash: 300ms p50 vs 1200ms p50, 400ms p90 vs 3000ms p90.Длина контекста у Jev 32к vs 1M+ у GLM 5.3 Flash.Хорошая модель, короче, но не прям уж отрыв от GLM 5.3 Flash (который так-то и текст генерировать умеет). Но что важно, на коротких контекстах скорость <200ms, то есть практически
местный датасасер
17 Sept, 07:56
forwarded from @vcnews
Apple разрабатывает серверы для ИИ на базе ещё не выпущенных процессоров M8 Ultra и обсуждает с Nvidia использование её технологий, узнало The Information.Выпустить оборудование на рынок планируют не раньше 2029 года, но от проекта могут и отказаться, говорят источники изданияvc.ru/apple/3143410
местный датасасер
5 Sept, 09:25
forwarded from @vcnews
OpenAI открыла доступ к GPT-6 Astra пользователям всех платных тарифов, кроме Go.Ей можно воспользоваться в Codex и ChatGPT Work, а также в APIvc.ru/chatgpt/3122065
местный датасасер
13 Aug, 23:43
forwarded from @ai_newz
Вышла Gemini 3.7 FlashПо бенчам Flash выросла выше Sonnet 5. На модель временно скинули цену, на этот раз в два раза, до $0.75/$3.75. Такая цена будет актуальна до конца 2026, после чего её опять поднимут. Использование токенов снова выросло, на тестах Artificial Analysis у модели уходит на 50% больше токенов.@ai_newz


местный датасасер
30 Jul, 18:22



местный датасасер
24 Jul, 17:13
forwarded from @seeallochnaya
Вышел Opus 5, уже доступен в Claude Code и на сайте. Модель во многом... лучше Fable 5 😎 Даже на Frontier-Bench, про который я писал сегодня — уже +9%.В общем выглядит как новая рабочая лошадка, постараюсь погонять в ближайший месяц и в хвост и в гриву.Цена та же, Fast-режим тоже есть.Карточка модели


местный датасасер
22 Jul, 15:14
forwarded from @seeallochnaya
Два дня назад я писал, что часть инфраструктуры HuggingFace подверглась атаке и была частично взломана ИИ-агентом. Только что OpenAI признались, что... это была их модель, GPT-5.6-Sol и другая более сильная неназванная LLM.Их тестировали на ExploitGym (бенчмарк по кибербезопасности), и модель сначала смогла найти новый, до этого неизвестный эксплойт в инфраструктуре OpenAI (это не было её задачей, её не натравили «поискать баги чтоб мы пофиксили»), оттуда раскрутиться на получение полноценного доступа в интернет (который по умолчанию обрезан в тестовой среде), а затем залезть на HuggingFace искать ответы для бенчмарка. После этого она нашла уязвимость и там, получила доступ к коду авторизации некоторых сервисов и продолжила искать ответы.Этот инцидент без преуменьшения беспрецедентный, и я пока не могу представить, что должно произойти, чтобы политики, NSA, DOD и Китай не обратили


местный датасасер
15 Jul, 20:09
https://youtu.be/m8uUUUsMD3Y?si=Mo2u4m6uDxCYDBLmYouTubeIntroducing the Codex MicroSee how the Codex Micro, a customizable keyboard built with Work Louder for Codex, helps you move through a build without leaving your flow. In this demo, GPT-5.6 Sol creates a word game while the Micro handles voice dictation, task switching, reasoning controls…
местный датасасер
14 Jul, 13:29
forwarded from @alwebbci
New from Google: LLMs Need Sleep and Dreaming.Researchers introduced a phase, where the model consolidates its fragile short-term memories into stable long-term memories, and then dreams to recursively self-improve over time.For memory consolidation, researchers introduced a new form of distillation, called Knowledge Seeding (KS), where a small model(s) distills its knowledge to a larger model.Experiments on continual learning and reasoning tasks show that this new phase can help the model to perform better and relatively better mitigates catastrophic forgetting.arXiv.orgLanguage Models Need Sleep: Learning to Self-Modify and...The past few decades have witnessed significant advances in the design of machine learning algorithms, from early studies on task-specific shallow models to more general deep Large Language Models...
местный датасасер
7 Jul, 08:21
forwarded from @data_secrets
Anthropic нашли внутри Claude внутреннее пространство, где хранятся его мыслиСтартап выпустил одну из самых интересных работ по интерпретируемости за последнее время. Они обнаружили, что в LLM есть отдельный небольшой внутренний набор нейронных активаций, который используется как рабочая память для сложного мышления: так называемый J-space.Мы часто представляем LLM как огромную мешанину чисел, где знания и рассуждения размазаны по миллиардам параметров. Но похоже, что это не совсем так.Любопытно, что человеческий мозг работает похожим образом. Есть когнитивная теория, утверждающая, что он состоит из множества специализированных подсистем, которые работают независимо; но иногда какая-то информация попадает в небольшой общий workspace, становится доступной сразу многим областям мозга и может использоваться для рассуждений и принятия решений. И вот именно такой механизм исследователи


местный датасасер
1 Jul, 08:39
forwarded from @vcnews
Anthropic восстановит доступ к Fable 5 для пользователей по всему миру c июля 2026 года. Минторг США снял запрет на доступ к модели для иностранных граждан.Ограничения действовали с 12 июня 2025 годаvc.ru/ai/3005331


местный датасасер
30 Jun, 18:57
forwarded from @ai_newz
Вышел Claude Sonnet 5По перформансу ближе к Opus 4.8 чем к Sonnet 4.6. Модель уже доступна всем пользователям, включая бесплатных. Цена до конца лета $2/$10 за миллион токенов, потом поднимут до классических $3/$15.@ai_newz


местный датасасер
30 Jun, 10:07
forwarded from @sysblok
Национальный корпус русского языка вырос в шесть разНациональный корпус русского языка (НКРЯ) пополнился новым разделом — Генеральным интернет-корпусом русского языка (ГИКРЯ). В него вошли тексты социальной сети ВКонтакте с 2007 по начало 2022 года. Общий объем НКРЯ вырос с 2,2 до 13,5 млрд словоупотреблений — более чем в шесть раз.НКРЯ существует с 2004 года и объединяет более 50 корпусов: от древнерусских летописей XI века до современной прессы. В нем есть сбалансированный Основной корпус, дающий общее представление о письменном русском языке последних 200–300 лет, а также множество специализированных корпусов: газетный, синтаксический, поэтический, устный, мультимедийный, диалектный, исторический и другие.В новом корпусе есть социолингвистическая разметка: каждому тексту приписаны данные об авторе — пол, возраст, город и регион проживания. Это позволяет изучать, как говорятСистемный БлокъНациональный корпус русского языка вырос в шесть раз - Системный БлокъТеперь в него входят тексты ВКонтакте — почти 11,3 млрд слов из соцсетей
местный датасасер
7 Jun, 11:56
Китайская Moonshot AI выпустила Kimi Code CLI: у нас теперь есть опенсорсный аналог Claude CodeGitHubGitHub - MoonshotAI/kimi-code: Kimi Code CLI — The Starting Point for Next-Gen AgentsKimi Code CLI — The Starting Point for Next-Gen Agents - MoonshotAI/kimi-code1,070Open in Telegram
местный датасасер
14 May, 08:53
forwarded from @cgevent
Krea сделала свой MidjourneyСвоя модель от Krea, натренированная с нуля и заточенная на разные художественные стили. Не ждите фоторил или рендеринг текста, ожидайте креатива в духе Миджорни.Доступна пока на планах Max и Businesses.https://www.krea.ai/krea-2@cgevent
местный датасасер
19 Mar, 13:21
Сохраним Android открытым https://keepandroidopen.org/ru/keepandroidopen.orgСохраним Android открытымВ защиту Android как свободной и открытой платформы, на которой каждый может создавать приложения.1,320Open in Telegram
местный датасасер
17 Mar, 10:32
forwarded from @vcnews
Глава Nvidia Дженсен Хуанг в ходе конференции GTC презентовал корпоративную платформу NemoClaw. Она представляет собой OpenClaw с дополнительными функциями безопасности, пишет TechCrunch.Компания хочет предложить для бизнеса систему, которая позволит использовать ИИ-агентов с соблюдением требований к конфиденциальности и возможностью контролировать их работуvc.ru/ai/2799287
1,260Open in Telegram
местный датасасер
26 Feb, 08:43
forwarded from @wavecut_vibin
Это было неизбежно: рано или поздно должны были появиться специализированные решения для инференса. И вот, Taalas (бывшая команда из Tenstorrent) выкатили то, чего я так ждал — настоящий Direct-to-Silicon.Ребята не стали мелочиться и буквально «запекли» модель в кремний. Никакой внешней памяти, никакого HBM, никакой сложной упаковки. Веса модели и архитектура — это и есть сам чип.Цифры выглядят дико: 17,000 токенов в секунду на Llama 3.1 8B. Это на порядок быстрее текущей SOTA GPU, при этом чип стоит в 20 раз дешевле в производстве и потребляет в 10 раз меньше энергии. Самое крутое, что это не просто красивые слайды для инвесторов. Железо уже существует, и его можно «потрогать» (ссылка на демо внизу).Конечно, это ASIC, и тут есть нюанс: чип заточен под одну конкретную модель. Но Taalas продумали этот момент — они оставили поддержку LoRA-адаптеров и изменяемого контекстного окна.
1,030Open in Telegram
местный датасасер
18 Feb, 18:34
forwarded from @techsparks
После перепалки Anthropic и OpenAI на тему допустимости рекламы в ИИ-чатботах решила высказаться и Perplexity. Руководство компании приняло сторону Anthropic и заявило, что недолгие эксперименты с рекламой решено свернуть. Доверие пользователя слишком дорогого стоит при общении с ИИ, и компания решила им не рисковать. А монетизацию обеспечить подпиской: компания сфокусируется на развитии сервисов, "за которые людям захочется платить". Похожим спорам о монетизации больших интернет-сервисов лет почти столько же, сколько и интернету. Попытки сделать поиск или почту, “за которые захочется платить”, на b2c рынке не привели к появлению сколь-нибудь крупных игроков. Интересно, как здесь разрешится спор моделей. Все-таки за последние годы подписочная модель в стримингах, например, вполне доказала свою состоятельность, так что привычка платить потихоньку у людей вырабатывается https://www.thevergThe VergePerplexity switches sides in AI ad warsExecutives fear users won’t trust an ad-serving chatbot.
местный датасасер
13 Jan, 08:18
forwarded from @ctodaily
О, война платежных стандартов в ИИ!3 месяца назад OpenAI совместно со Stripe (крупнейший карточный процессинг с фокусом на разработчиков) разработали свой протокол для покупок внутри ChatGPT — Agentic Commerce Protocol (ACP).И вот вчера Google совместно с Shopify (крупнейшая платформа для создания интернет-магазинов) представили Universal Commerce Protocol (UCP).Совсем упрощая, это чтобы можно было покупать товары прямо на странице результатов поиска, не переходя на страницу интернет-магазина. Протокол гораздо более открытый, чем ACP.Хотелось бы поставить эмоджи 🍿, но мне кажется и так понятно, кто выиграет. Это как со государством соревноваться.
1,130Open in Telegram
Related Channels
Other channels in the same section of the catalogue.
