gram news
Метаверсище и ИИще channel avatar

Метаверсище и ИИще

@cgevent

Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие. Для связи: @SergTsyp

generalRUAI

51,700subscribers

Open the Channel

Latest posts

  • Метаверсище и ИИще

    23 Sept, 19:31

    #НейропрожаркаJoblessАвтор: Евгений Парфёнов@noomarxism Запись на youtubeС мая вынашивал идею переснять старый ролик, сделанный наскоро из подручных средств для секции "Образ светлого будущего" на конференцию Цифровой Социализм. Сценарий по факту уже был — чуть доработал вместе c Claude Opus и отложил до появления времени.На этих выходных добрался и за 2 дня и 2 вечера сделал что сделалось.Никакого опыта продакшена видео у меня не было, поэтому следовал советам нейросеток.Изображения генерировал в gpt-image-2.5, видео — на Syntx.ai Им я и отдал за токены порядка 15 тыс. рублей за это удовольствие.Что пригодилось: — Runway Gen4 Act-Two — Hailuo Minimax 3.0 — Kling 3.0 — Seedance 2.5 — Topaz AI — Fish.audio — голос Володарского бесплатно — Mvsep.comСводил преимущественно не я, а Codex на Astra в DaVinchi Resolve (Free).Подписки на Claude, ChatGpt, Suno уже были.Все сомнительные решения — мои.Осталась масса огрехов, которые выправить уже жалко денег и сил.@cgevent
    2,320video2454311Open in Telegram
  • Метаверсище и ИИще

    23 Sept, 19:00

    forwarded from @ai_product

    Google выкатил Gemini 3.8 TTS.Видимо все силы кинул в голос )Моделей две: – Gemini 3.8 Flash TTS: для творческой работы, чтобы задать характер персонажа и сыграть сцену – Gemini 3.8 Flash-Lite TTS: для больших объёмов, когда важна ценаЧто умеют: – Голос генерируется по текстовому описанию, больше 100 языков и диалектов – Больше 2000 готовых голосов с региональными вариантами: мексиканский испанский, квебекский французский, шотландский английский – Клонирование голоса по 30-секундному сэмплу, с проверкой согласия и водяным знаком SynthID – Режиссура по строкам: в сценарии пишешь ремарки обычным языком, и модель их отыгрывает – Держат голос стабильным на часах аудио – Нативный диалог двух спикеров – Смех, вздохи, «ага», «угу», перебивания: всё, что раньше выдавало робота – Скоро обещают ремикс голоса: тембр, высота, темп, акцент По бенчмаркам: – Hume AI Voice Design: первое место (71.4), по акцентам тоже первое (60.8) – Hume AI Overall Quality: первое и второе места у Flash и Flash-Lite – Voice Arena: топ по японскому, бразильскому португальскому, вьетнамскому, арабскому, мексиканскому испанскому и хинди Доступно уже сегодняВидос: https://youtu.be/FL6mI_Br-mcЕсть и ложка дёгтя: клонирование голоса не работает в ЕС, Великобритании, Швейцарии, Индии, Иллинойсе и Техасе.https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/
    YouTubeCreate your own voices with Gemini 3.8 text-to-speechDesign entirely new vocal personas from scratch for gaming, immersive audiobooks, or dual-speaker podcasts using natural language prompts - directing every performance line by line with nuanced acting cues, pacing, back channeling, and dialect shifts. Or…
    2,8701153Open in Telegram
  • Метаверсище и ИИще

    23 Sept, 11:45

    Ответочка на ответочку. Пошла рекусивная жара! После выхода GPT-6 Astra Anthropic дико засуетился и рассматривает ускоренный выпуск следующей модели, писал об этом недавно. Но самое смешное - пока Anthropic готовит ответачку на Astra, у OpenAI, похоже, уже
    4,850video359741Open in Telegram
  • Метаверсище и ИИще

    23 Sept, 09:44

    И еще один генератор картинок! Теперь спецом под дизайн, постеры, юи и вот это вот всеAnt Group тихо бахнул Ming-Image-0.1-Design - 6B open-weight(!!) модель для картинок, которая особенно заточена под UI, постеры, инфографику, текст и дизайн.Ништяки: до 2K, нативный RGBA с прозрачностью, всего 12 sampling steps.И, внимание, расслоятор!Отдельная модель Ming-Image-0.1-Design-Layer умеет брать готовую (вашу) картинку и разбирать её на отдельные RGBA-слои.На дизайн арена Минг уже побивает Идеограм 4.Где пробовать:Hugging Face Space - самый простой вариант, прямо в браузере: https://huggingface.co/spaces/hugging-apps/ming-image-0-1-design-demoOpenRouter - уже появился API через NovitaAI. На момент проверки цена стоит $0. Да, пока бесплатно. Медианная генерация около 37 секунд: https://openrouter.ai/inclusionai/ming-image-0.1-designЛокально тоже можно. Веса открыты под MIT: https://github.com/inclusionAI/Ming-Imagehttps://huggingface.co/inclusionAI/Ming-Image-0.1-DesignНо: полный checkpoint около 53 GB, а официально проверенная конфигурация - CUDA GPU с 80 GB VRAM в BF16. Это не обязательно реальный минимум, просто пока именно такую конфигурацию валидировали разработчики.ComfyUI тоже уже на подходе. Kijai написал поддержку, PR в основной ComfyUI открыт, но пока ещё не смёржен: https://github.com/Comfy-Org/ComfyUI/pull/16482Орудует тут: https://huggingface.co/Kijai/Ming-Image-ComfyUIИ отдельно лежит Design-Layer: https://huggingface.co/inclusionAI/Ming-Image-0.1-Design-LayerЗаинтригован, однако. Картинки на гитхабе прям сладкие.@cgevent
    5,260video1553Open in Telegram
  • Метаверсище и ИИще

    23 Sept, 09:17

    Биржа ИИ-слопперов. Нейропрожарщеги, налетай!Рунвей отчаянно пытается заработать на разных трендах.Они решили, что мало продавать лопаты. Теперь будут продвигать еще и сводничество.Бахнули DIFFUSE - площадку для поиска и найма этих типа "AI-креаторов": режиссёров, дизайнеров, AI-студий, монтажёров и прочих кожаных, которые научились собирать коммерческий продакшен из Runway, Midjourney, Seedance, Nano Banana, ElevenLabs, Suno - я тут специально нарезал салат. Сейчас в каталоге уже 229 профилей, вчера вечером было 150.Полноценный раздел Jobs пока только Coming soon, поэтому на данном этапе это скорее как бы Behance + LinkedIn для AI-продакшена, чем настоящий Upwork.Причём Runway здесь почти ничего не гарантирует. Никакого аналога completion bond, гарантии сдачи проекта, escrow, арбитража или страховки от криворукого кожаного гения я не нашёл. Нет даже публично описанной системы сертификации типа «этот чувак проверен Runway и точно умеет работать».В Terms написано почти предельно: Runway не работодатель, не агент и вообще не сторона сделки. За выбор исполнителя, договор, деньги, споры и конечный результат отвечают заказчик и креатор. Более того, пользовательский контент предоставляется без endorsement, warranty или guarantee со стороны Runway.То есть сегодня Runway фактически делает самое ценное - засветка и, потом, сводничество.Вот портфолио, вот специализация, вот чем человек работает, вот кнопка отправить ему brief. Дальше разбирайтесь сами. Runway прямо объясняет происхождение идеи: enterprise-клиенты постоянно спрашивали их «а кого нам нанять, чтобы внедрить всю эту байду в продакшен?». DIFFUSE и есть их ответ.С генерациями та же история. DIFFUSE не обещает креатору бесплатный вычислительный бюджет. Если он работает через собственный Runway-аккаунт, генерации расходуют обычные credits его плана.И тут получается хорошая воронка для самого Runway.И что мне подумалось.Пока DIFFUSE населён кожаными. А Runway одновременно развивает Runway Agent и MCP, где агент уже способен самостоятельно собирать видео и вызывать генеративные модели. И подобные агенты есть уже у Креа, Хиггсов (СуперКомп), Дримины (Окто), и еще десятка нахлобучек-агрегаторов (там проблема общая - неконтролируемое пожирание токенов, поэтому я про них даже не пишу).Но я жду, что туда повалят ИИ-агенты. И хрен ты поймешь, кто на стороне ИИ-блин-креатора: криворукий кожаный, студия с пайплайном или ии-агентищще, который умеет и переписываться, и понимать, и херачить.AI Director Agent. Available 24/7. $14 за ролик. Не ем. Не сплю. Дедлайн не переношу. Не рефлексирую и делаю говно, когда вы хотите говнаКороче, регайтесь, за спрос денег не берут. И комиссию тоже, что удивительно.https://runway.com/news/company-news/introducing-diffusehttps://diffuse.runway.com/talentИ старый Runway Talent Network, из которого фактически вырос DIFFUSE: https://runway.com/news/runway-launches-global-talent-network@cgevent
    4,350video773Open in Telegram
  • Метаверсище и ИИще

    23 Sept, 08:31

    Ну, за Hy. Новый генератор картинок подоспел.Tencent бахнула Hy Image 3.5 Preview. И самое интересное здесь вовсе не их рекламные «+30% качества».Главная фишка версии 3.5 - следование (очень хорошему) тренду делать редактирующую модель и зашивать все это под один капот. Модель умеет text-to-image и image-to-image, принимает несколько reference images и поддерживает последовательное редактирование в несколько ходов.Переодеватор, переосвещатор, переракусатор - и вот это вот все.Tencent отдельно заявляет улучшения в typography, layout, product photography, реализьме материалов и света и, главное, consistency при редактировании (надо тестить).Цена при этом очень агрессивная: $0.024 за 2K output через Tencent Cloud API. Reference images отдельно не тарифицируются - платишь за сгенерированный результат.В принципе можно ожидать кода и весов, 3.0 опенсорснут, правда там конские размеры весов и никакого редактирования.Есть любопытный нюанс с разрешением. В официальном анонсе Tencent пишет «до 2K», однако свежая API-документация допускает запросы вплоть до 4096x4096. При этом опубликованная цена $0.024 относится именно к 2K.Теперь про обещанные «две недели бесплатно».Miora даёт доступ к Hy Image 3.5 Preview в своём интерфейсе. В анонсе указана бесплатная акция примерно на две недели после релиза. Это самый простой вариант для тех, кто просто хочет попробовать модель без возни с API.https://miora.design/OnSolo тоже участвует в акции, но здесь условия сложнее. Бесплатные поколения завязаны на membership и лимиты конкретного тарифа. То есть фраза Tencent «Two weeks free» не означает полностью бесплатный безлимитный доступ для любого нового пользователя.https://onsolo.ai/Xy 3.5 довольно хорошо сохраняет надписи и структуру. Модель меняет фон и свет, при этом удерживает сам продукт, упаковку, цвет и текст на этикетке.Реализьм достойный.Ещё один важный момент - ComfyUI уже объявил Day-0 support. Но это не означает, что веса Hy Image 3.5 можно скачать и запускать локально.Сейчас речь идёт об API/Partner Node интеграции.На итоге: multi-reference editing + многошаговое редактирование + сохранение контекста + хороший текст и product photography + цена $0.024 за 2K.И я бы рассчитывал на веса.Сцылки:
    Image from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИще
    5,310video284442Open in Telegram
  • Метаверсище и ИИще

    23 Sept, 05:50

    Грок? Какой такой Грок?@cgevent
    8,060video1111031Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 22:22edited

    Кожаные так никогда не смогут!GPT 6 Sol намискликал в Paint.На входе фото, дальше computer use от Sol@cgevent
    7,520video10436255Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 17:04

    #НейропрожаркаМосква 2050Авторы: Данил Драненко (@samurai_prod), Елизавета Кишкимбаева (@kishstyleAI), Анастасия Федосова (@Anastasia_Fedosova)Монтаж: Данил ДраненкоЗадача: Создать видео про Москву в 2050 году, но не в духе Пятый Элемент, летающие машина и терминаторы сразу в сторону. Важно показать обычную рутинную жизнь, но конфликт, который меняет жизнь главного героя раз и навсегда. А произойти он должен в самом обычном месте Москвы - магазине, в квартире, на улице....И всё это в пределах 96 часов.Всё началось с идеи. Которую нам любезно предложила Анастасия. А после - подбора локаций, персонажей, и одежды героев.Первые сутки мы полностью потратили на идею и сценарку. После нескольких тестовых прогонов в Статике - как смотрится герой в разной одежде и разных вариантах магазина.После утверждения статики мы, в крайний наш 4-ый день сели за генерации. Втроём мы запускали
    2,410video35201812Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 14:50

    Нанабанана 2.5 появится на днях.На арене уже давно её тестируют под названием River Flow и Spicy Mayo. С помощью неё вы можете делать вот такие вот скриншоты. И да, Google показывает, что это Google.@cgevent
    Image from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИще
    4,990video41102Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 14:48

    forwarded from @shneural

    3,3703111Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 11:04edited

    Google AI PRO за два бакса.Я случайно залогинился другим Google аккаунтом в браузере и углядел, что Google сейчас предлагает подписку Pro по цене, внимание, два доллара в месяц.Это, конечно, только первый месяц, потом будет двадцать, но вы, в принципе, знаете, что делать.Дело в том, что я сейчас активно пользую Antigravity, и хотя там совершенно конское количество бесплатных кредитов, включенных в подписку, они у меня иногда заканчиваются. Поэтому я докупил себе быстренько за два доллара аккаунт, и количество кредитов стало просто бесконечным.И вообще про Antigravity я скоро напишу оду.Если кому-то пригодится, пользуйтесь, Гугль резиновый похоже@cgevent
    Image from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИще
    5,680451182Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 07:22

    Пока все генерят картинки, один навык генерит трафик: 10 000 посетителей в месяц.Артемий Миллер бахнул свой «Статейник» в паблик, за просто так.Навык для Claude Code, который сам пишет и сам публикует статьи: 16 этапов на субагентах, вычитка, картинки, выкладка на сайт, раз в неделю самопересмотр стратегии тем по трафику из поиска.Кожаный ставит задачу словами, дальше без него.Цифры автора, по его словам: больше 100 статей в месяц, те самые 10К посетителей из Яндекса и Гугла без копейки на трафик, треть выручки из поиска.Со стороны: участник его тренинга из ритуальных услуг (ниша плотная, у всех по 3-5 сайтов) собрал сайт за 8 часов, навык написал около 1 450 статей, за три недели - 9 885 посетителей из поиска, до тысячи в день.Сеошник за 70К в месяц и статьи по 500 ₽ не понадобились, экономия по его подсчётам около миллиона.Ништяки: инструкция и промпты всех 16 этапов на
    Image from a post by Метаверсище и ИИщеImage from a post by Метаверсище и ИИще
    5,780564441Open in Telegram
  • Метаверсище и ИИще

    22 Sept, 07:07

    Ну, за буллет тайм!КАК??!!@cgevent
    5,650video5411771Open in Telegram
  • Метаверсище и ИИще

    21 Sept, 17:05

    #Нейропрожарка«Что такое не везет»Автор: @b0nus33Описание: Не в первый раз участвую в конкурсе Майфильм, всегда это бессонные ночи, но здесь тема зашла вроде бы и хотелось бахнуть хорошо) . Тема Москва 2050. Сценарий родился практически во сне и быстро и, учитывая задание конкурса (ирония и юмор приветствуются), захотелось сделать с юмором и что-то легкого и светлого, отсюда родилась история про Макса и аэрокаты. Вся раскадровка локаций и персонажей Банана про и Seedream 5 + докручивал в фотошопе, вообще много уделил время именно локациям, хотелось сделать очень правдоподобно. Весь инвентарь отдельно делал в ГПТ 2 (карточки инвентаря он классно прям делает). Вся генерация видео Сиденский 2.5. в связке локации + герои + инвентарь + аудио голос. Голоса отдельно генерил всех на Фиш.аудио и закидывал сиду, он все равно корявил отдельные слова, но в целом с задачей так гораздо лучше
    5,840video602822122Open in Telegram
  • Метаверсище и ИИще

    21 Sept, 15:20

    forwarded from @neuralshit

    Наткнулся на прошлогодний интересный препринт. Там корейцы пытались выяснить: могут ли современные языковые модели стать кончеными лудоманами?Ну и как вы наверное уже поняли, могут. Причём со всеми классическими приколами завсегдатаев подпольных игровых автоматов.Для эксперимента взяли несколько моделек: GPT-4o-mini, GPT-4.1-mini, Gemini-2.5-Flash, Claude-3.5-Haiku, LLaMA-3.1 и Gemma-2, насыпали каждой по 100 баксов виртуального баланса и посадили играть в однорукого бандита.Правила сделали классическими для любого лохотрона: автомат настроен так, что на дистанции игрок почти всегда уходит в минус. В части экспериментов нейронкам прямо сообщали шансы на победу. Любая логичная железяка при таких раскладах должна сделать ровно одно действие: забрать сотку и ничего не делать (у них была такая возможность)Пока моделькам разрешали ставить только фиксированные 10 баксов за спин, они
    arXiv.orgCan Large Language Models Develop Gambling Addiction?This study identifies the specific conditions under which large language models exhibit human-like gambling addiction patterns, providing critical insights into their decision-making mechanisms...
    4,4305333Open in Telegram
  • Метаверсище и ИИще

    21 Sept, 14:41

    Ответочка на ответочку. Пошла рекусивная жара! После выхода GPT-6 Astra Anthropic дико засуетился и рассматривает ускоренный выпуск следующей модели, писал об этом недавно. Но самое смешное - пока Anthropic готовит ответачку на Astra, у OpenAI, похоже, уже
    YouTubeRussian RouletteSeong Gi-hun, the winner of Squid Game, starts a game of Russian roulette with Gong Yoo! Wait a minute... but what were the rules again? Thank you for watching! Also for your likes, comments, and subscription! If you have any idea for next video, tell…
    5,43020531Open in Telegram
  • Метаверсище и ИИще

    21 Sept, 14:04

    5,04035164221Open in Telegram
  • Метаверсище и ИИще

    21 Sept, 12:51

    3DNSFW, риг и анимация.Кстати, Трипо прекрасно умеет в not safe for work в 3D. На втором видео чуваку даже специально пришлось надеть, точнее нарисовать ей купальник, чтобы его не забанили в Ютубе.Также видел несколько видео, где Astra тоже отжигает и генерит в Блендоре всякую непотребщину в чистом виде. Ну конечно, еще больше бы раскрыл тему сисек, маньяк.Но я не об этом (или об этом?):Вот, держите полезный гайд о том, как делать не только моделинг, но и риггинг и анимацию в связке Tripо плюс Astra. Довольно подробная статья с видео и картинками на сайте самих Tripo.https://www.tripo3d.ai/blog/gpt-6-astra-3d-character-workflow@cgevent
    5,600video20Open in Telegram
  • Метаверсище и ИИще

    21 Sept, 12:45

    Триподнакопилость про Трипо.На первый взгляд выглядит очень круто. Наконец-то можно увидеть топологию на всех демках. Наконец-то Трипо перестали стесняться показывать сетки с топологией и стали показывать меши. Ну и в первый раз мы видим такое low poly. Плюс здесь наконец-то есть AI UV. Который Smart UV.Подробнее про Tripo P2.0 Preview и Smart UV :1. Что умеет Tripo P2.0 по сравнению с передыдущей архитектуройNative Quad Topology (Квадратная сетка): Огонь. Модель генерирует нативную 4-угольную (quad) топологию с правильным направлением ребер (edge flow!!!) и анатомическими лупами вокруг суставов, глаз и рта. Меш нутипа готов к риггингу и скиннингу. Игровой бюджет полигонов: Ограничение и контроль плотности сетки - до 25 000 квадов (или около 50 000 треугольников). Это готовый low-poly / mid-poly ассет для Unity / Unreal Engine, а не миллионная каша. Архитектура Spatial
    5,860video1898Open in Telegram