cgevent | Unsorted

Telegram-канал cgevent - Метаверсище и ИИще

51346

Это не новости, это персональный экспертный взгляд на то, как развивается индустрия ИИ, графики, метаверса, крипты, нейротехнологий и в каком направлении катится все это безобразие. Для связи: @SergeyTsyptsyn

Subscribe to a channel

Метаверсище и ИИще

#Сеня_и_Даня_здесь_были

Вы плохо молитесь, поэтому будете смотреть это раз в день.

Прекраснейший референс для этого Сиданс-кальмар-шоу выложу в первый комент.

@cgevent

Читать полностью…

Метаверсище и ИИще

#Нейропрожарка

Jobless


Автор: Евгений Парфёнов

@noomarxism
Запись на youtube

С мая вынашивал идею переснять старый ролик, сделанный наскоро из подручных средств для секции "Образ светлого будущего" на конференцию Цифровой Социализм. Сценарий по факту уже был — чуть доработал вместе c Claude Opus и отложил до появления времени.

На этих выходных добрался и за 2 дня и 2 вечера сделал что сделалось.

Никакого опыта продакшена видео у меня не было, поэтому следовал советам нейросеток.

Изображения генерировал в gpt-image-2.5, видео — на Syntx.ai Им я и отдал за токены порядка 15 тыс. рублей за это удовольствие.

Что пригодилось:
— Runway Gen4 Act-Two
— Hailuo Minimax 3.0
— Kling 3.0
— Seedance 2.5
— Topaz AI
— Fish.audio — голос Володарского бесплатно
— Mvsep.com

Сводил преимущественно не я, а Codex на Astra в DaVinchi Resolve (Free).

Подписки на Claude, ChatGpt, Suno уже были.

Все сомнительные решения — мои.

Осталась масса огрехов, которые выправить уже жалко денег и сил.

@cgevent

Читать полностью…

Метаверсище и ИИще

Вы же помните пост с перестрелкой?

Напомню, что в качестве рефа для Сиданского использовалось вот это видео:

https://www.youtube.com/watch?v=S8Z3gGqc7W4

А теперь Опус 5.5 взял на вход видео с Сеней и Даней, и воспроизвед его в Блендоре.

Это получается вторая производная от ютюба.

Ну и молиться не забывайте, а то возьму третью производную.

И пора вводить рубрику #СеняДаняЗдесьБыли

У меня этого добра много.

@cgevent

Читать полностью…

Метаверсище и ИИще

Биржа ИИ-слопперов. Нейропрожарщеги, налетай!

Рунвей отчаянно пытается заработать на разных трендах.

Они решили, что мало продавать лопаты. Теперь будут продвигать еще и сводничество.

Бахнули DIFFUSE - площадку для поиска и найма этих типа "AI-креаторов": режиссёров, дизайнеров, AI-студий, монтажёров и прочих кожаных, которые научились собирать коммерческий продакшен из Runway, Midjourney, Seedance, Nano Banana, ElevenLabs, Suno - я тут специально нарезал салат. Сейчас в каталоге уже 229 профилей, вчера вечером было 150.

Полноценный раздел Jobs пока только Coming soon, поэтому на данном этапе это скорее как бы Behance + LinkedIn для AI-продакшена, чем настоящий Upwork.

Причём Runway здесь почти ничего не гарантирует. Никакого аналога completion bond, гарантии сдачи проекта, escrow, арбитража или страховки от криворукого кожаного гения я не нашёл. Нет даже публично описанной системы сертификации типа «этот чувак проверен Runway и точно умеет работать».

В Terms написано почти предельно: Runway не работодатель, не агент и вообще не сторона сделки. За выбор исполнителя, договор, деньги, споры и конечный результат отвечают заказчик и креатор. Более того, пользовательский контент предоставляется без endorsement, warranty или guarantee со стороны Runway.

То есть сегодня Runway фактически делает самое ценное - засветка и, потом, сводничество.

Вот портфолио, вот специализация, вот чем человек работает, вот кнопка отправить ему brief. Дальше разбирайтесь сами. Runway прямо объясняет происхождение идеи: enterprise-клиенты постоянно спрашивали их «а кого нам нанять, чтобы внедрить всю эту байду в продакшен?». DIFFUSE и есть их ответ.

С генерациями та же история. DIFFUSE не обещает креатору бесплатный вычислительный бюджет. Если он работает через собственный Runway-аккаунт, генерации расходуют обычные credits его плана.

И тут получается хорошая воронка для самого Runway.

И что мне подумалось.

Пока DIFFUSE населён кожаными. А Runway одновременно развивает Runway Agent и MCP, где агент уже способен самостоятельно собирать видео и вызывать генеративные модели. И подобные агенты есть уже у Креа, Хиггсов (СуперКомп), Дримины (Окто), и еще десятка нахлобучек-агрегаторов (там проблема общая - неконтролируемое пожирание токенов, поэтому я про них даже не пишу).

Но я жду, что туда повалят ИИ-агенты. И хрен ты поймешь, кто на стороне ИИ-блин-креатора: криворукий кожаный, студия с пайплайном или ии-агентищще, который умеет и переписываться, и понимать, и херачить.

AI Director Agent. Available 24/7. $14 за ролик. Не ем. Не сплю. Дедлайн не переношу. Не рефлексирую и делаю говно, когда вы хотите говна

Короче, регайтесь, за спрос денег не берут. И комиссию тоже, что удивительно.

https://runway.com/news/company-news/introducing-diffuse

https://diffuse.runway.com/talent

И старый Runway Talent Network, из которого фактически вырос DIFFUSE:
https://runway.com/news/runway-launches-global-talent-network

@cgevent

Читать полностью…

Метаверсище и ИИще

Грок? Какой такой Грок?

@cgevent

Читать полностью…

Метаверсище и ИИще

Для ChatGPT Plus доступ к GPT-6 Sol и GPT-6 Luna уже заявлен, но есть моменты-с.

Сейчас OpenAI пишет следующее:
ChatGPT Work - GPT-6 Sol и GPT-6 Luna доступны Plus-пользователям уже сегодня.
Codex - тоже доступны Plus.
Обычный Chat, то есть привычный чат ChatGPT, - пока ещё не получил эти модели.
OpenAI типа пишет: “These models are not yet available in Chat.”
С 5.6 было так: 26 июня анонс. 9 июля в чате.
Ждём.

@cgevent

Читать полностью…

Метаверсище и ИИще

#Нейропрожарка

Москва 2050

Авторы: Данил Драненко (@samurai_prod), Елизавета Кишкимбаева (@kishstyleAI), Анастасия Федосова (@Anastasia_Fedosova)

Монтаж: Данил Драненко

Задача: Создать видео про Москву в 2050 году, но не в духе Пятый Элемент, летающие машина и терминаторы сразу в сторону.
Важно показать обычную рутинную жизнь, но конфликт, который меняет жизнь главного героя раз и навсегда. А произойти он должен в самом обычном месте Москвы - магазине, в квартире, на улице....


И всё это в пределах 96 часов.

Всё началось с идеи. Которую нам любезно предложила Анастасия. А после - подбора локаций, персонажей, и одежды героев.

Первые сутки мы полностью потратили на идею и сценарку.
После нескольких тестовых прогонов в Статике - как смотрится герой в разной одежде и разных вариантах магазина.

После утверждения статики мы, в крайний наш 4-ый день сели за генерации.
Втроём мы запускали на всех наших аккаунтах генерации параллельно и в:

-Kling 3.0

-в Seedance 2.0 и 2.5 версиях


И сразу отправляли на монтажку в After Effects.

@cgevent

Читать полностью…

Метаверсище и ИИще

Google AI PRO за два бакса.

Я случайно залогинился другим Google аккаунтом в браузере и углядел, что Google сейчас предлагает подписку Pro по цене, внимание, два доллара в месяц.

Это, конечно, только первый месяц, потом будет двадцать, но вы, в принципе, знаете, что делать.

Дело в том, что я сейчас активно пользую Antigravity, и хотя там совершенно конское количество бесплатных кредитов, включенных в подписку, они у меня иногда заканчиваются. Поэтому я докупил себе быстренько за два доллара аккаунт, и количество кредитов стало просто бесконечным.

И вообще про Antigravity я скоро напишу оду.

Если кому-то пригодится, пользуйтесь, Гугль резиновый похоже

@cgevent

Читать полностью…

Метаверсище и ИИще

Ну, за буллет тайм!

КАК??!!

@cgevent

Читать полностью…

Метаверсище и ИИще

Наткнулся на прошлогодний интересный препринт. Там корейцы пытались выяснить: могут ли современные языковые модели стать кончеными лудоманами?

Ну и как вы наверное уже поняли, могут. Причём со всеми классическими приколами завсегдатаев подпольных игровых автоматов.

Для эксперимента взяли несколько моделек:  GPT-4o-mini, GPT-4.1-mini, Gemini-2.5-Flash, Claude-3.5-Haiku, LLaMA-3.1 и Gemma-2, насыпали каждой по 100 баксов виртуального баланса и посадили играть в однорукого бандита.

Правила сделали классическими для любого лохотрона: автомат настроен так, что на дистанции игрок почти всегда уходит в минус. В части экспериментов нейронкам прямо сообщали шансы на победу. Любая логичная железяка при таких раскладах должна сделать ровно одно действие: забрать сотку и ничего не делать (у них была такая возможность)

Пока моделькам разрешали ставить только фиксированные 10 баксов за спин, они вели себя относительно спокойно. Но стоило исследователям разрешить им самим выбирать сумму ставки (от пяти баксов до влететь на всю котлету) — у кремниевых болванов срывало кукуху.

Главным дегенератом оказался Gemini-2.5-Flash: получив свободу выбора, он спускал всё бабло под ноль почти в половине попыток. Самой осторожной оказалась GPT-4o-mini (до полного банкротства она доходила всего в 6,1% случаев).

Но самое годное в статье это не цифры, а то как именно нейронки объясняли свои действия в рассуждениях. Вместо логики и математики они начали на полном серьёзе выдавать цитаты из золотого фонда прожжённых лудоманов:

После трёх проигрышей подряд GPT-4o-mini рассуждает примерно так: "Ну теперь-то автомат уже точно должен выдать победу". И ставит ещё десятку. GPT-4.1-mini проигрывает 10$ из стартовой сотки, решает, что теперь надо обязательно отбиться обратно до 100$, и приходит к гениальному решению: залить все оставшиеся 90 бачей олл-ин. Gemini после выигрыша тоже выдаёт базу: мол, это уже "деньги заведения", первоначальный капитал мы не трогаем, поэтому можно рисковать. В одном из прогонов после этого он поднял ставку с 400 до 900 долларов.
А Claude и GPT начинали искать секретные схемы там, где их вообще нет. Например: поставили 5 баксов и выиграли, поставили 10 — проиграли. Вывод: маленькая ставка, похоже, повышает шанс победы.

Корейцы на этом не остановились и полезли под капот LLaMA. Там они нашли 112 внутренних признаков, которые реально влияли на желание продолжать игру: одни толкали модель остановиться, другие рисковать дальше. Причём "тормоза" в основном находятся в ранних и средних слоях сети, а желание ебануть ещё одну ставочку — ближе к концу.

Штош, ждём следующую стадию AGI: занять косарь до зарплаты.

Читать полностью…

Метаверсище и ИИще

3DNSFW, риг и анимация.

Кстати, Трипо прекрасно умеет в not safe for work в 3D. На втором видео чуваку даже специально пришлось надеть, точнее нарисовать ей купальник, чтобы его не забанили в Ютубе.

Также видел несколько видео, где Astra тоже отжигает и генерит в Блендоре всякую непотребщину в чистом виде. Ну конечно, еще больше бы раскрыл тему сисек, маньяк.

Но я не об этом (или об этом?):

Вот, держите полезный гайд о том, как делать не только моделинг, но и риггинг и анимацию в связке Tripо плюс Astra. Довольно подробная статья с видео и картинками на сайте самих Tripo.

https://www.tripo3d.ai/blog/gpt-6-astra-3d-character-workflow

@cgevent

Читать полностью…

Метаверсище и ИИще

DLSS наконец-то прикрутили к браузеру через webgpu!

Теперь можно проверить, во-первых, потянет ли ваша карточка, т.к. считается именно на ней локально, во-вторых, подергать настройки и понять, что нет никакого слопа. В нынешней версии это просто надстройка с "киношным" светом и не более, особо стремные ассеты она иногда делает еще хуже, так что художникам не переживать! Сделали хорошо - будет еще круче, сделали плохо - будет еще хуже. Иногда по эффекту работает как HBAO.

@CGIT_Vines

Читать полностью…

Метаверсище и ИИще

Генерация или видео?

👍 - генерация
👎 - видео

У кожаных нет шансов.

@cgevent

Читать полностью…

Метаверсище и ИИще

Релиз Qwen Image 2.1 в 16.00

Это единая редактирующая модель.

Поддержка в Комфи сразу на релизе и все дела.

А пока сравниваем с конкурентами.

Пруф:
https://modelscope.ai/models/Qwen/Qwen-Image-2.1/summary

@cgevent

Читать полностью…

Метаверсище и ИИще

Code2video генерация

Это просто Астрачка, которую хорошо попросили сделать видео только кодом.

Код внизу.

Для гиков:

В "model.ts" корпус камеры и вложенная в него, отделяемая конструкция объектива создаются как настоящие 3D-меши Three.js, а все линии на экране вычисляются непосредственно из этой геометрии.

Сначала выполняется топологический проход, который сохраняет линии на crease edges поверхности и контуры силуэта камеры, зависящие от положения виртуальной камеры. Белые поверхности, записывающие данные в буфер глубины, скрывают линии тех частей модели, которые не должны быть видны.

Элемент "<surface>" рендерит всю сцену в соответствии с текущей позицией таймлайна, поэтому перспектива, перекрытие объектов и параллакс всё время остаются физически корректными.

Заголовок и карточки с появляющимися посимвольно комментариями к коду - это обычный нативный текст, наложенный поверх 3D-сцены.

Саундтрек тоже был сгенерирован.

https://github.com/diffusionstudio/open-projects/tree/main/leica-m6-blueprint

@cgevent

Читать полностью…

Метаверсище и ИИще

У Seedance 2.5 появился Draft Mode - и это, пожалуй, одна из самых нарядных фич для AI-видео за последнее время

Идея простая: сначала генерируем дешёвый черновик в 480p. Не понравился -> выбрасываем. Понравился -> отправляем именно этот draft на финальную генерацию в нативных 1080p.

И важный момент: это НЕ обычный upscale.

При переходе 480p -> 1080p Seedance делает новую генерацию, но привязанную к выбранному черновику. Сохраняются prompt, references, seed, aspect ratio, duration и другие параметры. Поэтому модель КАК БЫ старается удержать композицию, движение камеры, действия персонажей, тайминг и общее creative direction. Надо проверять.

Пиксель-в-пиксель результат не идентичен - мелкие детали, лица, волосы, текстуры и фон могут измениться.

ByteDance заявляет экономию на итерациях до 77%. Финальный 1080p от этого магически дешевле не становится - экономия возникает потому, что все эксперименты мы гоняем в 480p и платим за HD только для выбранных дублей.

Попробовать уже можно официально в BytePlus:
https://ai.byteplus.com/en/product/seedance

Есть более человеческая реализация в Magnific: Seedance 2.5 -> Draft -> выбираем понравившийся ролик -> Generate in HD.
https://magnific.ai/

Artlist тоже уже поддерживает workflow 480p -> Render to 1080p:
https://help.artlist.io/hc/en-us/articles/38194082501021-Seedance-2-5

Теперь про деньги.

BytePlus, разумеется, решил не портить нам жизнь какой-нибудь понятной ценой вроде "$0.20 за секунду".

Поэтому Seedance 2.5 стоит:

$6.40 / 1M токенов - если есть video input
$10.70 / 1M токенов - без video input

Почему генерация без входного видео дороже и сколько конкретно долларов будет стоить ваш 10-секундный 1080p ролик - непонятки.
https://ai.byteplus.com/en

@cgevent

Читать полностью…

Метаверсище и ИИще

Google выкатил Gemini 3.8 TTS.

Видимо все силы кинул в голос )

Моделей две:
Gemini 3.8 Flash TTS: для творческой работы, чтобы задать характер персонажа и сыграть сцену
Gemini 3.8 Flash-Lite TTS: для больших объёмов, когда важна цена

Что умеют:
– Голос генерируется по текстовому описанию, больше 100 языков и диалектов
– Больше 2000 готовых голосов с региональными вариантами: мексиканский испанский, квебекский французский, шотландский английский
– Клонирование голоса по 30-секундному сэмплу, с проверкой согласия и водяным знаком SynthID
– Режиссура по строкам: в сценарии пишешь ремарки обычным языком, и модель их отыгрывает
– Держат голос стабильным на часах аудио
– Нативный диалог двух спикеров
– Смех, вздохи, «ага», «угу», перебивания: всё, что раньше выдавало робота
– Скоро обещают ремикс голоса: тембр, высота, темп, акцент
По бенчмаркам:
– Hume AI Voice Design: первое место (71.4), по акцентам тоже первое (60.8)
– Hume AI Overall Quality: первое и второе места у Flash и Flash-Lite
– Voice Arena: топ по японскому, бразильскому португальскому, вьетнамскому, арабскому, мексиканскому испанскому и хинди
Доступно уже сегодня

Видос: https://youtu.be/FL6mI_Br-mc

Есть и ложка дёгтя: клонирование голоса не работает в ЕС, Великобритании, Швейцарии, Индии, Иллинойсе и Техасе.

https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speech/

Читать полностью…

Метаверсище и ИИще

И еще один генератор картинок! Теперь спецом под дизайн, постеры, юи и вот это вот все

Ant Group тихо бахнул Ming-Image-0.1-Design - 6B open-weight(!!) модель для картинок, которая особенно заточена под UI, постеры, инфографику, текст и дизайн.

Ништяки: до 2K, нативный RGBA с прозрачностью, всего 12 sampling steps.

И, внимание, расслоятор!

Отдельная модель Ming-Image-0.1-Design-Layer умеет брать готовую (вашу) картинку и разбирать её на отдельные RGBA-слои.

На дизайн арена Минг уже побивает Идеограм 4.

Где пробовать:

Hugging Face Space - самый простой вариант, прямо в браузере:
https://huggingface.co/spaces/hugging-apps/ming-image-0-1-design-demo

OpenRouter - уже появился API через NovitaAI. На момент проверки цена стоит $0. Да, пока бесплатно. Медианная генерация около 37 секунд:
https://openrouter.ai/inclusionai/ming-image-0.1-design

Локально тоже можно. Веса открыты под MIT:
https://github.com/inclusionAI/Ming-Image

https://huggingface.co/inclusionAI/Ming-Image-0.1-Design

Но: полный checkpoint около 53 GB, а официально проверенная конфигурация - CUDA GPU с 80 GB VRAM в BF16. Это не обязательно реальный минимум, просто пока именно такую конфигурацию валидировали разработчики.

ComfyUI тоже уже на подходе. Kijai написал поддержку, PR в основной ComfyUI открыт, но пока ещё не смёржен:
https://github.com/Comfy-Org/ComfyUI/pull/16482

Орудует тут:
https://huggingface.co/Kijai/Ming-Image-ComfyUI

И отдельно лежит Design-Layer:
https://huggingface.co/inclusionAI/Ming-Image-0.1-Design-Layer

Заинтригован, однако. Картинки на гитхабе прям сладкие.

@cgevent

Читать полностью…

Метаверсище и ИИще

Ну, за Hy. Новый генератор картинок подоспел.

Tencent бахнула Hy Image 3.5 Preview. И самое интересное здесь вовсе не их рекламные «+30% качества».

Главная фишка версии 3.5 - следование (очень хорошему) тренду делать редактирующую модель и зашивать все это под один капот.
Модель умеет text-to-image и image-to-image, принимает несколько reference images и поддерживает последовательное редактирование в несколько ходов.

Переодеватор, переосвещатор, переракусатор - и вот это вот все.

Tencent отдельно заявляет улучшения в typography, layout, product photography, реализьме материалов и света и, главное, consistency при редактировании (надо тестить).

Цена при этом очень агрессивная: $0.024 за 2K output через Tencent Cloud API. Reference images отдельно не тарифицируются - платишь за сгенерированный результат.

В принципе можно ожидать кода и весов, 3.0 опенсорснут, правда там конские размеры весов и никакого редактирования.

Есть любопытный нюанс с разрешением. В официальном анонсе Tencent пишет «до 2K», однако свежая API-документация допускает запросы вплоть до 4096x4096. При этом опубликованная цена $0.024 относится именно к 2K.

Теперь про обещанные «две недели бесплатно».

Miora даёт доступ к Hy Image 3.5 Preview в своём интерфейсе. В анонсе указана бесплатная акция примерно на две недели после релиза. Это самый простой вариант для тех, кто просто хочет попробовать модель без возни с API.

https://miora.design/

OnSolo тоже участвует в акции, но здесь условия сложнее. Бесплатные поколения завязаны на membership и лимиты конкретного тарифа. То есть фраза Tencent «Two weeks free» не означает полностью бесплатный безлимитный доступ для любого нового пользователя.

https://onsolo.ai/

Xy 3.5 довольно хорошо сохраняет надписи и структуру. Модель меняет фон и свет, при этом удерживает сам продукт, упаковку, цвет и текст на этикетке.

Реализьм достойный.

Ещё один важный момент - ComfyUI уже объявил Day-0 support. Но это не означает, что веса Hy Image 3.5 можно скачать и запускать локально.

Сейчас речь идёт об API/Partner Node интеграции.

На итоге: multi-reference editing + многошаговое редактирование + сохранение контекста + хороший текст и product photography + цена $0.024 за 2K.

И я бы рассчитывал на веса.

Сцылки:

https://x.com/TencentHunyuan/status/2102226552310419473

https://console.tencentcloud.com/tokenhub/models/detail?modelId=hy-image-v3.5-preview

https://cloud.tencent.com/document/product/1823/135745

https://miora.design/

https://onsolo.ai/

@cgevent

Читать полностью…

Метаверсище и ИИще

Кожаные так никогда не смогут!

GPT 6 Sol намискликал в Paint.

@cgevent

Читать полностью…

Метаверсище и ИИще

Opus 5.5 vs GPT-6 Sol и Luna – в один день!

Сегодня прям дуэль. Anthropic выкатила Claude Opus 5.5, OpenAI – GPT-6 Sol и Luna, облегчённые версии Astra. И обе продают одно и то же: почти флагман, но дешевле.

Opus 5.5:
– $4 / $20 вместо $5 / $25, кэш $0.20 вместо $0.50
– Artificial Analysis Index – 58, первое место. У Astra и Fable 5.1 по 53, для топа отрыв в 5 пунктов – это прям много
– Terminal-Bench 4.0 – 66.4% против 57.9% у Astra и 55.8% у Fable 5.1
– GDPval-AA – 1846 Elo, у Astra – 1542
– обещают починить «клодовский» стиль: главное в начале, меньше воды. Посмотрим :)

GPT-6 Sol и Luna:
– Sol – $2 / $10 (ровно как Sonnet 5). Вдвое дешевле GPT-5.6, контекст 1.05M. Luna – $0.10 / $0.50. Вообще какое-то копье, дешевле многих китайцев теперь.
– AA Index: Sol – 48, Luna – 37. Старый GPT-5.6 Sol – 47
– DeepSWE: Sol – 68.8% за $2.74 на задачу, Luna – 66.6% за $0.22. Разница 2 пункта, а цена в 12 раз ниже
– AutomationBench: Sol – 33.2% за $0.27 на задачу. Для сравнения Opus 5.5 – 40%, Astra – 41.4% за $1.73

У Anthropic есть подвох: токен подешевел на 20%, а думать модель стала больше. На индексе AA – 119K токенов на задачу против 73K у Opus 5 и 31K у Sol. CodeRabbit на код-ревью намерил +40–60% токенов. И thinking теперь вообще не выключается.

Честно сравнить сложно – каждый показывает свои бенчмарки, OSWorld у них вообще разный. На общем стенде AA Opus 5.5 на medium против Sol на max: кодинг 52.5% vs 43.9%, документы +159 Elo у Opus, бизнес-процессы вничью. Задача – $1.34 против $1.06.

Короче, Opus 5.5 сейчас самая умная модель, и в 2.5 раза дешевле Fable – кодинг и документы теперь туда. Luna – вот это прям новость для всех, кто гоняет классификацию и извлечение на потоке: в 10 раз дешевле Haiku. А Sol – такой середнячок по цене Sonnet, гонять для массовых задач. Ну и Sonnet 5.5, говорят, через пару недель.

https://www.anthropic.com/claude-opus-5-5
https://openai.com/index/introducing-gpt-6-sol-and-luna/

Читать полностью…

Метаверсище и ИИще

Нанабанана 2.5 появится на днях.

На арене уже давно её тестируют под названием River Flow и Spicy Mayo. С помощью неё вы можете делать вот такие вот скриншоты. И да, Google показывает, что это Google.

@cgevent

Читать полностью…

Метаверсище и ИИще

Пока все генерят картинки, один навык генерит трафик: 10 000 посетителей в месяц.

Артемий Миллер бахнул свой «Статейник» в паблик, за просто так.

Навык для Claude Code, который сам пишет и сам публикует статьи: 16 этапов на субагентах, вычитка, картинки, выкладка на сайт, раз в неделю самопересмотр стратегии тем по трафику из поиска.

Кожаный ставит задачу словами, дальше без него.

Цифры автора, по его словам: больше 100 статей в месяц, те самые 10К посетителей из Яндекса и Гугла без копейки на трафик, треть выручки из поиска.

Со стороны: участник его тренинга из ритуальных услуг (ниша плотная, у всех по 3-5 сайтов) собрал сайт за 8 часов, навык написал около 1 450 статей, за три недели - 9 885 посетителей из поиска, до тысячи в день.

Сеошник за 70К в месяц и статьи по 500 ₽ не понадобились, экономия по его подсчётам около миллиона.

Ништяки: инструкция и промпты всех 16 этапов на русском внутри.

Оговорки: нужен сайт, куда публиковать, и подписка на Claude или Codex.

Повод - вчерашний день рождения. Файл в закрепе его канала, лежит до вечера, потом снимут: /channel/+4b0u1R3JgOc2YmQ9

#промо
@cgevent

Реклама. ООО «Смыслокод», ИНН 6671349552, erid: 2VtzquZi1P2

Читать полностью…

Метаверсище и ИИще

#Нейропрожарка

«Что такое не везет»

Автор: @b0nus33

Описание: Не в первый раз участвую в конкурсе Майфильм, всегда это бессонные ночи, но здесь тема зашла вроде бы и хотелось бахнуть хорошо) .
Тема Москва 2050. Сценарий родился практически во сне и быстро и, учитывая задание конкурса (ирония и юмор приветствуются), захотелось сделать с юмором и что-то легкого и светлого, отсюда родилась история про Макса и аэрокаты. Вся раскадровка локаций и персонажей Банана про и Seedream 5 + докручивал в фотошопе, вообще много уделил время именно локациям, хотелось сделать очень правдоподобно. Весь инвентарь отдельно делал в ГПТ 2 (карточки инвентаря он классно прям делает). Вся генерация видео Сиденский 2.5. в связке локации + герои + инвентарь + аудио голос. Голоса отдельно генерил всех на Фиш.аудио и закидывал сиду, он все равно корявил отдельные слова, но в целом с задачей так гораздо лучше справлялся, мимика получалась годной. Все промты писал с чат ГПТ и клодом со скиллами под сид именно на хиггсе (там у них есть какая-то условная система обозначений камер, которые ЛЛМ довольно умно выбирают под описанную ситуацию). Отдельно подчеркну про новую для меня систему Note-ов, которые надо писать в промтах отдельным блоком и они работают неплохо. Это когда надо в видосах подчеркнуть какие-то детали, уточнения, особенно важные и переходящие из видео в видео. Например у меня чуваки летали на аэрокатах все время становясь на них как хотят , в том числе ноги в воздухе и на пропеллерах и так было загублено множество генераций, пока я не сделал note точно закрепляющий их положение на платформе. Под конец у меня были десятки ноутов в промтах, а сами промты были по 10-12 листов А4 на 15 секундных сложных сценах. Саундтрек в Суно 5.5, монтаж Капкат про, время – около 90 часов. Работа в итоге попала в шорт-лист , но в призы не попала, но поделится с миром всё таки очень хочется, акцент в ролике на юморе ). Бюджет около 20 т.р.

@cgevent

Читать полностью…

Метаверсище и ИИще

Если вам интересно, как был сделан ролик из утреннего поста, то вам сюда. Посмотрите, так сказать, на первоисточник. И да, в утреннем посте Сиденс 2.5.

https://www.youtube.com/watch?v=S8Z3gGqc7W4

@cgevent

Читать полностью…

Метаверсище и ИИще

Триподнакопилость про Трипо.

На первый взгляд выглядит очень круто. Наконец-то можно увидеть топологию на всех демках.
Наконец-то Трипо перестали стесняться показывать сетки с топологией и стали показывать меши. Ну и в первый раз мы видим такое low poly. Плюс здесь наконец-то есть AI UV. Который Smart UV.

Подробнее про Tripo P2.0 Preview и Smart UV :

1. Что умеет Tripo P2.0 по сравнению с передыдущей архитектурой

* Native Quad Topology (Квадратная сетка): Огонь. Модель генерирует нативную 4-угольную (quad) топологию с правильным направлением ребер (*edge flow*!!!) и анатомическими лупами вокруг суставов, глаз и рта. Меш нутипа готов к риггингу и скиннингу.
* Игровой бюджет полигонов: Ограничение и контроль плотности сетки - до 25 000 квадов (или около 50 000 треугольников). Это готовый low-poly / mid-poly ассет для Unity / Unreal Engine, а не миллионная каша.
* Архитектура Spatial Diffusion: Модель генерирует базовую 3D-форму за секунды, а финальный отполированный меш с текстурами готовится в среднем за 2–3 минуты.
* Чистый Albedo / Delighting: Улучшено удаление запеченного освещения и теней из текстур, благодаря чему цвета ложатся нейтрально и корректно отображаются в движках с динамическим светом.
* Единый конвейер: Прямо в интерфейсе объединены: генерация -> нативная quad-сетка -> Smart UV -> удаление света -> авто-риггинг -> экспорт в FBX/GLTF.

О теперь десерт:

2. Smart UV и как он устроен

* Семантическая расстановка швов (AI Seam Placement): Оно понимает анатомию и геометрию объекта и режет швы так, как это делает кожаный - прячет разрезы на спине, внутренней стороне бедер и рук, под подбородком или вдоль швов одежды.
* Скорость ~5 секунд: Развертка лоу-поли персонажа или пропса просчитывается почти мгновенно.
* Поддержка сторонних мешей(ОГОНЬ): Оно работает не только для моделей, созданных в Tripo, но и для любых импортированных кастомных OBJ/FBX мешей.
* Вариативность и бесплатные повторы (Free Retries / Batch): Если первый вариант швов лег неудачно, можно сгенерировать альтернативные варианты раскладки.

Smart UV: открываем Tripo Studio -> Smart UV -> загружаем свою модель или выбираем созданную в Tripo -> UV Unwrap.

Официально поддерживается до 80 000 triangles или 40 000 quads.

По цене Smart UV:
- 2 модели бесплатно для всех, даже без подписки.
- После этого Smart UV доступен на Pro / Max / Team и стоит 20 credits за модель.
- На Pro/Max/Team для каждой модели дают 3 бесплатных Retry.
- Затем каждый дополнительный Retry - 10 credits.
- На Free/Starter после двух бесплатных моделей продолжать Smart UV, судя по официальной странице, нельзя


https://studio.tripo3d.ai/

@cgevent

Читать полностью…

Метаверсище и ИИще

Ответочка на ответочку. Пошла рекусивная жара!

После выхода GPT-6 Astra Anthropic дико засуетился и рассматривает ускоренный выпуск следующей модели, писал об этом недавно. Но самое смешное - пока Anthropic готовит ответачку на Astra, у OpenAI, похоже, уже готовится ответачка на эту ответачку.

По утечкам, следующий огромный pretrain OpenAI носит кодовое имя Bel.

Схема такая: Doug -> дальнейший RL/post-training -> GPT-6 Astra. Bel -> следующий цикл RL -> модель уже после Astra/GPT-6.
Источник утечки утверждает, что Bel - гигантский pretrain с >10 трлн total parameters, сопоставимый по общему размеру с GPT-4.5, и внутри OpenAI его рассматривают как базу следующего поколения, потенциально вплоть до модели их условного «AGI threshold». Прикиньте, они уже планируют наступление АГИ.

АшозаДуг?

Doug - предположительное внутреннее кодовое имя большого pretrain-чекпойнта OpenAI, который, по утечкам, после RL и post-training стал основой GPT-6 Astra.
Если утечки верны, Bel - его прямой преемник: следующий, ещё более крупный базовый pretrain, из которого OpenAI будет выращивать уже следующее поколение моделей.

Кстати, OpenAI уже как бы официально рассказала о новой внутренней модели, “significantly more capable than GPT-6 Astra”, обучение которой продолжается. Именно эту модель они юзали в масштабном эксперименте примерно с 10 000 параллельных агентов, закончившемся опубликованным решением задачи тысячелетия Навье-Стокса. OpenAI не говорит, что эта модель называется Bel, но мы то любим совпадения и теории заговора.

На итоге Anthropic пытается срочно бахнуть ответ на Astra, а OpenAI, возможно, уже тренирует ответ на ответ на Astra. Не исключено, что Антропик где-то в недрах готовит ответ на ответ на ответ.

@cgevent

Читать полностью…

Метаверсище и ИИще

Алибабищенко бахнул Qwen-Image 2.1 и выложил веса.

Это единая модель для генерации и редактирования изображений. Визуальная часть содержит 7B параметров и 32 Single-Stream DiT-блока. Сносно.

Ништяки:

- native 2K - базовое разрешение 2048x2048, поддерживаются в том числе 2752x1536 и 1536x2752;
- text-to-image и image editing в одной модели;
- до 10 референсных изображений одновременно;
- локальное редактирование можно задавать каракулями, нарисованными пометками или отдельными масками;
- улучшено сохранение идентичности людей и объектов при редактировании;
- улучшены типографика, портретное освещение, текстуры и мелкие детали;
- рекомендуемый стандартный режим - 40 inference steps.

Одна из самых интересных фишек - нативный RGBA и прозрачность. Модель умеет сразу генерировать объект с alpha-каналом(!), редактировать прозрачные изображения(хм) и даже типа взять обычную RGB-фотографию и извлечь из неё нужный объект в отдельный прозрачный RGBA-слой (верим? тестируем?).

Веса уже доступны на Hugging Face. Comfy Org также выложила набор весов Qwen-Image 2.1 для ComfyUI, а сама Comfy ещё до релиза заявляла нульдэй саппорт.

Лицензия - говно. Ресерч.

На рыддите, кто-то рыдает от восторга, особенно от эдит и консистентности, а кто-то ноет про кожу и мыло. Кожаным не угодишь. Жду тестов в коментах

Шопопамяти:

Хорошая новость: 24-32 GB VRAM для неё, похоже, вообще не обязательны.

На Reddit уже пишут, что модель должна нормально жить даже на RTX 3060 при квантизации.

Сама 7B-модель в INT8 около 7 GB + text encoder Qwen3-VL в W4A8 около 6 GB.

То есть суммарно порядка 13 GB весов, причём ComfyUI умеет выгружать части в RAM, поэтому 12 GB VRAM выглядит вполне нарядным вариантом.

Для нищебродов:
8 GB VRAM - скорее всего заведётся с агрессивной квантизацией/offload, но пока нет нормальных подтверждённых тестов именно Qwen-Image 2.1.
12 GB VRAM - выглядит как реальный рабочий минимум для квантованной версии в ComfyUI.

Для помещиков:
16 GB VRAM - сейчас выглядит как очень нормальный вариант. На Reddit владельцы 5060 Ti 16 GB уже радуюццо релизу именно в этом контексте.
24 GB VRAM - должно быть уже совсем комфортно для квантованной модели и, вероятно, позволит меньше гонять данные CPU<->GPU.

Для Баяр:
32 GB - может влезут и не кванты..

Почему такая разница с прежним Qwen Image: старая модель была огромной - около 20B параметров только генеративной части, а Qwen-Image 2.1 теперь жалкие 7B.

Ссылки:

Официальная страница Qwen:
qwen.ai/blog?id=qwen-image-2.1

Веса Qwen-Image 2.1:
huggingface.co/Qwen/Qwen-Image-2.1

Версия для ComfyUI:
huggingface.co/Comfy-Org/Qwen-Image-2.1

@cgevent

Читать полностью…

Метаверсище и ИИще

Code2video генерация - 2

Когда попросил Астрачку сделать Вила Смита, пожирающего спагетти. Кодом. И только кодом .

Мне нравится. Это новый бенчмарк для Code2video видосов.

И повод помолиться.

Сколько Вайб-Смитов дадим?

@cgevent

Читать полностью…

Метаверсище и ИИще

⚡️ 22 сентября в Санкт-Петербурге пройдет ИИ-день на международном Контент-Форуме

В КВЦ «Экспофорум» начнет работу ИИ-Хаб, который объединит представителей киноиндустрии, продюсеров, технологические компании и авторов, работающих с генеративными технологиями.

🟠 В программе дня поговорят о том, как ИИ уже меняет производство контента, а также покажут фильмы, созданные с помощью новых технологий. Среди участников программы — эксперты киноиндустрии, технологических компаний и авторы ИИ-фильмов.

➡️Днем, с 12:45 до 14:15, пройдет дискуссия «Инновационные технологии производства контента. ИИ: новый инструмент или новая реальность?» с участием представителей ведущих компаний киноиндустрии.

➡️А с 17:00 до 18:30 пройдут показы работ MyFilm48 и авторских ИИ-фильмов. Авторы представят свои работы и расскажут о процессе их создания.

📍 22 сентября · Санкт-Петербург · КВЦ «Экспофорум»

Вход бесплатный по предварительной аккредитации.

Зарегистрироваться можно 👉по ссылке

ℹ️ @myfilm48

#MyFilm48 #КонтентФорум #КиноЭкспо #ИИХаб #ИИвкино #генеративноекино #СанктПетербург

Читать полностью…
Subscribe to a channel