93643
Культурно освещаю самые и не самые важные новости из мира AI, и облагораживаю их своим авторитетным профессиональным мнением. В свободное время работаю как Staff Research Scientist в Meta Generative AI в Швейцарии. Aвтор: @asanakoy PR: @ssnowysnow
Почему роботов учат в симуляторах
Собирать данные на реальных роботах дорого и долго. Симуляторы позволяют менять условия, повторять эксперименты и проверять опасные сценарии без риска повредить оборудование.
Но успешное обучение в симуляции не гарантирует такой же результат на реальном роботе. Проверка и перенос на железо требуют понимания физики, механики и работы сенсоров.
Как подготовить инженеров для Physical AI с таким набором компетенций, обсуждали на образовательной конференции Яндекса. В ИТМО, например, классическую роботехнику дополнили изучением AI-инструментов. Так сохраняется классический инженерный бэкграунд и формируется новая экспертиза в машинном обучении. Крайне актуальный для AI/ML вопрос, ведь таких компетенций обычно не ожидается от типичного специалиста.
@ai_newz
Google отправили четыре TPU в космос
Прототип Project Suncatcher вышел на орбиту 1 октября на ракете SpaceX в рамках миссии Transporter-18. Спутник сделали вместе с Planet, на борту четыре TPU. Google уже подтвердили связь с аппаратом и штатную работу.
В ближайшие недели будут проверять, как чипы переносят радиацию и перепады температур в реальных условиях. Это первый орбитальный эксперимент проекта, который изучает возможность масштабировать вычисления для ИИ в космосе.
Солнечные панели на подходящей орбите могут давать до восьми раз больше энергии, чем на Земле. А вот с охлаждением придётся повозиться. В вакууме нет воздуха, поэтому тепло от TPU отводят через тепловые трубки и радиаторы. Холодный космос сам по себе проблему перегрева не решает.
Анонс
Запуск
Подробности
@ai_newz
Что показали OpenAI на DevDay
Главный анонс — dots, конкурент Muse и Grok Bot. Это постоянно работающий агент с собственным облачным компьютером, при этом dots не используют лимиты Codex. Фича доступна для Pro, Business Premium и Enterprise подписок.
GPT 6.1 Sol — OpenAI решили заспидранить цикл релиза новой версии, с релиза GPT 6 Sol прошла всего неделя. Обещают почти уровень Astra, при цене токенов в 5x меньше.
Анонсировали Pro Max подписку — $500 за 25x использования от Plus плана, подписка включает в себя Ultrafast режим для Astra, он в 8 раз быстрее и в 6 раз дороже. Также Ultrafast запустили в API и обещают добавить Ultrafast режим для GPT 6.1 Sol.
Лимиты OpenAI подписки теперь можно использовать в 16 сторонних апках (Devin, Notion, OpenClaw), зайдя в них через ChatGPT. Надеюсь это раскатают на больше количество приложений.
Decisions API — у OpenAI ушло всего две недели на то чтобы склонировать Jev и запустить конкурента на основе Luna. Пока что доступно по API в приватном превью, обещают раскатать публично в ближайшие дни.
@ai_newz
Что в тренде на IROS 2026: мои впечатления
Походил по постер-сессиям, поговорил с авторами и вот что на повестке дня:
1. VLA везде. Модели, которые по картинке и текстовой команде сразу выдают действия робота, — главная тема года. Только про них в программе 8 отдельных сессий.
2. Роботы учатся чувствовать. Очень много работ про силу, контакт и тактильные сенсоры. Похоже, все поняли: для работы руками одних камер мало.
3. Диффузия и flow matching теперь генерируют не картинки, а движения робота.
4. Гуманоиды. Их тут много, от ходьбы до управления всем телом, а на соревновании они сами собирают мебель из IKEA.
5. Почти все учится на данных: reinforcement learning и imitation learning - в каждой второй работе, которую я видел.
В общем, ощущение такое, что роботы сейчас примерно там, где языковые модели были пару лет назад. Модели уже умеют многое, а всё упирается в данные: реальных записей с роботов пока очень мало. Для языковых моделей есть целый интернет, а роботы пока только начинают учиться.
@ai_newz
Что за конференция?
IROS — International Conference on Intelligent Robots and Systems, одна из двух главных мировых конференций по робототехнике наравне с ICRA.
В этом году в программе около 1900 статей, а кроме докладов — воркшопы, живые демо и соревнования. Например, гуманоиды Unitree G1 полностью автономно собирают детский стол из IKEA, а двурукие роботы складывают бумажный самолётик, который потом оценивает мастер оригами.
@ai_newz
OpenAI режут лимиты $200 подписки Pro в два раза
Вместе с этим снова открывают возможность подписаться на этот тир подписки. Оправдывают это тем что количество сделанного всё равно будет выше чем у Pro подписки месяц назад (пока ещё не вышла Astra) и тем что обещают не возвращать пятичасовые лимиты. Плюс обещают добавить в подписку что-то новое, что не будет юзать лимиты.
Ну и это всё происходит на фоне отмены релиза Astra 6.1, из-за волнений по поводу безопасности модели, и слухов о грядущем Pro Max плане за $500. А у основного конкурента, Anthropic, как раз вышли очень удачные Opus 5.5 и Sonnet 5.5.
@ai_newz
Про ML в маркетплейсах
Ozon Tech традиционно провёл ко Дню программиста конференцию E-CODE. Записи докладов уже выложили. В треке ML/DS разбирали в том числе рекомендательную систему Ozon. Компания постепенно переводит на нейросетевые модели разные этапы пайплайна, от отбора кандидатов до финального ранжирования. При этом система должна учитывать продажи, рекламу, вовлечённость и LTV. В докладе также разобрали архитектуру Large User Model, которая объединяет пользовательские сигналы, включая негативную обратную связь.
Другой доклад посвятили измерению габаритов товаров на конвейере с помощью стереокамеры, сегментации и 3D-реконструкции. Для этой задачи собрали датасет из более чем 100 000 изображений, а для полуавтоматической разметки использовали Grounding DINO и SAM2. Товары движутся со скоростью до 1 м/с, так что помимо точности важна и скорость обработки. Команда сравнивала ML-подход с классическими методами и подходами на основе облаков точек по качеству, стоимости и производительности.
Вообще все шесть докладов трека достойны внимания. Посмотреть можно здесь
Ещё из примечательного: на конференции подвели итоги ежегодного ML-соревнования E-CUP. В этом сезоне его проводили только для студентов. Победители разделили призовой фонд 7,2 млн рублей за решения задач на реальных данных Ozon.
@ai_newz
LLM становятся частью рабочих процессов
Скиллы позволяют один раз задать порядок работы с документом или отчётом и затем его переиспользовать. Агенту не нужно повторять одни и те же инструкции в каждом запросе.
Голосовые агенты через Realtime API могут вести диалог и вызывать инструменты по ходу разговора, например искать по файлам или обращаться к CRM. Это позволяет связать разговор с данными и сервисами компании.
На Yandex Scale Яндекс показал оба направления. В AI Studio появились переиспользуемые навыки и новая модель синтеза речи. В Алисе AI Про собрали навыки и плагины, а внутренние сервисы можно подключать через MCP.
@ai_newz
Нейродайджест за неделю (#131)
LLM
- Siri AI — Apple запустила англоязычную бету с личным контекстом, пониманием экрана и действиями между приложениями.
- Gemini 3.8 Live — две голосовые модели с визуальным контекстом и фоновыми tool calls. Extended Thinking умеет рассуждать и говорить одновременно.
- Qwen3.8-Omni-Flash — принимает текст, изображения, аудио и видео, имеет контекст 1M и возвращает текст. Есть thinking, function calling и веб-поиск.
- Jev — модель TypeSafe вместо текста выдаёт типизированные решения с вероятностями. Заявленная задержка 70–500 мс, доступ пока ранний.
Генеративные модели
- Qwen-Image 2.1 — единая 7B-модель для генерации и редактирования в 2K. Поддерживает RGBA, до 10 референсов и локальные маски; веса доступны по research-лицензии.
- Vidu S2 — 720p-аватары и редактирование входящего видеопотока в реальном времени: замена персонажа, одежды, фона и стиля.
- Boreal — модель Creatify для рекламных text-to-video и image-to-video, дообученная на открытой LTX-2.5. Заявленная цена через fal — около $0,01 за секунду, но она ещё ждёт финального подтверждения.
- HiDream O1 Video — image-to-video модель с асинхронным API: принимает один референс и промпт, а длительность определяет сама либо фиксирует на 10 секундах.
- Enhance Frame Rate — инструмент Runway для готовых роликов: работает с видео до 4K, повышает частоту до 120 fps и сохраняет исходное разрешение.
Агенты и продукты
- Claude собрали воедино — чат, Cowork и Design объединяются; появились редактируемые Docs и Slides с экспортом в PDF и PowerPoint.
- ChatGPT в Office — один add-in работает в Word, Excel и PowerPoint, умеет править открытый файл и подтягивать контекст из подключённых приложений.
- Astra for Law — GPT-6 Astra получила юридический поиск по праву США и 26 интеграций. Доступ пока дают выбранным американским юрфирмам.
- Агенты в DaVinci — Resolve Studio 21.1 добавил интеграцию AI-ассистентов для работы с медиатекой, монтажом и рендером.
Безопасность и исследования
- Claude помог взломать OpenAI — Hacktron с помощью Opus построили эксплойт, а цепочка из RCE и ошибки SSO дала доступ к аккаунту сотрудника и внутреннему репозиторию. Уязвимости уже закрыты.
- Оценщик внутри Anthropic — Accenture — международная консалтинговая и технологическая компания, которая внедряет ИИ для бизнеса и государства. Её специализированное AI-подразделение Faculty получит доступ уровня сотрудника для red teaming и проверки safeguards; работу напрямую финансирует Anthropic.
> Читать дайджест #130
#дайджест
@ai_newz
GPT 6 Sol и Luna
Лучше чем 5.6, при этом в два раза дешевле и использует меньше лимитов Codex. Sol теперь стоит $2/$10 за миллион токенов, прямо как Sonnet. Цену Luna вообще скинули до $0.1/$0.5 за миллион токенов, то есть цену по сравнению с оригинальной 5.6 Luna сбросили в 10 раз. Ну и подписчикам завезли banked reset.
Блогпост
@ai_newz
Вышел Grok 4.7
Заметный прирост при той же цене и скорости. Маск ранее заявлял что Grok 4.7 должен быть новый претрейн на 2.1 триллиона параметров, но похоже планы поменялись. А тем временм Grok 4.8 с 2.5T параметров должен был закончить тренировку на прошлой неделе и, скорее всего, сейчас уже на стадии RL.
@ai_newz
Сейчас более рискованно оставаться в найме, чем делать свой стартап
Можно начать с малого: запустить свой небольшой IT-проект.
Но большинство застревает ещё до запуска:
• какую идею выбрать;
• где искать первых пользователей без бюджета;
• как не потратить полгода на продукт, который никто не купит.
В комьюнити Короче, капитан выработали формулу:
найти существующий спрос ➡️ собрать минимальную версию продукта ➡️ протестировать на реальных пользователя
И это работает в разных нишах:
— Парень в одиночку собрал Telegram-игру с AI и заработал около $1500 за первые полтора месяца;
— Девушка без навыков программирования запустила AI-бота для изучения английского и получила первые ~$200 уже в первый месяц;
— У другого участника коммьюнити сервис для тренировки китайского произношения вырос до $4000 в месяц без затрат на рекламу — за счёт Google и продвижения внутри сторов.
Это не истории про «гениальную идею» и миллионы через неделю. А примеры того, как маленький продукт можно запустить без команды и инвестиций. Получить результат, а уже потом решать, стоит ли его масштабировать.
В канале @its_capitan:
• разбирают такие проекты
• делятся реальными цифрами
• показывают, где были ошибки
Подписывайтесь, чтобы знать, как надо и НЕ надо запускать продукты.
#промо
😮 это все из-за нового гигачата - слишком мощным оказался )))
А если серьезно, то подумайте кому это выгодно – сдерживать своих конкурентов, а также раздувать хайп об угрозах AGI, перед выходом на IPO. AGI уже вот-вот появится, если прям ща все не запретить!))
Ну, а китацы точно клали болт на эти вопли в X, они ничего замедлять уж точно не собираются.
@ai_newz
Ну а тем временем HuggingFace 🤗 показали робо-утку за $399
https://pollen-robotics.com/microduck/
@ai_newz
Индустрия перепродажи подписок на нейросети
На площадке ggsel можно взять доступы к разным сервисам с хорошим дисконтом.
Сразу стоит понимать суть схемы. Это не белый сервис, а продажа "серых" аккаунтов от частных селлеров. Достаются они различными способами: через ботов, автореги и пр. По отзывам подписчиков, из-за такой подозрительной активности подписка может слететь в любой момент.
Но низкий прайс с лихвой перекрывает риски, будь то условный Gemini PRO или Adobe.
Из плюсов - спокойно проходит оплата по ру-картам.
Тема отлично спасает, если нужно много учёток для массового прожигания токенов, например в Codex, но не хочется руками регистрировать новые почты.
При таких копеечных затратах зачастую проще поднять новый аккаунт, чем пытаться выбить замену у продавца.
Но я ни в коем случае не агитирую пользоваться серыми схемами, т.к. это нарушает Terms of Use. Пишу этот пост чисто для информации.
ggsel
@ai_newz
Нейродайджест за неделю (#133)
LLM
- DevDay OpenAI — OpenAI представила постоянно работающих агентов dots, модель GPT-6.1 Sol и подписку Pro за $500 с Astra Ultrafast.
- Лимиты ChatGPT Pro — OpenAI вдвое уменьшает лимит использования ChatGPT Pro за $200 в пересчёте на стоимость тех же запросов в API. Цена подписки не меняется. Компания ссылается на удешевление GPT-6 Sol и Luna и обещает не возвращать пятичасовые лимиты. Изменения войдут в силу в конце месяца, подписчикам раздали эквивалент $2500 в кредитах.
- Gemini 4 Argon — закрытое превью для киберзащитников. Первое время цена будет $2/$10 за миллион токенов, такая же как у Sonnet и Sol, потом её увеличат вдвое.
Генеративные модели
- Репортаж с IROS — прямое включение из Питтсбурга: VLA, тактильные сенсоры и гуманоиды, собирающие мебель IKEA. Миша из магистратуры AI Robotic также рассказал о своей модели HapticVLA, которая учится на тактильных данных, а работает без датчиков касания.
Прочее
- ML в Ozon — записи докладов с E-CODE о нейросетевых рекомендациях и измерении габаритов товаров с помощью стереокамеры и 3D-реконструкции.
- TPU на орбите — Google запустила прототип Project Suncatcher. На спутнике проверят работу TPU при воздействии радиации и перепадах температуры.
> Читать дайджест #132
#дайджест
@ai_newz
Google очнулся и показал Gemini 4 Argon
Заявляют что модель тягается с Astra, Fable и новым опусом. Пока что доступна в закрытом превью, обещают полноценный релиз "скоро", доступ будет сначала у подписчиков Ultra и через API. Первое время цена будет $2/$10 за миллион токенов, такая же как у Sonnet и Sol, потом её увеличат вдвое.
@ai_newz
HapticVLA: как научить робота чувствовать без датчиков касания?
Одна из ключевых задач Physical AI заключается в том, чтобы научить роботов взаимодействовать с физическим миром, в том числе контролировать силу захвата и аккуратно работать с хрупкими предметами.
В нашей работе HapticVLA мы предложили использовать тактильные сенсоры только во время обучения. Сначала модель учится с их помощью, а затем полученные знания переносятся в VLA-модель, которая работает без датчиков касания.
В экспериментах HapticVLA достигла 86,7% успешных выполнений на трёх задачах с предметами разной степени хрупкости: пластиковой банкой, вафлями и яйцами.
Наш подход позволяет использовать тактильную информацию для обучения роботов без необходимости оснащать их дополнительными сенсорами при реальном применении.
Я начал работу над HapticVLA после поступления на совместную магистерскую программу AI Robotics Яндекса и Сколтеха. Параллельно с учёбой исследование заняло около полугода.
Статья на arxiv
—
Спасибо Мише за годные инсайды прямиком с IROS! На самом деле очень сложно с нуля за полгода сделать проект, который залетит и будет принят на топовую конфу, поэтому это мощно!
Накидайте Мише реакций за эксклюзив и пишите вопросы в комменты, пока он там на месте.
@ai_newz
Я здесь не просто так, а со статьёй HapticVLA. Мы научили VLA-модель бережно работать с хрупкими предметами — яйцами, вафлями, банкой с мармеладом. Тактильные сенсоры нужны ей только на обучении, а на самом роботе датчиков касания нет вообще. Подробности в отдельном посте.
А пока покажу, как конференция выглядит изнутри и что сейчас в тренде в робототехнике.
@ai_newz
Эксклюзив с конференции по robotics - IROS 2026
Этим летом я сам лично до США не добрался (сейчас как раз жду визу). Обычно я езжу только на AI / Vision конференции, но сегодня будет прямое включение с топовой конференции по роботикс, так что без инсайдов мы не останемся.
Сегодня у нас на канале репортаж от Миши, который получил Lightning Talk со своей статьей на IROS. Будет прямое включение с конфы из Питтсбурга, и мы увидим, куда прямо сейчас движется робототехника.
@ai_newz
Нейродайджест за неделю (#132)
LLM
- GPT-6 Sol и Luna — OpenAI выпустила две модели с API-ценами $2/$10 и $0,10/$0,50 за миллион входных/выходных токенов.
- Claude Opus 5.5 — Anthropic заявляет уровень Fable 5.1 на большинстве задач; цена в API — $4/$20 за миллион токенов.
- Alice AI Foundation — Яндекс открыл веса MoE-претрейна 80B-A3B, обученного с нуля, под Apache 2.0.
- Grok 4.7 — xAI перешла на более крупную базовую модель, сохранив цену и скорость Grok 4.6.
Генеративные модели
- FLUX 3 Action — BFL открыла веса 7B-модели, которая совместно предсказывает кадры и действия робота. На симуляционном RoboLab-120 компания сообщает о 42,9% успешных попыток.
Прочее
- Алиса AI Про — Яндекс добавил корпоративному агенту настраиваемые навыки и подключение сервисов по MCP; в AI Studio появились новые голосовые модели.
- Pro Max за $500? — в конфигурации ChatGPT нашли следы нового тарифа с ускоренным Work и Codex. Цена и дата запуска официально не подтверждены.
> Читать дайджест #131
#дайджест
@ai_newz
BFL выпустили FLUX 3 Action для управления роботами
BFL дообучили основу видеомодели FLUX 3 на записях работы роботов, где кадры с камер синхронизированы с положениями суставов и действиями. Модель на 7B учится совместно восстанавливать из шума будущие кадры и последовательность движений.
По текстовой задаче, текущим кадрам и состоянию робота она предсказывает движения суставов и захвата вместе с их визуальным результатом. Робот исполняет часть команд, получает новые кадры и пересчитывает следующие движения.
На симуляционном RoboLab-120 заняли первое место с 42.9% успешных попыток против 36.8% у Cosmos 3 Nano на 16B. Под нового робота нужно дообучение. Веса под FLUX Kommunity License, код под Apache 2.0.
Техрепорт
Веса
Код
@ai_newz
OpenAI готовит Pro Max подписку за $500 в месяц
Датамайнеры нашли упоминания нового тира подписки в фронтенде ChatGPT, из уникальных фич "более быстрый Codex и Work", скорее всего речь идёт о доступе к Cerebras в подписке. Насколько большие там лимиты непонятно, а представить её могут уже на DevDay в следующий вторник. Ну а тем временем оформить Pro подписку за $200 всё ещё нельзя.
@ai_newz
Яндекс открыл веса Alice AI Foundation LLM
Alice AI Foundation LLM представляет собой собственный MoE-претрейн Яндекса. Весь цикл обучения провели с нуля, без стартовых весов сторонних открытых моделей.
В модели 80B параметров, из которых на каждый токен активируются 3B. Это меньше, чем у большинства других открытых претрейнов, но по бенчам результаты в паритете, а иногда и лучше. При обучении отдельно оптимизировали обмен данными между видеокартами и отбор материалов, чтобы сократить вычисления при сохранении качества. В техрепорте есть комплиментарный замер с Nemotron и Qwen – с кодом и с математикой. Плюс к этому заявляют, что заложили базу для рассуждений ещё на претрейне.
Модель выпустили под Apache 2.0, её можно свободно использовать и дообучать. За пару дней у модели уже больше 2000 скачиваний на HF.
Техрепорт
Веса на HF
@ai_newz
Anthropic выпустили Opus 5.5
По бенчам лучше Fable 5.1, уже доступен в чате, клод коде и апи. Цену за токен снизили по сравнению с Opus 5 — теперь она $4/$20 за миллион токенов. Кроме этого повысили пятичасовые лимиты и дали banked ресет.
@ai_newz
Вас тоже напрягают записывальщики митингов, которых все сейчас таскают по созвонам? (меня да, как CEO часто с этим сталкиваюсь). А ведь еще часто записывают, ничего мне не говоря, через wispr или granola.
Как и следовало ожидать нашлись люди, которые придумали продукт для противостояния этому.
Локально крутится LLM, которая адверсариально натренирована против wispr и прочих voice2text моделей. Она в риалтайме добавляет adversarial noise к вашему аудиостриму, который ломает распознавалки речи на другой стороне.
Из минусов - это сейчас иногда превращает вашу речь в что-то, что трудно распарсить и человеку, кек))
Теперь voice2text модели придется регулярно перетренировывать, чтобы они были робастными к таким атакам!
Ну а вообще респект ребятам, довести до ума, убрать явный шум и будет полезный продукт, для поддержания privacy звонков.
Сам продукт
@ai_newz
Нейродайджест за неделю (#130)
LLM
- Astra в Blender — Два примера видосов, которые модель делает через Blender.
- GigaChat 3.5 Reasoning — Сбер открыли веса MoE 432B-A28B. Шесть экспертов обучали через online RL, затем объединили в одну модель.
Генеративные модели
- ChatGPT Images 2.5 — Более точечные правки и меньше искажений при последовательном редактировании. В Flare примерно в 1,9 раза быстрее Sunburst, но уступает по качеству.
- AuK — Tencent открыли генератор и редактор речи по текстовым инструкциям. Меняет слова, голос и эмоции в записи; есть веса и ComfyUI-ноды.
- Krea Agents — Агент для генерации контента с файловой системой, скиллами и моделями в одном интерфейсе.
Прочее
- Кому достаётся компьют — По оценке Epoch оценили кто является конечным пользователем вычислительных мощностей.
- Притормозите ИИ — Дарио Амодеи призвал замедлить развитие моделей. Кому выгодны такие призывы и при чём тут конкуренция.
> Читать дайджест #129
#дайджест
@ai_newz
OpenAI будут давать по бесплатному ресету всем подписчикам каждый день пока нет доступа к Astra. Такие ресеты можно применять в любой момент в течении месяца.
@ai_newz
Новая линейка моделей GigaEmbeddings в открытом доступе
Бесплатные модели под лицензией MIT, переводят текст в векторы для RAG-системы и поиска по смыслу. Стали сильнее на английском языке и особенно в задачах с кодом, получили поддержку vLLM и SGLang и подходят для разных требований к качеству и производительности. На выбор дали три размера — от совсем легкой 480M до флагмана на 10B.
При обучении гоняли открытые датасеты Nemotron, F2LLM и KALM, плюс использовали дистилляцию для младшей версии. В итоге 10B-A1.8B взяла первое место в ruMTEB и ускорила инференс в два раза, 3B прибавила 14,5 пункта в коде, а 480M стала лучшей на русском среди малопараметрических моделей.
@ai_newz
Встречайте GLM 5.3
Прирост по сравнению с 5.2 был достигнут иключительно масштабированием RL, причём упор был на RL на реальный задачах, вроде оптимизации тренировки модели. Внезапно такой подход дал очень хороший буст в кибербезопасности — компания заявляет что их модели смогли найти 2.5к уязвимостей с момента релиза GLM 5.2, причём самой старой уязвимости 45 лет. Весов пока что нет, обещают через две недели.
Блогпост
@ai_newz