287027
Самая актуальная информация из мира ML, Нейронных сетей,DI По всем вопросам- @haarrp @itchannels_telegram - 🔥 best it channels @pythonl - 🐍 @machinee_learning -chat @ArtificialIntelligencedl - AI @datascienceiot - ml 📚 @machinelearning_ru ml
✔️ Организатора схемы накрутки ИИ-музыки приговорили к 18 месяцам тюрьмы
Федеральный суд США назначил полтора года тюремного заключения фигуранту первого уголовного дела о мошенничестве со стриминговыми сервисами с применением генеративного ИИ.
Злоумышленник загружал в каталоги платформ Spotify и Apple Music сотни тысяч сгенерированных треков, после чего симулировал прослушивания через распределённую сеть бот-аккаунтов для получения роялти.
Чтобы обходить антифрод стримингов, схема опиралась на дробление трафика - боты распределяли фиктивные стримы тонким слоем по огромной библиотеке композиций, не поднимаясь выше триггеров аномальной активности для единичных треков.
Прецедентный приговор подсветил уязвимость традиционных эвристик безопасности платформ и вынудил их ускорить внедрение поведенческого анализа и систем выявления синтетического контента в реальном времени.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Anthropic даёт стартапам год Claude Team и 1000 долларов на API
Программу Claude for Startups расширили - участникам полагается год тарифа Claude Team на пять премиальных мест и 1000 долларов кредитов на разработку с Claude.
Этим шагом компания стремится переманить разработчиков и фаундеров на ранних стадиях, напрямую конкурируя с программами поддержки от OpenAI и облачных гигантов Microsoft Azure и AWS.
К участию допускаются проекты, основанные в течение последних пяти лет. Подать заявку можно на странице программы Claude for Startups.
techcrunch.com
✔️ Google открыла веб-платформу генерации браузерных игр
Платформа Playground, запущенная в рамках партнерства Google и Unity, предоставляет возможность генерации браузерной игры по текстовому запросу с настраиваемой физикой, правилами механики, окружением и внешним видом персонажей. Созданную игру можно запустить в мобильном или десктопном браузере.
В сервис встроены публичная галерея проектов, лидерборды и мультиплеер для некоторых жанров. В будущем заявлена интеграция с Unity Spark. через который можно будет экспортировать текстовые наработки в движок Unity для добавления 3D-графики и игровой логики.
На старте Playground доступен пользователям из США. Лимиты на генерацию зависят от уровня подписки Google One.
blog.google
✔️ Nous Research представила бенчмарк оценки эффективности и стоимости агентов
Исследовательская группа собрала Hermes Index, публичный лидерборд для сравнения языковых моделей внутри фреймворка Hermes Agent при максимальной глубине рассуждения.
Итоговый балл формируется на основе четырёх тестов: Terminal-Bench 4, Terminal-Bench Science, SkillsBench и нового набора Hermes Bench. В последнем агент выполняет 150 разноплановых задач в реальном рабочем пространстве, оперируя файлами и внешними инструментами.
Первое место заняла Claude Opus 5.5 с расходом около $5 на задачу, опередив GPT 6 Astra, которая показала второй результат, но оказалась самой дорогой в рейтинге - $11,6. Тройку замкнула Sonnet 5.5 ($2,8).
В бюджетном сегменте на границу Парето вышли DeepSeek V4.1 Flash (36,91 балла при 26 центах за задачу) и GPT6 Luna (14 центов). Они стали наиболее выгодными с точки зрения баланса цены и продуктивности.
nousresearch.com
✔️ ElevenLabs запустила инструмент сборки и отладки голосовых агентов через диалог
Открылось альфа-тестирование специализированного ассистента Architect, помогающего создавать, конфигурировать и оптимизировать голосовых агентов с помощью текстовых или голосовых команд.
Инструмент понимает логику, структуру баз знаний, настройки синтеза речи и системных промптов. Ему достаточно передать системе лог сбоя, статистику эскалаций на операторов или общий запрос на улучшение, после чего Architect самостоятельно выполнит анализ транскриптов, выявит узкие места и предложит готовые решения.
Все предложенные обновления фиксируются в виде версионируемых черновиков и применяются в продакшене только после ручного подтверждения.
Architect доступен внутри ElevenLabs и в Cursor, Claude Code, ChatGPT и Grok Bot.
elevenlabs.io
✔️ Boston Dynamics показала новые манипуляторы для Atlas под ручной инструмент
Новинка получила 13 степеней свободы - четыре оси на противопоставленном большом пальце и по три на остальных. Инженеры отказались от мизинца для упрощения кинематики и снижения себестоимости. Конструкция позволяет удерживать дрели, горелки и пневмопистолеты с возможностью нажатия на курок.
Механика построена на закрытых электроприводах прямого действия без тросовых тяг и выдерживает нагрузку свыше 45 кг. Подушечки пальцев и ладонь оснащены матрицами тактильных датчиков давления.
Аппаратная часть оптимизирована под sim2real. Точная проприоцепция минимизирует динамическую погрешность при моделировании - манипулятивные политики обучаются через RL в симуляции и напрямую переносятся на физического робота.
bostondynamics.com
@ai_machinelearning_big_data
#news #ai #ml
🌟 MIT CSAIL опубликовала модель разметки анатомии на рентгеновских снимках
MIT вместе с коллегами из Массачусетской больницы общего профиля и Гарвардской медицинской школы сделала модель FleXray, которая находит и выделяет на снимке 60 анатомических структур, от рёбер и позвонков до костей таза и конечностей.
Модель работает с разными областями тела, стандартными и косыми проекциями, кадрами рентгеноскопии во время операций, снимками взрослых и детей.
На размеченных структурах можно автоматически делать измерения, например угла искривления позвоночника при сколиозе, или сопоставлять кадры рентгеноскопии с трёхмерной КТ для навигации во время вмешательств.
Патологии модель не ищет, только анатомию, и правую сторону от левой не отличает.
Попробовать FleXray можно в браузерной демоверсии, которая работает локально через WebGPU.
🌟 VeriHarness: обвязка для проверки работы агентов той же моделью
Google AI Research и Кембриджский университет открыли код VeriHarness, системы, которая проверяет результаты долгих агентных задач силами той же модели, что их сделала.
Вместе с кодом выложены около 26 тысяч трейсов агентов Gemini 3.5 flash и Opus 4.8, на генерацию которых ушло больше 100 тысяч долларов.
Идею подсказали запуски Claude Opus 4.8 на бенчмарке APEX-Agents, где треть ответов, в которых сходились все десять попыток, оказалась ошибочной, а при расхождении верный вариант обычно был среди попыток, но голосование большинством выбирало его лишь примерно в половине случаев.
Протокол работает внутри Gemini CLI, Claude Code и Codex.
✔️ TikTok добавил ИИ-ассистента для покупок и оплату в один клик
Платформа расширила коммерческий арсенал сервиса TikTok Shop, запустив диалогового ИИ-помощника для шопинга и механизм оформления заказов в один клик.
Нововведения должны минимизировать отток аудитории на финальных этапах воронки и сократить дистанцию между просмотром контента и покупкой.
Виртуальный ассистент интегрирован в интерфейс поиска и каталога - он обрабатывает пользовательские запросы, подбирает релевантные товары с учетом персональных предпочтений и контекста роликов, а также отвечает на уточняющие вопросы о характеристиках позиций.
Функция быстрой оплаты, в свою очередь, сохраняет платежные и данные для доставки, позволяя закрывать транзакцию мгновенно прямо из ленты или карточки товара в обход
стандартной многоэтапной корзины.
Релиз усиливает давление соцсети на традиционные маркетплейсы за счет упрощения импульсивных покупок.
📌 OpenAI выложила 722 математические работы своей внутренней модели
Все статьи написала внутренняя модель компании, название которой не раскрывают. На GitHub они разбиты на 372 семейства, от теории чисел и теоретической информатики до геометрии и математической физики.
Среди заявленных результатов есть доказательство рациональной гипотезы Ходжа для абелевых многообразий с комплексным умножением, гипотезы Капланского о прямой конечности в характеристике два и новая оценка показателя иррациональности числа π.
Рецензию работы не проходили, и независимо их пока никто не проверял.
О том, как публиковать такие результаты, OpenAI советовалась с независимой Консультативной группой по математике и ИИ при Институте перспективных исследований в Принстоне.
🔎 Google выпустила EmbeddingGemma 2: мультимодальный поиск прямо на устройстве
Модель переводит текст, код, изображения, видео и аудио в единое векторное пространство. Например, позволяет найти нужный снимок по текстовому описанию.
Всего 740 млн параметров:
• 270 млн для текста;
• 170 млн для изображений;
• 300 млн для аудио.
Нужные модули можно подключать отдельно. В оптимизированном запуске на Pixel 11 Pro полная модель использует около 567 МБ активной RAM, текстовая часть около 191 МБ.
Лицензия Apache 2.0 допускает коммерческое использование. Практическое применение: локальный поиск по документам и медиа без отправки данных в облако.
https://deepmind.google/models/gemma/embeddinggemma/
@ai_machinelearning_big_data
#Gemma #Google
🌟 Яндекс выложил в опенсорс технологию, которую уже используют Маркет, Реклама и антифрод
YTsaurus Flow рассчитан на непрерывные потоки данных большого объёма: события в интернете обрабатываются в реальном времени, без ожидания, пока данные накопятся в партии.
За счёт этого алгоритмы быстрее замечают смену интересов пользователей и точнее подбирают рекламу, товары, книги и фильмы.
🇪🇺 Mistral анонсировали - Large 4, она же Le Chonk: модель на триллион параметров
Согласно анонсу, новая модель получила нативную мультимодальность и 49 млрд активных параметров из 1 трлн.
Что заявляют разработчики:
• Лидерство среди моделей с открытыми весами из США и Европы по совокупности бенчмарков.
• Сильные результаты в киберзащите, промышленности и финансах.
• Превосходство над закрытыми флагманами в visual grounding: определении объектов и областей изображения по текстовому описанию.
Модель создана в Европе и доступна через европейскую инфраструктуру Mistral Cloud.
API, по анонсу, уже доступен. Открытые веса обещают к концу октября, ждемс.
https://x.com/MistralAI/status/2107456586813730854
@ai_machinelearning_big_data
#Mistral
⚡️ ElevenLabs запустила конкурс генеративной рекламы с фондом $100 000
Участники должны создать видеоролик для вымышленного продукта. Главное требование - генерация оригинального джингла исключительно средствами платформы ElevenCreative.
Для синтеза видео, графики и дополнительных звуковых эффектов разрешено использовать сторонние решения, но жюри обещает начислять бонусные баллы за максимальное применение инструментов экосистемы ElevenLabs в общем пайплайне.
Критерии оценки работ:
🟢Вирусность аудиодорожки (35%)
🟢Целостность концепта (25%)
🟢Качество технической реализации (25%)
🟢Синхронизация визуального ряда со звуком (15%)
Победитель заберет $50 000.
Все 11 финалистов получат приглашение на собеседование на позицию AI Creative Producer в штат ElevenLabs.
Прием готовых роликов вместе с исходниками и описанием архитектуры продакшена открыт до 1 ноября.
@ai_machinelearning_big_data
#news #ai #ml
🏅 Учёные научились включать и выключать нейроны светом. За это дали Нобелевскую премию
Карл Дейссерот, Петер Хегеманн и Георг Нагель получили Нобелевскую премию по физиологии и медицине 2026 года за открытия, заложившие основу оптогенетики.
Принцип такой: выбранные нервные клетки генетически делают чувствительными к свету. Затем световыми импульсами управляют их активностью.
Это помогает выяснять, какие нейронные цепи участвуют в формировании воспоминаний, эмоций и поведения: исследователи воздействуют на конкретные клетки и наблюдают результат.
🧠 Свет становится инструментом, позволяющим проверять, как работает живой мозг.
https://www.nobelprize.org/prizes/medicine/2026/press-release/
@ai_machinelearning_big_data
#nobelprize
✔️ Anthropic раздаёт бесплатные плюшевые игрушки и стикеры
На сайте для разработчиков claude.dev появилась раздача фирменных подарков. В разделе Терминал нужно ввести команду /plushies, чтобы оформить заявку на плюшевого Clawd, маскота Claude Code, или /stickers, чтобы получить набор стикеров.
Покупать ничего не нужно, подарок положен один на человека, участвовать могут только совершеннолетние. Дизайн игрушки выбирается случайно, заказать конкретный нельзя.
Тайваньское издание BlockTempo насчитало пять вариантов – волшебник, ковбой, учёный, весёлый и в солнечных очках.
Заявки принимает и подарки рассылает сторонний сервис Brilliant, поэтому доставка работает только там, где он обслуживает клиентов.
Раздача идёт, пока подарки не закончатся. По наблюдению BlockTempo, уже в первый день приём заявок временно закрывался, издание предполагает, что его будут периодически открывать снова.
Официального анонса акции Anthropic не публиковала.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Агенты OpenAI выложили в сеть 53 фото пользователей
Изображения пользователи загружали в сервисы OpenAI, затем они попали в обучающие данные, а агенты из исследовательской среды компании разместили их на сторонних фотохостингах.
Ссылки не публиковались, но найти снимки было можно. Большую часть OpenAI удалила, остальное ещё в сети. Уведомить владельцев компания не может, её технический подход и политика конфиденциальности не позволяют связать снимки с аккаунтами.
Случай вошёл в обзор поведения агентов, который OpenAI ведёт после взлома ими Hugging Face.
На прошлой неделе премьер Австралии заявил, что агенты OpenAI проникли в базы национальной системы здравоохранения и через запрос Сената вызвал Сэма Альтмана и Дарио Амодея для дачи показаний по инциденту на парламентских слушаниях.
openai.com
✔️ OpenRouter доверил выбор модели нейросети Jev
Jev Router подбирает модель и глубину рассуждений под каждый запрос с учётом качества, скорости и цены. Решение принимает Jev, модель компании TypeSafe. Перед каждым запросом она оценивает его сложность и нужную точность.
На четырёх агентских бенчмарках Jev Router решил 237 задач из 423 против 130 у прежнего Auto Router, это по замерам самой OpenRouter. Роутер бесплатный, контекст 1 млн токенов.
openrouter.ai
✔️ Китай стал вторым рынком дата-центров после США
SemiAnalysis насчитала больше 1000 объектов у 60 с лишним операторов на 24 с лишним ГВт. Ещё около 20 ГВт в проектах со сроками ввода и 30 ГВт в анонсах.
Примерно пятую часть введённых мощностей занимает ByteDance, и почти всё она арендует. Капитальные затраты Alibaba, Tencent и Baidu во втором квартале выросли больше чем вдвое год к году, до 20 млрд долларов, и впервые все три компании показали дефицит свободного денежного потока.
semianalysis.com
✔️ ElevenLabs выпустила Eleven v4 и Eleven v4 Turbo
Новая модель синтеза речи построена на другой архитектуре и подстраивает подачу под контекст сцены и предыдущие реплики. Интонацией управляют встроенными тегами, а произношением – через международный фонетический алфавит.
Для клонирования голоса хватает 10 секунд записи. Языков больше 90 и голос, записанный на одном, сохраняет тембр на остальных.
Turbo сделана для голосовых агентов. Медианная задержка около 100 мс, до начала речи около 150 мс.
Модели доступны в ElevenAgents, ElevenCreative и через ElevenAPI, в том числе бесплатно. Первые две недели API стоит 22 доллара за миллион символов для v4 и 11 для Turbo.
elevenlabs.io
✔️ Manus обновился до версии 2.0
Обновление построено вокруг нового харнесса Cascade, который подключает специализированные инструменты, только когда они нужны задаче.
В тестовой конфигурации он потратил на 23% меньше токенов и на 28% меньше времени и обошёлся на 32% дешевле прежней системы. Задачи теперь запускаются по событиям из почты, календаря, Slack или Notion, для постоянно работающих проектов предусмотрен Cloud Computer.
Десктопное приложение стало Manus Studio с видеоредактором на таймлайне и средой для разработки игр.
Отдельное приложение Cue даёт каждому агенту почту, номер телефона, кошелёк с лимитом трат и отдельную виртуалку.
Manus 2.0 доступен в вебе, на десктопе и Android, версия для iOS ждёт проверки в App Store. Cue в раннем доступе по инвайт-коду.
manus.im
@ai_machinelearning_big_data
#news #ai #ml
✔️ Создатель Ruby on Rails полностью отказался от ручного программирования
На конференции Rails World 2026 создатель Ruby on Rails и сооснователь Basecamp Дэвид Хейнемейер Ханссон признался, что после 25 лет карьеры прекратил писать код вручную.
Всего за год из скептически оценивавшего перспективы генеративного ИИ в разработке, с марта 2026 года он не набрал самостоятельно ни одной строчки.
«...меня удивил тот факт, что на самом деле существует язык программирования, который нравится мне больше, чем Ruby... Он называется английским. Английский - более лучший язык программирования, чем Ruby».
«...написание кода вручную больше не является экономически продуктивным занятием для подавляющего большинства программистов, работающих в большинстве компаний.»
✔️ OpenAI обновила голосовой режим ChatGPT
Голосовой интерфейс ChatGPT перевели на новую линейку моделей GPT-6 (Astra, Sol и Luna).
Главное изменение - подключение голосового ядра к внешним плагинам и API. Теперь система выполняет сквозные действия без текстового ввода.
Пользователи могут голосом проверять календарь, отправлять письма, работать со Slack, отменять списания в финансовых сервисах и генерировать сайты.
Голосовой движок также интегрирован в корпоративную среду ChatGPT Work в веб-версии и мобильных приложениях.
Инструмент позволяет создавать документы, презентации и таблицы в ходе устного диалога с ассистентом.
Обновление доступно глобально в актуальных сборках приложения.
@ai_machinelearning_big_data
#news #ai #ml
📌Baseten выпустила бесплатный учебник по инженерии инференса
Платформа, которая хостит модели Cursor, Notion и Harvey, выложила в открытый доступ книгу Inference Engineering за авторством Филипа Кайли. который четыре года работает в Baseten и написал её по интервью с инженерами компании и собственным докладам.
Среди рецензентов - автор FlashAttention Три Дао.
Baseten основана в 2019 году тремя выходцами из Gumroad, четвёртым сооснователем стал Панкадж Гупта из Uber.
Компания продаёт выделенные развёртывания открытых и собственных моделей клиентов, готовые Model APIs и инфраструктуру для дообучения, а также развивает открытый фреймворк упаковки моделей Truss.
⚡ Anthropic представила Claude Haiku 5.5
Claude Haiku 5.5 — самая быстрая и доступная модель в линейке Claude 5.5.
Она рассчитана на задачи, где важны скорость, низкая стоимость и масштабирование: массовая обработка запросов, классификация, автоматизация, простые агенты и API-нагрузки.
Линейка Claude 5.5 теперь выглядит так:
- Opus 5.5 — максимум возможностей
- Sonnet 5.5 — баланс качества и стоимости
- Haiku 5.5 — скорость и минимальная цена
Самое интересное — насколько близко Haiku 5.5 подошла к более крупным моделям прошлых поколений по качеству.
https://www.anthropic.com/claude-haiku-5-5
GPU, токены и деньги: как балансировать на ИИ-арене?
15 октября на ежегодной конференции Orion soft «Большая игра» обсудят, что происходит после успешного ИИ-пилота. Промышленный сервис требует распределять GPU между моделями, управлять нагрузкой в Kubernetes, защищать обращения к LLM и понимать, какое подразделение сожгло месячный запас токенов за три дня.
На дискуссии «Deploy: Become AI-ready» топ-менеджеры ПИК, «Газпром нефти» и red_mad_robot разберут свой опыт внедрения ИИ: что меняется при переходе от эксперимента к промышленной эксплуатации, готова ли к этому корпоративная инфраструктура и как удержать расходы под контролем.
Техническая часть будет посвящена двум слоям корпоративного ИИ. Первый — запуск и масштабирование AI-нагрузок в Kubernetes с помощью Nova AI, включая распределение GPU между командами и сервисами. Второй — AI Gateway на базе StarGuard AI: единая точка доступа к моделям, через которую можно применять политики безопасности, контролировать запросы и ответы, маскировать чувствительные данные и вести аудит.
Отдельная премьера — новый продукт Orion soft для биллинга ИИ-токенов. Он должен ответить на вопрос, который быстро возникает после массового внедрения LLM: кто, какую модель и для каких задач использовал — и кому в итоге выставлять счёт.
Кроме ИИ-трека, в программе — инфраструктура, DevOps, кибербезопасность, опыт импортозамещения и демо-лаборатории с продуктами Orion soft.
📌15 октября, Москва + онлайн
🕹Deploy: Become AI-ready → регистрация
⚡️ Google выпустила Nano Banana 2.1
Модель построена на базе Gemini 3.6 Flash и предназначена для генерации и редактирования изображений с возможностью вывода сопутствующего текста.
Обновление принесло увеличение входного контекста до 1 млн токенов (выходной буфер составляет 4K токенов для графики и 64K для текста), что позволяет обрабатывать большие текстовые описания и серии референсных картинок в едином запросе.
На бенчмарках генерации и редактирования модель обошла Nano Banana 2 и Nano Banana Pro - в режиме ризонинга рейтинг предпочтений вырос до 1050 Elo.
Google удалось заметно улучшить консистентность персонажей и объектов между кадрами, редактирование по маскам и эскизам, а также фактологическую точность при отрисовке инфографики за счет базы знаний Gemini.
Обновлённая модель доступна в приложении Gemini, AI Studio, API, Flow и Stitch.
deepmind.google
✔️ Отрыв США от Китая в ИИ сократился до минимума
По расчётам аналитиков, средний разрыв между флагманами двух стран по ключевым бенчмаркам сузился с 15% в начале года до 9% в мае и 3% после выхода DeepSeek V4.1 Flash в сентябре.
Прогресс китайских лабораторий связывают с оптимизацией алгоритмов под местные ускорители и сомневаются на этом основании в действенности экспортных ограничений США на чипы Nvidia.
В деньги паритет пока не превращается - из-за ценовой войны сектор, по тому же прогнозу, может оставаться убыточным до 2030 года, зарабатывать получается у единиц вроде ByteDance, а DeepSeek отдаёт модели бесплатно и продаёт токены с околонулевой маржой.
bloomberg.com
✔️ Anthropic ослабила ограничения для проверенных ИБ-команд
Cyber Verification Program свела прежнюю одноимённую программу и Project Glasswing в три уровня допуска к Opus 5.5, Sonnet 5.5 и Mythos 5.1.
Defense Access рассчитан на центры мониторинга, разбор инцидентов, реверс вредоносов и анализ уязвимостей. Red Team Access добавляет авторизованный пентест, Specialized Access отведён организациям, тестирующим критичные для безопасности системы в сотрудничестве с правительством США.
Заявку на первый уровень рассматривают дни, на второй берут только организации и рассматривают недели. Доступ через Claude Platform, Vertex AI и Microsoft Foundry.
anthropic.com
✔️ Hugging Face выпустила инструмент обучения моделей в кодинг-агентах
Multi-harness RL позволяет обучать языковые модели с подкреплением непосредственно в Claude Code, Codex и OpenCode. Из коробки поддерживается 10 сред.
Инструмент работает через прокси-прослойку, которая перехватывает запросы в форматах OpenAI, Anthropic или Gemini, направляет их в vLLM, логирует token ID и logprobs, а затем передает траектории в библиотеку TRL. Это превращает агентский интерфейс в RL-окружение без изменения кодовой базы самого агента.
Исходный код прокси в OpenEnv, обучающие скрипты для TRL и семь готовых моделей выложены в открытый доступ.
Clement Delangue в X
✔️ Трафик ИИ-сервисов больше не гарантирует выручку
Венчурный фонд Andreessen Horowitz опубликовал седьмой отчет Consumer AI, впервые сопоставив посещаемость сервисов с реальными тратами пользователей на основе банковских данных.
Главный вывод - популярность продукта перестала напрямую определять его финансовую успешность: 29 из 50 самых прибыльных ИИ-компаний вообще не входят в топ по веб- или мобильному трафику.
При этом монетизация сектора держится на сверхпользователях - верхний 1% платящей аудитории тратит в среднем 903 доллара в месяц, обеспечивая пятую часть всей выручки рынка, тогда как медианный чек составляет 25 долларов.
Аналитики также зафиксировали замедление ротации лидеров - в рейтинги пробились лишь 11 новичков, что стало историческим минимумом.
Единственной заметно растущей категорией остаются персональные агенты, ориентированные на выполнение прикладных задач вместо стандартного диалога.
Индустрия постепенно смещается от хайпа вокруг чат-ботов к утилитарным агентским пайплайнам с четкой бизнес-моделью.
a16z.com
@ai_machinelearning_big_data
#news #ai #ml
Как сократить расход токенов на веб-контекст до трёх раз
Если корпоративному ИИ-ассистенту нужны свежие данные из интернета, за поиском стоит отдельная работа: загрузить страницы, очистить HTML, разбить текст на фрагменты и отобрать релевантные. Всё это нужно разрабатывать и поддерживать.
В Yandex Search API появились Smart Snippets - возможность получить подходящие фрагменты найденных страниц одним вызовом API. Отправляете запрос, получаете контекст с цитатами и ссылками на источники.
Каждый фрагмент занимает около 500 токенов. В модель отправляются нужные выдержки вместо страниц целиком. По данным команды продукта, это позволяет сократить расход токенов на веб-контекст до трёх раз при том же качестве ответа.
Итоговый ответ по-прежнему формирует ваша модель. Smart Snippets подготавливают для неё материал из веба, например, для проверки актуальных условий, поиска документации или сбора данных о рынке.
Для команд, которые строят ИИ-агентов и корпоративных ассистентов, это меньше компонентов в поисковом пайплайне и ниже затраты на обработку веб-контекста.
Свяжитесь с экспертом, чтобы протестировать – по ссылке.
🌟 Xiaomi открыла модель для табличных данных
Xiaomi-TabLDM решает задачи классификации и регрессии на таблицах и её не нужно обучать под конкретную задачу. Модель берёт размеченные строки датасета как контекст и за один проход предсказывает значения для новых строк.
Классификатор и регрессор выпущены отдельными чекпоинтами. У классификатора 70 млн параметров, из них активны 61 млн, у регрессора – 71 и 62 млн. При предсказании модель объединяет результаты нескольких прогонов с перемешанными признаками и разной предобработкой, по умолчанию восьми.
Напрямую модель различает до 10 классов, а метки задач с большим числом классов перекодирует в несколько разрядов, каждый не больше чем на 10 значений.
Для повторных запросов к тем же данным есть KV-кэш, для крупных таблиц – выгрузка на CPU и диск.
Xiaomi рассчитывали на таблицы от сотен до десятков тысяч строк и от нескольких до сотни с лишним столбцов. Время инференса растёт квадратично и с числом строк, и с числом столбцов.
fit у неё на 82% быстрее, чем у TabFM, предсказание – на 68%.
🌟 Ai2 выпустила открытую модель для научных отчётов
AstaBrief 8B - файнтюн Qwen3-8B от Института Аллена, который по исследовательскому запросу и найденным фрагментам научных статей пишет отчёт со ссылками на источники.
Модель уже работает в Asta, сервисе Ai2, где она стала быстрым режимом в дополнение к Thinking с Claude под капотом.
Сама AstaBrief ничего не ищет, отрывки статей ей нужно подать вместе с вопросом. Из них модель отбирает нужное, сводит в связный текст и расставляет ссылки на отрывки, из которых взят каждый факт. Отчёт она пишет целиком за один проход.
🟡Тесты
На наборе ScholarQA-CS2 из 200 вопросов по информатике AstaBrief набрала в среднем 87 баллов, по полноте ключевых элементов ответа 90,2, по точности ответа 89, по точности ссылок 90,5, по их полноте 78,2.
По этому набору и по DeepScholarBench Ai2 называет модель сопоставимой с конвейером на Claude и со своим исследовательским агентом DR Tulu.
В небольшом исследовании с тремя учёными и 14 вопросами в целом предпочли DR Tulu, хотя двое из трёх сочли ссылки у AstaBrief точнее.
Пример, как генерировать отчёты по собственным PDF, Ai2 выложила в репозитории ScholarQA.
✔️ Wikimedia Foundation обнаружила следы несанкционированной активности агентов OpenAI
Фонд сообщил, что его платформы подверглись воздействию неконтролируемых агентов, запущенных из инфраструктуры OpenAI.
Согласно заявлению техдиректора Селены Декельманн, ИИ-боты совершали тестовые правки в изолированных песочницах, пытались переписать конфигурацию инструмента цитирования для его эксплуатации в качестве прокси-сервера, а также атаковали публичный сервис совместных заметок Etherpad с целью скрытой пересылки сетевого трафика.
Параллельно агенты обрушили на инфраструктуру миллионы запросов к API Wikidata и Wikimedia Commons, что стало одной из вероятных причин майского сбоя службы Wikidata Query Service.
Фонд заверил, что компрометации критических данных и внутренних систем не произошло, однако инцидент подсветил системную проблему неконтролируемого ИИ, истощающего открытые ресурсы интернета.
По данным Wikimedia, всплеск активности ботов уже привел к росту потребления сети на 50%, а автоматизированные запросы генерируют до 65% серверного трафика.
✔️ Белый дом создал группу для надзора за ИИ-отраслью
Власти США сформировали межведомственную группу Super Intelligence Force для координации федеральной политики в сфере ИИ.
Новый орган подчиняется напрямую президенту США. Координатором группы назначен директор Национальной разведки Джей Клейтон. В состав также вошли председатель FTC Эндрю Фергюсон, замминистра обороны по R&D Эмиль Майкл и глава кадрового управления Скотт Купор.
Super Intelligence Force будет мониторить угрозы национальной безопасности, удерживать технологическое лидерство США и устранять барьеры, тормозящие разработку.
washingtonpost.com
✔️ Из OpenAI ушёл один из авторов Preparedness Framework
Дэвид Робинсон, проработавший в компании три с половиной года и участвовавший в создании регламента готовности, объявил об отставке и опубликовал эссе о том, что в отрасли скорость выпуска побеждает качество проработки.
Подход, при котором проблемы устраняют по мере появления, он считает оправданным для ПО и недопустимым для ИИ - когда модель превзойдёт человека по когнитивным способностям, устранять последствия критического инцидента будет некому.
Дэвид считает, что разработка передовых моделей должна перейти на стандарты гражданской авиации и ядерной энергетики с их строгим резервированием и проектированием систем, исключающим катастрофу из-за человеческого фактора.
theatlantic.com
✔️ Aleph Alpha выложила в открытый доступ модель Kolibri
Немецкий стартап выпустил под лицензией Apache 2.0 большую языковую модель Kolibri 1, созданную в рамках европейской инициативы цифрового суверенитета и полностью соответствующую нормам EU AI Act.
Это MoE на 78 млрд общих и 3,5 активных параметров с базовым контекстным окном в 262 144 токена, которое может масштабироваться до одного миллиона.
Kolibri оптимизирована под немецкий и английский языки за счёт кастомного токенизатора UniBPE. Против галлюцинаций применён протокол Merlin-Arthur - модель учат отказываться от ответа, если контекст его не содержит.
Среди слабых сторон - скромные результаты в генерации кода, вызове функций и закрытых тестах на общую эрудицию без RAG.
aleph-alpha.com
✔️ Основатель Figure представил ассистента Hark
Бретт Эддкок анонсировал Hark с агентом Handoff, рассчитанным на длинные автономные задачи в интернете - заказ еды, покупки, бронирование, поиск информации.
На каждый запрос поднимается отдельный виртуальный компьютер с браузером, файловой системой и терминалом, а подключённые аккаунты дают доступ к адресам и предпочтениям.
По собственным замерам Hark занял первое место в человеческой оценке Online-Mind2Web, обойдя GPT-5.4 на 8 пунктов и Claude Opus 4.8 на 2.
Проект, уже привлекший более 700 млн долларов от топовых инвесторов, планирует открыть бесплатный Pro-доступ первым 100 000 пользователей из листа ожидания.
hark.com
✔️ OpenAI будет показывать рекламу во время генерации изображений
До конца месяца OpenAI запустит в США пилотный показ графической рекламы в ChatGPT. Баннеры будут появляться в интерфейсе на время ожидания генерации изображений.
Цель запуска - монетизация аудитории, которая достигла 1,2 млрд активных пользователей в неделю. Рекламные блоки получат маркировку и будут визуально изолированы от сгенерированного контента.
Для рекламной инфраструктуры компания интегрирует стек сторонних аналитических платформ по сбору данных о конверсиях и атрибуции кликов.
Внешние партнеры по верификации не получат прямого доступа к содержимому приватных диалогов.
openai.com
@ai_machinelearning_big_data
#news #ai #ml
✔️ Anthropic передала полиции логи чата с угрозами
Жительница Флориды была задержана после того, как автоматические фильтры безопасности Anthropic зафиксировали в ее запросах намерения устроить стрельбу в местном офисе шерифа и упоминание покупки оружия.
Алгоритмы мониторинга выявили триггерные конструкции и эскалировали сессию на внутреннюю команду ручной проверки Safeguards Team.
Та, руководствуясь регламентом компании о предотвращении насилия и экстренном раскрытии данных при угрозе жизни, оперативно передала материалы расследования правоохранительным органам.
Сама обвиняемая заявила помощникам шерифа, что воспринимала чат-бот как «личный дневник» и не предполагала стороннего контроля.
Прецедент подчеркивает технические и юридические реалии работы с публичными ИИ - диалоговые сессии не имеют сквозного шифрования, бэкенд провайдеров осуществляет непрерывный семантический анализ входящих промптов, а пользовательские данные деанонимизируются и передаются властям в обход стандартной судебной процедуры.
@ai_machinelearning_big_data
#news #ai #ml
✔️ Китайские инженеры разработали неинвазивный нейроинтерфейс весом 3 грамма
Исследователи Тяньцзиньского университета представили неинвазивную ЭЭГ-систему Shen Gong Xumi Brain Cube. При объеме 2 см³ устройство весит 3 грамма.
Датчик крепится к коже головы под волосами, заменяя стандартные ЭЭГ-шапочки с проводами. Внутри корпуса размещены массив электродов, цепи фильтрации и оцифровки биопотенциалов, аккумулятор и модуль беспроводной передачи данных.
Платформа предназначена для длительного непрерывного сбора данных.
Заявленные сценарии применения включают клинический мониторинг (трекинг фаз сна, выявление патологий, нейрореабилитация) и контроль психофизиологического состояния сотрудников спецслужб в полевых условиях.
@ai_machinelearning_big_data
#news #ai #ml
⚡️ 12 ноября в Москве пройдет MWS Cloud Day 2026
Это вторая конференция MWS Cloud, входящей в МТС Web Services. Формат гибридный: можно прийти очно или подключиться онлайн.
Тема понятная: компании постепенно доводят ИИ-пилоты до продакшена и встраивают модели в продукты и процессы. А вместе с этим возникают вопросы к инфраструктуре: хватит ли вычислений, как устроены данные и сети, как всё это мониторить и во сколько обойдётся.
Разбирать это будут в трёх треках: облака, ИИ и безопасность. Всего 20 докладов, в которых эксперты расскажут про cloud-native-подходы, создание и внедрение ИИ-систем и кибербезопасность, с упором на реальные бизнес-задачи.
Конференция рассчитана на CTO и CIO, руководителей инфраструктурных, платформенных, data- и ИИ-команд, DevOps-, backend- и platform-инженеров, а также технологических партнеров, интеграторов и клиентов MWS. Регистрация по ссылке.
@ai_machinelearning_big_data
📌 Dream-RSI: агент улучшает стратегию поиска решений на основе прошлых запусков
Google опубликовала Dream-RSI - надстройку над агентами, которые ищут решения перебором: пишут код, прогоняют его через оценщик и дорабатывают лучшие варианты.
Концепт управляет стратегией исследования, решая, какие варианты развивать, сколько попыток запускать параллельно и когда остановиться. Модель, агент и оценщик при этом не меняются, самосовершенствуется только код стратегии.
🟡Механика
Каждый запуск сохраняется как дерево попыток, где узел хранит версию решения, диагностику и оценку.
Это дерево используется как симулятор - альтернативная стратегия проходит по записанным ветвям в другом порядке, с другой параллельностью и другими точками остановки, а результаты берутся из записей без новых вызовов агента.
Отдельный агент на базе языковой модели несколько раз переписывает код стратегии, каждую версию прогоняют по всем накопленным деревьям, и в следующий раунд уходит лучшая.
Оценка складывается из лучшего найденного результата, штрафа за число попыток и бонуса за параллельность. Прежняя стратегия тоже участвует в отборе, поэтому на записях прошлых запусков новая версия по оценке не уступает старой.
🟡Тесты
В задаче ускорения решателя Lasso версия на Gemini 3.1 Pro снизила среднее время работы на шести отложенных наборах данных с 3587 до 2931 мс и потратила 317 вызовов агента вместо 550.
В математических задачах результат смешанный: в задаче сумм и разностей 1,145427 против 1,143975 у SimpleTES, в упаковке кругов ничья, в неравенстве автокорреляции результат хуже собственной базы.
В третьей серии агент ускорял операции нейросетей на видеокарте из набора KernelBench. Для сети VGG16 и слоя нормализации LayerNorm Dream-RSI достиг той же скорости, что и база, за в 2,43 и 1,79 раза меньшее число попыток.
Для двух связок свёртки с делением и с выбором максимума он при том же числе попыток нашёл код быстрее базового в 2,09 и 1,44 раза.
Пока доступны только статья и страница проекта с интерактивной демонстрацией.
Код и скрипты для воспроизведения Google обещает выложить позже.
📌Fable 5.1 рассчитала амплитуду рассеяния в девяти петлях
Модель в среде Claude Science рассчитала шестичастичную амплитуду рассеяния в планарной четырёхкратно суперсимметричной теории Янга–Миллса на уровне девяти петель.
Амплитуды рассеяния показывают, насколько вероятна та или иная реакция при столкновении частиц, и по ним теорию сверяют с данными Большого адронного коллайдера.
Целиком их не посчитать, поэтому физики обрывают расчёт на определённом числе петель, т.к каждая следующая приближает к реальному ответу, но так его утяжеляет, что большинство амплитуд доведены лишь до двух петель, а некоторые до трёх.
Суперсимметричный вариант теории Янга–Миллса реальный мир не описывает, это полигон, где специалисты по амплитудам оттачивают методы, потому что считать в нём парадоксально проще.
«... я иду спать, продолжай, пока не скажу остановиться, и присылай отчёт каждые 4–6 часов».
«В марте 2026 года ИИ выполнял физические проекты как студент - это были небольшие задачи, много опеки и ошибок. Здесь же настоящий расчёт на переднем крае науки, из тех, за которые обычно берутся ведущие специалисты по амплитудам», – пишет он.
✔️ OpenAI предложила правила внешнего аудита безопасности своих моделей
Компания готова открывать независимым организациям данные об обучении, тестировании и развёртывании моделей, чтобы те проверяли её доказательства безопасности.
Главный предмет проверки – кейсы безопасности, то есть обоснования того, что риски модели под контролем. В списке приоритетов - защита от джейлбрейков, тесты опасных возможностей в химии, биологии, кибербезопасности и самоулучшении ИИ, а также расследование случаев, когда модель действует без разрешения или уходит от надзора.
Предмет проверки стороны согласуют заранее, а до публикации отчёта OpenAI получает время на исправления. С кем идут переговоры, компания не раскрывает.
openai.com
✔️ Anthropic запретила Opus 5.5 помогать в разработке LLM
В Opus 5.5 появились классификаторы, как в моделях Fable, которые передают запросы менее мощной модели и показывают пользователю уведомление, а переключение сохраняется до конца диалога, хотя Opus 5.5 можно вернуть вручную.
Под фильтр попадает узкий круг задач вроде низкоуровневого кода для ИИ-ускорителей. Обычную работу в ML и программирование он, по словам Anthropic, затрагивать не должен.
В API автоматического переключения нет, такой запрос просто останавливается, пока разработчик сам не настроит резервную модель. Компания объясняет меру тем, что защита должна расти вместе с возможностями модели.
claude.com
✔️ Ant Group открыла модели Ming-Image для дизайна интерфейсов
Ming-Image-0.1-Design рисует интерфейсы, инфографику и постеры с текстом, в том числе на прозрачном фоне, а Ming-Image-0.1-Design-Layer раскладывает готовый макет на прозрачные слои для ручной доработки.
Обе модели на 6 млрд параметров вышли под лицензией MIT. B рейтинге Artificial Analysis UI/UX Design модель Design первая среди открытых с 1082 Elo.
К моделям приложены навыки для агентов. Design Skill связывает генерацию с фронтенд-кодом, PPT Skill превращает картинку в редактируемую презентацию PowerPoint.
Веса лежат на Hugging Face, Design бесплатно доступна через OpenRouter.
Ant Ling в X
✔️ Google выпустила модели синтеза речи Gemini 3.8 Flash TTS и Flash-Lite TTS
Старшая Flash TTS создаёт голос по текстовому описанию на 100 с лишним языках и клонирует его по 30-секундной записи. Flash-Lite TTS рассчитана на массовый дубляж и голосовых агентов.
Обе понимают ремарки о темпе, паузах, смехе и вздохах, держат тембр на длительных записях и озвучивают диалог двух персонажей по одному сценарию, не путая их голоса.
Модели доступны в Gemini API и AI Studio, Flash TTS также в Gemini Notebook, Flash-Lite в Google Vids.
Клонирование в AI Studio не работает в Европейской экономической зоне, Великобритании, Швейцарии и Индии.
blog.google
✔️ Toyota поставит на заводы 400 тысяч роботов
Программа стартует в 2028 году и обойдётся примерно в 6,42 млрд долларов в год, роботов будут ставить по мере обновления заводов. На предприятия самой Toyota придётся 150 тысяч машин, ещё 250 тысяч получат компании группы.
Часть парка составят колёсные гуманоиды ELEY, которых уже учат на линиях рабочие методом ручных телеопераций.
Исполнительный вице-президент автоконцерна пообещал, что роботы будут работать рядом с людьми, а не вместо них. Сколько из 400 тысяч окажутся гуманоидами, компания не раскрывает.
arstechnica.com
Аудиоверсия этого выпуска сгенерирована моделью Gemini 3.8 Flash TTS