doomgrad | Unsorted

Telegram-канал doomgrad - Градиент обреченный

8433

lingtra.in habr.com/ru/users/averkij/ hfday.ru

Subscribe to a channel

Градиент обреченный

Mistral OCR 3

Mistral выпустили новую модель для распознавания текстов. В демо примерах она разбирается даже с врачебным почерком (на английском), мой рукописный текст нормально не распознала.

Работает быстро, есть доступ по API за $2 доллара за 1000 страниц, а если посылать батчами, то за $1. Есть playground попробовать.

Сделал Colab, чтобы попробовать автоматизировать распознавание через API (ссылка).

Есть нюанс. Последняя модель mistral-ocr-latest на моем тексте (попробовал распознать удмуртский pdf) почему-то поубирала диакритики с кириллических букв (ӵ, ӟ и т.д.), а это важно. Предыдущая модель mistral-ocr-2505 их сохраняет. Возможно, что затюнили на рукописные тексты и всякие low-res картинки, чтобы подтянуть бенчи.

Вышла новая, используем старую.

https://mistral.ai/news/mistral-ocr-3

Читать полностью…

Градиент обреченный

Прохожу мимо Лебедева в офисе и чувствую, что мы тут делаем настоящие крутые отечественные православные модели, а они с их геминаями могут дружно пойти…

Ух, все, отпустило, далеко отошел.

Читать полностью…

Градиент обреченный

Друзья, это шедевр

https://notebooklm.google.com/notebook/2ce0360f-5182-4f72-98b2-8a6accfedd82

Читать полностью…

Градиент обреченный

Лекун за 300

Побывал на съемках Своей игры. Это какой-то свой мир. Во-первых, выглядит все во много раз прикольней чем по телеку. Раскрыл для себя тайну, как ведущий Пётр Кулешов так четко и без запинки произносит вопросы, с правильной расстановкой ударений в именах и названиях. Все просто, каждый 4-5 вопрос он повторяет, когда сбивается (но голос классный все равно).

Во-вторых, зрители там явно из числа фанатов игры и ходят туда годами. Если у вас был одноклассник чудоковатого вида, который знал во много раз больше фактов обо всем, то вот они все там. Насест для зрителей (по другому не назовешь) уж слишком маленький, могли бы и побольше соорудить.

Просочился, значит, между товарищей в третий ряд, сижу слушаю. Люди живо обсуждают, кто и с каким счетом выиграл и делятся инсайдами про Игру. Говорят, например, что со следующего года будут показывать на табло фальстарт, когда игрок раньше жмет на кнопку. Послушать прикольно.

Снимают передачу на Соколе, сразу выпусков по 5 за день. Если хотите сходить, то в канале периодически приглашают. Снимают сразу кучу выпусков за неделю, поэтому надо следить. Рекомендую.

Читать полностью…

Градиент обреченный

Визуальный редактор в Cursor'е

New feature. Открываете свое веб-приложение в курсоре, запускаете, во вкладке browser открываете страничку и начинаете редактировать: двигать элементы, центрировать по вертикали, менять стили на отдельной панельке и т.д.

Ваши действия преобразуются в промпты и модели меняют сопутствующие файлы в зависимости от проекта. Можно выбирать элементы и писать словами как их поменять.

По сути, откопали стюардессу в виде идеи WYSIWYG редактора. Теперь с AI.

https://cursor.com/blog/browser-visual-editor

Читать полностью…

Градиент обреченный

Немного обновил hfday.ru. Если кто не видел, то это

🟢 ML статьи с HF daily papers
🟢 Есть фильтры по темам (агенты, архитектура, перевод и т.д.)
🟢 Общий топ за месяц, тоже с фильтрами
🟢 Описание статей на китайском, если вдруг
🟢 Сортировка по дате публикации
🟢 Все данные сохраняются на github, можно использовать у себя
🟢 Синхронизируется с hf раз в час через github actions
🟢 Код скриптов и данные тут

👉 https://hfday.ru

Читать полностью…

Градиент обреченный

Написал редактор Хабра, предложил написать статью про "ИИ в разработке". Типа сейчас идет конкурс с денюжкой и т.д (в комментах из-за упоминания Гиги сразу думают, что конкурс от Сбера, лол).

В свое время, когда переходил с бекенда в машинное обучение, мне очень помогли мои заметки на Хабре про ML и пет-проекты, так что, если у вас есть идеи, то пишите статью, поддержу плюсиком.

Читать полностью…

Градиент обреченный

Человек, которого не хватает в офисе

Читать полностью…

Градиент обреченный

Любопытная небольшая статья от исследователей из MIT. Собирают типичные вопросы и ответы типа "В какой стране находится Москва?" / "В России".

Затем генерят предложения, в которых меняют часть слов на рандомные, но сохраняют синтаксис — "В почему балалайка летит Москва?" и задают моделям. Модели часто продолжают отвечать "В России".

Делают вывод, что для некоторых доменов могут быть настолько сильные синтаксические паттерны, что на смысл самого предложения модели даже не смотрят.

Читать полностью…

Градиент обреченный

Посмотрел на фирменные удары Медведева и приколы от Бублика. Просто праздник какой-то!)

Читать полностью…

Градиент обреченный

👆 Скорей бы завтра

Читать полностью…

Градиент обреченный

Тут Гигачат в космос летит 🚀 Будет помогать космонавтам вести рабочие записи

🟠live: https://vkvideo.ru/video-30315369_456244580

Читать полностью…

Градиент обреченный

Выпустили FLUX.2. Он довольно хорош, особенно Pro версия (есть на fal.ai) и дешевле Nano Banana Pro. А Dev версию выложили на HF 👍

В сравнении с бананой, конечно, не то, но мемы с алфавитом стали great again. Аж 44 буквы! Видимо, обязательно хотел все замостить.

https://bfl.ai/blog/flux-2

Читать полностью…

Градиент обреченный

Claude Opus 4.5

По качеству в коде заявляется лучше во всем и мы этому верим, потому что Opus и раньше был крут, но цена была уж слишком завышенной ($15/$75 за вход/выход 1M токенов).

О чудо, модель улучшили, а цену снизили в три раза — $5/$25 за 1М токенов, что все равно дороже чем те же Gemini и GPT. Но теперь можно подключать и его к работе. В API уже есть, в курсоре и везде появился.

Так же добавили reasoning effort для гибкости. Еще из интересного пишут, что стала безопасней к prompt injection на случай, если агент на этой модели захочет что-то сломать. Замеряли через компанию Grey Swan, которая сделала Agent Red Teaming (ART) benchmark для этих целей. Вот тут пишут детальней.

👉 Пост | System Card

Читать полностью…

Градиент обреченный

🍌 Ого, похоже в Nano Banana Pro, которая только что вышла, влили много чего советского и российского.

Смешариков умеет, Васю Ложкина знает, выглядит мощно.

https://blog.google/technology/ai/nano-banana-pro/

Читать полностью…

Градиент обреченный

RAG для чайников

Дошли руки почитать подаренную издательством Питер книжку про RAG'и — "RAG и генеративный ИИ" Дэниса Ротмана.

Переводить техническую литературу вообще сложно, но к этой книге претензии скорее по количеству необязательной информации в ней. Штуки типа версий библиотек для jupyter ноутбуков, которые надо установить, настройки сред и т.д. можно было бы сократить, оставив ссылки на сами ноутбуки.

Во-вторых, это куча сниппетов с кодом под конкретные библиотеки, которые вообще вряд ли кто-то будет читать, а тем более переписывать (ссылок на репозиторий с кодом я не увидел).

В остальном же это базовые знания о том, что такое RAG, зачем нужен, как хранятся данные, как оптимизировать и т.д.

Для знакомства с темой подойдет, но, если пойти почитать статьи на Хабре или спросить у ИИ, то точно будет не хуже.

Читать полностью…

Градиент обреченный

Скачки нарисованных лошадей

Еще весной модель для генерации картинок gpt-image от OpenAI будоражила умы, выдавая тонны полезных картинок в стиле аниме Ghibli, логотипов и подобного контента. Модель лично меня поразила, особенно то, что можно было накидать несколько картинок и объединить их в одну фоточку, например, так. Это был скачок, модель вырвалась вперед.

Затем скакнул Google, чья Nano Banana завирусилась, так как в ней можно не просто нагенерировать что-то прикольное, но и редактировать в pixel perfect режиме (части, которые не редактируются, остаются неизменными) в большинстве случаев. Особенно порадовало, что в обучении явно участвовали данные, широко описывающие мировую культуру. Модель и советские мультики знает и даже Васю Ложкина.

Еще она генерирует надписи на русском и других языках, даже если это чертеж турбины в разрезе. Опять-таки иногда сбивается и опять-таки это очередной скачок.

Тут бесплатная интеграция моего хорошего знакомого Макса Купрашевича и его команды, которая среди прочего пилит модель Malvina для попиксельного редактирования картинок и которую можно попробовать в GigaChat'е.

И вот OpenAI спешит нам напомнить, что у неё тоже есть достойная модель, зарелизив GPT Image 1.5. В глаза бросается то, что надписи стали генерироваться лучше, в том числе на русском. Мне особенно нравится кейс, когда нашел хорошую инфографику для презы и хочется ее перевести, а часть легенды убрать/переделать.

Скорость тоже стала выше, раза в 2-3. Качество вообще улучшилось в разы, но, кмк, до гугловской модели пока недотягивает. Кажется, что Gemini понимает инструкцию чуть получше (экспертное мнение, сделанное по пяти картинкам).

Тестируем, ждём GPT Image 2.0 Pro+

https://openai.com/index/new-chatgpt-images-is-here/

Читать полностью…

Градиент обреченный

NotebookLM прокачался

Сервис от Google, в который можно сбрасывать все имеющиеся материалы на вашу тему (ссылки, тексты, видео и т.д.) и выбрать, что с ними сделать. Можно создавать аудио и видео-обзоры, отчеты, инфографику, задавать вопросы в свободной форме.

Генерация подкастов появилась уже довольно давно и так сильно не удивляет (зажрались!), когда-то делал подобную вещь на коленке (подкаст по инструкции от холодильника).

А вот генерация слайдов по данным впечатлила, очень заметен буст от новых Gemini и Banana. Загрузил интервью Ильи Суцкевера (рекомендую послушать), модель и числа из интервью правильно вытащила и диаграммы с ними нарисовала, хоть сейчас иди за инвестициями.

Пробуем, увеличиваем ai slop.

Читать полностью…

Градиент обреченный

Все про кодовые модели

Хороший обзор Code LLMs, от фундаментальных моделей до агентов.

🟢 Какие задачи есть в кодогенерации. Неплохая таксономия (code completion, FIM, оптимизация кода, ревью, генерация тестов и т.д.)

🟢 Как обучают, про претрейн для кода, SFT и RL. Какие есть метрики и бенчи под них.

Добавляем в закладки, когда-нибудь почитаем.

https://arxiv.org/pdf/2511.18538

Читать полностью…

Градиент обреченный

GPT 5.2

После выхода Gemini 3 и объявления красного кода в OpenAI, ребята ускорились и выпустили новую версию. Возможно, что и сама модель новая, так как цена повысилась на ~40% ($1.25/$10 → $1.75/$14 за input/output 1M токенов).

Не думаю, что код от этого перестал быть красным. Ну, может, побледнел и теперь он код цвета бедра испуганнной нимфы (гуглим).

🟢 Потыкал, думает как будто сильно быстрее (либо сильно меньше), даже если выбирать extended thinking.

🟢 5.1 по сравнению с 5 была гораздо лучше в коде, особенно в UI. 5.2, надеюсь, не стала хуже. В курсоре и в других инструментах уже есть.

В общем пробуем, хороший дотюн Qwen'а получился.

https://openai.com/index/introducing-gpt-5-2/

Читать полностью…

Градиент обреченный

Обложка последнего журнала TIME

P.S. чуть-чуть подредачил

Читать полностью…

Градиент обреченный

Попробовал представить, чтобы они поменялись местами, не получилось

Читать полностью…

Градиент обреченный

Приехал на финал соревнований по программированию Yandex Cup в Стамбул. Хожу с бейджем Медиа, изучаю обстановку.

Понетворкался с участниками, почти все здесь уже не в первый раз, очень много ребят из других стран в секции алгоритмов (самая сложная, кмк).

Сейчас все в стадии напряжения мозгов, пять часов будут истязать себя задачами. Гости и прочие Медиа ходят кушают лукумы.

Читать полностью…

Градиент обреченный

Всем хорошей недели!

Начинаем предвкушать НГ (фото с работы (2017), где мы нарезали два таза оливье на время, а независимое жюри оценивало на вкусность).

Читать полностью…

Градиент обреченный

Друг поставил пиратскую 11-ю винду и она без активации не дает наушники подключить и другие настройки менять. Погуглил и, оказывается, есть рабочий способ активации одной командой

irm https://get.activated.win | iex


которая подкачивает ps скрипт с github'а из проекта massgravel. Скрипт, как я понял, маскируясь под старую винду, тупо активирует новую через официальные сервера MS.

Т.е. у проекта 150k звезд, MS про него знает, оно работает, хакает активацию и все довольны. Зачем нужна активация?

Читать полностью…

Градиент обреченный

Первый курс в магистратуре по ML если бы я был деканом.

Обязательные курсы:
- Просмотр аниме "Психо-паспорт"
- Угадывание содержания статей по абстрактам. Экзамен: определение китайских статей
- Скроллинг Твиттера

Курсы по выбору:
- Критика Юдковского в Интернете.
- Создание паблика с мемами про вагонетки и шогготов.
- Введение в рисование графиков экспонент.
- Прикладной слив персональных данных.
- Углубленное использование команды vllm serve.
- Основы создания бенчмарков с n=1.
- Введение в product-free стартапы с уклоном в AI safety.
- Подготовка резюме для Palantir.

Курсовая работа: Kaggle соревнование по построению кибергулага

Читать полностью…

Градиент обреченный

По подаркам. Насчитал 40 участников. взял из распределения большее/меньшее/среднее количество номеров. Получились 3, 7, 8, 10 и 25. Под этими номерами у нас @VVoLframium, @davletsh1n, @rocauc, @Mmmariu и @thectrls.

🎉 Поздравляем! Редакция канала с вами свяжется

Читать полностью…

Градиент обреченный

🎁 Итак, друзья, НГ розыгрыш!

Как обещал, среди тех, кто отметился, разыграем книжку "ИИ 2041" + еще две книжки про ИИ с моей полки, чтобы порадовать больше подписчиков.

Кроме этого, разыграем книжки "Искусственный ты" (очень клевая) и большую во всех смыслах книгу Сергея Маркова "Охота на электроовец. Большая книга искусственного интеллекта", которую он мне только что выдал специально для вас.

Пока что разыграем первые три, сейчас сварганим скрипт.

Upd. Решил все скопом разыграть.

Upd. Все разыграли, книжки ушли к победителям!

Читать полностью…

Градиент обреченный

🔺 Коллеги написали несколько обзорных статей по свежим релизам с AIJ с деталями разработки, читаем:

MERA Multi. Новый мультимодальный бенч для русскоязычных моделей. В топе там пока что мы, humans.

GigaTTS. Новый синтез речи. По естественности голоса стал в несколько раз лучше. Научили смеяться.

Linear Attention. Берем свой предобученный трансформер, стучим по нему молотком (оптимизируем), получаем те же метрики, но константу по памяти. Есть код.

GigaChat Ultra. Как с нуля обучается самая большая 702B (!) русскоязычная модель (прямо сейчас).

Читать полностью…

Градиент обреченный

🔺 GigaChat 3 в открытом доступе

Друзья, отличные новости. Выкатываем новые модели в open source.

🟢 GigaChat Ultra Preview. Самая жирная MoE модель, на 702B параметров, 36B активных. Просто так её не запустишь, но крупные компании могут переиспользовать. В русском языке она должна быть лучше чем текущий GigaChat 2 Max.

🟢 GigaChat3-10B-A1.8B. Модель поменьше и побыстрей. Активных параметров тут 1.8B. Для нее выложили еще и претрейн GigaChat3-10B-A1.8B-base.

🟢 Лицензия MIT

Я в этой активности поучаствовал в сборе мультиязычных данных вместе со многими из присутствующих тут языковых энтузиастов и организациями (отдельное спасибо Дому народов РФ и Лаборатории ИИ Якутии), которым, так же как и коллегам, огромная благодарность! ❤️

Полную большую модель можно будет попробовать чуть позже, после того как она появится в API.

👉 HF Ultra Preview | HF 10B

Читать полностью…
Subscribe to a channel