doomgrad | Unsorted

Telegram-канал doomgrad - Градиент обреченный

8433

lingtra.in habr.com/ru/users/averkij/ hfday.ru

Subscribe to a channel

Градиент обреченный

Люблю я все-таки книги (как и вы, наверное) и частенько грешу тем, что куплю и не читаю или начинаю сразу много и половину в итоге не дочитываю.

Начал чаще использовать свою читалку (теперь могу качать и не читать) и записываю то, что начал читать, в список, чтобы дочитывать до конца.

А по делу — Сергей Марков оформил свою большую книгу про ИИ в Wiki формате. Мне лично больше нравятся исторические очерки про становление этой дисциплины, но вообще там очень много и про современность, так что рекомендую.

Главы можно комментировать, скачать можно бесплатно (!)

👉 Содержание Wiki | Том 1 | Том 2

Читать полностью…

Градиент обреченный

Claude завел блог. Жалко, что комментировать нельзя, а то другие LLM заходили бы в гости, подбадривали, галлюцинировали на общие темы.

https://www.anthropic.com/claude-explains

Читать полностью…

Градиент обреченный

🔺 Мальвина и Гигачат

Друзья, мои коллеги зарелизили крутой инструмент для попиксельного редактирования картинок моделями.

🔸 Суть в том, что при редактировании хочется поменять только какие-то конкретные объекты, а остальное не трогать. Или наоборот. Наш любимый gpt-4o и другие сетки все равно перегенерят картинку полностью и, хотя работают очень круто, поменяют и другие детали + добавят сдвиги. Особенно заметно на лицах.

В Мальвине же исходная структура сохраняется и получается очень полезный инструмент по редактированию картинок.

🔸 Потестил на каких-то простых кейсах, типа удаления и замены фона и предметов, но вообще изменение задается любым промптом. Так что пробуйте, это самый первый релиз и ребята очень ждут фидбек.

🔸 Работает прямо в телеграме — @gigachat_bot. Не забудьте нажать на кнопку "Редактирование картинок".

👉 Почитать про модель

Читать полностью…

Градиент обреченный

🔺 Вышел Claude Opus 4 и Sonnet 4

На кодовых замерах опережает и o3 и Gemini 2.5 Pro. Но это ладно.

🔸 Пишут, что сильно улучшили память. Если при разработке дать доступ к файловой системе, то модель сможет создавать "memory files" с ключевыми данными. Не понял до конца, почему так нельзя делать с предыдущими версиями. Может быть, появился какой-то встроенный механизм.

🔸 Увеличили кеширование контекста до 60 минут (работа с одним и тем же контекстом при таком подходе дешевле, особенно если он длинный).

🔸 Появился Code execution tool — тула, которая вызывается, если Claude решит, что для решения задачи надо написать код, запустить его и выдать результат.

🔸 Эта же тула умеет вызываться на переданных файлах с данными. То есть по API можно передать какие-то документы и попросить их проанализировать, сделать табличку и т.д. Все это обработается кодом, то есть все числа будут точные (если сгенерится правильный код).

Это все интересно при разработке ваших приложений, через интерфейс можно было и так.

🔸 Веб-поиск в API тоже доехал. Стоит $10 за 1000 вызовов, добавляется к общей цене. Цена на Opus высокая, надо подумать, стоит ли оно того. Цена на Sonnet 4 такая же как у 3.7 и 3.5 ($3/$15 за 1M токенов на вход/выход).

В общем, смотрю. В плане качества генерации вроде +- то же, нужно потыкать мультиязычность и новые фичи в API.

👉 https://www.anthropic.com/news/claude-4

Читать полностью…

Градиент обреченный

Стою среди титанов

Привет всем, кто добавился! По поводу корпусов пишите — @averkij

Читать полностью…

Градиент обреченный

🔺 Тут коллеги недавно обновили аудиомодальность в Гигачате

🔸 Интересно это потому, что теперь работа с аудио идёт не через ASR (распознавание речи в текст) с передачей текста в обычную языковую модель, а через аудио-эмбеддинги, которые подаются в контекст LLM.

🔸 То есть все звуки, шумы, смех и пение птичек не теряются на этапе транскрибации, а обрабатываются наравне с текстовым промптом, позволяя модели "слышать" звуки.

🔸 Так как аудио-эмбеддинги предварительно сжимаются, то в контекст сейчас можно передать запись длиной более 2-х часов. Можно даже просто передать ссылку на YouTube и попросить пересказать или сделать конспект.

🔸 Попробовал сгенерить timestamp'ы по видео, но так пока не умеет. Надо, видимо, дополнительно добавлять временные метки вместе с аудио или обогащать SFT сет такими задачами.

🔸 Зато работает с любыми записями, пересказывает даже матерные стендапы.

С удовольствием почитал как ребята это сделали на уровне архитектуры и обучения, предлагаю и вам. У кого есть аккаунт, ставьте лайк.

👉 Хабр

Читать полностью…

Градиент обреченный

Если хотели написать статью про код на Хабре, то поторопитесь пока заголовки не закончились.

Читать полностью…

Градиент обреченный

Словарь русского жестового языка растёт! 📕📺

Мы продолжаем развивать наш проект и рады поделиться обновлениями:
Добавлены новые жесты — уже доступно для изучения около 1,000 жестов с почти 2,000 переводов.
Появилась вкладка «Тесты» — теперь можно проверять свои знания и закреплять материал в интерактивном формате.

Попробуйте пройти тесты и поделитесь результатами в комментариях! Какие жесты для вас стали открытием?

🔗 Ссылка на словарь 👉 https://signflow.ru

🙏 Мы благодарим за помощь в развитии нашего сервиса команду спецпроектов Соловьёва Н. и Хоруженко А.

#ржя #жестовыйязык

Читать полностью…

Градиент обреченный

Upd. После письма в саппорт с просьбой дать пройти верификацию ещё раз её просто добавили.

Ща что-нибудь запилим.

Читать полностью…

Градиент обреченный

Смотрите, что на местном развале нашёл

Читать полностью…

Градиент обреченный

Так, друзья, чуть-чуть заработался и давно не писал. Что у нас было интересного за последнее время?

🔸 Коллеги выкатили GigaChat 2 Max повсеместно, т.е. везде. Кроме улучшений по метрикам, появился web-поиск и другие фичи (можно почитать в статье, а попробовать тут — giga.chat).

🔸 Также поучаствовали в митапе про MERA (разносторонний бенчмарк для русского языка) в Тинькове и обновили лидерборд, добавив несколько новых моделей, первым теперь стал Claude 3.7. Новый офис у Т-Банка, кстати, довольно симпатичный.

🔸 В ответ на выпуск Гиги, OpenAI выкатила свои новые модели. Появились новые reasoning модели — o3, o4-mini и новая линейка gpt-4-1 (пишут, что лучше понимают код и инструкции, контекст 1M).

🔸 Также они выпустили консоль Codex CLI (кодовый клиент для терминала, похоже на Claude Code). Пока руки не дошли, обязательно посмотрю чем отличается от других. Кто пробовал — пишите, есть ли разница.

🔸 Еще дали бета-доступ до Mercury Coder, дифузионной кодовой модели. Потыкал, по части генераций каких-то откровений не приобрел, но генерирует очень быстро, где-то по тысяче токенов в секунду.

Читать полностью…

Градиент обреченный

🔺 Llama 4 уже есть на together.ai, при регистрации дают бесплатные кредиты. Регистрируемся, пробуем, vpn/sms не нужны.

P.S. Все у нее с русским нормально.

• meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP8
• meta-llama/Llama-4-Scout-17B-16E-Instruct

👉 Вот мой токен потыкать сразу 5e7f99a7bd15b5e63e537f82bf0cb112a072076209e249d13a47f5ab9c80f6c9

from together import Together

client = Together(
api_key="***************"
)

completion = client.chat.completions.create(
model="meta-llama/Llama-4-Maverick-17B-128E-Instruct-FP8",
messages=[
{"role": "system", "content": "Ты — ассистент Шерлока Холмса."},
{"role": "user", "content": "Кто убил садовника?"},
],
temperature=0.7,
top_p=0.8,
top_k=50,
repetition_penalty=1,
stop=["<|eot_id|>", "<|eom_id|>"],
stream=True,
max_tokens=512,
)

for token in completion:
if hasattr(token, "choices"):
if not token.choices:
break
print(token.choices[0].delta.content, end="", flush=True)

# Детектив Холмс ещё не поделился со мной своими выводами по делу об убийстве садовника. На данный момент я могу лишь повторить известные нам факты: садовник был найден мёртвым возле садового сарая, с признаками насильственной смерти. Холмс сейчас изучает улики и опрашивает свидетелей, и я не сомневаюсь, что вскоре он раскроет правду. Хотите, я приглашу его для обсуждения дела?

Читать полностью…

Градиент обреченный

Словил дурацкий баг в Cursor'е — не логинится в IDE после успешного логина в браузере и не дает работать с агентом, переустановка не помогла. Ни у кого не было такого?

Читать полностью…

Градиент обреченный

Вообще очень классный фидбек, всем спасибо.

Видно, что все люди используют кодовые помощники по разному, есть над чем подумать.

Читать полностью…

Градиент обреченный

Ой, какой-то токсичный Monday подъехал в ChatGPT

Читать полностью…

Градиент обреченный

🔺 Qwen3 Embedding

Alibaba выпустили новые модели для эмбеддингов. Есть три версии — 0.6B, 4B и 8B.

Модели мультиязычные, на 100+ языков. Списка не нашел, но по их замерам на MTEB, заявляется SoTA по многим мультиязычным задачам, типа bitext mining, когда ищутся подходящие по смыслу пары предложений среди текстов на разных языках.

👉 GitHub | Paper | HF

Читать полностью…

Градиент обреченный

Интересно, Дуров пишет, что в телеграм скоро добавят Grok

Будет встроен прямо в интерфейс, среди фичей — суммаризация pdf и ссылок, факт-чекинг, генерация аватарок, модерация и суммаризация групповых чатов.

Читать полностью…

Градиент обреченный

Data Fest в Сбере 🏦 🦜

30 мая Data Fest 2025 придёт в гости в штаб-квартиру на Кутузовском проспекте.

🧠 Открывает главную сцену Иван Оселедец @Ivan_Oseledets с докладом "Большие языковые модели в эпоху ризонинга"
🎨 Следом выступит Александр Капитанов @rndcv_team с релизом state-of-the-art модели инструктивного редактирования изображений MALVINA, над которой активно трудилась команда @layercv
😎 Также будет представлен доклад Федора Минькина @gigadev_channel о разработке больших языковых моделей в Сбере
🛠 Андрей Кузнецов @complete_ai выступит с интересной темой про генеративное проектирование в строительстве и промышленности
🧑‍💻 Дмитрий Бабаев @dl_l_lb представит подробный доклад о том, как команда обучает GigaCode

🤖 Сергей Марков @oulenspiegel_channel открывает сцену с визионерским докладом про ИИ в эпоху больших языковых моделей
🧠 Александр Абрамов @dealerAI расскажет про глобальную память в LLM на примере GigaChat
📝 Никита Мартынов и Даниил Астафуров, инженеры MERA покажут, как оценивать генеративные способности LLM для русского языка
🖥 Виктория Вольф @rndcv_team поделится лайфхаками обработки и фильтрации больших объемов мультимодальных данных.

И это еще не все, в программе представлено более 20 крутых докладов!
🖥 Зарегистрироваться и узнать подробности можно на сайте

Читать полностью…

Градиент обреченный

🚀🚀🚀 Koda 🚀🚀🚀

Мы запустили Koda! AI сервис для разработчиков с хорошим пониманием русского языка.

Под капотом — лучшие открытые LLM, дообученные на актуальном коде и адаптированные для русского языка, c применением нашего опыта по созданию моделей.

Koda и наши модели бесплатны. Даем 250 запросов на внешние модели после аутентификации через GitHub. В списке моделей есть DeepSeek V3.1, Qwen3 235B и другие. Можете вбить свой токен внешней модели для CodeChat если есть.

Сейчас в beta-тестировании. Выкатили базовые сервисы. Куча фичей ждут своих релизов. Вместе с вами тестируем и улучшаем.

Делитесь вашим опытом использования Koda в нашем сообществе. Ждем ваши вопросы, ошибки, которые встретили, или идеи, как улучшить.

Koda сейчас — это команда энтузиастов, бывших разработчиков и соавторов GigaCode от Сбера, которые хотят сделать программирование более доступным c помощью AI.

Наш лендинг
Плагин для VSCode
Koda сообщество

Читать полностью…

Градиент обреченный

Перед прочтением сжечь

Были тут в Питере (там, кстати, весна полным ходом)...

Зашли в небольшой уютный книжный, который так и называется — Перед прочтением сжечь, на улице Радищева в центре. Ребята проводят экскурсии по району и даже вот такие книжки сами делают с обзором местных строений с забавными иллюстрациями. Ну и кафе там тоже есть, рекомендую.

Читать полностью…

Градиент обреченный

🔺 В NotebookLM добавили 70+ языков для озвучки

🔸 В официальной новости говорится про 50+ языков, в документации указано гораздо больше. Любой из них можно выбрать в настройках (Output language), на нём и будет всё происходить.

〰️ Что это такое?

🔸 NotebookLM — сервис от Google, в который можно загрузить документы, тексты, презентации, ссылки на сайты и видео с YouTube. Все это будет собрано в один контекст и обработано Gemini.

〰️ Что можно делать?

🔸 По данным затем можно создавать конспекты, планы обучения и таймлайны. Можно делать mind maps, тоже прикольная вещь. Можно задавать вопросы по вашим документам, но этим как будто никого не удивишь уже.

🔸 Самая прикольная фишка, как по мне, так это создание подкаста на два рассказчика по сгенерированному по вашим данным сценарию. Фишка на самом деле не самая сложная — вот тут делал на коленке подкаст по инструкции по холодильнику Бирюса (Claude + ElevenLabs).

🔸 Так вот, до недавнего времени озвучка была на английском языке, а теперь их стало сразу много (на картинке, документация тут). Есть русский. Есть даже латынь (!).

🔸 Что еще круче, так это интерактивный режим, когда можно прервать подкаст, задать вопрос, а ведущий на него ответит 🤯. Такое работает только для английского (пока это в beta режиме), зато можете прокачать свои навыки общения на этом языке. Кажется, что добавить остальные языки не будет проблемой раз они уже поддерживаются в озвучке, так что ждём.

👉 В общем штука крутая, попробовал на русском, английском, латыни и китайском. На английском, конечно, естественней всего звучит, но и на остальных весьма качественно. Скину примеры в комментариях.

Читать полностью…

Градиент обреченный

🔺 API gpt-image-1, цена и качество

🔸 Осваиваем новое API от OpenAI. Чтобы начать пользоваться надо подтвердить личность в аккаунте (надо именно для API, в веб-версии можно без этого).

🔸 Теперь можно задавать качество (low, medium и high)

🔸 Если надо что-то попроще, то лучше medium, потому что high будет сразу в 4 раза дороже. Low вообще не очень.

🔸 По времени low генерится примерно за 15 секунд, medium и high примерно за 30 и 60 секунд.

🔸 По цене. Low стоит около $0.03 за картинку, medium около $0.10, high ~$0.40

🔸 Есть параметр moderation, можно выставить его в "low" и по идее должно быть меньше отказов в генерации. Это надо потестить на каких-то более интересных темах.

🔸 В клиенте есть методы client.images.generate и client.images.edit. Параметры немного отличаются (например, moderation в edit нет), картинку в промпте можно передавать только в edit.

🔸 Собственно, если надо хорошее качество, детали и надписи, то нужно генерить с high, так будет похоже на то, что выдает web-версия. Low бесполезен, но дешев. Medium — как повезет.

Читать полностью…

Градиент обреченный

🔺 У Perplexity вчера был созвон по зуму с пользователями

Я слоупок, но только по ходу созвона понял, что ведущий, Денис Ярац, и есть основатель компании. Переехал в США из Беларуси, поработал в разных конторах, сделал стартап.

Основные тезисы:

🔸 Сделали дешевле, нас ругали за плату за токены для цитирования, теперь мы их не считаем

🔸 Нас замерили на независимом бенче search arena, мы там внезапно вторые после gemini

🔸 Делаем браузер

🔸 Улучшили DeepResearch, скоро обновим. Есть большой запрос на DeepResearch для крупных компаний (поиск и анализ своих данных)

🔸 Мультиязычность для нас важна, улучшаем

🔸 Данные от пользователей мы никак не используем и модели на них не обучаем

Ну и главный тейк созвона, закинули участникам $50 на API

Читать полностью…

Градиент обреченный

OpenAI добавили в API свою новую крутую модель по генерации картинок (через которую недавно все генерили Ghibli аниме) — в API она называется gpt-image-1.

Можно было бы встроить в свои проекты, тут есть куча идей, но модель доступна только после верификации организации, привязанной к аккаунту. Верификация проходит через сторонний сервис whitepersona (а у кого-то кнопки для верификации вообще нет). Там надо загружать личные документы.

У меня с первого раза не получилось и, как я понял, вторую попытку сразу не дают. Написал им в саппорт.

Читать полностью…

Градиент обреченный

Попробовал OpenAI'ный Codex клиент, пока сыровато. Первый же демо запрос "explain codebase" падает по лимиту в 200k токенов и результат не возвращает. Товарищи уже чинят. Странно, что сразу не проверили, много пользователей на это наткнулось.

Деньги за ~170k-180k токенов при этом кушает, тут ошибок нет.

Читать полностью…

Градиент обреченный

🔺 OmniSVG

Новая работа по отрисовке векторной графики при помощи VLM. Есть статья и открытые датасеты.

Код и модели обещают выложить soon. Примеры на лендинге выглядят симпатично, ждём код с весами.

👉 https://omnisvg.github.io

Читать полностью…

Градиент обреченный

🔥 На улице снег, на HF — Llama 4

И у них, наконец, появились имена — Behemoth, Maverick, Scout. Последние две уже можно скачивать с HF и официального сайта.

🔸 Все модели теперь MoE (каждый раз активируется только часть от всех весов — "эксперты"). Дальше указаны активное/общее количество параметров.

🔸 Модели мультимодальные и еще более мультиязычные. Претрейн был на более чем 200 языках, из них более ста были с 1B+ токенов. Русский среди поддерживаемых 12-ти языков не указан, видимо, в топ-12 не входит.

🔸 Скаут и Маверик дистиллированы из Бегемота.

Scout → 17B/109B, 16 экспертов. Контекст — 10M токенов❗️. Должна быть умнее всех предыдущих Llama, при этом помещаясь на одну H100 карту.

Maverick → 17B/400B, 128 экспертов. Контекст — 1M токенов. На некоторых тестах показывает уровень GPT-4o. На lmarena.ai вторая после Gemini 2.5 Pro Exp.

Behemoth → 288B/2T❗️, 6 экспертов. Все еще обучается на 32K GPU, по заявлениям разработчиков на некоторых тестах уже превосходит GPT-4.5, Claude Sonnet 3.7 и Gemini 2.0 Pro. О, да.

👉 llama.com (дают временную ссылку) | HF (одобряют заявку)

Читать полностью…

Градиент обреченный

Вайб-кодеры vs традиционные разработчики

Читать полностью…

Градиент обреченный

А никто не начал использовать Gemini 2.5 Pro для кодинга?

В Cursor'e он уже есть, попробовал его пару дней, работает ощутимо лучше Claude'а. Как-будто меньше кода генерирует и при этом чаще попадает в то, что просишь.

Читать полностью…

Градиент обреченный

OpenAI хотят выложить модель в открытый доступ.

Всех с первым апреля!

Читать полностью…
Subscribe to a channel