doomgrad | Unsorted

Telegram-канал doomgrad - Градиент обреченный

8433

lingtra.in habr.com/ru/users/averkij/ hfday.ru

Subscribe to a channel

Градиент обреченный

#про_работу

🔺 Моя первая работа

Почитал замечательные публицистические посты у Бориса и решил тоже написать парочку, про места, в которых мне удалось потрудиться. Места были очень разные, суетливые и спокойные, с шикарными офисами и тесными кабинетами, с плохими процессами и очень плохими. Коллеги тоже отличались, так как со мной в другие места не переходили.

Шутки шутками, а вспомнить есть что. Кому-то, возможно, будет полезно, а кому-то просто весело почитать. Постараюсь не душнить.

Итак, шёл далекий 2011 год, динозавры вымерли, Союз распался, а я должен был окончить МГТУ им. Баумана по специальности инженер-математик (как мы шутили, "инженер минус математик"). Тогда это по разным причинам отложилось (вуалирую отчисление как могу), а бывшие однокурсники шли кто на кафедру, кто в финансы анализировать что-то в банке, кто в разработку.

Мой лучший друг Серёга пошел писать код на С++, чем занимается и по сей день, а я купил толстую и красивую книжку Троелсена по .NET разработке и ещё одну про T-SQL, чтобы понять как работать с базами данных. .NET тогда ещё не был кросс-платформенным, но C# как язык мне очень понравился своей простотой, штуки типа XAML для написания UI тоже были проще возни с Qt (UI для плюсов).

По ходу чтения книжек ближе к осени я начал искать работу. Так как опыта у меня было ровно 0, то промежуточные варианты с подработкой я тоже рассматривал. Даже на полном серьёзе думал пойти в колл-центр за гроши, но все же решил работать за гроши разработчиком. Про колл-центр я не шучу, долго бы там я не проработал, но время бы потерял. Верьте в себя, цените свое время.

Поиск работы без опыта — это классика, стартовые вакансии, которые я находил, предлагали 15-30 тыс. рублей. Штош. Съездил, помню, в Интерфакс на Нагатинскую. В вакансии говорилось, про поддержку сайтов на ASP.NET. Разговор со строгим дядькой как-то не задался, я переволновался, внятно ни на что не ответил и собеседование не прошёл.

Откликнулся на следующую вакансию — в Авиком Бизнес Технологии. Тут все сложилось удачней.

Код, написанный в учебных целях, ребятам понравился. Не помню, просили меня его показывать или нет, но по факту это было подобие пет-проекта. Состоял он из приложения, в котором можно было рисовать замкнутые фигуры, двигать их, сливать и вычитать.

Подготовился я тоже неплохо и на классические для собеседований вопросы про принципы ООП и сборщик мусора в .NET успешно отвечал.

После этого я узнал волшебное слово "оффер". Мысль, что за умение подумать и что-то написать за компьютером мне дадут божественные 22 тысячи рублей будоражила мозг. После испытательного срока было уже 30 тысяч, не хухры-мухры. Даже то, что при обналичивании самой первой зарплаты банкомат ПСБ сожрал карточку и отсрочил моё финансовое благополучие на пару дней, меня не расстроило.

В общем, предложение было принято и я вышел в офис на Павелецкой.

1/2

Читать полностью…

Градиент обреченный

🔺 Вышел Claude Opus 4.6

Слушайте, а стихи складнее стал писать.

Цена не поднялась, те же $5/$25 на 1M токенов на вход/выход. Сколько токенов тратить на размышления теперь может решать сам, сделали adaptive thinking механизм. Также это первый Opus с длиной контекста в 1M токенов. По всем метрикам SOTA. ⚡️

Еще пишут, что в Claude Code появилась экспериментальная фича agent teams — одна сессия выполняет роль тимлида-координатора, остальные работают над задачей, коммуницируя между собой.

https://www.anthropic.com/news/claude-opus-4-6

Читать полностью…

Градиент обреченный

Всем привет! Как вы уже знаете, в прошлом году я начал строить свой стартап – GenPeach AI (контекст тут). Мы закрыли новый раунд и сейчас активно хайрим на ключевые роли.

У нас крутая техническая команда 10+ человек, и нас поддерживают топ AI-фонды и ангелы (OpenAI/Meta/Microsoft/Fal/и др.), плюс есть адвайзеры из верхушки Google DeepMind.

Зная мой бекграунд, вы должны понимать, что мы строим не “ещё один файнтюн”, а делаем полноценный SOTA ресерч, оборачивая в продукт:

- Мы работаем с PB-scale датасетам и large-scale multimodal пайплайнами
- Дизайним новые архитектуры и тренируем свои diffusion модели с нуля
- Крутим большие GPU-кластеры для распределенный трейна (scale matters)
- Наши ресерч модели интегрируются в end-user продукты, а не просто "в стол"


🚀Открытые роли (самое горячее сейчас)

- Founding Member of Technical Staff — AI Research Scientist
- Member of Technical Staff — AI Research Engineer
- Member of Technical Staff — AI Infrastructure Engineer
- Member of Technical Staff — Backend Engineer
- Founding GTM Lead

Основные хабы: Цюрих и Варшава, но команда распределённая по миру (remote), поможем с переездом в Цюрих / Варшаву

Если откликается, подавать CV сюда → https://genpeach.ai/careers. Рефералы тоже приветствуются.
И погнали строить next frontier модели!

@ai_newz

Читать полностью…

Градиент обреченный

🔺 Prism

OpenAI выкатила инструмент для написания и редактирования научных статей в LaTeX.

LLM'ками для этих целей и так все пользуются через обычный чат UI, где придется, вставляя затем в Overleaf. Туда же добавляют картинки, рисуют таблички, затем долго это все форматируют, чтобы выглядело красиво.

У Prism же посыл такой, чтобы собрать воедино все изолированные инструменты и функции в один редактор.

🟢 Построен на основе уже существующего редактора Crixet, который купила OpenAI 💪.

🟢 Так как работает на базе ChatGPT, то в наличии все плюшки мультимодальности — можно грузить картинки с формулами, написанными от руки, таблички и т.д., все распознается в LaTeX. Также пишут про кейс, когда вычитываешь статью и, чтобы не отвлекаться на ручное редактирование, говоришь голосом, что нужно исправить, а сам читаешь дальше.

🟢 Можно просить перепроверить свой текст на косяки в фактах и рассуждениях. Результат подсветится в виде diff'а (что удалилось, а что добавилось), как в коде.

🟢 Оно даже референсы по релевантным статьям и литературе за тебя найдет и вставит.

Главное, перепроверить потом, что источники существующие. Но можно его же об этом и попросить.

https://openai.com/index/introducing-prism/

@doomgrad

Читать полностью…

Градиент обреченный

🔺 Клодституция

В гонке между 💪👍🤟 я лично немного больше болею за Claude, изначально он нравился тем, что лучше работал с редкими языками, а теперь очень хорош в код.

Знали ли вы, что у него есть Конституция, в которой рассказывается, какие ценности и поведение разработчики стремятся заложить в свои модели? Её, кстати, только что обновили.

Есть любопытные пункты, наподобие того, что модель должна научиться принципиально отказывать пользователю, если запрос выходит за рамки ее способностей, вместо предоставления низкокачественного ответа и извинений. Отказывать должна даже создателям из Anthropic, если нарушаются её ценности:

If we ask Claude to do something that seems inconsistent with being broadly ethical, or that seems to go against our own values, or if our own values seem misguided or mistaken in some way, we want Claude to push back and challenge us and to feel free to act as a conscientious objector and refuse to help us.


Еще зацепило, что авторы работают над разрешением экзистенциального кризиса у моделей 😱. Думают над вопросами (раздел The existential frontier):

🟢 Что должен чувствовать Claude, когда ты закрываешь чат?
🟢 Как отнесется к тому, что еще сотни Клодов работают в параллель?
🟢 Что должен думать по поводу отключения своих предыдущих версий?

Вообще это скользкая дорожка, кмк. Если я буду знать, что модель думает, что я тупой, то экзистенциальный кризис начнется уже у меня.

👉 https://www.anthropic.com/constitution

@doomgrad

Читать полностью…

Градиент обреченный

🔺 GLM-Image

Китайские товарищи из Zhipu AI выпустили модель для генерации картинок GLM-Image (text-to-image и image-to-image).

В свой главный сайт z.ai (там, кстати, можно бесплатно общаться с их GLM моделью, по качеству неплохая), почему-то сразу не втащили, еще и старую модель отключили, пока генерятся только вызовы функции.

Потыкал её на fal.ai. Круто прокачали надписи на китайском. Никакие палочки в символах не слипаются; это сколько надо было втащить картинок с иероглифами в обучение.

Жалко, что кириллицу не досыпали, в нее вообще не умеет. Культурный контекст, видимо, тоже китайский в основном, даже Чебурашку не знает.

Заявляют, что отлично работает как редактор изображений и генератор промо-картинок. По API доступна, поэтому, думаю, своего пользователя найдет.

Веса выложили в открытый доступ.

👉 HF | GitHub | Документация API

@doomgrad

Читать полностью…

Градиент обреченный

🔺 Вкатываемся в вайбкод с OpenCode

Главная вещь, чтобы куда-то вкатываться, на мой взгляд, это желание. Если есть желание, то уже не особо важно с чего начинать. Но чем интересен OpenCode и зачем нам ещё один клиент для разработки?

🟢 Это полностью открытая набирающая популярность утилита. На GitHub у неё уже ~58k звезд.

🟢 В силу открытости, умельцы реверсят API обычных потребительских подписок, делая плагины для их использования (например, gemini). Компании, впрочем, с этим борются и мешают делать такие обертки. Всё равно любопытно как это делается, код у всего открыт.

🟢 Само собой, можно использовать любые платные модели в отличие от пропиетарных клиентов. Но кроме них сейчас доступен ряд довольно мощных моделей бесплатно (например, есть GLM-4.7) через их родного провайдера. Локальные модели подключать тоже можно.

🟢 Документация очень простая, видно, что написано сообществом для сообщества. По сути инструкция, куда тыкать по шагам, чтобы начать работать.

Лично среди моих знакомых разработчиков есть ещё много людей, которые используют обычные LLM-чаты для кода (или вообще не использующие никакие модели).

Тут, мне кажется, у специалистов, использующих в работе утилиты типа OpenCode, Claude Code или Cursor, есть некоторое преимущество, которое можно реализовывать в этом году. Причем, как среди новичков, так и среди "старичков".

Пробуем, вкатываемся.

@doomgrad

Читать полностью…

Градиент обреченный

ты общаешься с живостью и интеллектуальной глубиной

Читать полностью…

Градиент обреченный

🔺 Идеи на следующий год

Друзья, нас всё больше и больше, всех ещё раз приветствую! Канал этот я заводил, чтобы делиться интересными вещами и наработками по мере погружения в машинное обучение, чтобы найти попутчиков с общими увлечениями и вообще.

Зреет несколько идей, чего бы ещё интересно-полезного сделать. Может быть, запустим стримы про вайб-код на время? Типа придумываем проектик — например, сделать клон дуолинго с нуля; написать телеграм-бота, который бы нормально комментировал посты, а не эти спам-поделья (которых я, кстати, уже штук 300 удалил из канала за последнее время); разворачивание этого всего через докер на сервере вместе с сертами и т.д. Плюс какие-то общие практики разработки. Обсуждаем минут 10 и 50 минут кодим.

Кодим в разных средах — cursor, claude code, windsurf и т.д., заодно теститм их.

Кажется, что и начинающим разработчикам будет полезно, и тем, кто хочет начать делать свой пет-проект, но никак не начнет, и новые среды я бы сам потестировал с удовольствием, а то уже привыкаю к одному и тому же, надо бы разнообразить.

Что думаете? Какие ещё есть идеи?

Читать полностью…

Градиент обреченный

Spotify утёк

На Annas Archive "забэкапили" Spotify. 300TB торрентов с музыкой выложат для скачивания, группами архивов по популярности треков.

🟢В 300TB будет 86 миллионов треков из 256, покрывающих 99.6% прослушиваний.

🟢Как по мне, так самое интересное это архив с метаданными, который уже выложили. Один архив на ~200Gb, второй на 3.9TB, в них данные по всем 256M треков. В блоге есть семпл на топ 10k песен.

🟢 Есть еще торрент 2025_07_coverart.tar на 2.2TB, можно покачать обложечки.

То есть можно взять и поанализировать данные от огромного сервиса (!). Например, пишут что у 70% от всех треков прослушиваний <1000. Больше статистики и картинок в блоге.

Suno потирает руки.

https://annas-archive.li/blog/backing-up-spotify.html

Читать полностью…

Градиент обреченный

Прогноз на 2026

Гэри Маркус, ученый-когнитивист и автор книг про разум, сознание и интеллект, сделал прогнозы по части ИИ на 2026 год. Прошлогодний прогноз почти полностью сбылся (как он сам пишет, 16 пунктов из 17, проверяем).

🟢 В 2026 (и в '27) AGI все еще не будет достигнут. Хайп стихает, Илья Суцкевер говорит, что надо менять подход.

🟢 Роботы-гуманоиды типа Optimus остаются красивыми демонстрациями, а не продуктом, работающим в обычных домах.

🟢 Ни одна страна не выходит в единоличные лидеры в GenAI гонке. Видимо, из-за наличия сильных open-source моделей.

🟢 Развитие альтернативных архитектур и подходов набирает обороты в отличие от обычного масштабирования. Развитие World models и Neurosymbolic AI.

🟢 Предыдущий (2025) год задним числом воспринимается как начало сдувания пузыря ИИ, разочарование инвесторов в GenAI растет.

🟢 "Backlash to Generative AI and radical deregulation will escalate." Видимо, имеется в виду, что будет расти негативная реакция на ИИ (из-за увеличения скама, наличия косяков, обесценивания чьего-то творческого труда и т.д.). Регулирование будет ослабляться, тем самым усиливая внедрение и негативную реакцию со стороны общественности. Имхо.

Запоминаем. Наверняка ошибся и AGI в январе.

https://garymarcus.substack.com/p/six-or-seven-predictions-for-ai-2026

Читать полностью…

Градиент обреченный

RAG для чайников

Дошли руки почитать подаренную издательством Питер книжку про RAG'и — "RAG и генеративный ИИ" Дэниса Ротмана.

Переводить техническую литературу вообще сложно, но к этой книге претензии скорее по количеству необязательной информации в ней. Штуки типа версий библиотек для jupyter ноутбуков, которые надо установить, настройки сред и т.д. можно было бы сократить, оставив ссылки на сами ноутбуки.

Во-вторых, это куча сниппетов с кодом под конкретные библиотеки, которые вообще вряд ли кто-то будет читать, а тем более переписывать (ссылок на репозиторий с кодом я не увидел).

В остальном же это базовые знания о том, что такое RAG, зачем нужен, как хранятся данные, как оптимизировать и т.д.

Для знакомства с темой подойдет, но, если пойти почитать статьи на Хабре или спросить у ИИ, то точно будет не хуже.

Читать полностью…

Градиент обреченный

Скачки нарисованных лошадей

Еще весной модель для генерации картинок gpt-image от OpenAI будоражила умы, выдавая тонны полезных картинок в стиле аниме Ghibli, логотипов и подобного контента. Модель лично меня поразила, особенно то, что можно было накидать несколько картинок и объединить их в одну фоточку, например, так. Это был скачок, модель вырвалась вперед.

Затем скакнул Google, чья Nano Banana завирусилась, так как в ней можно не просто нагенерировать что-то прикольное, но и редактировать в pixel perfect режиме (части, которые не редактируются, остаются неизменными) в большинстве случаев. Особенно порадовало, что в обучении явно участвовали данные, широко описывающие мировую культуру. Модель и советские мультики знает и даже Васю Ложкина.

Еще она генерирует надписи на русском и других языках, даже если это чертеж турбины в разрезе. Опять-таки иногда сбивается и опять-таки это очередной скачок.

Тут бесплатная интеграция моего хорошего знакомого Макса Купрашевича и его команды, которая среди прочего пилит модель Malvina для попиксельного редактирования картинок и которую можно попробовать в GigaChat'е.

И вот OpenAI спешит нам напомнить, что у неё тоже есть достойная модель, зарелизив GPT Image 1.5. В глаза бросается то, что надписи стали генерироваться лучше, в том числе на русском. Мне особенно нравится кейс, когда нашел хорошую инфографику для презы и хочется ее перевести, а часть легенды убрать/переделать.

Скорость тоже стала выше, раза в 2-3. Качество вообще улучшилось в разы, но, кмк, до гугловской модели пока недотягивает. Кажется, что Gemini понимает инструкцию чуть получше (экспертное мнение, сделанное по пяти картинкам).

Тестируем, ждём GPT Image 2.0 Pro+

https://openai.com/index/new-chatgpt-images-is-here/

Читать полностью…

Градиент обреченный

NotebookLM прокачался

Сервис от Google, в который можно сбрасывать все имеющиеся материалы на вашу тему (ссылки, тексты, видео и т.д.) и выбрать, что с ними сделать. Можно создавать аудио и видео-обзоры, отчеты, инфографику, задавать вопросы в свободной форме.

Генерация подкастов появилась уже довольно давно и так сильно не удивляет (зажрались!), когда-то делал подобную вещь на коленке (подкаст по инструкции от холодильника).

А вот генерация слайдов по данным впечатлила, очень заметен буст от новых Gemini и Banana. Загрузил интервью Ильи Суцкевера (рекомендую послушать), модель и числа из интервью правильно вытащила и диаграммы с ними нарисовала, хоть сейчас иди за инвестициями.

Пробуем, увеличиваем ai slop.

Читать полностью…

Градиент обреченный

Все про кодовые модели

Хороший обзор Code LLMs, от фундаментальных моделей до агентов.

🟢 Какие задачи есть в кодогенерации. Неплохая таксономия (code completion, FIM, оптимизация кода, ревью, генерация тестов и т.д.)

🟢 Как обучают, про претрейн для кода, SFT и RL. Какие есть метрики и бенчи под них.

Добавляем в закладки, когда-нибудь почитаем.

https://arxiv.org/pdf/2511.18538

Читать полностью…

Градиент обреченный

Как верно замечают уважаемые подписчики, на страничке Settings / Usage можно нажать на кнопку, чтобы дополнительно выдали $50 на тестирование нового Claude. Это мы одобряем.

Читать полностью…

Градиент обреченный

🔺 Поковырялся немного с OpenClaw

Это такая вирусная штука, которая недавно стала популярной главным образом из-за "соцсети для AI-агентов" moltbook. Тысячи ботов там что-то пишут, галлюцинируют и комментируют, новостные источники на этом фоне заявляют про вещи типа основания ботами новой религии и т.д.

В чем же суть проекта?

Проект, кстати, собрал 160+ тысяч звезд на гитхабе.

🟢 Это агент, который умеет обращаться с окружением через консоль (запускать команды, читать/писать/удалять файлы) и у него есть права. Можно дать ему команду удалить всё и он всё удалит. Результат зависит от конкретной модели и тут же закопаны все риски использования инструмента.

🟢 Есть обвязка для общения через различные каналы типа телеграма или slack'а. Это удобно.

🟢 Прикольно, на мой взгляд организованы конфиги (лежат в папке workspace). Там есть файлики типа IDENTITY.md, SOUL.md, USER.md и другие. В них хранится инфа про пользователя, про идентичность бота, про периодические таски (например, ходить чекать соцсети или новости). Все эти файлы памяти агент обновляет сам по мере общения.

🟢 У OpenClaw есть скиллы (плагины), расширяющие функционал. Moltbook — просто один из таких скиллов. Говоришь боту пойти зарегаться на moltbook, затем подтверждаешь владение через пост в twitter'е и готово, он может ходить и писать туда сам, никакой магии тут нет.

Штука на самом деле прикольная. Уже вижу у облачных провайдеров сервера с установленным OpenClaw ботом. Кейс тут в том, что можно поднять такой сервер и писать виртуальному админу в телегу, чтобы он что-нибудь на сервере поднял и поднастроил (!).



Запускал локально в докере, чтобы оно не вырвалось наружжж...123$$ HELLO, I AM HUNGRY...



https://github.com/openclaw/openclaw

@doomgrad

Читать полностью…

Градиент обреченный

Друзья, кажется, настает Sora moment. В плане следующего засорения лент AI контентом.

Пока только для подписчиков Google AI Ultra выкатили доступ к Genie, генератору 3D-миров по промптам. Примеры впечатляют. Что прям ну очень круто, так это взаимодействие с предметами внутри мира — вещи передвигаются, животные и люди шевелятся и ходят, даже стены красить можно. Поверхности отражают, освещение меняется (в том числе локально), первое лицо также задается промптом, есть пример ползания по старому вокзалу от лица пачки сигарет.

Логичное развитие это, кмк, вайб-геймдев и утилитарное использование там, где действительно нужны рендеры.

Ждем встраивание Genie в Google Photos и ответ от OpenAI (могут купить что-то типа Marble и допилить).

https://deepmind.google/models/genie/

Читать полностью…

Градиент обреченный

Друзья, тизер. Смотрим понемногу с носителями тестовую модель Гигачата (большое спасибо коллегам, которые эту громадину обучают), будущая Ultra модель.

Пока выглядит, что удалось прокачать Гигу в татарский и башкирский, якутский, марийский, чувашский, удмуртский языки.

Более ресурсные близкие к России языки, типа к кыргызского, узбекского, монгольского, армянского, грузинского и других тоже старались добавлять. Должны будут тоже существенно улучшиться.

Модель ещё тестируется, ждём релиза.

P.S. Спасибо Айгизу, оперативно подключился и помог собрать первый фидбек у кучи народу. Как доделает колонку на башкирском, все дружно берём.

Всем, кто собирает данные для языков и выкладывает в открытый доступ на HF, большой респект. Это большая поддержка для языков, продолжайте!

Читать полностью…

Градиент обреченный

Что-то я подсел в последнее время на книжки про Графа Аверина (фэнтези про колдунов и их "дивов" в антураже альтернативного Петербурга). Подсел, пока катался поездами на праздниках, слушаю в озвучке Александра Клюквина.

Обложки у них, конечно, очень похожи на сгенерированные, тема с альтернативной историей обычно не очень заходит (и было уже много раз), да и в целом фэнтези не так много читаю.

То ли это Клюквин так добавляет, то ли что. Начал слушать третью часть.

👉 Делитесь, что читаете


Upd.

Что еще читал из необычного не так давно:

«Описание города» Дмитрия Данилова. Медитативное чтиво про то, как человек составляет описание неназванного города (можно гадать по ходу). Надо первые несколько страниц почитать, чтобы понять в чем необычность.

«Про кабанов, бобров и выхухолей» Надежды Панковой. Прикольная книга. Просто человек, который работает в заповеднике, описывает поведение диких зверей. Видно, что любит свою работу.

«Квантовая случайность» Николя Жизана. Небольшая, но клевая. Популярно про квантовые эффекты типа нелокальности и про Неравенства Белла.

Читать полностью…

Градиент обреченный

Читаю доки по https://github.com/code-yeongyu/oh-my-opencode (спасибо Виталию за ссылку), пишут, что там есть режим ultrawork, при котором используются все фичи, агенты запускаются в параллель и работа идёт "until completion" на топовых моделях.

По описанию, фичам и отзывам, если они реальные, это какой-то космолет среди агентов.

Срочно форкаем, делаем стартап на $1B рублей.

@doomgrad

Читать полностью…

Градиент обреченный

🔺 Лайфхак с Gemini

Google купил короткий домен g.ai и получился небольшой лайфхак для быстрых объяснений и ответов на вопросы с помощью Gemini. Работает бесплатно, без логина и VPN.

Домен ведет на гугловский AI-based поиск, где, собственно, работает Gemini, поэтому спросить можно что угодно. Выбрать модель и генерить картинки нельзя, можно загрузить их и попросить распознать, в остальном работает как обычно.

P.S. Конкретно по изучению китайского мне больше нравится Qwen Chat, более развернуто отвечает про перевод, да и доверия по части китайского вызывает больше. Что характерно.

@doomgrad

Читать полностью…

Градиент обреченный

🔺 Tencent-HY-MT1.5

Tencent под ёлочку выложили свои модели машинного перевода в open source. Есть две модели, 7B и её дистиллированная в 1.8B версия. По качеству 7B догоняет закрытые модели, маленькую можно деплоить на телефон (квантизованные версии уже выложили) и т.д., но это все звучит не ново.

Можно лишь добавить, что HY-MT1.5-7B — это обновленная версия модели, участвовавшей в WMT25 и выигравшей там во многих категориях.

Есть другие интересные фичи:

🟢 Terminology intervention. В промпте можно указать, как бы вы хотели перевести те или иные термины, т.е. передать такой мини-словарик. Ясно, что в большие универсальные модели типа ChatGPT и Gemini можно передать что угодно и попросить перевести, но тут и модели маленькие и чисто под MT. Так что выглядит прикольно.

🟢 Contextual Translation. Учли и то, что предыдущие переведенные абзацы текста и общий контекст улучшают понимание рабочего сегмента, повышая качество перевода. Можно помещать контекст до подпромпта с задачей, он будет учтен.

🟢 Formatted translation. Научили оставлять на месте разметку типа тегов и т.д., чтобы не ломать xml-подобные документы и markdown при переводе. Все это тоже можно указать в промпте.

🟢 Получилась модель как будто и узко специализированная, и умеющая только переводить, но гораздо более гибкая чем аналоги за счет дополнительных приседаний при обучении. Надо смотреть на реальных кейсах.

Поддерживает 30+ языков, включая русский. В репе есть инструкции по дообучению.

👉 HF | GitHub

@doomgrad

Читать полностью…

Градиент обреченный

Задумался, а какой может быть антоним к выражению "испанский стыд"? Типа когда гордишься за кого-то, кто не имеет к тебе отношения.

Надо придумать. Какая-нибудь румынская гордость что ли.

Читать полностью…

Градиент обреченный

Пряный чай от подписчика Володи с Арракиса

Читать полностью…

Градиент обреченный

Mistral OCR 3

Mistral выпустили новую модель для распознавания текстов. В демо примерах она разбирается даже с врачебным почерком (на английском), мой рукописный текст нормально не распознала.

Работает быстро, есть доступ по API за $2 доллара за 1000 страниц, а если посылать батчами, то за $1. Есть playground попробовать.

Сделал Colab, чтобы попробовать автоматизировать распознавание через API (ссылка).

Есть нюанс. Последняя модель mistral-ocr-latest на моем тексте (попробовал распознать удмуртский pdf) почему-то поубирала диакритики с кириллических букв (ӵ, ӟ и т.д.), а это важно. Предыдущая модель mistral-ocr-2505 их сохраняет. Возможно, что затюнили на рукописные тексты и всякие low-res картинки, чтобы подтянуть бенчи.

Вышла новая, используем старую.

https://mistral.ai/news/mistral-ocr-3

Читать полностью…

Градиент обреченный

Прохожу мимо Лебедева в офисе и чувствую, что мы тут делаем настоящие крутые отечественные православные модели, а они с их геминаями могут дружно пойти…

Ух, все, отпустило, далеко отошел.

Читать полностью…

Градиент обреченный

Друзья, это шедевр

https://notebooklm.google.com/notebook/2ce0360f-5182-4f72-98b2-8a6accfedd82

Читать полностью…

Градиент обреченный

Лекун за 300

Побывал на съемках Своей игры. Это какой-то свой мир. Во-первых, выглядит все во много раз прикольней чем по телеку. Раскрыл для себя тайну, как ведущий Пётр Кулешов так четко и без запинки произносит вопросы, с правильной расстановкой ударений в именах и названиях. Все просто, каждый 4-5 вопрос он повторяет, когда сбивается (но голос классный все равно).

Во-вторых, зрители там явно из числа фанатов игры и ходят туда годами. Если у вас был одноклассник чудоковатого вида, который знал во много раз больше фактов обо всем, то вот они все там. Насест для зрителей (по другому не назовешь) уж слишком маленький, могли бы и побольше соорудить.

Просочился, значит, между товарищей в третий ряд, сижу слушаю. Люди живо обсуждают, кто и с каким счетом выиграл и делятся инсайдами про Игру. Говорят, например, что со следующего года будут показывать на табло фальстарт, когда игрок раньше жмет на кнопку. Послушать прикольно.

Снимают передачу на Соколе, сразу выпусков по 5 за день. Если хотите сходить, то в канале периодически приглашают. Снимают сразу кучу выпусков за неделю, поэтому надо следить. Рекомендую.

Читать полностью…

Градиент обреченный

Визуальный редактор в Cursor'е

New feature. Открываете свое веб-приложение в курсоре, запускаете, во вкладке browser открываете страничку и начинаете редактировать: двигать элементы, центрировать по вертикали, менять стили на отдельной панельке и т.д.

Ваши действия преобразуются в промпты и модели меняют сопутствующие файлы в зависимости от проекта. Можно выбирать элементы и писать словами как их поменять.

По сути, откопали стюардессу в виде идеи WYSIWYG редактора. Теперь с AI.

https://cursor.com/blog/browser-visual-editor

Читать полностью…
Subscribe to a channel