8433
lingtra.in habr.com/ru/users/averkij/ hfday.ru
А удобная вещь в codex'е для сброса 5-часового лимита. И в целом логичная — недельный лимит же все равно остается. Почему в других клиентах так не сделают?
Upd. недельный тоже сбрасывается, надо задуматься о переходе на кодекс
🔺 Начал тестировать нашу читалку под андроид, открыл для себя новый дивный мир отладки мобильных приложений.
Что прикольно, клод-код (codex надо проверить) умеет подключаться через adb к телефону, ставить туда отладочную версию и собирать логи, пока ты тыкаешь по экранам. Полечил так пару особо интересных багов.
На имеющемся POCO смартфоне для включения режима установки через кабель зачем-то необходимо вставить симку (!), ну вот зачем, учитывая, что телефон esim не поддерживает и ты ещё отдельно включаешь режим разработчика.
Если ставить приложение через Expo Go, то при загрузке вылезает полупрозрачный серый экран, который всё блокирует. После пары часов дебага оказалось, что это системный экран экспо почему-то не дорисовывается и что он убирается потрясыванием телефона (а-а-а!).
Вылезла куча багов в интерфейсе, которых не было под iOS и это очень напоминает веб-разработку в былые времена, когда всё по разному глючило в разных браузерах.
Релиз всё ближе. Для выкладывания приложения в google play нужно добавить пару человек с андроид-телефонами в команду тестирования.
👉 Кто хочет поучаствовать (кто на android), скидывайте email в личку
Ещё один проект, над которым работаю последние месяцы — это платформа для языковых курсов на базе нашего Lingtrain портала. Немного рассказывал про это, когда ездил в МарГУ в замечательный город Йошку, как его называют местные.
Сделал студию для создания курсов, в ней, собственно, создаются модули с описанием заданий, ответами, теорией, подсказками и т.д. Все раскладывается по json'чикам, чтобы веб и мобильный клиенты могли утащить это к себе и красиво отрисовать.
Со студией и приложением пару месяцев точно провозился. На старте, конечно, очень большой объем работы надо сделать, чтобы поднять систему в рабочем состоянии.
Дизайн UI это вообще отдельная тема. Я, конечно, поделал его немного за свою карьеру, но каждый раз это очень времязатратное задание. Фронтендеры — святые люди, я считаю. Тут Claude Design выручил, за 5-6 итераций поправок рисует приемлемый дизайн, если в него импортировать рабочий репозиторий. Из него потом можно взять архивчик-автопилот для клод-кода, который почти точно (процентов на 80 с опусом) перенесет его в мобильный.
Само приложение, это по сути Duolingo, в курсы которого можно будет подмешивать задания на основе параллельных книг Lingtrain, как публичных так и своих (то есть любых, которые сделаете), с дополнительной теорией, для тех кто любит почитать и новыми упражнениями, которые мы с вами туда добавим.
Кроме того, это возможность избавиться от досадного недостатка, что до сих пор нет хороших приложений для изучающих языки России — башкирского, татарского, марийского, якутского, чувашского и всех остальных. Так что, возможно, это тоже исправим.
👉 Кто хочет помочь с разработкой таких курсов для своего языка, можете уже начинать. Обсуждать давайте в этой ветке лингтрейн-чата.
Ну что, все свои проекты успели доделать за три дня?
Fable/Mythos вырубили по требованию правительства США.
🔺 Claude 5
Друзья, с новым клодом. Пишут, что это самая сильная модель, которая сейчас есть, следующий уровень после Opus — Mythos-class.
🟢 Переложили правилами, чтобы, чуть что, — и роутинг шёл на более простой Опус (более простой Опус!). Так и пишут, что спешили с релизом, поэтому на первых порах будет много ложных срабатываний из-за их safeguard rules. Особенно режут вопросы, связанные с биологией и химией, так как в этих областях заявляют об особо крутых улучшениях. Постепенно будут настраивать свои регулярки.
🟢 Обновили policy, теперь все обращения к Mythos-class моделям будут хранить 30 дней, на всякий случай. Обучать модели на них не будут, честно.
🟢 Версия с более сильными ограничениями — Claude Fable 5, доступна всем подписчикам до 22 июня, потом уберут (по API тоже доступна, $10/$50 за input/output 1M токенов). Ограничения срабатывают примерно на каждом двадцатом запросе в обычных сессиях, то есть, если не спрашивать на harmful темы, то будет как Mythos.
🟢Версия Claude Mythos 5, которую можно использовать для поиска уязвимостей в ПО, раздают в рамках проекта Glasswing проверенным компаниям, чтобы они их у себя находили и чинили.
🟢 Пишут, что особо хороша должна быть на долгих сложных задачах — в разработке, научных исследованиях, в vision-тасках. В Claude Code в последней версии модели пока не вижу, но у знакомых есть. В Cursor'е уже видно.
Пентагон уже взломал, пойду смотреть умеет ли матерные частушки сочинять.
👉 https://www.anthropic.com/news/claude-fable-5-mythos-5
Сделал для нашей читалки режим сокрытия перевода, очень долго возился с UI чтобы выглядело как задумано (чтобы перевод появлялся/скрывался по тапу).
Ещё сделал агентный перевод для книг. Тут большое спасибо Насте, которая меня проконсультировала по теории перевода и даже конспект сделала.
Сначала модель составляет анкету по части стиля текста, терминов и имён, времени написания и т.д. и закрепляет правила для перевода в json файле. Разбивает файл на куски, переводит в параллель, затем всё это валидируется, исправляются закреплённые в правилах термины.
Работает очень круто, нравится как соблюдается стиль (например, на скриншоте, модель поняла, что у персонажа-работяги кокни-акцент и переводит на русский также просторечно). Сделал скилл для клод-кода, лимиты оно съедает очень быстро, но качество огонь. Работает через workflow-фичу.
Попутно из текста извлекается метадата — списки персонажей с описаниями, цитаты и диалоги для будущего использования.
Новый режим подвезли в claude code
Поразбирался чем workflow отличается от agent team, в котором запускается несколько инстансов клод-кода со своим контекстом и ролями, они между собой переговариваются, делятся результатами, кушают много токенов. Мне в целом очень нравится как они работают.
В workflow же режиме (надо выбрать его в /efforts, чтобы само решалось, запускать или нет, или писать текстом "make a workflow for this", когда необходимо) командная работа реализована по другому.
Как намекает название, структура тут более жёсткая — после того, как решено использовать workflow, модель пишет скрипт (скрипт можно открыть по Ctrl+G), скрипт запускается отдельно от текущей сессии (смотреть список можно командой /workflows, там же можно ставить их на паузу и снова запускать, промежуточный результат сохранится).
В скрипте будет описание фаз и субагентов, до 1000 штук. Они потихоньку запускаются в параллель, пишут результаты в переменные. Все сохраняется, поэтому можно ставить на паузу.
Свой workflow можно сохранить как команду. Как пример, есть встроенный воркфлоу /deep-research. Запустил и его и workflow на поиск багов в API, за 10 минут съел пятичасовой лимит подписки за 100 баксов...
Позиционируется как тяжелый инструмент для поиска сложных багов в системе, аудита безопасности, сложных миграций и других критических задач. С ним же переписали bun на rust за 11 дней (750k строк кода). Теперь можно пользоваться и вам, если позволит бюджет.
Вообще штука прикольная и реализация неплохая, надо бы такое встроить в другие клиенты. В крупных компаниях с локальными моделями, я уверен, был бы мощный буст.
И ещё. По словам знакомых разработчиков, до сих пор во многих компаниях кодовые модели используют мало, либо развернут что-то простое, поплюются и перестанут. Так нельзя, друзья, используйте кодовые агенты по полной.
Включил амазоновский сериал про молодого Шерлока. Он там за пару месяцев выучил китайский язык у пьяного сапожника, когда подрабатывал в церкви между отсидками в тюрьме. Сапожники есть в чате?
Читать полностью…
🔺 Фотословарь
Друзья, сделал небольшое приложение для помощи в чтении китайских текстов.
Так как сам слишком часто лезу в словарь и это очень тормозит, то набросал такую штуку — по фотке страницы книжки делаем OCR маленькой моделью и ищем слова по предподготовленным HSK словарям.
Можно добавлять слова в списки или скрывать их, чтобы в следующий раз уже знакомые слова не показывались.
Можно добавлять свои слова, особенно помогает с именами.
Списки сохраняются, можно возвращаться к ним позднее. Пока без всяких повторений, просто для организации.
Работает всё локально (и модели и словари) на CPU, получилось довольно удачно, быстро и можно портировать на телефон, чтобы офлайн работало. Поэтому код тоже выложу, можно будет утащить к себе.
Развернул все на Lingtrain, можно пользоваться, распознавать, сохранять списки. Если что-то найдете или чего-то не хватает, то пишите в чатик.
👉 https://lingtrain.ru/blog/fotoslovar-dlya-kitayskogo--1a7379
Неплохая вводная статья про устройство агентов — про память, subagents, сжатие контекста, как и что они дергают, пока делают задачу и т.д.
Автор ещё делает фреймворк AG2, не тыкал его, но он вроде как популярный (под 200 контрибьютеров и 4.5k звёзд).
https://habr.com/ru/articles/1029326/
А у кого-нибудь забанили аккаунт для клод-кода? Удалось разбанить или новый акк зарегать с той же картой?
Читать полностью…
Возвращаемся на грешную землю через Ханой. Во Вьетнаме прикольно, всё тут у них идёт по плану, жара +30.
Сразу в аэропорту стал миллионером (есть нюанс).
Есть Grab, аналог Яндекс такси, от аэропорта до центра стоит в районе 10 долларов, удобно.
Надо будет ещё сюда приехать. Надеюсь, что миллиард людей на мопедах куда-то денется и можно будет нормально дороги переходить.
Но ладно, пора домой. У вас тут наверняка много всего нового вышло и AGI has been achieved по белым спискам.
🚀Наша новая модель NextEdit Suggestions.
Обычный автокомплит предсказывает текст под курсором. А что если модель будет предсказывать следующее действие программиста — что он изменит, где и как?
Это Next Edit Suggestions (NES). Модель смотрит на историю правок и предсказывает следующую правку в той же логике. Не только добавляет код — но и удаляет, переименовывает, рефакторит. И не только под курсором, а в любом месте файла.
Как обучали: взяли Qwen2.5-Coder-1.5B как базу, подготовили качественный NES-датасет (склейка микро-правок, фильтрация по причинной связи с историей, апсемплинг replace), обучили SFT.
Результат: наша модель 1.5B занимает топ-1 в среднем по бенчмаркам, обгоняя модели до 7B.
Подробности как обучали в статье на Хабре:
https://habr.com/ru/companies/koda/articles/1028578/
Уже доступна в бете в Kodacode для VSCode. Пробуйте и делитесь фидбеком.
Так на всякий напомню, что в Kodacode не одна модель под капотом, кроме большой LLM. Есть модели CodeСompletion, модели поиска (embedder и reranker), apply модель и вот еще наша новая модель NextEdit.
Установить Koda | Чат поддержки
Продолжаю возиться с интерфейсом для читалки, довольно неплохо получается. Книжки там будут появляться после выравнивания на lingtrain.ru + какие-то публично доступные книги.
Для мобильных приложений и клод и кодекс как будто послабее работают чем для веба, больше приходится допиливать. Либо на экране телефона косяки сильнее в глаза бросаются по сравнению с другими приложениями. Пишите про свой опыт с UI.
Vision у клода улучшился, это заметно. По референсным элементам стал ближе к оригиналу отрабатывать.
Дальше думаю, чего бы такого прикольного добавить к экрану для чтения. Вот есть у нас книга с оригиналом и переводом, хотим её читать и улучшать знание языка. Можно подсвечивать сложные слова какого-то уровня или новые слова, можно добавлять их к себе в список, можно с ними генерировать другие примеры предложений или иной контент. В общем, думаю. Если есть какие-то идеи, то пишите.
Заметил новую фишку в редакторе картинок в ChatGPT — можно расставлять комментарии на картинке в нужных местах, чтобы проще было редактировать.
Если вы не поняли, то это должен был быть смешарик Карпатыч.
А есть тут ещё добряки кроме меня, торгующие на ММВБ?
Читать полностью…
Возможно ещё, что они поняли, что трудно тягаться с Гигачатом на якутском, марийском, чувашском, удмуртском и других языках, которые мы в этом году добавили, и решили доработать мифос.
Читать полностью…
Я, кстати, по поводу вайб-кодинга вообще не переживаю, ведь я могу бросить его в любой момент
Читать полностью…
Ну всё, пошли Пентагон ломать
https://www.anthropic.com/news/claude-fable-5-mythos-5
#про_работу
Продолжение этого поста.
🔺 Второе место, CNET
Итак, получив первый опыт вместе с первой зарплатой в Авикоме, я познакомился с Пашей, который работал через дорогу. Паша был гораздо опытней и уже тогда говорил, что надо идти в Data Science, а ведь это было лет сто назад или около того.
Ни я, ни Паша, впрочем, в машинное обучение тогда не ушли, а продолжили погружаться в волшебный мир бэкенда на C#. Я купил лучшую книгу по устройству .NET фреймворка «CLR via C#» Джеффри Рихтера, и за лето её прочитал, что-то там даже усвоив (а книжка толстая, люблю такие).После третей кружки Когда однажды мы шли компанией к метро после работы, Паша предложил пособеседоваться к ним в CNET Content Solutions, как раз, говорит, есть вакансия. Не долго думая, я откликнулся, пообщался с HR'ом и пришёл к ним в офис пообщаться.
Собеседовался я в команду, которая разрабатывала внутренние сервисы для обработки большого объема фидов (кучи архивов с тучей xml файлов) с всевозможными товарными позициями и размазыванием этого всего по дальнейшей инфраструктуре.
Как сейчас помню, в моде тогда были вопросы про круглые люки и вопросы на размышление — как взвесить слона без весов или сколько теннисных мячиков поместится в автобус. Собственно про люки меня и спросили, а также про количество светофоров в Москве (или про количество заправок?). В основном, разумеется, поговорили про устройство .NET — про сборку мусора, многопоточность и т.д. В общем мило поболтали.
Через недельку, когда я ехал на автобусе от Царицыно до Бирюлево, позвонил HR и сказал, что мне на почту выслали оффер и я могу с ним ознакомиться. Судорожными руками я залез в телефон и увидел, что мне предложили божественные 60 тыс. рублей (в два раза больше чем на текущей работе). Profit.
В Авикоме царила семейная атмосфера и увольняться оттуда было неловко. Увольнение — это всегда очень волнительный процесс, причем для обеих сторон. Но идти за новым опытом никогда не зазорно, как и возвращаться в хорошую компанию. В том же Каспере, где я потом работал, было особенно много возвращенцев. Но об этом позже.
В сентябре, значит, вышел я в команду к Валере Ильину. Валера, скажу я вам, — это голова, и Паша — это голова, а был ещё мой ментор Дима (тоже голова). Я тогда был не голова, поэтому впитывал всё хорошее и не только от своих старших товарищей. Особенно много впитал от Паши, но, опять же, не обо всём тут можно рассказывать, все-таки нас читают зумеры.
В CNET'е я проработал 3 года, периодически там поднимали зарплату и повышали, под конец платили в районе 90 тыс. рублей. Но по сравнению с командой, в которой я работал, да и с компанией в целом, это все ерунда. Даже жалко, что её уже нет.
Период этот был очень весёлым. Впервые съездил в отпуск за рубеж, ещё раз отчислился из университета (перед самым дипломом), начал учить японский и сдал по нему Норёку (самый простой), тогда же сдал и английский IELTS. По пятницам ходили компанией играть в баскетбол в соседней с офисом школе, увлекался забегами, шахматами и т.д. Короче, понемножку жил эту жизнь.
Затем, в очередной раз привыкнув ко всему, захотелось нового и я походил на пару собеседований. Помню, как ездил в Дойче Банк, там я сразу уехал не на том на лифте на технический этаж, из которого нельзя было выйти без пропуска. А потом меня собеседовало 4 человека из совершенно разных команд по разным направлениям, было весело. Но вышел я в другую контору. Как и первые две, она была в пяти минутах ходьбы от Павелецкой.
Продолжение следует.
🔺 Вышел новый Opus 4.8
В стихи не сильно испортили (пишет хорошо, но надо несколько попыток). Попробовал сразу ещё разные диаграммы и визуализации порисовать как тут (про эту фичу отдельно писали), в них заметно хуже стало.
Думаю, что основные метрики сейчас идут в код, чтобы поддерживать конкуренцию, поэтому другие скиллы можно и просадить. Завтра поглядим как оно в агенте, как раз готовлю выложить пару приложений в app store.
Ещё поговаривают про более сильную модель в ближайшее время, типа Mythos, но упрощённую, чтобы программисты и хакеры пока ещё не всё.
Кстати, если ИИ суждено заменить людей и стать следующим поколением существ на Земле, то он ведь должен и воровать научиться, и водку пить, и отвечать, что ты не абсолютно прав, иначе какая-то неравноценная и скучная цивилизация получится. Это вам идея для стартапа.
Пробую тут новое, начал использовать Kimi для кодинга. Взял простую подписку.
Сам терминал выглядит как будто какие-то фичи накидывали по ходу дела, чтобы было удобно пользоваться, типа контрастной подсветки во время выбора файла. Не очень красиво выглядит, зато гораздо более заметно чем в Codex и Claude code (я бы вот ровно так же делал, если потом никому не показывать).
Понятно, что должно быть послабее в сложных тасках, это мы проверим ещё, но вот в мобильном UI делает на удивление более целостные экранчики. На первом скрине Codex, на втором Kimi.
Кто-то пользуется китайскими кодовыми LLM как основными или дополнительно? Как оно?
🔺 США vs Китай
Любопытный пост от Anthropic про то, какие сценарии они видят к 2028 году в контексте конкуренции с Китаем.
🟢 Конкуренция разворачивается по четырем направлением — уровень интеллекта моделей, внедрение внутри страны, экспорт наработок вовне, стабильность при внедрении ИИ внутри страны (рынок труда, безопасность и т.д.).
🟢 Лидерство достигается благодаря инновациям частных компаний типа NVIDIA, AMD, ASML, TSMC. Топовые американские модели минимум на несколько месяцев опережают китайские.
🟢 Это лидерство предлагается удерживать законодательно, продолжать запрещать экспорт чипов, запретить обучать китайцам модели в датацентрах других стран, криминализировать дистилляцию сильных моделей, ещё активней экспортировать свои технологии.
🟢 При таком сценарии к 2028 году США будут опережать Китай на 1-2 года. Если так не делать, то страны приблизятся к паритету (узнал, что "ноздря в ноздрю" переводится как "neck-and-neck"). При приближении к паритету все начнут забивать на безопасность новых моделей при релизе, чтобы не отстать.
В общем шеймят Китай за их модели. Значит, хорошие модели, надо брать.
https://www.anthropic.com/research/2028-ai-leadership
привет!
у нас на митапе в Нижнем Новгороде автор FastStream и AG2 (популярная библиотека для написания агентов на питоне https://github.com/ag2ai/ag2/) сделал очень хорошее интро в агенты и все штуки рядом с ними. с примерами кода и написанием своих штук. по результату сделали большую статью: https://habr.com/ru/articles/1029326/
если получится помочь продвинуть его опенсорс проект - будет круто :)
Купил в Осаке журнал с Сэмом Альтманом на обложке.
Прочитал, что он держит в рабочем кабинете технологические артефакты разных времен — первобытный топор, урановый стержень и т.д.
Дочитал до места про его мужа... Подумал, что перевод кривой. А он не кривой.
Погуляли несколько дней по Шанхаю, крутейший город, заезжайте при оказии.
К туристической нерасторопности везде отнеслись снисходительно. Не смог купить билет на паром через Шанхай-реку, пропустили просто так. Не записался на вход в книжный (когда людей много, надо ткнуть где-то в вичате), тоже пустили. Сам книжный Duoyun, кстати, классный — на 52-м этаже Shanghai tower.
Книжки недорогие, дешевле чем в Москве. Как вообще в мире так делают, что цены, напечатанные на книгах, действительные, а у нас цены везде разные?
Маглев хорош, но скорее как атракцион, 8 минут едет на скорости 300 км/ч, потом выходишь у метро ближе к центру, стоит 40 юаней. Обычное метро в аэропорту тоже есть. Проезд в метро стоит 3-5 юаней, зависит от длины маршрута.
Город зеленый, куча парков, набережная с небоскрёбами и районы бывших концессий, еда, всё понравилось.
В сотый раз столкнулся с ситуацией, когда мастерски выдаешь фразу на местном языке, после чего ни черта не понимаешь, что тебе говорят. Пора бы им всем уже что-то с этим сделать.
🔺 ChatGPT Image 2.0
OpenAI выкатили новую модельку. Примеры в посте очень крутые, особенно нравятся с типографикой.
Культурные аспекты тоже стали лучше. Алфавит с персонажами из советских мультфильмов, который у предыдущей модели совсем не получался, теперь рисуется гораздо лучше, как и вообще всякие композиционные картинки. Думал, что она сама гуглит картинки перед поиском для контекста, но у меня так не получилось.
Детали и текст рисует лучше Nano Banana.
Если есть иллюстраторы в чате, напишите, насколько вообще такие модели используются в профессиональной работе иллюстратора или дизайнера. Эти профессии уже, конечно, всё или ещё, конечно, нет.
По API тоже доступна (gpt-image-2-2026-04-21), так что можно встроить к себе в приложения.
👉 https://openai.com/index/introducing-chatgpt-images-2-0/
Spark модель в Codex'е, кстати, довольно прикольная (gpt-5.3-codex-spark). Работает супер быстро, но для больших задач не годится. Пробовал её с gsd плагином и ушел в цикл — начинает планировать, через 15 секунд сжимает контекст, опять начинает планировать и т.д.
Собственно, она для точечных задач и была сделана изначально, так что это не баг. Зацикливание, конечно, всё равно странное, циклов 10 подождал и вырубил. Вот всякие рефакторинги и задачи попроще делает раз в 5-6 быстрее других, очень круто.