boris_again | Unsorted

Telegram-канал boris_again - Борис опять

15113

life = curiosity + irreducible noise Whois: https://t.me/boris_again/1652 Лс: @btseytlin

Subscribe to a channel

Борис опять

# Честно про жизнь без работы 3/3

Цена всего этого счастья – стресс. Я получил свой опыт "реального мира" сполна. Всё ещё не в режиме настоящего выживания, потому что у меня есть инвестиции и в худшем случае я смогу продать их часть. Но я поставил себе условие, что в этом случае я сразу признаю поражение и иду искать работу. В идеале вообще за месяц до этого события.

Для комфортной жизни в Лиссабоне на одного нужно 3000 - 3500 евро. Вы наверное думаете "сколько???" и я тоже сначала офигел. Но все, что ниже этой планки, требует или жить с соседями, или не в Лиссабоне, или охотиться на крыс. Все три варианта для меня неприемлемы и ломают всю затею – тогда уж лучше остаться на работе. Я в целом верно прикинул, что отказавшись от инвестиций, поумерив аппетиты и приложив некоторые усилия я могу обеспечивать себе такой доход. Или достаточно близкий, чтобы уходить лишь в небольшой минус.

Однако я не учел некоторых вещей. Например, что я захочу оплачивать репетиторов для своего младшего брата. Так же я недооценил некоторые поездки. И переоценил свою способность отказаться от хипстерского кофеечка. К тому же доходы от канала и подработки чрезвычайно сезонные и непредсказуемые. Пусть в среднем они и могут приносить то, что нужно, но в любой конкретный месяц может быть ноль. Всё это привело к дыре в бюджете.

Спустя месяца три эта дыра съела большую часть свободных денег. Все сходилось к жизни в ноль без подушки безопасности. Я несколько раз обнаруживал себя в тишине, за столом, наблюдающим как волны тревоги накатывают на меня. Потому что на счетах меньше денег, чем нужно на аренду. Это чрезвычайно интересное ощущение. Головой я понимал: голодная смерть мне не угрожает, мне есть к кому обратиться, я уже всё спланировал и сейчас ничего не могу сделать. Но страху этого мало.

Я и раньше не верил в "писатель должен быть голодным". Теперь я побыл голодным писателем и имею основания сказать: лучше покормите. Да, в состоянии "МЫ СЕЙЧАС СДОХНЕМ!!!!" мозг очень креативный. Но только по вопросам как заработать пятьсот евро. В нем невозможно делать ничего творческого или долгосрочного. Например, писать книгу или делать проект. Зато возможно нервно залипать в рилсы и играть в компьютерные игры, ещё больше усугубляя ситуацию. Гораздо лучше пишется когда у тебя всё хорошо.

Со временем я привык к этому ощущению. Сейчас я снова в такой ситуации когда на аренду не хватает. Тревога не ушла, но больше меня не парализует. Просто висит как напоминание которое невозможно свернуть: у тебя проблемы, чел. Я делаю с этим, что могу: время от времени прикладываю усилия для поиска источников дохода. Вместе с этим пилю MVP стартапа, делаю дела, читаю книжки, играю в игры. Даже хипстерские кофеечки покупаю, потому что эти 4 евро меня всё равно не спасут.

Мне всё ещё не нравится текущая нестабильная ситуация, но теперь с более спокойных позиций. Меня бесит считать деньги по мелочам, это отвлекает! Теперь я чувствую, что пора что-то менять и делать новый шаг.

Как ни странно, я теперь чувствую себя свободнее. Стало проще верить в своё "я что-нибудь придумаю." Думаю толерантность к риску неплохо прокачалась.

Записывайтесь на консультации как потерять работу.

Читать полностью…

Борис опять

# Честно про жизнь без работы

В июне 2025 я исполнил мечту айтишника и уволился с работы. В основном просто потому, что могу. Причины конечно были. Например, я писал книгу и меня раздражало, что я могу уделять ей время только на выходных. К тому же наступил момент когда надо было коммититься в eBay на 2-4 года и переезжать в Берлин по рабовладельческой рабочей визе, чего мне делать не хотелось. Однажды я просто сел и посчитал ради интереса: могу ли я взять и уволиться?

Согласно арифметике получилось что, внезапно, могу. Несмотря на высокую стоимость жизни в Лиссабоне (моя аренда 1500 евро) свободные накопления, доходы с канала и возможные подработки позволили бы прожить без работы как минимум полгода не сильно потеряв в качестве жизни. Далее я или что-то придумаю, или, в худшем случае, найду новую работу.

Тем не менее, я не сбежал сразу, потому что идея показалась странной. Я вообще не привык разбрасываться деньгами. Всю свою карьеру я инвестировал часть зарплаты. Я переживал когда норма сбережений падала ниже желаемой. Даже переход недостаточный рост дохода ощущался как катастрофа: из-за сложного процента ты теряешь МИЛЛИОНЫ! У меня никогда не было кредитки. Моя самая дорогая покупка в жизни это Mac Pro M3 – средство производства. Когда-то я даже ходил с Едадилом и закупался по скидкам в трех разных супермаркетах. Правда это было очень давно, такими оптимизациями я уже не страдаю и теперь довольный просаживаю деньги на оверпрайснутый кофе для хипстеров.

К тому же странно уходить с работы просто так. Люди так не делают. В прошлом я всегда переходил с одной работы на работу по-лучше – это уважаемо. Максимум две недельки передохнуть и снова в бой. Так же уважаемо уходить когда что-то не устраивает, начальник дурак и вообще выгорание. Но уходить просто так, без плана, потому что хочется? Что дальше, может ещё начнешь высыпаться и регулярно пить воду?

Поэтому я подготовился. Месяц тщательно потрекал свои расходы и доходы, чтобы убедиться в расчетах. Подумал и посоветовался с друзьями. Мне не верилось, что я правда могу уйти с работы и не умереть. Я просил их найти ошибку в моих рассуждениях, но никто не нашел и почти все были согласны, что игра стоит свеч. Часть указывала на понятные мне риски: а что с ВНЖ делать будешь? ВНЖ Португалии я всё ещё жду, так что рад, что не стал из-за этого сомневаться.

Риски были понятны, а награда очень заманчива. Во-первых, опыт. Будучи айтишником я с одной стороны радовался как зарплата просто возникает каждый месяц, а с другой стороны чувствовал свою ограниченность. Отчастия я завидовал знакомым которые живут в реальном мире где не поработал значит не поел и постоянно надо крутиться. Я не хочу всю жизнь быть наемным работником и это показалось мне хорошим способом прокачать свою толерантность к риску. Во-вторых, свобода. Штука самоценная. Наконец, все вещи на которые не хватает времени и сил: писать книгу, делать пет-проекты, пробовать идеи проектов, прокачивать канал, трогать траву. У меня не было конкретного плана, но я был уверен, что что-нибудь придумаю. Я предположил, что скорее всего даже выиграю по деньгам: за год на работе я могу вырасти предсказуемо и линейно, а за год в свободном полете могу вырасти хз как нелинейно. Наконец, я просто люблю делать вещи потому что могу, хотя и не часто удается.

Я уволился. Теперь, спустя полгода такой жизни, можно подвести некоторые итоги.

Часть 1/3

Читать полностью…

Борис опять

В Белграде 19-20 февраля пройдет OpenTalks.AI 2026.

Недавно опубликовали программу конференции. Среди спикеров: Дмитрий Ветров, Евгений Бурнаев, Андрей Устюжанин, Татьяна Шаврина, Анна-Вероника Дорогуш, Сергей Николенко, Рома Доронин и многие другие. Съезжается едва ли не всё русскоязычное AI/ML сообщество. И я почти наверняка буду 👀!

На конференции будет 3 трека: исследовательский, инженерный и бизнес. Очень много про ИИ-агентов, обучение LLM, оптимизацию вычислений, генерацию данных, генеративный ИИ в бизнесе.

Есть онлайн формат, хотя конечно лучше слетайте в Белград, там хорошо.

Регистрироваться и платить сюда: https://opentalks.ai/ru/#registration

Для подписчиков есть промокод на 20% скидку: RD20

UPD: взял билеты в Белград, точно буду. Приходите общаться!

Читать полностью…

Борис опять

😂 Оптимизатор правда понял по-своему и взял такую метафору: AI агенты похожи на овец. Так даже лучше!

Читать полностью…

Борис опять

Админу грустно, поэтому оптимизатор резюме под вакансию hr-breaker был обновлен фиксами и фичами, которые просили (и даже контрибьютили!) на Github:
1. Возможность подставлять любой ключ который поддерживает LiteLLM: Google, OpenAI, Anthropic, Openrouter, итд.
2. Возможность подставлять свой LITELLM_BASE_URL, так что можно даже на локальных моделях запускать.
3. Пользовательские инструкции: uv run hr-breaker optimize resume.txt job.txt -i "Focus on Python, add K8s cert"
4. Перевод результата на русский язык по желанию (с сохранением терминов и прочего)
5. Ретраи, чтобы не падало когда модель перегружена.

У репозитория кстати 564 звездочки, прикольно

Читать полностью…

Борис опять

🎉Мы возращаемся!

У нас открылась регистрация на весенний семестр 🎆
Сейчас можно оставить заявку на классические потоки частей 1 и 2, а также на DLS: Speech!

Но это не всё — в этом семестре мы запустим ещё два курса:
🔵 Математика для AI
🔵 Фундаментальные модели, включая CLIP, диффузионные модели, Flow Matching, а также VLM!

Подробнее про них напишем в следующих постах

Форма регистрации 👇
https://talent.kruzhok.org/events/10714

❗️Внимание:
1. Её обязательно нужно заполнить для получения дипломов.
2. Курсы нужно будет проходить через аккаунт Stepik, указанный при регистрации.
3. Также для получения диплома просим указать свои ФИ из «Таланта» в Stepik.

Прикладываем ссылки на курсы на платформе Stepik:
🔵Курс DLS: часть 1
🔵Курс DLS: часть 2
🔴Курс DLS: Speech

Начало занятий — 28 февраля!

Ждите дальнейших подробностей в этом канале!

P.S. Уже в этом феврале пройдёт традиционная олимпиада DLS. Скоро выложим анонс 😉

Читать полностью…

Борис опять

Интересные моменты из Claude Opus 4.6 System Card

Главное наблюдение: огромный рост на задачах поиска информации в длинном контексте. Это про иголки в стоге сена и MRCR v2 8-needle. В релизе упомянуто, что Opus 4.6 на 17 п. п. лучше Opus 4.5 и на 82 п. п. (!) лучше Sonnet 4.5.

Однако сравнение с конкурентами почему-то спрятали в System Card, хотя там есть чем похвастаться. Антропики всех уничтожили. Opus 4.6 достигает 93%, GPT-5.2 70%, а Gemini 3 Pro всего 45.4%. Победили Gemini на их же поле!

Можно подумать, что нашли способ сломать бенчмарк, но одновременно с этим подросло ещё несколько оценок автономности и способности действовать на длинном контексте. Самое главное это, пожалуй, Vending-Bench 2, где модели нужно в симулированной среде управлять магазином и зарабатывать деньги. Opus 4.6 примерно на 30% лучше Gemini 3 Pro.

Я думаю именно за счет длинного контекста Opus 4.5 ощущался настолько более умным, чем даже Sonnet 4.5.

Так же очень сильно вырос ARC-AGI-2 (на 14.6 п.п.). Многие этот бенчмарк не любят, но мне кажется он несет полезный сигнал про способность модели разобраться в незнакомой задаче, особенно вкупе с другими бенчмарками.

В целом можно точно сказать, что Opus 4.6 на данный момент самое близкое к автономной модели, что у нас есть.

Немного пугающе близкое. Например, бенчмарки по кибербезопасности полностью решены:

Claude Opus 4.6 has saturated all of our current cyber evaluations, achieving
~100% on Cybench (pass@30) and 66% on CyberGym (pass@1). Internal testing
demonstrated qualitative capabilities beyond what these evaluations capture, including
signs of capabilities we expected to appear further in the future and that previous models
have been unable to demonstrate.

Я недостаточно разбираюсь, чтобы понять насколько это стремно. Наверняка есть разница между "идеально решает любой CTF" и "идеально ломает любую систему."

Устойчивость к различным атакам в среднем выросла, но есть нюанс. Например, в агентском кодинге были успешны 0% промпт инъекций (у предыдущей версии было около 15%). Круто! Однако для неявных промпт инъекций при 100 попытках шанс успешной атаки 21.7%. То есть ваши openclaw боты всё ещё достаточно легко взломать если задаться целью.

При этом при использовании GUI доля успешных атак уже 57.1%. В целом как будто все способности моделей многократно хуже когда в дело вступают картинки.

Читать полностью…

Борис опять

Снова и опять

Я уже серьёзно не понимаю, что происходит на этих графиках

Upd:
Меня обманули, это фейк ньюз. Спасибо @senior_augur, что откопал источник

https://x.com/d4m1n/status/2016596621832700085

Читать полностью…

Борис опять

Время тестировать гипотезу в действии

https://www.anthropic.com/news/claude-opus-4-6

Читать полностью…

Борис опять

Всё, что происходит с moltbook, rentahuman.ai и так далее для меня выглядит так:
1. Мы дали 5-летнему ребенку заряженный пистолет-пулемет, чтобы посмотреть, что получится.
2. Получилось забавное "пиу пиу" потому что он не смог снять оружие с предохранителя.
3. Попробуем теперь дать ему ствол побольше.

Читать полностью…

Борис опять

#дайджест

Дайджест ML/AI за неделю 26 января - 1 февраля 2026

Nvidia: PersonaPlex
Audio-to-Audio 7b Duplex model, то есть разговорная real-time модель без LLM посередине, как sesame или Moshi. Вы можете говорить одновременно с моделью, прерывать друг-друга и т.д.  В общем, диалог ощущается живо. Модель оупенсорсная, можно добавить аудиореференс голоса и текстовое описание роли/контекста разговора.
Блогпост Github, HF, Статья

DeepMind: Project Genie
World-model как она есть. Генерация консистентного интерактивного 3D окружения по картинке и описанию, которое не разваливается за 60 сек (предел сессии). Интерпретирует WASD, пробел и движение мышью. Достаточно адекватно симулирует все подряд от файтингов до симуляторов таракана.
Доступно только в Gemini Ultra (249$) и только для США
Блогпост

Decart: Lucy 2.0
Стартап Decart предлагает диффузионную Video-to-Video модель для редактирования видео с вэбкамеры по текстовому промпту в realtime c 1080p в 30 FPS. Из интересного модель дообучали на ее собственных генерациях корректировать дрейф видеогенерации со временем. Качество совсем не супер, видны артефакты, но дрейфа действительно не ощущается.
Попробовать здесь, Блогпост

Anthropic: MCP Apps
Model Context Protocol получил расширение MCP Apps - теперь MCP-серверы могут возвращать не просто данные, а полноценные интерактивные UI: графики, формы, дашборды, прямо внутри диалога с моделью. По сути это способ превратить любой MCP-инструмент в мини-приложение без выхода из чата. Уже реализовано в Claude для Pro подписчиков.  Google и OpenAI также планируют интеграцию в свои чаты.
Список коннекторов в Claude, Блогпост, GitHub, Спецификация

Tencent: HPC-Ops
Команда Hunyuan AI Infra открыли библиотеку операторов для инференса LLM - HPC-Ops. Оптимизация под NVIDIA H20 (порезанные H200 для китайцев), даёт до 2.22x ускорение на decode-attention относительно FlashAttention. Уже в продакшене у Tencent. Прирост пропускной способности 30% для моделей Tencent-HY и 17% для DeepSeek.
Пост в X, GitHub

Google: Agentic Vision
Теперь у Gemini 3 Flash есть функция анализа изображений через агентную систему. Сначала изображение анализируется как обычно, LLM предлагает какие-то правки через python вроде обрезания, зума на сложных участках, аннотирует табличные данные или дорисовывает красные прямоугольники чтобы считать пальцы. После этого цикл повторяется пока модель не будет довольна результатом. Все эти танцы с бубном дают +5-10% к визуальным бенчмаркам относительно базовой модели.
Доступно демо в Google AI Studio,
а также в AI Studio Playground (нужно включить Code Execution)
Блогпост

NVIDIA: Earth-2
Семейство моделей для метеорологии. SOTA в направлении замены уравнений Навье-Стокса на сильно более вычислительно дешевые AI модели.
Блогпост, GitHub, HF


Что-то много интересного вышло, в дайджест не вошли новости о том что:
- OpenAI выложили техрепорт об устройстве Codex CLI
- OpenAI сделали LaTeX ориентированную среду для ученых Prism.
- Figure AI выпустили модель Helix 02 для управления своими роботами.
- Появился реддит для ИИ Moltbook и свел всех с ума
- Вышедший 3 месяца назад агент-аркестратор LLM Clawdbot Moltbot OpenClaw тоже неожиданно свел всех с ума
- Вышла Kimi K2.5 как написано в блогпосте Visual Agentic Intelligence

Читать полностью…

Борис опять

Она: ты у меня первый

Так же её история переписок:

Читать полностью…

Борис опять

зря вы дали мне клода....

https://huggingface.co/spaces/AlexWortega/hr-breaker

Читать полностью…

Борис опять

По просьбам трудящихся был добавлен режим для настоящих волчар, который активируется по флагу —no-shame и сильно ослабляет проверки. Ллмкам всё ещё запрещено изобретать новые места работы и всякое такое, но гораздо больше свободы для вольных интерпретаций.

Прикладываю своё резюме на позицию "Водитель на илосос"

Естественно не советую это применять при реальном поиске работы, фича сделана ради прикола

UPD: и убрал торч из зависимостей — теперь ходит за эмбеддингами в gemini embedding модель

Читать полностью…

Борис опять

Для примера

1. Моё резюме в текущем виде, с косяком в виде части текста вылезшего на вторую страницу
2. Результат оптимизации под вакансию Computational Scientist в медицинском домене на которую я объективно не подхожу

Косяки форматирования поправлены, ничего не выдумано, важное не опущено, безобидные базворды насыпаны, всё что нужно притянуто за уши (статья про ковид как нечто наиболее релевантное к медицине)

Особенно забавно давать ему что-то соверешенно нерелвантное и смотреть как оно пытается натянуть очень узкую сову на очень большой глобус

Читать полностью…

Борис опять

# Честно про жизнь без работы 2/3

Если выделять один ключевой вывод, то жизнь не особо изменилась. Я всё так же сижу перед монитором большую часть дня, только теперь мне за это не платят. Я все так же терпеть не могу созвоны. Так же занимаюсь спортом в лучшем случае два раза в неделю. Я все так же ложусь спать за полночь и встаю поздно. У меня всё так же есть дни и даже недели которые словно улетают в никуда. Самое забавное: у меня всё так же ощущение, что ни на что не хватает времени и сил! Все как раньше, только теперь не на кого свалить ответственность.

В моих кругах очень романтизируется прекращение работы "на дядю", свой консалтинг или стартап, путь свободного художника и всяческий дауншифтинг. Работа в IT к этому располагает. Я и сам очень люблю мемы про то, как я с детства мечтал приносить shareholder value и достигать не менее 75% поставленных OKR.

В общем, глобальной перемены не случилось примерно ни в одной сфере жизни. На основе своего опыта могу сказать, что вся эта романтизация фигня. Это просто другая конфигурация жизни. Я думаю, что мы стремимся к некоторому привычному образу жизни, в моем случае тревожной креветки за компьютером, и среда должна кардинально измениться, чтобы выдернуть нас из этого.

Возможно тут дело в том, что я не ушел в настоящий дауншифтинг. Я уходил с работы, чтобы больше делать то, что я хочу, а не чтобы ничего не делать. Я стал писать книгу чаще. Я почти сразу сел кодить пет проект, чтобы сделать свой собственный data engine. Я довольно быстро обнаружил себя на парттайме, где я писал бенчмарк по Machine Unlearning для AI safety лабы. Позже консалтинг, карьерные консультации. В общем, я на самом деле продолжил жить жизнью айтишника. Наверное, если бы я уехал работать барменом в фавелах Рио, то перемены были бы радикальнее.

При всем этом я не хочу сказать, что это плохо. Я писал свой data engine без оглядки на то, нужен он кому-то или нет, что ощущалось охуенно. Во взрослой жизни ты постоянно обусловлен окружающей средой. Очень приятно сделать что-то потому что хочется

Кроме того жизнь действительно стала интереснее. Я стал чаще выбираться куда-то и чаще пробовать новое. Событий на квадратный метр календаря стало больше. Да, бесполезные дни есть, но их как будто гораздо меньше. На работе у меня часто было такое: я поработал, поел и позалипал вечером. Вот и день прошел, но зачем я его жил? Сейчас такого почти не бывает.

Просто перемена не такая радикальная как хотелось бы. Запал ведь был огромный: сейчас уволюсь и буду проходить курсы, шутки для стендапа писать каждое утро, по стартапу в месяц тестировать, на все подкасты ходить, лонгриды писать! Я ведь получу плюс восемь часов в день. Время будет некуда девать! Чтож, оказалось не так радужно. Освободившееся время как минимум на 60% заполняется залипанием в телеграм чаты и ещё чем-то непонятным. В целом было странно ожидать, что уволившись с работы я стану более дисциплинированным.

Однако те 40%, что удается выгрызть, почему-то очень ценные. Когда мне пишут с предложениями о работе, даже на позиции о которых я бы раньше мечтал, мне почти никогда не интересно. Это даже пугает меня. Страшно привыкнуть и стать творческим бомжом для которого никакая зарплата не стоит того ужаса, чтобы подключаться на один зум митинг в день. Я ожидал, что желание выйти на работу волшебным образом появится когда деньги подойдут к концу, но этого не произошло.

Парадоксальным образом, я теперь как будто проще отношусь к работе. Раньше это бы вопрос идентичности: если я работаю на крутой работе, то я молодец. Внутри я всегда боялся её потерять хотя предпосылок никогда не было. Из-за этого я сильно переживал. Теперь я знаю: могу работать в найме, могу не работать в найме. Есть плюсы и минусы.

Часть 2/3

Читать полностью…

Борис опять

#дайджест

Дайджест AI/ML за неделю 2 - 8 февраля 2026

Anthropic: Claude Opus 4.6
SOTA на агентных задачах, впереди с отрывом в работе с длинным контекстом, в бете миллион токенов контекста. ARC-AGI-2 тоже сильно вырос. Подробнее в моем обзоре на System Card. Также для модели добавили режим fast с генерацией 100 токенов/с (в 2.5 раза быстрее) по цене в 6 раз дороже на случай если вам некуда было девать ваши миллионы.
Блогпост, Системная карточка

Anthropic: Agent Teams
Симуляция команды разработки внутри Claude Code. Запускает несколько сессий с общим контекстом и ролями, lead-агент координирует работу остальных.
Включается через переменную среды CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS
Блогпост

OpenAI: GPT 5.3 Codex
Новая модель для Codex ожидаемо с ориентацией на кодинг и агентность. В стравнении с Opus 4.6 большой отрыв в Terminal-Bench 2.0 на 12п.п. По SWE-Bench не сравнить, из-за того что Anthropic замеряют SWE-Bench-Verified, a OpenAI SWE-Bench-Pro. Так как Codex выкатили позднее, есть подозрение что на SWE-Bench-Verified он проигрывал. Модель работает на 25-40% быстрее предыдущей версии.
Блогпост
Блогпост-ru (теперь у OpenAI есть версии сайта с бросающимся в глаза машинным переводом)

OpenAI: Frontier
B2B инструмент для создания агентной инфраструктуры. Сейчас тестируется в нескольких компаниях, цены или дата выхода не ясны.
Блогпост

Kling: Kling 3.0
Новые модели и ребрендинг названий,
Kling 2.6 -> VIDEO 3.0 для генерации видео по промпту,
а Kling O1 -> VIDEO 3.0 Omni для редактирования с подачей на вход и аудио и видео.
Теперь можно выбирать длину видео от 3 до 15 сек, есть фиксация персонажей и предметов через Elements. Выгладит очень круто, персонажи играют лучше чем многие актеры.
Блогпост

Менее значительные релизы:

xAI: Grok Imagine 1.0 у Маска теперь тоже есть видеогенератор, есть звук, генерация до 10 сек, доступно бесплатно здесь

Google: PaperBanana - агент для создания академических иллюстраций
попробовать здесь, статья, GitHub

ACE-Step: ACE-Step 1.5
Open Source Генератор музыки, теоретически должен запускаться на 4GG VRAM
демо, черри-пики, веса, статья

Nvidia: Nemotron ColEmbed V2 SOTA семейство моделей (3B, 4B, 8B) для OCR.
HF, Статья

ElevenLabs: Eleven v3 вышла из альфа тестирования. Есть все фишки новых TTS в виде большего контроля и эмоциональности
блогпост

Waymo+Deepmind: The Waymo World Model модель мира на основе Genie 3 для обучения беспилотных автомобилей Waymo. Видят основной юзкейс в генерации редких ситуаций, вроде слонов и торнадо на дороге.
блогпост

@boris_again

Читать полностью…

Борис опять

💅 Выкладываю Arxiv at Home: Семантический поиск по статьям на своем железе

Стандартный поиск arXiv — это танец с бубном. Semantic Scholar иногда ищет не то, что хочешь. SerpAPI по Google Scholar платный.

Поэтому я за выходной собрал Arxiv at Home — open-source движок для семантического поиска статей, который можно развернуть локально.

По фичам:
* Гибридный поиск: Retrieval Stage из эмбеддингов и BM25, сверху нейронный реранкинг.
* Citation Boosting: Формула ранжирования учитывает не только смысл, но и импакт статьи. Сейчас для получения цитат используется бесплатный Batch API Semantic Scholar.
* Инкрементальные обновления: Умная синхронизация, тянет только новые статьи, не обрабатывая весь датасет заново.
* Оффлайн-режим: Всё локально, кроме цитат. Цитаты можно отключить в конфиге.

Кстати, сама API-шка stateless и хорошо скейлится горизонтально, а для стораджа используется PostgreSQL и QDrant - по идее, эту штуку можно развернуть примерно где угодно.

Код и инструкция по запуску на GitHub:
🔗 github.com/mrapplexz/arxiv-at-home

Читать полностью…

Борис опять

Моё новоё резюме пастуха овец с особой инструкцией: лидить ML команды и лидить стадо овец это почти одно и то же. Теперь на русском языке

Читать полностью…

Борис опять

Я раньше постил прикол, но с тех пор он стал реальностью: регистрация на Claude Code Hackathon происходит через LLM форму

Читать полностью…

Борис опять

Угадайте с трех раз кто из них инженер

Читать полностью…

Борис опять

BabyVision: Visual Reasoning Beyond Language https://unipat.ai/blog/BabyVision

Читать полностью…

Борис опять

Если написать достаточно грустный промпт LLM чувствует тоску и переходит на русский

Читать полностью…

Борис опять

Верить в "its just scale" больше не модно, однако я все больше убеждаюсь во мнении, что решает ML/AI твою задачу или нет в первую очередь определяется способностями модели. Промтпы, скаффолды, раги и прочие костыли вносят эффект в пределах чуть больше погрешности. Даже если они помогают, то со следующим релизом модели побольше и поумнее эффект пропадает.

Несколько наблюдений на тему. Я сейчас играюсь с GUI агентами, даже сделал свой скаффолд а-ля MobileAgentV3. Общаясь текстом ты не сразу увидишь разницу скажем между Gemini 2.5 Flash, Gemini 3 Flash и Gemini 3 Pro. Но когда ты сажаешь эту штуку управлять телефоном через тулколы разница видна моментально несмотря на то, что модели обучались на схожих данных. Flash 2.5 не может тапнуть куда нужно, принимает иконку Google Translate за Google Play, галлюцинирует целые экраны. Flash 3 уже сносно работает, Pro 3 делает прям вау.

Причём ты можешь дать маленькой модели самый лучший скаффолд, заточить тулы под задачу, очень хитро и умно оптимизировать контекст и всё равно будет плохо. Ты можешь дать большой модели всё максимально кривое и она разберётся.

Другие наблюдения которые объясняются этой гипотезой. Почему Claude Code сработал так, как не сработал до этого Cursor? Потому что вышли Sonnet 4.5/Opus 4.5 у Claude Code и вкупе с максимально простым скаффолдом (фор луп + тулколлы + периодический compact) вдруг заработало. Почему у людей зааработал OpenClaw сделанный максимально проклято, хотя предыдущие попытки сделать такого ассистента не смогли? Вышел Sonnet 4.5 и заработало.

Вывод я для себя сформулировал так. Делая что-то на LLM надо начинать с самой умной и дорогой модели, а затем смотреть насколько ты можешь снизить косты не потеряв в качестве катастрофически. А не начинать эксперименты с мелких моделек и расти по необходимости. Ты понаделаешь для мелких моделей тонну костылей, но все равно не заработает, и все это будет впустую так как большим моделям костыли не нужны и даже мешают.

Очень хочется любить мелкие модели, но не получается

Читать полностью…

Борис опять

Заметили как нам три года снова и снова продают кусочки маркдаун текста? .cursorrules, agents.md, claude.md, skills, slash commands, subagents... Каждый раз платные буквы

Хотя я и Скайрим как минимум три раза купил

Читать полностью…

Борис опять

Мужское желание запустить с братанами стартап по ллм агентам прямо перед тем как пузырь лопнет

Читать полностью…

Борис опять

Внесезонный Московский митап читателей Скотта Александера

(Гостевой анонс)

Где: площадка ЦДО Моноид, г. Москва, Ломоносовский пр-т, 25к3, помещение 15

Когда: 2026.02.01 (воскресенье) с 16:00 до 21:00

Как попасть: возьмите паспорт, воспользуйтесь @MonoidBot

Чат: /channel/+-rklmbNwMvE0YTgy

Формат: свободное обсуждение. В прошлые разы люди стихийно образовывали группы по интересам и периодически переходили от одной к другой. Обсуждение не ограничивается постами Скотта, но обычно они служат отправной точкой.

О Скотте:
Сейчас он пишет на https://www.astralcodexten.com/
Ранее писал на https://slatestarcodex.com

Старое интро от него самого, с подборкой классических старых постов
https://slatestarcodex.com/top-posts/

Правила:
- Не пьем алкоголь, не приходим в состоянии опьянения - снеки будут, но можно принести и свои;
- Не курим и не вейпим в помещении - можно на улице, но не прямо под окнами;
- Не приходим с симптомами ОРВИ - бережем и свое здоровье, и здоровье других;
- Не ходим по помещению в уличной обуви - берите красивые носки или тапочки;
- Бережно относимся к помещению, другим и себе.

Кого спрашивать если что-то не так: @red_hara , @MonoidAdmin

Читать полностью…

Борис опять

В комментариях обсуждали мой опыт с HR Tech тулами и почему я считаю, что в среднем там очень слабый ML.

Я поделился ссылкой на один абсолютно астрологический тул под названием thrive как пример 100% пыли в глаза. Они дают странные психологические тесты и потом гаданием на кофейной гуще говорят как сотрудникам развиваться. Берут много денег.

Превьюшка у их сайта оказалась вот такая. Продукт который говорит сам за себя!

Читать полностью…

Борис опять

Лучшая попытка соптимизировать моё резюме MLE под позицию пастуха овец 😂

Читать полностью…

Борис опять

На днях обсуждали с админом @pseudolabeling, что автоматические фильтры резюме совсем оборзели. Некоторые ребята которых я менторил из-за этого вручную оптимизировали резюме под каждую вакансию. Почему бы не автоматизировать?

Навайбкодил https://github.com/btseytlin/hr-breaker:

1. Загружаете резюме
2. Даете ссылку на вакансию
3. LLM вооруженная тулколами генерирует оптимизированное резюме (в том числе по советам из методички)
4. Делаются стандартные проверки: keyword matching, vector similarity, проверка LLM-кой (в том числе визуально, что всё не поехало), проверка на галлюцинации, проверка на очевидный AI-generated текст
5. Если хотя бы одна проверка не пройдена оптимизация продолжается

Важно, что всё сконфигурировано не врать и не изобретать опыта которого нет, поэтому получается очень неплохо. Но если у вас нет совести ничто не мешает форкануть, поиграться с промптами и отключить пару проверок 🤗

UX сделан для массовой подачи: кладет оптимизированные PDF в папку с указанием роли и компании, чтобы вы не забыли какое резюме куда отправляли.

Скачиваете, подставляете свой ключ Gemini API, uv run и уничтожаете скрининг как явление. Добейте выживших

@boris_again

Читать полностью…
Subscribe to a channel