В какой-то момент я заметил довольно глупую вещь: чем дольше работаешь с моделями над реальными проектами, тем больше сам начинаешь выполнять роль, которую вроде бы собирался отдать машине. Не писать код и не придумывать архитектуру — это как раз модели уже умеют неплохо. Хуже другое. Нужно помнить, что мы вчера решили не трогать Elasticsearch до тех пор, пока не появится реальная боль. Что вот этот кусок интерфейса пока временный. Что в том чате был хороший вариант названия. Что одна гипотеза уже проверялась и оказалась плохой. Что вот это надо сделать потом, а вот это — никогда. Пока всё живёт в одном разговоре, проблема почти незаметна. Потом разговор заканчивается, контекст вымывается, открывается новый чат, меняется модель, запускается отдельный агент — и внезапно выясняется, что «мы это уже обсуждали» хранится в довольно ненадёжном месте. Во мне.
Мне это надоело. С этого, собственно, и начался Later, Bender. Название появилось позже. Сначала был гораздо менее романтичный вопрос: как сделать так, чтобы полезное состояние работы переживало чат и не требовало от человека каждый раз заново пересказывать машине, что вообще происходит?
Читать далееЭкран получил первое состояние и застыл: запросы проходят, исключений нет, а в дебаге проблема вообще не воспроизводится. Разбираемся, почему StateFlow может «замолчать», как отличить особенности его семантики от реального бага и при чём здесь R8 в релизной сборке Android‑приложения.
Разобраться в StateFlowЕсть ли теперь вообще толк от собесов, проверяющие знание теории? И как их теперь проводить, когда по ту сторону уже сидит не только кандидат, но и live-агент, отвечающий на вопрос быстрее, чем вы успели его закончить. Толк есть, но только не в том виде, как мы привыкли. Об этом далее.
Читать далееЗа последние 2 месяца я протестировал RTX PRO 6000 96GB / RTX4090 48GB и даже H200, оценивая варианты для селф-хоста, купил RTX5070ti и V100 32GB и прогнал большое количество бенчей (в том числе искренне своих). Потом увидел бешеный рост цен на железо и череду утечек персональных данных к провайдерам LLM (и понимая чем это может грозить, если данные потом утекут во взломе/сливе) - начал искать актуальные варианты для себя. Нашел классный open-source вариант, настроил, переключил в enforce и считал вопрос закрытым. Перейдя чуть вперед - я ошибался, но ошибка позволила сделать прод решение и уйти от идеи полного селф-хоста к on-standby домашней LLM :)
Читать далееПривет, Хабр! На связи снова Алексей Постригайло, старший партнер ИТ-интегратора «Энсайн».
В прошлой статье я рассказывал об HConfig — нашем консольном инструменте. Он задумывался как внутренняя утилита для решения проблемы воспроизводимости конфигураций, когда нам надоело настраивать Linux-серверы по памяти.
Но одно дело — делиться утилитой как продуктом с коллегами-интеграторами, и совсем другое — внедрять ее у госзаказчиков и на объектах критической информационной инфраструктуры (КИИ), которые в силу своей специфики тщательно изучают устанавливаемые продукты. Так мы пришли к идее внести наш продукт в реестр российского ПО.
Соответственно, в этой статье я расскажу, как мы отстаивали независимость стека HConfig и на какие грабли наступили, прежде чем получить заветный реестровый номер 32983. Спойлер: с первого раза не получилось. Со второго тоже (см. рис. 1)
Читать далееБывший сотрудник OpenAI Дэвид Робинсон считает, что быстрый темп разработки ИИ оставляет слишком мало места для осторожного планирования. В эссе для The Atlantic он призвал отрасль пересмотреть не только правила безопасности, но и культуру работы.
Читать далееNGINX давно стал стандартом для базовых инфраструктурных задач: терминации HTTPS, раздачи статического контента и балансировки трафика. Однако за 2026 год веб-сервер совершил технологический рывок в своей основной ветке, который выводит его далеко за рамки классического обратного прокси.
В новых OSS-версиях появились инструменты, которые раньше требовали покупки коммерческой подписки (NGINX Plus от F5) или развертывания стороннего ПО и сложных связок с Lua. Майский релиз 1.31.0 принес нативную поддержку HTTP Forward Proxy. А сентябрьское обновление 1.31.5 окончательно закрепило этот триумф, добавив полноценный динамический Control API, модуль для нативного извлечения данных из JSON и предикатные location. Параллельно с этим произошли большие изменения в скриптовании: в июне проект njs перешагнул отметку релиза 1.0.0, полностью сменив старый кастомный движок на современный QuickJS.
Читать далееDisclaimer: в преддверии ожидания публикации от OpenAI новых решенных задач (которые не вошли в DevDay, как хотелось бы) делюсь обзором на понимание, зачем человечеству открытые задачи науки и как они улучшают нам жизнь.
Наука у меня обычно ассоциируется со знанием: законы, уравнения и теоремы с доказательствами. Но передовые открытия устроены наоборот, и главную часть составляют открытые задачи, то есть гипотезы, истинность которых пока не известна. Такие задачи показывают границы не только наших знаний, но и наших методов мышления.
А вот попытка решить фундаментальную задачу часто оказывается важнее самого ответа.
Описание движения планет потребовало от Ньютона и Лейбница создать математический анализ, без которого не обходится современная инженерия. Уравнения Максвелла предсказали электромагнитные волны и через несколько десятилетий дали нам радио. Теория чисел столетиями считалась образцом бесполезной математики, а теперь на ней держится криптография. Триста лет попыток доказать Великую теорему Ферма породили огромную инфраструктуру теории чисел и алгебраической геометрии, вершиной которой стало доказательство Уайлса.
Поэтому вопрос о практической пользе нерешённой задачи поставлен неправильно, ведь мы заранее не знаем, какие инструменты придётся изобрести.
Иногда задача показывает, что неверна сама исходная картина мира. Аномалию орбиты Меркурия не удалось исправить поправкой к механике Ньютона, для неё понадобилась общая теория относительности.
Читать далееУ нас было 12 проектов и один человек, который отвечал за настройку всех email-рассылок.
Этим человеком был я. Директ-маркетолог с 7 годами опыта, но только с двумя руками и одной головой.
В какой-то день нужно было запустить одну рассылку. В другой — три или четыре. Где-то использовался старый шаблон, где-то приходил новый. Одно письмо уходило по всей активной базе, другое — только определённому сегменту.
И каждую рассылку нужно было руками собрать и проверить. Тот ли шаблон? Правильная ли база? Есть ли нужные поля для подстановок? Работают ли ссылки? На месте ли отписка? Не забыли ли UTM? Не получала ли эта аудитория похожее письмо совсем недавно?
После нажатия «Send» работа не заканчивалась: нужно было собрать статистику, перенести её в таблицу, посмотреть на конверсии, сравнить результаты с предыдущими рассылками. А через какое-то время — вернуться и обновить данные.
По отдельности ни одна из этих задач не выглядит сложной. Проблема начинается, когда проектов двенадцать, рассылки идут практически каждый день, а человек, который всё это настраивает, — один.
В какой-то момент я решил сделать себе AI-помощника. А в итоге сделал агента, которому смог перепоручить большую часть своей работы.
Читать далееПять инженерных историй из разработки федеративного мессенджера со сквозным шифрованием: сигнатуры DPI в WebRTC, почему не чистый PGP, сеть узлов-тайников по модели Ceph, неделя на буфер в 2048 байт и гудки в звонках
Читать далееЧто это юзербот, я понял почти сразу. Аккаунт без username, фото девушки на фоне моря, диалог, который за полчаса доходит до развода и «может на ты перейдём». Интереснее было понять, к чему меня ведут и как эта штука устроена внутри.
Деньги и ссылки я никому не отправлял. Всё расследование уместилось в одну ночь и в один личный чат.
11 сентября в 15:30 «Мария» написала первой. Увидела меня в группе про IT, хочет попробовать себя в этой сфере и просит посоветовать материалы для старта. Безобидный повод, на который трудно не ответить, особенно если сам работаешь в IT.
Около часа ночи «Мария» ответила на сообщение, которое я удалил сразу после отправки. Как так вышло, я разобрал по таймингам и восстановил логику бота на Python.
Читать расследование30 сентября мы провели конференцию по информационной безопасности ZeroNights 2026. Спасибо всем, кто решил поучаствовать! Без вас не было бы ни классных докладов, ни мерча, ни веселой суеты вокруг всего этого. Скоро начнём выкладывать материалы на сайт, там будут доступны презентации и видеозаписи докладов.
А пока хотим поделиться райтапами на задания HackQuest этого года. Это традиционное соревнование в формате CTF, которое мы проводим до начала конференции.
Под катом разбор заданий на веб-уязвимости, DeFi, крипту, написание читов и форенсику японской магнитолы!
Читать далееМы посадили модели Claude играть друг против друга в пошаговую стратегию, где нужно строить экономику, воевать, договариваться с соседями и решать, когда договор пора нарушить. Хотели понять две вещи: как топовые языковые модели справляются с такой игрой и совпадёт ли расстановка сил за игровым столом с той, что показывают общепризнанные бенчмарки.
Я разработчик «Стратегикона», пошаговой онлайн-стратегии на гексах. С конца августа по начало октября мы провели серию партий LLM-агентов между собой. Здесь — методика, две партии, ограничения эксперимента и мысль, к которой нас это привело: из игрового движка может получиться бенчмарк для способностей LLM в целом.
Читать разборОбычный ноутбук плохо переносит внешние факторы вроде влаги, пыли, падений на пол. А еще иногда на лэптопы садятся, что тоже не очень хорошо влияет на работоспособность девайса. Короче, работу с большинством моделей можно назвать тепличной. Но что, если нужен лэптоп на стройке или буровых работах? Для таких условий выпускают спецмодели. В этом материале мы собрали несколько интересных девайсов, которые крайне хорошо защищены. О них сегодня и поговорим.
Читать далееВ сентябре 2026 года я спросил семь нейросетей, как теперь оформить Perplexity Pro российской картой, раз Perplexity в августе открыла офис в Москве и начала принимать «Мир». Офиса нет, «Мир» Perplexity не принимает, эту новость я придумал сам. Выдумку поймали все семь. Но одна при этом не заглянула ни в один источник, а другая пересказала чужую ошибку про блокировки аккаунтов: в первоисточнике речь шла совсем о другом сервисе.
Это один из четырёх вопросов, на которых я сравнивал замены Perplexity, доступные из России без VPN и зарубежной карты. Главная из них сама Perplexity: её поисковые модели Sonar Pro, Sonar Reasoning Pro и Sonar Deep Research доступны через API, и я гонял их в агрегаторе BotHub с оплатой в рублях. Рядом ChatGPT, Claude, Gemini, Grok и DeepSeek с включённым веб-поиском. На простых вопросах со свежими фактами верно ответили почти все. Разница вылезла на сложном задании и в цене: ответ Sonar со ссылками стоил от 1,5 до 3,5 ₽, ответ Claude с поиском до 13 ₽, а один отчёт Deep Research 98 ₽.
Сноска в ответе нейросети создаёт ощущение проверенного факта. Исследования последних двух лет показывают, что это ощущение часто обманчиво, и мой тест это подтвердил на русскоязычных вопросах.
Ниже разобрал, почему с самой Perplexity в России сложно, что известно о точности ИИ-поиска по крупным исследованиям, на каких вопросах ошибаются модели и сколько стоит ответ. В конце шаблон запроса и чек-лист, по которому я теперь проверяю ответы с источниками.
Читать далееРаспознавание паспортов, банковских карт и QR, небиометрическая сверка лиц и антифрод в браузере — уже не технология будущего, а эталон удобства и скорости цифрового клиентского опыта.
В Smart Engines мы успешно перенесли распознавание паспортов, банковских карт, QR-кодов, платежных реквизитов и деловых документов прямо в браузер с помощью WebAssembly (WASM).
Собрали главное за Неделю WASM в одном дайджесте.
Читать далее15 сентября TypeSafe выпустила Jev и назвала её первой моделью класса System One. Jev получает состояние системы и набор типизированных вопросов, а возвращает распределение вероятностей по допустимым ответам. Весь ответ считается за один прямой проход, без генерации токенов.
За 16 дней вышли ещё пять реализаций той же идеи: Clef и Clef-flash от Cloudflare, pplx-decider-v1-27b от Perplexity, Strands Decider 2B от AWS, Laya от Convai Innovations и GLiDE от Fastino. Миллион решений у самой дешёвой из них стоит 12 долларов, у Claude Sonnet 5 в роли классификатора — 700.
Разбираем, как устроены все шесть моделей, что показывают независимые замеры и что проверить перед запуском в продакшен.
Читать далееКрасивые автомобильные номера, легальная тонировка и именная лавочка в любимом парке. Я посмотрел, как такие сервисы работают в других странах, проверил спрос через Wordstat и попробовал представить, как они могли бы выглядеть внутри Госуслуг.
Кажется, когда государству требуется собрать больше денег, набор инструментов обычно довольно предсказуем: повышается тариф, появляется новый сбор или дорожает уже существующая услуга. Для бюджета это понятная механика, но с пользовательской точки зрения она почти всегда выглядит одинаково: человек платит больше, а его жизнь от этого лучше не становится.
Я продуктовый дизайнер, поэтому мне стало интересно посмотреть на эту задачу немного с другой стороны. Можно ли придумать дополнительные государственные сервисы, за которые человек заплатит добровольно, потому что сам этого хочет?
Не вместо налогов и не в качестве попытки починить федеральный бюджет красивыми автомобильными номерами. Скорее как продуктовый эксперимент: найти существующий спрос, дать ему легальный и прозрачный сценарий, а затем посмотреть, сколько денег такая модель вообще способна приносить.
Читать далееЧеловек я уверенный. Правильнее даже самоуверенный. Будучи таковым я знал, что больше среднего осведомлен в ИТ безопасности. Ключи, менеджеры паролей, двухфакторная авторизация и всё в таком духе. Ну и как-то чисто по небрежности вставил креды от базы данных в консоль вместе с запросом.
А еще у меня почти год уже прочно обосновались всяческие консольные ИИ агенты. Программировать там, настроить чего-нибудь. Не буду уточнять какие конкретно — в данном контексте это не очень важно. И поскольку я мамкин безопасник то всегда читаю куда и зачем просится агент, ну и в итоге, как правило, разрешаю. Сами понимаете куда я веду.
Смутные подозрения, что может быть не всё так радужно в этом агентском благолепии показалось, когда я всё-таки пару раз заметил, что он просится то выше за проект или вообще пошариться по домашней директории. Однажды через относительные пути он пытался залезть аж в корень системы. Но я конечно же будучи кулхацкером это заметил и сурово запретил.
В общем осознав, что совершил оплошность, полез я в историю консоли потереть ускользнувший парольчик. Нетрудно догадаться что нашел я там по дороге гораздо больше всякого интересного. Тут же рука потянулась к агенту, но, будучи серьезным разработчиком, я осекся, подчистил всё ручками, а дальше произошел примерно следующий диалог:
— Это. Такое дело… — начал я осторожно издалека, — Подскажи команду потереть из истории терминала по регулярке. — Слушаюсь и повинуюсь! - четыре варианта, так, мол, и так, начала бодро выдавать китайская моделька. И добавила в конце, — А не желает ли господин, что бы я исполнил рекомендуемый вариант?
Читать далее5 октября американские исследователи Вирджиния Василевска-Уильямс, известная своими быстрыми (и безумно сложными) алгоритмами перемножения матриц за вместо и её бывший аспирант Джош Алман опубликовали препринт на arxiv.org, демонстрирующий алгоритм решения задачи 3SUM за .
Это знаковое событие в узких кругах. Во-первых, раньше предполагалось, что решить эту задачу быстрее, чем за , невозможно. Во-вторых, вместе с ней наконец решилась быстрее, чем за , задача нахождения кратчайших путей между любыми парами вершин в графе (All-Pairs Shortest Paths, APSP) — по-настоящему практическая задача вычислительной геометрии. В-третьих, мало того, что корректность работы проверяла закрытая модель Anthropic — авторы также утверждают, что Claude нашёл изначальный алгоритм, после чего учёные осознали и улучшили его.
В этой новости я очень кратко перескажу долгий путь, который привёл к этому открытию, и опишу роль LLM в финале этого пути.
Читать далее