Книга «Разработка приложений на базе больших языковых моделей» Сухаса Пая призвана помочь разработчикам закрыть разрыв между вызовом API языковой модели и построением реально работающего и конкурентного на рынке продуктового приложения. Книга разбирает LLM как компонент сложной системы — от устройства трансформера до RAG-конвейеров и агентов. Для разработчика или ML-инженера, уже прошедшего стадию первого прототипа, это полезное русскоязычное издание, где архитектура LLM-приложений разобрана шаг за шагом, без сведения материала к перечню промптов.
Читать далееЧто бы мы ни делали, в результате генерируются данные. А когда ничего не делаем, тоже генерируются – только другие. Все, что сгенерировали, потом анализируют, проверяют, изменяют, продают и используют для генерации новых данных. В 2026 году глобальный объем данных достиг 200 зеттабайт, около половины из них сгенерировал частный сектор.
При этом данные становятся разнообразнее и сложнее. Двадцать лет назад пользовательский клик фиксировался тремя полями: идентификатором пользователя, временем и самой операцией. Сегодня за тем же действием могут стоять запрос к нескольким сервисам, bounce rate, информация об авторизации, реакция на рекламу, пользовательские сценарии и куча чего еще. И чем больше появляется сценариев, тем больше данных нужно собирать и обрабатывать.
Привет, меня зовут Дмитрий Кузняков, я отвечаю за развитие платформы данных для BI-аналитики в Goodt (ИТ-холдинг LANSOFT), и в этой статье я расскажу, почему мы выбрали подход федерации данных для своего продукта Insight.
Читать далее«Просто прикрутить вход через Steam и цены из маркета» — примерно так это выглядит из бэклога. На деле: OpenID 2.0 образца 2007 года вместо OAuth, звёздочка ★ в имени ножа, из-за которой одно и то же название готовится для двух соседних эндпоинтов противоположными способами, и цена, приходящая строкой в чужой локали. Собрал все проблемы в одном месте.
Читать далееМы разбирали, почему в нашем продукте люди включают режим, который включать не собирались. Перед этим стоит подтверждение с описанием последствий. Оно там появилось именно затем, чтобы этого не происходило.
Я посмотрел записи сессий и посчитал время между появлением окна и нажатием кнопки. Медиана - около трёхсот миллисекунд, и в интервал короче секунды попало больше четырёх пятых случаев. Прочитать текст за это время нельзя даже по диагонали.
Первым делом я предложил переписать текст короче и понятнее. Мы переписали. Время не изменилось.
Читать далееСалют, Хабр!
Меня зовут Маркос, я руковожу разработкой аппаратной части устройств Сбер, в том числе интеллектуальных колонок. Особенно их — я более двадцати лет занимаюсь исследованиями и разработкой в области электроакустики (включая разработку линеек активной концертной акустики одного из мировых лидеров индустрии).
В новом поколении колонок мы поставили себе задачу дать её владельцам уникальный пользовательский опыт и выстроить свой фирменный звук. Так появилась мощная стационарная колонка СберБум 2.0. Устройство премиум-класса, звучащее как Hi-Fi начального уровня.
Сегодня расскажу об акустике колонки: почему у неё не семь динамиков, какой диапазон частот ключевой для стереоэффекта и чем наш пользовательский эквалайзер отличается от других.
Читать далееКлубника — хороший пример задачи, которая для человека выглядит элементарно, а для робота оказывается довольно сложной. Человек практически одновременно видит ягоду, оценивает её спелость, понимает, где она находится в пространстве, просовывает руку между листьями и другими ягодами, берёт плод с подходящим усилием и отделяет его, стараясь не повредить.
Для робота каждый из этих шагов превращается в отдельную инженерную задачу.
И это не только учебная проблема. Современные обзоры роботизированного сбора отмечают, что сбор свежей клубники по-прежнему сильно зависит от ручного труда, а сама ягода сложна для механизации из-за мягкости, неоднородного расположения и риска повреждения. Отдельная проблема — перекрытие ягод листьями, стеблями и соседними плодами.
Читать далееMiro продали в 13 раз дешевле оценки 2021 года, и я пошёл считать, что вышло из нашей попытки уйти от подписок. За год мы заменили Tilda, Confluence, Jira и Slack своим кодом, целей было две: экономия и гибкость. Экономии не получилось: по полной ставке сеньора и с учётом владения первый год ушёл в минус около 2 млн. Гибкость, кажется, получилась, и выяснилось, что трекер до рабочего состояния доводит не разработчик, а скрам-мастер. В статье цифры по четырём заменам, инцидент с уязвимостью в авторизации, который заставил поставить ревью второй нейронкой, и критерий из трёх вопросов, что переписывать не стоит.
Читать далее31 августа прод моего приложения пролежал около часа.
Причина была обидно простой. Агент добавил в коммит все файлы из общей рабочей папки, вместе с чужой недоделанной работой. Потом сделал это еще раз. Во второй раз уже после того, как сам записал в правила, что так делать нельзя.
Дальше он начал чинить. Ошибка, правка, следующая ошибка, еще правка. Каждая починка тянула за собой новую поломку. Я посмотрел на это и написал: «верни просто старую версию» То есть откатись к последнему состоянию, про которое точно известно, что оно работало.
И тут поймал себя на странном ощущении. Я только что провел разбор инцидента. Ровно так, как годами делал это на работе с живыми командами. Мысль, которая крутилась у меня с июня, в тот вечер наконец сложилась: я не пишу приложение с ИИ. Я управляю департаментом.
Читать далееДля описания архитектуры важно выбрать подход, который будет понятен всей команде. Одним из них является нотация C4, разработанная Саймоном Брауном.
Данная статья — это продолжение и значительное дополнение моей предыдущей статьи по C4, опубликованной в 2023 году. Здесь я детально разобрала для вас каждый уровень и элемент нотации, распространённые ошибки и спорные вопросы, а также инструменты для создания диаграмм, в частности графический редактор Draw.io и Structurizr для создания C4 через код.
Внутри — много схем, картинок и практических примеров для монолитной и микросервисной архитектуры, готовый код Structurizr и промпт для ИИ. Статья организована таким образом, чтобы вы могли открыть её, последовательно пройти все разделы и самостоятельно разобраться с C4.
Статья будет полезна системным и бизнес-аналитикам, архитекторам, разработчикам, менеджерам проектов и всем, кто участвует в проектировании архитектуры систем.
Читать далееВ компании может быть сильная команда, десятки идей и стабильный бизнес — но при этом не быть единого ответа на вопрос: куда двигаться дальше?
Продажи требуют ресурсов на привлечение клиентов, маркетинг предлагает новые сегменты, производство говорит об ограничениях, HR — о дефиците людей, а собственник видит еще несколько направлений роста. Каждое предложение может быть разумным, но ресурсов одновременно на всё не хватает.
В такой ситуации компании нужен не очередной мозговой штурм, а управленческий выбор: на чем сосредоточиться, от чего отказаться и какие решения реализовывать в первую очередь.
Для этого и проводят стратегические сессии.
Читать далееVault Audit AI вырос из Obsidian-плагина для аудита заметок в систему с отдельным Companion, MCP-доступом для AI-клиентов и безопасными change proposals. Рассказываю, зачем пришлось разделить проект на два репозитория, почему агентам нельзя напрямую писать в Vault, как устроен self-hosted Companion и почему всё это в итоге привело к ребрендингу в Veynrel.
Как это устроеноПочтовый аудит-лог Яндекс 360 отдаёт запись о событии структурой ответа AuditLogService_Mail, а в ней 22 поля (справочник Яндекс 360 API, сверка 10 сентября 2026 года). Тема письма и адреса участников среди них есть, а ни суммы, ни контрагента, ни номера договора нет. Ограничения распознавания и рекомендации к качеству входа я привожу по документации Anthropic, а дальше идёт моя инженерная логика: какой шаг создаёт недостающие поля и чего это стоит.
Смотреть, чего нет в записи о событии.# Сторож на ESP32-CAM
Возникла следующая практическая задача: в ограниченном пространстве (узком коридоре, лестничном пролете или тамбуре), отследить активность, сделать фото пространства и уведомить пользователя, переслав фотографии в телеграм. При этом известно, что в месте наблюдения установлен бытовой датчик движения, который включает освещение.
Читать далееВот было у Вас такое, что на вход реализованному на Python автоматизированному процессу, принципиально не использующему приложение Microsoft Word и COM-объекты, нет-нет да и придет файл с расширением docm? Ведь фактически, чтобы обращаться к текстовым файлам, на текущий момент в экосистеме Python существует только одна более-менее функциональная (и, что греха таить, бесплатная) библиотека – python-docx. А она позволяет работать только с docx-файлами...
Читать далееIMPulse - ChatOps система менеджмента инцидентов. Если вы получаете алерты напрямую от Alertmanager, IMPulse поможет формировать из них полноценные инциденты с эскалацией, ответственными и тредом обсуждения проблемы. Подробности в статье.
После прошлого поста вышли v3.4.0-v3.7.0. Ниже - что изменилось по факту.
Читать далееВ 2026 году решили расширить штат. Разместил вакансию, начался поиск.
За первые два дня после публикации вакансии пришло более 400 откликов. Это сумасшедшая цифра... Ладно, собрался, отфильтровал, осталось около 300.
Начались собеседования, и именно на них я был сильно удивлён, ведь не так давно ситуация была другая…
Читать далееПроцесс VM везде один, но дьявол в деталях. Где в АСУ ТП нельзя просто запустить сканер, какие сетевые уязвимости встречаются чаще всего, почему полмиллиона камер и роутеров с дефолтным паролем однажды положили половину интернета, что такое prompt injection в ML-системах и где прячутся уязвимости на уровне прошивок и процессоров (Spectre, BadUSB). Обзор специфики разных сред.
Читать далееХабр показывает материалы как ленту соцсети: читают в основном свежее и обсуждают, а через пару недель статья уходит из поля зрения и может попасться читателю если на нее приведет внешний поисковик или по пользователь перейдет с внешнего ресурса. В ленте выигрывают частота публикации и объем. При этом за 20 лет на ресурсе накопилась редкая база знаний: некоторые старые статьи до сих пор отвечают на актуальные вопросы, их держат в закладках, а темы живут десятилетиями.
Я отлично понимаю что любой проект в этом мире пытается выжить и получать прибыль. К чести этого ресурса, у читателя есть возможность сконцентрироваться на контенте и не отвлекаться на мерцание рекламы и баннеров! Но в этом же плюсе Хабра кроется и минус - реклама становится не явной, а вплетенной в текст.
Начинаешь читать материал и получаешь ссылки на телеграм каналы в статьях независимых авторов призывающих подписаться. А в корпоративных блогах рекомендации виртуальных машин на хостинге, подписки на агрегаторы AI чатботов, дозы нейрослопа для поисковой оптимизации сайтов и продуктов с 2023 года, продвижение HR бренда компании для создания очереди кандидатов и тому подобное. И с этим вряд ли станет лучше. Не спасет читателя модерация и политики платформы.
Нарушается баланс между коммерческими интересами продажи корпоративных подписок и мотивацией независимых и не оплачиваемых авторов-энтузиастов создавать и публиковать полезные материалы. Когда техническую статью на которую ты тратишь дни своей жизни в ленте вытесняют генерируемые быстрее кроликов фибоначчи поверхностные материалы, созданные ради продвижения бренда. Автор не находит своего читателя, а все что было дальше второй-третьей страницы ленты уже вряд ли попадется кому-либо на глаза, кроме небольшого шанса быть прочитаным людьми при попадение в выдачу гугла и яндекса.
Я не агитирую “пчел против мёда”! Но предложу свой подход, который позволяет искать нужную информацию среди десятков и сотен тысяч статей. На Хабре есть контент высочайшего качества: описания решений практических задач, фреймворков, технологий, фич и конструкций языков программирования, как выжить в корпорации или стартапе. И все это можно найти как человеку, так и автоматизированным агентам, нужно лишь обработать и подготовить этот массив информации. И да, здесь для обработки статей и их группировки используются нейросети и алгоритмы кластеризации.
Будем группировать 34 тысячи статьи Хабра по смыслу и каталогизировать их, читать похожие по теме не доверяя ключевым словам и хабам которые указал автор материала. Таким же образом вы можете создавать свою локальную базу знаний из личных материалов и записок на работе и дома, при желании не делясь этой информацией с облачными API сервисами нейросетей. Эту же структурированную информацию будет гораздо проще найти и AI агенту для решения ваших технических задач, где нужны точные решения, алгоритмы и “рецепты”.
Материал в статье, не скрывающийся под спойлером, написан вручную дедовским “ламповым” методом.
Читать далееВо многих статьях про нейросети и 152-ФЗ написано, что за отправку договора с чужими персональными данными в ChatGPT компании грозит штраф 20 тысяч рублей. Цифра из старой редакции КоАП, и она про должностное лицо, а не про компанию: с мая 2025 юрлицу это 150-300 тысяч. Я полез в текст закона, в цифры Роскомнадзора и в суды. Нашёл одно российское дело про нейросеть - трудовое, а не про персональные данные, - и в нём суд сказал вещь, которую пора принять всем: отправить документ в нейросеть - это передать его третьему лицу. Дальше - что именно нарушает договор, вставленный в ChatGPT, чего он не нарушает, и почему 15 миллионов из заголовков к этому не относятся.
Читать далееДоступен Firefox 156.
В этой версии cнижено потребление ресурсов процессора и памяти при уменьшении больших изображений JPEG до размеров страницы.
( читать дальше... )