В Лаборатории искусственного интеллекта «Финама» мы изучаем и развиваем применение ИИ в финансовом домене: от бенчмаркинга LLM до прикладных сценариев в трейдинге, аналитике и управлении рисками. В предыдущей статье мы рассказывали о первой версии нашего набора бенчмарков для оценки финансовых знаний моделей. С тех пор проект вырос, получил отдельную страницу FINESSE-Bench и заметно изменился — и по объёму, и по качеству, и по строгости методологии.
Почему нам вообще важна эта тема? Потому что в финансах недостаточно проверить модель на нескольких популярных открытых QA-бенчмарках и сделать вывод, что она «хорошо понимает домен». На практике мы постоянно видим, что сильные результаты на привычных публичных наборах данных далеко не всегда переносятся на более прикладные, экзаменационные или ориентированные на трейдинг задачи.
По этой причине мы продолжаем развивать FINESSE-Bench как набор бенчмарков, который позволяет оценивать не только среднюю точность модели, но и то, как она ведёт себя при росте сложности, как переносит качество между разными типами задач и насколько уверенно работает в специализированных финансовых сценариях.
В этой статье мы хотим показать, как проект изменился после первой публикации. Мы обновили часть данных и исправили проблемные вопросы в CFA-like Level 1, добавили новый набор данных по техническому анализу — CFTe-like Level 1, расширили пул моделей, усилили расчёт метрик за счёт бутстрап-оценки и аккуратного агрегирования результатов по группам бенчмарков, а также отдельно посмотрели на различающую способность и насыщение самих наборов вопросов.
Читать далееВ первой части статьи мы пришли к выводу, что само использование ИИ не ускоряет инженерную систему. Можно вырастить MAU LLM, потом MAU API, раздать людям кодинг-агентов и всё равно не увидеть изменений в Lead Time, Throughput и Defect Rate.
Проблема в том, что локальное ускорение быстро упирается в остальной процесс. Один человек или одна роль могут начать делать свою часть быстрее, но задача всё равно ждёт требований, проверки, тестирования, согласований, соседних команд или бизнес-эксперта. Поэтому дальше мы пошли в Agentic Engineering.
Читать далееВайб-кодинг появился в начале прошлого года скорее как шутка, но к середине этого года уже стал нормальным способом делать приложения и сайты. Суть такая: ты описываешь задачу обычными словами, а нейросеть пишет код. Потом ты смотришь, что получилось, и просишь что-то поправить: добавить функцию, изменить дизайн, исправить ошибку или объяснить, почему что-то не работает.
В этой статье разберем восемь полезных инструментов для вайб-кодинга: четыре нейросети, которые умеют писать код, и четыре среды, где с ними удобнее всего работать. Ещё покажем простой пример, как сделать приложение с нуля, дадим готовые промпты, разберём частые ошибки и расскажем, как пользоваться такими инструментами из России без VPN.
Читать далееКупили блок питания помощнее, а ПК все равно вырубается в играх? Разбираем, как за полчаса вычислить настоящую причину.
Читать далееСпойлер: оба находятся в опасности, но по-разному. Эта разница имеет значение.
Я не собирался сравнивать веб и мобилку как две враждующие платформы.
Меня всегда больше цеплял другой момент: в проектах они часто выглядят как разные продукты, а ломаются через один и тот же бэкенд.
На вебе можно спрятать админку за условием в JavaScript и решить, что доступ закрыт. В мобилке можно положить токен в SharedPreferences и надеяться, что до него никто не доберется. Можно оставить открытый бакет, отключить нормальные правила Firebase, забыть про rate limit на логине или принять userId из тела запроса.
Все это выглядит как мелочи, пока приложение работает.
Проблема начинается там, где клиент перестает быть интерфейсом и становится поверхностью атаки. В браузере злоумышленник давит на сервер через запросы, куки, DOM и XSS. В мобилке он может разобрать само приложение, вытащить ключи, перехватить трафик, изменить APK и посмотреть, что команда случайно отправила пользователю вместе с релизом.
Разбираем: где веб и мобильная безопасность совпадают; где расходятся; почему общий API часто опаснее конкретного клиента и какие решения действительно закрывают риски, а какие только создают ощущение защиты.
Читать далееПривет, Хабр!
Воодушевившись статьёй std::expected в C++23: гайд по миграции с исключений на функциональный error handling, представляю собственную с переписанными примерами на Rust. Код в статье итеративно переписывается и улучшается.
Читать далее
Привет, Хабр, всем случайно зашедшим и зашедшим целенаправленно! Меня зовут Семён Клюев, я фронтенд-разработчик в компании «Криптонит»! Хочу поведать вам историю о том, как я стал джуном в период конкуренции «1000 человек на 1 вакансию» и «замены всех на ИИ».
Наверняка вы слышали о том, что на рынке труда сейчас очень сложная ситуация, что сотрудников заменяет ИИ и что в IT сейчас не попасть. Давайте разберёмся, действительно ли это так, и если нет, то на какой путь я бы встал сейчас, чтобы попасть в это самое IT ☺ Спойлер: Меня не заменили, но до этого момента было страшно.
Я перепробовал много подходов к обучению, наступил на десятки граблей, прежде чем понял, что курсы не сделают из тебя разработчика, несмотря на то что обещают золотые горы.
Моя история учёбы: как врач решил стать программистом
Давайте сразу к делу. Я по образованию врач. Да-да, тот самый, который должен слушать фонендоскопом и выписывать рецепты. Но со временем понял, что меня всё больше привлекает мир технологий.
Читать далееПриветствую, коллеги! Это опять @ProstoKirReal.
Мы с вами прошли большой цикл статей про SFP-модули. Обсудили историю развития, типы модулей, скорости, DAC/AOC, оптические кабели, пассивные компоненты, а также технологии WDM, CWDM и DWDM:
Читать далееДевелопмент — это динамичная и меняющаяся среда, несмотря на довольно строгий внешний образ.
Со 2 апреля 2026 года при подаче на согласование архитектурно-градостроительных решений (АГР) объектов капитального строительства в Московскую городскую экспертизу (МГЭ) обязательно предоставление цифровой информационной модели (ЦИМ АГР) в формате IFC, соответствующем машиночитаемым требованиям в формате IDS.
Во многих компаниях строительной отрасли в этом году обсуждают, что BIMы (сотрудники BIM-команд) стали тратить часы на итерации: нужно было выгрузить модель, проверить, исправить и снова выгрузить. В этой статье расскажем, как в ПИК сократили время подготовки и научили систему проверять соответствие требованиям IDS еще на этапе проектирования — без единой выгрузки в IFC. Опытом поделятся Максим Курбатов, руководитель продукта BIM Inspector в ПИК Digital, и Авенир Барышев, координатор по технологиям цифрового моделирования в ПИК.
Читать далееИИ уже давно стал неотъемлемой частью наших жизней, иногда он полезен, а иногда бывает даже вреден, но что если я скажу, что он может очень сильно помочь вам в написании автоматизаций и разработке дашбордов для Home Assistant!
В этой статье рассмотрим The Unofficial and Awesome Home Assistant MCP Server и как он может облегчить жизнь и сэкономить время.
ПогналиПривет! На связи Антон Дятлов, инженер по защите информации в Selectel. В инфраструктуре из 1000 серверов и 100 администраторов счет активным SSH-ключам может идти на тысячи. По умолчанию они не имеют срока действия, поэтому со временем накапливаются и устаревают.
Исследования показывают, что в крупных компаниях до 90% ключей не используются и не администрируются, а часть оставшихся предоставляет доступ на уровне root. Отсутствие централизованного управления усугубляет проблему: при увольнении сотрудника его доступы могут забыть удалить, сохранив за ним возможность подключаться к системам.
В итоге администраторы оказываются перед трудоемкой задачей контроля и актуализации авторизационных данных.
Читать далее →Как же бесят все эти статьи на тему «у-у-у, все права принадлежат нейросетям, все что вы туда загрузили, переходит к ним, а все что вы там создали, тоже не ваше».
Авторы, которые то ли не были в реальных судах, то ли пишут свои статьи этими же ИИшками, рассусоливают на не имеющие отношения к жизни темы, типа «а может ли робот считаться автором» и так далее (нет, в России не может).
Как юрист по авторским правам и патентный поверенный, не могу уже смотреть на это спокойно, надоело.
Давайте не на уровне международной теории, а на уровне конкретной российской практики разберем реально интересующие нас простые вопросы:
1. Я сделал что-то с помощью ИИ, могу я это спокойно использовать, мне не прилетит?
2. Я сделал что-то с помощью ИИ, а у меня это сперли, могу ли я наказать нарушителя?
3. Я переделал что-то чужое с помощью ИИ, может ли мне что-то за это прилететь?
Спойлер: нас ждут неочевидные выводы в вашу пользу, о которых вряд ли напишут юристы, работающие в интересах нейросетей.
Читать далееСразу после Saint Highload прошла Saint Teamlead, основной темой тоже было применение ИИ. Второй день принес прекрасное визионерское выступление Авенира Воронова, два тезиса.
Первое: ускорение разработки в 10 раз обнуляет нынешнюю систему планирования и управления через задачи и сложившуюся систему метрик. Потому что, когда проверка гипотезы теперь занимает день-два, вместо двух месяцев, то традиционный бэклог на квартал или год исчезает: ведь каждая гипотеза приносит новую информацию, и там получается точка ветвления. Разработка будет идти совершенно иначе, вместо списков задач – стримы активностей с целевыми векторами и оперативным маневром внутри.
Второе. Когда не только разработчики, но и сейлы и все остальные работают через копилоты, то его логи дают не только реальную картину того, чем занимаются сотрудники, но и как они это делают, как они общаются и каково их эмоциональное состояние в реальном времени. И это принципиально меняет управление командой.
Кроме этого, был еще ряд хороших выступлений с конкретными кейсами, например, о создании конвейера по переносу сервисов на другой техстек ИИ-агентами с гарантированным качеством. Ловите мой конспект, пусть неполный: на конференции было четыре трека, а я мог быть лишь на одном.
Читать далееРоссийская компания «ФорМакс», развивающая платформу мониторинга музыкального и медиаконтента SonicScout, решила через суд оспорить права The Linux Foundation на товарный знак SONiC. По данным CNews, компания требует досрочно прекратить правовую охрану в России товарных знаков SONiC по международным регистрациям №1534619 и №1402146, ссылаясь на их неиспользование. Иск был принят к производству 3 июля 2026 года.
Поводом для спора стал конфликт вокруг названия SonicScout. Как пишет CNews, «ФорМакс» подала в Роспатент заявки на регистрацию нескольких вариантов бренда SonicScout, но ведомство сочло их сходными до степени смешения с SONiC, права на который закреплены за The Linux Foundation. До завершения разбирательства суд запретил Роспатенту принимать решения по этим заявкам. Предварительное заседание назначено на апрель 2027 года — с учётом необходимости уведомить ответчика в США.
( читать дальше... )
Команда LineageOS заявила, что новая система проверки разработчиков Android не затронет пользователей этой прошивки. Речь идёт об Android Developer Verification — механизме, по которому приложения на сертифицированных Android-устройствах должны быть привязаны к разработчику с подтверждённой личностью.
( читать дальше... )
sizeof(Mutex<()>) в Rust 1.61 на Linux был 40 байт. В Rust 1.62 он стал 5 (точнее, 8 с учётом выравнивания, но базовый overhead 5).
За уменьшением размера в восемь раз стоит полная переписка стандартного Mutex с pthread на futex напрямую, ускорение uncontended locks в 2-3 раза, и десятилетие, которое стандартный Mutex провёл в роли «возьми parking_lot, std::sync::Mutex медленный».
Сегодня заглянем под капот всей этой темы, разберём, что лежит внутри std::sync::Mutex после 1.62, какой алгоритм там используется, почему он на самом деле быстрее pthread, как устроен fairness (точнее, его отсутствие), зачем нужен poisoning, и в каких случаях parking_lot всё ещё имеет смысл тащить в зависимости. Заодно вернёмся к моей старой async-статье и поясним конкретнее, почему в async-задачах std::sync::Mutex это проблема, и при чём тут вообще futex.
Читать далееПривет, Хабр! Меня зовут Никита, и я один из тех, кто каждый год делает Frontend CTF в рамках конференции «Я
Представьте ситуацию: вы сделали хороший продукт, вы уверены в его нужности, вы можете часами рассказывать про его архитектуру, функции, интеграции и пользовательские сценарии. Но на встрече с потенциальным клиентом вас спрашивают: «Сколько это нам принесет денег?», «За сколько времени окупится?», «Вы гарантируете финансовый эффект?». И тут оказывается, что рассказ про функциональность закончился, а ваши собеседники вообще не услышали того, что хотели.
В этом небольшом цикле статей я постараюсь поделиться своим более чем пятнадцатилетним опытом оценки экономической эффективности ИТ-решений и подготовки бизнес-кейсов внедрений, полученным в процессе работы в роли пресейл-архитектора и отраслевого эксперта у международных и отечественных вендоров корпоративного ПО,. В качестве примера я использую знакомую многим область – управление ТОиР (так же известное как ТОРО). Но логика подхода универсальна: меняются только исходные показатели и драйверы эффекта.
Читать далееЯ главный режиссёр и руковожу внутренним продакшеном одного из центральных каналов. Каждый месяц моя команда производит около 400 видеозадач. Это проморолики, фирменные заставки, партнёрский маркетинг и контент для соцсетей канала.
Вообще продакшен — это далеко не про творчество и свободу. Мы работаем в жёстких дедлайнах, потому что телек живёт по секундам. За ошибку и срыв сроков может прилететь гигантский штраф. Поэтому не потерять задачу — и есть главная задача.
При этом люди в индустрии (а я руковожу 40 сотрудниками) — довольно специфичные. Их нельзя просто засунуть в скучный таскер. И мы постоянно уязвимы перед человеческим фактором. Когда пайплайн длинный, а управление размазано по чатам и таблицам, — задачи неизбежно виснут и теряются.
Рассказываю, как живёт изнанка канала и что нам помогло выстроить производство без лишнего найма.
Читать далееВы наняли разработчиков, сделали продукт, оформили аккредитацию Минцифры — и выдохнули: пониженные взносы, налог на прибыль 5%, отсрочка от армии для команды, льготная ипотека. А через год приходит уведомление, что компания рискует вылететь из реестра. Не потому, что вы перестали писать код. А потому, что вовремя не подали заявление на ежегодное подтверждение, не уследили за профильной долей выручки или забыли продлить одно согласие. Именно так в июне 2026 года почти 3000 ИТ-компаний оказались на грани потери статуса — на ровном месте, без единой проверки.
Аккредитация — это не диплом на стену, а ежегодный экзамен на соответствие критериям. Получить статус технически не так сложно. Но после получения начинается постоянная работа по соблюдению критериев, и это не разовая ежегодная формальность. Иначе статус и все привязанные к нему льготы могут быть отменены «задним числом». В этом материале разбираем, как получить аккредитацию ИТ-компании в 2026 году и, что важно, как её не потерять — потому что спотыкаются почти все именно на удержании.
Читать далее