Небольшая заметка про Fill-in-the-Middle - способ обучения моделей, который позволяет предсказывать не следующий токен, а код между уже существующими фрагментами. Разберём основную идею (формат PREFIX–SUFFIX–MIDDLE) и посмотрим простой пример его применения для предсказания кода.
Читать заметкуПривет, Хабр! Меня зовут Артем Семагин, я ведущий аналитик киберкриминалистики в «Инфосистемы Джет». Пожалуй, один из самых популярных вопросов, который задают начинающие специалисты по цифровой криминалистике (да и не только начинающие), звучит примерно так:
Какой сертификат сейчас ценится, что стоит сдавать?
Если немного погрузиться в тему, то оказывается, что выбор совсем неочевиден. На рынке есть престижные сертификации (и очень дорогие) GIAC — GCFE, GCFA, а теперь ещё GX-FA и GLIR. Есть давно известный CHFI от EC-Council, множество вендорских сертификатов, таких как EnCE, ACE, MCFE, Belkasoft и от других разработчиков софта.
В этой статье я решил сделать субъективный обзор наиболее известных DFIR-сертификаций: рассказать о тех, с которыми сталкивался сам, поделиться личным опытом и мнением коллег, а также обсудить, какие сертификаты стоят потраченных времени и денег, а какие можно спокойно пропустить.
Читать далееВ проектах у аналитика обычно есть знакомый набор инструментов: нотации, шаблоны требований, чек-листы, правила описания процессов. Но реальная задача редко укладывается в них полностью.
За сформулированным требованием может скрываться другая потребность. При проектировании интеграции приходится одновременно учитывать производительность и отказоустойчивость. А иногда нужно разобраться в нетиповой системе, которую несколько лет дорабатывали без актуальной документации.
В таких ситуациях важнее не знание конкретного шаблона, а способность разобраться в контексте, увидеть ограничения и выбрать подход. Этому посвящена секция «Прикладные компетенции аналитика» на INFOSTART A&PM EVENT 2026.
Читать далее14 августа Anthropic опубликовала второй Risk Report — 186 страниц о том, насколько опасны ее собственные модели. В разделе с будничным названием "Заметки о невыпущенных моделях" компания между делом сообщила: внутри работает модель под кодовым именем Model 2. Она сильнее Claude Mythos 5 — самой мощной модели, к которой Anthropic вообще кого-либо подпускает; ею пишут код и генерируют данные; выпускать ее не планируют. Axios подал эту строчку как главную новость отчета. Но если дочитать документ, новость там другая — и куда менее уютная.
Читать далееВ последние недели собрал и протестировал 15 пользовательских 1 моделей (CM). Не претендую на полноту изучения опции, но надеюсь, что кому-то мой опыт сэкономит время. Основной вопрос: как на поведение модели влияют материал для тренировки (DS), стили, Lyrics и параметры.
1 идея витала в воздухе, как только народ услышал генерации очень похожие на известных артистов. В Udio/ Suno требовались танцы с бубном, в Sonauto (ныне Treblo) достаточно было ввести имя в промпт. В конце 2024 г. один проф. певец задал мне вопрос: "Как генерить с моим голосом и манерой?". Сделал его RVC-модель, он: "Тембр точно мой, но манера не везде", а с DS для Suno v3.5: "... похоже, и тембр, и манера. А можно, чтобы вообще как я и чистый звук?" Ответ: "Нужна ваша собственная модель".
Кажется, первыми CM предложили Mureka (Personalized Model): DS из 100+ треков (до 4 мин.), разовый платеж $100-200, тренировка ~3 ч. (сам не пробовал). Zaptrem (основатель Sonauto) на запрос о CM ответил, что не раньше v3. Локальные/ "открытые" инструменты я не смотрел (в своё время помучился с RVC на Google Colab и HuggingFace), но … как-нибудь попробую.
Во всех экспериментах с муз. ИИ меня интересовало 2 момента: а) как это устроено; б) как облагородить свои треки — придать правильное и "живое" звучание. Я не профессионал, но мне не нужно, чтобы ИИ за меня сочинял. Думаю, композитору важно самому отвечать за каждую ноту. Хотя можно и так: "Сгенери в моём стиле, а я выберу".
"Наевшись" вариативности с Persona, Your Voice, да и вообще с генерацией в Suno, я решил тестировать CM сразу на ярком материале. У меня не было и нет планов создавать несуществующие песни знаменитостей 2, но с DS из треков известных певцов поведение CM (похоже/ непохоже) должно быть очевидным для многих. Suno не работает с хитами, но пропускает генерации от Sonauto/ Treblo, т.к. мелодия и текст другие. Треки очень близки к реальным артистам — если не фанат, решишь, что просто не слышал эту песню.
Читать далееПривет, Хабр! Меня зовут Максим Темнов, я руковожу департаментом постгарантийной сервисной поддержки (ПГСО) в «РТК-ЦОД». Это девять складов с комплектующими, более ста тысяч «железок» на поддержке и специалисты, готовые привезти и установить ЗИП за считанные часы. Мы выручаем заказчиков с ИТ-оборудованием, когда угасает последняя надежда на его производителей или вендоров. В условиях санкций, штрафов, дефицита на российском рынке и сложных логистических цепочек в хорошем провайдере ПГСО важно… все. Его компетенции и ресурсы — единственная волшебная таблетка для заказчика. В статье расскажу, как обстоят дела с «железом» сейчас и почему паниковать на этот счет не стоит.
Читать далееПривет, Хабр! Понадобилось мне в 2026 году установить XPEnology на ESXi, но актуальных инструкций я не нашёл. Восполняем этот пробел.
Инструкция будет полезна администраторам или DevOps, начинающим своё знакомство с XPEnology.
Внимание: в статье очень много картинок.
Для чего это может потребоваться
Например, можно:
- Ознакомиться с функционалом NAS Synology перед покупкой дорогостоящего оборудования.
- Протестировать установку или настройку новых пакетов.
- Протестировать сценарии перед их реализацией на реальном железе. Например, замену, дисков меньшего объёма на больший. Или обновление DSM 7.2 на 7.3
Достоверность результатов аудита информационной безопасности (ИБ) и соблюдение его сроков во многом зависят от качества предварительной подготовки. До начала проверки заказчику необходимо определить ее цели, согласовать с аудиторами порядок совместной работы и сформулировать ожидания от результата — если этого не сделать, проверяющим придется постоянно уточнять детали и переделывать уже выполненную работу. В результате сроки аудита увеличатся и содержание итогового отчета может не совпасть с ожиданиями заказчика.
Разбираем пять типичных ошибок, которые замедляют проведение аудита, и делимся способами их предотвращения.
Уже довольно много лет руководители компаний, вкладывающих сотни миллиардов долларов в год в разработку различных инструментов искусственного интеллекта, настаивают на том, что в конечном итоге эта технология приведёт к сокращению времени, которое люди тратят на работу.
Четыре года назад технический директор Google заявил, что к 2025 году ИИ обеспечит переход на четырёхдневную рабочую неделю.
В начале этого года, всего через год после прогноза того технического директора, компания OpenAI приняла этот вызов. Она официально призвала компании начать тестирование четырёхдневной рабочей недели (без изменения заработной платы), утверждая, что ИИ вскоре сможет настолько ускорить человеческий труд, что корпоративный мир должен к этому подготовиться.
Однако бывший технический сотрудник OpenAI, уволившийся из компании в прошлом году, рассказал BBC, что пока он там работал, компания сама никогда не тестировала четырёхдневную рабочую неделю, которую она предлагала другим попробовать.
Вместо этого он описал зачастую изнурительную рабочую культуру, характеризующуюся частыми «кризисными совещаниями», работой по выходным и «чрезвычайно жёсткими» оценками эффективности, в результате которых коллег внезапно увольняли.
«Ты приходишь в субботу или воскресенье просто для того, чтобы наверстать упущенное или убедиться, что всё работает нормально», — сказал этот сотрудник.
Другие компании также продвигают идею о том, что ИИ эффективно сократит количество часов, которые людям нужно работать — к лучшему или к худшему. Компания Anthropic похвасталась тем, что её популярный инструмент для программирования и чат‑бот Claude способен работать самостоятельно в течение семи часов без перерыва, что по сути соответствует полному рабочему дню в компании. Марк Цукерберг из Meta заявил, что его компания находится в середине того года, когда «ИИ начинает кардинально менять наш подход к работе», и что такие инструменты позволяют гораздо меньшему числу сотрудников выполнять больше работы — гораздо больше, чем они когда‑либо могли бы сделать раньше.
Читать далееВсем привет! Меня зовут Андрей Лапкин. Около года назад я перешёл на роль архитектора ИТ-инфраструктуры в подразделении Эксплуатации музыкального сервиса Звук — и практически сразу мы запустили программу управления облачными расходами.
Облачная инфраструктура стримингового сервиса — это сотни виртуальных машин, десятки кластеров Kubernetes, объектные хранилища, базы данных, балансировщики. Ресурсы создаются под задачи, но далеко не всегда удаляются после их завершения. С ростом инфраструктуры вопрос «сколько стоит конкретный сервис?» потребовал системного ответа”.
За полгода систематической работы мы снизили ежемесячные расходы на инфраструктуру примерно на 22%. Для контекста: до старта программы счёт органически рос на 1–2% в месяц. Расскажу, как мы к этому пришли: какую методологию взяли за основу, какие принципы заложили в фундамент и как выглядит дорожная карта. Фокус статьи — на стратегии, процессах и культуре, а не на готовых шаблонах развёртывания.
Читать далееКогда речь идет о промышленном сборе данных, даже компьютер-одноплатник иногда избыточен по габаритам. Если устройство встраивается в щиток, в корпус датчика или в готовый прибор стороннего производителя, каждый лишний сантиметр платы — это переделка корпуса. Для таких случаев мы разработали миниатюрный модуль — NAPI Slot, и еще несколько решений на его основе (мини-компьютер, коммутатор, мини-мрашрутизатор, шлюз). А сторонние разработчики могут сконструировать нужную плату c этим SOM под свои задачи.
Читать далееОбучение LLM — это в первую очередь инфраструктурная задача: нужен пайплайн, который можно перезапускать с новыми данными, архитектурой или другим расписанием обучения и получать повторяемый внутри команды результат. В этом материале — рассказ команды обучения и инференса моделей RWB о том, как мы с нуля, без загрузки pretrained-весов, обучили текстовую модель на основе гибридной архитектуры Qwen3.5-2B-Base и какие выводы сделали по пути — от сборки датасетов до чтения графиков онлайн-оценки.
Читать далееПредставьте: через ваш сервер проходит 10 миллионов запросов в минуту. Каждый запрос содержит метку (например, ID пользователя, IP-адрес или поисковый запрос). Руководство просит: «А давайте посмотрим, кто из пользователей самый активный?». Задача выглядит простой, пока вы не осознаете, что хранить HashMap из 10 миллионов ключей в оперативной памяти — это сотни мегабайт, а если ключи — длинные строки, то и гигабайты.
Вероятностные структуры данных решают такие задачи без гигантских кластеров. В прошлых статьях мы разобрали, как с помощью HyperLogLog считать количество уникальных элементов, а с помощью Фильтра Блума — проверять наличие элемента. Сегодня мы закроем триаду и поговорим об алгоритме, который отвечает на вопрос «А сколько раз этот элемент встречался?» с фиксированной памятью в пару килобайт и строгой вероятностной гарантией.
И это — Count-Min Sketch! Структура, которая лежит в основе анализа потоков в базах данных (от ClickHouse до BigQuery) и сетевых протоколов. Мы разберем её математику, реализуем на чистом C с использованием MurmurHash3 и проведем бенчмарки.
Читать далееНе так давно мы выяснили, что СДВГ (скорее всего) не виноват в том, что тебе тяжело сосредоточиться. Может быть, виновата тогда эпидемия дешёвого дофамина? Сегодня продолжаем поиски потерянного внимания и говорим о «дофаминовом голодании».
Читать далееПривет, Хабр! На связи команда автоматизации девелопмента — Карасева Лилия и Абражевич Ольга. Мы занимаемся цифровыми сервисами для строительной документации в ПИК и хотим поделиться историей одного внедрения, которое технически выглядело абсолютно правильным, но на практике оказалось намного сложнее, чем мы ожидали.
Эта статья не про «как выбрать систему» и даже не про Билдокс. Она про то, почему технически хорошее решение могут не принять пользователи, снижение рисков несоответствия законодательству не мотивирует бизнес, а внедрение новой системы и внедрение изменений — вообще не одно и то же.
В этом тексте мы делимся своими лайфхаками, поэтому он будет полезен деливери менеджерам, аналитикам и всем, кто внедряет внутренние корпоративные продукты и сталкивается с сопротивлением пользователей.
Читать далееМы хотели, чтобы iOS-тесты видели внутри WebView те же data-testid, что и фронтенд. Вроде бы простая задача. Но iOS устроена хитрее: WKWebView запускает веб-контент в отдельном процессе — тестовый раннер туда не достучится. А UI-автоматизация на Android умеет залезать в WebView «из коробки», а на iOS — нет. Как решать? Не писать же тесты по пикселям. Спойлер: пришлось написать JS-скрипт, который сам проставляет aria-label на основе data-testid. Под катом — как это работает и почему без MutationObserver никуда.
Читать далееВ своём блоге я часто пишу о японских RPG. Какие-то элементы этих порой странных, громоздких игр заставляют возвращаться к жанру снова и снова, несмотря на их частую репетативность и времязатратность. Разработчики из Страны восходящего солнца (а также все те, кто пытается подражать игровым или эстетическим элементам их игр) за десятилетия существования этой индустрии сформировали определённый канон жанра. Мы слышим «JRPG» и думаем об аниме стилистике и сопутствующем юморе, запутанной истории, цветастой экшен-боёвке или нагруженной пошаговой системе и, главное, чувстве огромного приключения. В той или иной мере этой есть в любом проекте, который относит себя к этому жанру.
Огромное разнообразие этих игр и фокус разработчиков на каком-то определённом аспекте означают, что фанату жанра никогда не придётся сидеть без дела. Особенно если ему приглянулась какая-то конкретная игра — с огромной долей вероятности это часть какой-то уже устоявшейся долгоиграющей франшизы. Японцы, в отличие от западных коллег, как-то редко хотят экспериментировать вне рамок существующих IP, особенно гиганты вроде Nintendo или Square Enix. Но эти эксперименты или, наоборот, их отсутствие, нередко становятся причиной «гибели» серии. Продажи падают, новичкам не хочется приобщаться к незнакомой серии с большим количеством игр, а «олдам» уже надоело.
Говорить о мёртвых франшизах интересно, но тяжело, хотя бы, потому что и зарубежом, и тем более у нас, о них мало кто помнит, а поиграть самому в них проблематично — игры редко покидали свой родной регион и не были локализированы. Что интереснее, дак это обсудить тех, кто всё смог вырваться из забытия и вернуть себе хотя бы часть былой славы. Тем более что через месяц выходит новая полноценная «Fire Emblem» — яркий пример подобного феномена.
Next turn!Самое сложное в ИТ — не технологии, а люди. Без них не получится ничего большого, но они сопротивляются, сомневаются, по-разному воспринимают изменения и далеко не всегда делают то, что казалось очевидным на схеме.
Поэтому эта история будет не только про очередной ИИ-инструмент, но и про команду из 16 человек, которая за несколько месяцев изменила привычный способ работы и перестроилась в пять микроюнитов.
Привет, Хабр! Меня зовут Сергей Чистяков, в ИТ я с 2006 года. Веду канал в телеграм. Сейчас работаю техлидом в Райффайзен Банке и строю систему автоматизации бизнес-процессов, в которой вместе работают люди и агенты. Расскажу про воркшоп, на котором никто не научился писать автотесты, двухдневный дофаминовый шок и пять маленьких команд, которые начали проводить задачи через весь цикл разработки и построили для этого собственный workflow поверх нескольких репозиториев.
Читать далееРешение запретить сотрудникам искать рабочую информацию в открытом интернете обычно кажется радикальным — пока не начинаешь считать потери. Один неточный ответ из Google, один лишний запрос в публичный AI-сервис, одна утечка кусочка внутренней информации — и у компании уже есть и риск, и простой, и лишняя головная боль.
Читать далееМы рады объявить о выходе Dart 3.13!
В этом релизе мы отмечаем тему, которую любят все разработчики: чистый и легковесный код. Dart 3.13 фокусируется на этом аспекте на каждом уровне работы разработчика. Что касается языка, то первичные конструкторы устраняют повторяющийся шаблонный код, позволяя определять классы в одной строке кода. В инструментах разработчика внесены улучшения, позволяющие dart formatподдерживать аккуратность кода в соответствии с правилами стиля Effective Dart , а также dart pubвведены новые команды рабочей области для поддержания порядка в монорепозиториях. На pub.dev расширенные функции документации, такие как <callout-box>теги и {@example}директивы, делают документацию пакетов более понятной. Внутри системы, оптимизация кода нативных библиотек (tree-shaking @RecordUse) и отложенная загрузка WebAssembly помогают сделать скомпилированные бинарные файлы приложений максимально компактными.
Так что обновите Dart или запустите программу flutter upgrade и следите за обновлениями, пока мы будем изучать новинки Dart 3.13!
Читать далее