Habr.com

  • user warning: Table './drupal/sessions' is marked as crashed and last (automatic?) repair failed query: SELECT COUNT(sid) AS count FROM sessions WHERE timestamp >= 1788955102 AND uid = 0 in /var/www/html/includes/session.inc on line 157.
  • user warning: Table './drupal/sessions' is marked as crashed and last (automatic?) repair failed query: SELECT COUNT(DISTINCT s.uid) FROM sessions s WHERE s.timestamp >= 1788955102 AND s.uid > 0 in /var/www/html/modules/user/user.module on line 808.
Ленты новостей Хабр
Все публикации подряд на Хабре
Обновлено: 33 мин. 19 сек. назад

GPT-6 на пороге: OpenAI готовит модель, часть мыслей которой люди прочесть не смогут

чт, 09/03/2026 - 00:39

OpenAI, похоже, в шаге от выпуска Astra — модели, которую компания с августа называет «нашей следующей большой моделью». 1 сентября OpenAI написала, что Astra выйдет "скоро", а вечером 2 сентября X-аккаунты заметили, что API OpenAI на запрос к модели "gpt-6-astra" отвечает кодом 404 — так ведут себя существующие, но закрытые модели вроде GPT-5.6 Cyber, тогда как на выдуманные имена сервер отвечает кодом 400. Официально имя GPT-6 не подтверждено. Зато подтвердилось кое-что поинтереснее: по данным The Information, у Astra другая архитектура, и из-за нее часть рассуждений модели больше нельзя прочитать.

Читать далее

«Спорт, борщ, крипта»: как мы проверяли, работают ли интересы в рекомендательной системе

чт, 09/03/2026 - 00:37

Пользователь пишет интересы текстом, мы делаем из них один эмбеддинг. Работает он как монета (ROC-AUC 0.52), а на коротких интересах 0.41, то есть хуже случайного порядка. Прогнали шесть вариантов починки и подняли до 0.80. Рассказываю, что сработало, а что нет.

Что показали цифры

Владельцев сайтов оштрафуют за вход через Google или Gmail? Разбираем новые правила и алгоритм действий

ср, 09/02/2026 - 23:50

В июле 2026 г. вступил в силу Федеральный закон от 26 июня 2026 года №199-ФЗ «О внесении изменений в Кодекс Российской Федерации об административных правонарушениях». Им устанавливаются штрафы до 700 000 рублей за авторизацию через зарубежные сервисы и за нарушения в работе рекомендательных технологий. Разберу подробно нововведения в этой статье.

На самом деле закон, запрещающий вход и регистрацию на российских ресурсах через иностранные сервисы (включая Apple ID и Google), действует ещё с декабря 2023 года. Но до сих пор в нём не были предусмотрены штрафы. Многие владельцы сайтов либо не знали о запрете, либо просто его игнорировали — безнаказанно. Это как было с маркировкой рекламой: правило существовало, но только с появлением штрафов бизнес начал его исполнять.

Читать далее

Как с помощью нейросети сделать перестановку в комнате

ср, 09/02/2026 - 23:44

Дело было вечером, делать было нечего. Сразу скажу, что я решал прежде всего практическую, а не дизайнерскую задачу.

Дано: комната, в которой проживают двое взрослых и двое детей 14 и 7 лет. В ней много мебели, которая исторически скопилась. Есть кровать чердак, есть большая кровать, два шкафа, комод, стол, система хранения.

Задача: нужно сделать еще одно рабочее место, ведь младший ребенок пошел в школу. 

Читать далее

Глупый пользователь против Умного Ноутбука ч. 2. Флагманы — Зло

ср, 09/02/2026 - 23:38

Графомания - штука такая. В отсутствии новых идей, приходится возвращаться к старым. Собственно новая статья – является продолжением вот этой вотъ.

Сегодня в программе:

1. P-cores vs E-cores
2. Болезненный переход с АМД на Интел.
3. Почему не получается резать частоту, но можно резать PL.
4. Почему 80 ватт*час для Intel Ultra 9 275HX не тоже самое, что 80 ватт*час для ryzen 5 5600h.
5. Криво нанесенный ЖМ с завода.
6. Троттлинг.
7. Много троттлинга.
8. Графомания.
И полная безграмотность. Всё в общем как всегда.

Похихикать над автором... Снова :-)

Сохранение джунов и будущее кадровой воронки

ср, 09/02/2026 - 23:34

Как мы знаем, рынок труда в некоторых сферах сейчас достаточно напряжен для соискателя и в материале про рынок ИТ специалистов я показывал, что некоторым молодым специалистам достаточно трудно сейчас найти работу, это касается многих офисных профессий, не только ИТ.

Сами компании зажаты между необходимостью расти и при этом не сильно увеличивать тот же ФОТ и получается вопрос: зачем нам нужен джун, которого нужно около года учить, и еще не факт, что он останется работать.

Это касается не только России. Причины немного отличаются, но в целом всё то же. World Economic Forum отмечает, что число начальных вакансий в США за последние 18 месяцев снизилось на 35%, и одной из причин этого называется как раз ИИ.

Читать далее

Системы речевой аналитики для крупного бизнеса: сравнение 10 платформ в 2026 году

ср, 09/02/2026 - 23:29

Сравнили 10 систем речевой аналитики для крупного бизнеса: AI и LLM, On-Premise, API, омниканальность, контроль качества, интеграции, цены, плюсы и ограничения.

Читать далее

[Перевод] «Я знаю, что ты не знаешь»: задача про пиратов

ср, 09/02/2026 - 23:06

Пиратский корабль, на борту которого находится команда грозных и безупречно логичных пиратов, а также сокровище из ста золотых монет, которое им предстоит разделить между собой. Как они это сделают?

Пираты уже давно договорились о процедуре раздела сокровища. Все они линейно упорядочены по старшинству: капитан, первый помощник, второй помощник и так далее по иерархии. Но для простоты будем называть их пиратом номер один, пиратом номер два, пиратом номер три и так далее. Пират номер девять тем временем драит палубу, готовясь к предстоящему.

Для проведения раздела все пираты собираются на палубе, а пират самого низкого ранга встает на доску. Стоя перед остальными пиратами, он предлагает конкретный способ разделить золото: столько-то золотых монет капитану, столько-то пирату номер два и так далее. После этого пираты голосуют за предложенный план, причем пират, стоящий на доске, также участвует в голосовании.

Если план одобряет строгое большинство пиратов, то он принимается, и золото распределяется именно таким образом. Но если план не получает поддержки большинства, то, к сожалению, предложивший его пират должен пройти по доске и упасть в море, где его ждет смерть. После этого процедура продолжается со следующим пиратом снизу по старшинству, который теперь, разумеется, становится пиратом самого низкого ранга.

Предположим, что вы — пират номер десять. Какой план вы предложите?

Сочли бы вы хорошей идеей предложить оставить себе девяносто четыре золотые монеты, а оставшиеся шесть раздать нескольким другим пиратам?

На самом деле вы действительно можете предложить именно такой вариант, и если все сделать правильно, ваш план будет принят!

Читать далее

Tome Reader, своя читалка для Obsidian

ср, 09/02/2026 - 23:00

Собрала свой плагин для Obsidian. Это Tome Reader – читалка EPUB с четырьмя темами, выделением текста в заметки и в словарные карточки, закладками, правкой опечаток прямо во время чтения, автоматическим оглавлением для «битых» книг и опциональным AI-ассистентом, куда пользователь добавляет собственный ключ. Читалка доступна в официальном каталоге плагинов Obsidian.

Читать далее

Архитектура банковского RecSys

ср, 09/02/2026 - 22:40

В этой статье разберем банковский RecSys: как он строится в 2026 году, что из классики все еще работает и на что стоит смотреть, если вы сейчас закладываете архитектуру RecSys для финансовых офферов с нуля.

Читать далее

Продуктовая гипотеза или баг фронтенда: как перестать угадывать почему пользователи не дошли до цели

ср, 09/02/2026 - 22:23

Возьмём типичный отчёт воронки интернет‑магазина: «Каталог → Товар → Корзина → Оформление заказа → Оплата». До последнего шага дошло 38% сессий, остальные 62% потерялись между «Оформлением» и «Оплатой». Для продуктовой аналитики эти 62% — повод для гипотезы «форма оформления слишком длинная» и задачи на редизайн. Для команды разработки те же 62% — конкретная JavaScript ошибка. Но пока данные о конверсии и данные об ошибках лежат в разных системах, выбор между ними происходит наугад. Как перестать «угадывать» почему отвалились пользователи и какую в этом роль играет Customer Journey Map разберу в статье.

Читать далее

[Перевод] Линус и Linux: решительный финский хобби-проект, который покорил мир

ср, 09/02/2026 - 22:10

Сентябрь 1991 года. Студент из Хельсинки в халате выкладывает в новостную группу первый релиз своей операционной системы Linux и почти извиняясь пишет: «Большим не будет». Внутри – 10239 строк кода и ноль юристов. Спустя тридцать с лишним лет эта «небольшая» система стоит за 3 миллиардами смартфонов, 95% веб-серверов и Международной космической станцией.

Это история о том, как финский хобби-проект Линуса Торвальдса стал крупнейшей опенсорсной коллаборацией в истории.

Читать далее

Отучаем IoT от облака

ср, 09/02/2026 - 21:55

Я уже несколько лет методично выбирал устройства для умного дома, работающие по протоколу Zigbee, чтобы не зависеть от облака вендора. Однако прошлой осенью в моей жизни появилась кошка. В силу ограниченности вариантов, пришлось обзавестись рядом устройств, работающих только по Wi‑Fi и только с приложением вендора.

Под катом расскажу, как я преодолел это недоразумение.

Читать далее

Как создавался агрегатор ИБ‑новостей: склейка сюжетов, семь признаков важности и порог по данным

ср, 09/02/2026 - 21:30

Идея агрегатора новостей по кибербезопасности зародилась еще давно. Хотелось получать самое важное и без инфошума. LLM тогда ещё не были повседневным инструментом, и первую версию реализовал на модели суммаризации rut5_base_sum_gazeta, а важность считал textrank. Работало так себе. Потом появились сервисы, которые сами подбирают новости под настроенную ленту. Но оптимального решения так и не увидел – это либо про всё сразу, либо что-то про одну узкую тему.

Задача изначально выглядела простой. Моделей полно, готовых наработок должно было быть много. Но на практике уже первые недели ушли на тюнинг, и лучше при этом не становилось: поднял порог – канал молчит сутки, опустил – в ленту попали вебинары, квадранты и пресс-релизы продуктов. Из этого опыта родилось гибридное решение. Важность теперь считает формула из семи признаков, все логируется, а модель пишет тексты и отсекает нерелевантное.

Читать далее

Локальный путь в image_input съел четыре слота подряд

ср, 09/02/2026 - 21:25

31 августа в 14:32 по Москве у нас вышла последняя штатная публикация. Дальше cron честно стартовал по расписанию, генератор успевал выбрать тему и написать текст, но в ленте ничего не появлялось. Так повторилось четыре раза: три запуска 1 сентября и утренний запуск 2 сентября.

Читать далее

Действительно ли Вселенная расширяется? Анализ спектра квазара после 2 миллиардов световых лет пути

ср, 09/02/2026 - 21:00

Вселенная постоянно меня удивляет тем, что здесь на Земле нет ничего постоянного — облака в небе в следующую секунду уже другой формы, а птенцы, едва вылупившись, уже через несколько недель становятся взрослыми птицами и навсегда покидают гнездо. Все меняется настолько стремительно, что кажется, и в космосе так же. Но нет, всякий раз, когда я получаю спектр звезды и вижу ее линии водорода неизменно на одних и тех же позициях, я удивляюсь: неужели свет не встречает на своем пути ничего, что может его изменить, там действительно так пусто?

Например, от Бетельгейзе свет идет около 600 лет, но в любой день сними ее спектр — линии на своих местах. А если взять объект за миллиарды световых лет от Земли, что покажут фотоны? Ученые говорят, на таком расстоянии длина волны света сильно растянута из‑за расширения пространства и линии смещены в красную зону спектра.

Мне захотелось проверить это самой. Что из этого вышло, я расскажу ниже, и забегая вперед, скажу, что спектр меня удивил. А начну с любопытной предыстории.

Читать далее

Меньше шума, больше смысла: опыт SESAME для Speech Enhancement

ср, 09/02/2026 - 21:00

Привет, Хабр! Мы — Александр Забурдаев, Ксения Золина, Даниил Марценюк, Илья Трофименко, Илья Кулешов — студенты мастерской по сервисам и платформам ИИ в Инженерно-математической школе НИУ ВШЭ и VK. Хотим поделиться опытом, который мы накопили, пытаясь перестать кормить весь речевой сигнал одной и той же нейросети целиком, и дать разным экспертам разбираться с разными типами шума. 

Речь пойдёт о задаче улучшения качества речи (Speech Enhancement, SE) и о том, как получилось интегрировать в неё разреженную смесь экспертов (sparse Mixture of Experts, MoE). Это архитектура, которая в языковых моделях уже стала стандартом, а в обработке аудио до сих пор не прижилась.

Модель мы назвали SESAME — Speech Enhancement with Sparse Adaptive Mixture of Experts. Она построена на базе MP-SENet. В ней стандартные полносвязные блоки внутри трансформера заменены на разреженный MoE-модуль. Код проекта доступен на GitHub.

Зачем вообще понадобилась очередная модель шумоподавления, когда их и так десятки — расскажем ниже. А заодно разберём, какие трюки из мира LLM в аудио работают, а какие нет (например, Expert Choice) — и почему.

Читать далее

Как подключить к LLM вашу документацию и базу знаний

ср, 09/02/2026 - 20:45

LLM умеет отвечать на вопросы, но не знает особенностей вашего проекта и внутренней документации. В статье разберём, как с помощью RAG подключить собственные данные к модели: от подготовки документов и эмбеддингов до поиска нужного контекста и генерации ответов.

Разобрать подход

Написал детектор ИИ‑текста на 13 правил и прогнал 59 своих статей: сумма баллов не забраковала ни одну

ср, 09/02/2026 - 20:42

Площадки перестали пускать машинный текст самотёком. Habr проверяет публикации автоматически, а Кевин Индиг пишет о том, что платформы строят anti-slop-системы — механизмы подавления массового низкокачественного ИИ-контента. Дальше обычно следует совет писать хорошо, и на этом разговор заканчивается.

Мне нужно было проверяемое условие вместо совета, поэтому я собрал детектор на правилах и прогнал через него 59 собственных статей. Главный результат оказался не в том, сколько текстов он забраковал, а в том, что при агрегатном подсчёте он не забраковал ни одного, хотя дефекты были в сорока.

Читать далее

Восстановление данных с ZFS: задача со звёздочкой об удалённом Zvol

ср, 09/02/2026 - 20:42

В один из дней в лаборатории раздался звонок. Звонил представитель организации, оказывающей услуги системного администрирования. Его первым вопросом было: «А вы умеете работать с ZFS?». Разумеется, мы пояснили, что у нас есть некоторые наработки в рамках собственных исследований, а также стандартные средства DR‑лаборатории, такие как PC-3000, где поддержка ZFS предусмотрена как минимум на базовом уровне.

Ответив на парочку каверзных вопросов клиента об устройстве ZFS, мы через некоторое время получили два SSD Samsung 870 EVO ёмкостью 2 ТБ, которые были объединены в зеркальный RAID‑массив (Mirror). Изначально комментарии сводились к тому, что оба диска рабочие, но один выпал из массива. Основная проблема заключалась в том, что был случайно удалён один из важных Zvol (блочный объект ZFS, используемый для виртуальных дисков). Клиент пояснил, что хотел откатиться к прошлой версии uberblock’а и получить снимок, когда этот Zvol ещё не был удалён, но у него это не получилось. Резервная копия сохранилась, но она была сделана ещё в апреле этого года.

Читать далее

Сейчас на сайте

Сейчас на сайте пользователей и гостей.