13 августа сайт X опубликовал значительно обновлённую версию исходного кода рекомендательной ленты. В репозитории под лицензией Apache 2.0 выложили код модели Phoenix, реальные значения основных коэффициентов ранжирования, механизмы отбора кандидатов, фильтрации видимости, поддержки новых авторов и обеспечения разнообразия ленты.
Заметная доля пользователей X предпочитает называть сайт микроблогов по старинке — Twitter. Другая неискоренимая вредная привычка — чтение алгоритмической ленты. Чтобы увеличить охват микроблога, было бы неплохо хотя бы в общих чертах разобраться, как работает рекомендательный алгоритм, а затем рассмотреть все основные коэффициенты. Этим в данной статье мы и займёмся.
Читать далееОтвет пришёл, статус двести, тест зелёный, а денег на счету нет. Я много раз попадал в эту ситуацию и каждый раз выяснялось одно и то же. Проверяли статус, а не то, что реально вернул сервер и что при этом попало в логи.
Нейросеть в таких местах уверенно пишет проверки, которые проходят всегда, а потом ночью звонят не ей.
Ниже разбираю, как я сверяю ответ с документацией и с логами за один прогон, сколько это занимает по секундомеру и почему обычные автотесты этот случай пропускают.
Читать далееШтука, которая точно есть; все о ней говорят; каждый уверен в своей; снаружи её не найти и не доказать, а споры о её существовании не утихают десятилетиями.
Это не научная статья и не популяризаторский пересказ — это стенограмма настоящего диалога с Клод (Anthropic), в котором мы пытались разобраться, почему споры о сознании (зомби, чужие сознания, hard problem) в принципе не заканчиваются данными, и что с этим общего у теоремы Гёделя о неполноте. По ходу поймали друг друга на ошибках трижды — эти моменты в тексте не вычищены, они часть аргумента.
Читать далееЧто Claude получает ещё до первого сообщения пользователя, зачем модели отдельные инструкции по работе с инструментами и длинными задачами и какие идеи из system prompts можно использовать в собственных AI-ассистентах.
Когда мы отправляем Claude первый запрос, для пользователя диалог только начинается.
Для модели нет.
До пользовательского сообщения Claude уже получает системную инструкцию, которая задаёт контекст работы: кто модель, какая сейчас дата, как оформлять ответы, как работать с доступными инструментами, что делать с неопределённостью и какие ограничения учитывать.
Anthropic публикует такие инструкции в официальной документации в разделе System Prompts. Причём там сохранена история изменений: от Claude Haiku 3 и Opus 3 до Fable 5 и Opus 5.
Получается довольно интересный датасет для тех, кто работает с LLM не только через обычный чат.
Можно посмотреть, как за два года изменился подход Anthropic к системным промптам и что компания считает действительно важным объяснить модели до того, как пользователь вообще сформулировал задачу.
И некоторые выводы вполне применимы к собственным AI-агентам.
Читать далееЯ играю на гитаре. Не то чтобы хорошо, но у костра сходит. И каждый раз одна и та же сцена: кто-то просит сыграть конкретную песню, я достаю телефон, открываю сайт с аккордами — и следующие полторы минуты наблюдаю, как на одной палке связи грузится баннер, потом второй баннер, потом видеореклама, потом всплывашка «скачайте наше приложение», и где-то под всем этим — песня. К этому моменту у костра уже поют что-то другое. Без меня.
В какой-то момент я сформулировал, чего хочу: сайт с аккордами, который открывается мгновенно, работает без интернета и ничего мне не продаёт. Такого сайта не нашлось. Зато нашлись подписки на Claude и GPT и спортивный вопрос: может ли один человек, не написав руками почти ни строчки кода, собрать себе идеальный продукт за месяц?
Проверил. Рассказываю:
Читать далее17 августа 1998 года - день, когда миллионы россиян узнали значение слов «дефолт» и «девальвация». День, который навсегда изменил жизнь и судьбу многих из нас, на долгие годы разделив всё на до и после.
Читать далее17 августа в Краснодаре произошло ДТП на 7-полосной дороге. С участием 4 автомобилей. Если бы не "Делимобиль" - нет никаких других причин рассказывать о нем: полиция и скорая прибыли за минуты, движение отрегулировано, погибших нет, все службы отработали эталонно.
Вот только один из участников ДТП был клиентом каршеринга "Делимобиль". И их техническая поддержка своими неадекватными, невменяемыми требованиями буквально довела ситуацию до "белого каления".
Кратко: после ДТП требовали от водителя не прекращать поездку (деньги списываются), предоставить невозможные в ближайшие часы, или нереальные априори ("временная справка о ДТП") документы. А без них - отказывались прислать представителя, техпомощь, эвакуатор.
Сам я оказался не только свидетелем, но даже и участником этого цирка. В самом тексте - подробности происходившего
Читать далееЧто делать, если нейросеть из 2500 слоёв выглядит как чёрный ящик, а привычные методы анализа не помогают? В статье разбираем, как по весам и структуре модели удалось восстановить скрытую программу, распознать MD5 и дойти до ответа через механистическую интерпретируемость, SAT и несколько тупиковых гипотез.
Читать разборВ воскресенье, 16 августа, в одной из пекинских пожарных частей прошел финал аварийно-спасательной дисциплины вторых Всемирных игр гуманоидных роботов (WHRG). Год назад роботы на первых играх бегали, танцевали и играли в футбол в декорациях, теперь их впервые вывели на настоящую площадку — с настоящим огнем, настоящими пожарными и, как выяснилось, настоящим дождем. Из двенадцати команд, стартовавших в тот день, до конца испытания дошли только три.
Читать далееИИ‑чаты стали рабочим инструментом наравне с почтой — а вместе с ними появился новый канал утечек, которого три года назад не существовало. Договоры, резюме, пароли и клиентские данные уезжают на чужие серверы не через взлом, а через обычное поле ввода. Блокировать доступ пробовали многие — люди просто уходят на личные устройства, и риск становится невидимым.
Мы решили задачу иначе: расширение для браузера в Chrome Web Store, которое перед отправкой заменяет чувствительные данные обезличенными метками, а ответ ИИ расшифровывает обратно — прямо на экране, незаметно для человека.
В статье расскажу, какие подходы мы перепробовали и почему они не сработали, как выглядит путь пользователя и что у решения под капотом — от контрольных сумм до локального распознавания сканов.
Читать далееУ технологических рынков есть неприятная цикличность. Сначала новую услугу способны запустить только гиганты: инфраструктура дорога, специалистов мало, а клиент ещё не понимает, зачем ему всё это. Затем технология стандартизируется, оборудование дешевеет, компетенции расползаются по рынку — и вчерашняя привилегия нескольких корпораций превращается в массовый бизнес, куда входят сотни небольших игроков. Конкуренция растёт, маржа падает, рынок перенасыщается; часть новичков закрывается, часть остаётся локальной, а наиболее интересных снова покупают те самые гиганты, с которых цикл начинался.
Так развивалась сотовая связь: от дорогой инфраструктуры и ограниченного числа операторов — к массовому рынку, ценовой конкуренции и последующей консолидации. Так развивался доступ в интернет: районные провайдеры тянули кабель быстрее, чем крупные компании согласовывали смету, но со временем абонентские базы, сети и локальные бренды начали собирать большие группы. Теперь в ту же фазу входят IT-сервисы и SaaS, только искусственный интеллект сжимает весь цикл: то, что раньше требовало отдела разработки, поддержки и маркетинга, небольшая команда собирает из моделей, облаков и готовых компонентов.
Значит ли это, что нас ждут тысячи равных компаний и вечный праздник малого бизнеса? Почему тогда технологическое удешевление снова заканчивается укрупнением? Почему хороший продукт не удерживает рынок, а гигант, даже опоздавший с функцией, покупает конкурента или копирует его и возвращает долю? Именно это мы и разберём, потому что производство продукта и производство спроса — разные индустрии.
Читать далееЕсли бы в интернете вручали премию за количество мемов, в финал наверняка вышли бы Леонардо ДиКаприо, коты с осуждающим взглядом и язык PHP. Над последним разработчики шутят уже столько лет, что фразу «я пишу на PHP» лучше говорить шепотом или не говорить вовсе.
При этом язык, который регулярно объявляют мертвым, продолжает получать новые версии, обслуживать миллионы сайтов и оставаться востребованным в веб-разработке. Как появился PHP, чем он заслужил плохую репутацию и почему до сих пор не исчез — рассказываем в этой статье.
Читать далееПривет, на связи команда Яндекс Практикума. Приёмная кампания в онлайн-магистратуру «Управление продуктом в цифровом бизнесе» ИТМО в партнёрстве с Практикумом вот-вот закончится: 28 августа — последний день приёма документов. Но вы ещё успеете поступить, в статье расскажем, как это сделать и что входит в программу.
Читать далееДефицит специалистов в сфере кибербезопасности перестал быть кадровой проблемой. Сегодня это прямой стратегический риск для бизнеса. Пока злоумышленники осваивают ИИ и практикуют новые техники взлома, мы в «Ростелекоме» укрепляем защиту. Причем делаем ставку не только на поиск уникальных ИБ-профессионалов, но и вполне успешно превращаем студентов первых и вторых курсов в специалистов по кибербезу.
Привет, Хабр! Я Ольга Лапшина, HR-бизнес-партнер блока информационной безопасности «Ростелекома». В этой статье расскажу, как мы построили настоящую лабораторию по созданию киберзащитников и покажу, как в ней все работает.
Читать далееА вот реально, что настоящего осталось в программисте когда вокруг llm ? Где его суть и индивидуальность, где теперь его ценность ?
Читать далееHelp desk часто ошибочно считают инструментом для больших контакт-центров: десятки операторов, отдельный руководитель поддержки, огромная очередь заявок.
На практике система обработки обращений (help desk) становится нужна гораздо раньше — когда клиентские вопросы перестают помещаться в почте, мессенджерах, таблицах и памяти сотрудников.
Сначала кажется, что все под контролем. Клиент написал менеджеру в Telegram — менеджер ответил. Другой отправил письмо на общую почту — его переслали коллеге. Третий спросил про заказ в чате на сайте — оператор пообещал уточнить.
Но чем больше обращений, тем чаще команда начинает искать не решение, а сам контекст: где клиент писал, кто уже отвечал, что ему обещали и на каком этапе вопрос остановился.
Читать далееПерегрев в космосе — это опасность как для научного оборудования, так и для вычислительной электроники на спутниках. В космосе нет конвекции, а сброс тепла только через излучение значительно усложняет и так непростую задачу.
Давайте разберемся, как ее решают и можно ли сделать радиаторы используя только внеземные материалы?
Читать далееВсем привет! На базе наших аналитических исследований вышла новость про 5G устройства в России. Решили поделиться с читателями Хабра подробностями, которые не попали в публикацию.
Это взгляд на запуск сети пятого поколения не из пресс-релизов операторов, а на базе миллионов мобильных устройств, работающих в России.
Читать далееПродуктовый менеджмент — одно из самых перспективных направлений в IT. Причём специализированное техническое образование продакту не нужно, а зарплаты сопоставимы с заработком сильных разработчиков.
Конечно, от продакта требуются другие навыки, за который рынок готов платить, — про них расскажем в статье. А ещё — о том, как попасть в профессию и где учиться.
Читать далееПривет! Меня зовут Даниил, я iOS-инженер в Циане. В этой статье расскажу, как мы заставили XCUITest работать с экраном, к которому он в принципе не мог подойти.
У нас есть server-driven UI экран, наш BDUI, про движок которого была отдельная статья. Дерево вьюх у него настолько глубокое, что любое обращение теста к элементам падало. Причём двумя разными способами, и оба — не из-за кода, а из-за жёстких лимитов внутри самого фреймворка автоматизации.
В итоге мы научились читать дерево произвольной глубины и тапать/вводить текст в поля, которые лежат глубже ~60 уровней AX-дерева, где публичный XCUITest бессилен. Далее я буду фокусироваться на общей технике для XCUITest, а не на внутреннем устройстве нашего движка. Так что статья пригодится, даже если у вас никакого BDUI нет, а просто есть очень глубокий экран.
Читать далее