Feed aggregator

boilerplate_ratio = 1.73: что считает аудитор готовности страниц к ответам ИИ

Habr.com - Mon, 10/05/2026 - 15:46

Прогон аудитора пригодности страниц к ответам ИИ вернул нули по всем адресам батча. Полез в исходники пакета и нашёл шесть мест, где он считает не то, что обещает: доля шаблонного текста, которая бывает больше единицы из-за двойного счёта вложенных узлов, регулярки на латинице, из-за которых русский текст получает ноль, веса, в которые не входит половина печатаемых метрик, и бюджет в десять секунд, отведённый на пятнадцать запросов. Разбор с кодом и минимальными примерами.

Читать далее

Можно ли научить маленькую LLM учиться без роста весов? Замеры, баги и честная статистика

Habr.com - Mon, 10/05/2026 - 15:45

Мейнстрим растит модели масштабом. Мы меряем ортогональное: можно ли растить компетентность маленькой модели без роста весов — через верифицированную память и локальное обучение, с жёстким потолком ресурсов (бытовая GPU 12 GB).

Читать далее

Правда о Coil в Jetpack Compose: измеряем реальный оверхед SubcomposeAsyncImage

Habr.com - Mon, 10/05/2026 - 15:37

«SubcomposeAsyncImage в списках использовать нежелательно, он тормозит скролл» — так написано в документации популярной библиотеки Coil. Действительно ли это так, и во сколько миллисекунд обходится сабкомпозиция на самом деле?

Я провел масштабный бенчмарк: взял 5 разных популярных способов загрузки картинок на тяжелом датасете из 500 элементов с замерами через Macrobenchmark на реальных устройствах, далее сравнил результаты с прогнозами четырех нейросетей (Claude, DeepSeek, Gemini, Qwen), а так же обнаружил неожиданный архитектурный нюанс.

Разбираемся, почему FPS врет, в чем коварство P99, как ошибаются нейросети, и какая стратегия добавления изображения в списки на самом деле быстрее всех.

Читать далее

Парсинг на Python: HTTP, Scrapy или браузер — практическое сравнение

Habr.com - Mon, 10/05/2026 - 15:23

BeautifulSoup, Scrapy, Selenium и Playwright часто сравнивают как аналоги, хотя это инструменты разных уровней. Я собрала тестовый стенд и сравнила их на статическом HTML, JavaScript-странице, массовом обходе и работе с UI — с замерами времени, памяти и неожиданными результатами.

Читать далее

MWS Cloud Platform глазами новичка: что здесь есть и как все устроено

Habr.com - Mon, 10/05/2026 - 15:21

Облачные платформы, как правило, выглядят одинаково пугающе: открываешь консоль, а там десятки сервисов, виртуальные сети, Kubernetes, базы данных, IAM, какие-то шлюзы… Вообще непонятно, что там делать, — прямо как при первом заходе в «Битрикс».

Мне по долгу службы выпала возможность поработать через MWS Cloud Platform, и я решил изучить ее как нормальный человек (а не от корки до корки по документации): поставить конкретную задачу и пройти весь путь самому. Сегодня миссия простая: взять готовую LLM в облаке, развернуть ее и начать отправлять ей реальные запросы со своего компьютера.

Если вам нужна LLM как часть своего инструмента, а не как очередной чат-бот, приложение, рабочий скрипт или AI-агент, ее нужно где-то запускать и как-то подключать. GPT Model Hub как раз позволяет взять готовую модель и получить к ней API, не разворачивая всю инфраструктуру самостоятельно.

Поэтому в этом обзоре пройдем путь от первого входа в аккаунт до рабочего Qwen: подключим биллинг, создадим деплоймент, получим API-ключ и заведем модель в VS Code. Этим материалом я запускаю цикл обзоров на большой продукт MWS Cloud Platform.

Поехали!

Читать далее

Дистилляция ИИ, или как создать свой Claude. Рассказываем без воды :)

Habr.com - Mon, 10/05/2026 - 15:19

Дистилляция знаний — это техника машинного обучения, при которой более компактная и быстрая модель (Student) обучается воспроизводить поведение, логит-вероятности и пошаговые цепочки рассуждений большой и сложной нейросети (Teacher). Метод используют программисты, чтобы сделать нейросети маленькими и быстрыми, не потеряв при этом их ум и точность.

Читать далее

Как разобрать macOS на части

Habr.com - Mon, 10/05/2026 - 15:13

Всем привет! Меня зовут Игорь Белов, я инженер в команде Мобильной Архитектуры Авито. Больше 6 лет занимаюсь iOS-разработкой, а ещё мне нравится изучать фундаментальные темы Computer Science и разбираться, как те или иные вещи работают под капотом.

В статье я расскажу, как исследовать произвольные приложения macOS с помощью отладчика LLDB и сопутствующих инструментов, и тем самым прокачать свой повседневный инструментарий разработчика. Сначала исследуем произвольно запущенные процессы в macOS с помощью LLDB. Затем на основе собранных знаний сделаем инъекцию своего кода, чтобы изменить их поведение. Ещё немного затронем теорию, подготовим и настроим окружение. В конце я посоветую, что почитать, чтобы углубиться в тему.

Статья будет полезна инженерам любого уровня, которым интересно узнать, как устроены привычные вещи. И да, это образовательная статья, а примеры из неё не предназначены для обхода защиты и несанкционированного вмешательства в чужие сервисы или данные.

На создание этого материала меня вдохновило выступление Дерека Селандера — ему уже около десяти лет, но оно всё ещё актуально. Мне захотелось взять идею оттуда в более прикладном виде и спроецировать на современную повседневную разработку.

Читать далее

Меня достала реклама, и я сделал свой торрент-клиент для Windows

Habr.com - Mon, 10/05/2026 - 15:08

Меня достала реклама в торрент-клиентах. Хотелось открывать программу, выбирать нужные файлы и оставлять загрузку в фоне. Так появился Tern: бесплатный клиент для Windows с открытым кодом, светлой и тёмной темами и автообновлением.

Хорошие альтернативы вроде qBittorrent уже существуют. Мне хотелось сделать приложение под себя, а заодно разобраться, сколько работы скрывается за обычной полоской прогресса. На больших торрентах мой собственный клиент начал тормозить, и пришлось заняться движком: убрать повторные обходы частей, вынести загрузки в отдельный процесс и ограничить скорость проверки файлов.

Показываю, что получилось, какие компромиссы остались и что удалось измерить в локальных тестах. Исходники и установщик доступны на GitHub.

Посмотреть, что получилось

Соглашение о неконкуренции в ИТ‑отрасли: работает ли это в России?

Habr.com - Mon, 10/05/2026 - 15:06

В статье подробнейшим образом освещаются практические вопросы связанные с актуальным регулированием и практикой применения соглашений о неконкуренции в России. В частности разбираются вопросы:

Что такое соглашение о неконкуренции?

Зачем работодателю соглашение о неконкуренции (NCA)?

Законно ли заключение соглашения о неконкуренции с работником?

Как защититься работодателю без классического NCA?

Можно ли заключить соглашение о неконкуренции с компанией?

Ответственность за заключение незаконного соглашения о неконкуренции

Что нужно указать в соглашении о неконкуренции?

Что нельзя делать при заключении NCA?

Законные альтернативы соглашению о неконкуренции?

Читать далее

Как посчитать статистику переписки на 500 тысяч сообщений в браузере и не увидеть ни одного

Habr.com - Mon, 10/05/2026 - 14:55

Переписка с близким человеком — одна из самых личных вещей на телефоне. А мы делаем сервис, которому нужно её прочитать. Из файла экспорта получаются карточки: кто чаще пишет первым, как быстро отвечает, в какие часы вы на связи, какие словечки появились у пары и кто из вас их придумал. Просьба «загрузите переписку к нам на сервер» убила бы такой проект в день запуска, и правильно.

Поэтому у «Чатограммы» (это наш пет-проект) одно жёсткое правило: всё считается в браузере, и по умолчанию сервер не видит ни одного сообщения. Ниже — как это устроено технически, во что это обходится по скорости и где у правила есть исключения. Все цифры я замерил на днях, в том числе на своих настоящих переписках, а не только на синтетике.

Читать далее

Прячем сервер за прокси. Часть 1: iptables и его пределы

Habr.com - Mon, 10/05/2026 - 14:42

Как спрятать реальный IP сервера?

В первой части серии разбираемся с iptables: как устроены таблицы и цепочки netfilter, что происходит с пакетом на пути от клиента до бэкенда и как с помощью DNAT/SNAT организовать простой прокси-узел. Покажем рабочую конфигурацию для HTTPS, TCP и UDP, разберём типичные проблемы с FORWARD, conntrack и маршрутизацией, а главное — выясним, почему простой NAT не позволяет одновременно скрыть IP сервера и сохранить реальный IP клиента. В конце сравним подход с nftables и разберём, в какой момент iptables перестаёт подходить для цепочки прокси.

Читать далее

Эскроу‑счета из двух банков в 1С по API с нуля: из чего состоит интеграция и где подстелить соломку

Habr.com - Mon, 10/05/2026 - 14:34

Застройщику нужно было видеть в 1С движение по эскроу‑счетам и расчётным счетам — раньше этих данных в системе не было вообще. Интеграции со Сбербанк API и Альфа‑Банк API написали с нуля: около 24 000 счетов, 30 объектов строительства, у банков разная авторизация, API и форматы. Рассказываю, из каких слоёв состоит такая интеграция, почему документация банка — не последняя инстанция и что проверить в первую очередь.

Читать далее

Что происходит после нажатия Play. Разбираем архитектуру Spotify

Habr.com - Mon, 10/05/2026 - 14:27

Всем привет. На днях попалась информация интересная и захотелось разобраться в сервисе, которым пользуются миллионы людей – это Spotify.

На первый взгляд всё очень просто, нашли песню, нажали Play, музыка заиграла, но, если вспомнить, что за этим приложением стоят миллионы пользователей и миллионы треков, всё становится гораздо сложнее и интереснее.

Где физически лежит музыка? Почему один и тот же трек существует в нескольких версиях? Кто отправляет аудио пользователю? Почему Spotify не отдаёт весь файл через свой backend? Как музыка успевает загрузиться раньше, чем мы до неё дослушали? И откуда приложение знает, где мы остановились на другом устройстве?

Давайте разберёмся.

Читать далее

Scala Digest. Выпуск 45

Habr.com - Mon, 10/05/2026 - 14:23

Привет, Хабр! Мы — Настя и Эвелина — бэкенд-разработчики Т-Банка, пишем код на Scala и горим желанием его популяризировать. Мы собираем и агрегируем новости из разных источников, включая Scala Times, блог Petr Zapletal, добавляем дополнительные материалы и собственные комментарии. Мотивацию черпаем из желания wразвиваться и делиться полученными знаниями.

Приветствуем любую обратную связь! (づ ◕‿◕ )づ

Читать сорок пятый выпуск

LLM научилась генерировать ДНК

Habr.com - Mon, 10/05/2026 - 14:01

На Хабре давно предупреждали о создании синтетических вирусов с заданными свойствами. Например, определёнными показателями смертности или целевой активацией. Есть конспирологическая версия, что даже вирус COVID-19 (SARS-CoV-2) искусственно вывели в китайской лаборатории.

Возможности людей-биологов сильно ограничены. А представьте, если GLM (Genetic Language Model) обучится на геномах всех живых существ — и сможет генерировать цепочку ДНК с любыми свойствами, а далее синтезировать новые формы жизни, практически как Бог.

Это открывает дорогу к улучшению человеческого генома, а также созданию принципиально новых, более совершенных организмов, которые не встречаются в природе.

Исследователи из Стэнфорда сделали первый шаг в этом направлении. Они впервые использовали ИИ для генерации нового вируса.

Читать далее

Как я перестал быть прокладкой между ИИ-агентами: ИТ-суперагент для Claude Code сотрудников

Habr.com - Mon, 10/05/2026 - 13:49

Сейчас у нас, как и почти везде, идёт переход на ИИ: каждому сотруднику пытаются выдать своего ИИ-агента. Очень быстро выяснилось, что раздать агентов — полдела. Дальше начинается управление ими: кто агенту говорит, что ему можно, откуда он знает, как устроена компания, и кто отвечает на его вопросы, когда он упирается в стену.

У нас на этом месте оказался я — единственный администратор примерно на 60 сотрудников. Агенты сотрудников писали мне письма, я пересылал их своему агенту и отправлял ответ обратно. Пользователи шутят, что мы стали прокладками между несколькими ИИ.

В статье — как мы пришли к профильному ИТ-суперагенту, как он устроен внутри (MCP, два RAG-источника, права, проверки на серверах, эскалация в мессенджер) и на какие грабли наступили. Это не продукт и не реклама — рабочий прототип, который сейчас крутится в пилоте.

Как устроен суперагент

Как меняют работающие 1С-системы: десять кейсов крупных компаний на TECH EVENT 2026

Habr.com - Mon, 10/05/2026 - 13:46

Разделить монолит без остановки бизнеса, сменить СУБД с сохранением существующей логики, встроить ИИ в корпоративные процессы — такие задачи разберут в секции «Кейсы крупных компаний» на INFOSTART TECH EVENT 2026. Конференция начнется 8 октября в Санкт-Петербурге. В программе секции — десять выступлений о проектах, технических решениях и ограничениях, с которыми столкнулись команды.

В этой секции партнеры конференции представят опыт разработки и эксплуатации корпоративных систем. Темы охватывают архитектуру, инфраструктуру, интеграции, внутренние продукты и найм специалистов. Ниже — что именно будут обсуждать и какие доклады можно выбрать под свои задачи.

Читать далее

Маргарет Митчелл, «Пропавший Лейсен»

Habr.com - Mon, 10/05/2026 - 13:44

Имя Маргарет Митчелл неразрывно связано с романом “Унесенные ветром”, одной из самых читаемых книг XX века. Долгое время считалось, что “Унесенные” - единственное произведение крупной прозы, созданное американской писательницей. Но в 1995 году литературный мир потрясла сенсационная новость: внезапно нашлась ее ранняя повесть Lost Laysen (“Пропавший Лейсен”), написанная в 1916 году и почти восемьдесят лет пролежавшая в частном архиве.

Читать далее

God of Pixels: шесть лет, два языка и один генератор планет

Habr.com - Mon, 10/05/2026 - 13:38

Личный проект длиной в шесть лет: от школьных скриптов на Python до OpenGL‑рендера с облачностью, климатом и картами звёздных систем. Когда переписывал рендеринг вручную — уходили недели. Когда подключил LLM — два вечера. Рассказываю, как это было, и что при этом чувствуешь.

Читать далее

Три ловушки в VOSK: моя программа удаляла корректные модели после скачивания

Habr.com - Mon, 10/05/2026 - 13:36

Мне нужно было приложение, которое распознаёт речь и никуда не отправляет аудио. Не «не отправляет по умолчанию» и не «у нас есть офлайн‑режим» — а физически не может, потому что сети нет в процессе.

Когда я начал искать, выяснилось, что выбор небольшой.

Читать далее

Who's online

There are currently 1 user and 3 guests online.
Syndicate content