Feed aggregator

Трудно быть безопасником

Habr.com - Wed, 08/12/2026 - 14:04

Многие представляют IT‑безопасников суровыми дядьками без чувства юмора и с нулевой терпимостью к окружающим. Однако это не так. Перед вами — сатирический монолог о жизни в информационной безопасности. Возможно, некоторые персонажи слишком похожи на ваших коллег.

Читать далее

Формула «идеального enterprise» для open-source

Habr.com - Wed, 08/12/2026 - 14:01

Как отделить платные enterprise-функции от open-source кода так, чтобы их нельзя было взломать с помощью ИИ — показываю на примерах Dokploy и Pangolin.

Читать далее

Не подавать холодным! Прогрев JVM перед запуском трафика

Habr.com - Wed, 08/12/2026 - 14:00

Всем привет! Меня зовут Александр, я бэкенд-инженер в Банки.ру.

Пару месяцев назад мы поймали проблему, которая жила у нас довольно долго и которую мы упорно списывали на случайность. После каждой выкатки сервис первые несколько минут отвечал заметно медленнее обычного, а потом сам собой приходил в норму. Ушло около десяти релизов, прежде чем мы перестали считать это совпадением, и еще пара дней, чтобы найти настоящую причину. Ей оказался холодный старт JVM, а точнее то, что Kubernetes пускал на новые поды боевой трафик раньше, чем они были к нему готовы.

Дальше расскажу, что мы видели на графиках, какие версии проверили и отбросили, что происходит внутри JVM в первые минуты жизни процесса и что мы сделали.

Читать далее

Как я индексировал экосистему MCP: 9 источников, 80 000 серверов и куча нюансов

Habr.com - Wed, 08/12/2026 - 13:59

Полтора года назад MCP-серверов были десятки, сейчас десятки тысяч. Найти нужный стало отдельной задачей: официальный реестр хранит голые метаданные, awesome-списки устаревают за неделю, а у большинства каталогов нет главного, установки и проверки безопасности.

Я строю Unyly, агрегатор MCP-серверов. Сейчас в каталоге больше 80 тысяч записей из девяти источников. Расскажу, как это устроено технически: пайплайн агрегации, дедупликация, резолв установочных команд, security-сканы, health-чеки remote-серверов и шлюз, который отдаёт весь каталог агенту через одно подключение.

Читать далее

ИИ-революция уже началась. Мы просто пока не знаем, чем она закончится

Habr.com - Wed, 08/12/2026 - 13:56

Кажется, что слово «революция» применительно к искусственному интеллекту используют слишком легко. Каждый новый продукт теперь «революционный», каждая новая модель «меняет всё», а через полгода выходит следующая.

Но если отойти от конкретных моделей, чат-ботов и маркетинговых заявлений и посмотреть на происходящее в масштабе истории, картина получается интереснее.

Я считаю, что революция искусственного интеллекта уже началась.

Не в том смысле, что ИИ уже заменил людей, наступил AGI или мы точно знаем, каким будет рынок труда через десять лет. Как раз этого мы не знаем.

Революция — это процесс. И процесс уже идёт.

Причём во многих отношениях происходящее удивительно похоже на предыдущие технологические революции: сначала появляется новая фундаментальная технология, затем она быстро совершенствуется и дешевеет, после чего проникает в разные отрасли. Старые процессы сначала пытаются просто делать немного быстрее. Потом выясняется, что технологию выгоднее использовать вообще иначе. Начинается перестройка компаний, профессий, инфраструктуры и в конечном счёте общества.

Именно так происходило раньше.

Читать далее

Как перестать искать место для плат и начать тестировать

Habr.com - Wed, 08/12/2026 - 13:53

Привет, Хабр! Меня зовут Антон. Я работаю в группе разработки аппаратной поддержки СнК в YADRO. Моя команда занимается разработкой аппаратной и программной частей стендов для тестирования полупроводниковых продуктов, поэтому наша деятельность находится на стыке железа и программирования. А тестовая лаборатория — неотъемлемая часть нашей работы.

Мой рассказ будет состоять из двух частей. В первой я расскажу, как мы организовали лабораторию и разместили стенды. Во второй — покажу, какое оборудование помогает сделать работу инженеров быстрее и удобнее. 

Читать далее

[Перевод] Что ждет нас в будущем с AI? Полный перевод манифеста Марка Цукерберга

Habr.com - Wed, 08/12/2026 - 13:51

Привет! Меня зовут Саша Журавлев. Я венчурный инвестор и основатель фонда Mento VC. Мы инвестируем в технологические компании на стадиях Seed / Series A в США, а в своем телеграм-канале рассказываю, как вижу рынок и принимаю инвестиционные решения.

Вчера Марк Цукерберг опубликовал огромный манифест о том, каким он видит будущее с AI и сверхинтеллектом. Мне он показался интересным, поэтому мы с командой его изучили и перевели для вас. Приятного прочтения!

Читать далее

Что не так с советами по продуктивности из интернета

Habr.com - Wed, 08/12/2026 - 13:50

Привет, Хабр!

Наверняка многие, как и я, натыкались на всякие советы в интернете – как быть продуктивным, успешным, прямо как какой-нибудь популярный блогер. И может, вы даже что-то из них пробовали применить в жизни. Вставать в пять утра, планировать каждый-прекаждый час, не тратить время на ерунду. Успешные же люди всегда в движении, всегда развиваются и, конечно же, всегда все успевают.

Читать далее

Как я собрал браузерный хоррор на Three.js: GLB-контракт, аномалии и PS1-рендеринг для слабых устройств

Habr.com - Wed, 08/12/2026 - 13:47

Как я сделал браузерную 3D-игру на Three.js и Vue: система аномалий, GLB-сцена, PS1-рендеринг и оптимизация под слабые устройства.

Читать далее

MoE на 5090 недобирает полтора раза, и дело не в маршрутизации

Habr.com - Wed, 08/12/2026 - 13:45

RTX 5090, одна и та же сборка llama.cpp, один драйвер, батч 1. Плотная Qwen3.5-9B выбирает 72% пропускной способности памяти карты. MoE Qwen3.5-35B-A3B на той же карте выбирает 41%.

Маршрутизация экспертов тут почти ни при чём, я её измерил: ядра top-k занимают 7% времени. CUDA-графы захватываются, дыр между запусками нет, занятость SM 97%. Карта работает почти всё время, просто делает работу медленнее, чем позволяет память.

Причина оказалась в том, сколько байт читает одно ядро за запуск. Я написал программу на ggml, которая гоняет тот же mul_mat_vec_q на холодных весах, и снял кривую: на 1 МБ ядро берёт 23% полосы, на 4.2 МБ уже 53%, на 33.6 МБ 91%. У MoE на одно ядро приходится 4.6 МБ, у плотной модели 22.2 МБ. Вот и весь разрыв.

В статье: разбивка всех 437 матвеков по трассе nsys, четыре способа померить это неправильно и посидеть в каждой ловушке по очереди, проверка модели на другой архитектуре с ошибкой 3.7% и на четырёх глубинах контекста, цена сэмплера и всей обвязки llama-server. Последнее оказалось крупнее всего остального: пользователь видит 225 токенов в секунду там, где бенчмарк показывает 317.

Читать далее

Игра-головоломка «Прогулка по подземельям»

Habr.com - Wed, 08/12/2026 - 13:44

Прогулка по подземельям — это минималистичная, но при этом очень интересная и сложная головоломка из игры MIT Mystery Hunt 2014 года. Она представляла собой видеоигру со множеством уровней, каждый из которых был подземельем с различными препятствиями и врагами, которые игроку нужно было преодолеть, чтобы добраться до выхода. Пройти первые несколько уровней не представляло особого труда — их главной целью было познакомить игрока с основными механиками игры. Однако затем сложность и оригинальность уровней резко возрастали, и каждый их них представлял собой уже далеко не тривиальную задачу.

Читать далее

Программный код летучий

Habr.com - Wed, 08/12/2026 - 13:39

В статье описывается Python пакет peacepie — экспериментальная фреймворк, реализующий акторную модель с динамически загружаемыми акторами из внешних пакетов во время выполнения. Основная область применения — автоматизация, бэкенд. Акторы, реализованные во внешних пакетах, демонстрируют необычайную подвижность благодаря своей изолированной природе.

Поскольку пакет представляет собой автономный модуль кода, его легко перемещать между различными процессами или даже узлами в распределённой системе. Это свойство делает акторы, созданные на основе таких пакетов, чрезвычайно гибкими и независимыми от конкретной среды выполнения.

Читать далее

Кадры вместо видео: как индустрия обходит вес scroll‑scrub анимаций

Habr.com - Wed, 08/12/2026 - 13:36

Продуктовые сайты любят анимацию «крутишь колесо мыши — объект меняется на глазах». Первый инстинкт: сделать это видео с currentTime. Вот почему это почти всегда неправильный первый инстинкт, и что вместо этого используют на практике.

Читать далее

Книга: «Армия иммунитета. Как два триллиона микроскопических существ хранят ваше здоровье и как им помочь»

Habr.com - Wed, 08/12/2026 - 13:34

Привет, Хаброжители! Издательство «Питер» выпустило весьма необычную книгу «Армия иммунитета», которая вскрывает клеточную оборону организма, используя необычную военную метафору. Все иммунные клетки и системы имеют армейские и полицейские специальности. Например, макрофаги появляются как местные участковые и дежурная охрана. Автор разделяет их на мирную форму М2 — дворники, которые ползают по тканям, собирают свернувшиеся белки, окисленные жиры и остатки погибших клеток, и тут же перерабатывает этот утиль в своих многочисленных лизосомах. А когда приходят сигналы о боевых действиях, тот же макрофаг меняет швабру на пушку и переходит в тип М1. Книга прямо описывает эту трансформацию, хотя в канонической иммунологии М2 обычно связывают с репарацией и подавлением воспаления, а провоспалительную работу закрепляют за М1. Автор трактует переход расширительно и делает его частью единого сюжета.

Читать далее

Kubernetes — это эксплуатация, а не деплой. Мы шли к этому пониманию 7 лет

Habr.com - Wed, 08/12/2026 - 13:30

Kubernetes называют инструментом автоматизации. Ирония в том, что первые годы его эксплуатации в облаке — это история ручного труда: сертификаты, которые никто не обновлял, кластеры, которые деградировали молча, клиенты, которые ждали поддержки там, где мы предполагали самообслуживание. Мы начали делать managed Kubernetes в 2018 году, когда на российском рынке этого сервиса почти не существовало. Эта статья о том, что значит слово «managed» на самом деле — и какую архитектуру оно в итоге требует.

Читать далее

Как мы автоматизировали рассылку персональных писем для конференции и починили доставляемость до сотрудников банков

Habr.com - Wed, 08/12/2026 - 13:23

Привет, Хабр! На связи команда Just AI. Два раза в год мы проводим конференцию Conversations — это от 500 до 700 участников, и каждый из них должен получить персональную памятку: уникальный ID для входа в приложение, персональную ссылку на трансляцию, информацию о программе. Звучит несложно до тех пор, пока не выясняется, что 30% писем вообще не доходят — участники из крупных банков и госструктур просто не видят их: корпоративные фильтры блокируют письма на уровне инфраструктуры.

В этой статье расскажем, как мы собрали автоматизированный workflow* на агентной платформе, который отправляет персонализированные письма — и проверили, что они действительно доходят даже на домены крупных банков. Это был самый оперативный способ облегчить жизнь команды, которая в день конференции получала десятки писем с одними и теми же вопросами.

* В этом решении нет языковой модели и принятия решений, только детерминированная цепочка шагов.

Читать далее

Агентская разработка и Documentation Driven Development: когда ИИ пишет не код, а контракты

Habr.com - Wed, 08/12/2026 - 13:07

Привет, Хабр! Я Матвей Лихота, старший Go-разработчик. В предыдущем материале я показывал, как получить Go-код из OpenAPI. Теперь хочу сделать еще один шаг назад — к моменту, когда контракта еще нет.

На демо частенько можно увидеть, как по простому запросу «напиши CRM» или «собери интернет-магазин» LLM уже через минуту готовит сервер, модели, миграции и тесты. Но в реальности, конечно, все происходит чуть иначе: проверяем код, а там — сюрприз-сюрприз ошибки. Повторив тот же промпт, мы получим другую архитектуру и снова потратим время на проверку. И нет гарантии, что после переделки ошибок не станет еще больше.

Конечно, все дело в промпте. Согласитесь, странно просить модель понять задачу, выбрать архитектуру, определить границы и все реализовать за один шаг? Что, если LLM сначала проектирует систему и выпустит OpenAPI, Proto, JSON Schema, CloudEvents и AsyncAPI? А код мы добавим чуть позже: за повторяемую часть будут отвечать обычные генераторы, а за проектно-зависимую — разработчики и агент в контексте репозитория.

Такой подход, где главным артефактом становится контракт, а код — его производной, можно назвать Documentation Driven Agent Development или Specification Driven Agent Development. Как он работает — покажу на примере разработки простой автоматической телефонной станции (АТС), а еще проведу границу между генераторами и агентами.

Читать дальше

Когда комментировать на Хабре: я разобрал 4404 комментария

Habr.com - Wed, 08/12/2026 - 13:02

Некоторое время назад я решил оживить мой аккаунт на Хабре. Покомментировав с умным видом здесь и тут, я решил подвести научную базу: собрал 4404 чужих комментария из 250 тредов и посчитал, когда и где надо оставить комментарий, чтобы он набрал максимум лайков. Спойлер: час на часах не важен, а вот позиция в треде и первые сутки решают всё.

Погрузиться в Биг Дейту

Создаём свой BI-дашборд с ИИ-редактором в Битрикс24

Habr.com - Wed, 08/12/2026 - 13:00

Создаём отдельный BI-дашборд на данных Битрикс24, в котором можно менять визуализацию и поддерживаемые настройки отчёта запросами к ИИ.

В статье — ссылка на готовый редактор, описание принципов его работы и промпты для самостоятельного повторения.

Читать далее

Как оптимизировать расходы на инфраструктуру для искусственного интеллекта. Выбираем железо и модели под разные задачи

Habr.com - Wed, 08/12/2026 - 13:00

В отчете The State of AI 2025 агентство McKinsey заявляет, что 88% компаний уже используют ИИ хотя бы в одном бизнес-процессе. Grand View Research отмечает, что по их прогнозам глобальный рынок вырастет до 3,5 триллионов долларов к 2033. Уже сейчас мы можем отследить эту динамику.

Однако AI-сервисы не бесплатны. Компании, которые начали с токенизированных API, часто обнаруживают, что при реальной нагрузке их счета растут быстрее, чем польза от ИИ. Поэтому возникает вопрос: как развернуть искусственный интеллект на собственной инфраструктуре и не переплатить.

Привет! Привет! Меня зовут Сергей Ковалёв, я менеджер продукта в Selectel. В статье отвечу на этот вопрос, сравню токенизированные API с on-premise и разберу, когда собственное железо будет выгоднее арендованного. Подскажу, как выбрать модель в зависимости от задачи и GPU под разные сценарии: от простого чат-бота на L4 до многоагентных систем на HGX B300. А в конце дам пошаговый план, как перейти с токенов на собственную инфраструктуру и посчитать реальную стоимость запроса.

Читать далее

Who's online

There are currently 0 users and 9 guests online.
Syndicate content