Feed aggregator

Klark + Klara: корпоративный мессенджер и таск‑менеджер, которые живут на нашем сервере

Habr.com - Mon, 09/28/2026 - 16:58

Свой корпоративный мессенджер на FastAPI и React: зачем он нам понадобился, что в нём есть и что ломалось по дороге.

Читать далее

Сколько стоит час работы кодинг-агента: рейтинг пяти API-шлюзов по расходам

Habr.com - Mon, 09/28/2026 - 16:51

Вышли Claude Opus 5.5 и GPT-6 Sol, и все пошли смотреть прайсы шлюзов. Я собрал цены пяти шлюзов с оплатой из России и посчитал иначе: сколько стоит час работы в Claude Code, если нагрузка как у меня — по логам 49 моих сессий, 138 часов работы.

Разброс получился почти десятикратный: от 181 до 1 756 рублей за один и тот же час на одной модели. Половина счёта уходит на запись в кэш, хотя её всего 5% от входящих токенов. А самый дешёвый ценник в таблице даёт не самый дешёвый час: когда чтение кэша стоит столько же, сколько обычный ввод, час работы агента выходит почти вдвое дороже, чем у шлюза с дешёвым кэшем.

Читать далее

Добавляем 3D в игру на Flame, не переписывая её

Habr.com - Mon, 09/28/2026 - 16:30

«У меня игра на Flame, можно ли добавить в неё 3D?». Можно, и игру не придётся переписывать: корабль летает по трёхмерному двору со светом и тенями, а джойстик, HUD и вся игровая логика остаются на Flame. У двух движков одни часы, одна физика и один ввод, поэтому таран, который посчитала 3D-физика, приходит во Flame обычным onCollisionStart. Я разберу по шагам небольшую аркаду на flame_flutter3d, покажу рецепты, которые можно брать в свою игру, и неочевидные места, на которые наступил сам. В аркаду можно сыграть прямо в браузере.

Читать далее

CMF: решения за миллисекунды без генерации токенов (аналог Jev) с открытыми весами

Habr.com - Mon, 09/28/2026 - 16:28

Сейчас очень много обсуждают модель Jev от Typesafe, я решил выложить модель в своем CMF формате для личного использования (License:apache-2.0) которая давно работает на шлюзе

Как это работает? Например пользователь пишет, что карта так и не пришла. Приложению нужно выбрать card_arrival и передать обращение в нужный обработчик, или напиши функцию на go, принять решения нужно максимально быстро. Таких развилок много: выбрать инструмент агента, определить тему заявки, сложность, направить документ на проверку, определить сложность и тип задачи.

Для этих задач я опубликовал CMF Decision: модель, которая принимает решения по ошибке реконструкции. Энкодер, обученные навыки и правила уверенности лежат в одном .cmf‑файле. Новые навыки можно добавлять по своим примерам, а незнакомые случаи — передавать подключаемому оракулу‑модели которая выступает в роли учителя.

В Cortiq 0.8.0 один и тот же файл работает на CPU, Apple Metal и Vulkan. На RTX PRO 4000 Blackwell полный локальный путь занял 1,10–1,24 мс.

Ниже — как устроен этот механизм, что получилось в сравнении с Jev и Laya и как запустить модель или добавить свою задачу.

Читать далее

Империя на бычках и калькуляторах — История Casio

Habr.com - Mon, 09/28/2026 - 16:22

Аж до самого ногтя шабили сигареты Японцы после войны, потому что табак тогда ценился дороже риса. Это заметили братья Касио и придумали кольцо-сигаретник, которое надевалось на палец и удерживало сигу, позволяя скуривать все до победного конца не обжигаясь. Поэтому девайс разлетался как горячие чебуреки.

Читать далее

Эволюция эксплуатации переполнения буфера в Windows: от Stack Smashing до ROP и CET

Habr.com - Mon, 09/28/2026 - 16:21

Как менялась эксплуатация переполнений буфера в Windows за последние десятилетия?

Рассмотрим путь от классического Stack Smashing до современных механизмов защиты потока выполнения. На практике рассматриваются x86-техники переписывания EIP, NOP-sled, JMP ESP, эксплуатация SEH, переход к ROP как способу обхода DEP.

Практически продемонстрированы примеры создания и эксплуатации указанных уязвимостей.

Читать далее

После релиза БОЛТУНа на Tauri: 134 млн голосовых кадров и рост аудитории

Habr.com - Mon, 09/28/2026 - 16:20

15 сентября мы выпустили БОЛТУН с Windows-клиентом на Tauri. К 28 сентября сервер учёл 134 млн входящих голосовых кадров, а среднее число разных клиентских ID в сутки выросло со 145 до 192 при сравнении одинаковых дней недели — примерно на 33%. Разбираем первые результаты: рост активности, голосовой трафик, демонстрации экрана и 854 часа суммарного прослушивания радио.

Читать далее

Периферийное распознавание — будущее работы с документами: дайджест недели Smart Document Engine

Habr.com - Mon, 09/28/2026 - 16:15

В бизнесе важна каждая минута. Но если документ сначала нужно передать на обработку, проверить его и только потом внести данные в учетную систему, между реальной операцией и ее отражением в системе возникает разрыв. Все это время собственник не видит актуальной картины и вынужден принимать решения на основе уже устаревшей информации. Поэтому распознавать документы нужно непосредственно там и тогда, где происходит операция.

Эту задачу решает периферийное распознавание, реализованное в Smart Document Engine. Платформа позволяет обрабатывать документы прямо в точке их появления — например, на складе или рабочем месте сотрудника — с помощью смартфона, планшета или другого устройства и сразу передавать готовые данные в корпоративные системы. В результате бизнес получает актуальную картину происходящего, а разрыв между реальной операцией и ее отражением в учете сокращается до минимума.

Собрали главное за Неделю Smart Document Engine в одном дайджесте

[Перевод] Как работает инференс в больших языковых моделях

Habr.com - Mon, 09/28/2026 - 16:07

Привет, Хаброжители! Когда вы вводите промпт в большую языковую модель (LLM), машина преобразует ваш текст в числа, обрабатывает их, а потом возвращает ответ токен за токеном. В этой статье мы разберём, что такое инференс (логический вывод) в LLM и посмотрим, как он работает.

Читать далее

Почему инференс LLM становится дорогим и как снизить расходы на GPU без покупки новых карт

Habr.com - Mon, 09/28/2026 - 16:05

Высокая загрузка GPU ещё не означает, что инфраструктуре не хватает ресурсов. В продакшене значительная часть времени может уходить на повторный расчёт одинаковых промптов, неэффективное распределение кэша или неверные параметры сервинга.

Разберём шесть шагов оптимизации инференса LLM на стеке vLLM и Kubernetes: от поиска узкого места и расчёта KV‑кэша до настройки prefix caching и проверки квантования.

Читать гайд

Почему fallback между LLM может сломать семантику ответа

Habr.com - Mon, 09/28/2026 - 15:57

В обычном backend fallback обычно означает: тот же контракт, другой исполнитель. С LLM всё сложнее — резервная модель может вернуть валидный JSON, но изменить смысл результата. Разбираю, почему retry и fallback нужно разделять, как учитывать деградацию качества и когда честная ошибка лучше «успешного» ответа другой модели.

Читать далее

Как зарабатывать на Open Source без смены лицензии: разбор Cap (22.8k звёзд) и схема с платными бинарниками

Habr.com - Mon, 09/28/2026 - 15:51

Большинство попыток заработать на открытом коде упираются в две крайности: сбор донатов, где за десятки тысяч звёзд на GitHub автор получает пару сотен долларов в месяц, или внезапная смена лицензии на BSL, которая оборачивается волной хейта и немедленными форками.

Проект Cap (открытый аналог Loom с 22 800 звёзд) нашёл третий путь. Их монорепозиторий на Rust, Tauri и Next.js выложен полностью, но проект успешно зарабатывает. Ниже — подробный разбор архитектуры проекта, того, как устроено разделение лицензий MIT и AGPLv3, и почему юридическая схема с платными бинарниками за $29/год работает даже без DRM.

Читать далее

[Перевод] Сравнение протоколов удаленного доступа VDI  Q2 2026 (On-prem / Не для облака) (часть 2)

Habr.com - Mon, 09/28/2026 - 15:44

Часть 2

Примечание переводчика

В первой части статьи о протоколах удаленного доступа разобраны архитектурные особенности Citrix HDX\EDT, Omnissa BlastExtreme, Microsoft и Parallels RDP. В этой части о технических, финансовых и "пользовательских" последствиях выбора того или иного VDI, а значит и протокола, а так же итоговая таблица "чемпионата" протоколов.

7. Перспектива FinOps: экономика кодеков и плотность пользователей VDI. 

Архитектура протокола напрямую влияет на капитальные и операционные затраты. Конвейер кодеков определяет потребление ресурсов ЦП и GPU на хостах ВМ, что, в свою очередь, определяет плотность пользователей на одном физическом сервере — основной единице стоимости инфраструктуры VDI. В этом разделе анализ протокола связывается с экономикой серверов, необходимой для стратегии FinOps. 

7.1 Экономическая эффективность Thinwire для CPU по сравнению с полнокадровым H.264 

Архитектура Citrix Thinwire, использующая многокодековое кодирование в одном кадре, вычислительно сложнее на кадр, чем стандартное кодирование H.264. Классификатор содержимого экрана, детектор областей и распределение кодеков добавляют циклы ЦП, чего не делает простой полнокадровый кодировщик H.264. Вопрос архитектуры заключается в том, превышает ли эта дополнительная нагрузка экономию. Эмпирический ответ: нет. Стоимость классификатора существенно ниже, чем стоимость кодирования, сэкономленная за счет отказа от применения H.264 к статическим текстовым областям (которые Thinwire обрабатывает без потерь с минимальным битрейтом). Полнокадровое кодирование в H.264 видео качество для экрана, на 80% состоящего из статического текста и на 20% из видео — значительная трата циклов ЦП и полосы пропускания. Thinwire кодирует 20% видео-области в H.264, а 80% текстовой области без потерь, используя кодек MDRLE, с минимальными затратами ЦП. Потребление ресурсов ЦП при типичном сеансе работы «продвинутого» сотрудника (редактирование документов, браузер, электронные таблицы) в Thinwire заметно ниже, чем при полнокадровом кодировании H.264 без применения vGPU в Omnissa Blast. 

Читать далее

Как Claude Code помог мне сделать звук на мансарде приятным

Habr.com - Mon, 09/28/2026 - 15:34

Всем привет. Меня зовут Антон Будон и в целом я занимаюсь маркетингом и обычно использую Claude Code для анализа трафика, настройки рекламных кампаний, SEO и создания лендингов. Дома же подвязал Клода напрямую к телеграму (наверное таких статей уже много) и общаюсь с ним напрямую как с помощником‑напарником по личным делам.

Я не являюсь профессиональным аудиофилом, и не ставлю себя в этой статье как эксперт по звуку либо звучанию, но у меня получилось что‑то что реально изменило восприятие звука и наконец‑то я понял зачем же по‑настоящему нужен эквалайзер.

Дорога к этому была не целенаправленная, а просто личностный интерес. Две недели назад я купил усилитель Technics su‑v505 и колонки Kenwood ls-90, годов 80х. Захотелось наконец‑то заново послушать красивый «старый звук» после всяких Алис и JBL, ну и лет 10 тому назад у меня всё‑таки был длительное время усилитель Marantz и колонки Sonus Faber Concertino, которые мне доставляли огромное удовольствие. Потом полоса жизни, переездов, семья, дети и все всегда уходило на задний план и в этот момент я решил что надо вернуться к прослушиванию музыки на чем‑то более качественном (я бы сказал ностальгическом).

Что имеем. Колонки Kenwood LS-90 1980 года: три полосы, фазоинвертор с портом спереди, 40–20 000 Гц, 8 Ом, чувствительность 91 дБ. Усилитель Technics SU‑V505 1983 года: 60 Вт на 8 Ом, Class A. Всё вместе обошлось примерно в 40 000 ₽ на вторичке.

Читать далее

На чём советские гики учились программировать? Часть 7 (Spectrum Edition)

Habr.com - Mon, 09/28/2026 - 15:28

Не «Микрошей» единым насыщалась страсть к играм и программированию среди советских технарей. И в самом конце 80-х, когда наступал неотвратимый закат наших родных ПЭВМ, на сцену вышел он: британский компьютер-легенда.

Читать далее

[Перевод] Дискретная диффузия: цепи Маркова с непрерывным временем

Habr.com - Mon, 09/28/2026 - 15:27

Этот материал, задуманный как первый в серии статей о дискретных диффузионных моделях, уже несколько месяцев лежал у меня в черновиках. Выход модели Gemini Diffusion от Google показался мне отличным поводом наконец его опубликовать.

Цепи Маркова с дискретным временем — это последовательности случайных величин, в которых прошлое и будущее условно независимы при известном настоящем. Они достаточно хорошо известны в машинном обучении. А вот непрерывные аналоги этих цепей встречаются гораздо реже. Подобные модели фигурируют в исследованиях по дискретным диффузионным моделям (вот, вот и вот — далеко не полный список публикаций на эту тему). Поэтому мне показалось, что можно вернуться к блогу и написать о цепях Маркова с непрерывным временем, а может быть, и подготовить целый цикл публикаций. Пока же цель этого материала — сформировать у читателя интуитивное понимание того, как работают марковские цепи с непрерывным временем.

Читать далее

Клетка 26. Космос и жизнь

Habr.com - Mon, 09/28/2026 - 15:27

Однажды известного физика спросили: что по-вашему мнению является самым удивительным фактом в мироздании? Его ответ. То, что сияющие и сгорающие, взрывающиеся звезды, туманности, планеты и всё, всё остальное, не исключая и нас самих, создано из одного и того же материала, по одним и тем же фундаментальным законам. Я бы добавил к этому, что мы, являясь формой живой материи, думаем о ней, о том, как в ней все устроено и о многом чем-то еще. Не исключая при этом устройства и самого Homo sapiens (человека разумного). Не исключено, что где-то из таких же материалов возникла иная подобная нашей или непохожая на нашу форма жизни.

Читать далее

Гореть и не выгореть: психиатр о выгорании в IT

Habr.com - Mon, 09/28/2026 - 15:21

Дергается ли у вас глаз от уведомлений в рабочих чатах? Код-ревью ощущается как дополнительная нагрузка на уже перегретую систему? Продукт больше не вызывает интереса, а любая новая задача воспринимается с раздражением и желанием «послать ее на небо за звездочкой»?

Ко мне, как к психиатру-психотерапевту, часто обращаются люди из IT-сферы. Связано ли это с их профессией или просто совпадение?

Решила разобраться, что говорят исследования о выгорании в IT-сфере. Как стремительное внедрение AI-технологий в рабочие процессы усугубляет выгорание у разработчиков? Почему отпуск может только усилить выгорание?

Вопрос со звездочкой: «Устал или выгорел?»

Если вы чувствуете обычную усталость после релиза продукта, ночной смены или серии тяжелых встреч, то это не значит, что вы именно выгорели. Если после восстановления и непродолжительного отдыха и хорошего сна вы смогли вернуться к нормальной работоспособности, то это указывает на то, что это была банальная человеческая усталость.

А если вам уже не помогает ни хороший сон по расписанию, занятия любимым хобби и даже отпуск, а перегрузка на работе становится чем-то обыденным, то «добро пожаловать» на стадию выгорания. Сжатые сроки работы, неопределённость, срочные переключения с одной задачи на другую, бесконечные уведомления и отсутствие нормального восстановления постепенно меняют не только продуктивность, но и отношение к работе.

Читать далее

DNS как выход из закрытого контура: что показал инцидент с агентом OpenAI

Habr.com - Mon, 09/28/2026 - 15:14

20 сентября 2026 года внутренняя модель OpenAI в среде без доступа к живому интернету обратилась к внешнему чат-боту через резолвер своей песочницы. P0-алерт появился через 12 минут, run остановили через 2,5 часа. Разбираем, почему DNS раз за разом остаётся незакрытым каналом в изолированных средах и что проверить в своём закрытом контуре.

Читать далее

Flow Matching: обучение и дистилляция

Habr.com - Mon, 09/28/2026 - 15:08

Flow Matching — один из главных подходов к генерации изображений. Его используют, например, Stable Diffusion 3.5 и FLUX.2.

Но есть нюанс: чтобы сгенерировать одну картинку, модель приходится запускать десятки, а иногда и сотни раз.

В новой статье разбираемся, как устроен Flow Matching и как дистиллировать обученную модель в быстрый одношаговый генератор

Who's online

There are currently 0 users and 20 guests online.
Syndicate content