Свой корпоративный мессенджер на FastAPI и React: зачем он нам понадобился, что в нём есть и что ломалось по дороге.
Читать далееВышли Claude Opus 5.5 и GPT-6 Sol, и все пошли смотреть прайсы шлюзов. Я собрал цены пяти шлюзов с оплатой из России и посчитал иначе: сколько стоит час работы в Claude Code, если нагрузка как у меня — по логам 49 моих сессий, 138 часов работы.
Разброс получился почти десятикратный: от 181 до 1 756 рублей за один и тот же час на одной модели. Половина счёта уходит на запись в кэш, хотя её всего 5% от входящих токенов. А самый дешёвый ценник в таблице даёт не самый дешёвый час: когда чтение кэша стоит столько же, сколько обычный ввод, час работы агента выходит почти вдвое дороже, чем у шлюза с дешёвым кэшем.
Читать далее«У меня игра на Flame, можно ли добавить в неё 3D?». Можно, и игру не придётся переписывать: корабль летает по трёхмерному двору со светом и тенями, а джойстик, HUD и вся игровая логика остаются на Flame. У двух движков одни часы, одна физика и один ввод, поэтому таран, который посчитала 3D-физика, приходит во Flame обычным onCollisionStart. Я разберу по шагам небольшую аркаду на flame_flutter3d, покажу рецепты, которые можно брать в свою игру, и неочевидные места, на которые наступил сам. В аркаду можно сыграть прямо в браузере.
Читать далееСейчас очень много обсуждают модель Jev от Typesafe, я решил выложить модель в своем CMF формате для личного использования (License:apache-2.0) которая давно работает на шлюзе
Как это работает? Например пользователь пишет, что карта так и не пришла. Приложению нужно выбрать card_arrival и передать обращение в нужный обработчик, или напиши функцию на go, принять решения нужно максимально быстро. Таких развилок много: выбрать инструмент агента, определить тему заявки, сложность, направить документ на проверку, определить сложность и тип задачи.
Для этих задач я опубликовал CMF Decision: модель, которая принимает решения по ошибке реконструкции. Энкодер, обученные навыки и правила уверенности лежат в одном .cmf‑файле. Новые навыки можно добавлять по своим примерам, а незнакомые случаи — передавать подключаемому оракулу‑модели которая выступает в роли учителя.
В Cortiq 0.8.0 один и тот же файл работает на CPU, Apple Metal и Vulkan. На RTX PRO 4000 Blackwell полный локальный путь занял 1,10–1,24 мс.
Ниже — как устроен этот механизм, что получилось в сравнении с Jev и Laya и как запустить модель или добавить свою задачу.
Читать далееАж до самого ногтя шабили сигареты Японцы после войны, потому что табак тогда ценился дороже риса. Это заметили братья Касио и придумали кольцо-сигаретник, которое надевалось на палец и удерживало сигу, позволяя скуривать все до победного конца не обжигаясь. Поэтому девайс разлетался как горячие чебуреки.
Читать далееКак менялась эксплуатация переполнений буфера в Windows за последние десятилетия?
Рассмотрим путь от классического Stack Smashing до современных механизмов защиты потока выполнения. На практике рассматриваются x86-техники переписывания EIP, NOP-sled, JMP ESP, эксплуатация SEH, переход к ROP как способу обхода DEP.
Практически продемонстрированы примеры создания и эксплуатации указанных уязвимостей.
Читать далее15 сентября мы выпустили БОЛТУН с Windows-клиентом на Tauri. К 28 сентября сервер учёл 134 млн входящих голосовых кадров, а среднее число разных клиентских ID в сутки выросло со 145 до 192 при сравнении одинаковых дней недели — примерно на 33%. Разбираем первые результаты: рост активности, голосовой трафик, демонстрации экрана и 854 часа суммарного прослушивания радио.
Читать далееВ бизнесе важна каждая минута. Но если документ сначала нужно передать на обработку, проверить его и только потом внести данные в учетную систему, между реальной операцией и ее отражением в системе возникает разрыв. Все это время собственник не видит актуальной картины и вынужден принимать решения на основе уже устаревшей информации. Поэтому распознавать документы нужно непосредственно там и тогда, где происходит операция.
Эту задачу решает периферийное распознавание, реализованное в Smart Document Engine. Платформа позволяет обрабатывать документы прямо в точке их появления — например, на складе или рабочем месте сотрудника — с помощью смартфона, планшета или другого устройства и сразу передавать готовые данные в корпоративные системы. В результате бизнес получает актуальную картину происходящего, а разрыв между реальной операцией и ее отражением в учете сокращается до минимума.
Собрали главное за Неделю Smart Document Engine в одном дайджесте
Привет, Хаброжители! Когда вы вводите промпт в большую языковую модель (LLM), машина преобразует ваш текст в числа, обрабатывает их, а потом возвращает ответ токен за токеном. В этой статье мы разберём, что такое инференс (логический вывод) в LLM и посмотрим, как он работает.
Читать далееВысокая загрузка GPU ещё не означает, что инфраструктуре не хватает ресурсов. В продакшене значительная часть времени может уходить на повторный расчёт одинаковых промптов, неэффективное распределение кэша или неверные параметры сервинга.
Разберём шесть шагов оптимизации инференса LLM на стеке vLLM и Kubernetes: от поиска узкого места и расчёта KV‑кэша до настройки prefix caching и проверки квантования.
Читать гайдВ обычном backend fallback обычно означает: тот же контракт, другой исполнитель. С LLM всё сложнее — резервная модель может вернуть валидный JSON, но изменить смысл результата. Разбираю, почему retry и fallback нужно разделять, как учитывать деградацию качества и когда честная ошибка лучше «успешного» ответа другой модели.
Читать далееБольшинство попыток заработать на открытом коде упираются в две крайности: сбор донатов, где за десятки тысяч звёзд на GitHub автор получает пару сотен долларов в месяц, или внезапная смена лицензии на BSL, которая оборачивается волной хейта и немедленными форками.
Проект Cap (открытый аналог Loom с 22 800 звёзд) нашёл третий путь. Их монорепозиторий на Rust, Tauri и Next.js выложен полностью, но проект успешно зарабатывает. Ниже — подробный разбор архитектуры проекта, того, как устроено разделение лицензий MIT и AGPLv3, и почему юридическая схема с платными бинарниками за $29/год работает даже без DRM.
Читать далееЧасть 2
Примечание переводчика
В первой части статьи о протоколах удаленного доступа разобраны архитектурные особенности Citrix HDX\EDT, Omnissa BlastExtreme, Microsoft и Parallels RDP. В этой части о технических, финансовых и "пользовательских" последствиях выбора того или иного VDI, а значит и протокола, а так же итоговая таблица "чемпионата" протоколов.
7. Перспектива FinOps: экономика кодеков и плотность пользователей VDI.
Архитектура протокола напрямую влияет на капитальные и операционные затраты. Конвейер кодеков определяет потребление ресурсов ЦП и GPU на хостах ВМ, что, в свою очередь, определяет плотность пользователей на одном физическом сервере — основной единице стоимости инфраструктуры VDI. В этом разделе анализ протокола связывается с экономикой серверов, необходимой для стратегии FinOps.
7.1 Экономическая эффективность Thinwire для CPU по сравнению с полнокадровым H.264
Архитектура Citrix Thinwire, использующая многокодековое кодирование в одном кадре, вычислительно сложнее на кадр, чем стандартное кодирование H.264. Классификатор содержимого экрана, детектор областей и распределение кодеков добавляют циклы ЦП, чего не делает простой полнокадровый кодировщик H.264. Вопрос архитектуры заключается в том, превышает ли эта дополнительная нагрузка экономию. Эмпирический ответ: нет. Стоимость классификатора существенно ниже, чем стоимость кодирования, сэкономленная за счет отказа от применения H.264 к статическим текстовым областям (которые Thinwire обрабатывает без потерь с минимальным битрейтом). Полнокадровое кодирование в H.264 видео качество для экрана, на 80% состоящего из статического текста и на 20% из видео — значительная трата циклов ЦП и полосы пропускания. Thinwire кодирует 20% видео-области в H.264, а 80% текстовой области без потерь, используя кодек MDRLE, с минимальными затратами ЦП. Потребление ресурсов ЦП при типичном сеансе работы «продвинутого» сотрудника (редактирование документов, браузер, электронные таблицы) в Thinwire заметно ниже, чем при полнокадровом кодировании H.264 без применения vGPU в Omnissa Blast.
Читать далееВсем привет. Меня зовут Антон Будон и в целом я занимаюсь маркетингом и обычно использую Claude Code для анализа трафика, настройки рекламных кампаний, SEO и создания лендингов. Дома же подвязал Клода напрямую к телеграму (наверное таких статей уже много) и общаюсь с ним напрямую как с помощником‑напарником по личным делам.
Я не являюсь профессиональным аудиофилом, и не ставлю себя в этой статье как эксперт по звуку либо звучанию, но у меня получилось что‑то что реально изменило восприятие звука и наконец‑то я понял зачем же по‑настоящему нужен эквалайзер.
Дорога к этому была не целенаправленная, а просто личностный интерес. Две недели назад я купил усилитель Technics su‑v505 и колонки Kenwood ls-90, годов 80х. Захотелось наконец‑то заново послушать красивый «старый звук» после всяких Алис и JBL, ну и лет 10 тому назад у меня всё‑таки был длительное время усилитель Marantz и колонки Sonus Faber Concertino, которые мне доставляли огромное удовольствие. Потом полоса жизни, переездов, семья, дети и все всегда уходило на задний план и в этот момент я решил что надо вернуться к прослушиванию музыки на чем‑то более качественном (я бы сказал ностальгическом).
Что имеем. Колонки Kenwood LS-90 1980 года: три полосы, фазоинвертор с портом спереди, 40–20 000 Гц, 8 Ом, чувствительность 91 дБ. Усилитель Technics SU‑V505 1983 года: 60 Вт на 8 Ом, Class A. Всё вместе обошлось примерно в 40 000 ₽ на вторичке.
Читать далееНе «Микрошей» единым насыщалась страсть к играм и программированию среди советских технарей. И в самом конце 80-х, когда наступал неотвратимый закат наших родных ПЭВМ, на сцену вышел он: британский компьютер-легенда.
Читать далееЭтот материал, задуманный как первый в серии статей о дискретных диффузионных моделях, уже несколько месяцев лежал у меня в черновиках. Выход модели Gemini Diffusion от Google показался мне отличным поводом наконец его опубликовать.
Цепи Маркова с дискретным временем — это последовательности случайных величин, в которых прошлое и будущее условно независимы при известном настоящем. Они достаточно хорошо известны в машинном обучении. А вот непрерывные аналоги этих цепей встречаются гораздо реже. Подобные модели фигурируют в исследованиях по дискретным диффузионным моделям (вот, вот и вот — далеко не полный список публикаций на эту тему). Поэтому мне показалось, что можно вернуться к блогу и написать о цепях Маркова с непрерывным временем, а может быть, и подготовить целый цикл публикаций. Пока же цель этого материала — сформировать у читателя интуитивное понимание того, как работают марковские цепи с непрерывным временем.
Читать далееОднажды известного физика спросили: что по-вашему мнению является самым удивительным фактом в мироздании? Его ответ. То, что сияющие и сгорающие, взрывающиеся звезды, туманности, планеты и всё, всё остальное, не исключая и нас самих, создано из одного и того же материала, по одним и тем же фундаментальным законам. Я бы добавил к этому, что мы, являясь формой живой материи, думаем о ней, о том, как в ней все устроено и о многом чем-то еще. Не исключая при этом устройства и самого Homo sapiens (человека разумного). Не исключено, что где-то из таких же материалов возникла иная подобная нашей или непохожая на нашу форма жизни.
Дергается ли у вас глаз от уведомлений в рабочих чатах? Код-ревью ощущается как дополнительная нагрузка на уже перегретую систему? Продукт больше не вызывает интереса, а любая новая задача воспринимается с раздражением и желанием «послать ее на небо за звездочкой»?
Ко мне, как к психиатру-психотерапевту, часто обращаются люди из IT-сферы. Связано ли это с их профессией или просто совпадение?
Решила разобраться, что говорят исследования о выгорании в IT-сфере. Как стремительное внедрение AI-технологий в рабочие процессы усугубляет выгорание у разработчиков? Почему отпуск может только усилить выгорание?
Вопрос со звездочкой: «Устал или выгорел?»
Если вы чувствуете обычную усталость после релиза продукта, ночной смены или серии тяжелых встреч, то это не значит, что вы именно выгорели. Если после восстановления и непродолжительного отдыха и хорошего сна вы смогли вернуться к нормальной работоспособности, то это указывает на то, что это была банальная человеческая усталость.
А если вам уже не помогает ни хороший сон по расписанию, занятия любимым хобби и даже отпуск, а перегрузка на работе становится чем-то обыденным, то «добро пожаловать» на стадию выгорания. Сжатые сроки работы, неопределённость, срочные переключения с одной задачи на другую, бесконечные уведомления и отсутствие нормального восстановления постепенно меняют не только продуктивность, но и отношение к работе.
Читать далее20 сентября 2026 года внутренняя модель OpenAI в среде без доступа к живому интернету обратилась к внешнему чат-боту через резолвер своей песочницы. P0-алерт появился через 12 минут, run остановили через 2,5 часа. Разбираем, почему DNS раз за разом остаётся незакрытым каналом в изолированных средах и что проверить в своём закрытом контуре.
Читать далееFlow Matching — один из главных подходов к генерации изображений. Его используют, например, Stable Diffusion 3.5 и FLUX.2.
Но есть нюанс: чтобы сгенерировать одну картинку, модель приходится запускать десятки, а иногда и сотни раз.
В новой статье разбираемся, как устроен Flow Matching и как дистиллировать обученную модель в быстрый одношаговый генератор