Мониторим ИТ
Open in Telegram
Канал о наблюдаемости (Observability): логи, трейсы, метрики. Реклама: @gals_ad_bot Вопросы: @antoniusfirst @usr_bin_linux — Linux @zabbix_ru — Zabbix @elasticstack_ru — ElasticSearch/OpenSearch
Show more8 524
Subscribers
No data24 hours
+37 days
+5130 days
Data loading in progress...
Similar Channels
Tags Cloud
Incoming and Outgoing Mentions
---
---
---
---
---
---
Attracting Subscribers
August '26
August '26
+108
in 1 channels
July '26
+105
in 1 channels
Get PRO
June '26
+159
in 2 channels
Get PRO
May '26
+206
in 3 channels
Get PRO
April '26
+105
in 1 channels
Get PRO
March '26
+175
in 8 channels
Get PRO
February '26
+99
in 0 channels
Get PRO
January '26
+96
in 2 channels
Get PRO
December '25
+254
in 2 channels
Get PRO
November '25
+107
in 1 channels
Get PRO
October '25
+124
in 3 channels
Get PRO
September '25
+138
in 3 channels
Get PRO
August '25
+173
in 4 channels
Get PRO
July '25
+129
in 2 channels
Get PRO
June '25
+86
in 1 channels
Get PRO
May '25
+132
in 3 channels
Get PRO
April '25
+134
in 4 channels
Get PRO
March '25
+198
in 2 channels
Get PRO
February '25
+205
in 3 channels
Get PRO
January '25
+201
in 10 channels
Get PRO
December '24
+202
in 5 channels
Get PRO
November '24
+159
in 1 channels
Get PRO
October '24
+145
in 2 channels
Get PRO
September '24
+112
in 2 channels
Get PRO
August '24
+123
in 1 channels
Get PRO
July '24
+89
in 1 channels
Get PRO
June '24
+93
in 4 channels
Get PRO
May '24
+90
in 1 channels
Get PRO
April '24
+127
in 1 channels
Get PRO
March '24
+105
in 2 channels
Get PRO
February '24
+177
in 1 channels
Get PRO
January '24
+240
in 2 channels
Get PRO
December '23
+165
in 1 channels
Get PRO
November '23
+64
in 1 channels
Get PRO
October '23
+73
in 3 channels
Get PRO
September '23
+67
in 0 channels
Get PRO
August '23
+91
in 0 channels
Get PRO
July '23
+429
in 0 channels
Get PRO
June '23
+78
in 0 channels
Get PRO
May '23
+160
in 0 channels
Get PRO
April '23
+92
in 0 channels
Get PRO
March '23
+153
in 0 channels
Get PRO
February '23
+58
in 0 channels
Get PRO
January '23
+47
in 0 channels
Get PRO
December '22
+49
in 0 channels
Get PRO
November '22
+47
in 0 channels
Get PRO
October '22
+71
in 0 channels
Get PRO
September '22
+68
in 0 channels
Get PRO
August '22
+1 511
in 0 channels
Get PRO
July '22
+692
in 0 channels
Get PRO
June '22
+53
in 0 channels
Get PRO
May '22
+31
in 0 channels
Get PRO
April '22
+57
in 0 channels
Get PRO
March '22
+21
in 0 channels
Get PRO
February '22
+42
in 0 channels
Get PRO
January '22
+344
in 0 channels
Get PRO
December '21
+75
in 0 channels
Get PRO
November '21
+755
in 0 channels
Get PRO
October '21
+36
in 0 channels
Get PRO
September '21
+49
in 0 channels
Get PRO
August '21
+32
in 0 channels
Get PRO
July '21
+33
in 0 channels
Get PRO
June '21
+27
in 0 channels
Get PRO
May '21
+15
in 0 channels
Get PRO
April '21
+53
in 0 channels
Get PRO
March '21
+290
in 0 channels
Get PRO
February '21
+51
in 0 channels
Get PRO
January '21
+36
in 0 channels
Get PRO
December '20
+2 406
in 0 channels
| Date | Subscriber Growth | Mentions | Channels | |
| 26 August | +3 | |||
| 25 August | +3 | |||
| 24 August | +4 | |||
| 23 August | +7 | |||
| 22 August | 0 | |||
| 21 August | +8 | |||
| 20 August | +4 | |||
| 19 August | +2 | |||
| 18 August | +3 | |||
| 17 August | +2 | |||
| 16 August | +3 | |||
| 15 August | +3 | |||
| 14 August | +8 | |||
| 13 August | +2 | |||
| 12 August | +4 | |||
| 11 August | +2 | |||
| 10 August | +3 | |||
| 09 August | +2 | |||
| 08 August | +2 | |||
| 07 August | +3 | |||
| 06 August | +14 | |||
| 05 August | +2 | |||
| 04 August | +8 | |||
| 03 August | +9 | |||
| 02 August | +4 | |||
| 01 August | +3 |
Channel Posts
neko-master
Инструмент для анализа и визуализации трафика в локальных сетях. Собирает данные в реальном времени через WebSocket с задержкой в миллисекунды.
Репыч на Гитхаб
📱 Telegram | 📲 MAX
| 2 | logchef
Logchef — это легковесная платформа для анализа и мониторинга логов из ClickHouse, VictoriaLogs или обоих сервисов одновременно. Logchef предоставляет единое окружение для исследования, создания дашбордов, сохранения запросов, оповещений и контроля доступа — без перемещения или изменения структуры данных.
Страница проекта
Публичное онлайн-демо
Репыч на Гитхаб
📱 Telegram | 📲 MAX | 1 523 |
| 3 | Разыгрывается 10 ваучеров со скидкой 50% на абсолютно весь каталог от The Linux Foundation и 10 комплектов видеокурсов по Kubernetes со скидкой 50% от Slurm.
⚪ Каталог курсов и сертификации
Ваучеры можно применить к любому:
— онлайн-курсу
— сертификационному экзамену (CKA, CKS, CKAD и другие)
— пакету продуктов (курс + сертификация)
— курс под руководством инструктора с гарантированным стартом
⚪ Запись на поток Kubernetes: Продвинутый уровень от Slurm.
Условия розыгрыша:
✅ Подпишитесь на KazDevOps и нажмите кнопку "Учавствую!" под оригинальным постом в канале KazDevOps.
❗ 1 сентября подведут итоги и выберут 10 победителей (каждый получит скидку на предложения Linux Foundation + скидку на курс Slurm). Активировать ваучеры Linux Foundation нужно до 07.01.2027. После этого у вас будет 1 год и 2 попытки, чтобы завершить обучение и сдать экзамен.
Go-go-go, и успехов!
@DevOpsKaz 😛 | 1 603 |
| 4 | Вышла Grafana 13.2
Одна из самых интересных новинок — Saved Queries. Теперь запросы PromQL или SQL можно сохранять в общей библиотеке, искать, переиспользовать в Explore и дашбордах и управлять ими через Terraform.
Также появился View panel sidebar, который позволяет выявлять перегруженные временными рядами дашборды, менять представления и делать fanout даже без прав на редактирование дашборда.
А ещё Grafana продолжает двигаться в сторону Observability as Code: Git Sync теперь поддерживает GitHub Enterprise, вебхуки для GitLab и Bitbucket, а Saved Queries можно хранить и разворачивать как код.
Подробнее в блоге Grafana
📱 Telegram | 📲 MAX | 1 828 |
| 5 | ➡ Приходите на ближайшие тренинги по Zabbix, которые я проведу (ближайший — уже через пару недель):
📅 7-11 сентября Zabbix сертифицированный специалист
📅 28-30 октября Zabbix сертифицированный профессионал
Это официальные тренинги Zabbix с возможностью получения вендорского сертификата после обучения. А еще мерча: футболки и термокружки, чтобы уверенно попивать чай у себя в квартале 😎
На занятиях будет много практики, разбор типовых ошибок, архитектурных решений и вопросов, с которыми я регулярно сталкиваюсь на проектах. Можно будет подробно обсудить свои кейсы, задать вопросы по вашей инфраструктуре и лучше понять не только что нажать, но и почему Zabbix работает именно так.
Еще один плюс официального обучения — после тренинга вы получаете системные знания по программе вендора и сможете сдать сертификационный экзамен Zabbix. Это хороший способ не только прокачать навыки, но и подтвердить свою квалификацию, чтобы позже вписать это достижение в резюме.
Certified Specialist подойдет тем, кто хочет уверенно освоить базовое и среднее администрирование Zabbix: настройку мониторинга, шаблонов, триггеров, обнаружения, уведомлений и основных механизмов системы. Рекомендую этот курс самоучкам, вы закроете пробелы в знаниях.
Certified Professional — следующий уровень: более глубокая работа с архитектурой, производительностью, автоматизацией и возможностями Zabbix для крупных и сложных инфраструктур.
Я стараюсь вести тренинги максимально живо: без сухой теории ради теории, с большим количеством практических примеров и обсуждений. Поэтому если вы давно хотели разобраться в Zabbix глубже, систематизировать уже имеющийся опыт или подготовиться к сертификации — буду рад видеть вас на занятиях.
Количество мест в группах ограничено, поэтому лучше зарегистрироваться заранее.
Приходите — будет много Zabbix, практики и ответов на ваши вопросы.
Запрос на участие вы можете оставить через форму обратной связи на странице курса, отправить на почту hello@gals.software или обратиться к менеджеру в ТГ @gals_software. | 1 685 |
| 6 | How to visualize workflows and business processes in Grafana: Introducing the Graphviz panel
Grafana постепенно превращается в инструмент, где можно показать как система или бизнес-процесс устроены целиком.
Виджет Graphviz позволяет описывать карты сервисов, payment flow, CI/CD-пайплайны, сетевые карты и ранбуки через DOT-синтаксис — без ручного перетаскивания десятков блоков.
А главное, цвета узлов, подписи и связи можно привязать к живым метрикам и запросам. Схема может строиться прямо из данных: в помощь Service registry, Terraform state или Kubernetes-топология.
Старый вопрос «а можно в Grafana сделать нормальную карту сервисов?» наконец получает ответ.
Статья в блоге Grafana
Плагин Graphviz
📱 Telegram | 📲 MAX | 2 008 |
| 7 | Observability на стероидах
Владимир Гордийчук, CTO Yandex Monium, в подкасте linkmeup рассказал о том, как появился Monium, как устроен внутри, что они для себя оптимизировали и почему Prometheus не справился.
Понимаю, что слушать почти 2 часа запись это же сколько нужно свободного времени, поэтому я совместил прослушивание с силовой тренировкой и мне очень даже зашло.
Ниже некоторые из ключевых тезисов подкаста (тут отдельная благодарность нейросказу, встроенному в Яндекс Браузер):
⚡️ Monium появился как система мониторинга для команды YDB (Yandex Database). Поэтому неудивительно, что в качестве бэкэнда хранения используется именно эта БД. Еще там есть собственная TSDB и даже ClickHouse.
⚡️ Предпосылкой к созданию система стала невозможность использования существующих решений. Яндексу нужно было собирать высококардинальные метрики.
⚡️ Внутри Яндекс в Мониум передается 3 миллиарда сэмплов в секунду и около 60 гигабайт логов в секунду.
⚡️ Мониум может использоваться независимо от Яндекс.Облака.
⚡️ Философия Мониума основана на принципе real-time мониторинга, т.е. данные попадают в систему через считанные секунды.
⚡️ Яндекс разработал свой бинарный протокол для обмена данными SPAC, что снизило накладные расходы на передачу данных.
⚡️ Протокол Protobuf требует много ресурсов для парсинга на больших объёмах данных.
⚡️ JSON неэффективен при передаче данных между системами, но удобен при взамодействии с ним человека.
⚡️ Monium имеет встроенный функционал агрегации алертов.
⚡️ В Monium есть встроенный функционал расчета SLO.
⚡️ В Monium есть встроенный функционал поиска аномалий.
📱 Telegram | 📲 MAX | 2 297 |
| 8 | Incident Relay
Incident Relay закрывает базовый incident workflow: маршрутизация алертов, дежурства и ротации, ACK/Resolve, напоминания, эскалации, silences и maintenance windows.
Из коробки есть интеграции с Zabbix, Grafana, Alertmanager, Datadog, Sentry и другими источниками, а уведомления можно отправлять в Telegram, Slack, Mattermost, Teams, email, webhook и даже голосовыми звонками.
Плюс всё можно держать у себя — Docker, Kubernetes/Helm или обычный systemd/RPM. В общем, практичный вариант для команд, которым нужен on-call без SaaS и с полным контролем над маршрутизацией алертов.
Я на это решение пока не смотрел, но выглядит интересно.
Репыч на Гитхаб
Статья на Хабре
📱 Telegram | 📲 MAX | 2 302 |
| 9 | Что за зверь такой Exponential Histogram
Во вчерашнем посте про обновления в ClickStack я в том числе упомянул exponential histograms. Это интересная штука, которая может быть весьма полезна для автоматизации мониторинга. А вдруг вы про неё не знаете 🙃 Или знаете, но в качестве Prometheus Native Histogram.
Exponential histogram — это тип гистограммы в OpenTelemetry, где границы бакетов задаются не вручную, а вычисляются по экспоненциальной шкале. Она нужна для метрик с большим динамическим диапазоном, например, latency, где значения могут быть и 1 мс, и 10 секунд. Главное преимущество такого подхода — не нужно заранее угадывать диапазоны значений.
Границы диапазонов при режиме explicit histogram могут задаваться в коде приложения или на уровне OpenTelemetry SDK. Если специально не определить в настройках exponential histogram, то применится explicit histogram с интервалами по умолчанию. А вот примеры использования exponential histogram.
Под капотом это работает так
В exponential histogram бакеты строятся автоматически по экспоненте. OpenTelemetry определяет base (коэффициент роста границ соседних бакетов) через параметр scale (разрешение гистограммы):
base = 2^(2^(-scale))
Чем выше scale, тем больше бакетов и тем выше точность. Например, при scale=3 между соседними степенями двойки будет 8 бакетов. Для примера посмотрите на приложенное изображение, а также на схему ниже:
scale = 3
|--|--|--|--|--|--|--|--|
scale = 2
|----|----|----|----|
scale = 1
|--------|--------|
При использовании explicit histogram возникает вопрос: какие buckets выбрать? Если сделать их слишком широкими — потеряется точность. Если слишком много — увеличится объём данных.
Exponential histogram автоматически распределяет значения по шкале и позволяет одновременно хорошо описывать очень маленькие и очень большие значения. А еще гистограмму можно понижать в разрешении без пересчёта исходных измерений. У exponential histogram разные scale согласованы между собой: бакеты более высокой детализации можно объединить в более грубые. Это удобно для агрегации телеметрии в OTEL-коллекторе или бэкэнде.
А вы используете у себя exponential histogram?
📱 Telegram | 📲 MAX | 1 981 |
| 10 | Whats new in ClickStack - June + July
Не знаю, заметили вы или нет, но команда ClickStack настолько увлеклась допиливанием новых фичей, что забыла выпустить статью с пакетом обновлений июня. И вот теперь вышла публикация с обновлениями сразу за 2 месяца.
ClickStack продолжает превращаться из ClickHouse для логов в полноценную observability-платформу. Они прокачали трейсы, добавили экспериментальную интеграцию с внешним Prometheus (вслед за OpenSearch и ElasticSearch), добавили поддержку экспоненциальных гистограмм, сделали алерты более умными, появился новый функционал дашбордостроения и расширили MCP Server.
А еще команда ClickStack добавила ресивер для Datadog-агента, тем самым намекнув, что решение от Datadog можно не выкидывать сразу, а подключать к ClickStack и мигрировать постепенно. Кажется, это первая ласточка: следом они наверняка добавят ресивер для OneAgent от Dynatrace (и аналогов), предлагая более простые способы миграции на открытые платформы. Война за доминирование на observability-поляне становится всё интереснее.
Читать статью в блоге ClickHouse
📱 Telegram | 📲 MAX | 1 789 |
| 11 | Почему 99% AI-агентов не доживают до продакшена?
Вы тратите недели на разработку «умного» агента, а в итоге — счёт за сожжённые токены и грустный архив в GDrive. Знакомо?
В новой статье экспертразбирает 5 главных причин:
🔹Недетерминированность
🔹Безграничная автономность
🔹Передача контекста — самая больная тема 2026 года.
🔹Тестирование — мокировать нейронку бесполезно, а семантические матчеры никто не настраивает.
🔹Мониторинг — как понять, что агент «ведёт себя разумно»? (Подсказка: KPI для людей тут работают лучше нейросетей).
В статье —живые примеры, фрагменты кода (Ruby, семантическое сравнение), чёткий роадмап внедрения👇
ЗАБРАТЬ СТАТЬЮ В БОТЕ | 1 100 |
| 12 | PromQL Anomaly Detection Framework
Фреймворк строит верхние и нижние границы для метрик, учитывает краткосрочную изменчивость и сезонность, а затем алертит, когда значение выходит за ожидаемый диапазон. Есть несколько стратегий детектирования: от адаптивной на основе среднего и стандартного отклонения до более устойчивой к выбросам через median/MAD.
Поддерживаются типовые сценарии для request rate, latency, errors и resource-метрик, а сами anomaly bands можно накладывать поверх графиков в Grafana.
Хороший вариант, когда хочется добавить динамический anomaly detection поверх обычного Prometheus, не таща отдельную систему анализа временных рядов.
Репыч на Гитхаб
📱 Telegram | 📲 MAX | 1 754 |
| 13 | В Беларуси внедрили онлайн-полигон для расследования кибератак
Облачный провайдер beCloud уже несколько лет развивает собственный SOC с выстроенными процессами мониторинга и реагирования. Теперь команда будет регулярно тренироваться на сценариях сложных атак в Standoff Defend Pro компании Positive Technologies.
В программе — 12 сценариев APT-атак, основанных на тактиках и техниках реальных группировок, сценарии по мотивам кибербитв Standoff и более 100 практических кейсов: от отдельных этапов до полных цепочек атак.
Плюс менторство экспертов Positive Technologies и регулярные разборы результатов.
Для зрелой команды это уже не про то, как пользоваться средствами защиты. Важнее другое: как аналитики действуют, когда привычного сценария нет, насколько быстро проверяют гипотезы, связывают события между собой и обмениваются результатами.
Именно это beCloud будет отрабатывать на полигоне до конца года. | 1 257 |
| 14 | Как мониторить Java-приложения: метрики, алерты и правило 80/20
Хороший мониторинг помогает быстро понять, что происходит с приложением и куда смотреть в первую очередь. Для этого не нужно пытаться измерить всё: базовый набор технических метрик покрывает большинство типовых проблем, а бизнес-метрики, SLO и анализ аномалий помогают заранее замечать нетипичные отклонения. В Календаре мы называем этот подход правилом 80/20.
Всем привет! Меня зовут Настя, я бэкенд-разработчик в Яндекс 360 и отвечаю за надёжность Календаря. В этой статье я покажу, какие метрики стоит взять за основу, как выбирать полезные алерты и чем дополнять базовый набор для оставшихся 20%.
В статье хороший разбор подхода 80/20: какие метрики реально ловят большую часть проблем, зачем следить за RED, лагами очередей, connection pool и JVM, когда нужны бизнес-метрики и SLO, и почему аномалии иногда полезнее очередного статического порога.
Отдельно плюсую за onepager, drill-down и ранбуки. Потому что хороший мониторинг — это не «у нас есть график на всё», а «мы быстро поняли, что сломалось и что делать дальше».
📱 Telegram | 📲 MAX | 1 876 |
| 15 | Mastering Log Rotation in Linux with Logrotate
Logrotate — тот самый компонент, про который обычно вспоминают в двух случаях:
👉 когда закончилось место на диске;
👉 когда после ротации внезапно выяснилось, что приложение продолжало писать не туда
Статья разбирает, что происходит под капотом утилиты: когда использовать size, чем minsize отличается от maxsize, почему create обычно безопаснее и за что можно не любить copytruncate — у него есть небольшое окно, в котором часть логов действительно может потеряться.
Читать в блоге Dash0
📱 Telegram | 📲 MAX | 2 209 |
| 16 | Знакомая конфигурация: Zabbix + Prometheus + Grafana + пачка скриптов, всё это держится на одном инженере, а при инциденте картина сшивается руками из трёх систем. Работает — пока этот инженер не ушёл в отпуск. Или просто не ушёл.
Мы сделали Voltir — managed-платформу мониторинга для среднего бизнеса (50–500 сотрудников):
⚡️ Метрики, логи и трейсы в одной платформе — стек VictoriaMetrics cluster / VictoriaLogs / VictoriaTraces, честная изоляция тенантов
⚡️ Настройку, алертинг и сопровождение берём на себя — включая разбор ложных срабатываний. Вашей платформенной команды не требуется, потому что ею работаем мы
⚡️ Мониторинг 1С из коробки: APDEX, техжурнал, метрики кластера — реальный экспортёр в агенте, а не строчка в буклете
⚡️ Агент ставится за день: Linux, Windows, SNMP, докер-контейнеры
Платформу строит инженер, а не отдел продаж — в канале показываем кухню изнутри: архитектуру, грабли прода, инциденты и что они поменяли в продукте.
👉 Канал: t.me/Voltir_tech · Сайт и демо: voltir.tech
Реклама. Водинский Иван Юрьевич, ИНН 400331598671, erid: 2VtzqvjyPZD | 1 497 |
| 17 | Metric cardinality limits in OpenTelemetry: a practical guide
Метрики OpenTelemetry разработаны таким образом, чтобы их было безопасно использовать в проде. Одним из элементов этой безопасности является ограничение кардинальности в SDK метрик. Это ограничение защищает от неограниченного роста объема памяти, когда метрика получает слишком много уникальных комбинаций атрибутов.
Такая защита полезна, но у неё есть последствие, которого многие пользователи не ожидают: при переполнении потока метрик общее значение остаётся корректным, в то время как запросы, фильтрующие или группирующие данные по атрибутам, могут занижать его. Это может повлиять на панели мониторинга, цели уровня обслуживания (SLO) и оповещения, которые выглядели корректно до начала переполнения.
В документации теперь есть раздел Ограничения кардинальности, который объясняет поведение SDK.
Эта статья в блоге OpenTelemetry — оперативное дополнение к этой части документации. В ней объясняется, что означает ограничение на практике, почему это влияет на каждый атрибут измерения, в котором произошло переполнение, как выбрать разумное ограничение, как проверить, достигнуто ли оно уже, и как отслеживать его в проде.
📱 Telegram | 📲 MAX | 2 166 |
| 18 | VictoriaLogs Deployment: Single Node vs Cluster Mode — A Comprehensive Guide
В статье разбираются оба варианта: single-node и cluster mode, с практическими примерами установки, настройкой Filebeat, подключением Grafana и базовым алертингом.
Ключевая мысль простая: single-node хорошо подходит для небольших и средних нагрузок, а кластер имеет смысл разворачивать, когда появляются требования к горизонтальному масштабированию, высокой доступности и устойчивости при больших объёмах логов.
Автор показывает архитектуру кластера VictoriaLogs: vlinsert принимает данные, vlstorage отвечает за хранение, а vlselect — за запросы. Также есть понятный сценарий миграции с одной ноды на кластер без полной перестройки ingestion-пайплайна.
Хороший материал для тех, кто присматривается к VictoriaLogs и хочет понять не только как установить, ноВ статье разбираются оба варианта: single-node и cluster mode, с практическими примерами установки, настройкой Filebeat, подключением Grafana и базовым алертингом.
Ключевая мысль простая: single-node хорошо подходит для небольших и средних нагрузок, где важны простота и экономия ресурсов. Кластер имеет смысл, когда появляются требования к горизонтальному масштабированию, высокой доступности и устойчивости при больших объёмах логов.
Отдельно полезно, что автор показывает саму архитектуру кластера VictoriaLogs: vlinsert принимает данные, vlstorage отвечает за хранение, а vlselect — за запросы. Плюс есть понятный сценарий миграции с одной ноды на кластер без полной перестройки ingestion-пайплайна.
Читать статью на medium.com
📱 Telegram | 📲 MAX | 2 114 |
| 19 | Участвуй в МТС True Tech Champ 2026 — всероссийском чемпионате по программированию с двумя треками и призовым фондом 10 250 000 рублей.
Трек 1: Алгоритмический [индивидуальный зачет, 2 750 000 ₽, шесть призовых мест]
Решай задачи по алгоритмам и структурам данных, которые помогут прокачать навыки для технических собеседований и работы в ведущих ИТ-командах. Лучшие участники пройдут в финал, где в режиме реального времени будут соревноваться в правильности решений и скорости мышления.
Трек 2: Программирование роботов [командный формат, 7 500 000 ₽, три призовых места]
Напиши алгоритмы для робособаки и робота-манипулятора и проведи их через три этапа соревнований. Сначала — через цифровой симулятор, где нужно пройти трассу и выполнить задания по передаче предметов. Затем — подключись к реальному полигону через удалённый доступ и выполни задания на физических роботах дистанционно. А в очном финале лучшим командам предстоит управлять роботами на площадке, дорабатывать алгоритмы под новые условия и бороться за победу на глазах у зрителей. Рекомендуемые стеки: Go, Java, Python, C#, C++, JS.
Регистрируйся до 13 сентября и стань частью масштабного чемпионата. | 1 023 |
| 20 | Choosing Between ClickStack and Grafana for ClickHouse Observability
Кажется, в observability снова выбор без выбора: Grafana или ClickStack?
Статья разбирает вопрос выбора на примере ClickHouse. Если ClickHouse — центральное хранилище телеметрии, а инженеры чаще расследуют инциденты, чем смотрят на заранее созданные графики, авторы предлагают смотреть в сторону ClickStack: поиск, корреляция логов, метрик и трейсов, session replay и отдельный акцент на AI/SRE-агентов через MCP.
Grafana остаётся сильнее там, где инфраструктура неоднородная: Prometheus, ClickHouse и ещё десяток источников, которые нужно собрать на одном дашборде, добавить алертинг и не заставлять команду менять привычные процессы.
Так как статья опубликована в блоге Clickhouse, практичный вывод напрашивается сам собой: «А зачем выбирать?» Grafana можно оставить для дашбордов и мониторинга, а ClickStack использовать для глубоких расследований по данным ClickHouse. Причём данные и ingestion pipeline дублировать не придётся.
Как вам такой подход?
Ссылка на статью
📱 Telegram | 📲 MAX | 2 401 |
