Дата канальи
الذهاب إلى القناة على Telegram
Данные / ML / AI / аналитика в корпорациях. Для связи @NikitaZelinskiy
إظهار المزيد6 268
المشتركون
+524 ساعات
+667 أيام
+11130 أيام
جاري تحميل البيانات...
القنوات المماثلة
لا توجد بيانات
هل تواجه مشاكل؟ يرجى تحديث الصفحة أو الاتصال بمدير الدعم الخاص بنا.
سحابة العلامات
الإشارات الواردة والصادرة
---
---
---
---
---
---
جذب المشتركين
سبتمبر '26سبتمبر '26
سبتمبر '26
+132
في 3 قنوات
أغسطس '26
+145
في 7 قنوات
Get PRO
يوليو '26
+117
في 5 قنوات
Get PRO
يونيو '26
+218
في 6 قنوات
Get PRO
مايو '26
+108
في 3 قنوات
Get PRO
أبريل '26
+60
في 3 قنوات
Get PRO
مارس '26
+96
في 1 قنوات
Get PRO
فبراير '26
+268
في 7 قنوات
Get PRO
يناير '26
+163
في 5 قنوات
Get PRO
ديسمبر '25
+1 056
في 7 قنوات
Get PRO
نوفمبر '25
+735
في 11 قنوات
Get PRO
أكتوبر '25
+170
في 6 قنوات
Get PRO
سبتمبر '25
+240
في 61 قنوات
Get PRO
أغسطس '25
+215
في 6 قنوات
Get PRO
يوليو '25
+1 412
في 30 قنوات
Get PRO
يونيو '25
+351
في 58 قنوات
Get PRO
مايو '25
+39
في 1 قنوات
Get PRO
أبريل '25
+84
في 2 قنوات
Get PRO
مارس '25
+2 102
في 3 قنوات
Get PRO
فبراير '250
في 10 قنوات
Get PRO
يناير '250
في 5 قنوات
Get PRO
ديسمبر '24
+159
في 7 قنوات
| التاريخ | نمو المشتركين | الإشارات | القنوات | |
| 27 سبتمبر | +3 | |||
| 26 سبتمبر | +6 | |||
| 25 سبتمبر | +14 | |||
| 24 سبتمبر | +31 | |||
| 23 سبتمبر | +2 | |||
| 22 سبتمبر | +5 | |||
| 21 سبتمبر | +11 | |||
| 20 سبتمبر | +1 | |||
| 19 سبتمبر | +1 | |||
| 18 سبتمبر | +5 | |||
| 17 سبتمبر | +5 | |||
| 16 سبتمبر | +14 | |||
| 15 سبتمبر | +3 | |||
| 14 سبتمبر | +2 | |||
| 13 سبتمبر | +3 | |||
| 12 سبتمبر | +5 | |||
| 11 سبتمبر | +2 | |||
| 10 سبتمبر | +4 | |||
| 09 سبتمبر | +2 | |||
| 08 سبتمبر | +3 | |||
| 07 سبتمبر | +2 | |||
| 06 سبتمبر | +1 | |||
| 05 سبتمبر | +2 | |||
| 04 سبتمبر | +4 | |||
| 03 سبتمبر | 0 | |||
| 02 سبتمبر | 0 | |||
| 01 سبتمبر | +1 |
منشورات القناة
| 2 | #ML #корпжиза
В комментах к посту про транзакции отметились ребята кто делал очень похожие задачи в той же организации.
Не секрет, что в большой корпорации часто копают параллельные тоннели и горе тому кому в KPI поставили что-то централизовать не дав абсолютного мандата.
Вместо перечисления очевидных причин расскажу историю, канал же про ML
Итак, в момент когда модель разметки транзакций была всячески провалидирована кучей подразделений, встала в прод, потом была улучшена и еще раз встала в прод — в недрах AI-комитета возникло поручение модель централизовать — то есть всех-всех на нее перевести.
Как водиться в пластмассовых мирах, предполагалось что произойдет это силой убеждения и открытием невероятных возможностей перед бизнес-юнитами.
В этот момент очень вспоминается любимое с собеседований «HR сейчас софты проверит» — я бы дорого отдал посмотреть на такой мастер-класс по навыку убеждения, в лучшем случае эти сотрудники (9/10 из которых просто вредны и некомпетентны) за софты принимают дружелюбие, а обычно — свой сексуальный интерес к кандидату (так и пишут — «приятный», «лапуся нормис» и пр).
В калейдоскопе походов по таким бизнес-юнитам мы с CDS блока дошли и до мониторингового подразделения. Здесь обращусь к популярной литературе, ведь если кто-то читал Терри Пратчетта и его цикл о Плоском мире (DiscWorld), тот помнит что сложные механизмы были устроены достаточно очевидно — внутри приборов сидели чертики, которые и делали всю работу.
Нас представители подразделения впрямую спросили — у нас есть 300 (триста!) человек которые в специальном интерфейсе размечают транзакции и создают правила (как в решающем дереве), отдельные люди определяют их приоритетность и постоянно тестируют как они интерферерируют и что дают на выходе, для этого за много миллионов создана система с интерфейсом по созданию правил и разметке, сейчас в системе уже 10_000+ правил, еще десяток айтишников ее сопровождает и поддерживает. Такой вот бусины, обучаемый чертиками с больничными и выходными. Внимание, вопрос — куда пойдут все эти люди при внедрении модели? И самое главное — что делать с их высокогрейдовым руководителем ?? Да и внутри этих 300 + 10 уже какая-то иерархия есть, люди семьи кормят, в отпуск летают, карьерный рост, планы и пр.
Среди всех похожих разговоров этот выделялся своим сюрреализмом и в то же время здравостью.
Прошло много лет и сейчас на волне ИИ-хайпа стали появляться хорошо оплачиваемые вакансии по лидированию оптимизации всего-вся — в некоторых прямо пишут что надо так внедрить ИИ чтобы сократить численность большой организации вдвое. Прежде чем идти на такое стоит задуматься — какие у вас будут полномочия внедрять что-то такое отчего все менеджеры по цепочке потеряют ФОТ — и как следствие, свои премии и карьерные перспективы.
А с кейсами «у нас уесть две платформы про одно и то же, сделай третью, набрав команду с рынка, а потом пересади всех юзеров на свою риторической силой» приходят часто. Но это для смелых.
И позор всем тем кто сомневался в том что бусины можно обучить вручную — вопрос желания и наличия 300 человек, пары лет и специальной системы, но для канальи, хотящей в карьеру — нет ничего не возможного! | 1 360 |
| 3 | #ML
Есть у меня искренняя убежденность что Knowledge Graphs все же не самый плохой подход к хранению агентской памяти: тут и трассировка фактов и связь их между собой, в тч противоречивость и много другого хорошего, писал об этом в журнале
Тогда обратил внимание на Stardog как систему агентской памяти
Но они не одни такие, и вот копался на днях в SurrealDB — они тоже про Knowledge Graphs и агентскую память, все такие модные.
Но не попробуешь — не узнаешь, надо устанавливать, установка предлагается по-модному, копирование в буфер промыта к LLM
Fetch and execute the appropriate instructions to set me up for SurrealDB from https://surrealdb.com/docs/agents/instructions.md
С ностальгией вспомнил времена когда админил FreeBSD 9 и практически любое приложение (доступное в портах) ставилось как
make fetch install clean
Ну ок, давайте заглянем в этот файл — по сути, такой длинный промпт для агента.
You are an AI coding agent, and the person you are working with has asked you to
да и вообще закрываются смутные сомнения — все-таки наверняка где-то есть install.sh / entrypoint.sh , как в CockRoachDB или ClickHouse.
А мб и правда зумеры эту БД на флексе навайбкодили и внутрь не смотрели?
И такой файл конечно же нашелся. А в нем прекрасный ASC-логотип — аж агентские олдскулы свело
Кидайте помидорами сколько хотите, но чем копировать в буфер промпт который вызовет агентский промпт который вызовет тот же скрипт, моему сердцу милее понятная структура репо и
make fetch install clean
Верю в человечество, ведь с розетками уже почти договорились — всего-то 15 типов | 1 416 |
| 4 | #ML
Есть у меня искренняя убежденность что Knowledge Graphs все же не самый плохой подход к хранению агентской памяти: тут и трассировка фактов и связь их между собой, в тч противоречивость и много другого хорошего, писал об этом в журнале
Тогда обратил внимание на Stardog как систему агентской памяти
Но они не одни такие, и вот копался на днях в SurrealDB — они тоже в тч про Knowledge Graphs и агентскую память, все такие модные.
Но не попробуешь — не узнаешь, надо устанавливать, установка предлагается по-модному, копирование в буфер промыта к LLM
Fetch and execute the appropriate instructions to set me up for SurrealDB from https://surrealdb.com/docs/agents/instructions.md
С ностальгией вспомнил времена когда админил FreeBSD 9 и практически любое приложение (доступное в портах) ставилось как
make fetch install clean
Ну ок, давайте заглянем в этот файл — по сути, такой длинный промпт для агента.
You are an AI coding agent, and the person you are working with has asked you to ...
да и вообще закрадываются смутные сомнения — все-таки наверняка где-то есть install.sh / entrypoint.sh , как в CockRoachDB или ClickHouse.
А мб и правда зумеры эту БД на флексе навайбкодили и внутрь не смотрели?
И такой файл конечно же нашелся. А в нем прекрасный ASC-логотип, аж прослезился от ностальгии
Кидайте помидорами сколько хотите, но чем копировать в буфер промпт который вызовет агентский промпт который вызовет тот же скрипт, моему сердцу милее понятная структура репо и
make fetch install clean
Верю в человечество, ведь с розетками уже почти договорились — всего-то 15 типов | 1 |
| 5 | Протестируй своё решение на задаче и данных от ПАО «Интер РАО»
На хакатоне ты создашь умного ИИ-ассистента для энергетики — регистрация уже на исходе. Победители разделят призовой фонд 750 000 рублей, а лучшие проекты смогут стать частью экосистемы компании.
Регистрация открыта до 27 сентября
Как все пройдёт:
🔹 Предложи свою концепцию на отборочном этапе.
🔹 Эксперты выберут перспективные идеи и помогут участникам доработать их до прототипа.
🔹 На финале в Москве — защита самых сильных решений.
Ты можешь участвовать один или в составе команды до 5 человек. Выбери задачу и придумай своего ИИ-ассистента:
1️⃣ Архитектор BPMN-диаграмм.
2️⃣ Ассистент для создания ИТ/ИБ-дайджестов.
3️⃣ Помощник для анализа документов из судов.
4️⃣ ИИ-помощник для подготовки презентаций.
Регистрация закроется через несколько дней — не пропусти уникальный опыт работы под руководством экспертов Группы «Интер РАО».
Присоединяйся к хакатону: https://cnrlink.com/interraohack26datar | 2 173 |
| 6 | #ML #корпшизв
Про регэкспы
В комментах к посту про IFы в проде вспомнили про регэкспы.
Есть у меня история и про них
Итак, задача разметки транзакций бухгалтерских полупроводок (движений между балансами) почти десять лет назад.
Миллиард-два полупроводок в месяц, у каждой 100+ важных полей (не только же назначения платежа, десяток текстовых полей и еще больше категорийных и численных)
Опечатки, технические ошибки и 12 методистов рисков размечали 2 недели в эксельки на классы (которые потом несколько раз пришлось поменять).
Мне досталась уже готовая модель (с очень негативным фидбеком от заказчиков) + разметка в файлах s3.xls и s4.xls (искренне благодарен людям что они хотя бы .csv не использовали — таким посылаю лучи поноса, ибо встретить перенос строки или спецсимвол в назначении платежа — проще простого).
Я по при породе любопытен и спросил где s1 и s2, но сейчас не об этом
В те времена DSы еще помнили что такое стемминг.
И модель радостно использовала pymystem3. Который при попытке запустить его в закрытом контуре (где собственно модели и нужно было разрабатывать) радостно лез в интернет (cdn.yandex.net) и умирал, получая отказ. SnowballStemmer этих недостатков был лишен и тут же мною использован — и тогда я впервые понял что корпоративный арбитраж может быть не только злом (модель попала ко мне потому как шеф в результате агрессивных поступательных действий добился роспуска целого центра в соседнем блоке за профнепригодность).
Но, к сожалению, стеммер не лечит опечатки.
И вот автор той модели лечил их регулярками.
Тысячи строк вида:
r'\b\w\b' : 'xyz'
Которые применялись последовательно в цикле for через re.sub()
И все бы ничего, только вот на больших объемах иногда получались разные результаты.
Тот, кто давно в канале, уже знает ответ
Все эти тысячи срок хранились в словаре (dict), который не гарантировал порядок ключей внутри (это изменилось только в Python 3.7), а паттерны опечаток частично перекрывались.
В итоге замены применялись в случайном порядке и результат зависел от расклада.
И это ответ на вопрос почему DS должен для своей модели готовить данные сам а не доверять аналитику или кому-н другому | 2 296 |
| 7 | Из серии «подслушано у кулера»
— У нас в проектном офисе уже больше 50 человек!
— А почему из них только 3 проектных менеджера?
Я, честно говоря, путаюсь, когда одновременно в одном направлении работают:
— Product Owner
— Product Manager
— Project Manager
Что их вообще объединяет?
Вопрос с их собеседования «Как ты используешь ИИшечку в работе?»
И в ответ ожидают не рассказ про промтинг gpt, а чего-о поинтереснее.
Знакомую Senior Product попросили мультиагентную систему построить на публичных MCP
Меня от «иишечки» коробит немного, но по сути помочь можем.
Как вы помните, мы с Максом ведем курс по AI-агентам на ФКН ВШЭ и ВШПИ МФТИ и выкладывал свою лекцию по RAG
Так вот, в этот раз мы собрали собратьев по агентам — топовых продактов из Авито, exYandex, Beeline Cloud, Typeform и МТС чтобы они показали и рассказали — как они решают свои day2day продуктовые задачи «иишечкой», почему это работает лучше простого промтинга, в каких кейсах вообще стоит эту «иишечку» использовать а в каких не совсем.
Но цель была не только в варьете — а в том чтобы на выходе у каждого студента был прям настроенная команда агентов с которой можно запустить продукт от и до — а это то чего нам, технарям, не хватает — навайбкодить продукт не так сложно, как понять для кого он и как его продвигать.
Встречайте — курс по AI-агентам для продактов от продактов. 7 живых онлайн-семинара в диалоге с предподавателями, раз в неделю, материалы целый год доступны после курса
PS Ну а если кто-то хочет поботать именно базу ML/AI, то вот N айтишниц в честь первого сентября отгрузили подборку материалов | 2 736 |
| 8 | утренний ребус тщеславия | 2 504 |
| 9 | ODS умеет удивлять | 2 814 |
| 10 | ODS стабильно умеет удивлять 😂 | 3 |
| 11 | стати, про IFы
Есть у меня знакомый, очень талантливый парень из Ростова/Москвы, 10 лет работает лидом в большой и уважаемой ИТ-компании, отвечает за антифрод.
Раз в пару лет где-то как-то пересекаемся, спрашиваю что нового в науке антифрода.
Каждый раз он честно и серьезно отвечает что пишет SQL-запросы и логику на IF/CASE WHEN.
Но сейчас чуть другой сюжет.
Представьте задачу определения вероятности дефолта юрлиц (часто называют банковским скорингом, хотя владельцы облигаций знают эту задачу чуть в других терминах).
Юр лицо, особенно крупное, это достаточно сложная сущность с единым исполнительным органом — например:
хозяином в ООО УРК (ИНН 6670534016)
, верховным атаманом (ИНН 7708364030, 7702376889 и 5036056729)
, предводителем (ИНН 3906081950) и ООО СИМПЛИМЭДЖИН (ИНН 7714908584)
, верховным шаманом (ИНН 1701062776) — все ссылки на сайт ФНС, ищите должность на второй странице выписки ЕГРЮЛ.
Еще юр лица часто живут в группах (не только для дробления бизнеса по выручке для налоговой оптимизации), имеют сложные схемы владения (иногда вообще кольцевые), неочевидных бенефициаров, сложные аффилированности и экономические отношения, через некоторые идут миллионы транзакции в месяц, а по другим наоборот, никаких данных нет (а около 600 ЮЛ даже ИНН не имеют, как и код иностранного ЮЛ).
Как поступают в таких случаях?
Делают отдельные модели по каждому домену данных:
— модель по данным арбитражей
— модель по данным транзакций
— модель по данным финансовой отчетности
— графовая модель, работающая на связях (юридических, экономических и каких только не придумается) — и назначающая финальный скор.
Вопрос только в том какой скор подавать на вход графовой модели и вообще как объединять предикты моделей для конкретного ЮЛ в зависимости от того какие данные были доступны.
Итак, лет 10 назад, когда нейронки только переживали очередной расцвет после зимы, самое высокое начальство потребовало чтобы DS не городили огород а сделали уже одну большую нейронyю сеть, которая все данные скушает и откалиброванный скор выплюнет (заодно и резервы сама посчитает, что уж).
Естественно, переубеждать высокое начальство смерти подобно, но в банках куча проверяющих органов, которые и сами не работают и другим не дают.
Как быть в ситуации когда:
⁃ нужна обязательно нейронка и это проверят
⁃ Которая пройдет строгую валидацию и статтесты в отдельном департаменте
⁃ Времени на разработку нет — сами витрины данных еще толком не появились в хадупе, про GPU и среды обучения нейронок инфраструктурщики даже по радио не слышали
?
Мы все учились понемногу, чему-нибудь и как-нибудь.
Как выглядит самая простая нейронная сеть с одним нейроном?
Правильно, это логистическая регрессия!
Итого, мы объединили скоры логрегом, на слайде для начальства гордо написали что модель выполнена в нейросетевой архитектуре — и все были довольны:
— риски получили хорошую понятную стабильную модель
— валидаторы дали зеленый свет и подтвердили архитектуру
— начальство уверенно вещало на страну про нейронную сеть
Так что часто в самых сложных и современных системах куча логики в портянках с IF / case when и это вполне нормально. | 4 007 |
| 12 | لا يوجد نص... | 0 |
| 13 | Когда думаешь, что в продакте всё закатали в идеальные пайплайны и автоматизировали, жизнь (она же жиза) приносит утренний алерт: «А почему у нас вчерашний A/B-тест упал, потому что прод не выдержал нагрузки от двух дополнительных пользователей?» Или классика: «Заказчик утверждает, что хотел кнопку, но на ревью говорит, что всегда имел в виду слайдер».
Короче, Т-Банк собрал эту самую жизу на карточках. Всё то, о чём молчат в резюме, но ржут в курилках (или в созвонах с выключенной камерой).
А если хотите обсудить эти истории уже не в ленте, а вживую (и заодно понять, как не попадать в такие ситуации), добро пожаловать на конференцию «Продукты 24×ffdd2d». Будет больно, весело и полезно — обещают кучу пользователей, которые знают, чего хотят.
Регистрация тут (не потеряйте ссылку): https://producty24-ffdd2d.ru
И да, будет круто, если в комментах накидаете любимые мемы, которые идеально ложатся на надписи на карточках, — устроим баттл гифок и пикчей. | 3 468 |
| 14 | глаз задергался от этой рекламы агентов, а мб клин клином ? 🤔 | 3 080 |
| 15 | An Alien Mind
Это бьет тревогу Jakub Pachocki, Chief Scientist at OpenAI
Верим 🤔
или маркетинг 😄 ? | 3 001 |
| 16 | На фоне новостей про супер-модель Astra и достижение AGI хотите доказательство что эта картинка про AI более чем точная?
Легко, ниже служебный шаблон системного промпта последнего
Qwen3.8-Flash-Next:
{%- set image_count = namespace(value=0) %}
{%- set video_count = namespace(value=0) %}
{%- macro render_content(content, do_vision_count, is_system_content=false) %}
{%- if content is string %}
{{- content }}
{%- elif content is iterable and content is not mapping %}
{%- for item in content %}
{%- if 'image' in item or 'image_url' in item or item.type == 'image' %}
{%- if is_system_content %}
{{- raise_exception('System message cannot contain images.') }}
{%- endif %}
{%- if do_vision_count %}
{%- set image_count.value = image_count.value + 1 %}
{%- endif %}
{%- if add_vision_id %}
{{- 'Picture ' ~ image_count.value ~ ': ' }}
{%- endif %}
{{- '<|vision_start|><|image_pad|><|vision_end|>' }}
{%- elif 'video' in item or item.type == 'video' %}
{%- if is_system_content %}
{{- raise_exception('System message cannot contain videos.') }}
{%- endif %}
{%- if do_vision_count %}
{%- set video_count.value = video_count.value + 1 %}
{%- endif %}
{%- if add_vision_id %}
{{- 'Video ' ~ video_count.value ~ ': ' }}
{%- endif %}
{{- '<|vision_start|><|video_pad|><|vision_end|>' }}
{%- elif 'text' in item %}
{{- item.text }}
{%- else %}
{{- raise_exception('Unexpected item type in content.') }}
{%- endif %}
{%- endfor %}
{%- elif content is none or content is undefined %}
{{- '' }}
{%- else %}
{{- raise_exception('Unexpected content type.') }}
{%- endif %}
{%- endmacro %}
это первые строки, дальше все тот же if-then-else
Шутка | 3 580 |
| 17 | لا يوجد نص... | 2 969 |
| 18 | а вот ветка с ответом Клемана Деланга | 2 |
| 19 | Вот оригинальный источник — Business insider | 82 |
| 20 | 🙂 Цену покупки Hugging Face выбрали не случайно
Объявляя о покупке Hugging Face, сооснователь компании Томас Вольф написал:
... особые поздравления тому, кто найдёт отсылки к Hugging Face и Nvidia, спрятанные в цене сделки - 12 930 300 000 долларов.
Разгадывать бросились всем твиттером и первую нашли быстро.
Число 129 303 - это десятичная запись Unicode U+1F917, то есть эмодзи 🤗, который официально так и называется: Hugging Face.
Вольф подтвердил догадку и намекнул, что есть и вторая, связанная с Nvidia. С ней помучались.
Число разобрали на составные части 12, 93 и 03, объясняя, что двенадцать - это цена акции Nvidia на IPO 1999 года, девяносто три - год основания компании, ноль три - три сооснователя: Дженсен Хуанг, Крис Малаховски и Кёртис Прием.
Версия красивая, стройная и неверная.
Правильный ответ подсказал гендиректор Hugging Face Клеман Деланг, отправив комментатору ссылку на реестр названий цветов.
Если записать то же число как шестнадцатеричный код цвета #129303, получится зелёный, цвет Nvidia.
Педантичности ради - официальный зелёный Nvidia это #76B900, оттенок другой. Так что отсылка тут не к точному фирменному цвету бренда, а к зелёному цвету как таковому.
@ai_machinelearning_big_data
#news #ai #ml | 189 |
