Data Secrets
Главный по машинному обучению Сотрудничество: @veron_28 РКН: clck.ru/3FY3GN
نمایش بیشتر📈 تحلیل کانال تلگرام Data Secrets
کانال Data Secrets (@data_secrets) در بخش زبانی روسی بازیگری فعال است. در حال حاضر جامعه شامل 92 467 مشترک است و جایگاه 1 352 را در دسته فناوری و برنامهها و رتبه 6 053 را در منطقه روسيا دارد.
📊 شاخصهای مخاطب و پویایی
از زمان ایجاد در невідомо، پروژه رشد سریعی داشته و 92 467 مشترک جذب کرده است.
بر اساس آخرین دادهها در تاریخ 25 اوت, 2026، کانال فعالیت پایداری دارد. در ۳۰ روز گذشته تغییر اعضا برابر 691 و در ۲۴ ساعت گذشته برابر 69 بوده و همچنان دسترسی گستردهای حفظ شده است.
- وضعیت تأیید: تأیید شده (به صورت رسمی توسط تلگرام)
- نرخ تعامل (ER): میانگین تعامل مخاطب 24.33% است و در ۲۴ ساعت نخست پس از انتشار، محتوا معمولاً 16.49% واکنش نسبت به کل مشترکان کسب میکند.
- دسترسی پستها: هر پست به طور میانگین 22 494 بازدید دریافت میکند. در اولین روز معمولاً 15 240 بازدید جمعآوری میشود.
- واکنشها و تعامل: مخاطبان بهطور فعال حمایت میکنند؛ میانگین واکنش به هر پست 277 است.
- علایق موضوعی: محتوا بر موضوعات کلیدی مانند claude, openai, контекст, стартап, llm تمرکز دارد.
📝 توضیح و سیاست محتوایی
نویسنده این فضا را محل بیان دیدگاههای شخصی توصیف میکند:
“Главный по машинному обучению
Сотрудничество: @veron_28
РКН: clck.ru/3FY3GN”
به لطف بهروزرسانیهای پرتکرار (آخرین داده در تاریخ 26 اوت, 2026)، کانال همواره بهروز و دارای دسترسی بالاست. تحلیلها نشان میدهد مخاطبان بهطور فعال با محتوا تعامل دارند و آن را به نقطه اثرگذاری مهم در دسته فناوری و برنامهها تبدیل کردهاند.
در حال بارگیری داده...
| تاریخ | رشد مشترکین | اشارات | کانالها | |
| 26 اوت | +52 | |||
| 25 اوت | +92 | |||
| 24 اوت | +44 | |||
| 23 اوت | +40 | |||
| 22 اوت | +43 | |||
| 21 اوت | +50 | |||
| 20 اوت | +40 | |||
| 19 اوت | +91 | |||
| 18 اوت | +75 | |||
| 17 اوت | +31 | |||
| 16 اوت | +34 | |||
| 15 اوت | +39 | |||
| 14 اوت | +98 | |||
| 13 اوت | +32 | |||
| 12 اوت | +31 | |||
| 11 اوت | +38 | |||
| 10 اوت | +39 | |||
| 09 اوت | +20 | |||
| 08 اوت | +39 | |||
| 07 اوت | +41 | |||
| 06 اوت | +40 | |||
| 05 اوت | +51 | |||
| 04 اوت | +73 | |||
| 03 اوت | +40 | |||
| 02 اوت | +16 | |||
| 01 اوت | +44 |
| 2 | Вышел Qwen-3.8 Flash-Next
Это MoE 125B + 51B N-gram таблица (но активных всего 6B), которая бьет Opus 4.6 Max на 8 из 9 бенчмарков!
Также превосходит Qwen3.8-27B и DeepSeek-V4-Flash. При этом обучение стоило в 9 раз дешевле, чем Qwen3.7-Plus.
Немного про архитектуру. Ключевых новшества всего четыре:
1. Те самые N-gram эмбеддинги aka дешевая память. Это таблица, которая индексируется не по одному токену, а по коротким последовательностям. Модель как бы запоминает типичные локальные комбинации токенов напрямую в виде векторов, а не выучивает их заново на каждом шаге. Потом происходит обычный lookup вместо матричного умножения, поэтому такие эмбеддинги почти не добавляют вычислений на токен, зато сильно увеличивают общую емкость модели.
2. Gated DeltaNet + Qwen Sparse Attention для скорости на длинных контекстах. Модель не запоминает весь контекст целиком, а выбирает небольшие релевантные блоки и работает только с ними. Gated DeltaNet – линейный механизм внимания с гейтами, которые как раз управляют тем, что модель запоминает, а что забывает. Результат: на 1М контекста prefill стал в 7.6 раз быстрее, а decode – в 4.9 раз.
3. Gated Residual connections. Обычные residual-связи просто прокидывают информацию между слоями, а здесь добавлены гейты, которые решают, сколько именно информации пропустить дальше.
4. Оптимизатор Muon вместо классического Adam. Как раз один из факторов, давших 9-кратную экономию на обучении.
В итоге обучение дешевле, параметров больше, а вычислений на токен меньше. Очередное достижение китайского опенсорса.
Модель | Репорт | Блог | 11 542 |
| 3 | ❗ Распространите ❗
Найден ИИ-ассистент, который реально экономит рабочее время и не сливает корпоративные данные.
Сотрудникам не придется тратить время на поиск информации по разрозненным документам, регламентам и ссылкам. С корпоративным ИИ-ассистентом от Selectel и KTS все собрано в единой базе знаний с умным поиском. С вас — запросы на естественном языке, с ассистента — мгновенные структурированные ответы, краткие выжимки и ключевые тезисы по внутренним файлам, черновики документов и многое другое.
Решение подойдет компаниям даже со строгими требованиями к безопасности:
➡️Ассистент автоматически маскирует чувствительные данные в запросах и проверяет их на соответствие политикам безопасности.
➡️Продукт можно интегрировать с корпоративными системами управления доступом и разграничить права пользователей при работе с информацией.
➡️Решение можно развернуть как в облаке Selectel, так и в вашем контуре – в этом случае Selectel предоставляет серверы с GPU в аренду на вашей площадке.
Корпоративного ИИ-ассистента можно внедрить всего за 2 недели, включая настройку решения под данные и процессы компании.
Протестируйте и убедитесь сами → https://slc.tl/afxmy
Реклама. АО "Селектел". erid:2W5zFJVvVVK | 11 873 |
| 4 | В OpenAI еще минус один
Глава подразделения дата-центров Крис Малон покинул стартап прямо перед IPO.
Итого с начала года свои должности покинули (это только руководители):
- Руководитель направления дата-центров
- Коммерческий директор
- Операционный директор
- Директор по коммуникациям
- Руководитель по робототехнике
- Директор по маркетингу
- Руководитель научного направления
- Руководитель Sora
- Технический директор B2B
- Генеральный директор по внедрению AGI
- Руководитель отдела оценки рисков
- Главный футуролог
- Руководитель отдела безопасности
- Ведущий специалист по этике ИИ (единственный в компании) | 14 402 |
| 5 | FigureAI собирают самый гигантский и разнообразный в мире датасет для обучения роботов
https://www.figure.ai/news/introducing-index
Оказывается, стартап 4 месяца в закрытом режиме тестировал приложение Index, через которое обычные люди записывают видео повседневных задач и получают за это деньги.
За это время компания заплатила пользователям уже 15 миллионов долларов, приложение скачали более 264 000 в 100+ странах. WAU – примерно 44к человек.
Собрано на данный момент более 15 миллионов роликов, каждую секунду приложение обрабатывает 30 минут видео. Это почти 5 лет человеческого труда в день. На этих данных уже обучают Helix, и в блоге написано, что разработчики «наблюдают существенные результаты в генерализации».
Figure заявляют, что планируют нарастить сбор еще в 100 раз и потратить >$1 млрд на данные и вычисления в следующем году. Масштаб!
Само приложение уже есть в AppStore и GooglePlay | 15 838 |
| 6 | Apple выпустили M6 и M5 Ultra
Цены сильно выросли, но приросты в метриках есть.
M6 – базовый чип, 12-core CPU, 12-core GPU, сдвоенный 16-core Neural Engine, до 32 ГБ unified memory, до 170 ГБ/с bandwidth. По цифрам Apple до 4.8x быстрее prompt processing, чем на M4. При 32 ГБ комфортно живут модели 7B–14B, квантованные 27-32B (Gemma 3, Qwen) тоже влезают. Mac mini с M6 от $899.
M5 Pro (тоже в Mac mini, старшая конфигурация) – до 18-core CPU, 20-core GPU, до 64 ГБ памяти, 307 ГБ/с. Норм для квантованных 70B-моделей (Llama 3 70B в 4-bit – это ~40 ГБ). Цена от $1699.
M5 Ultra (Mac Studio) – уже совсем другая весовая категория: до 36-core CPU, 80-core GPU, до 512 ГБ памяти, 1.2 ТБ/с bandwidth. Позволяет держать в памяти хорошие крупные модели, включая тяжёлые MoE. От $5499, а топовая конфигурация – за $18 000.
Так что полноценные 70B locally все-таки пока не выйдет, если вы случайно не Скрудж Макдак | 17 154 |
| 7 | Нейросеть в роли ИБ-специалиста: GigaChat 3.5 Ultra успешно сдал профессиональный экзамен
Модель ответила на 250 вопросов итогового теста программы «Информационная безопасность», превысив проходной балл на 14%. Знания проверяли специалисты УЦ «Информзащита» и департамента кибербезопасности Сбербанка.
Нейросеть обучали на массиве из более чем 300 тыс. документов, среди которых:
• лучшие практики ИБ и законодательство
• описания уязвимостей
• тактики и техники кибератак
Такой уровень знаний делает GigaChat 3.5 Ultra инструментом для реальных сценариев. Бизнесу без штатного безопасника он послужит первой линией консультаций по защите данных + профильным специалистам поможет в подготовке документов и управлении инцидентами. | 21 842 |
| 8 | Новые замеры собственного чипа OpenAI
https://openai.com/index/jalapeno-first-results/
Заявляют, что Халапеньо превосходит Nvidia GB200 и GB300 по скорости и эффективности. Для высоко интерактивных нагрузок говорят о производительности в 2,1–4,1 раза выше.
Начать использовать планируют уже в конце 2026 | 15 913 |
| 9 | Архитектура Qwen-4 уже почти здесь
Model Scope запустили отсчет до выхода Qwen3.8-Flash-Next. Ее релизнут ровно через сутки, и это будет первая модель, построенная на архитектуре следующего поколения, на которой будет также основан Qwen-4.
Пока деталей нет, пишут только, что изменения затронут внимание, residual-связи, эмбеддинг-слои и оптимизацию.
https://modelscope.cn/models/Qwen/Qwen3.8-Flash-Next/summary | 16 350 |
| 10 | Сбер открыл доступ к новому поколению моделей GigaEmbeddings
Линейка включает три модели разного размера: 480M, 3B и 10B-A1.8B. Они переводят тексты в числовые векторы для семантического поиска, построения RAG-систем (Retrieval-Augmented Generation), классификации и кластеризации.
Команда разработки изменила архитектуру модели, чтобы упростить интеграцию со стандартными открытыми инструментами. На vLLM GigaEmbeddings 3B работает в 1,6 раза быстрее предыдущей версии, а 10B-A1.8B — в 2 раза.
Объём данных для обучения увеличился в несколько раз. В частности, за счёт открытых датасетов Nemotron, F2LLM и KALM.
На всех этапах применяли мержинг экспертов для сохранения языкового баланса. Самую компактную модель обучали с помощью дистилляции: она усваивала ответы более крупных и точных моделей.
По результатам тестов 10B-A1.8B заняла первое место в рейтинге ruMTEB. У модели 3B качество обработки кода выросло на 14,5 пункта. При этом самая компактная модель 480M стала лучшей на русском языке среди решений до 500 млн параметров.
Ищите веса под лицензией MIT на GitVerse и HuggingFace.
Модели бесплатно доступны разработчикам и бизнесу под открытой MIT-лицензией:
HF: 480M | 3B | 10B-A1.8B
Gitverse: 480M | 3B | 10B-A1.8B
Подробности читайте в посте команды ↖️ | 18 241 |
| 11 | Хайп зашел слишком далеко: прокуратура Алабамы расследует инцидент со взломом Hugging Face
Генпрокурор штата уже выдал OpenAI повестку, в которой запрошены все документы, данные и информацию о взломе в июле, включая данные всех сотрудников OpenAI, причастных к инциденту + материалы об обнаружении компанией взлома + данные о мерах безопасности во время тестирования моделей.
В рамках расследования могут доказать, что OpenAI нарушила Deceptive Trade Practices Act штата, местный закон о защите прав потребителей. В следствие этого генпрокурор может даже добиться временного или постоянного запрета на определенную деятельность компании. | 19 029 |
| 12 | Кадры с World Humanoid Robot Games в Пекине можно разбирать на мемы бесконечно
Вес на видео 16кг, если что 💪 | 18 731 |
| 13 | У российских сайтов массово отзывают сертификаты безопасности. Разбираемся, что это значит, и как справляться.
Не так давно вступили в силу новые правила международного консорциума CA/Browser Forum. Это организация, которая устанавливает стандарты для всех удостоверяющих центров в мире.
На фоне этого часть сертификатов у российских сайтов начали отзывать, и разработчики стали переходить на российские сертификаты – их выдает Национальный удостоверяющий центр. Но проблема не решилась: после этого в большинстве браузеров сайты перестали открываться.
Дело в том, что когда браузер открывает защищенный сайт (https), он проверяет сертификат и выпустивший его удостоверяющий центр. У каждого браузера – свой список доверенных УЦ, зашитый внутри. Если сертификат сайта выпущен центром, который не нашелся в этом списке, браузер показывает предупреждение или блокирует доступ. Не потому что сайт опасный, а потому что браузер просто не знает соответствующий УЦ.
Именно поэтому один и тот же сайт может открываться в одном браузере, и не открываться – в другом. В Яндекс Браузере список доверенных УЦ шире, и туда изначально включены и российские сертификаты. Поэтому там все работает из коробки, и пользователи сохраняют доступ к ресурсу без сбоев.
Кроме того, владельцы сайтов с сертификатами НУЦ также могут проверить в публичном CT-логе Яндекса, когда и кем был выпущен сертификат для их ресурса. Это помогает убедиться, что сертификат настоящий и был выпущен с ведома владельца сайта. | 16 906 |
| 14 | На собеседовании в Anthropic кандидатов спрашивают, как бы они отреагировали, если бы акции компании обрушились до нуля
Что ни день – то очередной прикол от Дарио Амодеи. Еще недавно он был недоволен, что сотрудники приходят работать за зарплату, а не ради миссии. Теперь же, видимо, эта позиция отразилась и на процессе найма.
В Anthropic есть отдельное culture interview, где кандидатам теперь задают вопросы о приоритете миссии над будущей стоимостью акций.
Один из кандидатов рассказал, что его напрямую спросили, как бы он отреагировал, если бы компания в какой-то момент отказалась от развития AI-амбиций по соображениям безопасности, и это обрушило бы акции до нуля.
Кандидат честно ответил, что не был бы рад, и, по его словам, интервьюеру такой ответ не понравился. Другие кандидаты также вспоминают подобные формулировки.
Прекрасные вопросы на собеседовании компании, которая скоро выходит на IPO, не так ли? 🚬 | 18 660 |
| 15 | Дженсен Хуанг собирается создать открытую модель, которая составит конкуренцию китайскому опенсорсу
Nvidia вкладывает в эту идею порядка 7 миллиардов долларов.
Они заключили крупную сделку со стартапом Poolside, который занимается разработкой собственных моделей (в основном для кодинга). Кстати, создатель Poolside Джейсон Уорнер в прошлом был CTO GitHub и выпустил Copilot.
За 6 миллиардов Nvidia получает нексклюзивную лицензию на технологию Poolside + забирает на свои проекты большинство сотрудников, но при этом стартап формально продолжает существовать как независимая компания. Кроме того, Nvidia вкладывает сверху миллиард долларов в виде инвестиции (сама Poolside сейчас оценивается примерно в 12 миллиардов).
Собственно, с помощью полученной технологии и порядка ста сотрудников Poolside Nvidia собирается поднять с колен Nemotron – свою линейку открытых моделей. Цель – выпустить модель, которая могла бы составить конкуренцию DeepSeek и Moonshot.
Poolside, когда уведомляли акционеров о реорганизации компании, отметили, что "эта сделка призвана не дать ИИ стать закрытой технологией, контролируемой узким кругом людей". Звучит альтруистично, но для Хуанга, конечно, мотив не только в том, чтобы вывести американский опенсорс на новый уровень.
Ему важно оставаться монополистом, и он видит открытые веса как инфраструктурный рычаг, укрепляющий зависимость мира от его GPU. Китайцы разрабатывают собственные чипы, круные ИИ-игроки – тоже. А открытая модель, которая оптимизирована только под железо Nvidia, и которую тысячи компаний по всему миру разворачивают на своей инфраструктуре – это отличный способ сохранить больше рынка. | 19 057 |
| 16 | Вы не поверите, но Сэм Альтман признал, что он много лет зря разгонял хайп вокруг скорого появления AGI и переворота экономики
Чего-то такого, конечно, следовало ожидать: ведь нам обещали сдвиг в экономике и AGI уже в 2026, а он подходит к концу. Так что – приходится оправдываться.
И вот что Сэм говорит:
Я думал, что когда мы дойдем до GPT-4 в 2023 году, то сразу после этого произойдет гораздо большее потрясение, и IT-компании окажутся под угрозой гораздо быстрее, чем это оказалось на самом деле.
Я думаю, что ошибся в плане скорости, потому что экономика обладает огромной инерцией.
Люди продолжают делать то же самое, покупать у той же компании, хотеть использовать свои инструменты так же. Я думаю, что, на самом деле, это хорошо во многих отношениях, и это сделает большой переход более плавным и медленным.
Мы все были слишком амбициозны в отношении сроков. Даже с этой невероятной технологией общество и экономика будут адаптироваться медленнее.
Источник: новое интервью с Дэвидом Сенра | 21 557 |
| 17 | То же видео с другого ракурса (смотреть до конца)
Как говорила Сара Коннор: «Когда они гонятся за тобой, всегда беги к стене. Почему-то их никто не научил останавливаться. Так мы и победим в будущем». | 24 019 |
| 18 | Робот поставил мировой рекорд в беге на 100 метров
В Пекине стартовали Вторые Всемирные игры гуманоидных роботов. Включены: легкая и тяжелая атлетика, футбол, настольный теннис, большой теннис, единоборства, танцы и, дополнительно, всякие бытовые задачи типа открывания бутылок, сортировка и пр.
В первый же день сразу несколько роботов побили мировой рекорд на стометровке. Первым прибежал Tiangong Ultra, разработанный пекинским Центров инноваций. Его результат – 9,39с. Официальный человеческий мировой рекорд Усэйна Болта – 9,58 с. | 21 598 |
| 19 | DeepSeek выпустили новую мультимодальную модель для агентов
Встречаем DeepSeek-V4-Flash-Vision-Exp: https://api-docs.deepseek.com/guides/vision/
Это надстройка над V4-Flash специально под мультимодальные агентные сценарии.
Несмотря на «Flash» в названии, модель перформит на таких задачах на уровне Opus 4.8, а иногда и лучше. При этом на тексте способности не просели и остаются на уровне официального DeepSeek-V4-Flash.
Заодно вышел DeepSeek Harness 0.1.1 с готовой поддержкой модели из коробки.
Цены DeepSeek-V4-Flash, до 384 токенов за картинку. Принимает JPEG/PNG/GIF/WebP. | 20 273 |
| 20 | Автор uv ускорил запуск Codex CLI в 25 раз
Чарли Марш – основатель и CEO Astral. Это компания, которая разработала uv, Ruff, ty и много других Python тулов.
В марте этого года Astral была куплена OpenAI, и теперь Чарли работает в подразделении Codex.
Так вот, в последнем релизе Codex он переделал запуск командной строки так, что он стал в 25 раз быстрее.
В процесс запуска CLI (то есть когда вы вызываете команду codex) входит загрузка конфигов, аутентификация, установка соединений, подготовка окружения и т.д. Раньше эта цепочка занимала заметное время, а сейчас все происходит буквально мгновенно (попробуйте).
За счет чего конкретно произошел такой скачок – не раскрывается. Известно, что Codex CLI был ранее переписан с TypeScript на Rust, а в нем Чарли настоящий гуру. Он обещает, что «может ускорить это еще больше». | 20 839 |
