Machinelearning
Погружаемся в машинное обучение и Data Science Показываем как запускать любые LLm на пальцах. По всем вопросам - @haarrp @itchannels_telegram -🔥best channels Реестр РКН: clck.ru/3Fmqri
Показати більше📈 Аналітичний огляд Telegram-каналу Machinelearning
Канал Machinelearning (@ai_machinelearning_big_data) у мовному сегменті Російська є активним учасником. На даний момент спільнота об'єднує 288 007 підписників, посідаючи 331 місце в категорії Технології та додатки та 1 323 місце у регіоні Росія.
📊 Показники аудиторії та динаміка
З моменту свого створення невідомо, проект продемонстрував стрімке зростання, зібравши аудиторію у 288 007 підписників.
За останніми даними від 02 серпня, 2026, канал демонструє стабільну активність. Хоча за останні 30 днів спостерігається зміна кількості учасників на -5 417, а за останні 24 години на -206, загальне охоплення залишається високим.
- Статус верифікації: Не верифікований
- Рівень залученості (ER): Середній показник залученості аудиторії становить 7.77%. Протягом перших 24 годин після публікації контент зазвичай збирає 5.91% реакцій від загальної кількості підписників.
- Охоплення публікацій: В середньому кожен допис отримує 22 374 переглядів. Протягом першої доби публікація в середньому набирає 17 009 переглядів.
- Реакції та взаємодія: Аудиторія активно підтримує контент: середня кількість реакцій на один пост – 153.
- Тематичні інтереси: Контент зосереджений навколо ключових тем, таких як openai, claude, api, gemini, контекст.
📝 Опис та контентна політика
Автор описує ресурс як майданчик для висловлення суб'єктивної думки:
“Погружаемся в машинное обучение и Data Science
Показываем как запускать любые LLm на пальцах.
По всем вопросам - @haarrp
@itchannels_telegram -🔥best channels
Реестр РКН: clck.ru/3Fmqri”
Завдяки високій частоті оновлень (останні дані отримано 03 серпня, 2026), канал підтримує актуальність та високий рівень охоплення публікацій. Аналітика показує, що аудиторія активно взаємодіє з контентом, що робить його важливою точкою впливу в категорії Технології та додатки.
Новая система не соответствует тому, что было в GPT-5.5 и тем, кто переходит на более высокий уровень, следует начинать на один уровень ниже, чем они привыкли.🟠Light и Low предназначены для быстрых и простых задач 🟠Medium подходит для планирования и анализа 🟠High и xhigh - для сложных многоэтапных задач или верификации Max и Ultra работают по-разному: 🟢Первый позволяет модели уделять больше времени решению одной задачи; 🟢Ultra использует несколько суб-агентов параллельно, каждый из которых занимается отдельной частью задачи. Вайбхав рекомендует начинать с низкого уровня и повышать его только при необходимости, так как более высокие уровни требуют больше времени и расходуют больше токенов.
Всё это ни разу не приближает OpenAI к цели, озвученной Грегом Брокманом на Big Technology AI Summit буквально месяц назад. Он хочет сделать ChatGPT простым настолько, насколько это возможно.@ai_machinelearning_big_data #news #ai #ml
Речь идёт об информации, применимой и во благо, и во вред. Например, знания по кибербезопасности помогают закрывать уязвимости, но и находить их для атак, а сведения из вирусологии нужны как разработчикам вакцин, так и тем, кто захотел бы создать опасный патоген.🟡 Предложенный метод назвали GRAM К каждому слою нейросети добавляются дополнительные нейроны, сгруппированные в отдельные модули - по одному на каждую чувствительную тему. Во время обучения тексты из такой темы, скажем вирусологии, обновляют только соответствующий модуль, тогда как общие знания модель использует, но заново не переучивает. После обучения модуль можно удалить и вместе с ним исчезает и сама способность. Либо оставить для узкого круга пользователей, которым эти знания нужны по работе. 🟡 Метод актуален, потому что нынешние средства защиты несовершенны Обучение отказам и классификаторы, отсеивающие опасные запросы, не меняют того, что модель знает, и их можно обойти через джейлбрейк. Другой подход, фильтрация обучающих данных, убирает знания, но требует обучать отдельную модель под каждый набор ограничений, что для топовых моделей слишком дорого. GRAM, по замыслу, должен давать эффект множества по-разному отфильтрованных моделей ценой одного цикла обучения - в экспериментах с 4 категориями одна модель настраивалась 16 способами. 🟡Тесты Метод проверили в трёх условиях: синтетическом наборе детских рассказов, на модели с 800 млн параметров, обученной на смеси веб-текстов, кода и научных статей, и на 7 моделях размером от 50 млн до 5 млрд параметров. По результатам, удаление модуля убирало соответствующую способность почти так же полно, как если бы модель на этих данных вообще не обучалась, и при этом не ухудшало общие показатели. При этом защита устояла перед попыткой восстановить знания дообучением на токсичных данных, тогда как отдельный метод разучивания знания лишь подавлял, и их удавалось вернуть. 🟡Дисклеймер
GRAM не применялся ни к одной из рабочих моделей Claude, и в Anthropic не уверены, что это вообще произойдёт. Есть нерешённая проблема - некоторые полезные знания могут быть настолько переплетены с опасными, что чётко разделить их не удастся ни этим методом, ни фильтрацией.Код, скрипты анализа и метрики выложили на GitHub. Обучающие данные (токенизированные наборы и корпус научных статей по двойным темам) доступны на Hugging Face. @ai_machinelearning_big_data #AI #ML #LLM #Alignment #Research #Anthropic
🟡«Мы доказали, что такие сравнения не всегда корректны, и результат может зависеть в том числе от настроек эксперимента, объема данных или этапов обучения. Мы предложили единый подход, который позволяет сравнить методы в одинаковых условиях и понять, какие факторы действительно влияют на качество», — отметил Даниил Гаврилов, руководитель лаборатории Т-Технологий.🟡Результаты сравнения Исследование показало, что многие заявленные преимущества алгоритмов выравнивания стираются, а главным фактором качества остается тип ранжирования ответов. Методы, где модель сравнивает два ответа напрямую (pairwise), чаще показывают более высокий результат на задачах средней сложности, чем подходы, где ответы оцениваются по отдельности (pointwise). 🟡Что использовалось в работе В работе ученые использовали модели Llama 3.2 3B, Llama 3.1 8B, Mistral 7B, Qwen 2.5 7B и Qwen 2.5 14B. Обучение проводилось на данных Reddit TL;DR, UltraChat и UltraFeedback, а качество оценивали на AlpacaEval 2, ArenaHard, попарных сравнениях ответов с помощью более сильной модели и математических бенчмарках. 🟡Статья @ai_machinelearning_big_data #AI #ML
*организация признана экстремистской, её деятельность на территории РФ запрещена.@ai_machinelearning_big_data #news #ai #ml
В отличие от Odyssey, где логика вычислений и рендеринг разведены, MIRA пошла по пути генеративной симуляции в латентном пространстве видео.В основе - диффузионный трансформер на 5 млрд параметров и отдельный видеокодек-представление на 600 млн. Вместо автоэнкодера кодек строится поверх замороженного DINOv3-L, и латентное пространство выходит настолько стабильным, что специальные приёмы против дрейфа не понадобились, модель работает из коробки на обычном diffusion forcing. Экраны четырёх игроков MIRA сшивает в единую сетку латентов, чтобы механизмы пространственного внимания работали между ракурсами и держали машины, мяч и события согласованными на всех видах. Механизм action dropout достраивает поведение машин, для которых команды не пришли, компенсируя пропуски в потоках действий.
Всего на обучение MIRA ушло около 10 тыс часов геймплея, целиком сгенерированных ботами.🟡 Тесты Латентный подход бьёт пиксельный на порядок: gFID 10.7 против 81–105 и ARR 0.91 против 0.49–0.61 (ARR измеряет, насколько отданные команды считываются обратно из генерации). Ключ к стабильности именно в DINOv3-L, без него картинка дрейфует в 1.3–1.7 раза сильнее, а с ним gFID держится ровным вплоть до 5 минут, и на практике роллаут идёт часами без коллапса.
ARR, кстати, совпадает с оценками живых людей (корреляция Пирсона 0.84).🟡Недостатки
Контекст модели около четырёх секунд, поэтому повторы голов она попросту досочиняет - выглядит правдоподобно, но не совпадает с тем, что было на самом деле. Часы и счёт плывут на переходах, а за 40 минут игры набегает порядка 80 некомандных бустов и 30 прыжков.Авторы опубликовали код обучения и инференса, а также сет Rocket Science из 1000 часов каток в 720p с потоками действий и физическими состояниями. На одной NVIDIA B200 модель выдаёт 20 FPS при 576p в реальном времени. Потыкать в играбельное демо можно тут. @ai_machinelearning_big_data #news #ai #ml
Главная мысль: уходить от ручного режима, где разработчик задаёт направление на каждом шаге, и передавать агенту контроль по нарастающей.Всего выделяют 4 типа циклов, различая их по способу запуска, условию остановки и степени автономии. Логически получается некая лестница делегирования, где на каждой ступени вы отдаёте агенту очередное полномочие. 🟡Агентный цикл запускается промптом и завершается, когда Claude считает задачу выполненной. Здесь вы отдаёте агенту проверку. Ручные шаги верификации заполняются в
SKILL.md и чем более количественные критерии, тем точнее агент оценивает собственную работу.
🟡 Целевой цикл /goal забирает у вас условие прерывания
Вы описываете, что значит готово, а дальше при каждой попытке Claude завершить работу отдельная модель-оценщик сверяет результат с вашим критерием (скажем, долей пройденных тестов) и возвращает агента к работе, пока цель не достигнута или не исчерпан заданный лимит попыток.
🟡Временной цикл /loop или /schedule берёт на себя триггер запуска.
Это удобно для повторяющейся рутины и при работе с внешними системами (например, дайджест по таскам, реакция на новое ревью или упавший CI).
🟡Проактивный цикл убирает человека из контура.
Рутина срабатывает по событию или расписанию и живёт, пока вы её не выключите. В связке с динамическими воркфлоу агенту передаётся уже сам промпт. Вот этот сценарий уже ближе всего к полной автоматизации.
🟡Дополнительные советы
Не каждая задача требует сложного цикла, начинать стоит с простейшего решения. Кодовую базу следует держать чистой, а для ревью подключать второй агент. Для этого есть встроенный /code-review. Контролировать расход токенов чёткими границами: точные условия остановки, подбор модели под задачу (рутину - на модели поменьше и побыстрее, решения с ризонингом - на самой мощной). Динамические воркфлоу способны породить сотни агентов, так что масштаб лучше проверять на небольшой выборке.@ai_machinelearning_big_data #news #ai #ml
*организация признана экстремистской, её деятельность на территории РФ запрещена.@ai_machinelearning_big_data #news #ai #ml
Пример: около 48 тыс символов системного промпта и документации, которые как текст стоили бы примерно 25 тыс токенов, помещаются на одну PNG-страницу за ≈2700 токенов. На Fable 5 стоимость сессии упала с 42 до 6 долларов.🟡 Тесты Fable 5 читает такие рендеры практически без потерь (100% на бенчмарке с новыми задачами), а вот Opus 4.7 и 4.8 ошибаются примерно на 7% изображений. GPT 5.5 тоже деградирует на картиночном контексте, поэтому обе модели по умолчанию выключены и включаются вручную. 🟡Плата за экономию в потере точности На методе lossy важные строки вроде хешей и идентификаторов при чтении с картинки могут исказиться. Хуже когда промахи выглядят не как ошибки, а как правдоподобные выдумки.
Зрение модели это не OCR, изображение превращается в патч-эмбеддинги, и там, где пикселей не хватает, языковая модель просто достраивает похожее.Второй минус - это скорость. PNG-кодирование добавляет задержку из-за использования визуальныго энкодера, что дольше, чем чтение текста. Надеемся, что при массовом распространении такого трюка вендоры не поднимут цены на обработку изображений. 📌Лицензирование: MIT License 🖥GitHub @ai_machinelearning_big_data #AI #ML #LLM #Coding #Pxpipe
Чтобы удешевить инференс и ускорить обработку, провайдеры переиспользуют кэшированные фрагменты диалогов, и при коллизии ключей кэша или отказе разграничения кусок чужого контекста теоретически может просочиться в вашу сессию.Если эта версия верна, под угрозой данные любого пользователя. Но это лишь одна из гипотез, в самом отчёте среди возможных векторов названы также общее хранилище сессий, путаница при суммаризации контекста и перекрёстные ссылки в транскриптах. 🟡Есть и куда более прозаичное объяснение Возможно, это галлюцинация модели, случайно угадавшей реальный IP и слабый пароль, либо локальная история проекта, загрязнившая контекст. Пока Антропик не выпустила официального заключения, ни одну из версий нельзя ни подтвердить, ни отвергнуть. Автоматика GitHub повесила на тикет метку
security.
@ai_machinelearning_big_data
#news #ai #mlICML считается одной из ведущих мировых площадок в сфере искусственного интеллекта, а её премии - заметным профессиональным признанием.Лауреатов основной категории выбирали в несколько этапов - из 53 первоначальных кандидатов отобрали короткий список из 22 работ, которые затем в анонимизированном виде оценивал комитет из 11 человек. 🟡 Высшую награду в категории "Выдающиеся статьи" разделили 2 статьи The Flexibility Trap оспаривает распространённое мнение о диффузионных языковых моделях о том, что свобода выбирать порядок генерации текста, которую принято считать достоинством таких моделей, в задачах на рассуждение, наоборот, ухудшает результат. High-Accuracy Sampling for Diffusion Models and Log-Concave Distributions показывает, что диффузионные модели способны достигать высокой точности за существенно меньшее число вычислений. 🟡Отдельно отмечены работы, отстаивающие определённую точку зрения Лучшей признана статья Сары Болл и Фила Хакеманна, в которой утверждается, что элайнмент ИИ, создаваемый ради безопасности, может применяться и для цензуры. Почётного места удостоена работа Ли Цивэя и соавторов про то, что изучение дипфейков недостаточно учитывают проблему создания интимных изображений без согласия людей. 🟡Ещё 5 статей получили упоминания в основной категории 🟠Как модели обходят «детекторы лжи» при обучении; 🟠Отбор обучающих данных для генерации видео; 🟠Пределы запоминания данных языковыми моделями; 🟠Объяснение того, почему разные диффузионные модели выдают схожие результаты; 🟠Анализ эффекта грокинга, когда модель сначала запоминает обучающие примеры, а обобщать, то есть верно работать на новых, ранее не встречавшихся данных, начинает гораздо позже, если обучение продолжать. Премию Test of Time, отмечающую вклад с долгосрочным влиянием, присудили работе за авторством коллектива DeepMind под руководством Владимира Мниха. Она предлагает метод асинхронного RL, который повлиял и на обучение больших языковых моделей. @ai_machinelearning_big_data #news #ai #ml
«Контекстное окно на 100 миллионов слов уже возможно. Это примерно объём всего, что человек слышит за жизнь. Сейчас узкое место - только инференс. И модели действительно умеют учиться прямо внутри контекста, без изменения весов».— Дарио Амодей, CEO Anthropic https://www.youtube.com/watch?v=mYDSSRS-B5U @ai_machinelearning_big_data
