Машинное обучение RU
Все о машинном обучении админ - @workakkk @data_analysis_ml - анализ даннных @ai_machinelearning_big_data - Machine learning @itchannels_telegram -лучшие ит-каналы @pythonl - Python @pythonlbooks- python 📚 @datascienceiot - 📚 РКН: clck.ru/3FmrUw
Показати більше📈 Аналітичний огляд Telegram-каналу Машинное обучение RU
Канал Машинное обучение RU (@machinelearning_ru) у мовному сегменті Російська є активним учасником. На даний момент спільнота об'єднує 18 169 підписників, посідаючи 7 064 місце в категорії Технології та додатки та 36 461 місце у регіоні Росія.
📊 Показники аудиторії та динаміка
З моменту свого створення невідомо, проект продемонстрував стрімке зростання, зібравши аудиторію у 18 169 підписників.
За останніми даними від 25 серпня, 2026, канал демонструє стабільну активність. Хоча за останні 30 днів спостерігається зміна кількості учасників на 75, а за останні 24 години на -1, загальне охоплення залишається високим.
- Статус верифікації: Не верифікований
- Рівень залученості (ER): Середній показник залученості аудиторії становить 9.61%. Протягом перших 24 годин після публікації контент зазвичай збирає 5.24% реакцій від загальної кількості підписників.
- Охоплення публікацій: В середньому кожен допис отримує 1 746 переглядів. Протягом першої доби публікація в середньому набирає 951 переглядів.
- Реакції та взаємодія: Аудиторія активно підтримує контент: середня кількість реакцій на один пост – 8.
- Тематичні інтереси: Контент зосереджений навколо ключових тем, таких як github, llm, openai, параметр, архитектура.
📝 Опис та контентна політика
Автор описує ресурс як майданчик для висловлення суб'єктивної думки:
“Все о машинном обучении
админ - @workakkk
@data_analysis_ml - анализ даннных
@ai_machinelearning_big_data - Machine learning
@itchannels_telegram -лучшие ит-каналы
@pythonl - Python
@pythonlbooks- python 📚
@datascienceiot - 📚
РКН: clck.ru/...”
Завдяки високій частоті оновлень (останні дані отримано 26 серпня, 2026), канал підтримує актуальність та високий рівень охоплення публікацій. Аналітика показує, що аудиторія активно взаємодіє з контентом, що робить його важливою точкою впливу в категорії Технології та додатки.
ornith-ai/Ornith-1.5-35B-A3B с применением abliteration.
Что изменили:
* убраны встроенные ограничения модели;
* изменены только слои 11–29;
* базовая архитектура и остальные параметры сохранены.
Модель доступна на Hugging Face:
https://huggingface.co/huihui-ai/Huihui-Ornith-1.5-35B-A3B-abliterated
Ещё один пример того, как open-source сообщество экспериментирует с поведением LLM и настройкой моделей под разные сценарии.uv, после присоединения к OpenAI взялся за производительность Codex CLI.
Результат - время холодного старта сократилось примерно в 25 раз.
На практике разница ощущается сразу: Codex теперь открывается практически мгновенно и субъективно стартует даже быстрее Pi и Claude Code.
Если CLI запускается десятки раз в день, даже несколько сотен миллисекунд быстро превращаются в раздражение.
https://x.com/Machinelearrn/status/2091103150014935526Ox Alpha уже появилась у пользователей OpenCode, но её происхождение пока официально не раскрыто.
В одном из первых небольших прогонов на 10 сложных DeepSWE-задачах ей приписывают около 80% успешных решений - выше Fable 5, GLM-5.3, Grok 4.6 и GPT-5.6 Sol в том же мини-тесте.
Важно не путать это с официальным DeepSWE leaderboard: полный бенчмарк содержит 113 задач, и публичного полноценного результата Ox Alpha пока нет. Сам DeepSWE сейчас возглавляют frontier-модели примерно в районе 70+% pass@1.
По сообщениям пользователей, Ox Alpha также идёт с большим контекстом и сейчас доступна бесплатно/в промо-режиме, поэтому её активно гоняют на coding и agentic-задачах.
В сообществе уже подозревают, что под капотом может скрываться одна из новых китайских моделей, но это пока лишь догадки.
@machinelearning_interview / Папка полезного по ML.
https://x.com/Machinelearrn/status/2090758575475794270O(n³) и игнорируем константы. Для сравнения алгоритмов на больших данных это удобно.
Но современные CPU устроены намного сложнее: кэши, конвейеры, параллельное выполнение инструкций, SIMD, prefetching, память с разной задержкой.
Поэтому два алгоритма с одинаковым O(n) могут отличаться по скорости в разы.
А иногда алгоритм с формально «хуже» сложностью на реальных размерах данных оказывается быстрее.
Хорошая серия для тех, кто хочет перейти от «у этого O(n), значит быстро» к пониманию того, как код реально выполняется процессором.
en.algorithmica.org/hpc/complexity/Huihui-Qwen3.8-27B-abliterated — модифицированная версия Qwen3.8-27B, где через abliteration заметно ослабили safety-фильтры и склонность модели отказываться от запросов. Авторы прямо называют реализацию экспериментальной.
Теперь выложены все GGUF-квантизации, так что модель можно запускать через llama.cpp, LM Studio и совместимые инструменты. Отдельно появились готовые версии для Ollama.
Для Ollama достаточно:
ollama run huihui_ai/Qwen3.8-abliterated
Модель также можно протестировать прямо на Hugging Face, а в обсуждениях уже появились пользовательские тесты с довольно сильными результатами после abliteration.
При этом сами авторы предупреждают: фильтрация существенно снижена, поэтому модель лучше использовать для исследований и локальных экспериментов, а не без дополнительного контроля в публичном продакшене.
Hugging Face: huggingface.co/huihui-ai/Huihui-Qwen3.8-27B-abliteratedцена токена × количество токенов до завершения задачи
И здесь более дорогая модель может оказаться выгоднее, если она быстрее находит нужные данные, вовремя останавливается и работает с меньшим контекстом.
В многошаговых агентах это особенно критично: лишний retrieval на первом этапе раздувает контекст на всех следующих шагах.
AlphaSense пишет, что только изменение retrieval-пайплайна вокруг той же модели дало примерно 3× снижение стоимости.
Поэтому экономика AI всё сильнее зависит не от прайса API, а от retrieval, routing и evaluation вокруг самой модели.
https://www.alpha-sense.com/resources/product-articles/frontier-ai-models-context/low - простые задачи;
* high - обычные agent-workflows;
* max - сложные многошаговые задачи.
В актуальной API-документации DeepSeek для thinking mode фактически закреплены уровни high и max, а low/medium маппятся в high. Для сложных coding-agent сценариев effort может автоматически переключаться на max.
V4-Pro уже доступна через API как:
deepseek-v4-pro
Контекст - 1M токенов, максимальный output - до 384K, есть tool calling и thinking/non-thinking режимы.
DeepSeek также отдельно оптимизирует V4-линейку под coding agents вроде Claude Code и OpenCode.
Новая тарифная модель с peak/off-peak окнами. По заявлению DeepSeek, в непиковые часы API будет стоить на 50% дешевле, чтобы команды могли переносить тяжёлые batch-задачи на более дешёвое время.
https://x.com/deepseek_ai/status/2087864585504305397?s=46