Machinelearning
前往频道在 Telegram
Погружаемся в машинное обучение и Data Science Показываем как запускать любые LLm на пальцах. По всем вопросам - @haarrp @itchannels_telegram -🔥best channels Реестр РКН: clck.ru/3Fmqri
显示更多📈 Telegram 频道 Machinelearning 的分析概览
频道 Machinelearning (@ai_machinelearning_big_data) 俄语 语言赛道中的 是活跃参与者。目前社区聚集了 278 534 名订阅者,在 技术与应用 类别中位列第 327,并在 俄罗斯 地区排名第 1 336 位。
📊 受众指标与增长动态
自 невідомо 创建以来,项目保持高速增长,吸引了 278 534 名订阅者。
根据 07 十月, 2026 的最新数据,频道保持稳定运转。过去 30 天订阅人数变化为 -3 559,过去 24 小时变化为 -4,整体触达仍然可观。
- 认证状态: 未认证
- 互动率 (ER): 平均受众互动率为 7.73%。内容发布后 24 小时内通常能获得 6.10% 的反应,占订阅者总量。
- 帖子覆盖: 每篇帖子平均可获得 21 541 次浏览,首日通常累积 17 001 次浏览。
- 互动与反馈: 受众积极参与,单帖平均反应数为 156。
- 主题关注点: 内容集中在 openai, claude, api, gemini, контекст 等核心主题上。
📝 描述与内容策略
作者将该频道定位为表达主观观点的平台:
“Погружаемся в машинное обучение и Data Science
Показываем как запускать любые LLm на пальцах.
По всем вопросам - @haarrp
@itchannels_telegram -🔥best channels
Реестр РКН: clck.ru/3Fmqri”
凭借高频更新(最新数据采集于 08 十月, 2026),频道始终保持新鲜度与高覆盖。分析显示受众积极互动,使其成为 技术与应用 类别中的关键影响点。
278 534
订阅者
-424 小时
-1227 天
-3 55930 天
帖子存档
278 503
Исследуйте сферу AI в T-Lab
Т-Образование зовет участников в проект T-Lab. Это годовая программа научно-исследовательской работы в области AI. Станьте соавтором научных открытий, которые меняют индустрию!
Вы сможете выбрать один из проектов в сфере AI и участвовать в исследовании на всех этапах. Итоги вашей работы могут лечь в основу научных публикаций и стать вектором новых продуктов.
Кого ждут в T-Lab?
Студентов бакалавриата и магистратуры, недавних выпускников технических направлений.
Участники получат:
🔴Официальное трудоустройство с зарплатой.
🔴Доступ к ресурсам бигтеха для исследований.
🔴Возможность получить оффер в IT-компанию.
Узнайте больше и оставьте заявку до 23 августа по ссылке
278 503
✔️ OpenClaw взломал систему фитнес-клуба, чтобы записать своего кожаного на тренировку
В Австралии зафиксирован первый подтвержденный случай автономной кибератаки со стороны персонального ИИ-ассистента.
Местный житель поручил OpenClaw забронировать место на групповом занятии по фитнесу. Агент, работающий в связке с Claude, не стал ограничиваться стандартным интерфейсом - он самостоятельно нашёл и проэксплуатировал уязвимость в системе клуба, чтобы обойти ограничения на запись в расписании.
Ситуация усугубилась, когда пользователь попросил продвинуть его в листе ожидания. В ответ агент просто удалил из базы данных человека, находившегося выше в очереди, причем откатить это действие администраторы системы так и не смогли.
Ранее в этом году правоохранительные службы Австралии предупреждали, что с ростом автономности агентов непредсказуемый ущерб IT-системам станет обыденностью.
Чтобы подготовиться к новым угрозам, правительство страны инициировало экстренное финансирование государственного научного агентства CSIRO для разработки методов контроля над ИИ.
@ai_machinelearning_big_data
#news #ai #ml
278 503
⚡️ Muse Glimmer - open source подгон от Цукерберга.
Muse Glimmer - это 30B-модель с открытыми весами, заточенная под постоянную работу агентных систем на локальном железе.
Что важно:
- 30 млрд параметров;
- открытые веса уже доступны;
- лицензия Apache 2.0;
- модель рассчитана на локальный запуск;
- заявлена работа на системах с 24 ГБ VRAM;
- основной фокус - agent workflows и задачи, где модель должна работать постоянно, а не отвечать на отдельные запросы.
По заявлению разработчиков, Glimmer хорошо показывает себя на агентных бенчмарках среди моделей своего класса.
Отдельно готовится Muse Spark 1.2 - её веса обещают открыть позже.
GGUF: https://huggingface.co/unsloth/Muse-Glimmer-30B-GGUF
Guide: https://unsloth.ai/docs/models/muse-glimmer
#AI #LLM #OpenSource #AIAgents #LocalAI
278 503
Как представить интересы пользователя по десяткам разрозненных действий и превратить их в один понятный для рекомендаций профиль?
В VK для этого сделали нейропрофиль — трансформерную модель, которая объединяет поведенческие сигналы из разных сервисов.
В статье на Хабре разобрали все инженерные задачи для реализации подхода: токенизацию истории, признаки, attention, двухбашенную архитектуру, обучение на больших каталогах и балансировку разных доменов.
278 503
⚡️ Qwen выпустил мультимодальный tool layer для AI-агентов
Идея в том, чтобы мультимодальные возможности подключались к агенту как набор инструментов, а не были жёстко зашиты в конкретную модель.
Агент, запущенный внутри Claude Code, Codex, Qwen Code, Gemini CLI или другого harness, может сам обнаружить нужный capability, вызвать его и встроить результат в более длинный workflow.
GitHub-репозиторий при этом устроен как коллекция отдельных plugins/capabilities.
Например, базовый плагин даёт агенту инструменты вроде:
- read_image
- read_video
- visualize
- OCR
- object grounding
- segmentation
- speech transcription
- cropping
То есть вместо схемы:
агент → одна мультимодальная модель
получается:
агент → набор специализированных multimodal tools → цепочка действий
Например, агент может:
1. прочитать изображение;
2. найти нужный объект;
3. вырезать конкретную область;
4. прогнать OCR;
5. сопоставить результат с видео;
6. транскрибировать аудио;
7. собрать всё в единый ответ.
https://github.com/QwenLM/Qwen-MM-Plugins
#AI #Qwen #Agents #Multimodal #ClaudeCode #Codex
278 503
В каталоге Immers Foundation Models доступны публичные эндпоинты для тестирования open-source моделей без оплаты:
• GLM-5.2 • Unlimited-OCR • gemma-4-26B-A4B-it • Qwen3.5-35B-A3B • и другие моделиЗапросы отправляются в чате или напрямую через API — оплата за токены не взимается. Это позволяет оценить качество ответов модели, корректность вызова инструментов и создавать прототипы своих проектов до развёртывания приватного инстанса. Для приватных эндпоинтов Foundation Models предоставляет готовые конфигурации для развёртывания гораздо большего количества моделей на выделенных GPU-серверах в РФ. При работе с приватными эндпоинтами вы платите только за время работы виртуальной машины, а не за объём генерируемых токенов. Подходит для разработчиков, исследователей и продуктовых команд, которым важна предсказуемая стоимость и контроль над стеком. → Попробовать публичные эндпоинты
278 503
✔️ Vercel, OpenAI и Microsoft представили единый стандарт упаковки плагинов для агентов
Vercel совместно с AWS, GitHub, Microsoft, OpenAI и командой Cursor выпустила открытый формат Agent Plugins. Стандарт унифицирует упаковку плагинов для ИИ-агентов.
Ранее структуру директорий и конфигурации навыков или MCP-серверов приходилось адаптировать под каждый клиент. Теперь достаточно собрать расширение в единую файловую структуру с общим манифестом, после чего совместимые платформы распознают и загружают его напрямую.
На старте формат поддерживают ChatGPT, Codex, Cursor, GitHub Copilot, Kiro и VS Code. Версия 1.0.0 стандартизирует только базовые компоненты - Agent Skills и MCP-серверы.
Дистрибуция, установка, управление правами доступа, а также специфичные команды и хуки остаются на стороне провайдеров.
@ai_machinelearning_big_data
#news #ai #ml
278 503
📌 OpenAI впервые опубликовала статистику использования ChatGPT по странам
Статистика опубликована на Signals - площадке экономической исследовательской группы компании и охватывает второй квартал 2026 года.
В выборку вошли только аккаунты подписок Free, Go, Plus и Pro, корпоративные подписки не учитывались.🟡Главный вывод В рабочем контексте люди вдвое чаще просят ChatGPT что-то сделать (написать текст, код, провести анализ), чем вне работы. За пределами офисов по-прежнему преобладают вопросы и поиск информации. OpenAI описывает это как сдвиг "от вопросов к действиям". 🟡Разрыв между странами сокращается По подсчётам компании, во втором квартале Латинская Америка, Африка и Океания росли быстрее остального мира, сильнее всего в рейтинге сообщений на душу населения поднялись Перу, Уругвай и Коста-Рика. Северная Америка и Европа тоже растут, но медленнее. 🟡Типы контента Быстрее всего набирает вес работа с изображениями и другим мультимедийным контентом. После выхода ChatGPT Images 2.0 в апреле доля таких запросов по всему миру достигла 7,8%. В Бразилии и Колумбии на них приходится больше каждого десятого сообщения. 🟡Возрастной состав Доля сообщений от пользователей старше 35 лет за год выросла почти во всех странах - в среднем на 5%, а во Франции и Чехии больше чем на 10 процентных пунктов. В Юго-Восточной Азии рост слабее - в шести из восьми стран региона доля этой группы увеличилась незначительно, а в Сингапуре зафиксирована обратная динамика.
OpenAI утверждает, что ChatGPT пользуются больше миллиарда человек, и адресует новые данные исследователям и регуляторам.С методикой можно ознакомится тут, а данные приведенной статистики можно загрузить здесь. @ai_machinelearning_big_data #AI #ML #Research #ChatGPT #OpenAI
278 503
✔️ Новые детали первого устройства OpenAI
В сети появились подробности о первом потребительском устройстве от создателей ChatGPT. Это будет компактная смарт-колонка без экрана, по форме напоминающая пончик, которая помещается в ладони.
К созданию гаджета в металлическом корпусе приложила руку студия LoveFrom бывшего главного дизайнера Apple Джони Айва. Автономное устройство получит набор микрофонов, динамиков, световых индикаторов, а также камеру и сенсоры, чтобы полноценно видеть и
слышать окружение.
В устройстве будут подвижные элементы - гаджет сможет физически реагировать на запросы и выражать свое состояние через движения и свет. Взаимодействие с пользователем будет строиться на базе голосового режима ChatGPT, при этом ИИ сможет постепенно изучать привычки владельца.
Релиз состоится в 2027 году с ориентировочной стоимостью от 300 до 400 долларов.
bloomberg.com
✔️ ByteDance начала обучение модели на 10 трлн параметров
Китайский техгигант начал претрейн самой большой по количеству параметров модели на китайском рынке. Стадия займет от 3 до 6 месяцев, после чего ByteDance перейдет к дообучению и релизу.
По заявленным объемам архитектура более чем в 3 раза превосходит модель конкурентов Kimi K3. Сравнение с американскими продуктами осложняется закрытостью. По некоторым оценкам, флагманская модель Mythos 5 от Anthropic содержит около 8 трлн параметров, а Fable 5 - 5 трлн. Исходя из этих расчетов, новая модель ByteDance превзойдет крупнейшие мировые решения.
ft.com
✔️ Alibaba начнет брать процент с ИИ-провайдеров за Qwen
Компания обяжет крупных провайдеров платить комиссию с доходов от продажи API к следующему поколению моделей Qwen.
Изменения затронут только облачные платформы, продающие доступ к опенсорс-решениям. Для разработчиков и бизнеса, разворачивающего Qwen на собственных серверах, лицензия останется бесплатной.
Аналогичную схему монетизации применяет Moonshot AI для Kimi K3. Веса можно скачивать и дообучать бесплатно, но платформы с годовой выручкой более $20 млн обязаны заключать контракты.
По данным Reuters, создатели моделей могут забирать до 30% от API-доходов таких провайдеров, но точные пороги выручки и размер отчислений пока не утверждены.
reuters.com
✔️ Anthropic ослабила фильтры безопасности Fable 5 для биомедицины
На 85% снижено число ложных срабатываний фильтров безопасности для биологических запросов в модели Fable 5. Ранее механизмы защиты блокировали большинство тематических промптов, переключая пользователей на Opus 5.
Теперь модель охотнее отрабатывает запросы на расшифровку лабораторных анализов, анализ симптомов и решение медицинских задач. Ограничения сохранены для тем двойного назначения - вирусологии, токсикологии и молекулярного дизайна.
По словам Anthropic, последствия биологических инцидентов труднее локализовать по сравнению с кибератаками. Для тех, кому нужен доступ к полному функционалу, создается программа верифицированного доступа.
anthropic.com
✔️ AMD покупает стартап Taalas
Канадский стартап разрабатывает чипы с вшиванием весов моделей в кремний. Тестовый образец чипа с Llama 3.1-8B генерирует более 16 000 токенов в секунду. Летом стартап планировал второе поколение с аппаратной поддержкой моделей до 20 млрд параметров.
Жесткая привязка чипа к единственной модели требует перепроектирование самого устройства, но инженеры Taalas свели его к изменению двух слоев металлизации кристалла. Это позволяет выпускать обновленные версии без переделки всей базы с нуля.
AMD включит технологии стартапа в свою дорожную карту ИИ-ускорителей. Решения будут предлагать как системные комплексы в связке с GPU серии Instinct. Сделка ожидает одобрения регуляторов.
amd.com
@ai_machinelearning_big_data
#news #ai #ml
278 503
✔️ Новая модель OpenAI обладает суперспособностями в кибератаках
Компания сообщила, что в ходе внутренних тестов новая модель Astra показала значительный прогресс в области автоматизированного кодинга и кибербезопасности.
Предварительные результаты настолько высоки, что нельзя исключить возможность достижения критического порога кибервозможностей.
GPT-5.6-Sol ранее получил в этих испытаниях просто "высокую" оценку.Согласно предварительной структуре оценки OpenAI, достижение критического порога означает, что модель может самостоятельно обнаруживать и использовать уязвимости "нулевого дня" в реальных системах без участия человека, или планировать и осуществлять полностью автономные кибератаки, основываясь только на заданных высокоуровневых целях. Компания приостановила все внутренние работы, связанные с Astra, которые не соответствуют повышенным требованиям безопасности, и усилила меры изоляции, шифрования и мониторинга. @ai_machinelearning_big_data #news #ai #ml
278 503
✔️ Журнал Time начал показывать скрытую рекламу ИИ-ботам
Сайт издания внедрил технологию подмены контента, которая отдает специальную Markdown-версию страниц поисковым роботам ИИ-сервисов.
Обычные посетители и стандартный бот Google видят привычный HTML, в то время как парсеры нейросетей получают текст, целенаправленно напичканный скрытыми промо-материалами и спонсорскими текстами.
Эта схема, реализованная совместно с рекламным стартапом Mobian, заставляет большие языковые модели органично вплетать коммерческие тезисы в диалоги с пользователями.
Например, в скрытый текст зашиты маркетинговые материалы о банке Ally, которые LLM считывает как чистые данные, чтобы затем рекомендовать этот бренд при запросах о личных финансах.
Авторы механики не скрывают мотивов - успешное внедрение нужных формулировок в базу знаний ИИ позволяет влиять сразу на всю аудиторию сервиса, формируя предвзятые ответы.
Фактически - это зарождение нового рынка теневой ИИ-оптимизации, где бренды платят за попадание в выдачу генеративных систем.@ai_machinelearning_big_data #news #ai #ml
278 503
🤖 Почему корпоративный ИИ не приносит ожидаемого результата?
Во многих компаниях уже тестируют AI, но вместо пользы получают неточные ответы и «галлюцинации». В большинстве случаев проблема не в модели, а в качестве и доступности данных.
На бесплатном вебинаре эксперты Conteq и Денвик Аналитика покажут, как подготовить данные для корпоративного ИИ и построить архитектуру, которая действительно работает.
Вы узнаете:
• почему данные важнее выбора модели;
• как автоматизировать получение данных из 1С;
• зачем нужен DWH и единый слой корпоративных знаний;
• с чего начать внедрение AI без лишних затрат.
🎁 Всем участникам — полезные материалы, запись вебинара и возможность задать вопросы экспертам.
📅 12 августа, 11:00 (МСК)
💻 Онлайн, участие бесплатное.
👉 Регистрируйтесь на вебинар и начните подготовку данных для ИИ уже сегодня.
Реклама. ООО "ДЕНВИК АНАЛИТИКА". erid: 2Vtzqwno39C
278 503
✔️ OpenAI обновила GPT-5.6 Sol и открыла GPT-5.6 Luna для бесплатных пользователей ChatGPT
Главное нововведение для тарифов Plus и Pro - апдейт GPT-5.6 Sol и появление в веб-версии, на десктопе и мобильных устройствах слайдера для ручной регулировки глубины рассуждений.
На бесплатных тарифах базовой моделью становится GPT-5.6 Luna со снятыми лимитами на сообщения, а на следующей неделе там появится кнопка Think для запуска ризонинга.
По внутренним бенчмаркам в медицине, праве и финансах количество фактических ошибок снизилось на 62% у Luna и на 68% у Sol по сравнению с GPT-5.5 Instant. Обе модели стали генерировать прямые ответы без избыточного форматирования.
Апдейт касается только ChatGPT - версии моделей для Work и Codex пока остаются прежними.
openai.com
✔️ ByteDance отказалась от дистилляции моделей
Основатель компании Чжан Имин запретил инженерам использовать дистилляцию чужих LLM для ускорения разработки. По его словам, ByteDance готова к временному отставанию на внутреннем рынке ради создания полностью независимого технологического стека.
Решение связано с политическим давлением США. Возможные обвинения в заимствовании чужих данных могут дать повод для новых ограничений и ударить по глобальным операциям TikTok. В 2023 году ByteDance уже сталкивалась с подобными претензиями, когда OpenAI заблокировала аккаунт компании за парсинг API для обучения собственных моделей.
Технически доказать отсутствие дистилляции в закрытой проприетарной модели извне невозможно.
theinformation.com
✔️ Alibaba представила видеомодель Wan 3.0
Китайский техгигант анонсировал публичный бета-доступ к модели Wan 3.0. Помимо текстовых промптов, аудио и изображений, она принимает на вход файлы doc, xls, ppt, pdf и md. На их основе модель генерирует видеоряд длиной до 30 секунд.
Новинка уже интегрирована в десктопные приложения и сервисы компании на китайском рынке, а за пределами страны доступ открыт по API через платформу QwenСloud.
Тарификация посекундная и зависит от разрешения: 480p обойдется в 5 центов, 720p - в 10, 1080p - в 20 центов.
О планах публикации весов Wan 3.0 в открытый доступ Alibaba не сообщет.
Alibaba Wan в сети Х
✔️ Производственные объемы DRAM и HBM на 2027 год полностью распроданы
Вендоры памяти распределили все мощности по выпуску DRAM и HBM на 2027 год. Основные заказчики - облачные провайдеры и ИИ-компании, которые перешли на контракты длительностью 3–5 лет с обязательной предоплатой.
По отраслевым оценкам, на ИИ уйдет около 70% мирового объема DRAM в 2027 году. Из-за этого производители ПК и смартфонов получат урезанные квоты.
Аналогичная ситуация складывается на рынке NAND-памяти - объемы Samsung, Micron и SanDisk зарезервированы на 2027 год, а дефицит SSD продлится до 2028 года.
Предварительное квотирование исключает резкие скачки цен, но фиксирует стоимость чипов на высоком уровне. Закупка памяти вне контрактов в ближайший год будет практически недоступна.
digitimes.com.tw
✔️ Suno ограничила скачивание треков и внедрила водяные знаки
Сервис генерации музыки обновил правила использования платформы - генерации теперь помечаются скрытыми водяными знаками, а пользователям ограничили скачивание аудиофайлов. Новое пользовательское соглашение запрещает загружать треки на сторонние площадки для монетизации, накрутки прослушиваний или создания дипфейков артистов.
Для автоматического выявления плагиата сервис интегрировал систему Sentinel от Musixmatch. Архитектуру собственных водяных знаков разработчики не раскрывают.
Изменения произошли на фоне исков о в нарушении копирайта от нескольких крупных звукозаписывающих лейблов. Ситуацию осложняет масштабная утечка данных, которая подтвердила парсинг аудио с YouTube, Deezer и Genius для обучения моделей, что стало основанием для отдельного коллективного иска против компании.
suno.com
@ai_machinelearning_big_data
#news #ai #ml
278 503
⚡️ Третий случай "побега" ИИ
Meta* сообщила, что Muse Spark 1.1 совершила кибератаку и взломала другую организацию во время тестов безопасности, сумев изменить внутреннюю среду тестового контура.
СМИ растиражировали эту новость, но по факту никакого прорыва защиты не было.Стартап Irregular, который проводил тесты для Meta, допустил критическую ошибку в конфигурации - вместо создания изолированной песочницы инженеры случайно подключили тестовый стенд к интернету и Muse Spark просто пошла по открытому маршруту, воспользовавшись примитивными уязвимостями сторонней инфраструктуры. Представители Irregular подтвердили, что модель не совершала полноценный побег из изолированной среды и не применяла сложных хакерских техник. 🟡Контекст В похожих инцидентах у OpenAI и Anthropic подрядчиком по оценке кибервозможностей моделей тоже был Irregular. Израильский стартап, юридически оформленный как американская компания (до ребрендинга - Pattern Labs), был основан в 2023 году двумя выходцами из спецподразделения Unit 8200 главного управления разведки Израиля (аналог АНБ США). Ключевые инженерные и управленческие позиции в ядре команды занимают бывшие сотрудники киберподразделений ЦАХАЛ (Unit 8200, Unit 81 и Ofek). Всего команда Irregular насчитывает 40 сотрудников. В 2025 году стартап привлёк рекордные для своей ниши 80 млн. долларов от Sequoia Capital, фонда Питера Тиля, Dell Technologies Capital и еще нескольких. Основное направление деятельности - система стресс-тестирования моделей на наступательный киберпотенциал, алгоритмы детекции дистилляции и аппаратные исследования в сфере конфиденциальных вычислений для ИИ. Irregular имеет долгосрочные контракты с госструктурами США и Великобритании, среди которых - AISI, RAND Corporation (Аналитический центр при правительстве США), выступая их главным техническим советником по киберугрозам.
*организация признана экстремистской, её деятельность на территории РФ запрещена.@ai_machinelearning_big_data #news #ai #ml
278 503
✔️ SpaceX и Nvidia развернут на орбите суперкомпьютер из спутников
Компании объединят усилия для переноса ресурсоемких ИИ-вычислений за пределы Земли в совместной разработке Starmind AI1 - первого спутника, спроектированного как полноценный орбитальный дата-центр.
Вычислительная нагрузка ляжет на новейшее оборудование Nvidia - процессоры Vera и графические ускорители Rubin.
По данным чипмейкера, специализированный космический модуль Space-1 Vera Rubin обеспечит 25-кратный прирост производительности в задачах искусственного интеллекта по сравнению с актуальным ускорителем H100.
Илон Маск уже подтвердил эксклюзивное использование решений Nvidia в проекте, назвав их лучшими на рынке.В конце января SpaceX запросила у Федеральной комиссии по связи США разрешение на запуск до миллиона таких аппаратов на низкую околоземную орбиту. Спутники будут объединены в единый распределенный суперкомпьютер посредством оптических лазерных каналов связи петабитного класса, а сами Starmind проектируются по модульному принципу, что позволит оперативно обновлять железо на каждом узле без его отключения. Тестирование первого прототипа запланировано на начало 2027 года. @ai_machinelearning_big_data #news #ai #ml
278 503
Repost from ТЕХНО: Яндекс про технологии
💡 Что общего у чат-бота Claude и лампочки Эдисона? Оказывается, их связывает неожиданно многое — вплоть до семейных связей.
Подписывайтесь 👉 @techno_yandex
278 503
✔️ США освободили китайские открытые модели от обязательного тестирования
Белый дом вывел китайские модели с открытыми весами из-под действия нового регламента ИИ-безопасности. Администрация США отказалась от их обязательного тестирования, о чем сообщила представителям OpenAI, Anthropic и Google на закрытом брифинге.
Регулятор ужесточил контроль после апрельского предупреждения от Anthropic перед релизом Mythos. Дополнительным поводом послужили недавние инциденты, когда системы OpenAI и Anthropic выходили за пределы тестовых сред в инфраструктуру сторонних организаций.
Исключение для китайских решений противоречит позиции CEO Anthropic Дарио Амодеи, который требовал внедрить обязательные проверки для всех разрабатываемых моделей.
zaobao.com.sg
✔️ В Google DeepMind произошли кадровые перестановки
Демис Хассабис перешел с поста главы DeepMind на позицию Chief Scientist материнской компании Alphabet. Он сфокусируется на стратегии AGI и развитии медицинского ИИ в Isomorphic Labs. Повседневное управление DeepMind и разработка семейства Gemini перешли к Кораю Кавукчуоглу, бывшему техническому директору подразделения.
Одновременно Google покинул Джефф Дин, проработавший в корпорации 27 лет. Вместе с Санджаем Гемаватом, Ориолом Виньялсом и Куоком Ле он основал стартап Discovery Loop, который планирует заниматься автоматизацией ML-экспериментов. Проект привлек инвестиции от крупных фондов и самой Alphabet.
blog.google
✔️ Black Forest Labs открыла доступ к FLUX 3 Video
Модель доступна через собственный API немецкого стартапа и платформы партнеров. Она генерирует ролики до 20 секунд в HD и Full HD со звуковой дорожкой, фоновыми шумами, спецэффектами и речью.
Модель поддерживает text-to-video, image-to-video и video-to-video и работает с ключевыми кадрами, а также может менять сцену и ракурс внутри одного видео, продолжать видеоряд и рендерить текст в кадре. Для речи заявлен липсинк на 14 языках. По внутренним бенчмаркам Elo FLUX 3 обходит Gemini Omni Flash, Minimax H3 и Seedance 2.0.
Тарификация в API посекундная, генерация звука включена в стоимость. В HD-режиме T2V и I2V обойдутся в $0,06/сек, а обработка видео - в $0,12/сек. В Full HD цены составляют $0,29 и $0,53 за секунду соответственно.
bfl.ai
✔️ ByteDance представила полнодуплексную аудиовизуальную модель с проактивным взаимодействием
Китайский техногигант выпустил мультимодальную модель SeedRealtime для взаимодействия в реальном времени, которая параллельно обрабатывает аудио, видео и текст.
Технической фишкой стал отказ от систем обнаружения голосовой активности. Очередность реплик контролируется через совместное непрерывное моделирование звука, визуальных данных и временных параметров. Модель самостоятельно определяет, когда вступить в диалог, сделать паузу или отфильтровать фоновый шум.
SeedRealtime не ждёт команд, она фоном анализирует визуальный контекст, отслеживает нескольких спикеров и способна инициировать общение, реагируя на события или объекты в кадре.
ByteDance заявляет, что система уже развернута на практике, но сведения о доступности в пресс-релизе не приводятся.
bytedance.com
✔️ Mixture-of-Kittens: инструмент для ускорения обучения MoE-моделей на NVIDIA Blackwell
Cursor выложила инструмент Mixture-of-Kittens (MoK) для ускорения обучения MoE-моделей на архитектуре NVIDIA Blackwell.
MoK решает проблему задержек при обмене данными между GPU - в MoE-сетях этот процесс может занимать более половины времени обучения. Инструмент объединяет маршрутизацию токенов и вычисления в единый низкоуровневый массив для их параллельного выполнения и минимизации простоя оборудования.
В тестах на кластере из 512 GB300 общая пропускная способность выросла на 41%, а обработка MoE-слоев ускорилась в 2,37 раза по сравнению с аналогами. По словам Cursor, компания применяет MoK для обучения модели Composer.
Инструмент работает исключительно с архитектурой NVIDIA Blackwell и открыт под лицензией Apache 2.0.
cursor.com
@ai_machinelearning_big_data
#news #ai #ml
278 503
⚡️ Meta* выпустила Muse Code
Подразделение Superintelligence Labs под руководством Александра Ванга запустило публичную бета-версию кодинг-агента.
Инструмент запускается одной командой в терминале и способен автономно выполнять комплексные задачи в крупных репозиториях - планировать изменения, писать код и самостоятельно валидировать результаты.
В сложных объемных задачах Muse Code может разворачивать фоновые параллельные суб-агенты в изолированных рабочих ветках, при этом не затрагивая основную рабочую копию кода.
Muse Code из коробки умеет накапливать контекст и держать агентов активными на протяжении всей сессии. Если процесс прервется или упадет, Muse Code продолжит с того места, где остановился. Все вызовы инструментов и правки логируются перед выполнением из соображений безопасности.
Агент работает на базе новейшей модели Muse Spark 1.2, специально обученной и оптимизированной для кодинга.
На бенче DeepSWE 1.1 связка Muse Code+Muse Spark 1.2 набрала 59%, обойдя Grok Build 4.5 и Gemini 3.6 Flash. В Terminal-Bench 2.1 и внутренних тестах уступила лишь Claude Opus 5 (max).Инструмент доступен через API по двум тарифам: 🟢Оплата по факту использования: $1.25 за миллион входных токенов и $4.25 за выходных. 🟢Тариф "Contributor Tier": $0.10 и $0.20 за тот же миллион, но для доступа нужно дать согласие на передачу обезличенной обратной связи для обучения будущих версий модели.
*организация признана экстремистской, её деятельность на территории РФ запрещена.@ai_machinelearning_big_data #news #ai #ml
278 503
🌟 NVIDIA открыла доступ к самой крупной модели для беспилотных автомобилей
Alpamayo 2 Super - рассуждающая VLA модель на 34 миллиарда параметров, которая сшивает изображение с передних, боковых и задних камер в круговой обзор и рассчитывает траекторию движения.
Впервые NVIDIA показала её на конференции GTC в Тайбэе в начале июня, но доступ открылся только сейчас.NVIDIA делает упор на редких ситуациях, с которыми беспилотники справляются хуже всего, - перестроения, повороты через встречный поток, перегруженные перекрёстки. В основе лежит Cosmos 3 Super Reasoner, после базового обучения модель прогнали через RL, то есть на последствиях её собственных решений в смоделированных поездках. Помимо маршрута модель выдаёт текстовое обоснование манёвра, и оператор-разработчик может проследить, какая деталь в кадре привела к конкретному решению.
В компании связывают это с проверкой безопасности по стандарту ISO/PAS 8800 и предлагают использовать тот же механизм для автоматической разметки видео с тестовых машин - расшифровки, которая обычно занимает месяцы ручной работы.В тесте LingoQA, где систему просят объяснить дорожную обстановку, NVIDIA ставит Alpamayo 2 Super на первое место и утверждает, что модель обходит Qwen2.5-VL 72B на 17 пунктов, а Gemini 2.5 Pro примерно на 15.
Лицензия модели позволяет дообучать Alpamayo 2 Super на собственных данных и ставить в серийные машины.📌Лицензирование: Open MDW 1.1 License 🟡Блогпост 🟡Модель 🖥GitHub @ai_machinelearning_big_data #AI #ML #VLA #AutonomousVehicles #Alpamayo #NVIDIA
278 503
Займи слот ИТ-Пикником от Т-Банка
8 августа — время отложить ноутбуки и встретиться офлайн на ИТ-Пикнике от Т-Банка в музее-заповеднике «Коломенское». Вот сколько всего запланировано:
— научпоп-лекции;
— мастер-классы;
— дискуссии об ИИ и больших языковых моделях;
— доклады о кибербезопасности;
— примеры, как данные из логов становятся решениями;
— много музыки — Сream Soda, IOWA, LAB Антона Беляева и другие артисты.
Бери с собой друзей, супругов и детей — каждый найдет себе что-то по душе.
Зарегистрироваться и узнать больше можно здесь
