en
Feedback
Vikhr models

Vikhr models

Open in Telegram

Vikhr models news feed Задонатить можно: - Наш сайт: https://vikhr.org Чат сообщества: @vikhrmodels

Show more
2 595
Subscribers
No data24 hours
+87 days
+1130 days
Posts Archive
SIQ-1-35B Короче я обучил qwen35b a3 с PPO и я первый раз в жизни увидел чтобы PPO докидывало нормально(reward был верифициру
SIQ-1-35B Короче я обучил qwen35b a3 с PPO и я первый раз в жизни увидел чтобы PPO докидывало нормально(reward был верифицируемый) Эта штука на karpathy autoresearch для parametr golf лучше чем glm5.2 и qwen350b и генерит идеи похожие на опус А еще она на bullshit бенч лучше чем NEX и gpt5.5 Модель + gguf: https://huggingface.co/AlexWortega/SIQ-1-35B Демо чтобы гонять на zero gpu и радоваться: https://huggingface.co/spaces/AlexWortega/hermes-agent-zerogpu

31-я международная конференция по компьютерной лингвистике и интеллектуальным технологиям «Диалог»  (https://dialogue-conf.org/) 24-26 июня 2026 года   Приглашаем прийти послушать доклады и принять участие в обсуждении достижений больших языковых моделей и современной лингвистики   Приглашенные доклады: Колмогорова  Анастасия Владимировна д-р филол.наук, профессор, профессор департамента филологии Школы гуманитарных наук и искусств НИУ ВШЭ СПб, академический руководитель магистерской программы «Языковые технологии в бизнесе и образовании», руководитель научной лаборатории языковой конвергенции  «Визуальные языковые модели в задаче описания картин»   Украинский Руслан Владимирович, руководитель проекта Исследования и инновации Производственного управления компании «Гарант»  «От модели к агенту: как генеративный ИИ меняет работу с правовой информацией и разработку справочных правовых систем»   Подобряев Александр Владимирович, phd, доцент школы лингвистики, ВШЭ «Семантические компетенции больших языковых моделей»   Регистрация до 23 июня 2026 года   МЕСТО ПРОВЕДЕНИЯ 2-й гуманитарный корпус, факультет ВМК, Ленинские горы, 1, стр. 52, северный вход, 2 этаж

Оно не адаптировано под русский и русский не стоял как основная цель при обучении, но в целом модель мне нравится

https://alexwortega.github.io/pi-agent/hermes/ я продолжаю угарать по локальному инфернсу через webgpu и сунул в форк hermesa
https://alexwortega.github.io/pi-agent/hermes/ я продолжаю угарать по локальному инфернсу через webgpu и сунул в форк hermesagent дистил 4b qwen3.5 который бегает у вас на маке и притворяется что 4b вообще для чего то полезны(нет)

Вихри как проект был осонован мной глядя на тотальную неспоснобность команд в россии сделать нормальную ллмку для людей, в момент когда я начинал эту движуху у меня была только довольно жирная зарплата, навык и несколько гпу. Это вообще не планировалось как что то большое, выложить пару удачных моделей и все. Потом я решил еще повливать своих денег, набрать побольше реклам в LDT и подистилить gpt4, потом я захотел еще поигратся с аудио и мы стали делать SALT и Borealis. В это время Серега удачно переделал бенчи на русский и сделал отличную Vikhr Nemo 12b, ru arena hard. [тут мы довольно удачно залетели на воркшоп EMNLP, спасибо нашему научному консультанту/руководителю] Мы планировали скейлится и поднимать денег, брать комерческие заказы, но реальность российского рынка примерно такая: если у вас нет горы денег от материнской компании - вам пизда. А еще нам прилетатает ACL претензия от Сбера за авторством (Сергей Марков, Алена Феногенова ...) что МЕРA мы меряем неверно и в целом занимаемся наебом. В целом крайне забавно смотреть как трестся столь большое начальство, статью мы отозвали по итогу тк не хотелось подставлять нашего научного консультанта, а я начал заниматся более важными для себя вещами чем русский опенсурс. По состоянию на март 2026 я могу сказать что пациент скорее мертв, бигтехи не тянут конкуренцию не с китайем не с америкой (простите я не хочу сравнивать мистралем), а проект не будет обновлятся по крайней мере централизовано. За все время было потрачено ~70к долларов моих личных денег, а несколько ребят получившие опыт на Вихрях довольно успешно устроились на работу. К слову мы не получили не копейки от рутуба, газпрома, ингостраха и нескольких других компаний использующих наши модели. НО СКОЛЬКО УДОВОЛЬСТВИЯ Я ПОЛУЧИЛ НАБЛЮДАЯ ЗА ТРЯСКОЙ СЕРГЕЯ... Я бы повторил.3

tldr: Rust backend engineer, $80k-$150k + equity, relocation to Paris Ищем rust-бекендера в White Circle – перекладывать JSONы в Postgres, перекладывать в ClickHouse, перекладывать в воркеры в RedPanda, которые потом снова перекладывают в базы + перекладывать в Redis, чтобы потом быстро перекладывать на фронт. Короч делать все, чтобы продукт двигался вперед. Мы занимаемся AI Security & Observability: представьте себе Datadog/Sentry, но для AI/LLM/Агентов. Мы нормальный-AI-стартап-не-ChatGPT-враппер: свои LLMки, куча бенчмарков, куча данных + есть клиенты: обрабатываем сотни миллионов запросов в месяц, получаем revenue. Зарейзили $11mln на cиде, среди наших инвесторов ко-фаундеры HuggingFace, Mistral и C-level из OpenAI, Datadog, Senty, Anthropic и других крутых компаний. Откликаться – сюда У нас вообще еще пачка вакансий есть. Ищем: • Продакт инженера на фронт (next.js) • Продакт инженера на бекенд (раст) • Аудио-инженераMLE / MLOps / Inference EngineerData Scientist

Бета релиз Borealis 5b - 4b qwen + whisper + сделали плагин для vllm + теперь оно работает с инструкциям и может решать задачи qa, cls, summarize, json mode Модель на hf

Для чего вы используете audio llm типа qwen audio, voxtral? Используете ли?

Repost from LLM Arena
🔫 GenCode Mini Gallery Bench LLM Arena совместно с Сергеем Курбановым (руководитель направления RnD в компании MWS) рады пре
🔫 GenCode Mini Gallery Bench LLM Arena совместно с Сергеем Курбановым (руководитель направления RnD в компании MWS) рады представить новый бенчмарк. 📈 LLM стремительно эволюционируют и выходят на уровень AGENT-поведения, где модели решают задачи от анализа данных до полноценной разработки. На этом фоне особенно интересно посмотреть на то, как модели в режиме реального времени справляются даже с такими, на первый взгляд, простыми задачами вёрстки. GenCode Mini Bench не содержит выводов — только чистый эксперимент и результат работы моделей. Да, это не совсем привычный бенчмарк, но надеемся, что вам понравится его формат. Кроме того, там подключена форма обратной связи, где вы можете прислать собственные промпты, а мы каждые 2 недели будем обновлять его содержимое. Генерации обновляются каждые 6 часов, поэтому заглядываете периодически, чтобы посмотреть на результаты различных моделей. ❗️ Модели, используемые для генераций доступны по API на VSELLM ♾ Вкладка с бенчмарком доступна на https://llmarena.ru/ или напрямую по ссылке https://clocks.llmarena.ru/. 📸 Ждем вашего мнения и обратной связи.

🤖 Хотите больше информации про наши последние релизы? 10 декабря на «Салют, Гига!» мы подробно расскажем, что сделали за этот год в командах GigaChat, Kandinsky и GigaData (платформы для управления данными, аналитики и поиска в контексте ИИ-моделей и сервисов). От архитектур и метрик до подходов, решений и планов на будущее. Будут доклады от инженеров, разборы под капотом, постерная сессия с командами и возможность задать любые технические вопросы тем, кто эти модели создаёт. Мы делаем формат максимально полезным для тех, кто работает с ML, данными, исследовательскими пайплайнами или инфраструктурой. Присоединяйтесь офлайн или онлайн, участие бесплатное. ➡️Вот ссылка на регистрацию. Будем рады видеть всех 10 декабря.

Repost from GigaChat
🔥МЫ ПРЕДСТАВЛЯЕМ КРУПНЕЙШИЙ OPEN-SOURCE AI В ЕВРОПЕ 🔥 Мы стремимся не замыкаться в «закрытой» технологии, а строить открыту
🔥МЫ ПРЕДСТАВЛЯЕМ КРУПНЕЙШИЙ OPEN-SOURCE AI В ЕВРОПЕ 🔥 Мы стремимся не замыкаться в «закрытой» технологии, а строить открытую платформу для всей страны, поэтому мы публикуем веса наших моделей Что появилось в открытом доступе ↓
🔷 GigaChat Ultra Preview Самая мощная модель Сбера. Лучше DeepSeek V3.1 и GigaChat Max 2 в русскоязычных задачах. Подходит для бизнеса, аналитики, разработки и дообучения на ваших данных ➡ GitHub | HuggingFace |GitVerse
GigaAM-v3 Пять моделей, которые превращают голос в текст с пунктуацией, понимают акценты, спонтанную речь и даже музыкальные запросы. Подойдут для голосовых ассистентов, контакт-центров, аналитики звонков ➡ GitHub | HuggingFace | GitVerse
🔷 GigaChat Lightning Лёгкая, компактная и быстрая. Конкурирует с Qwen3-4B, по скорости сравнима с Qwen3-1.7B, но намного умнее и больше по параметрам ➡ GitHub | HuggingFace |GitVerse
🔷 Kandinsky 5.0 Создание фото и видео по тексту. Внутри: • Image Lite — делает изображения в HD, отлично понимает русский язык и культурный контекст • Video Pro — создаёт до 10 секунд реалистичного HD-видео. Конкурирует с топовыми мировыми моделями • Video Lite — облегчённая версия для домашней видеокарты (от 12 ГБ) ➡️ GitHub | GitVerse | Hugging Face | Технический репорт
🔷 K-VAE 1.0 Ускорение генеративного AI. Это технологии, которые «упаковывают» картинки и видео в скрытое пространство, чтобы модели работали быстрее и требовали меньше ресурсов. Лучшие среди открытых аналогов ➡️ GitHub|Hugging Face
Код и веса этих всех моделей теперь доступны всем пользователям по лицензии MIT, в том числе для использования в коммерческих целях

Ксюша довезла постер!
Ксюша довезла постер!

Repost from Avito. Press room
🚀 Технологическая платформа Авито открывает доступ к собственным ИИ-моделям, в разработку которых компания вложила около пол
🚀 Технологическая платформа Авито открывает доступ к собственным ИИ-моделям, в разработку которых компания вложила около полумиллиарда рублей A-Vibe и A-Vision – это первые российские открытые модели с глубокой оптимизацией под русский язык, специально обученные для e-commerce. Разработчики, стартапы, бизнес и исследователи получат готовые инструменты для анализа документов, автоматизации контента и создания ИИ-ассистентов. Модели позволят сократить затраты ресурсов до 50% по сравнению с другими открытыми нейросетями. Модели умеют вызывать внешние инструменты (function calling), что позволяет создавать автономные системы и агенты. A-Vibe заняла первое место среди лёгких нейросетей в популярных открытых тестах: по пониманию русского языка, работе с кодом и решению сложных задач. Нейросети доступны бесплатно по лицензии Apache 2.0 для любого использования. 🎯 Где можно применять: — Бизнес: автоматизация контента, анализ документов, создание клиентских ассистентов — Разработка: дообучение под конкретные задачи на собственной инфраструктуре — Образование: инструмент для обучения и исследований — Наука: изучение мультимодальных технологий 🎁 Бонус для комьюнити: Команда Авито также перевела на русский язык 4 международных открытых набора задач для тестирования нейросетей – теперь все российские разработчики смогут использовать их для проверки своих больших языковых моделей. Модели доступны на Hugging Face с подробной документацией и примерами использования! 🔗

Repost from Krist/Blog
RuQualBench 🐸 Я сделал бенчмарк для оценки качества русского языка в LLM. Подробности: - Набор из 100 (по умолчанию)/250/500
RuQualBench 🐸 Я сделал бенчмарк для оценки качества русского языка в LLM. Подробности: - Набор из 100 (по умолчанию)/250/500 вопросов по general chat/creative writing доменам. - LLM as a Judge, но с четкими критериями разметки ответов. - Упор на типичные для LLM ошибки на русском (перепутанные рода, "китайщина", выдуманные слова). - Всё под открытой лицензией! Анализ результатов: - Лучшими моделями всё еще остаются закрытые (в частности, Sonnet 4.5, Gemini, GPT-4o). Но некоторые открытые очень близки. - GPT-5 ужасна. Я думал, что она лучше. - Из открытых моделей Gemma-3-27b-it и Vistral-24B оказались вне конкуренции. - Ruadapt значительно уменьшает количество ошибок относительно Qwen. - Qwen3 и GPT-oss очень плохи. Даже хуже, чем я ожидал. - Qwen3-Next лучше, чем Qwen3. Похоже, туда долили русского языка. - У DeepSeek V3 мало ошибок, но актуальная V3.2-Exp почти в 2 раза хуже. Лидерборд, код и данные

Repost from Pavel Zloi
Давно мечтал разобраться с тем как конвертировать в GGUF без потерь в качестве, чтобы оного добиться необходимо использовать
Давно мечтал разобраться с тем как конвертировать в GGUF без потерь в качестве, чтобы оного добиться необходимо использовать калибровочный датасет, но как подружить датасет, GGUF и инструменты квантизации для меня было неведомо. Поэтому решил изучить тему сам и рассказать вам в моей новенькой публикации "GGUF: квантизация с калибровкой (imatrix)" на Хабр. UPD. На примере модельки ai-sage/GigaChat-20B-A3B-instruct #habr #gguf

⚪️ White Circle Всем привет, мы делаем лучшую AI safety платформу, чтобы модельки не делали rm -rf без вашего ведома Про нас: - Подняли 💸 $10m 💸, инвесторы — топы OpenAI, Anthropic, Deepmind, Mistral, HuggingFace, etc - Команда из 10 человек с офисом в самом центре Парижа - Обрабатываем десятки миллионов API запросов в месяц - 🍴 80-150к USD Вакансии: 1. FullStack Engineer Typescript, React, Nextjs, Nodejs, Tailwind, GraphQL, ClickHouse 2. AI Engineer MoE, multimodality (audio / images), Megatron, distributed training, Triton 3. AI Engineer Redteaming, agents, rlhf - если у вас нет опыта на mle, но есть опыт swe и построения всякого промптового - позиция для вас 📨 CV → https://forms.gle/XysjrjHgxiRicGsb6

📆GigaChat Audio Day Nizhniy 🚀В начале октября ездили командой речевых технологий в Нижний Новгород с митапом. Поделились на
📆GigaChat Audio Day Nizhniy 🚀В начале октября ездили командой речевых технологий в Нижний Новгород с митапом. Поделились нашими разработками, познакомились с интересными ребятами и очень продуктивно провели время в столице закатов. ➡️Записи докладов уже доступны VK | YouTube 🔘Как мы сделали production ASR для новых языков на 10 часах данных (Андрей Кузьменко) 🔘Распознавание речи по спикерам в SaluteSpeech: от моделей и алгоритмов до production-оптимизаций (Никита Ноев и Михаил Кузьмин) 🔘Быстрые команды (Юлия Кокорина и Максим Сурков) 🔘GigaChat Audio: как мы добавили поддержку суммаризации видео длительностью 3 часа в мультимодальной LLM (Григорий Фёдоров) Смотрите, ставьте лайки, приходите на наши будущие мероприятия: следующее пройдёт в Москве уже в декабре — stay tuned.