Vikhr models
Open in Telegram
Vikhr models news feed Задонатить можно: - Наш сайт: https://vikhr.org Чат сообщества: @vikhrmodels
Show more2 595
Subscribers
No data24 hours
+87 days
+1130 days
Posts Archive
2 595
Repost from Love. Death. Transformers.
SIQ-1-35B
Короче я обучил qwen35b a3 с PPO и я первый раз в жизни увидел чтобы PPO докидывало нормально(reward был верифицируемый)
Эта штука на karpathy autoresearch для parametr golf лучше чем glm5.2 и qwen350b и генерит идеи похожие на опус
А еще она на bullshit бенч лучше чем NEX и gpt5.5
Модель + gguf:
https://huggingface.co/AlexWortega/SIQ-1-35B
Демо чтобы гонять на zero gpu и радоваться:
https://huggingface.co/spaces/AlexWortega/hermes-agent-zerogpu
2 595
Repost from Ruadaptная комната
31-я международная конференция по компьютерной лингвистике и интеллектуальным технологиям «Диалог» (https://dialogue-conf.org/)
24-26 июня 2026 года
Приглашаем прийти послушать доклады и принять участие в обсуждении достижений больших языковых моделей
и современной лингвистики
Приглашенные доклады:
Колмогорова Анастасия Владимировна
д-р филол.наук, профессор, профессор департамента филологии Школы гуманитарных наук и искусств НИУ ВШЭ СПб, академический руководитель магистерской программы «Языковые технологии в бизнесе и образовании», руководитель научной лаборатории языковой конвергенции
«Визуальные языковые модели в задаче описания картин»
Украинский Руслан Владимирович,
руководитель проекта Исследования и инновации Производственного управления компании «Гарант»
«От модели к агенту: как генеративный ИИ меняет работу с правовой информацией и разработку справочных правовых систем»
Подобряев Александр Владимирович,
phd, доцент школы лингвистики, ВШЭ
«Семантические компетенции больших языковых моделей»
Регистрация до 23 июня 2026 года
МЕСТО ПРОВЕДЕНИЯ
2-й гуманитарный корпус, факультет ВМК,
Ленинские горы, 1, стр. 52, северный вход, 2 этаж
2 595
Оно не адаптировано под русский и русский не стоял как основная цель при обучении, но в целом модель мне нравится
2 595
Repost from Love. Death. Transformers.
https://alexwortega.github.io/pi-agent/hermes/
я продолжаю угарать по локальному инфернсу через webgpu и сунул в форк hermesagent дистил 4b qwen3.5 который бегает у вас на маке и притворяется что 4b вообще для чего то полезны(нет)
2 595
Вихри как проект был осонован мной глядя на тотальную неспоснобность команд в россии сделать нормальную ллмку для людей, в момент когда я начинал эту движуху у меня была только довольно жирная зарплата, навык и несколько гпу.
Это вообще не планировалось как что то большое, выложить пару удачных моделей и все. Потом я решил еще повливать своих денег, набрать побольше реклам в LDT и подистилить gpt4, потом я захотел еще поигратся с аудио и мы стали делать SALT и Borealis.
В это время Серега удачно переделал бенчи на русский и сделал отличную Vikhr Nemo 12b, ru arena hard.
[тут мы довольно удачно залетели на воркшоп EMNLP, спасибо нашему научному консультанту/руководителю]
Мы планировали скейлится и поднимать денег, брать комерческие заказы, но реальность российского рынка примерно такая: если у вас нет горы денег от материнской компании - вам пизда. А еще нам прилетатает ACL претензия от Сбера за авторством (Сергей Марков, Алена Феногенова ...) что МЕРA мы меряем неверно и в целом занимаемся наебом.
В целом крайне забавно смотреть как трестся столь большое начальство, статью мы отозвали по итогу тк не хотелось подставлять нашего научного консультанта, а я начал заниматся более важными для себя вещами чем русский опенсурс.
По состоянию на март 2026 я могу сказать что пациент скорее мертв, бигтехи не тянут конкуренцию не с китайем не с америкой (простите я не хочу сравнивать мистралем), а проект не будет обновлятся по крайней мере централизовано. За все время было потрачено ~70к долларов моих личных денег, а несколько ребят получившие опыт на Вихрях довольно успешно устроились на работу.
К слову мы не получили не копейки от рутуба, газпрома, ингостраха и нескольких других компаний использующих наши модели.
НО СКОЛЬКО УДОВОЛЬСТВИЯ Я ПОЛУЧИЛ НАБЛЮДАЯ ЗА ТРЯСКОЙ СЕРГЕЯ... Я бы повторил.3
2 595
tldr: Rust backend engineer, $80k-$150k + equity, relocation to Paris
Ищем rust-бекендера в White Circle – перекладывать JSONы в Postgres, перекладывать в ClickHouse, перекладывать в воркеры в RedPanda, которые потом снова перекладывают в базы + перекладывать в Redis, чтобы потом быстро перекладывать на фронт. Короч делать все, чтобы продукт двигался вперед.
Мы занимаемся AI Security & Observability: представьте себе Datadog/Sentry, но для AI/LLM/Агентов. Мы нормальный-AI-стартап-не-ChatGPT-враппер: свои LLMки, куча бенчмарков, куча данных + есть клиенты: обрабатываем сотни миллионов запросов в месяц, получаем revenue. Зарейзили $11mln на cиде, среди наших инвесторов ко-фаундеры HuggingFace, Mistral и C-level из OpenAI, Datadog, Senty, Anthropic и других крутых компаний.
Откликаться – сюда
У нас вообще еще пачка вакансий есть. Ищем:
• Продакт инженера на фронт (next.js)
• Продакт инженера на бекенд (раст)
• Аудио-инженера
• MLE / MLOps / Inference Engineer
• Data Scientist
2 595
Бета релиз Borealis 5b - 4b qwen + whisper + сделали плагин для vllm + теперь оно работает с инструкциям и может решать задачи qa, cls, summarize, json mode
Модель на hf
2 595
Repost from LLM Arena
🔫 GenCode Mini Gallery Bench
LLM Arena совместно с Сергеем Курбановым (руководитель направления RnD в компании MWS) рады представить новый бенчмарк.
📈 LLM стремительно эволюционируют и выходят на уровень AGENT-поведения, где модели решают задачи от анализа данных до полноценной разработки. На этом фоне особенно интересно посмотреть на то, как модели в режиме реального времени справляются даже с такими, на первый взгляд, простыми задачами вёрстки.
GenCode Mini Bench не содержит выводов — только чистый эксперимент и результат работы моделей.
Да, это не совсем привычный бенчмарк, но надеемся, что вам понравится его формат. Кроме того, там подключена форма обратной связи, где вы можете прислать собственные промпты, а мы каждые 2 недели будем обновлять его содержимое.
Генерации обновляются каждые 6 часов, поэтому заглядываете периодически, чтобы посмотреть на результаты различных моделей.
❗️ Модели, используемые для генераций доступны по API на VSELLM
♾ Вкладка с бенчмарком доступна на https://llmarena.ru/ или напрямую по ссылке https://clocks.llmarena.ru/.
📸 Ждем вашего мнения и обратной связи.
2 595
Repost from GigaDev — разработка GigaChat
🤖 Хотите больше информации про наши последние релизы?
10 декабря на «Салют, Гига!» мы подробно расскажем, что сделали за этот год в командах GigaChat, Kandinsky и GigaData (платформы для управления данными, аналитики и поиска в контексте ИИ-моделей и сервисов).
От архитектур и метрик до подходов, решений и планов на будущее.
Будут доклады от инженеров, разборы под капотом, постерная сессия с командами и возможность задать любые технические вопросы тем, кто эти модели создаёт.
Мы делаем формат максимально полезным для тех, кто работает с ML, данными, исследовательскими пайплайнами или инфраструктурой.
Присоединяйтесь офлайн или онлайн, участие бесплатное.
➡️Вот ссылка на регистрацию.
Будем рады видеть всех 10 декабря.
2 595
Repost from GigaChat
🔥МЫ ПРЕДСТАВЛЯЕМ КРУПНЕЙШИЙ OPEN-SOURCE AI В ЕВРОПЕ 🔥
Мы стремимся не замыкаться в «закрытой» технологии, а строить открытую платформу для всей страны, поэтому мы публикуем веса наших моделей
Что появилось в открытом доступе ↓
🔷 GigaChat Ultra Preview Самая мощная модель Сбера. Лучше DeepSeek V3.1 и GigaChat Max 2 в русскоязычных задачах. Подходит для бизнеса, аналитики, разработки и дообучения на ваших данных ➡ GitHub | HuggingFace |GitVerse
GigaAM-v3 Пять моделей, которые превращают голос в текст с пунктуацией, понимают акценты, спонтанную речь и даже музыкальные запросы. Подойдут для голосовых ассистентов, контакт-центров, аналитики звонков ➡ GitHub | HuggingFace | GitVerse
🔷 GigaChat Lightning Лёгкая, компактная и быстрая. Конкурирует с Qwen3-4B, по скорости сравнима с Qwen3-1.7B, но намного умнее и больше по параметрам ➡ GitHub | HuggingFace |GitVerse
🔷 Kandinsky 5.0 Создание фото и видео по тексту. Внутри: • Image Lite — делает изображения в HD, отлично понимает русский язык и культурный контекст • Video Pro — создаёт до 10 секунд реалистичного HD-видео. Конкурирует с топовыми мировыми моделями • Video Lite — облегчённая версия для домашней видеокарты (от 12 ГБ) ➡️ GitHub | GitVerse | Hugging Face | Технический репорт
🔷 K-VAE 1.0 Ускорение генеративного AI. Это технологии, которые «упаковывают» картинки и видео в скрытое пространство, чтобы модели работали быстрее и требовали меньше ресурсов. Лучшие среди открытых аналогов ➡️ GitHub|Hugging FaceКод и веса этих всех моделей теперь доступны всем пользователям по лицензии MIT, в том числе для использования в коммерческих целях
2 595
Repost from Avito. Press room
🚀 Технологическая платформа Авито открывает доступ к собственным ИИ-моделям, в разработку которых компания вложила около полумиллиарда рублей
A-Vibe и A-Vision – это первые российские открытые модели с глубокой оптимизацией под русский язык, специально обученные для e-commerce.
Разработчики, стартапы, бизнес и исследователи получат готовые инструменты для анализа документов, автоматизации контента и создания ИИ-ассистентов. Модели позволят сократить затраты ресурсов до 50% по сравнению с другими открытыми нейросетями. Модели умеют вызывать внешние инструменты (function calling), что позволяет создавать автономные системы и агенты.
A-Vibe заняла первое место среди лёгких нейросетей в популярных открытых тестах: по пониманию русского языка, работе с кодом и решению сложных задач. Нейросети доступны бесплатно по лицензии Apache 2.0 для любого использования.
🎯 Где можно применять:
— Бизнес: автоматизация контента, анализ документов, создание клиентских ассистентов
— Разработка: дообучение под конкретные задачи на собственной инфраструктуре
— Образование: инструмент для обучения и исследований
— Наука: изучение мультимодальных технологий
🎁 Бонус для комьюнити:
Команда Авито также перевела на русский язык 4 международных открытых набора задач для тестирования нейросетей – теперь все российские разработчики смогут использовать их для проверки своих больших языковых моделей.
Модели доступны на Hugging Face с подробной документацией и примерами использования! 🔗
2 595
Repost from Krist/Blog
RuQualBench 🐸
Я сделал бенчмарк для оценки качества русского языка в LLM. Подробности:
- Набор из 100 (по умолчанию)/250/500 вопросов по general chat/creative writing доменам.
- LLM as a Judge, но с четкими критериями разметки ответов.
- Упор на типичные для LLM ошибки на русском (перепутанные рода, "китайщина", выдуманные слова).
- Всё под открытой лицензией!
Анализ результатов:
- Лучшими моделями всё еще остаются закрытые (в частности, Sonnet 4.5, Gemini, GPT-4o). Но некоторые открытые очень близки.
- GPT-5 ужасна. Я думал, что она лучше.
- Из открытых моделей Gemma-3-27b-it и Vistral-24B оказались вне конкуренции.
- Ruadapt значительно уменьшает количество ошибок относительно Qwen.
- Qwen3 и GPT-oss очень плохи. Даже хуже, чем я ожидал.
- Qwen3-Next лучше, чем Qwen3. Похоже, туда долили русского языка.
- У DeepSeek V3 мало ошибок, но актуальная V3.2-Exp почти в 2 раза хуже.
Лидерборд, код и данные
2 595
Repost from Pavel Zloi
Давно мечтал разобраться с тем как конвертировать в GGUF без потерь в качестве, чтобы оного добиться необходимо использовать калибровочный датасет, но как подружить датасет, GGUF и инструменты квантизации для меня было неведомо.
Поэтому решил изучить тему сам и рассказать вам в моей новенькой публикации "GGUF: квантизация с калибровкой (imatrix)" на Хабр.
UPD. На примере модельки ai-sage/GigaChat-20B-A3B-instruct
#habr #gguf
2 595
⚪️ White Circle
Всем привет, мы делаем лучшую AI safety платформу, чтобы модельки не делали rm -rf без вашего ведома
Про нас:
- Подняли 💸 $10m 💸, инвесторы — топы OpenAI, Anthropic, Deepmind, Mistral, HuggingFace, etc
- Команда из 10 человек с офисом в самом центре Парижа
- Обрабатываем десятки миллионов API запросов в месяц
- 🍴 80-150к USD
Вакансии:
1. FullStack Engineer
Typescript, React, Nextjs, Nodejs, Tailwind, GraphQL, ClickHouse
2. AI Engineer
MoE, multimodality (audio / images), Megatron, distributed training, Triton
3. AI Engineer
Redteaming, agents, rlhf - если у вас нет опыта на mle, но есть опыт swe и построения всякого промптового - позиция для вас
📨 CV → https://forms.gle/XysjrjHgxiRicGsb6
2 595
Repost from GigaDev — разработка GigaChat
📆GigaChat Audio Day Nizhniy
🚀В начале октября ездили командой речевых технологий в Нижний Новгород с митапом. Поделились нашими разработками, познакомились с интересными ребятами и очень продуктивно провели время в столице закатов.
➡️Записи докладов уже доступны VK | YouTube
🔘Как мы сделали production ASR для новых языков на 10 часах данных (Андрей Кузьменко)
🔘Распознавание речи по спикерам в SaluteSpeech: от моделей и алгоритмов до production-оптимизаций (Никита Ноев и Михаил Кузьмин)
🔘Быстрые команды (Юлия Кокорина и Максим Сурков)
🔘GigaChat Audio: как мы добавили поддержку суммаризации видео длительностью 3 часа в мультимодальной LLM (Григорий Фёдоров)
Смотрите, ставьте лайки, приходите на наши будущие мероприятия: следующее пройдёт в Москве уже в декабре — stay tuned.
