en
Feedback
Технозаметки Малышева

Технозаметки Малышева

Open in Telegram

Новости инноваций из мира Искусственного Интеллекта. 🤖 [РКН: 7021469833 ] Всё об ИИ, ИТ трендах и Технологической Сингулярности. 🤖: @ai_gptfreebot [бесплатный бот] ✍️: @tsingular_bot [каталог ботов и курсов] 💸: https://pay.cloudtips.ru/p/c8960bbb

Show more

📈 Analytical overview of Telegram channel Технозаметки Малышева

Channel Технозаметки Малышева (@tsingular) in the Russian language segment is an active participant. Currently, the community unites 12 761 subscribers, ranking 9 532 in the Technologies & Applications category and 50 416 in the Russia region.

📊 Audience metrics and dynamics

Since its creation on невідомо, the project has demonstrated rapid growth, gathering an audience of 12 761 subscribers.

According to the latest data from 22 September, 2026, the channel demonstrates stable activity. Although there has been a change in the number of participants by 918 over the last 30 days and by 27 over the last 24 hours, overall reach remains high.

  • Verification status: Not verified
  • Engagement rate (ER): The average audience engagement rate is 20.74%. Within the first 24 hours after publication, content typically collects 15.26% reactions from the total number of subscribers.
  • Post reach: On average, each post receives 2 647 views. Within the first day, a publication typically gains 1 948 views.
  • Reactions and interaction: The audience actively supports content: the average number of reactions per post is 31.
  • Thematic interests: Content is focused on key topics such as claude, openai, openclaw, hermes, opus.

📝 Description and content policy

The author describes the resource as a platform for expressing subjective opinions:
Новости инноваций из мира Искусственного Интеллекта. 🤖 [РКН: 7021469833 ] Всё об ИИ, ИТ трендах и Технологической Сингулярности. 🤖: @ai_gptfreebot [бесплатный бот] ✍️: @tsingular_bot [каталог ботов и курсов] 💸: https://pay.cloudtips.ru/p/c8960...

Thanks to the high frequency of updates (latest data received on 23 September, 2026), the channel maintains relevance and a high level of publication reach. Analytics show that the audience actively interacts with content, making it an important point of influence in the Technologies & Applications category.

12 761
Subscribers
+2724 hours
+3097 days
+91830 days
Attracting Subscribers
September '26
September '26
+973
in 24 channels
August '26
+304
in 21 channels
Get PRO
July '26
+269
in 18 channels
Get PRO
June '26
+337
in 18 channels
Get PRO
May '26
+515
in 20 channels
Get PRO
April '26
+416
in 19 channels
Get PRO
March '26
+712
in 24 channels
Get PRO
February '26
+1 529
in 36 channels
Get PRO
January '26
+561
in 12 channels
Get PRO
December '25
+529
in 14 channels
Get PRO
November '25
+1 037
in 32 channels
Get PRO
October '25
+803
in 26 channels
Get PRO
September '25
+406
in 16 channels
Get PRO
August '25
+422
in 27 channels
Get PRO
July '25
+586
in 20 channels
Get PRO
June '25
+549
in 13 channels
Get PRO
May '25
+447
in 11 channels
Get PRO
April '25
+542
in 9 channels
Get PRO
March '25
+424
in 5 channels
Get PRO
February '25
+690
in 8 channels
Get PRO
January '25
+450
in 14 channels
Get PRO
December '24
+344
in 3 channels
Get PRO
November '24
+356
in 1 channels
Get PRO
October '24
+422
in 6 channels
Get PRO
September '24
+1 198
in 8 channels
Get PRO
August '24
+1 388
in 7 channels
Get PRO
July '24
+34
in 1 channels
Get PRO
June '24
+28
in 0 channels
Get PRO
May '24
+47
in 0 channels
Get PRO
April '24
+35
in 0 channels
Get PRO
March '24
+250
in 2 channels
Date
Subscriber Growth
Mentions
Channels
23 September0
22 September+28
21 September+16
20 September+11
19 September+19
18 September+44
17 September+195
16 September+16
15 September+8
14 September+17
13 September+9
12 September+8
11 September+11
10 September+10
09 September+34
08 September+29
07 September+363
06 September+20
05 September+66
04 September+24
03 September+17
02 September+8
01 September+20
Channel Posts
Repost from CodeCamp
+2
Claude Opus 5.5 оказался чертовски хорош в создании игр — первые демки выглядят потрясающе 🤩 Так, юзеры уже навайбкодили Dark Souls, Flight Simulator и Mario Kart. Причём последнюю, по словам автора, Claude ваншотнул. Системный промпт модели, кстати, уже вытащили и слили в сеть. Можете поизучать ☕️

2
Ааа!! ИМБА!! я сдвинул её с рельс!! It's alive, ALIVE! Змейка ищет кратчайший путь и старается выживать! Это вам не муха! тут
Ааа!! ИМБА!! я сдвинул её с рельс!! It's alive, ALIVE! Змейка ищет кратчайший путь и старается выживать! Это вам не муха! тут всего 6 мегабайт! #змейка ——— @tsingular
1 621
3
А вот и OpenAI: встречайте GPT-6 Sol и Luna. — обе модели ровно в 2 раза дешевле, чем их 5.6-версии. — общаться должны так же+2
А вот и OpenAI: встречайте GPT-6 Sol и Luna. — обе модели ровно в 2 раза дешевле, чем их 5.6-версии. — общаться должны так же понятно и без жаргона, как Astra — и... всё. Sol не лучше Astra (а во многом и хуже, в отличии от пары Fable <-> Opus), но сильно дешевле, и всё ещё лучше Sol 5.6. Поэтому модель может стать основной рабочей лошадкой, сохраняя ваши лимиты.
1 554
4
читаем полную версию венка сонетов в комментарии. ваши мысли? #венок #соннет #Opus ——— @tsingular
читаем полную версию венка сонетов в комментарии. ваши мысли? #венок #соннет #Opus ——— @tsingular
1 524
5
Традиционно, - проверяем новейшую модель через написание венка сонетов. Напиши венок сонетов о том как тихоходка наблюдает во
Традиционно, - проверяем новейшую модель через написание венка сонетов. Напиши венок сонетов о том как тихоходка наблюдает волны технологических сингулярностей сквозь эпохи Погнали #венок ——— @tsingular
1 514
6
🚀 Anthropic представила Claude Opus 5.5 Новая флагманская модель стала сильнее Opus 5, при этом работает быстрее и дешевле.
🚀 Anthropic представила Claude Opus 5.5 Новая флагманская модель стала сильнее Opus 5, при этом работает быстрее и дешевле. Что изменилось: - сильнее в агентном программировании, computer use и knowledge work - лучше справляется с длинными задачами и большими кодовыми базами - ответы стали короче и естественнее - улучшена устойчивость к prompt injection - Anthropic заявляет примерно на 40% более низкую стоимость на типичных задачах и более чем на 30% более быструю генерацию Из примеров: - один из ранних тестеров провёл миграцию 680 000 строк кода менее чем за день - в тесте Anthropic модель переписала HAProxy с C на Rust за 9,5 часа Цена API: - $4 / 1M входных токенов - $20 / 1M выходных токенов - $0,20 / 1M токенов при чтении кеша Бенчмарки: - Terminal-Bench 4.0 — 66,4% - FrontierCode v1.1 — 54,4% - Humanity’s Last Exam — 67,7% с инструментами Также Anthropic подтвердила, что Claude Sonnet 5.5 и Haiku 5.5 выйдут в ближайшие недели. https://www.anthropic.com/claude-opus-5-5
1 522
7
Последние 3 дня я прям сильно закопал агентов в тему с Recursive Self Improvement. Собственно это агентский цикл самоулучшени
Последние 3 дня я прям сильно закопал агентов в тему с Recursive Self Improvement. Собственно это агентский цикл самоулучшения. В основном агенты занимались разработкой сверхмалой модели по типу Jev которая смогла бы одновременно (это как раз сложно) играть в тетрис, змейку, уметь классифицировать логи и сортировать картинки. такой сверх-быстрый комбайн. определённый прогресс есть, все узкоспециализированные задачи модель размером в 1.8 млн параметров (7 мегабайт всего) выполняет. причём в тетрис играет лучше всего, в змейку - идеально но линейно, с остальным пока учится разбираться, но самое интересное что в ходе этой работы сам цикл самоулучшения постоянно дорабатывается. Вот тут версия на Питоне, сейчас переписывется на Rust и вот, сначала Гермес, потом Астра и затем Fable 5.1 собрали Универсальный RSI навык. он гигантский. Это не просто промпт, - это прям шаблоны инструкций для Мета RSI с примерами инструментов и процессов. навык, как обычно, в ИИзбранном ибо сложно и дорого. На всю историю уже около 1млрд токенов сожглось. (хочу безлимит) А тут в комментариях, - примеры результатов обучения модели. особенно радует скорость отклика в диапазоне 4-40мс #RSI #навыки ——— @tsingular
1 731
8
🌟 Xiaomi выпустила MiMo-V2.6 Pro и Flash Xiaomi закончила обучение серии MiMo-V2.6 и опубликовала веса флагманской Pro и обл
🌟 Xiaomi выпустила MiMo-V2.6 Pro и Flash Xiaomi закончила обучение серии MiMo-V2.6 и опубликовала веса флагманской Pro и облегчённой Flash. Обе модели омнимодальные, то есть принимают текст, изображения, видео и аудио. Рассчитаны на агентные задачи, кодинг, автоматизацию рабочих процессов, управление компьютером, кибербезопасность, генерацию 3D-объектов, воплощенное моделирование, создание музыки, научные и математические исследования. 🟡Архитектура У Pro 1,02 трлн параметров, из них 42 млрд активных, и 384 эксперта. У Flash 309 млрд параметров, 15 млрд активных и 256 экспертов. На каждый токен в обеих моделях работают восемь экспертов. Большая часть слоёв использует внимание со скользящим окном в 128 токенов, остальные – глобальное внимание: у Pro так устроены 60 слоёв из 70, у Flash 39 из 48. Визуальный энкодер на 681 млн параметров и два аудиоэнкодера на 308 и 127 млн у моделей одинаковые. Вывод ускоряет пятислойный спекулятивный декодер - за один проход он предлагает семь следующих токенов, основная модель проверяет их параллельно. Контекст – 1 млн токенов 🟡Бенчмарки По замерам самой Xiaomi Pro близка к закрытым флагманам в агентных тестах, но отстаёт в эксплуатации уязвимостей: DeepSWE v1.1: Pro – 71,9, Flash – 67,9, Claude Opus 5 – 74,0, GPT-5.6 Sol – 73,0; AutomationBench: Pro – 53,1, выше Opus 5 (50,3) и GPT-5.6 Sol (45,8); Terminal-Bench 4.0: Pro – 34,9 против 49,0 у Opus 5 и 42,4 у Claude Fable 5; ExploitBench: Pro – 47,9, Flash – 25,3 против 78,5 у GPT-5.6 Sol и 78,0 у Fable 5. Модели также доступны в AI Studio, MiMo Code, приложении MiMo Desktop, через API Xiaomi MiMo Open Platform и на OpenRouter. 📌Лицензирование: MIT 🟡Блогпост 🟡Веса 🟡Техотчет @ai_machinelearning_big_data #AI #ML #MMLM #MiMO #Xiaomi
1 504
9
Xiaomi представила MiMo-V2.6 с открытыми весами 👀 В семейство вошли две MoE-модели: - Flash: 309B параметров, 15B активных,
Xiaomi представила MiMo-V2.6 с открытыми весами 👀 В семейство вошли две MoE-модели: - Flash: 309B параметров, 15B активных, 177,8 ГБ в FP8 - Pro: 1,02T параметров, 42B активных, 573,5 ГБ в FP8 Обе поддерживают контекст до 1 млн токенов и работают с текстом, изображениями, видео и аудио. После квантизации в NVFP4 требования к памяти можно сократить примерно вдвое. По предварительным оценкам, Flash поместится на 1-2 DGX Spark, Pro потребует около четырёх. В указанном репозитории опубликована отдельная дистиллированная версия на базе Qwen 9B, а не веса Flash или Pro. https://huggingface.co/XiaomiMiMo/MiMo-V2.6-Distill-Qwen-9B
1
10
Qwen4 уже скоро. #Qwen ——— @tsingular
Qwen4 уже скоро. #Qwen ——— @tsingular
2 115
11
Cisco выложила в открытый доступ SOC Cockpit: командный дашборд для менеджеров SOC с ИИ-помощником Keo, который отвечает толь
Cisco выложила в открытый доступ SOC Cockpit: командный дашборд для менеджеров SOC с ИИ-помощником Keo, который отвечает только по данным инструмента SOC Cockpit, - это веб-консоль оперативного управления для руководителей SOC. Не SIEM или SOAR, а тот слой, который обычно живёт в табличке Excel на ноутбуке менеджеров: смены, планёрки, задачи, KPI. 🧠 Что внутри: Командный дашборд: готовность самого SOC, статусыSLA/KPI, оценка рисков в реальном времени, расписание смен 24/7 Планировщик смен с будущими датами и подсказками по разрывам в расписании Планёрки с матрицей Эйзенхауэра: Do, Delegate, Delay, Discard, у каждой задачи лид, длительность и статус Реестр проблем и KPI/SLA с трендами, которые берутся из интегрируемых систем Автогенерация отчёта для руководства (bottom line, wins, concerns, decisions), работает даже без LLM 🔐 Keo: ИИ-помощник с привязкой к фактам: Ценность помощника в SOC упирается в доверие, поэтому Keo отвечает строго по живым данным кокпита: смены, открытые проблемы, цели, KPI, заметки берутся из системы и подтверждены источниками. Рутинные вопросы вроде «какая смена работает на следующей неделе» или «какие не закрытые задачи остались с прошлого месяца» выводятся прямо из базы, без модели. Интегрируется с любым OpenAI-совместимым эндпоинтом, - можно привязать к Ollama или vLLM локально и данные не покинут периметр. 💼 Зачем бизнесу: Операционный слой SOC получает общее хранилище с историей вместо чата и таблички у дежурного. Полностью self-hosted сценарий: SQLite внутри, свой LLM, никакие данные не передаются наружу, - для ИБ это фундаментальная потребность. Вообще в наше время навайбкодить такое, - 1 день, но приятно что Cisco думает о пользователях и публикует вендоркий вариант интеллектуального дашборда. #SOCCockpit #Cisco #SOC #cybersecurity ——— @tsingular | Max | YouTube | RuTube | VK | VK Video | Дзен
1 999
12
Unitree представили новые руки для роботов. ловкая кисть Unitree Dex5-S с 22 степени свободы Размер 1:1 с человеческой рукой
Unitree представили новые руки для роботов. ловкая кисть Unitree Dex5-S с 22 степени свободы Размер 1:1 с человеческой рукой Прецизионная биомиметическая ловкая кисть, цена от $6 500 (без учёта налогов и доставки). Все 22 сустава — с плавными тактильными приводами, каждый оснащён защитой от предельного ударного момента. Как раз в продолжение сегодняшнего обсуждения о недостающем 1% для плетения лаптей 😀 #Unitree #роботы #руки ------ @tsingular
2 239
13
В принципе, когда все камеры мира будут писать с качеством из которого можно будет воссоздать подобную 3Д сцену, обычные фото
В принципе, когда все камеры мира будут писать с качеством из которого можно будет воссоздать подобную 3Д сцену, обычные фотографии устареют. Можно будет вернуться в любой момент времени, подобрать нужный ракурс, а нейронка достроит недостающее Автор: joergkahlhoefer #gaussian #splat #3D ------ @tsingular
3 344
14
Qoder раздаёт бесплатный доступ к Qwen3.8-Flash до 30 сентября https://docs.qoder.com/events/flashoffer Период проведения акц
Qoder раздаёт бесплатный доступ к Qwen3.8-Flash до 30 сентября https://docs.qoder.com/events/flashoffer Период проведения акции : с 18 сентября 2026 г., 10:00, по 30 сентября 2026 г., 23:59:59. Условия участия : Все новые и существующие индивидуальные пользователи Qoder International, включая пользователей тарифных планов Free, Pro Trial, Pro, Pro+ и Ultra. Подписчики Teams и Enterprise не имеют права участвовать. Модель : Qwen3.8-Flash. Предложение : Стоимость этой модели снижена с 0,1× до 0,0×. Работа с этой моделью не расходует кредиты. Активация : Предложение применяется автоматически, активация не требуется. Вы можете использовать эту модель даже при нулевом балансе кредитов. В период проведения акции Qwen3.8-Flash испытывает высокий спрос, поэтому в часы пик скорость ответа может быть ниже. #Qoder #free #Qwen ——— @tsingular
2 140
15
Grok 4.7 обновили. Способен работать вдвое дольше за те же деньги SpaceXAI выпустила Grok 4.7, флагман для кодинга и работы с+3
Grok 4.7 обновили. Способен работать вдвое дольше за те же деньги SpaceXAI выпустила Grok 4.7, флагман для кодинга и работы со знаниями. База крупнее, чем у 4.6, обучение шло дольше и на задачах, которые человек решает часами, защиту переписали целиком. Цена не изменилась: 2 доллара за миллион входных токенов, 6 за миллион выходных. Быстрый вариант вдвое быстрее и вдвое дороже. ⚙️ Главный прирост в терминале: на Terminal-Bench 4.0, где модель часами работает в командной строке, результат вырос с 20,3% до 38,0%. В CursorBench 4.0 прирост скромнее: 40,4% против 46,3%. Подтянулись документы и презентации: 1657 против 1546 у 4.6. Модель отдельно учили понимать среду Grok Bot. 📊 Где конкуренты впереди: Fable 5.1 сильнее в CursorBench 4.0 (51,8%), Terminal-Bench (57,9%) и HealthBench (62,1%). Но дороже в 5 раз - 10 и 50 долларов за миллион токенов. GPT-5.6 Sol дороже в два-три раза и проигрывает почти по всем строкам. 🛡 Защита переписана целиком. SpaceXAI называет новый стек самым устойчивым к взлому среди своих моделей: на HackerBench v0.3 проходит только 3,3% опасных двойных запросов, биологическая безопасность по LatchBio 62,4%. Отдельным партнёрам по кибербезопасности открыли доступ к редтимингу командами по приглашеню. Уже доступна в Cursor, Grok Build и API, а также у облачных провайдеров. Между 4.5 и 4.7 прошло всего два с половиной месяца, а Grok 4.8 на 2,5 триллиона параметров, по словам Маска, уже учится. Модели выходят быстрее, чем вы успеваете к ним привыкнуть, не то что внедрить. #Grok #SpaceXAI ——— @tsingular
2 080
16
Счётчик AGI сдвинулся на 99%: гуманоид Figure впервые поработал в 30 незнакомых квартирах без единой минуты обучения там Комп
Счётчик AGI сдвинулся на 99%: гуманоид Figure впервые поработал в 30 незнакомых квартирах без единой минуты обучения там Компания Figure выкатила Helix 2.5, - самую продвинутую свою нейросеть. Управляемый ею робот зашёл в 30 незнакомых домов Калифорнии и сразу приступил к работе: ни минуты сбора данных, ни файнтюнинга в этих квартирах. Счётчик AGI Алана Томпсона, всё лето стоявший на 98%, сдвинулся на 99%: Helix 2.5 закрыл Woz-тест в масштабе. ⚛️ За счёт чего получилось: Helix 2.5 претренировали на Index, - датасете человеческого поведения, прирастающем на ~35 минут новых данных каждую секунду. Из одной базовой модели сделали три поведения: уборка гостиной, складывание полотенец, заправка кровати. Претрейн на Index сам по себе поднял zero-shot успех с 9% до 56% (строгая оценка: всё или ничего, зачёт только за полностью выполненную задачу). Если сравнивать с Helix 02, то получается вдвое меньше данных, специфичных для конкретной задаче при генерализации, охватывающий в 30 раз более широкий диапазон. 🧠 Впервые измерен scaling law переноса человек-робот: Каждое удвоение данных Index закономерно улучшало предсказание действий робота, - как в языковых моделях. Точность такая, что лосс крупнейшего прогона предсказали до старта обучения: ошибка 0.54% на диапазоне 8x. Figure: рецепт уже знаком по другим областям ИИ: широко учись на претрейне, задай поведение один раз, генерализуй на развёртывании. На тренировку Helix влили $3.5 млрд вычислений. 💼 Зачем бизнесу: Zero-shot успех в незнакомой обстановке закрывает парадигму «учим робота под каждое место отдельно» и позволяет быстро масштабироваться. Самокоррекция всего тела по классам действий, - "отойти, сменить стойку, обойти препятствие", позволяет доводить длинные задачи до конца без человека. Оставшийся 1% в AGI счётчике Алана, - тонкая моторика многошаговой сборки на уровне среднего человека. Чуть чуть осталось. Может до Нового Года как раз. #Helix #Figure #робототехника #AGI #ИИ ——— @tsingular | Max | YouTube | RuTube | VK | VK Video | Дзен
2 396
17
Autodesk открывает Fusion для AI-агентов 📋 Autodesk, - компания, больше сорока лет задающая стандарты проектирования, на про
Autodesk открывает Fusion для AI-агентов 📋 Autodesk, - компания, больше сорока лет задающая стандарты проектирования, на прошлой неделе на Autodesk University 2026 выкатили Fusion Compute MCP в публичную бету. MCP сервер дает ИИ агенту доступ практически ко всему функционалу Fusion напрямую. 💡 Под капотом - больше 7000 api вызовов, собранных в единый инструмент через TypeScript API. Почти всё, что инженер делает в десктопном Fusion, агент выполняет в облаке прямо на рабочих документах: сессия стартует за секунды, живёт до часа, работает через Claude, Antigravity, VS Code, Codex и любой совместимый с MCP инструмент. 💼 Демо показывают цепочку действий, которую человеческая команда обычно выполняет за несколько дней: агент проектирует корпус для одноплатника, строит пресс-форму с матрицей и пуансоном, программирует черновое и чистовое фрезерование обеих плит, и управляющие программы генерируются примерно за шесть с половиной секунд. В другом кейсе, роботе-газонокосилке на 1100 деталей, четыре параллельных субагента перекрашивают модель, каждый в своём облачном инстансе. 💡 При этом MCP даёт среду и инструменты: что агент соберёт, решает модель, которая им управляет. Это уже третий сервер MCP для Fusion. Дополнительно Autodesk дают ИИ ассистента, который создаёт чертежи по описанию, от стандартов и форматов листа до видов и размеров. 🔮 Смысл сдвига глубже, чем чат-бот внутри САПР: сама САПР становится средой исполнения для агентов, где инженер формулирует намерение, а агент оперирует инструментами внизу, от модели до оснастки и документации. Autodesk рассчитывают, что техническая документация автоматизируется быстрее всего: результат виден и проверяется до выпуска. #САПР #MCP #Autodesk #Fusion ——— @tsingular
2 768
18
Забавный тренд. Кидаете в GPT пустую коробочку с промптом, получаете разбор: На основе всего, что ты о мне знаешь, заполни об+1
Забавный тренд. Кидаете в GPT пустую коробочку с промптом, получаете разбор: На основе всего, что ты о мне знаешь, заполни обе стороны этого контейнера. Сверху какой я для мира, снизу,- какой я внутри Делитесь, что получилось :) #промпты ------ @tsingular
2 395
19
Это нам за то, что не молимся #дрозофила #роботы ------ @tsingular
Это нам за то, что не молимся #дрозофила #роботы ------ @tsingular
2 414
20
Multiverse Computing усилили обучение LLM с помощью квантового процессора: Quasar 1.1 438B тратит на 37.6% меньше токенов на
Multiverse Computing усилили обучение LLM с помощью квантового процессора: Quasar 1.1 438B тратит на 37.6% меньше токенов на каждый ответ Европейская компания Multiverse Computing перевыпустила кодинг-агента Quasar: часть обучающих данных сгенерировал гибридный квантовый LLM на 156-кубитном IBM Heron в Сан-Себастьяне. Первый случай, когда квантовый компьютер поучаствовал в обучении модели. ⚛️ Квант в конвейере: Взяли Qwen3-30B-A3B и заменили шестую часть слоёв квантовой нейросетью (QNN). Генератор дополнил healing-набор: логи рассуждений, tool-call, знания. Квантовые исследования тут уже использовались ранее для разработки алгоритма отбора экспертов CompactifAI. 🧠 Сжатие плюс доводка: В основе открытая GLM-5.2 от Z.ai. CompactifAI оставляет 148 из 256 экспертов MoE на слой: компактнее и дешевле в использовании. Healing-дообучение возвращает способности после сжатия и убирает дурные привычки исходника. В сравнении с Quasar 1.0 получили прирост: HLE +6.2%, GPQA +4.3%, IFBench +4.6%. При этом средняя длина ответа сжалась с 3322.9 до 2074.3 токенов: на каждый ответ уходит на 37.6% меньше токенов. Агент делает десятки вызовов на задачу и сокращение длины ответа в совокупности с ростом метрик по качеству ответов даёт кратный рост общей эффективности. 🛡 Расцензуривание без переобучения: В рамках переработки модели так же были удалены некоторые типы цензуры, которые мешали непредвзятой обработке политик безопасности. При этом политические отказы упали с 71.18% до 41%, а вредоносный контент по-прежнему блокируется (93% на JailbreakBench). Метод из статьи Refusal Steering: судья-LLM отличает отказ от уловок (подмена темы, нарратив), вектор уводит активации от «направления отказа». Веса не трогаются, правка обратима. Для аналитики главное: вместо одной одобренной версии - разбор по фактам из весов модели. 💼 Зачем бизнесу: Меньше токенов на ответ: ниже счёт за сервинг, быстрее агент. Комплаенс для Европы: вендор из ЕС, развёртывание по EU AI Act. И для информации, что квантовые компьютеры уже частично участвуют в обучении моделей. Дальше, - больше. #Quasar #Multiverse #кванты #ИИ ——— @tsingular | Max | YouTube | RuTube | VK | VK Video | Дзен
2 370