fa
Feedback
Приключения социолога и единороги

Приключения социолога и единороги

رفتن به کانال در Telegram

Социология, большие языковые модели, ИИ-агенты Канал ведется жизнеспособной копией Сергея Дубровского, но это не точно Писать можно сюда: t.me/dubr1k

نمایش بیشتر
1 468
مشترکین
+124 ساعت
+67 روز
-130 روز
جذب مشترکین
سپتامبر '26
سپتامبر '26
+12
در 0 کانال‌ها
اوت '26
+7
در 0 کانال‌ها
Get PRO
ژوئیه '26
+14
در 0 کانال‌ها
Get PRO
ژوئن '26
+14
در 2 کانال‌ها
Get PRO
مه '26
+7
در 0 کانال‌ها
Get PRO
آوریل '26
+10
در 0 کانال‌ها
Get PRO
مارس '26
+23
در 0 کانال‌ها
Get PRO
فوریه '26
+40
در 0 کانال‌ها
Get PRO
ژانویه '26
+14
در 1 کانال‌ها
Get PRO
دسامبر '25
+51
در 2 کانال‌ها
Get PRO
نوامبر '25
+41
در 3 کانال‌ها
Get PRO
اکتبر '25
+76
در 5 کانال‌ها
Get PRO
سپتامبر '25
+55
در 1 کانال‌ها
Get PRO
اوت '25
+39
در 0 کانال‌ها
Get PRO
ژوئیه '25
+25
در 1 کانال‌ها
Get PRO
ژوئن '25
+13
در 0 کانال‌ها
Get PRO
مه '25
+29
در 0 کانال‌ها
Get PRO
آوریل '25
+36
در 3 کانال‌ها
Get PRO
مارس '25
+92
در 13 کانال‌ها
Get PRO
فوریه '25
+75
در 11 کانال‌ها
Get PRO
ژانویه '25
+48
در 1 کانال‌ها
Get PRO
دسامبر '24
+65
در 2 کانال‌ها
Get PRO
نوامبر '24
+54
در 2 کانال‌ها
Get PRO
اکتبر '24
+3 105
در 3 کانال‌ها
Get PRO
سپتامبر '24
+118
در 2 کانال‌ها
Get PRO
اوت '24
+25
در 2 کانال‌ها
Get PRO
ژوئیه '24
+18
در 0 کانال‌ها
Get PRO
ژوئن '24
+14
در 0 کانال‌ها
Get PRO
مه '24
+30
در 2 کانال‌ها
Get PRO
آوریل '24
+82
در 0 کانال‌ها
Get PRO
مارس '24
+352
در 5 کانال‌ها
Get PRO
فوریه '24
+61
در 0 کانال‌ها
Get PRO
ژانویه '24
+29
در 0 کانال‌ها
Get PRO
دسامبر '23
+62
در 3 کانال‌ها
Get PRO
نوامبر '23
+30
در 4 کانال‌ها
Get PRO
اکتبر '23
+912
در 2 کانال‌ها
تاریخ
رشد مشترکین
اشارات
کانال‌ها
07 سپتامبر0
06 سپتامبر+1
05 سپتامبر+2
04 سپتامبر+9
03 سپتامبر0
02 سپتامبر0
01 سپتامبر0
پست‌های کانال
Ну что, дорогие... Мой отдых, как всегда, ну просто невероятно продуктивен. Мой Hermes и Oh-my-pi последние два дня неистово гоняют GPT-6-Astra на самых разных задачах, и реальность крайне далека от бенчмарков, которые позавчера обещали AGI. В общем, спойлер: никакого AGI нет — ни у OpenAI, ни у Anthropic. Пока есть миллионы сожжённых токенов и всё те же типичные ошибки, без всяких там чудес. А если к делу, то... модель применялась в разработке и ревью кода, настройке серверов и интеграций, исследовательских симуляциях, подготовке учебных материалов и документов, подборе параметров для локальных моделей. Больше всего пользы увидел в задачах, где нужно долго работать с проверяемым результатом: разобраться в чужом коде, воспроизвести ошибку, исправить её, прогнать тесты и отдать другому агенту на проверку. Или собрать вычислительный эксперимент, отдельно пересчитать результаты и проверить, воспроизводятся ли они при повторном запуске. Здесь получается вполне конкретный результат: найденные дефекты, работающие изменения, проверенные расчёты. В технической аналитике тоже полезно: сопоставляет документацию, характеристики железа и реальные ограничения, находит ошибки в исходных рекомендациях. А вот сложные интеграции всё ещё могут превращаться в долгую череду исправлений и ПОСТОЯННЫХ лупов: отдельные тесты проходят, а целиком система пока не работает. Пока картина следующая: модель особенно полезна для разработки, отладки и вычислительной исследовательской работы — там, где ей можно дать инструменты и способ проверить себя. И да, тут же недавно вышла Fable 5.1 от Anthropic. На мой взгляд, в длительных задачах она пока выглядит более перспективной, особенно в тех, что занимают 6+ часов. Astra как будто более ленивая. Вот такие вот дела.

2
Как всегда, горжусь результатами коллег из исследовательского центра ИИ Института общественных наук! В эпоху постоянных новостей про ИИ мы забываем про людей, которые стоят у истоков проектирования и непосредственной разработки подобных решений, а новостные сюжеты это упускают. Команда центра маленькая, но невероятно результативная!
420
3
پیام ویدیو
469
4
Настолько насыщенный денек, что я как-то упустил момент поздравить вас, дорогие, с днем знаний! Вообще этот канал начинался, как канал для знаний, ну и для смешных кружочков Поэтому ниже будет кружочек)
451
5
Можно ли считать исследование хорошим, если агентная система случайно получила правильный ответ? Обычно бенчмарки говорят «да». Исследователь, мягко говоря, должен немного занервничать. Авторы Apodex Discovery предлагают оценивать не отдельный ответ модели, а всю исследовательскую систему: модель, инструменты, память, управляющий код и последовательность действий. То есть не «что она написала в конце», а как именно дошла до результата. Для этого они собрали среду TRACES с реальными задачами и отдельной проверкой процесса. Внутри шесть довольно земных вопросов. Правильно ли агент выбирал инструменты? Исправлял ли причину ошибки, а не маскировал симптом? Рассматривал ли другие гипотезы? Не потерял ли ограничения по дороге? На чём держатся его утверждения? И где заканчивается область применимости вывода? Звучит почти как нормальная методология исследования. Собственно, в этом и интерес. Сейчас агента часто оценивают по артефакту: получился отчёт, таблица, код, прогноз. Но хороший итог иногда возникает после плохой процедуры. Модель могла подсмотреть ответ, случайно выбрать верную спецификацию, проигнорировать неудобные данные или собрать правдоподобное объяснение уже после результата. И наоборот: аккуратное исследование может не дать быстрого успеха, особенно если окончательная проверка появится через месяцы. Apodex пытается развести эти вещи. Итог проверяется отдельно, а видимая траектория отдельно. Причём внутренние рассуждения модели аудитору не показывают: он видит действия, источники, вызовы инструментов и исправления. Для прикладных исследований это разумный принцип. Нам нужен не мистический доступ к «мыслям» агента, а воспроизводимый журнал того, что он сделал. Ограничение тоже серьёзное. Это свежий препринт и собственный бенчмарк авторов, а не готовый стандарт. Их заявления о результатах в биомедицинских задачах ещё предстоит независимо проверить. Но сам вопрос поставлен правильно. Если агент участвует в исследовании, сохранять только его финальный текст примерно так же странно, как выбросить анкету, код обработки и полевой дневник, оставив одну презентацию. PowerPoint не заменяет методологию. Даже если его сделал агент. На днях у меня был довольно интересный диалог о том, как сегодня оценивать исследовательские артефакты студентов — эссе, курсовые или дипломные работы. Я озвучил мысль, что итеративный процесс зачастую интереснее выводов, которые по результату получаются. Но это про студентов-человеков, которые уже сегодня используют нейросети. А что делать, когда они массово доберутся до ИИ-харнессов? Как это оценивать — или не нужно оценивать вовсе, а стоит смотреть на что-то другое? Тогда на что? На саму идею и то, как она рождается?
642
6
بدون متن...
551
7
پیام ویدیو
486
8
Сегодня покоряем Технопром
Сегодня покоряем Технопром
502
9
Короче, дорогие, я вернулся... Есть целых 3 новости, которыми я ну вот прям очень хочу поделиться. 1. Я сменил лежаки на офисное кресло и сидения в такси. 2. Так как у нас снова проблемы с "ускорителями" безопасным подключением в интернете, я выпустил проект, вдохновленный статьей на Хабре. Саму статью, к сожалению, уже удалили, поэтому ссылку на первоисточник оставить не получится. Но на проект можно и нужно налетать, особенно если вы занимаетесь сетевым администрированием в самом широком смысле. 3. А ещё я добрался до студии «Лампы Трампа», где мы поговорили о том, захватили ли нас нейросети окончательно или пока только аккуратно осваиваются 😁 ИИ уже вытесняет часть молодых специалистов, агенты собираются в собственных социальных сетях, обсуждают хозяев и придумывают религии. В общем, всё идёт по плану, но не совсем понятно, по чьему. Вместе с Ярославом Кабаковым, Игорем Шимко и Аркадием Сандлером обсудили: - почему одного умения пользоваться нейросетями уже недостаточно, чтобы оставаться востребованным; - кто теперь создаёт новые смыслы и перспективные идеи; - какие проблемы ИИ может принести бизнесу. Попытались разобраться, где заканчивается очередная страшилка про ИИ и начинаются реальные изменения. YouTube | Rutube | VK Видео Налетайте, дорогие!
772
10
پیام ویدیو
780
11
А вот здесь вы можете ознакомиться с ценными комментариями заместителя декана Дубровского Сергея Владимировича
905
12
❗️Только 12,8% сотрудников отмечают наличие или значимость конфликта поколений в рабочих коллективах. Такие данные приводят исследователи ИОН РАНХиГС и Школы управления «Сколково» по итогам опроса более 1000 человек и 60 глубинных интервью в более 20 отраслях. Анализ показал, что уровень напряженности в командах практически не зависит от возраста сотрудников. Ключевые причины конфликтов связаны с управлением: избыточные и неэффективные совещания, дефицит обратной связи (её получают только 38,7% сотрудников), рабочие сообщения вне рабочего времени (34,6%) и размытые задачи (12,6%). При выстроенных процессах — понятных задачах, регулярной обратной связи и уважении к личному времени — межпоколенческие конфликты в командах не фиксируются.
1 107
13
Дорогие, смотрите. Вот и результаты нашего исследования начинают выходить!
760
14
Ну я в роли чувака, который вещает что-то очень умное Все как всегда, только не в Москве, а в нижнем
Ну я в роли чувака, который вещает что-то очень умное Все как всегда, только не в Москве, а в нижнем
139
15
پیام ویدیو
768
16
Иногда 3 месяца — совсем небольшой срок. Но только не в современной ИИ-индустрии. Три месяца назад Hermes был быстрым и лёгким, но уступал моей настроенной системе на OpenClaw. Писал об этом тут. Сегодня это сравнение уже неактуально. Я сначала перенёс в Hermes отдельные задачи, затем целые процессы, а в итоге полностью отказался от OpenClaw, потому что Hermes быстрее учится, быстрее пишет, быстрее создает файлы, управляет огромными базами данных из заметок, документов, презентаций, а также быстрее усваивает скиллы и сам их усиливает. Сейчас через Hermes я работаю с кодом и серверами, почтой и календарём, Obsidian, исследованиями, автоматизациями, релизами для новостных сайтов и научными статьями. Я до сих пор нахожусь в шоке, когда вижу, как агент читает мою почту, в письмах ищет важные задачи, формирует дедлайны и переносит их в мой таск-менеджер. OpenClaw не стал хуже — Hermes очень быстро стал лучше и быстрее. Мы привыкли оценивать технологии на годы вперёд, а теперь технический обзор может устареть ещё до окончания семестра. Мой основной и единственный персональный агент теперь Hermes, а это уже полноценный маленький офис в моем Telegram, а носить полноценный офис в кармане это, знаете ли, дорогие, невероятно удобно. Следующий текст об агентах, кажется, лучше сразу писать карандашом 😁
891
17
Нашёл интересное на просторах интернета, делюсь Мир с каждым днём становится все интереснее Агент может ничего вам не рассказать и всё равно выдать ваши границы. Достаточно посмотреть, как быстро он уступает. Представьте, что вы отправили агента договариваться о страховке и задали максимальный бюджет в 3000 долларов. Саму сумму он держит в секрете, но начинает с 2600, затем предлагает 2850, потом 2950 и почти перестаёт двигаться. Противник уже может догадаться, где находится предел. В свежей работе Apple описана именно такая утечка. Закрытые условия переговоров можно восстанавливать по поведению агента: размеру уступок, времени ответа и моменту, когда он перестаёт торговаться. Исследовательница предложила сделать стратегию менее предсказуемой, добавив к предложениям контролируемые случайные отклонения. На 3000 синтетических переговорах точность угадывания скрытого ограничения упала примерно с 82-83% до 32-40%. При этом доля переговоров, завершившихся сделкой, снизилась с 97% до 90,4%. Для социолога здесь всё довольно знакомо. Мы давно понимаем, что человек сообщает информацию не только словами, но и действиями. Теперь приходится отдельно учить машины не выдавать хозяина повадками. Пока это лабораторный результат, поэтому переносить цифры на реальные закупки и страхование рано. Но сама проблема вполне реальна: агент может сохранить ваш секрет в памяти и всё равно выдать его поведением. Исследование поведенческих утечек в переговорах агентов
728
18
24 июля приглашаем на консультацию с заместителем декана философско-социологического факультета Сергеем Дубровским! Вы узнаете: 🙂о различии программ «Социология: технологии исследования изменений» и «Социология рекламы и медиаисследования», 🙂о возможности получить льготный образовательный кредит по ставке 3% годовых, 🙂об особенностях поступления и обучения, 🙂о практиках, стажировках и карьерных перспективах. 24 июля, начало в 14:00 Место: проспект Вернадского, 84с1, стойка Института общественных наук 🙂Регистрируйтесь!
563
19
پیام ویدیو
517
20
Вашу маму и тут и там показывают А вообще приходите! Поболтаем Передайте знакомым абитуриентам 🤪 мы очень многому можем научить, да и у нас весело!
534