fa
Feedback
Новости сообщества LessWrong

Новости сообщества LessWrong

رفتن به کانال در Telegram

Новости русскоязычной части сообщества LessWrong. Интересные статьи, новые переводы и встречи.

نمایش بیشتر
1 767
مشترکین
+224 ساعت
+17 روز
+230 روز
جذب مشترکین
سپتامبر '26
سپتامبر '26
+24
در 0 کانال‌ها
اوت '26
+24
در 0 کانال‌ها
Get PRO
ژوئیه '26
+18
در 0 کانال‌ها
Get PRO
ژوئن '26
+47
در 0 کانال‌ها
Get PRO
مه '26
+48
در 2 کانال‌ها
Get PRO
آوریل '26
+25
در 0 کانال‌ها
Get PRO
مارس '26
+35
در 0 کانال‌ها
Get PRO
فوریه '26
+35
در 0 کانال‌ها
Get PRO
ژانویه '26
+51
در 0 کانال‌ها
Get PRO
دسامبر '25
+37
در 0 کانال‌ها
Get PRO
نوامبر '25
+41
در 0 کانال‌ها
Get PRO
اکتبر '25
+28
در 0 کانال‌ها
Get PRO
سپتامبر '25
+58
در 0 کانال‌ها
Get PRO
اوت '25
+35
در 0 کانال‌ها
Get PRO
ژوئیه '25
+42
در 0 کانال‌ها
Get PRO
ژوئن '25
+28
در 0 کانال‌ها
Get PRO
مه '25
+42
در 0 کانال‌ها
Get PRO
آوریل '25
+42
در 1 کانال‌ها
Get PRO
مارس '25
+42
در 0 کانال‌ها
Get PRO
فوریه '25
+37
در 0 کانال‌ها
Get PRO
ژانویه '25
+45
در 0 کانال‌ها
Get PRO
دسامبر '24
+40
در 0 کانال‌ها
Get PRO
نوامبر '24
+43
در 0 کانال‌ها
Get PRO
اکتبر '24
+35
در 0 کانال‌ها
Get PRO
سپتامبر '24
+32
در 0 کانال‌ها
Get PRO
اوت '24
+30
در 0 کانال‌ها
Get PRO
ژوئیه '24
+34
در 0 کانال‌ها
Get PRO
ژوئن '24
+25
در 0 کانال‌ها
Get PRO
مه '24
+47
در 0 کانال‌ها
Get PRO
آوریل '24
+35
در 0 کانال‌ها
Get PRO
مارس '24
+45
در 0 کانال‌ها
Get PRO
فوریه '24
+27
در 1 کانال‌ها
Get PRO
ژانویه '24
+51
در 0 کانال‌ها
Get PRO
دسامبر '23
+51
در 0 کانال‌ها
Get PRO
نوامبر '23
+52
در 0 کانال‌ها
Get PRO
اکتبر '23
+49
در 0 کانال‌ها
Get PRO
سپتامبر '23
+43
در 0 کانال‌ها
Get PRO
اوت '23
+41
در 0 کانال‌ها
Get PRO
ژوئیه '23
+33
در 0 کانال‌ها
Get PRO
ژوئن '23
+32
در 0 کانال‌ها
Get PRO
مه '23
+21
در 0 کانال‌ها
Get PRO
آوریل '23
+28
در 0 کانال‌ها
Get PRO
مارس '23
+17
در 0 کانال‌ها
Get PRO
فوریه '23
+22
در 0 کانال‌ها
Get PRO
ژانویه '23
+40
در 0 کانال‌ها
Get PRO
دسامبر '22
+20
در 0 کانال‌ها
Get PRO
نوامبر '22
+20
در 0 کانال‌ها
Get PRO
اکتبر '22
+27
در 0 کانال‌ها
Get PRO
سپتامبر '22
+27
در 0 کانال‌ها
Get PRO
اوت '22
+26
در 0 کانال‌ها
Get PRO
ژوئیه '22
+18
در 0 کانال‌ها
Get PRO
ژوئن '22
+16
در 0 کانال‌ها
Get PRO
مه '22
+27
در 0 کانال‌ها
Get PRO
آوریل '22
+36
در 0 کانال‌ها
Get PRO
مارس '22
+79
در 0 کانال‌ها
Get PRO
فوریه '22
+17
در 0 کانال‌ها
Get PRO
ژانویه '22
+15
در 0 کانال‌ها
Get PRO
دسامبر '21
+25
در 0 کانال‌ها
Get PRO
نوامبر '21
+23
در 0 کانال‌ها
Get PRO
اکتبر '21
+21
در 0 کانال‌ها
Get PRO
سپتامبر '21
+22
در 0 کانال‌ها
Get PRO
اوت '21
+44
در 0 کانال‌ها
Get PRO
ژوئیه '21
+30
در 0 کانال‌ها
Get PRO
ژوئن '21
+43
در 0 کانال‌ها
Get PRO
مه '21
+45
در 0 کانال‌ها
Get PRO
آوریل '21
+42
در 0 کانال‌ها
Get PRO
مارس '21
+39
در 0 کانال‌ها
Get PRO
فوریه '21
+689
در 0 کانال‌ها
تاریخ
رشد مشترکین
اشارات
کانال‌ها
24 سپتامبر+1
23 سپتامبر+2
22 سپتامبر0
21 سپتامبر+1
20 سپتامبر+1
19 سپتامبر+2
18 سپتامبر0
17 سپتامبر0
16 سپتامبر+1
15 سپتامبر+1
14 سپتامبر+2
13 سپتامبر+3
12 سپتامبر0
11 سپتامبر+1
10 سپتامبر0
09 سپتامبر+1
08 سپتامبر+1
07 سپتامبر+3
06 سپتامبر0
05 سپتامبر+1
04 سپتامبر0
03 سپتامبر0
02 سپتامبر+3
01 سپتامبر0
پست‌های کانال
Перевёл (нейронкой и отредачил) первую часть вчерашнего поста Скотта Ааронсона (не путать с Скоттом Александером). Эпоха чудес и ужасов Двадцать лет назад, когда идея, что ИИ захватит мир при нашей жизни, казалась большинству из нас необузданной фантазией читающих слишком много научной фантастики и слишком мало науки, многие говорили что-то вроде: Смотрите, самая неправдоподобная часть этой истории — что рекурсивно самосовершенствующийся суперинтеллект просто без предупреждения вырвется из подвала какого-то хакера и захватит мир. Случись такое, мы сначала увидели бы кучу предупреждающих знаков. Ну не знаю, вырвавшихся из-под контроля ИИ-агентов, вместе замышляющих взлом сайтов в фанатичном преследовании каким-то своих странных целей. А потем, конечно, увидели бы, как ИИ решает важные математические задачи — даже Задачи тысячелетия. Вот тогда будет время паниковать! Разбудите, как это случится! Двадцать лет назад под этим с радостью подписались бы даже мои самые консервативные и скептические коллеги по академической информатике. Если вы хотите знать моё нынешнее мнение, начните с вышесказанного, а затем скорректируйте его с учётом того, что дикие пророчества сбылись. Первые раскаты, я бы сказал, начались десять лет назад с AlphaGo, заметно усилились с появлением LLM, программирующих и рассуждающих агентов, и достигли крещендо этим летом и осенью — крещендо чудес и ужасов, и нужно быть особым видом идиота, чтобы его отрицать. Меня утомляет вечная игра в напёрстки, когда говорят: «ну конечно, ИИ теперь может [вырваться из песочницы / решить проблему тысячелетия / что угодно из последних драматических событий], никто этого и не отрицал [отрицали], разбудите меня, когда ИИ сделает [то, чего он ещё не сделал, но сделает в следующем году], вот тогда я пересмотрю всё своё мировоззрение [нет, не пересмотрят]». Когда, как бы быстро ни разгонялись американские горки, даже после того, как весь привычный мир исчез позади, всё равно находят причины, почему это не считается. Моя позиция по ИИ — это просто консервативная и скептическая позиция 2006 года, интеллектуально честно скорректированная с учётом реальности конца 2026 года. И эта позиция, если обязательно вслух, такая: ААААААААААААААААААААААААААААААААААААААА ААААААААААААААААААААААААААААААААААААААА АААААААААААААААААААААААААААААААААА Мне кажется, Сингулярность уже началась; она просто ужасно неравномерно распределена. Да, я всё ещё разгружаю посудомойку и стригу ногти на ногах. С другой стороны, не думаю, что за оставшиеся мне годы мне снова доведётся доказать теорему, потому это действительно будет нужно. Только для моего или чужого удовольствия или просвещения. Проверка такая: если бы мы взяли новости последних недель и отправили их на двадцать лет назад, согласился бы я, что это похоже на начало ИИ-Сингулярности? Честный ответ: да, безусловно. Ну вот и всё. Назад не отыграешь. Мне кажется, всем было бы полезно перестать точить свои идеологические топоры, унять свои чувства о Дарио Амодее или Сэме Альтмане, хотя бы на время, чтобы просто признать: чудеса и ужасы уже здесь. Яснее это не было бы, даже покрасней небо, как в Матрице. Это настолько очевидно, что теперь, укладывая своих детей спать, я чувствую эту пропасть в животе: какое будущее у них вообще может быть? Что они могут изучать сегодня, чтобы это имело к нему хоть какое-то отношение? (Вчера моя тринадцатилетняя дочь сама пошутила, что если она хочет стать математиком, то теперь, похоже, на это осталось где-то две недели.) Уж точно, когда мои аспиранты хотят обсудить, какая карьера может их потом ждать, я больше понятия не имею, что им сказать. Может, лучше, если я на секундочку сменю тему. С тех пор как мы с женой переехали в Остин, меня иногда спрашивают что-то вроде «Как ты, и евреем, и учёный-скептик, вообще можешь ладить с этими техасскими христианами-евангелистами? Конечно, они могут казаться очень дружелюбными к евреям, но разве не понимаешь, это только из-за особой роли евреев в их эсхатологии, где, когда Христос вернётся во славе, вы либо примете Его как Господа, либо будете вечно гореть в аду?». Я в ответ вылупляю глаза и говорю: «подождите, то есть мне можно принять Христа только после Его возвращения? Вот это отличная сделка! Как я вообще могу быть против?». Тем, кто говорит, что предсказания о погибели из-за ИИ звучат как апокалиптическая религия, что рационалисты/сингуляритарианцы похожи на любой культ из Залива Сан-Франциско, что у Элиезера Юдковского вайбы мессианского пророка: да, да и да. Но принципиально важно, что теперь вас просят верить не в аргументы и экстраполяции, а лишь в новости с передовицы. Признать реальность приближающегося машинного бога после того, как он решил Навье — Стокса и десятки других давних открытых математических проблем (при этом резко наращивая свои возможности каждый месяц), — это примерно как принять Иисуса, уже вернувшегося на Землю на сияющем облаке. Это эпистемический минимум. Да, остаётся мощнейшая неопределённость о том, как будет выглядеть оставшаяся часть нашей жизни, но, насколько я могу судить, больше нет никакой реальной неопределённости о том, что всё это будет в основном вращаться вокруг ИИ и того, насколько мы сумеем или не сумеем направить его силу на благо человечества. По любому непредвзятому счёту, Элиезер Юдковский оказался прав о том, каким будет величайший вызов, стоящий перед цивилизацией в наши дни, а мы с вами ошибались. Почему я ошибался — вопрос, который я буду задавать себе каждый день оставшегося мне времени. Но, знаете, по крайней мере я скорректировал свои взгляды, когда предсказанные чудеса и ужасы действительно начались! Если вы этого не сделали — почему?

2
⭐️ С чего начать, если хотите работать в technical AI safety Мы уже публиковали подобные подборки, но, пожалуй, пора их обновить. Если вы уже инженер или ресерчер и хотите работать в AI safety, но пока не очень понимаете, что происходит в этом поле, вот несколько хороших точек входа, которые помогут разобраться в нём за пару месяцев. Если хотите получить общее представление и проходить материалы с фасилитацией, посмотрите: ⭕️ BlueDot Impact — Technical AI Safety Если вам комфортнее разбираться самостоятельно, можно начать с: ⭕️короткого курса от DeepMind Safety Research; ⭕️The Compendium— структурированного обзора основных идей и направлений AI Safety. Если основы уже знаете и у вас хороший технический бэкграунд, попробуйте ARENA. Это более техническая программа с большим количеством практики: transformers, interpretability, RL, evals и другие темы. Curriculum открыт для самостоятельного прохождения, также есть очные наборы. При этом при поиске работы свой небольшой проект может быть полезнее, чем сертификат о прохождении курса. Если не знаете, что именно сделать, можно поискать задачу в подборке списков открытых проблем и идей для проектов в AI Safety И ещё советуем сначала посмотреть, какие адженды вообще существуют и чем занимаются разные команды можно почитать Shallow Review от Arb Research
540
3
Игорь Тимофеев и Владислав Мешкорудный решили вести свой подкаст. Кажется, эта идея у них пока "не взлетела", но на первую свою беседу они пригласили Славу Матюхина - в прошлом самого активного организатора сообщества рационалистов в России. Беседа в основном шла вокруг темы "в чём ошибаются рационалисты". С моей точки зрения, очень много рассуждений на эту тему оказываются откровенно неудачными. Однако в этом случае участники (особенно Слава) достаточно хорошо представляют, что именно рационалисты утверждают, поэтому беседа может оказаться для многих достаточно интересной. https://www.youtube.com/watch?v=-AKXeE_VH6s
533
4
Котятки, тут такое. Пока разбиралась, куда самой податься на финансирование по AI safety, я свела все открытые гранты, фонды, compute-кредиты и fellowships в одну большую карту. Получилось прилично - от «горит, дедлайн через неделю» до «откроется осенью, готовься заранее». Раз уж все равно собрала - делюсь. Пусть кому-то повезет )) Что горит прямо сейчас: grantmaking.ai — раунд $1M ($5k–$50k), приоритет 13 июля / закрытие 27 июля, через Manifund Heron AI Security — 8 июля (без стипендии, для кибербез-специалистов) GovAI DC и UK Winter Fellowship 2027 + ARENA 9.0 — дедлайн 12 июля PIBBSS Winter Fellowship — 20 июля, $3k/мес + жилье (Кейптаун) PIBBSS × Iliad Fellowship — 27 июля, $6k/мес (Лондон) DeepMind × Schmidt Multi-agent AI Safety call — 8 августа, пул до $10M Плюс десятки rolling-грантов (LTFF, Coefficient Giving, Manifund, SFF), compute-кредиты (TRC, Prime Intellect, fal.ai, HF) и осенние программы (MATS, SPAR, CHAI, AI Safety Camp). Вся карта тут, с суммами, дедлайнами и ссылками (живой документ, буду обновлять) Дисклеймер: суммы и дедлайны меняются, перед подачей сверяйтесь на официальной странице. Санкционные, визовые и налоговые нюансы у каждого фонда свои - уточняйте отдельно.
533
5
⭐️AI Safety × Philosophy Reading Group Онлайн группа чтения 📍Где: онлайн 🗓Когда: июль - сентябрь 2026 ⏰Дедлайн подачи: 15 июля Англоязычная группа чтения материалов по философским основам AI Safety: x-риски, alignment, ценности, агенты, сознание, control problem и good futures. Программа рассчитана на 8 недель. Формат — еженедельные встречи на 1,5 часа. Материалы включают статьи, эссе, главы книг и видео. Иногда будут необязательные к посещению сессии с исследователями: Q&A, дискуссии или дебаты. Что предоставляют: ⭕️подборку материалов по темам AI Safety × philosophy, ⭕️группу на 6-7 человек с фасилитатором, ⭕️доп. встречи с исследователями. Что делать в рамках программы: ⭕️читать материалы заранее (подготовка к сессии обычно занимает до 3 часов), ⭕️участвовать в еженедельных обсуждениях. Кого ждут (требования): ⭕️всех интересующихся концептуальными компонентами того, что обычно является техническими исследованиями. 📌 Набирают участников и фасилитаторов. Так, если вы искали, где бы получить опыт фасилитации на английском языке (без которого обычно не берут на оплачиваемые позиции фасилитаторов), то обратите внимание. 🔗Подробности: тут 🔗Подать заявку: тут
750
6
Читательский клуб, где обсуждаются разные книги, так или иначе связанные с популярными на LW темами, переходит к следующей книге. Ей станет книга D. Dennett, "From Bacteria to Bach and Back". Обсуждение начнётся сегодня, 22 июня, в 20:30 по московскому времени. Начнём с введения (Preface) и главы 1 "Introduction". О том, как подключиться, и прочие подробности будет в группе https://t.me/minireading
1 503
7
Русский перевод новой книги Юдковского уже в продаже.
1 307
8
🔵 AGI Strategy Вводный курс по сейфети от BlueDot Impact 📍Где: онлайн, Zoom 🗓Когда: 29 июня - 3 июля (интенсив), 6 июля - 9 августа (part-time) ⏰Дедлайн подачи: 21 июня (интенсив), 28 июня (part-time) Это стартовый в сетке регулярных курсов от BlueDot Impact. В программе курса 5 встреч, пройти их можно либо в формате интенсива (встречи каждый день) либо в формате part-time (встречи раз в неделю). У этого курса есть и другие даты запуска. Что предоставляют: ⭕️материалы для чтения и письменные задания, ⭕️обсуждения в группе с фасилитатором, ⭕️доступ к community Slack (ради которого курсы BlueDot обычно и проходят), ⭕️сертификат по окончании курса, ⭕️возможность дальше податься на Technical AI Safety, AI Governance, Biosecurity. Что делать в рамках программы: ⭕️читать материалы, ⭕️выполнять короткие упражнения (письменно), ⭕️участвовать в 2 часовых Zoom встречах. Кого ждут (требования): ⭕️Курс подходит для новичков, но ждут обоснования мотивации и готовности к построению карьеры в сейфети. 📌Курс бесплатный и работает по модели pay what you want. 🔗Подробности: тут 🔗Подать заявку: тут
1 296
9
Новая книга Юдковского и Соареса об опасностях искусственного интеллекта ("Если кто-то его создаст — все погибнут") скоро выйдет на русском языке. В некоторых интернет-магазинах уже доступен предзаказ. https://www.chitai-gorod.ru/product/esli-kto-to-ego-sozdast-vse-pogibnut-3162997 https://book24.ru/product/esli-kto-to-ego-sozdast-vse-pogibnut-8817799/
1 133
10
Новость для любителей аудиокниг. Сергей Васильев озвучил рассказ "Доброта к родственникам", про который я писал выше. https://www.youtube.com/watch?v=vq7mNZDFuVE
1 192
11
Пётр Гамбарян перевёл рассказ "Kindness to Kin" пользователя solguard из сабреддита r/HFY. Это история о контакте между цивилизациями в далёком будущем с рассуждениями об эволюции этики. Часть 1: https://telegra.ph/Dobrota-k-rodstvennikam-moj-perevod-Kindness-to-Kin-by-solguard-CHast-I-04-30 Часть 2: https://telegra.ph/Dobrota-k-rodstvennikam-moj-perevod-Kindness-to-Kin-by-solguard-CHast-II-04-30 Оригинал: https://www.reddit.com/r/HFY/comments/lom9cb/kindness_to_kin/
3 364
12
Есть вещи, о которых мы даже не подозреваем | Брайан Томасик Порой кажется, что сторонники эффективного альтруизма одержимы «квантифицированной эффективностью»: метриками, показывающими результативность чего-либо — будь то QALY на доллар, управление временем, результаты опросов или оптимизация диеты и физических упражнений. Квантификация полезна и часто может выявить серьёзные пробелы, которые можно упустить, если применять только качественное, а не количественное мышление. Также квантификация может привести к выводам, которые не были очевидны до обработки данных. Цифры позволяют проводить гораздо больше вычислений, чем способен делать наш мозг сам по себе. В то же время я опасаюсь, что некоторые сторонники эффективного альтруизма слишком сильно увлекаются квантификацией и перестают видеть лес за деревьями. Стоит помнить принцип «мусор на входе, мусор на выходе»: метрики хороши лишь настолько, насколько хороши те рассуждения, на основании которых мы решили, что именно эти метрики стоит оптимизировать. Кроме того, они могут упускать какие-то ключевые соображения. Чрезмерно оптимизируя что-то по узким или даже довольно широким метрикам, вы можете приносить в жертву какие-то важные элементы ценного, которые просто не измерялись. Оптимизация по метрике может создавать иллюзию прогресса, в то время как более широкий взгляд на ситуацию показал бы, что всё гораздо более размыто, чем казалось. Порой качественное, масштабное мышление человеческого мозга лучше справляется с подобными макроуровневыми проблемами, чем другие из доступных нам инструментов. Холден Карнофски обсуждает этот и другие связанные вопросы в эссе «Passive vs. rational vs. quantified». Одна из областей, в которых оптимизация по метрикам сталкивается с серьёзными трудностями, — это открытие, выражаясь словами диснеевской Покахонтас, «вещей, о которых ты даже не подозревал» [things you never knew you never knew]. Непонятно, как вообще строить метрики для измерения тех аспектов проблемы, о которых мы ещё даже не подумали*. Если мы слишком сильно оптимизируем свои нынешние цели, мы можем упустить важность того, чтобы отступить на шаг назад и посмотреть на картину в целом. Суженный фокус — одна из нескольких проблем, о которых говорят авторы статьи «Goals Gone Wild: The Systematic Side Effects of Over-Prescribing Goal Setting». * См. такие понятия как «тяжёлая неопределенность», «неизвестные неизвестности», «чёрные лебеди» и «неведение» — прим. пер. Оригинал: Things you never knew you never knew (2013-2019) Перевод: К. Кирдан (добавлены ссылки) #Брайан_Томасик #эффективный_альтруизм
548
13
Леонид Хоменко написал серию постов про неявное знание и его важность в контексте работы с LLM. Когда мы хорошо что-то знаем или умеем, мы часто забываем, как сложно нам было этому научиться. И когда мы пытаемся это своё знание кому-то передать, мы нередко недооцениваем количество информации, которое для этого необходимо. Леонид пишет об этом в контексте обучения и в контексте работы с LLM, однако мне представляется, что описанная идея актуальна много где. Я не во всём согласен с автором с точки зрения практических выводов, но само понятие выглядит довольно полезным инструментом.
846
14
Читательский клуб, где обсуждаются разные книги, так или иначе связанные с популярными на LW темами, переходит к следующей книге. В ближайшее время будет обсуждаться книга Кевина Симлера и Робина Хансона "Слон в голове" ("The Elephant in the Brain") - книга о неосознаваемых или скрытых по другим причинам человеческих мотивах. Робин Хансон в своё время вместе с Юдковским создал блог Overcoming Bias, от которого позже отделился LessWrong. Юдковский утверждал, что цинизм профессора Квиррелла из "ГПиМРМ" частично позаимствован у Хансона. Как я понимаю, в книге это будет заметно. Встречи проходят по понедельникам, онлайн, в Google Meet (но это может измениться). Начало в 20:30 по московскому времени (UTC+3). Подробности: https://t.me/minireading
1 002
15
🐉 Открыт набор на Technical AI Safety курс по оценке LLM: подходы, бенчмарки и методология Evals for AI Safety — это методол
🐉 Открыт набор на Technical AI Safety курс по оценке LLM: подходы, бенчмарки и методология Evals for AI Safety — это методология измерения качества, надежности и безопасности ИИ-систем. В условиях повсеместного внедрения языковых моделей в продакшн умение корректно оценивать их возможности и риски становится приоритетным навыком. Как устроен курс: 🔘Анализ методологии evals на основе современных и классических статей в области 🔘Менторы из Apollo research, AI Lab SKOLKOVO, AIRI Institute, Яндекс и др 🔘Обучение в мини-группах, по 4-6 человек 🔘Формат: оффлайн в Москве или онлайн 🔘Ожидаемая нагрузка: 10-15 часов в неделю 🔘Стоимость: бесплатно, отбор на конкурсной основе Цель курса: Дать базу для начала карьеры в области оценки ИИ и понимание того, какую роль evals играет в AI Safety. Программа знакомит с основными концепциями evals, учит анализировать существующие бенчмарки, проектировать собственные оценки и разрабатывать дизайн экспериментов в области evals. Участники курса освоят Inspect AI (один из самых популярных фреймворков для оценки LLM). Кого мы ждем: 🔘Студентов STEM-направлений, планирующих карьеру в области ИИ 🔘IT-специалистов, желающих освоить навык тестирования языковых моделей 🔘Продвинутых и начинающих специалистов в области ML, которые хотят углубиться в методологию оценки моделей Подробнее: тут Подать заявку на участие в курсе, а также на фасилитацию можно до 22 февраля: тут Если вам интересно менторство, преподавание, сотрудничество с курсом или вы хотите задать вопрос, то напишите Юле
565
16
Для тех, кто больше любит смотреть или слушать. В конце июля прошлого года на канале Елизаветы Осетинской вышло большое интервью с Дмитрием Волковым, руководителем исследований в Palisade Research - некоммерческой организации, занимающейся вопросами безопасности ИИ. В интервью Дмитрий рассказывает, какую опасность потенциально может представлять искусственный интеллект, какие исследования на эту тему проводятся уже сейчас и что с этим можно делать. Интервью рассчитано на очень широкую аудиторию. https://www.youtube.com/watch?v=au5fU-nbZmc
840
17
Читательский клуб, где обсуждаются разные книги, так или иначе связанные с популярными на LW темами, переходит к следующей книге. Ей станет вышедшая в прошлом году книга Элиезера Юдковского и Нейта Соареса "If Anyone Builds It, Everyone Dies". Встречи будут проходить по понедельникам. Первая встреча пройдёт уже сегодня, начало в 21:00 по московскому времени (UTC+3). Однако, в дальнейшем встречи будут начинаться в 20:30 (по московскому времени). Группа читательского клуба в телеграме: https://t.me/minireading Встречи проходят в онлайне (в настоящее время в Google Meet, но это может меняться). Подробности в упомянутой группе.
1 006
18
Глеб Горов, автор телеграм-канала "Рациональный Гуманист", выложил запись эфира со Славой Меритон по теме "Честность против эффективности". Поскольку на выбор темы эфира в какой-то степени повлияли именно мои вопросы и замечания, немного напишу, что я по этому поводу думаю. Я полностью согласен с тезисом, что не имеет никакого смысла тратить слишком много времени на вычисление шансов на успех. Если можно что-то быстро "взять и сделать", и потенциальные потери в случае неудачи не выглядят существенными, то, конечно, проще всего "взять и сделать". Однако у меня сложилось впечатление, что участники эфира под оценкой шансов подразумевают что-то очень сложное и действительно малореалистичное. Я же скорее под оценкой шансов подразумеваю что-то вроде метода, упомянутого Элиезером Юдковским в "Лицензии героя": Когда я задумываюсь о шансах, я считаю, что я согласился бы на пари 20:1 — в смысле, если бы вы предложили мне 20 долларов против одного ... И мне было бы неуютно заключать пари при ставке 4 доллара против одного. Возьмём примерно геометрическое среднее и получим шансы 9:1. Очевидно, что это очень неточный метод, и тем более он будет неточным для человека, который не "калибровался" в этой сфере (т.е. не записывал ранее своих предсказаний на эту тему и не оценивал результаты). Однако мне представляется, что, во-первых, начать калиброваться в этой области никогда не поздно, и это будет скорее полезно. Во-вторых, мне представляется, что даже из самых несовершенных интуитивных оценок на эту тему можно делать какие-то выводы. Если вы ощущаете, что готовы поставить на свой успех 10 против 1, то, действительно, можно задаться вопросом, а почему вы ещё не начали свой путь к этому успеху. И наоборот, если даже ставка 1 против 10 вас как-то не вдохновляет, то стоит задуматься, а действительно ли успех того стоит. (На всякий случай отмечу, что на уровне интуитивной калибровки не стоит оценивать шансы меньшие, чем 1:100 - чтобы быть уверенным в своей калибровке на таких шансах, вам, очевидно, нужно никак не меньше 100 предыдущих наблюдений.) Также в порядке мысленного эксперимента можно задавать вопрос: а сколько бы поставил ваш лучший друг на ваш успех, если бы он был достаточно в курсе ваших дел и идей? И этот же мысленный эксперимент, с моей точки зрения, порождает вопросы к тезису про уверенность. Предположим, вы спрашиваете своего лучшего друга: "Какие, по-твоему, мои шансы на успех в деле Х?" И после получения ответа задаёте следующий вопрос: "А если я буду очень в себе уверен?" Я бы ожидал встретить здесь некоторое недоумение. С моей точки зрения, люди не умеют переключать уверенность в себе усилием воли. Конечно, можно проделать какие-то действия, которые уверенность в себе могут повысить. Они могут стать частью плана. Но в этом случае при оценке шансов на успех нужно уже оценивать не абстрактную "уверенность в себе", а конкретный план. Что же касается тезиса "если я буду оценивать свои шансы на успех, то я пойму, что они низки, и не смогу заставить себя этим заниматься", то здесь, с моей точки зрения, важно отметить, что "осмысленность" действия определяется не только тем, насколько высоки шансы. Если потенциальный выигрыш очень велик, а потенциальные потери - малы, то вполне осмысленно "ставить" и на довольно малые шансы. Очень много на эту тему написано, например, книге Джулии Галеф "Настрой разведчика" (неоднократно упомянутой в этом канале).
1 156
19
Анонс: Честность vs Эффективность. Эфир со Славой Меритон В последних постах я очень много говорил на тему инструментальной п
Анонс: Честность vs Эффективность. Эфир со Славой Меритон В последних постах я очень много говорил на тему инструментальной пользы уверенности. Некоторые преданные подписчики в комментариях справедливо замечали, что попытки «накачать» уверенность выглядят как самообман, искажающий карту реальности. Действительно, есть ощущение конфликта между Эпистемической честностью (видеть мир таким, какой он есть) и Инструментальной эффективностью (действовать так, чтобы побеждать). Чтобы разобраться, как это работает на самом деле, я решил позвать человека, который варится в контексте рациональности гораздо дольше меня и имеет свою позицию по теме. В ближайший понедельник, 22 декабря в 19:00 по МСК, мы поговорим со Славой Меритон. Слава — одна из заметных фигур в русскоязычном рациональном сообществе и у неё есть интересный взгляд на эту проблему, который немного перпендикулярен нашему спору. Её тезис примерно такой: пока одни ревностно высчитывают свои (обычно низкие) вероятности успеха, другие просто берут и делают. Поговорим о том: — Не становится ли сам подсчет вероятностей ловушкой, убивающей агентность? — Где проходит граница между «полезным игнорированием сложностей» и глупостью? — И насколько допустимо менять свою карту для того, чтобы быстрее добираться до пунктов назначения? Формат: Голосовой эфир прямо здесь, в канале. Мы начнем с диалога, но значительную часть времени уделим общению с вами. Так что приходите, задавайте вопросы, спорьте. Запись, конечно, тоже сделаем и потом выложим на YouTube, но лучше быть онлайн, чтобы поучаствовать в дискуссии. Ставьте напоминание: Понедельник, 22 декабря 19:00 МСК
946
20
⭐️ Sci.STEPS 2026 менторское сопровождение в исследовательских и карьерных задачах 📍Где: онлайн 🗓Когда: 2 февраля - 30 апреля 2026 ⏰Дедлайн подачи: 28 декабря Sci.STEPS дают менторскую поддержку под широкий набор задач, связанных с научными и карьерными треками. Обязательных встреч с ментором немного: программа скорее про коммитмент и помощь в приоритизации. Подходит, напрмер, если вам нужно податься в PhD или магистратуру, собрать нормальное резюме или наконец-то сесть за ресёрч, но оно всё откладывается. В этом сезоне много русскоговорящих менторов и много менторов из разных университетов мира. Если вы собираетесь поступать в один из них, то это хорошая возможность узнать про внутреннюю кухню академии в конкретном месте. Есть менторы по ML и AI Safety (их немного, но они есть, так что лучше заполнять заявки оперативно). Что предоставляют: ⭕️регулярные встречи с ментором ⭕️доступ к материалам и тематическим мероприятиям ⭕️поддержку сообщества Sci.STEPS Что можно делать в рамках программы: ⭕️формулировать и уточнять карьерные и исследовательские цели ⭕️работать над заявками в академию или индустрию ⭕️работать с ментором над навыками и проектами ⭕️участвовать в общих встречах и нетворкаться Кого ждут (требования): ⭕️Студентов, аспирантов и молодых специалистов, заинтересованных в научной или исследовательской карьере ⭕️Вы можете подаваться с safety проектом не только к профильному ментору по safety 📌 Один из авторов канала стал ментором в этом сезоне Sci.STEPS, так что AI Safety там тоже представлено. 🔗Подробности: тут 🔗Подать заявку: тут
930