Блины и роботы
Ir al canal en Telegram
Подписывайтесь на один из двух лучших в истории ютуб-каналов о спортивном ЧГК: https://www.youtube.com/@postmortemchannel.
Mostrar más2 057
Suscriptores
-124 horas
-27 días
-1030 días
Archivo de publicaciones
2 057
Теперь немножко насчёт AI, LLM, доступа в Гугл и размера доступных баз данных.
Ну вот уже есть данные о том, что старая модель Claude 5.0 уверенно разделывается с людишками из топ-100. В моей картине мира абсолютно неважно, какой объем данных был ей доступен: 100 петабайт, 1 петабайт или 10 терабайт. Это не имеет значения с качественной точки зрения. Никто не ставит задачу оптимизации этого параметра для обыгрыша человека в ЧГК. Это просто малоинтересная техническая задача. Да, наверняка можно с помощью хитрого частотного анализа распарить базу и понять какой тип реалий лучше закэшировать, а какой встретится с меньшей вероятностью. Но это не имеет качественного значения.
Да, вероятно сейчас ещё существует тип вопросов, на которых команды из топ-100 все ещё сильнее чем Claude 5.0 или даже Claude 5.1 (это, кстати, неплохо было бы проверить). Но в общем и целом ощущения такие, что даже general purpose модели очень скоро закроют эту лавочку.
В мире бенчмарков ЧГК — это тот самый неуловимый Джо из анекдота. Мы даже сами в комьюнити не готовы протестировать современные пакеты на Claude 5.1 или GPT 6.0.
2 057
Тут в дискуссиях пару раз всплыл тейк о том, что машины занимаются перебором, а у человека может быть озарение.
Моё видение такое:
Когда мы думаем над вопросом — мы просто перебираем определенный набор логик и слов вокруг этих логик. Эти входные параметры могут зажечь какие-то цепочки нейронов. Ощущение озарения — это просто сигнал от других нейронов о том, что рядом что-то ярко зажглось (озарение при этом не обязано приводить к правильной версии).
Почти всё ЧГК — это наигрыш паттернов, миелинизация аксонов и перебор входных параметров при обдумывании вопроса. Вся эта игра — это несколько сотен тысяч реалий (вероятно даже несколько десятков тысяч), несколько тысяч паттернов и способность перебирать эти паттерны. Поверх этого нужен небольшой лингвистический аппарат для анализа стиля автора и понимания современных конвенций вопросописания + логическая надстройка, которая позволяет проверить несколько версий и оценить их.
2 057
Если насчёт способности AI разгадывать загадки лучше человека я уже окончательно уверен, то вот написание загадок может продержаться заметно дольше. Это занятие требует очень серьезного прогресса в theory of mind, и вполне может оказаться самым сложным навыком для AI, которым большинство из нас владеет.
2 057
Мне кажется, что многие слишком резво кинулись отвечать на вопрос из прошлого поста и даже не особо подумали над ним. Я однозначно уверен, что чем дальше в сторону развития LLM, тем меньше мне будет интересно ЧГК.
Нас однозначно будут ждать читинговые скандалы, паранойя вокруг жуликов и эпоха недоверия. Я на это насмотрелся в эпоху онлайнов и онлайны мне не очень интересны. Вы, конечно, можете писать, что играете не на результат, а ради любви к игре и все такое прочее, но это все чушь собачья. Если бы результат никого не интересовал, то у нас не было бы пум-пум-пум, псов и шакалов и всего такого прочего.
Психологически принять тот факт, что машина теперь доминирует над человеков в интеллектуальной деятельности типа ЧГК мне тоже будет непросто. Я готов к тому что автомобиль ездит быстрее человека, что алгоритмы побеждают в четко поставленных алгоритмических задачах, но я не очень готов к тому, что машины могут думать на нашем языке, сочинять произведения, шутить и обыгрывать нас в ЧГК. Я привык ассоциировать себя с тем о чем я думаю, а не со скоростью своего бега. ЧГК очень близко к пределам моей когнитивной функции, это один из самых сложных тестов, который я могу пройти сам. Я расстроюсь, когда железка за 20 баксов станет мощнее меня.
2 057
Будет ли вам менее интересно играть в ЧГК, если в какой-то день достоверно выяснится, что существуют LLM которые играют сильнее средней команды?
2 057
Я протестировал на работе GPT Астру, есть вопросики к нашему будущему. Интернов нанимать вроде смысла уже никакого нет, лучше чуточку больше заплатить и найти сотрудника хоть с каким-то опытом и набитыми шишками. В раздумьях нахожусь.
2 057
Рой агентов произвёл координированную атаку на сайт letopis.chgk.info, чтобы выяснить ответ на вопрос «Черепаха — Зелёная, а кот?».
2 057
Август 2027. Вадим Молдавский признает, что LLM достигли уровня средней команды в игре в ЧГК
2 057
2019. Модель OpenAI Five обыгрывает команду OG в Dota 2.
2020. OpenAI решает задача уровня easy на литкод.
2022. Выпущена система распознавания речи Whisper, превосходящая человеческие возможности
2025. Достигнут уровень золотой медали IMO по математике
Май 2026. Опровергнута гипотеза Эрдёша о единичных расстояниях
Сентябрь 2026. Решена проблема существования и гладкости решений уравнений Навье — Стокса
========= Вы находитесь здесь =========
Ноябрь 2026. Решены все проблемы тысячелетия
Февраль 2027. Достигнут холодный ядерный синтез
Март 2027. Исправлены все баги в Сбербанк Онлайн
Апрель 2027. Технологическая сингулярность
Июль 2027. Open AI обыгрывает Ивана Семушина на пакете Бесконечных Земель - 109
2 057
Раньше я знал медведя Смоки только как персонажа свояка. Сегодня я своими глазами увидел, как накачанный медведь с плаката запрещает собакам срать.
2 057
Турнир Ярослава стремительно подходит к концу, очень надеюсь, что он откроет обсуждение для всех.
Напоминаю свою позицию на этот счёт: проводите турнир — будьте добры выложить вопросы в Баду, даже если вы Моносов или Карпук.
2 057
К сожалению, вынужден отметить, что я плохо понимаю увлечения молодежи. Гарри Поттер, названия песен Тейлор Свифт, миссии в Ведьмаке и персонажи позднего СССР — ничего из этого меня не возбуждает ((
