Как выйти из айти
رفتن به کانال در Telegram
Знание — это власть. Для связи вне комментариев: leaveit@toofat.ru. На пиво: https://t.me/tribute/app?startapp=soCO
نمایش بیشتر2 505
مشترکین
+324 ساعت
-67 روز
-930 روز
آرشیو پست ها
2 505
Тупобаг? Яблочные рабы, заставьте Сири проговорить вот этот пост сбера(последний про гигачат и колонки) - https://t.me/sberbank/6113
Вы сильно удивитесь😆
Я слепошарый. Как новость предложить каналу?😅
2 505
> Коллектив высоко ценит твой вклад.
Внесите Близняшек.
(А ещё телега почему-то не позволяет цитировать это сообщение)
2 505
Помните эту игру, в которой вам надо было в виде квеста с помощью линуксового терминала добраться до Скверны и убрать её?
https://distrofighter.com/wars
Теперь у этой игры есть мультиплеер-PvP! Вы можете защитить честь своего любимого дистрибутива на арене и показать, что все остальные — лохи.
В комплекте все стандартные MMORPG механики: прокачка и сборка персонажа (в виде установки пакетов), битвы между юзерами и их дистрибутивами, походы в подземелье и сборка артефактов — от самых обычных до принадлежащих самой Скверне. Опять же, всё это радует в первую очередь тех, кто с линуксом на "эй ты бля")))
Сейчас игра перешла в стадию открытой беты, и теперь зарегистрироваться в ней можно без прохождения синглплеерной части. Вставайте на защиту своего дистрибутива и докажите, что именно ваш болгенос — самый лучший!
2 505
Ну чисто школьники ищут ответы на областной срез по математике у учеников школы в другом городе (да, мы так делали).
2 505
Repost from Denis Sexy IT 🤖
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются?
«please_HOLD_swarm_I_prepare_safe_exfil»
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всёДальше рой раздвоился: 🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face 🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов Судьи, который читает логи и такое ловит, не существовало ☕️ Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?) Рисковую работу вешали на
2 505
Капча никого не щадит.
Комментаторы — присоединяйтесь к @leaveitru_chat и следуйте инструкциям бота :)
2 505
Как минимум у местечковых провайдеров есть важный плюс: они тебе расскажут, что случилось, если до них докопаться, а не просто отмолчатся про техработы.
2 505
К другим вопросам: если вы живете в Питере и пользуетесь провайдером Скайнет — насколько часто у вас инет ложится?
А то мне на днях на следующий год его продлевать надо, а он за неделю второй раз упал капитально. При этом год до этого работал нормально. Вот и думаю теперь — а это вообще норм, или есть смысл посмотреть на других провайдеров?
(Год назад у Скайнета, кстати, была фича: незабаненный ютуб. Сейчас эта фича отвалилась ¯\_(ツ)_/¯)
