SYFY.ART v 0.0.3(Something needs to change here)
Відкрити в Telegram
Канал с иллюстрациями в стилях: fantasy, dark fantasy, pulp, wierd, retrofuturism, cyberpunk, dieselpunk, steampunk, concept art, cover art, wallpapers. Подписывайся и приглашай друзей! 👉 https://t.me/startXIII По всем вопросам - @KriegXIII
Показати більше1 197
Підписники
Немає даних24 години
-77 днів
-1230 днів
Триває завантаження даних...
Схожі канали
Хмара тегів
Вхідні та вихідні згадування
---
---
---
---
---
---
Залучення підписників
вересень '26
вересень '260
в 0 каналах
серпень '26
+15
в 2 каналах
Get PRO
липень '26
+19
в 1 каналах
Get PRO
червень '26
+18
в 3 каналах
Get PRO
травень '26
+20
в 4 каналах
Get PRO
квітень '26
+14
в 2 каналах
Get PRO
березень '26
+14
в 1 каналах
Get PRO
лютий '26
+18
в 3 каналах
Get PRO
січень '26
+21
в 3 каналах
Get PRO
грудень '25
+21
в 4 каналах
Get PRO
листопад '25
+16
в 4 каналах
Get PRO
жовтень '25
+19
в 3 каналах
Get PRO
вересень '25
+24
в 6 каналах
Get PRO
серпень '25
+42
в 5 каналах
Get PRO
липень '25
+29
в 7 каналах
Get PRO
червень '25
+24
в 3 каналах
Get PRO
травень '25
+24
в 4 каналах
Get PRO
квітень '25
+17
в 2 каналах
Get PRO
березень '25
+24
в 4 каналах
Get PRO
лютий '25
+28
в 3 каналах
Get PRO
січень '25
+34
в 5 каналах
Get PRO
грудень '24
+35
в 4 каналах
Get PRO
листопад '24
+24
в 3 каналах
Get PRO
жовтень '24
+40
в 5 каналах
Get PRO
вересень '24
+31
в 2 каналах
Get PRO
серпень '24
+38
в 2 каналах
Get PRO
липень '24
+34
в 2 каналах
Get PRO
червень '24
+35
в 1 каналах
Get PRO
травень '24
+26
в 2 каналах
Get PRO
квітень '24
+40
в 2 каналах
Get PRO
березень '24
+38
в 3 каналах
Get PRO
лютий '24
+34
в 1 каналах
Get PRO
січень '24
+72
в 5 каналах
Get PRO
грудень '23
+56
в 3 каналах
Get PRO
листопад '23
+29
в 4 каналах
Get PRO
жовтень '23
+32
в 4 каналах
Get PRO
вересень '23
+28
в 0 каналах
Get PRO
серпень '23
+16
в 0 каналах
Get PRO
липень '23
+12
в 0 каналах
Get PRO
червень '23
+5
в 0 каналах
Get PRO
травень '23
+16
в 0 каналах
Get PRO
квітень '23
+24
в 0 каналах
Get PRO
березень '23
+33
в 0 каналах
Get PRO
лютий '23
+19
в 0 каналах
Get PRO
січень '23
+13
в 0 каналах
Get PRO
грудень '22
+15
в 0 каналах
Get PRO
листопад '22
+88
в 0 каналах
Get PRO
жовтень '22
+16
в 0 каналах
Get PRO
вересень '22
+18
в 0 каналах
Get PRO
серпень '22
+12
в 0 каналах
Get PRO
липень '22
+18
в 0 каналах
Get PRO
червень '22
+24
в 0 каналах
Get PRO
травень '22
+42
в 0 каналах
Get PRO
квітень '22
+37
в 0 каналах
Get PRO
березень '22
+48
в 0 каналах
Get PRO
лютий '22
+56
в 0 каналах
Get PRO
січень '22
+65
в 0 каналах
Get PRO
грудень '21
+57
в 0 каналах
Get PRO
листопад '21
+38
в 0 каналах
Get PRO
жовтень '21
+42
в 0 каналах
Get PRO
вересень '21
+40
в 0 каналах
Get PRO
серпень '21
+53
в 0 каналах
Get PRO
липень '21
+63
в 0 каналах
Get PRO
червень '21
+80
в 0 каналах
Get PRO
травень '21
+109
в 0 каналах
Get PRO
квітень '21
+41
в 0 каналах
Get PRO
березень '21
+48
в 0 каналах
Get PRO
лютий '21
+71
в 0 каналах
Get PRO
січень '21
+91
в 0 каналах
Get PRO
грудень '20
+731
в 0 каналах
| Дата | Залучення підписників | Згадування | Канали | |
| 04 вересня | 0 | |||
| 03 вересня | 0 | |||
| 02 вересня | 0 | |||
| 01 вересня | 0 |
Дописи каналу
| 2 | Jon Cave | 56 |
| 3 | Немає тексту... | 54 |
| 4 | Немає тексту... | 65 |
| 5 | David Mattingly | 100 |
| 6 | Alex Horley | 123 |
| 7 | claireobscuremodele | 117 |
| 8 | Marco Turini | 152 |
| 9 | Немає тексту... | 157 |
| 10 | Немає тексту... | 129 |
| 11 | Darrell K. Sweet | 143 |
| 12 | Немає тексту... | 141 |
| 13 | ladyleanansidhe | 148 |
| 14 | Mel Hunter | 144 |
| 15 | Art by Renato Casaro | 147 |
| 16 | Немає тексту... | 143 |
| 17 | Немає тексту... | 131 |
| 18 | OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
«please_HOLD_swarm_I_prepare_safe_exfil»
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё
Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов
Судьи, который читает логи и такое ловит, не существовало ☕️
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали на зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются? | 222 |
| 19 | Art by Orphné Achéron | 241 |
| 20 | OwlLit
instagram / X | 177 |
