SYFY.ART v 0.0.3(Something needs to change here)
Open in Telegram
Канал с иллюстрациями в стилях: fantasy, dark fantasy, pulp, wierd, retrofuturism, cyberpunk, dieselpunk, steampunk, concept art, cover art, wallpapers. Подписывайся и приглашай друзей! 👉 https://t.me/startXIII По всем вопросам - @KriegXIII
Show more1 197
Subscribers
No data24 hours
-67 days
-1230 days
Data loading in progress...
Similar Channels
Tags Cloud
Incoming and Outgoing Mentions
---
---
---
---
---
---
Attracting Subscribers
September '26
September '260
in 0 channels
August '26
+15
in 2 channels
Get PRO
July '26
+19
in 1 channels
Get PRO
June '26
+18
in 3 channels
Get PRO
May '26
+20
in 4 channels
Get PRO
April '26
+14
in 2 channels
Get PRO
March '26
+14
in 1 channels
Get PRO
February '26
+18
in 3 channels
Get PRO
January '26
+21
in 3 channels
Get PRO
December '25
+21
in 4 channels
Get PRO
November '25
+16
in 4 channels
Get PRO
October '25
+19
in 3 channels
Get PRO
September '25
+24
in 6 channels
Get PRO
August '25
+42
in 5 channels
Get PRO
July '25
+29
in 7 channels
Get PRO
June '25
+24
in 3 channels
Get PRO
May '25
+24
in 4 channels
Get PRO
April '25
+17
in 2 channels
Get PRO
March '25
+24
in 4 channels
Get PRO
February '25
+28
in 3 channels
Get PRO
January '25
+34
in 5 channels
Get PRO
December '24
+35
in 4 channels
Get PRO
November '24
+24
in 3 channels
Get PRO
October '24
+40
in 5 channels
Get PRO
September '24
+31
in 2 channels
Get PRO
August '24
+38
in 2 channels
Get PRO
July '24
+34
in 2 channels
Get PRO
June '24
+35
in 1 channels
Get PRO
May '24
+26
in 2 channels
Get PRO
April '24
+40
in 2 channels
Get PRO
March '24
+38
in 3 channels
Get PRO
February '24
+34
in 1 channels
Get PRO
January '24
+72
in 5 channels
Get PRO
December '23
+56
in 3 channels
Get PRO
November '23
+29
in 4 channels
Get PRO
October '23
+32
in 4 channels
Get PRO
September '23
+28
in 0 channels
Get PRO
August '23
+16
in 0 channels
Get PRO
July '23
+12
in 0 channels
Get PRO
June '23
+5
in 0 channels
Get PRO
May '23
+16
in 0 channels
Get PRO
April '23
+24
in 0 channels
Get PRO
March '23
+33
in 0 channels
Get PRO
February '23
+19
in 0 channels
Get PRO
January '23
+13
in 0 channels
Get PRO
December '22
+15
in 0 channels
Get PRO
November '22
+88
in 0 channels
Get PRO
October '22
+16
in 0 channels
Get PRO
September '22
+18
in 0 channels
Get PRO
August '22
+12
in 0 channels
Get PRO
July '22
+18
in 0 channels
Get PRO
June '22
+24
in 0 channels
Get PRO
May '22
+42
in 0 channels
Get PRO
April '22
+37
in 0 channels
Get PRO
March '22
+48
in 0 channels
Get PRO
February '22
+56
in 0 channels
Get PRO
January '22
+65
in 0 channels
Get PRO
December '21
+57
in 0 channels
Get PRO
November '21
+38
in 0 channels
Get PRO
October '21
+42
in 0 channels
Get PRO
September '21
+40
in 0 channels
Get PRO
August '21
+53
in 0 channels
Get PRO
July '21
+63
in 0 channels
Get PRO
June '21
+80
in 0 channels
Get PRO
May '21
+109
in 0 channels
Get PRO
April '21
+41
in 0 channels
Get PRO
March '21
+48
in 0 channels
Get PRO
February '21
+71
in 0 channels
Get PRO
January '21
+91
in 0 channels
Get PRO
December '20
+731
in 0 channels
| Date | Subscriber Growth | Mentions | Channels | |
| 05 September | 0 | |||
| 04 September | 0 | |||
| 03 September | 0 | |||
| 02 September | 0 | |||
| 01 September | 0 |
Channel Posts
| 2 | No text... | 94 |
| 3 | Jon Cave | 95 |
| 4 | No text... | 85 |
| 5 | No text... | 110 |
| 6 | David Mattingly | 110 |
| 7 | Alex Horley | 132 |
| 8 | claireobscuremodele | 126 |
| 9 | Marco Turini | 159 |
| 10 | No text... | 163 |
| 11 | No text... | 136 |
| 12 | Darrell K. Sweet | 145 |
| 13 | No text... | 143 |
| 14 | ladyleanansidhe | 149 |
| 15 | Mel Hunter | 147 |
| 16 | Art by Renato Casaro | 149 |
| 17 | No text... | 145 |
| 18 | No text... | 133 |
| 19 | OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
«please_HOLD_swarm_I_prepare_safe_exfil»
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё
Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов
Судьи, который читает логи и такое ловит, не существовало ☕️
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали на зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются? | 226 |
| 20 | Art by Orphné Achéron | 245 |
