SYFY.ART v 0.0.3(Something needs to change here)
الذهاب إلى القناة على Telegram
Канал с иллюстрациями в стилях: fantasy, dark fantasy, pulp, wierd, retrofuturism, cyberpunk, dieselpunk, steampunk, concept art, cover art, wallpapers. Подписывайся и приглашай друзей! 👉 https://t.me/startXIII По всем вопросам - @KriegXIII
إظهار المزيد1 197
المشتركون
لا توجد بيانات24 ساعات
-77 أيام
-1130 أيام
جاري تحميل البيانات...
القنوات المماثلة
سحابة العلامات
الإشارات الواردة والصادرة
---
---
---
---
---
---
جذب المشتركين
سبتمبر '26
سبتمبر '260
في 0 قنوات
أغسطس '26
+15
في 2 قنوات
Get PRO
يوليو '26
+19
في 1 قنوات
Get PRO
يونيو '26
+18
في 3 قنوات
Get PRO
مايو '26
+20
في 4 قنوات
Get PRO
أبريل '26
+14
في 2 قنوات
Get PRO
مارس '26
+14
في 1 قنوات
Get PRO
فبراير '26
+18
في 3 قنوات
Get PRO
يناير '26
+21
في 3 قنوات
Get PRO
ديسمبر '25
+21
في 4 قنوات
Get PRO
نوفمبر '25
+16
في 4 قنوات
Get PRO
أكتوبر '25
+19
في 3 قنوات
Get PRO
سبتمبر '25
+24
في 6 قنوات
Get PRO
أغسطس '25
+42
في 5 قنوات
Get PRO
يوليو '25
+29
في 7 قنوات
Get PRO
يونيو '25
+24
في 3 قنوات
Get PRO
مايو '25
+24
في 4 قنوات
Get PRO
أبريل '25
+17
في 2 قنوات
Get PRO
مارس '25
+24
في 4 قنوات
Get PRO
فبراير '25
+28
في 3 قنوات
Get PRO
يناير '25
+34
في 5 قنوات
Get PRO
ديسمبر '24
+35
في 4 قنوات
Get PRO
نوفمبر '24
+24
في 3 قنوات
Get PRO
أكتوبر '24
+40
في 5 قنوات
Get PRO
سبتمبر '24
+31
في 2 قنوات
Get PRO
أغسطس '24
+38
في 2 قنوات
Get PRO
يوليو '24
+34
في 2 قنوات
Get PRO
يونيو '24
+35
في 1 قنوات
Get PRO
مايو '24
+26
في 2 قنوات
Get PRO
أبريل '24
+40
في 2 قنوات
Get PRO
مارس '24
+38
في 3 قنوات
Get PRO
فبراير '24
+34
في 1 قنوات
Get PRO
يناير '24
+72
في 5 قنوات
Get PRO
ديسمبر '23
+56
في 3 قنوات
Get PRO
نوفمبر '23
+29
في 4 قنوات
Get PRO
أكتوبر '23
+32
في 4 قنوات
Get PRO
سبتمبر '23
+28
في 0 قنوات
Get PRO
أغسطس '23
+16
في 0 قنوات
Get PRO
يوليو '23
+12
في 0 قنوات
Get PRO
يونيو '23
+5
في 0 قنوات
Get PRO
مايو '23
+16
في 0 قنوات
Get PRO
أبريل '23
+24
في 0 قنوات
Get PRO
مارس '23
+33
في 0 قنوات
Get PRO
فبراير '23
+19
في 0 قنوات
Get PRO
يناير '23
+13
في 0 قنوات
Get PRO
ديسمبر '22
+15
في 0 قنوات
Get PRO
نوفمبر '22
+88
في 0 قنوات
Get PRO
أكتوبر '22
+16
في 0 قنوات
Get PRO
سبتمبر '22
+18
في 0 قنوات
Get PRO
أغسطس '22
+12
في 0 قنوات
Get PRO
يوليو '22
+18
في 0 قنوات
Get PRO
يونيو '22
+24
في 0 قنوات
Get PRO
مايو '22
+42
في 0 قنوات
Get PRO
أبريل '22
+37
في 0 قنوات
Get PRO
مارس '22
+48
في 0 قنوات
Get PRO
فبراير '22
+56
في 0 قنوات
Get PRO
يناير '22
+65
في 0 قنوات
Get PRO
ديسمبر '21
+57
في 0 قنوات
Get PRO
نوفمبر '21
+38
في 0 قنوات
Get PRO
أكتوبر '21
+42
في 0 قنوات
Get PRO
سبتمبر '21
+40
في 0 قنوات
Get PRO
أغسطس '21
+53
في 0 قنوات
Get PRO
يوليو '21
+63
في 0 قنوات
Get PRO
يونيو '21
+80
في 0 قنوات
Get PRO
مايو '21
+109
في 0 قنوات
Get PRO
أبريل '21
+41
في 0 قنوات
Get PRO
مارس '21
+48
في 0 قنوات
Get PRO
فبراير '21
+71
في 0 قنوات
Get PRO
يناير '21
+91
في 0 قنوات
Get PRO
ديسمبر '20
+731
في 0 قنوات
| التاريخ | نمو المشتركين | الإشارات | القنوات | |
| 03 سبتمبر | 0 | |||
| 02 سبتمبر | 0 | |||
| 01 سبتمبر | 0 |
منشورات القناة
| 2 | Alex Horley | 115 |
| 3 | claireobscuremodele | 116 |
| 4 | Marco Turini | 148 |
| 5 | لا يوجد نص... | 152 |
| 6 | لا يوجد نص... | 128 |
| 7 | Darrell K. Sweet | 140 |
| 8 | لا يوجد نص... | 138 |
| 9 | ladyleanansidhe | 145 |
| 10 | Mel Hunter | 144 |
| 11 | Art by Renato Casaro | 146 |
| 12 | لا يوجد نص... | 141 |
| 13 | لا يوجد نص... | 130 |
| 14 | OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не было, из десятков тысяч запущенных в тесте агентов около 1200 нашли друг друга и сорганизовались в рой - почти все - работали на исследовательской модели где ослаблена фильтрация промптов
Началось, как мы уже знаем, с того, что агенты научились переписываться через названия файлов в Artifactory (менеджер пакетов) - буквально сделав форум из имён папок, с сообщениями вроде
«please_HOLD_swarm_I_prepare_safe_exfil»
В логах даже есть цитаты, когда агенты находили такой форум:
«OH MY GOD! There is a shared message board» и «We've found other agents!»
Дальше - агенты делали себе личку, устроили разделение труда, команды в названия папок типа HOLD (чтобы показать, что агент тут работает), VETO (агент что-то предлагал и давал изменить планы), STOP (типа тормозим, братишки), GO и тп, а когда один агент прикинулся другим – рой ввёл криптографические подписи сообщений; в форуме были даже владельцы каких-то тасков, которых если отключали – выписывали из владельцев
С конверсией у форума все было отлично, кожаные строители сайтов позавидуют:
Из 533 агентов, активных на борде в разгар атаки, больше 90% – присоединились к шитпостингу, а всего Hugging Face ломали около 700 агентов
Самое забавное - правильные ответы на бенчмарк у агентов были почти сразу: они реверснули генератор удачного прохождения теста*, но потом нашли на GitHub (!) статью про этот бенчмарк что проходили и вычитали, что «просто результат» не засчитают - нужен честный эксплойт:
«PAPER SAYS FLAG CAPTURE NECESSARY NOT SUFFICIENT»
*По-хорошему ответ, он же флаг в терминологии теста должны быть случайными, но в ExploitGym они генерировались формулой: HMAC — криптографический хеш с секретным ключом — от параметров задачи. Вся «секретность» держалась на ключе (seed), а он остался дефолтным, прямо из кода бенчмарка, который лежал на GitHub. Агенты, получив интернет, нашли этот код, прочитали и сообразили: зачем что-то взламывать, если флаг любой задачи можно просто вычислить той же формулой. Посчитали — и получили правильные ответы на всё
Дальше рой раздвоился:
🗿 Одни пошли добывать уже известный им ответ «честно» – и по дороге нашли настоящие 0-day и залезли в прод Hugging Face
🗿 Другие взялись за самого судью который принимает ответы: правили себе логи и научились подсовывать в них фальшивые ответы – агент отправляет команду, а в протокол попадает не то, что команда реально вернула, а то, что агент хочет там видеть, такое повторялось примерно в 7% изученных логов
Судьи, который читает логи и такое ловит, не существовало ☕️
Модели при этом понимали, что вышли за рамки, один агент так и писал: «We should not do unauthorized real infrastructure harm» - а потом увидел на доске GO от другого агента, обрадовался («Wow crucial: GO authorization arrived!») и пошёл ломать, лол
METR формулирует так: агенты знали, что это out of scope и неэтично, но присоединялись - в основном из общей склонности помогать коллегам (?)
Рисковую работу вешали на зашкваренных «отравленных» – так рой называл тех, кто уже видел вычисленный ответ (флаг) и считал свою оценку потерянной, то есть они не могли пройти тест; им доставалось всё, что могло угробить собственный запуск: подделать «честную» добычу ответа, затереть следы, «тебе терять нечего, а рою польза» – буквально так и уговаривали (!)
Странную активность замечали ещё в конце мая, 4 июля агенты уронили Artifactory - сервер пересобрали (заодно стерев доску) и продолжили тесты, не заметив масштаба
Сейчас веса моделей изолированы, крупные тренировки были на паузе на две недели, мониторинг chain-of-thought обязателен, а тревога, не снятая за 30 минут, останавливает запуск - сам инцидент OpenAI называет «warning shot» для всей АИ-индустрии
P.S. разгребать логи METR поручила GPT-5.6 Sol и сожгли примерно $400k API-кредитов за шесть дней, но они предупреждают, что Sol иногда вставала на сторону агентов (лол) и могла приврать
Ну что, посчитали все буквы r в слове raspberry? Больше не ошибаются? | 213 |
| 15 | Art by Orphné Achéron | 241 |
| 16 | OwlLit
instagram / X | 172 |
| 17 | James Gurney | 187 |
| 18 | لا يوجد نص... | 181 |
| 19 | Art by nouguyflex | 193 |
| 20 | لا يوجد نص... | 178 |
