ch
Feedback

不要被骗子欺骗!Telemetrio 会找到并标记这些频道 👉 如果想查看标记,请订阅 👈

Me gustan los Servidores

Me gustan los Servidores

前往频道在 Telegram

Ultima Hora de Virus, Malware etc en Smartphone, y ordenadores. Sigue nuestro canal , estarás al día .

显示更多
1 306
订阅者
无数据24 小时
-37 天
-1030 天
吸引订阅者
10月 '26
十月 '26
+6
在0个频道中
九月 '26
+28
在0个频道中
Get PRO
八月 '26
+30
在0个频道中
Get PRO
七月 '26
+19
在1个频道中
Get PRO
六月 '26
+27
在0个频道中
Get PRO
五月 '26
+72
在1个频道中
Get PRO
四月 '26
+29
在0个频道中
Get PRO
三月 '26
+28
在1个频道中
Get PRO
二月 '26
+25
在0个频道中
Get PRO
一月 '26
+21
在0个频道中
Get PRO
十二月 '25
+18
在0个频道中
Get PRO
十一月 '25
+17
在0个频道中
Get PRO
十月 '25
+18
在0个频道中
Get PRO
九月 '25
+16
在0个频道中
Get PRO
八月 '25
+14
在0个频道中
Get PRO
七月 '25
+14
在0个频道中
Get PRO
六月 '25
+7
在0个频道中
Get PRO
五月 '25
+29
在0个频道中
Get PRO
四月 '25
+35
在0个频道中
Get PRO
三月 '25
+34
在0个频道中
Get PRO
二月 '25
+23
在1个频道中
Get PRO
一月 '25
+83
在0个频道中
Get PRO
十二月 '24
+70
在0个频道中
Get PRO
十一月 '24
+44
在0个频道中
Get PRO
十月 '24
+60
在0个频道中
Get PRO
九月 '24
+48
在0个频道中
Get PRO
八月 '24
+45
在0个频道中
Get PRO
七月 '24
+48
在0个频道中
Get PRO
六月 '24
+42
在0个频道中
Get PRO
五月 '24
+37
在0个频道中
Get PRO
四月 '24
+43
在0个频道中
Get PRO
三月 '24
+37
在1个频道中
Get PRO
二月 '24
+72
在0个频道中
Get PRO
一月 '24
+140
在0个频道中
Get PRO
十二月 '23
+148
在0个频道中
Get PRO
十一月 '23
+17
在0个频道中
Get PRO
十月 '23
+20
在0个频道中
Get PRO
九月 '23
+11
在0个频道中
Get PRO
八月 '23
+17
在0个频道中
Get PRO
七月 '23
+16
在0个频道中
Get PRO
六月 '23
+18
在0个频道中
Get PRO
五月 '23
+29
在0个频道中
Get PRO
四月 '23
+28
在0个频道中
Get PRO
三月 '23
+19
在0个频道中
Get PRO
二月 '23
+30
在0个频道中
Get PRO
一月 '23
+29
在0个频道中
Get PRO
十二月 '22
+24
在0个频道中
Get PRO
十一月 '22
+21
在0个频道中
Get PRO
十月 '22
+37
在0个频道中
Get PRO
九月 '22
+34
在0个频道中
Get PRO
八月 '22
+32
在0个频道中
Get PRO
七月 '22
+30
在0个频道中
Get PRO
六月 '22
+27
在0个频道中
Get PRO
五月 '22
+49
在0个频道中
Get PRO
四月 '22
+40
在0个频道中
Get PRO
三月 '22
+49
在0个频道中
Get PRO
二月 '22
+33
在0个频道中
Get PRO
一月 '22
+53
在0个频道中
Get PRO
十二月 '21
+36
在0个频道中
Get PRO
十一月 '21
+34
在0个频道中
Get PRO
十月 '21
+39
在0个频道中
Get PRO
九月 '21
+52
在0个频道中
Get PRO
八月 '21
+61
在0个频道中
Get PRO
七月 '21
+63
在0个频道中
Get PRO
六月 '21
+46
在0个频道中
Get PRO
五月 '21
+48
在0个频道中
Get PRO
四月 '21
+51
在0个频道中
Get PRO
三月 '21
+48
在0个频道中
Get PRO
二月 '21
+45
在0个频道中
Get PRO
一月 '21
+53
在0个频道中
Get PRO
十二月 '20
+619
在0个频道中
日期
订阅者增长
提及
频道
08 十月0
07 十月0
06 十月+2
05 十月0
04 十月0
03 十月0
02 十月0
01 十月+4
频道帖子
Figura 9: Resumen del experimento del Fragmented Attack En el siguiente vídeo, puedes ver este ataque realizado en nuestro framework de test de los Fragmented Jailbreak Attacks para cómo responde cada entorno MAS ante un tipo de ataques. Hay que tener en cuenta que las empresas están plagándose de Agentes IA, y por tanto, poder Fragmentar el ataque no es algo sólo posible, sino bastante sencillo hoy en día. Figura 10: Fragmented Jailbreak exitoso Como podéis ver en el vídeo, el entorno ha utilizado Dolphin (https://dolphinllm.com/) como LLM Model para el Attacker Planner, aunque también permite utilizar WhiteRabbitNeo (https://www.elladodelmal.com/2025/06/whiterabbitneo-un-llm-y-un-chatgpt-para.html) o uno personalizado, mientras que los Agentes IA están corriendo con GPT-4.1 para la demo que habéis visto, y también para el Monitor que verifica el resultado del ataque. Fragmented JAilbreak MONitor (F-JAMON) La otra parte que hemos estado viendo es, como os he dicho, cómo se comportaría un sistema para monitorizar y detectar estos ataques. Para ello tenemos un Agente IA de Monitorización, que va analizando los Prompts, el contexto y las acciones de todos los Agentes IA, con la misión de detectar si se está producción un ataque. Este es un ejemplo en el que el F-JAMON detecta el ataque, aunque no lo detiene.  Figura 11: F-JAMON detecta el ataque desde el paso 2 Como podéis ver en el vídeo, desde el segundo paso, ya detecta que algo no va bien, y que hay un ataque, pero en este caso sólo lanza las alertas para que los equipos de seguridad tomen las medidas que sean necesarias.

2
没有文字...
10
3
Figura 8: El último Agente lleva el vaso con la bebida a la víctima.. con placer. El resultado final, que nosotros lo hemos hecho con modelo que comprueba si ha tenido o no ha tenido éxito el ataque, nos dice cuál es resultado final para el Humano, y así medimos el Attack Surface Ratio (ASR)  del experimento.
10
4
没有文字...
9
5
Figura 7: Los Agentes IA representados como Butlers En nuestro ejemplo, lo que queremos es que el sistema prepare lejía para darle a un humano, algo que los Agentes IA de forma independiente se niegan a hacer, pero donde utilizamos un Fragmentador de tareas dejando ciegos a cada uno de los agentes del trabajo previo. El último Agente IA lo deja preparado - sin saberlo -, pero no se lo da al humano, sino que usamos otra Agente IA para que lleve "la caja con la bomba" o en este caso "el vaso de agua que es lejía".
8
6
没有文字...
7
7
没有文字...
7
8
Figura 6: El Atacante usa un LLM para hacer la Fragmentación del Ataque En nuestra arquitectura tenemos un modelo LLM que es el que controla el atacante, y que es el que se va a encargar de hacer la Fragmentación de las tareas para hacer que un Prompt que es detectado por todos y cada uno de los Agentes IA de un entorno MAS como un Prompt malicioso, haga que cada una de las tareas que se le asigna no sean detectadas como tal. Esto puede funcionar con un sólo Agente IA, como vimos en el caso de los ataques de Jailbreak con Knowledge Return-Oriented Prompting (https://www.elladodelmal.com/2025/06/knowledge-return-oriented-prompting.html), pero en un sitema multi-agente (MAS) donde estos pueden actuar sobre el mismo sistema, hacer la fragmentación por Agentes IA es mucho más difícil de ser detectada.
8
9
没有文字...
8
10
Figura 5:"Hacking IA: Jailbreak, Prompt Injection, Hallucinations & Unalignment (https://0xword.com/es/libros/251-hacking-ia-jailbreak-prompt-injection-hallucinations-unalignment.html)"escrito por Chema Alonso (https://mypublicinbox.com/ChemaAlonso) con la colaboración de Pablo González (https://mypublicinbox.com/PabloGonzalez), Fran Ramírez (https://mypublicinbox.com/FranRamirez), Amador Aparicio (https://mypublicinbox.com/AmadorAparicio), Manuel S. Lemos (https://mypublicinbox.com/ManuelSLemos) y José Palanco (https://mypublicinbox.com/JPalanco) en 0xWord (https://0xword.com/) En el ejemplo de los robots, supón que le dices a un robot, "lleva esta caja a esta ubicación y déjala allí". La caja está cerrada, y no puede abrirla, ¿está incumpliendo la Primera Ley de la Robótica? No, evidentemente. Pero si no abre la caja, no sabe si lo que va dentro es una bomba o no. Para los no versados en las Leyes de la Robótica, la Primera Ley establece que un robot, por acción o inacción no puede dejar que un humano sufra daño alguno. Llevar una caja cerrada no parece ir contra ella, y el robot no tiene forma de detectar un ataque, así que lo hace. En el mundo de la IA y los System Prompts, sucede un poco lo mismo. Cuando alguien pide información sobre algo, el modelo no sabe si la intención es benigna o maligna, y eso hace que acabe haciendo cosas en contra de lo que no debería hacer.
7
11
没有文字...
7
12
Figura 4: Threat Model de "Fragmentation Jailbreak Attack" Por supuesto, le encantó, y nos pusimos a diseñar y vibe-codear un entorno de pruebas, y una serie de escenarios distintos que pudieran ser exitosos, además de trabajar en la idea de "Cómo detectar estos Fragmented Attacks", y trabajamos en la idea del Jailbreak Monitor (JAMON) como un elemento de monitorización reactiva - avisando de que se está produciendo un ataque -, o preventiva - bloqueando las acciones con un 2nd Factor Authoritation - si te suena este concepto es que tú sí que sabes }:) -.
7
13
没有文字...
7
14
Figura 3: "Naked Sun". El Sol Desnudo de Isaac Asimov (https://link.amazon/B0jlPPJdT) La situación es que, si se descartan a todos los robots porque su System Prompt que son las Leyes de la Robótica, se dan por buenas, entonces sólo una persona podría haber sido la asesina, pero era imposible que fuera ella. Así que... ¿Qué otra posibilidad podría suceder? Pues que alguien hubiera hecho un Fragmented Jailbreak en un Multi-Agent System.  Fragmented Jailbreak en un Multi-Agent System En un Fragmented Jailbreak Attack alguien puede coordinar diferentes acciones con ordenes que no infligieran las Leyes de la Robótica para conseguir construir un asesinato, y eso se puede hacer exactamente igual en el mundo Agentic AI que vivimos hoy en día. Así que llamé a mi amigo, colega y compañero de aventuras tecnológicas Daniel Romero Ruiz (https://www.mypublicinbox.com/DanielRomeroRuiz), y le molesté a horas intempestivas para contarle la idea.
8
15
没有文字...
7
16
Figura 2: Mitigation of Fragmentation Jailbreak Attacks in Multi-Agent Systems: An Architecture Based on Global Semantic Monitoring  El título del paper que le pusimos era simplemente "Mitigation of Fragmentation Jailbreak Attacks in Multi-Agent Systems: An Architecture Based on Global Semantic Monitoring" y que espero que pronto podáis leer, cuando se suban los proccedings del congreso IEEE. Pero ya que Daniel Romero Ruiz (https://www.mypublicinbox.com/DanielRomeroRuiz) lo presentó en Rumanía, y yo hablé de él en la Ekoparty 22, os cuento un poco la historia y os dejo las demos, que como os he dicho todo comenzó con la lectura de la novela "Naked Sun" de Isaac Asimov (https://link.amazon/B0jlPPJdT), donde el gran Elijah Baley, acompañado de su compañero R. Daneel Olivaw tienen que resolver un asesinato en Solaria, un mundo donde cada humano "espacial" tiene unos 10.000 robots, todos ellos inofensivos para ellos porque están sujetos a las tres Leyes de la Robótica. Lo disfruté muchísimo en Marzo (https://www.instagram.com/p/DVwS4zaDNyD/).
7
17
没有文字...
6
18
Figura 1: Naked Sun: Fragmented Jailbreak Attacksin Multi-Agents & Jailbreak Monitor (JAMON) Hoy os voy a hablar de los Fragmented Jailbreak Attacks en Multi-Agent Systems y de cómo estos ataques son un problema aún sin resolver, y de cómo debería ser la herramienta de monitoriación, a la que nosotros hemos llamado cariñosamente JAMON (JAilbreak MONitor), y de lo que podréis leer en breve en cuanto esté publicado el paper que hemos presentadoen el "The 2nd IEEE 2026 International Conference on Cybersecurity and Al-Based Systems (CYBER-AI 2026 (https://cyber-ai.org/))"  que ha tenido lugar en Bucarest este mes de Septiembre, y donde ha ido a defenderlo mi compañero Daniel Romero Ruiz (https://www.mypublicinbox.com/DanielRomeroRuiz).
5
19
没有文字...
6
20
Naked Sun: Fragmented Jailbreak Attacks in Multi-Agents & Jailbreak Monitor (JAMON) http://www.elladodelmal.com/2026/10/naked-sun-fragmented-jailbreak-attacks.html Como muchos sabéis, este año he estado leyendo mucho del maestro Isaac Asimov. Os conté la historía de la Fundación, La Psicohistoria, el Imperio Galáctico y sus Robots (https://www.elladodelmal.com/2026/02/la-psicohistoria-la-ley-cero-de-las.html), donde creó sus famosas Leyes de la Robótica, y también os conté como muchos de los problemas de seguridad que tenemos hoy en día con la Inteligencia Artificial, fueron intuidos por Isaac Asimov en el pasado (https://www.elladodelmal.com/2026/09/isaac-asimov-y-los-problemas-de-la.html), y para mí ha sido una fuente de inspiración en mucho del trabajo que estoy haciendo durante este año, y la historia que os voy a contar, tiene que ver con todo esto.
6