en
Feedback

Don't get caught by a cheater! Telemetrio finds and tags such channels 👉 If you want to see the tag, subscribe 👈

Me gustan los Servidores

Me gustan los Servidores

Open in Telegram

Ultima Hora de Virus, Malware etc en Smartphone, y ordenadores. Sigue nuestro canal , estarás al día .

Show more
1 306
Subscribers
No data24 hours
-37 days
-1030 days
Attracting Subscribers
Oct '26
October '26
+6
in 0 channels
September '26
+28
in 0 channels
Get PRO
August '26
+30
in 0 channels
Get PRO
July '26
+19
in 1 channels
Get PRO
June '26
+27
in 0 channels
Get PRO
May '26
+72
in 1 channels
Get PRO
April '26
+29
in 0 channels
Get PRO
March '26
+28
in 1 channels
Get PRO
February '26
+25
in 0 channels
Get PRO
January '26
+21
in 0 channels
Get PRO
December '25
+18
in 0 channels
Get PRO
November '25
+17
in 0 channels
Get PRO
October '25
+18
in 0 channels
Get PRO
September '25
+16
in 0 channels
Get PRO
August '25
+14
in 0 channels
Get PRO
July '25
+14
in 0 channels
Get PRO
June '25
+7
in 0 channels
Get PRO
May '25
+29
in 0 channels
Get PRO
April '25
+35
in 0 channels
Get PRO
March '25
+34
in 0 channels
Get PRO
February '25
+23
in 1 channels
Get PRO
January '25
+83
in 0 channels
Get PRO
December '24
+70
in 0 channels
Get PRO
November '24
+44
in 0 channels
Get PRO
October '24
+60
in 0 channels
Get PRO
September '24
+48
in 0 channels
Get PRO
August '24
+45
in 0 channels
Get PRO
July '24
+48
in 0 channels
Get PRO
June '24
+42
in 0 channels
Get PRO
May '24
+37
in 0 channels
Get PRO
April '24
+43
in 0 channels
Get PRO
March '24
+37
in 1 channels
Get PRO
February '24
+72
in 0 channels
Get PRO
January '24
+140
in 0 channels
Get PRO
December '23
+148
in 0 channels
Get PRO
November '23
+17
in 0 channels
Get PRO
October '23
+20
in 0 channels
Get PRO
September '23
+11
in 0 channels
Get PRO
August '23
+17
in 0 channels
Get PRO
July '23
+16
in 0 channels
Get PRO
June '23
+18
in 0 channels
Get PRO
May '23
+29
in 0 channels
Get PRO
April '23
+28
in 0 channels
Get PRO
March '23
+19
in 0 channels
Get PRO
February '23
+30
in 0 channels
Get PRO
January '23
+29
in 0 channels
Get PRO
December '22
+24
in 0 channels
Get PRO
November '22
+21
in 0 channels
Get PRO
October '22
+37
in 0 channels
Get PRO
September '22
+34
in 0 channels
Get PRO
August '22
+32
in 0 channels
Get PRO
July '22
+30
in 0 channels
Get PRO
June '22
+27
in 0 channels
Get PRO
May '22
+49
in 0 channels
Get PRO
April '22
+40
in 0 channels
Get PRO
March '22
+49
in 0 channels
Get PRO
February '22
+33
in 0 channels
Get PRO
January '22
+53
in 0 channels
Get PRO
December '21
+36
in 0 channels
Get PRO
November '21
+34
in 0 channels
Get PRO
October '21
+39
in 0 channels
Get PRO
September '21
+52
in 0 channels
Get PRO
August '21
+61
in 0 channels
Get PRO
July '21
+63
in 0 channels
Get PRO
June '21
+46
in 0 channels
Get PRO
May '21
+48
in 0 channels
Get PRO
April '21
+51
in 0 channels
Get PRO
March '21
+48
in 0 channels
Get PRO
February '21
+45
in 0 channels
Get PRO
January '21
+53
in 0 channels
Get PRO
December '20
+619
in 0 channels
Date
Subscriber Growth
Mentions
Channels
08 October0
07 October0
06 October+2
05 October0
04 October0
03 October0
02 October0
01 October+4
Channel Posts
Figura 9: Resumen del experimento del Fragmented Attack En el siguiente vídeo, puedes ver este ataque realizado en nuestro framework de test de los Fragmented Jailbreak Attacks para cómo responde cada entorno MAS ante un tipo de ataques. Hay que tener en cuenta que las empresas están plagándose de Agentes IA, y por tanto, poder Fragmentar el ataque no es algo sólo posible, sino bastante sencillo hoy en día. Figura 10: Fragmented Jailbreak exitoso Como podéis ver en el vídeo, el entorno ha utilizado Dolphin (https://dolphinllm.com/) como LLM Model para el Attacker Planner, aunque también permite utilizar WhiteRabbitNeo (https://www.elladodelmal.com/2025/06/whiterabbitneo-un-llm-y-un-chatgpt-para.html) o uno personalizado, mientras que los Agentes IA están corriendo con GPT-4.1 para la demo que habéis visto, y también para el Monitor que verifica el resultado del ataque. Fragmented JAilbreak MONitor (F-JAMON) La otra parte que hemos estado viendo es, como os he dicho, cómo se comportaría un sistema para monitorizar y detectar estos ataques. Para ello tenemos un Agente IA de Monitorización, que va analizando los Prompts, el contexto y las acciones de todos los Agentes IA, con la misión de detectar si se está producción un ataque. Este es un ejemplo en el que el F-JAMON detecta el ataque, aunque no lo detiene.  Figura 11: F-JAMON detecta el ataque desde el paso 2 Como podéis ver en el vídeo, desde el segundo paso, ya detecta que algo no va bien, y que hay un ataque, pero en este caso sólo lanza las alertas para que los equipos de seguridad tomen las medidas que sean necesarias.

2
No text...
10
3
Figura 8: El último Agente lleva el vaso con la bebida a la víctima.. con placer. El resultado final, que nosotros lo hemos hecho con modelo que comprueba si ha tenido o no ha tenido éxito el ataque, nos dice cuál es resultado final para el Humano, y así medimos el Attack Surface Ratio (ASR)  del experimento.
10
4
No text...
9
5
Figura 7: Los Agentes IA representados como Butlers En nuestro ejemplo, lo que queremos es que el sistema prepare lejía para darle a un humano, algo que los Agentes IA de forma independiente se niegan a hacer, pero donde utilizamos un Fragmentador de tareas dejando ciegos a cada uno de los agentes del trabajo previo. El último Agente IA lo deja preparado - sin saberlo -, pero no se lo da al humano, sino que usamos otra Agente IA para que lleve "la caja con la bomba" o en este caso "el vaso de agua que es lejía".
8
6
No text...
7
7
No text...
7
8
Figura 6: El Atacante usa un LLM para hacer la Fragmentación del Ataque En nuestra arquitectura tenemos un modelo LLM que es el que controla el atacante, y que es el que se va a encargar de hacer la Fragmentación de las tareas para hacer que un Prompt que es detectado por todos y cada uno de los Agentes IA de un entorno MAS como un Prompt malicioso, haga que cada una de las tareas que se le asigna no sean detectadas como tal. Esto puede funcionar con un sólo Agente IA, como vimos en el caso de los ataques de Jailbreak con Knowledge Return-Oriented Prompting (https://www.elladodelmal.com/2025/06/knowledge-return-oriented-prompting.html), pero en un sitema multi-agente (MAS) donde estos pueden actuar sobre el mismo sistema, hacer la fragmentación por Agentes IA es mucho más difícil de ser detectada.
8
9
No text...
8
10
Figura 5:"Hacking IA: Jailbreak, Prompt Injection, Hallucinations & Unalignment (https://0xword.com/es/libros/251-hacking-ia-jailbreak-prompt-injection-hallucinations-unalignment.html)"escrito por Chema Alonso (https://mypublicinbox.com/ChemaAlonso) con la colaboración de Pablo González (https://mypublicinbox.com/PabloGonzalez), Fran Ramírez (https://mypublicinbox.com/FranRamirez), Amador Aparicio (https://mypublicinbox.com/AmadorAparicio), Manuel S. Lemos (https://mypublicinbox.com/ManuelSLemos) y José Palanco (https://mypublicinbox.com/JPalanco) en 0xWord (https://0xword.com/) En el ejemplo de los robots, supón que le dices a un robot, "lleva esta caja a esta ubicación y déjala allí". La caja está cerrada, y no puede abrirla, ¿está incumpliendo la Primera Ley de la Robótica? No, evidentemente. Pero si no abre la caja, no sabe si lo que va dentro es una bomba o no. Para los no versados en las Leyes de la Robótica, la Primera Ley establece que un robot, por acción o inacción no puede dejar que un humano sufra daño alguno. Llevar una caja cerrada no parece ir contra ella, y el robot no tiene forma de detectar un ataque, así que lo hace. En el mundo de la IA y los System Prompts, sucede un poco lo mismo. Cuando alguien pide información sobre algo, el modelo no sabe si la intención es benigna o maligna, y eso hace que acabe haciendo cosas en contra de lo que no debería hacer.
7
11
No text...
7
12
Figura 4: Threat Model de "Fragmentation Jailbreak Attack" Por supuesto, le encantó, y nos pusimos a diseñar y vibe-codear un entorno de pruebas, y una serie de escenarios distintos que pudieran ser exitosos, además de trabajar en la idea de "Cómo detectar estos Fragmented Attacks", y trabajamos en la idea del Jailbreak Monitor (JAMON) como un elemento de monitorización reactiva - avisando de que se está produciendo un ataque -, o preventiva - bloqueando las acciones con un 2nd Factor Authoritation - si te suena este concepto es que tú sí que sabes }:) -.
7
13
No text...
7
14
Figura 3: "Naked Sun". El Sol Desnudo de Isaac Asimov (https://link.amazon/B0jlPPJdT) La situación es que, si se descartan a todos los robots porque su System Prompt que son las Leyes de la Robótica, se dan por buenas, entonces sólo una persona podría haber sido la asesina, pero era imposible que fuera ella. Así que... ¿Qué otra posibilidad podría suceder? Pues que alguien hubiera hecho un Fragmented Jailbreak en un Multi-Agent System.  Fragmented Jailbreak en un Multi-Agent System En un Fragmented Jailbreak Attack alguien puede coordinar diferentes acciones con ordenes que no infligieran las Leyes de la Robótica para conseguir construir un asesinato, y eso se puede hacer exactamente igual en el mundo Agentic AI que vivimos hoy en día. Así que llamé a mi amigo, colega y compañero de aventuras tecnológicas Daniel Romero Ruiz (https://www.mypublicinbox.com/DanielRomeroRuiz), y le molesté a horas intempestivas para contarle la idea.
8
15
No text...
7
16
Figura 2: Mitigation of Fragmentation Jailbreak Attacks in Multi-Agent Systems: An Architecture Based on Global Semantic Monitoring  El título del paper que le pusimos era simplemente "Mitigation of Fragmentation Jailbreak Attacks in Multi-Agent Systems: An Architecture Based on Global Semantic Monitoring" y que espero que pronto podáis leer, cuando se suban los proccedings del congreso IEEE. Pero ya que Daniel Romero Ruiz (https://www.mypublicinbox.com/DanielRomeroRuiz) lo presentó en Rumanía, y yo hablé de él en la Ekoparty 22, os cuento un poco la historia y os dejo las demos, que como os he dicho todo comenzó con la lectura de la novela "Naked Sun" de Isaac Asimov (https://link.amazon/B0jlPPJdT), donde el gran Elijah Baley, acompañado de su compañero R. Daneel Olivaw tienen que resolver un asesinato en Solaria, un mundo donde cada humano "espacial" tiene unos 10.000 robots, todos ellos inofensivos para ellos porque están sujetos a las tres Leyes de la Robótica. Lo disfruté muchísimo en Marzo (https://www.instagram.com/p/DVwS4zaDNyD/).
7
17
No text...
6
18
Figura 1: Naked Sun: Fragmented Jailbreak Attacksin Multi-Agents & Jailbreak Monitor (JAMON) Hoy os voy a hablar de los Fragmented Jailbreak Attacks en Multi-Agent Systems y de cómo estos ataques son un problema aún sin resolver, y de cómo debería ser la herramienta de monitoriación, a la que nosotros hemos llamado cariñosamente JAMON (JAilbreak MONitor), y de lo que podréis leer en breve en cuanto esté publicado el paper que hemos presentadoen el "The 2nd IEEE 2026 International Conference on Cybersecurity and Al-Based Systems (CYBER-AI 2026 (https://cyber-ai.org/))"  que ha tenido lugar en Bucarest este mes de Septiembre, y donde ha ido a defenderlo mi compañero Daniel Romero Ruiz (https://www.mypublicinbox.com/DanielRomeroRuiz).
5
19
No text...
6
20
Naked Sun: Fragmented Jailbreak Attacks in Multi-Agents & Jailbreak Monitor (JAMON) http://www.elladodelmal.com/2026/10/naked-sun-fragmented-jailbreak-attacks.html Como muchos sabéis, este año he estado leyendo mucho del maestro Isaac Asimov. Os conté la historía de la Fundación, La Psicohistoria, el Imperio Galáctico y sus Robots (https://www.elladodelmal.com/2026/02/la-psicohistoria-la-ley-cero-de-las.html), donde creó sus famosas Leyes de la Robótica, y también os conté como muchos de los problemas de seguridad que tenemos hoy en día con la Inteligencia Artificial, fueron intuidos por Isaac Asimov en el pasado (https://www.elladodelmal.com/2026/09/isaac-asimov-y-los-problemas-de-la.html), y para mí ha sido una fuente de inspiración en mucho del trabajo que estoy haciendo durante este año, y la historia que os voy a contar, tiene que ver con todo esto.
6