Spammers usan Unicode oculto para evadir filtros, aunque la mayoria de mensajes cae
Microsoft identifica una campaña masiva que inserta caracteres invisibles entre letras para romper las firmas de detencion por keywords. El truco falla frente a las defensas modernas.

La tecnica conocida como ASCII smuggling salta de la investigacion sobre inyeccion de prompts en los modelos de lenguaje a las campañas de spam masivo. Investigadores de Microsoft detectaron un ataque a gran escala que utiliza caracteres Unicode ocultos para evadir los filtros basados en texto plano, aunque el resultado practico del intento de evasion es, en el mejor de los casos, limited.
El mecanismo es conocido: el bloque de tags de Unicode (U+E0000 a U+E007F) contiene copias invisibles de los caracteres ASCII imprimibles. Durante los dos ultimos anos, los investigadores de seguridad de IA han utilizado estos caracteres para esconder instrucciones maliciosas que los modelos leen pero los humanos ignoran. Los atacantes han adaptado esta tecnica para burlar las verificaciones de firma literal en los correos electronicos. Al insertar un caracter invisible dentro de una palabra clave, como "funding" (con un tag oculto entre la "n" y la "d"), el texto visual sigue siendo legible para el receptor, pero el analizador que busca la cadena exacta no encuentra coincidencia.
Esto afecta no solo a los filtros sencillos, sino a los clasificadores de machine learning modernes. Estos sistemas segmentan el texto en tokens antes de procesarlo. La insercion de un caracter oculto rompe el token original en fragmentos desconocidos o rarezas que el modelo no asociara inmediatamente con estafa financiera, reduciendo la probabilidad de detencion automatica basada en el contenido del mensaje.
Por desgracia para los atacantes, la estrategia tiene defectos de diseno. Microsoft reporto que mas del 99% de los mensajes de esta campaña fueron bloqueados por otras capas de defensa: reputacion del remitente, analisis de URLs, autenticacion de dominios y filtros de impersonacion de marcas. Ademas, el propio hecho de usar estos caracteres Unicode es ahora una senal de confianza alta para los detectores, ya que son extremadamente raros en el correo legitimo. En efecto, lo que intentaba ser un camuflaje se convirtiio en un baliza.
Un detalle operativo revela la naturaleza automatizada del ataque: los picos de trafico caian en dias laborables, con caidas drasticas los domingos. Entre febrero y marzo, los volumenes oscilaron entre 1 y 2,37 millones de mensajes diarios. El trafico se genero mediante ActiveCampaign, una plataforma de marketing legtima, aprovechando su reputacion de infraestructura de envio. Microsoft encontro que los atacantes desplegaron cerca de 150 dominios desechables construidos con combinaciones de varias decenas de palabras financieras clave.
Un falso positivo no menor
La firma de detencion inicial de Microsoft tenia un problema de configuracion ironico: detonaba constantemente en correos legitimos que contenian las banderas de Inglaterra, Escocia y Gales. Estos emojis estan construidos internamente utilizando los mismos caracteres Unicode invisibles que los atacantes aprovecharon. Tras ajustar esta falsa alerta, la monitorizacion permitio rastrear la vida util de la campaña, que Decay desde su pico en febrero hasta dejar de ser relevante en junio.
El caso ilustra como las tecnicas de evasion de IA estan filtrando rapidamente al spam tradicional, pero tambien recuerda que la seguridad en profundidad sigue siendo la unica defensa viable. Un solo filtro de texto plano es insuficiente, pero el analisis de reputacion y comportamiento sigue siendo inexpugnable ante trucos visuales simples.
Para los administradores de seguridad, la recomendacion de Microsoft es clara: normalizar y limpiar los caracteres Unicode antes de aplicar cualquier logica de firma o clasificacion. Es un paso adicional minimo, pero que cierra una brecha que los atacantes estan probando sistematicamente.


