WhatsApp ha comenzado a probar Scam Alert, una nueva función de seguridad capaz de identificar posibles estafas utilizando inteligencia artificial directamente en el dispositivo del usuario. El sistema analiza determinados mensajes sin necesidad de enviar su contenido a los servidores de Meta, manteniendo así intacto uno de los principales pilares de la aplicación: el cifrado de extremo a extremo.
La función comenzó a desplegarse de forma limitada en fase beta el 12 de agosto de 2026 y, por ahora, es opcional. Su funcionamiento se basa en un modelo de aprendizaje automático ejecutado localmente en el teléfono, que analiza determinadas conversaciones para detectar patrones asociados con fraudes conocidos.
Una IA que analiza los mensajes directamente en el teléfono
Cuando el usuario activa Scam Alert desde los ajustes de WhatsApp, la aplicación descarga un modelo de inteligencia artificial ligero que permanece en el propio dispositivo.
Este modelo analiza principalmente los mensajes procedentes de personas que no están guardadas como contactos, buscando patrones lingüísticos y estructurales característicos de diferentes tipos de estafa.
Entre las señales que puede identificar se encuentran:
- Mensajes que intentan generar una sensación de urgencia.
- Peticiones de dinero o información personal.
- Intentos progresivos de establecer confianza con la víctima.
- Patrones asociados con las conocidas estafas de «pig-butchering», en las que el estafador desarrolla una relación ficticia con la víctima antes de solicitar dinero.
La diferencia fundamental está en que el análisis se realiza localmente.
«Ningún contenido de los mensajes sale del dispositivo para su clasificación ni se informa automáticamente a WhatsApp, Meta o cualquier otra persona».
De esta forma, Meta pretende combinar la detección automática de fraudes con la privacidad que proporciona el cifrado de extremo a extremo.
WhatsApp mostrará una alerta dentro de la conversación
Si el modelo considera que un mensaje tiene características propias de una posible estafa, WhatsApp mostrará un aviso dentro del chat.
La advertencia solamente será visible para el destinatario. El remitente no recibirá ninguna notificación indicando que su mensaje ha sido identificado como sospechoso.
A partir de ahí, el usuario podrá decidir qué hacer:
- Bloquear al remitente.
- Denunciar la conversación a WhatsApp.
- Continuar hablando con la persona pese a la advertencia.
- Confiar en el remitente, eliminando la alerta y evitando futuras advertencias para esa conversación.
La decisión queda, por tanto, en manos del usuario.
También puede ayudar a mejorar el sistema
WhatsApp incluye además una opción voluntaria para quienes decidan confiar en un remitente.
El usuario puede elegir compartir con WhatsApp los últimos cinco mensajes recibidos para ayudar a mejorar la precisión del sistema.
Este envío requiere una acción explícita del usuario y no se realiza automáticamente.
Meta asegura que mientras el modelo realiza la clasificación no existe una transferencia automática del contenido de las conversaciones a sus servidores.
No busca palabras concretas
Scam Alert no funciona simplemente buscando términos como «dinero», «inversión» o «urgente».
El modelo ha sido diseñado para analizar señales lingüísticas y estructurales dentro de las conversaciones, tratando de reconocer patrones característicos de determinados métodos de fraude.
Esto es especialmente importante porque muchas estafas modernas intentan evitar palabras obviamente sospechosas y construyen una relación con la víctima durante días o incluso semanas.
Meta ha desarrollado internamente el modelo y ha publicado información sobre su arquitectura para facilitar su revisión por parte de investigadores externos a través de su programa Bug Bounty.
Una protección que llega después de otros sistemas antifraude
Scam Alert amplía las medidas de seguridad que WhatsApp ya había comenzado a introducir.
En marzo de 2026, Meta presentó una función más específica destinada a detectar peticiones sospechosas para vincular dispositivos, un método utilizado por delincuentes para hacerse con cuentas mediante códigos de vinculación o códigos QR falsos.
Ahora la compañía amplía esa protección al contenido de las conversaciones, aunque inicialmente de forma limitada a mensajes procedentes de remitentes desconocidos.
La necesidad de este tipo de herramientas no es menor. WhatsApp cuenta con más de 3.000 millones de usuarios en todo el mundo y las estafas que comienzan en servicios de mensajería y redes sociales representan pérdidas económicas considerables.
IA local frente al debate sobre la privacidad
El diseño de Scam Alert resulta especialmente interesante dentro del debate sobre cómo combatir los delitos en plataformas cifradas.
Durante los últimos años, diferentes organismos reguladores de Europa y Reino Unido han presionado a servicios de mensajería para introducir sistemas capaces de detectar determinados contenidos ilegales.
El problema es que realizar ese análisis directamente en los servidores podría entrar en conflicto con el cifrado de extremo a extremo, ya que requeriría acceder al contenido de mensajes que, por diseño, solamente deberían poder leer sus participantes.
El procesamiento local ofrece una alternativa diferente: el mensaje puede ser analizado en el propio teléfono sin tener que descifrarlo en un servidor de Meta.
De hecho, el Consejo de la Unión Europea confirmó en julio de 2026 la reinstauración de un régimen temporal que permite a determinadas plataformas realizar voluntariamente análisis de mensajes no cifrados para detectar material de abuso sexual infantil. El régimen excluye de su ámbito los servicios cifrados de extremo a extremo como WhatsApp y Signal.
Google también apuesta por la detección local
Meta no es la única compañía que está explorando este modelo.
Google utiliza un planteamiento similar con Scam Detection en Google Messages, donde un modelo de IA ejecutado en determinados dispositivos analiza mensajes SMS, MMS y RCS para identificar patrones potencialmente fraudulentos.
La tendencia resulta significativa: en lugar de enviar continuamente conversaciones privadas a la nube para analizarlas, las compañías están intentando trasladar cada vez más tareas de inteligencia artificial al propio dispositivo.
Esto permite aprovechar modelos capaces de detectar comportamientos sospechosos manteniendo el contenido lejos de los servidores.
Por ahora, una prueba limitada
Scam Alert todavía no está disponible para todos los usuarios de WhatsApp. Meta ha comenzado con un grupo limitado de participantes en fase beta y todavía no ha anunciado una fecha definitiva para su lanzamiento general.
Tampoco está claro si el sistema terminará ampliándose a grupos y conversaciones con contactos conocidos. La compañía utilizará los datos obtenidos durante esta fase de pruebas para determinar hasta dónde puede extender la detección sin generar un número excesivo de falsos positivos.
En cualquier caso, Scam Alert representa un enfoque interesante para combatir las estafas en WhatsApp: utilizar IA para detectar patrones sospechosos sin convertir los mensajes privados del usuario en datos que tengan que analizarse en los servidores de Meta.


