Seguridad en Pleembed: moderación automática con Jev
Actualizado en septiembre de 2026.
El acoso es el motivo por el que mucha gente —y sobre todo muchas mujeres— se va de una app de citas. No los mensajes subidos de tono, que son parte de para qué está esto: los insultos cuando dices que no, la insistencia que no para, la amenaza velada, el chantaje con una foto que enviaste confiando.
La respuesta habitual del sector es una cola de denuncias que revisa alguien días después, cuando el daño ya está hecho. Pleembed hace otra cosa: el mensaje abusivo no llega.
Pioneros en moderación con Jev
Pleembed es una de las primeras apps de citas del mundo que modera con Jev, el modelo de decisión de TypeSafe AI presentado en septiembre de 2026. Jev no es un chatbot y no escribe texto: ante una pregunta concreta devuelve una probabilidad calibrada. Eso cambia dos cosas importantes.
- Criterio estable: un modelo que redacta opiniones puede juzgar hoy distinto que mañana. Una probabilidad calibrada se puede poner en un umbral y ese umbral significa siempre lo mismo.
- Suficientemente rápido para llegar antes: unos 300 milisegundos por mensaje, así que la decisión ocurre antes de que el mensaje se entregue, no después de una denuncia.
Cada mensaje se evalúa con varias preguntas independientes —amenaza, chantaje, insulto, odio, coacción, contenido sexual no correspondido, indicios de minoría de edad— para que una señal no contamine a otra.
Lo que se retira y lo que no se toca
| ¿Se modera? | |
|---|---|
| Sexo explícito entre adultos de mutuo acuerdo | No. Nunca. Ni el lenguaje soez, ni las fantasías duras compartidas. |
| Rechazar a alguien, incluso sin diplomacia | No. Decir que no, o que una persona no te atrae, no es acoso. |
| Insultos, desprecio y humillación | Sí. El mensaje se retira y la cuenta acumula un aviso. |
| Insistir después de un no o de un «para» | Sí. La coacción se mide sobre la conversación, no sobre un mensaje aislado. |
| Contenido sexual a quien no participa | Sí, cuando no hay reciprocidad o ya se pidió parar. |
| Ataques por origen, religión, cuerpo, identidad u orientación | Sí. |
| Amenazas de violencia y chantaje con fotos | Sí. Cuenta suspendida en el primer mensaje. |
| Indicios de que alguien es menor de edad | Sí. Suspensión inmediata, con el umbral más bajo de todos. |
Lo prohibido es el maltrato, no el deseo.
Cómo escala
- Mensaje retirado. No se entrega ni genera notificación: la otra persona no se entera de que existió. A quien lo escribió se le dice por qué.
- Tres avisos en 30 días y la cuenta deja de poder escribir durante 24 horas.
- Amenaza, chantaje o indicio de menor: suspensión directa, sin avisos previos.
Sin que nadie lea tus conversaciones
Esta es la parte que más nos importa, porque una app discreta que se pusiera a leer chats para moderarlos dejaría de ser discreta:
- No hay revisión humana. Jev decide y la sanción se aplica sola. Nadie del equipo lee conversaciones para decidir.
- No se guarda el contenido. De un mensaje retirado queda el tipo de señal y su probabilidad. El texto no se archiva en ningún registro de moderación.
- El modelo no aprende de ti. TypeSafe declara que Jev no se entrena con las peticiones de sus clientes.
Fotos y descripción del perfil
Pasan por el mismo filtro antes de publicarse. En las fotos públicas se rechaza el sexo explícito —lo exigen App Store y Google Play—, los indicios de menores, la violencia y los números o usuarios sobreimpresos, el truco clásico de las cuentas de estafa. La ropa interior, la lencería y el torso desnudo no son motivo de rechazo. En las fotos privadas, que solo ve quien tú autorizas, se comprueba únicamente lo peligroso o ilegal. En la descripción se rechazan el odio, el desprecio, las tarifas y los contactos fuera de la app.
Lo que sigue estando en tu mano
La moderación automática no sustituye a tus herramientas: puedes bloquear a cualquiera en cualquier momento, denunciar un perfil, activar el modo invisible y borrar tu cuenta y tus datos por completo. Las imágenes que envías en el chat son efímeras y desaparecen segundos después de abrirse.
Si algo se nos ha escapado o crees que una restricción es un error, escríbenos a admin@pleembed.es indicando el correo de tu cuenta. Y si hay un delito de por medio —amenazas, difusión de imágenes sin consentimiento, extorsión— denúncialo también a la Policía Nacional o la Guardia Civil: nosotros podemos cerrar una cuenta, pero no instruir un caso.
Preguntas frecuentes
¿Se moderan las conversaciones sexuales?
No. El sexo explícito entre adultos que participan de mutuo acuerdo no se modera nunca. Existe una comprobación específica de reciprocidad para que una conversación caliente no se confunda con acoso.
¿Qué pasa si alguien me amenaza?
El mensaje no te llega y no recibes ni la notificación. La cuenta que lo escribió queda suspendida en ese mismo momento.
¿Y si la IA se equivoca conmigo?
Los umbrales están puestos para actuar solo cuando la señal es clara, y ante la duda el mensaje se entrega. Si crees que hay un error, escribe a admin@pleembed.es con el correo de tu cuenta y lo revisamos.
¿Por qué Jev y no un ChatGPT cualquiera?
Porque un modelo generativo devuelve texto y hay que interpretarlo; Jev devuelve probabilidades calibradas ante preguntas concretas. Para decidir si un mensaje es abusivo o simplemente caliente, esa diferencia es todo.
Jev es un modelo de TypeSafe AI; TypeSafe no tiene relación con Pleembed más allá del uso de su tecnología. La moderación automática reduce el acoso, pero ninguna tecnología lo elimina por completo: usa también el bloqueo y la denuncia.
Safety on Pleembed: automatic moderation with Jev
Updated in September 2026.
Harassment is why many people — and above all many women — walk away from a dating app. Not the racy messages, which are part of the point: the insults when you say no, the insistence that will not stop, the veiled threat, the blackmail with a photo you sent in good faith.
The usual answer in this industry is a report queue someone reviews days later, when the damage is done. Pleembed does something else: the abusive message never arrives.
Pioneers in moderation with Jev
Pleembed is one of the first dating apps in the world to moderate with Jev, the decision model released by TypeSafe AI in September 2026. Jev is not a chatbot and writes no text: given a specific question it returns a calibrated probability. That changes two important things.
- A stable standard: a model that writes opinions may judge differently tomorrow. A calibrated probability can sit behind a threshold, and that threshold always means the same thing.
- Fast enough to arrive first: around 300 milliseconds per message, so the decision happens before delivery rather than after a report.
Every message is assessed with several independent questions — threat, blackmail, insult, hate, coercion, unwanted sexual content, signs of someone underage — so that one signal never contaminates another.
What gets pulled and what is never touched
| Moderated? | |
|---|---|
| Explicit sex between consenting adults | No. Never. Neither crude language nor hard fantasies both share. |
| Turning someone down, even bluntly | No. Saying no, or that you are not attracted, is not harassment. |
| Insults, contempt and humiliation | Yes. The message is pulled and the account takes a strike. |
| Pushing on after a no or a "stop" | Yes. Coercion is judged across the conversation, not on one message. |
| Sexual content aimed at someone not taking part | Yes, when there is no reciprocity or a stop was already asked for. |
| Attacks on origin, religion, body, identity or orientation | Yes. |
| Threats of violence and blackmail with photos | Yes. Account suspended on the first message. |
| Signs that someone is underage | Yes. Immediate suspension, at the lowest threshold of all. |
What is banned is abuse, not desire.
How it escalates
- Message pulled. It is not delivered and triggers no notification: the other person never learns it existed. Whoever wrote it is told why.
- Three strikes in 30 days and the account cannot write for 24 hours.
- Threat, blackmail or signs of a minor: straight suspension, with no prior warnings.
Without anyone reading your conversations
This is the part we care about most, because a discreet app that started reading chats to moderate them would stop being discreet:
- No human review. Jev decides and the measure applies itself. Nobody on the team reads conversations to decide.
- The content is not stored. A pulled message leaves behind the type of signal and its probability. The text is not filed anywhere.
- The model does not learn from you. TypeSafe states that Jev is not trained on customer requests.
Profile photos and description
They go through the same filter before being published. On public photos we reject explicit sex — the App Store and Google Play require it — signs of minors, violence, and phone numbers or handles written across the image, the classic scam-account trick. Underwear, lingerie and a bare torso are not grounds for rejection. On private photos, seen only by people you authorise, we check only what is dangerous or illegal. In the description we reject hate, contempt, rates and contact details pointing off the app.
What stays in your hands
Automatic moderation does not replace your own tools: you can block anyone at any time, report a profile, turn on invisible mode and delete your account and data completely. Images you send in chat are ephemeral and vanish seconds after being opened.
If something slipped through, or you believe a restriction is a mistake, write to admin@pleembed.es with the email address of your account. And if a crime is involved — threats, sharing images without consent, extortion — report it to the police too: we can close an account, but we cannot investigate a case.
Frequently asked questions
Are sexual conversations moderated?
No. Explicit sex between adults who are both taking part is never moderated. There is a specific reciprocity check so that a steamy conversation is not mistaken for harassment.
What happens if someone threatens me?
The message never reaches you and you get no notification. The account that wrote it is suspended there and then.
What if the AI gets it wrong about me?
Thresholds are set to act only when the signal is clear, and when in doubt the message is delivered. If you think there is a mistake, write to admin@pleembed.es with your account email and we will look at it.
Why Jev and not just a ChatGPT?
Because a generative model returns text that has to be interpreted; Jev returns calibrated probabilities to specific questions. To decide whether a message is abusive or simply steamy, that difference is everything.
Jev is a model by TypeSafe AI; TypeSafe has no relationship with Pleembed beyond the use of its technology. Automatic moderation reduces harassment, but no technology removes it entirely: use blocking and reporting as well.