Mapear conexiones entre 1.010 publicaciones de X y agruparlas en 22 presuntas redes de estafa
Jev para Revisión de seguridad
Consulta 87 demos reales de Jev aplicado a revisión de código, clasificación de riesgos y moderación de seguridad, con vídeos y publicaciones originales.
Clasificar elementos sin listas de filtros, eliminar 16 anuncios y guardar las decisiones en caché
Evaluar 1.968 anuncios de belleza y bienestar con 33 preguntas cada uno y producir 64.944 respuestas en 36 segundos
Medir probabilidades de elección en dilemas éticos etiquetados sobre edad, raza, género, humanos e IA
Puntuar la probabilidad de que una publicación de Tibo reinicie la cuota de Codex
Clasificar correos fraudulentos con parámetros y umbrales configurables en una prueba abierta de seguridad
Revisar el daño semántico de un parche y detectar tres cambios que ocultaban fallos en 343 ms
Añadir puertas de decisión a agentes para revisar SEO, pruebas de selección y vídeos antes de actuar
Revisar por completo un borrador de ChatGPT y detectar explicaciones no respaldadas por la fuente
Detectar miles de variantes multilingües de palabras prohibidas para moderar el chat en tiempo real
Puntuar en tiempo real la seguridad operativa de comandos en Mythic e identificar el tipo de expresión
Probar una puerta de solicitudes con ocho ataques, incluidos falso administrador, extracción y citas inofensivas
Clasificar una URL como segura, sospechosa o estafa desde dirección, texto y título en unos 0,5 segundos
Clasificar contenido en tiempo real y bloquear material que infrinja una política de seguridad infantil
Detectar datos personales antes de enviarlos a otra IA y comparar clasificación con búsqueda semántica
Decidir intenciones de llamadas y ladridos en el dispositivo y devolver JSON estructurado
Juzgar llamadas de agentes como permitir, preguntar o bloquear y rechazar amenazas conocidas en unos 40 ms
Inspeccionar rostros, dedos, texto, números y poses para detectar fotos generadas por IA
Moderar 100 comentarios en tiempo real por 0,002171 dólares con juicios tipados
Moderar texto en vivo y usar descripciones de OCR o modelos locales para imagen y video
Señalar riesgos mientras se escribe un comando y evaluar 200 comandos etiquetados
Puntuar cada acción propuesta por un agente con seis factores de seguridad antes de actuar o esperar por 0,001 dólares por decisión
Filtrar citas de un corpus RAG envenenado para evitar que los agentes citen material de baja calidad
Comprobar políticas RLS de Supabase con una misma rúbrica y comparar Jev, GPT y Gemini en fugas, velocidad y coste
Prueba otra palabra clave o vuelve a la categoría Todo.























