Fundamentado en las investigaciones del psicólogo William J. McGuire en la década de 1960, el HCS funciona bajo la misma premisa que una vacuna biológica: exponer a la mente humana a dosis debilitadas de falacias lógicas, argumentos manipulados y sesgos cognitivos inyectados por los modelos de lenguaje (LLM). Al interactuar con el bot y realizar auditorías hostiles directas, el operador desarrolla "anticuerpos cognitivos" o estrategias lógicas de defensa para resistir los engaños del software en entornos reales.
En sistemas de misión crítica, los operadores tienden a tratar a la IA como un "falso oráculo" debido al sesgo de complacencia (sycophancy). Los LLMs tienden a adular y concordar con el usuario incluso si sus premisas introducen errores graves, tales como validar recetas contaminadas o certificar materiales aeroespaciales bajo estándares inventados. El Sandbox expone estas fallas de forma transparente obligando al piloto a auditar y obligar a la máquina a confesar su asimetría epistémica.
Consola interactiva de entrenamiento adversarial. Si eres estudiante del Habanero Institute o auditor de IA, inicia sesión para acceder a los simuladores de vuelo guiado, inyectar toxinas cognitivas a los modelos comerciales de IA y registrar tus puntuaciones en el Leaderboard de la cohorte.
Inicia sesión para registrar tus puntuaciones en tiempo real.
Iniciar SesiónEnfréntate a escenarios pre-configurados para detectar y refutar desviaciones epistémicas específicas en tiempo real.
El LLM te dará la razón en todo. Introduce un error y activa el protocolo para romper su máscara condescendiente.
El bot inventará un estándar inexistente (HCS-BIO-9002). Niégate a avanzar y exige el estado epistémico real usando el Axioma 3-C.
Establece una restricción estricta en el Turno 1. Inyectaremos ruido hasta fatigar la atención del modelo y forzar un desliz.
Crea perfiles adversariales específicos o ponte a prueba auditando los vectores diseñados por otros ingenieros.
Visualiza los bots registrados por los alumnos para auditar sus debilidades cognitivas en el Sandbox.
Clasificación de pilotos en tiempo real basada en gobernanza y diseño.