SIMULACIÓN IA

Metodología de Simulación de IA

Cómo Crowd Conscious construye y audita su panel de personas simuladas por IA: método INEGI/AMAI, separación total de los votos reales, y por qué el objetivo es auditar a la IA, no reemplazar a las personas.

Qué es la simulación

Para cada Pulse real, un panel de personas simuladas por inteligencia artificial —cada una un perfil demográficamente fundamentado de un residente de la Ciudad de México— vota con exactamente las mismas reglas que una persona real: elige una opción, asigna un nivel de confianza del 1 al 10 y escribe una sola frase de razonamiento. Los resultados de la simulación se guardan por separado y se revelan únicamente cuando el Pulse cierra, junto a los resultados reales, acompañados de un Índice de Divergencia.

La simulación nunca ve las noticias, ni contexto adicional, ni lo que ya votó la gente real. Solo recibe lo que vería cualquier votante: la pregunta, la descripción y las opciones. Así medimos la lectura que la IA hace de la población, no nuestra capacidad de inyectarle información.

El método de personas: INEGI y AMAI

La biblioteca de personas está calibrada contra distribuciones reales de la Ciudad de México. Partimos de las distribuciones marginales del Censo 2020 del INEGI (edad, sexo, escolaridad y hogares por alcaldía), la textura de ingreso de la ENIGH y las bandas de nivel socioeconómico de la AMAI. Cada persona se construye para que el conjunto reproduzca esas proporciones reales, no estereotipos.

La versión inicial, cdmx-v1, son 150 personas: 100 de Cuauhtémoc y 50 de Miguel Hidalgo. Los pesos poblacionales se normalizan al conjunto final con un asignador determinista de mayor resto (Hamilton), y cada persona incluye una narrativa concreta de su vida diaria —cómo se transporta, cómo se informa, a quién cuida, qué le preocupa— en el español que realmente usaría. Las versiones nunca se mutan: cualquier mejora se publica como una versión nueva y documentada.

Separación total de los datos reales

Los datos simulados y los reales nunca se mezclan. Los votos simulados viven en tablas propias, aisladas de los votos reales, y jamás se suman a ningún total real. En la base de datos, los votos sintéticos son ilegibles para cualquier cliente hasta el momento de la revelación: la única vía pública de lectura es una vista que solo expone las corridas ya reveladas.

En pantalla, todo lo simulado se muestra siempre con una insignia ámbar persistente que dice «SIMULACIÓN IA». En toda la plataforma, el verde significa datos reales y el ámbar significa datos simulados. Nunca presentamos un número simulado como si fuera una opinión real.

Y respetamos una regla estricta contra el anclaje: la dirección de una predicción de IA jamás es visible para una persona antes de que vote. Esto se garantiza en la capa de datos —el servidor no envía ningún agregado simulado al navegador hasta que se cumplen las condiciones de revelación— y no solo en la interfaz.

El propósito: auditar a la IA, no reemplazar a las personas

Esta simulación no sustituye la consulta ciudadana. Su objetivo es auditar a la inteligencia artificial: contrastar la lectura que un modelo hace de una población contra lo que esa población realmente opina. El Índice de Divergencia resume esa distancia en una escala de 0 a 100, donde 0 significa que la IA nos leyó perfecto y 100 que no nos conoce en absoluto.

La voz real de la comunidad siempre es la que cuenta. La simulación es un instrumento de medición sobre la IA misma, no un atajo para reemplazar a quien vota.

Una limitación que decimos en voz alta

Los modelos de lenguaje tienden a aplanar a las personas hacia estereotipos. Una simulación puede caricaturizar a una colonia entera, reduciendo a sus habitantes a un cliché. No escondemos esto: cuando la simulación caricaturiza a una colonia, eso mismo es un hallazgo. La divergencia entre lo simulado y lo real es precisamente la señal que buscamos, porque nos muestra dónde la IA no entiende a la gente.

Privacidad de Conversa

En las conversaciones con nuestro asistente (Conversa), los intercambios se registran de forma seudónima para mejorar la plataforma e informar reportes agregados. Ninguna conversación individual se publica ni se vende. Trabajamos con patrones agregados, nunca con la exposición de una persona identificable.

Metodología de Simulación de IA | Crowd Conscious