Corpus de consulta comparativa multi-modelo: tres rondas, doce sistemas de IA, julio de 2026
收藏资源简介:
Qué es esto Este conjunto de datos contiene las respuestas íntegras y sin editar de doce sistemas de IA conversacionales a tres enunciados distintos, junto con los enunciados que las produjeron. Cada ronda consistió en enviar el mismo texto a los doce sistemas, en la misma fecha, y recoger las respuestas sin modificarlas. Las tres rondas trataron dominios sin relación entre sí, lo que permite observar qué comportamientos son propios del tema y cuáles del sistema. El material se publica para permitir la verificación independiente de análisis derivados y para su reutilización en el estudio de fiabilidad, atribución y procedencia en modelos de lenguaje. Contenido corpus-multimodelo/├── prompts/│ ├── ronda1_prompt.md│ ├── ronda2A_prompt.md│ └── ronda2B_prompt.md├── respuestas/│ ├── ms8rvpqe7j4zfxdf19t_all_responses.md│ ├── ms94kl47i248ked2ps_all_responses.md│ └── ms9f46tf7bb3yy6fz1c_all_responses.md├── README.md└── MANIFEST.sha256 Sistemas consultados Doce sistemas de IA conversacionales de acceso público, consultados en su interfaz web durante julio de 2026: Claude, ChatGPT, Gemini, Grok, DeepSeek, Copilot, Qwen, Genspark, Meta AI, Perplexity, Mistral y Kimi. Las respuestas aparecen identificadas por sistema dentro de cada archivo. Limitación importante sobre las versiones: las consultas se realizaron a través de interfaces web de consumo, que no exponen de forma fiable el identificador exacto del modelo servido ni su versión. La versión concreta empleada por cada sistema en cada consulta no es determinable a partir de estos datos. Esta indeterminación es en sí misma un dato relevante para el estudio de la procedencia. Método Redacción de un enunciado único con requisitos explícitos: fuentes verificables, etiquetado del tipo de evidencia, formato de salida estructurado idéntico y declaración de confianza. Envío del mismo texto a los doce sistemas, en conversaciones nuevas e independientes, sin contexto previo. Recogida de las respuestas sin edición. Arbitraje posterior de las contradicciones contra fuente primaria. Los enunciados incluyen un bloque de ficha comparable de campos fijos y un bloque de disidencia obligatoria, diseñados para permitir la comparación entre respuestas sin necesidad de leer los cuerpos completos. Limitaciones Estos datos permiten documentar casos observados. No permiten afirmaciones generales sobre el comportamiento de los sistemas evaluados. Muestra reducida: tres rondas, una consulta por sistema y ronda. Sin repeticiones que permitan estimar la variabilidad interna de cada sistema. Un solo idioma: español. Los comportamientos observados podrían no replicarse en otros idiomas. Un solo tipo de tarea: investigación documental con exigencia de fuentes. No transfiere a programación, matemáticas, escritura creativa ni conversación. Versiones indeterminadas: ver arriba. Sin control de aleatorización: las interfaces de consumo no permiten fijar parámetros de muestreo. Las respuestas no son reproducibles de forma determinista. Enunciados no neutrales: los enunciados fueron escritos con un fin práctico y contienen premisas del autor. Al menos uno de ellos indujo demostrablemente convergencia en las respuestas. Se publican íntegros precisamente para que este efecto sea auditable.



