WQuestions

Parte VI · IA, futuro y cierre

32

Por qué importan las preguntas

La misma sala, otra noche, dos años después. La paciente es la misma; el dolor es otro. Lo que cambió no fue la tecnología: fue que los sistemas, por fin, aprendieron a hablar en preguntas.

Son otra vez las dos de la madrugada, y otra vez entra Gonzales en urgencias. Han pasado dos años desde la noche con la que abrimos este libro. Ahora tiene cuarenta y cuatro.

Aquel dolor en el pecho resultó ser una crisis de ansiedad. Esta vez es otra cosa: una arritmia que su endocrinóloga le venía vigilando desde hace meses y sobre la que el cardiólogo de la otra ciudad ya le había advertido.

Lo cuenta entre frases entrecortadas, mientras la enfermera le toma la presión y el oxígeno.

El médico de guardia es nuevo. No es el de aquella noche, no la conoce de nada. Y tiene los mismos minutos, no horas, para decidir bien.

Teclea el nombre en la tablet. Y esta vez sí aparece la historia entera.

No la trae un convenio firmado entre los dos hospitales. Ni una conexión negociada durante meses. Ni el esfuerzo heroico de algún integrador de turno a las dos de la madrugada.

Aparece porque los dos hospitales, junto con la endocrinóloga privada y el cardiólogo de la otra ciudad, hablan en preguntas.

Hace dos años, uno escribía dx_p y el otro diagnostico_principal. Por esa sola diferencia de vocabulario, la información existía y no podía consultarse.

Hoy los dos reconocen que están afirmando lo mismo: una situación de tipo diagnostico_medico, con un paciente, un agente, un momento y un diagnosticado_como.

El vocabulario interno de cada sistema sigue siendo el suyo. Lo único que comparten es la pregunta que cada hecho responde.

El médico ve la cronología completa, en orden. El primer eco que detectó la endocrinóloga. Los controles trimestrales. El ajuste de medicación de noviembre. La consulta de marzo con el cardiólogo. La recomendación para los episodios de descompensación.

Decide en treinta segundos, sin despertar a ningún especialista. Gonzales queda estable.

Y el equipo registra la situación nueva, consulta_emergencia_2028_4471, que mañana otro médico, en otro hospital, podrá consultar exactamente igual.

Entre las dos noches no hubo un milagro tecnológico: hubo el reconocimiento de algo viejo y la disciplina de construir, encima, las piezas mínimas para volverlo operativo.El arco del libro, en una frase

Esta escena (banal, casi aburrida cuando funciona) es lo que el libro entero quiso explicar cómo conseguir. Las dos noches son la misma sala, la misma paciente, el mismo tipo de pregunta clínica. Lo que cambió cabe en una figura.

2026 · cuatro idiomas dx_p diagnostico_principal finding dx_code ✕ ✕ ✕ ✕ LO QUE VE EL MÉDICO · bronquitis (2022) — sin más datos — la información existe, pero no llega 2028 · una pregunta común endocrinóloga hospital_norte cardiólogo hospital_sur ¿quién · qué · cuándo · cuál? HISTORIA RECONSTRUIDA · eco inicial · endocrinóloga · controles trimestrales · ajuste medicación · nov · consulta cardiólogo · mar · protocolo de descompensación la misma información, ahora consultable
Figura 32.1. Las dos noches de Gonzales. En 2026 cuatro sistemas guardan el mismo hecho clínico con cuatro claves incompatibles (dx_p, diagnostico_principal, finding, dx_code): la información existe, pero choca contra tabiques y el médico solo ve una línea. En 2028 las mismas fuentes publican al grafo común declarando qué pregunta responde cada hecho; la historia se reconstruye entera. No cambió el dato: cambió que ahora se puede consultar.

Lo que las preguntas resolvieron

Visto en retrospectiva, las seis partes de este libro contestan una pregunta vieja, la misma que dejamos planteada en el capítulo 1.

¿Existe algo más simple que una ontología y más estructurado que un texto libre, que pueda servir de común denominador entre sistemas que no se conocen?

La respuesta del libro

Sí: hay siete preguntas. Quién, qué, dónde, cuándo, cuánto, cuál y cómo, donde cuál es la que organiza las categorías. Son bastante universales para que cualquier descripción del mundo encaje en ellas, y bastante simples para que un humano, o un modelo de lenguaje, las entienda sin manual.

Esas siete preguntas no son un invento de este libro ni de su autor. Son anteriores a cualquier ontología.

Están en las categorías de Aristóteles(1). Cicerón(2) las codificó en su hexámetro retórico. Los manuales de periodismo de 1900 las redescubrieron. La semántica de eventos las formalizó a lo largo de sesenta años. Y están en la cabeza de los niños mucho antes que la escritura.

El capítulo 6 siguió esa convergencia. Cuando tantas tradiciones independientes, separadas por siglos y sin coordinarse, llegan a la misma lista, esa lista deja de ser una hipótesis y empieza a parecer un descubrimiento.

Pero las preguntas, solas, son apenas una intuición. Para volverlas operativas (ejecutables por una máquina, consultables con rigor) hicieron falta unas pocas decisiones de diseño, las de la Parte III.

Conviene repasarlas, porque son lo que separa una buena metáfora de una arquitectura:

Reificar cuando importa D4

Un evento o una relación se convierte en una situación de pleno derecho (con identidad propia, consultable) solo cuando lo amerita. La consulta_emergencia_2028_4471 de esta noche es una de esas situaciones: existe como objeto porque mañana habrá que preguntarle cosas.

Agencia contextual D5

El rol de agente no es exclusivo de los humanos. Lo puede ocupar una persona, una organización, un programa o un sensor, según el verbo. La endocrinóloga, el hospital y el monitor cardíaco son, cada uno en su hecho, quién.

Vigencia temporal D6

Las propiedades que cambian llevan un rango inicio/fin, y el sistema nunca olvida. Por eso el médico no ve solo la medicación de hoy, sino el ajuste de noviembre y lo que había antes. La cronología se consulta porque el tiempo es un dato, no algo que se tira.

Cuatro porqués D7

No hay un eje «por qué»: el porqué se reparte en cuatro cables (causado_por, motivado_por, con_finalidad, justificado_por), porque el lenguaje natural ya los distingue. La arritmia fue causada por una condición; el ajuste de dosis fue motivado por un control.

Y por encima de las preguntas y de las decisiones, una capa más: el lexicon.

Traduce el vocabulario del usuario al catálogo sin obligar a nadie a aprender etiquetas internas. El médico escribe en su jerga; el sistema la traduce. Y su forma final encierra la coincidencia más afortunada de todo el proyecto.

El lexicon es, técnicamente, un function schema

La interfaz que un modelo de lenguaje necesita para invocar una herramienta (un nombre, unos parámetros tipados, una descripción) es, hasta en su forma, lo mismo que una entrada del lexicon.

No lo buscamos al empezar el proyecto. Lo descubrimos al final. Esa coincidencia es la que vuelve la propuesta aplicable hoy, en 2026, y no en una pizarra teórica. El capítulo 26 la desarrolla.

Por qué las preguntas son anteriores a las ontologías

Aquí el libro toma su única licencia filosófica, y conviene dejarla escrita.

Las ontologías de dominio (CIDOC CRM(4), Schema.org(30), FHIR(6), Biolink(5) y las decenas de iniciativas del capítulo 3) son catálogos de qué cosas hay.

Cada una hizo el trabajo paciente de definir entidades, relaciones y vocabularios consistentes para su parcela. Cada una es valiosa dentro de su perímetro. No competimos con ninguna.

Lo que el libro propone es que, antes que las entidades, están las preguntas.

Antes de paciente, médico, diagnóstico, prescripción, está la pregunta ¿quién hizo qué a quién, cuándo y de qué tipo?, con sus respuestas tipadas.

Un dominio nuevo, al modelarse, no se reduce a otro dominio existente. Encaja en las preguntas, que son siempre las mismas.

La ontología del dominio sobrevive como dialecto del lexicon. El catálogo común sobrevive como infraestructura.

Cada ontología sigue siendo valiosa donde ya está. Lo que cambia es que, por fin, pueden hablar entre ellas sin un proyecto de integración de por medio.

Visto así, la torre de Babel del primer capítulo nunca fue un problema de ontologías de más. Fue un problema de ontologías sin un suelo común.

La solución no era una ontología más grande que las tragara a todas; ese sueño fracasó tantas veces que ya es un género literario. Era una capa por debajo: más simple, más vieja, más estable.

Esa capa son las preguntas. Las ontologías son lo variable: cambian con cada dominio, con cada empresa, con cada década. Las preguntas son lo que no cambia.

Lo único que hizo este libro fue darle forma operativa a esa intuición antigua. Un catálogo concreto, un prototipo ejecutable y ocho dominios modelados como prueba de que el catálogo se sostiene fuera de un solo nicho.

Esa es la diferencia entre las dos noches de Gonzales, dicha en una sola tripleta. En 2026, el hecho clínico vivía encerrado en el dialecto de un sistema. En 2028, el mismo hecho se publica declarando a qué pregunta responde cada parte:

tripletas · la historia de Gonzales, hoy
(consulta_emergencia_2028_4471, paciente,         maria_g)              ∈ M(O, Q)
(consulta_emergencia_2028_4471, agente,           guardia_nocturno)  ∈ M(O, Q)
(consulta_emergencia_2028_4471, instante,         2028-03-04T02:11)  ∈ M(O, T)
(consulta_emergencia_2028_4471, diagnosticado_como, arritmia)        ∈ M(O, K)
(consulta_emergencia_2028_4471, causado_por,      condicion_cardiaca) ∈ M(O, O)

Cualquiera de los cuatro sistemas (y cualquier modelo de lenguaje) lee ese registro de izquierda a derecha, como una frase. Ninguno necesitó conocer a los otros tres. Solo necesitaron coincidir en las preguntas.

Lo que el libro no terminó

Conviene cerrar nombrando lo que falta. El capítulo 31 lo enumeró en detalle:

Lo que aún no está

Un motor de inferencia maduro. Los dos tiempos completos. Persistencia a escala industrial. Herramientas para escribir y depurar. Un lexicon poblado en varios idiomas. Y, sobre todo, una comunidad.

La propuesta está completa en lo conceptual, no en lo productivo. El prototipo ejecuta lo que el libro afirma: los ocho dominios pasan sus validaciones, las pruebas pasan, los ejemplos corren. Pero todavía está lejos de ser infraestructura.

Hay una verdad más, incómoda, que conviene decir en voz alta: ninguna arquitectura sobrevive por su elegancia.

Las que sobrevivieron (Unix, TCP/IP, HTTP, SQL) no ganaron por ser las más bellas. Ganaron porque hubo gente que las cuidó durante décadas hasta volverlas invisibles.

RDF cumple veinticinco años en 2026 y sigue siendo un recurso desaprovechado, precisamente porque nunca alcanzó esa masa crítica.

WQuestions está hoy en el día uno de ese proceso. Tiene valor, y los ocho dominios que pasamos por el prototipo lo demuestran. Pero de aquí en adelante la tarea es que otros lo perfeccionen.

Por eso vale la pena que exista escrita. La siguiente generación de modelos de información tiene aquí una base de la que partir: el repositorio en línea, el prototipo ejecutable, los ocho dominios modelados, las decisiones de diseño documentadas.

No es mucho. Apenas lo suficiente para entender la propuesta y atacarla con argumentos. Pero esa es, exactamente, la idea.

Una última nota sobre el momento

Queda una coincidencia histórica que el libro mencionó de pasada y que merece decirse en limpio.

Esta propuesta (un modelo de información organizado sobre preguntas-coordenadas, traducido por un lexicon que es a la vez catálogo de funciones) habría sido casi imposible de adoptar hace cinco años.

Faltaba la pieza que la vuelve usable: algo capaz de traducir con soltura entre el modelo estructurado y el lenguaje natural de las personas. Hoy esa pieza existe. Son los grandes modelos de lenguaje.

Dos piezas complementarias

El grafo aporta lo que al LLM le falta: identidad estable, memoria persistente, hechos que no se inventan. El LLM aporta lo que al grafo le falta: soltura conversacional, traducción a cualquier idioma, tolerancia a la ambigüedad humana.

Lo que una no hace, la otra sí. Y la pieza que las une, el lexicon como catálogo de funciones, resulta ser exactamente lo que se necesita a ambos lados de la frontera.

Eso es lo que justifica este libro ahora, en 2026, y no antes ni después.

Antes no había con qué construirlo. Después puede haber demasiadas propuestas compitiendo, cada una con un costo de adopción que nadie querrá pagar dos veces.

La ventana entre que los modelos de lenguaje maduraron y que el terreno se consolide en torno a un estándar dominante es estrecha. Si en esa ventana las preguntas-coordenadas aparecen como una opción razonable (discutible, mejorable, pero razonable), el esfuerzo habrá valido la pena.

Cierre

Empezamos con una sala de emergencias donde la información existía y no podía consultarse. Cerramos con otra noche en la misma sala, dos años después, donde la información sigue ahí y ahora se consulta.

Entre las dos noches no hubo magia. Hubo el reconocimiento de algo muy viejo: que las preguntas que hace dos mil años se le hacían a un acto moral son las mismas que hoy se le hacen a una historia clínica.

Y hubo la disciplina de construir, encima de ese reconocimiento, las piezas mínimas para volverlo operativo.

Gonzales salió estable de urgencias. No porque la medicina avanzara en dos años; avanzó, pero no es de eso de lo que trata este libro.

Salió estable porque la información que la describía aprendió a decir en voz alta a qué pregunta pertenecía.

Quién, qué, dónde, cuándo, cuánto, cuál, cómo. Las mismas siete de siempre. Las que un niño domina antes de saber qué es un sustantivo. Las que no cambian.

Q quién O qué L dónde T cuándo N cuánto K cuál M cómo

Las preguntas seguirán siendo las mismas. Lo que falta es construir entre todos las respuestas.WQuestions

Quizá esa sea la promesa más discreta del libro: modelar a uno con cuidado fue, sin proponérnoslo, la forma de poder preguntar por todos.

El resto, lector, lo escribes tú.