diff --git a/Source-Code/UniversalResearchBank/README.md b/Source-Code/UniversalResearchBank/README.md new file mode 100644 index 0000000..c1ae50c --- /dev/null +++ b/Source-Code/UniversalResearchBank/README.md @@ -0,0 +1,44 @@ +# Actualizador Bibliográfico Universal (Universal Research Bank) + +Herramienta **single-file** (`index.html`, sin backend) para construir, codificar y analizar un +**banco de información bibliográfico** de cualquier investigación. Todo se procesa en el navegador: +ningún dato sale de tu equipo. + +## Idea central + +La herramienta es **agnóstica al tema**: no trae ninguna clasificación fija. Todo el esquema +(categorías, enfoques, contexto objetivo, señales de inferencia, banco previo) se define en una +**configuración JSON** que puedes: + +1. Escribir tú mismo (botón *Plantilla de configuración*). +2. Generar con un LLM / **deep research** (botón *Superprompt deep-research*: pide al modelo la + configuración + un banco inicial de referencias reales). +3. Probar con la **DEMO** incluida (ejemplo del proyecto MPI-DUAE, solo demostrativo). + +## Esquema universal de 19 campos + +``` +id, autores, anio, titulo, revista, doi, categoria, subcategoria, enfoque, +rol, ipd, pais, seminal, instrumento, variable_rol, diseno_estudio, +muestra, hallazgo_principal, relevancia_tema +``` + +## Flujo de trabajo + +| Paso | Sección | Qué hace | +|------|---------|----------| +| 1 | **Configurar** | Aplica el JSON de tu investigación (catálogos cerrados + banco previo opcional). Se guarda en `localStorage`. | +| 2 | **Importar** | XML bibliográfico (Mendeley/Zotero/EndNote, `b:Sources`), tablas de Word (`w:tbl`), CSV, XLSX o JSON de 19 campos. Las refs que coinciden con el banco previo (DOI/título) **heredan** su codificación. | +| 3 | **Verificar** | Editor fila a fila con nivel de confianza, inferencia heurística dirigida por tus señales, y ciclo opcional de clasificación con LLM (validación estricta contra tus catálogos). | +| 4 | **Exportar** | `dashboard.html` autónomo (KPIs, matriz Categoría×Enfoque, gráficos Chart.js, tabla filtrable), banco CSV/JSON, XML corregido, libro XLSX con proyección de vacíos y superprompt de dashboard. | + +## Regla de integridad + +Nunca se inventan datos: las referencias sin categoría/enfoque válidos quedan marcadas como +pendientes, se cuentan como *Desconocido* y quedan fuera del análisis temático hasta que las +revises. La *proyección de vacíos* se declara siempre como META, separada de los datos reales. + +## Uso + +Abre `index.html` en el navegador (Chart.js y SheetJS se cargan por CDN solo cuando se necesitan; +sin conexión, la herramienta sigue funcionando salvo XLSX y los gráficos del dashboard). diff --git a/Source-Code/UniversalResearchBank/index.html b/Source-Code/UniversalResearchBank/index.html new file mode 100644 index 0000000..0fdd13a --- /dev/null +++ b/Source-Code/UniversalResearchBank/index.html @@ -0,0 +1,2427 @@ + + +
+ + +Construye y mantén un banco de información para cualquier investigación: define tu propio esquema de clasificación (categorías, enfoques, contexto), carga referencias desde Mendeley, Zotero, EndNote, Word, CSV o Excel, codifícalas con control de calidad, y exporta un dashboard analítico. La configuración puede generarla tú o un flujo de deep research. Todo se procesa en tu navegador: ningún dato sale de tu equipo.
Flujo de cuatro pasos, de una configuración de investigación a un tablero analítico verificable.
+Carga o pega la configuración de tu investigación: categorías, enfoques, contexto objetivo y (opcional) un banco previo de referencias ya codificadas. Puede generarla un deep research con el superprompt incluido.
+Interpreta XML bibliográfico (Mendeley/Zotero/EndNote, esquema b:Sources), tablas de Word XML, CSV, Excel o JSON con el esquema de 19 campos.
+Editor fila por fila con nivel de confianza. No inventa datos: lo que no puede clasificar queda marcado como pendiente y fuera del cómputo hasta que lo revises.
+Dashboard HTML autónomo, banco CSV/JSON actualizado, libro Excel con matriz y proyección de vacíos, XML corregido y superprompts para LLM.
+Toda la clasificación se rige por esta configuración: categorías, subcategorías sugeridas, enfoques, niveles IPD, contexto objetivo y señales de inferencia. Pégala como JSON, cárgala desde archivo, o genérala con un LLM/deep research usando el superprompt. El botón DEMO carga un ejemplo real (proyecto MPI-DUAE) solo para probar la herramienta.
+ +Inserta un archivo exportado desde Mendeley, Zotero o EndNote (XML), una tabla de Word (XML), o un archivo CSV / Excel / JSON con la cabecera de codificación de 19 campos. Las referencias que coincidan (por DOI o título) con tu banco previo heredan su codificación.
+ +Procedimiento recomendado para construir el banco a partir de los papers, con extracción codificada y sistema de palabra dominante:
+Distribución del corpus según cinco grupos documentales. Estos conteos salen directos del archivo cargado (campo SourceType + detección heurística de normas legales y documentos institucionales), independientes de la codificación temática.
+ + +Los archivos bibliográficos no incluyen categoría · enfoque · IPD · rol · seminal · país ni los metadatos de investigación. Las refs que coincidían (por DOI o título) con tu banco previo heredan sus valores (badge verde). Las nuevas quedan REQ. CODIFICACIÓN (badge ámbar) hasta que las completes. Editar una celda la marca como editado (badge azul).
+ +El dashboard NO se exporta con datos falsos. Las refs sin categoría/enfoque válidos se contarán aparte y el análisis temático solo usará las codificadas. Un dashboard bonito sobre datos falsos es peor que ningún dashboard.
+| # | +Referencia (dato real) | +Tipo doc. | +Categoría * | +Subcategoría | +Enfoque * | +IPD | +Rol | +Sem. | +País | +Origen | +
|---|
Descarga un dashboard.html autónomo (single-file, sin dependencias en runtime salvo Chart.js por CDN) con las 0 referencias ya integradas y codificadas, más el banco actualizado en CSV/JSON para la siguiente iteración. Las refs sin codificar se incluyen pero no ensucian el análisis temático.
Genera un .xlsx con los datos reales del corpus cargado: matriz Categoría × Enfoque, distribuciones (año, IPD, rol, país), y una hoja de proyección de vacíos que estima —como META de búsqueda, separada de los datos— cuántas referencias faltarían para cerrar cada celda crítica. Las refs sin codificar se cuentan como Desconocido, nunca se inventan. Incluye instructivo para insertar los gráficos nativos en 3 clics.
Para las referencias que la heurística deja en REQ. COD. o marca de baja confianza: expórtalas como lote, clasifícalas con un LLM (ChatGPT/Claude) usando el prompt incluido —construido con tus catálogos—, y reimporta el JSON. La herramienta valida contra los catálogos cerrados y rechaza cualquier valor inventado.
+Genera un bloque con las refs sin codificar (o de baja confianza) + el prompt listo para pegar.
+Pega el bloque en ChatGPT o Claude. El prompt exige salida JSON estricta, con evidencia y confianza por fila, y prohíbe valores fuera de tu esquema.
+Pega aquí el array JSON que devolvió el LLM. Se validará fila por fila; lo válido se aplica (badge llm), lo inválido se reporta y se ignora.
+ +