Núcleo del repositorio
Esta página explica de qué está hecho el Ta-Na-Si Media & Document Repository — su arquitectura, su tecnología y las personas detrás de su desarrollo. Creemos en la transparencia plena: quien usa un archivo, o piensa en llevar uno propio, merece saber exactamente de qué está hecho el sistema. La página «Acerca de» explica para qué existe el archivo; esta página explica cómo funciona.
1. Qué es el Núcleo del repositorio
El Núcleo del repositorio es el software sobre el que funciona este archivo: un sistema de archivo digital completamente independiente y autoalojado, escrito desde cero con un único propósito — almacenar, organizar y servir abiertamente documentos y medios como material de fuente probatorio. No se basa en WordPress, Joomla, Drupal ni en ningún otro CMS prefabricado, y no usa ningún framework de PHP. Cada componente — la capa de base de datos, el motor de búsqueda, la sala de trabajo de curaduría, las páginas públicas — fue diseñado y escrito específicamente para esta tarea.
El software está construido como una plataforma de instalaciones múltiples: no sirve a un archivo central, sino que sostiene muchos archivos separados e independientes. Cada archivo — sea una pequeña colección familiar o un gran repositorio regional — es su propia instalación completa, con su propia base de datos, sus propios archivos y su propio custodio. No hay infraestructura compartida entre archivos ni ningún servicio central del que dependan.
2. Una base de código, muchos archivos independientes
Cada instalación ejecuta la base de código idéntica. Todo lo que es específico de un servidor — su dirección pública, su acceso a la base de datos, su remitente de correo — vive en un único archivo de entorno que se crea una vez durante la instalación y que nunca viaja con el código. Esta separación estricta es lo que hace funcionar el modelo: la misma actualización de software puede aplicarse a cada archivo, pequeño o grande, sin tocar la configuración individual de ninguno.
Un archivo nuevo se instala mediante un asistente de instalación guiado en el navegador — sin línea de comandos, sin archivos de configuración que editar a mano. El asistente habla 18 idiomas, comprueba los requisitos del servidor, prueba la conexión con la base de datos antes de escribir nada y crea la cuenta del propietario con una contraseña protegida por un hash seguro. Las tablas de la base de datos las crea un sistema de migración idempotente: puede ejecutarse cuantas veces haga falta y siempre converge en el esquema correcto. Los cambios de esquema posteriores están versionados y se les hace seguimiento, de modo que cada instalación puede ver exactamente en qué punto está; los cambios rutinarios se aplican automáticamente, mientras que los pesados esperan la confirmación deliberada del propietario. Las actualizaciones siguen el mismo orden cuidadoso: primero copia de seguridad, luego migración, luego vaciar la caché.
3. Pila tecnológica Versión 1.0.0 (Thuringia)
4. Búsqueda y navegación por facetas
El corazón del archivo público es su búsqueda. Un único índice de texto completo cubre cada registro publicado — título, descripción, resumen, notas y el texto de los artículos —, de modo que un solo campo de búsqueda lo alcanza todo. Pero el texto completo por sí solo no basta para una investigación seria, y por eso cada registro se clasifica además a lo largo de nueve ejes de facetas:
- Tema — los temas y asuntos de los que trata un registro.
- Lugar — los lugares geográficos con los que se relaciona un registro, tomados de un directorio estructurado de lugares (véase el apartado sobre GeoNames más abajo).
- Idioma — el idioma del contenido del registro, de entre 49 idiomas admitidos de forma nativa.
- Colaborador — las personas implicadas: autores, locutores, fotógrafos, editores.
- Género — el tipo de material: testimonio, análisis, informe, etcétera.
- Parte de — la obra mayor a la que pertenece un registro; conecta el material de varias partes.
- Colección — agrupaciones curadas y con nombre, mantenidas por los custodios del archivo.
- Serie — agrupaciones ordenadas para material que sigue una secuencia.
- Acceso — el nivel de acceso de un registro, por ejemplo público o solo para miembros.
La navegación por facetas funciona como los investigadores esperan de los grandes archivos institucionales. Junto a los resultados, cada eje muestra sus valores más frecuentes con recuentos de resultados en vivo — un clic acota los resultados, y los filtros de distintos ejes pueden combinarse libremente: por ejemplo, todos los registros de audio en alemán sobre el tema educación de los años noventa. Los filtros activos se muestran como fichas eliminables encima de los resultados, de modo que la acotación actual siempre es visible y cualquier filtro puede quitarse de nuevo con un clic. Donde un eje contiene más valores de los que muestra la barra lateral, puede hojearse un índice alfabético completo de todo el eje, letra por letra.
Más allá de las facetas, los resultados pueden limitarse por tipo de material (artículos, audio, vídeo, documentos, imágenes, conjuntos de datos — varios a la vez si se quiere) y por fecha, ya sea mediante enlaces rápidos por décadas o mediante un rango exacto de años. Los resultados pueden ordenarse por relevancia, título o fecha, y mostrarse de cuatro maneras: una lista detallada, una galería de imágenes, una cuadrícula compacta o una presentación a pantalla completa. Todo el estado de la búsqueda — consulta, filtros, orden, vista — vive en la barra de direcciones, de modo que cualquier página de resultados puede guardarse como marcador, citarse y compartirse exactamente tal como está.
Las facetas no son etiquetas sueltas: sus vocabularios están curados por los custodios del archivo, y ejes como colección y serie pueden organizarse jerárquicamente. Cada valor de faceta que aparece en la página de un registro enlaza de vuelta a la búsqueda, de modo que un lector siempre puede saltar de un registro interesante a todo lo demás que el archivo custodia sobre el mismo tema, lugar, persona o serie.
5. Páginas de registro
Cada registro tiene su propia página con una presentación adecuada a su tipo: el audio y el vídeo se reproducen directamente en la página, los documentos PDF se abren en un visor integrado, las imágenes pueden examinarse en una vista profunda ampliable, y los artículos se renderizan a partir de Markdown filtrado de forma segura. Junto al propio archivo, la página de un registro muestra la descripción completa, los colaboradores, la obra mayor a la que pertenece (con navegación entre sus partes), registros relacionados que vale la pena ver a continuación, y citas ya preparadas en formato Chicago, APA y MLA. Cada registro lleva metadatos legibles por máquina (schema.org JSON-LD) y una dirección estable que nunca cambia; pueden asignarse enlaces permanentes cortos de la forma /go/… para citas impresas y referencias externas.
6. Idiomas
El archivo está construido para un mundo multilingüe, en dos niveles distintos.
La interfaz — todo lo que un visitante o un custodio lee en las propias páginas — está escrita en inglés y mantiene cada texto visible en archivos de idioma traducibles, nunca enterrado en el código. Los paquetes de idioma de la interfaz para 18 idiomas están en preparación y actualmente en traducción: inglés, alemán, francés, italiano, español, portugués, neerlandés, ruso, polaco, sueco, danés, noruego, chino, japonés, coreano, turco, checo y rumano. Los paquetes se instalan y gestionan desde el panel de administración, que también hace seguimiento de lo completa que está cada traducción frente a la fuente inglesa. El asistente de instalación ya habla hoy los 18.
El contenido — el propio material archivado — admite de forma nativa 49 idiomas: inglés, alemán, francés, italiano, español, portugués, neerlandés, ruso, ucraniano, polaco, griego, sueco, danés, noruego, turco, chino, hindi, árabe, indonesio, japonés, vietnamita, coreano, bielorruso, checo, eslovaco, húngaro, rumano, búlgaro, croata, esloveno, finés, bengalí, urdu, persa, islandés, irlandés, suajili, tailandés, filipino, hebreo, panyabí, telugu, tamil, maratí, hausa, yoruba, amárico, javanés y pastún. Los registros se marcan con el idioma de su contenido, y la faceta de idioma de la búsqueda filtra por cualquiera de ellos — así, un lector puede, por ejemplo, sacar con un clic todo lo que el archivo custodia en ucraniano o en árabe. Las escrituras de derecha a izquierda, como el árabe, el hebreo, el persa y el urdu, se muestran correctamente en todo el sitio.
Además, un selector de idioma en cada página pública abre una vista de la página traducida por máquina, sin cargar ningún script de terceros en la propia página.
7. Datos de lugares: GeoNames
La faceta de lugar se apoya en un directorio geográfico organizado como jerarquía — país, región, lugar —, de modo que los registros pueden ubicarse con precisión y volver a encontrarse por la geografía. Los datos de base (los países y sus regiones administrativas de todo el mundo) provienen de la base de datos geográfica GeoNames y se importan a un almacén local de consulta durante la instalación o más tarde desde el panel de administración; los custodios de un archivo pueden ampliarlo con sus propios lugares locales. Datos de lugares: GeoNames.org, con licencia CC BY 4.0.
8. Datos de vocabulario: catálogos de temas y géneros
Los vocabularios curados detrás de facetas como tema y género se entregan con el software y se traducen de forma centralizada, de modo que sus términos tengan significado en cada idioma de la interfaz. Para mantenerlos compatibles con los estándares establecidos de organización del conocimiento, los siguientes vocabularios controlados públicos sirven como fuentes de referencia del trabajo de catálogo: EuroVoc, el tesauro multilingüe de la Unión Europea (© Unión Europea, CC BY 4.0), IPTC Media Topics (© IPTC, CC BY 4.0) y el Getty Art & Architecture Thesaurus (ODC-By 1.0). Cada término del catálogo derivado de un vocabulario externo registra su origen, y la lista completa de todos los componentes de terceros y fuentes de datos acompaña a cada instalación: léala aquí.
9. El lado de trabajo
Detrás del archivo público hay un panel de administración organizado en cuatro áreas: Gobernanza de personas (cuentas de operadores y miembros, roles, permisos), Publicación interna (la sala de trabajo de curaduría de registros y los editores), Configuración de la plataforma (ajustes, formas de medios, facetas, idiomas, estructura del sitio) y Tecnología & datos (estado del sistema, diagnóstico, copias de seguridad). Todo lo que el custodio de un archivo necesita configurar es accesible a través de estas páginas — llevar un archivo no requiere cambios en el código.
Los registros recorren un flujo de curaduría claro: se crean como borradores, se completan con metadatos y facetas, se envían opcionalmente a revisión y después se publican — o se archivan de nuevo más adelante. Los archivos se suben en pequeños bloques reanudables, de modo que los medios grandes sobreviven a conexiones inestables, y cada subida se verifica contra su tipo declarado mediante la inspección de la firma del archivo antes de aceptarse. Las imágenes de vista previa se generan automáticamente donde el servidor lo permite.
Un área de miembros opcional permite que un archivo crezca más allá de sus custodios: a los miembros registrados se les puede ir confiando paso a paso, a través de cuatro niveles fijos, desde leer y debatir hasta curar y publicar registros. Los permisos son de grano fino en ambos lados — los roles administrativos son libremente definibles y se nutren de un registro de derechos detallado, y las excepciones individuales pueden ampliar o estrechar el acceso de cualquier persona concreta. El acceso del propietario se mantiene deliberadamente fuera de la base de datos por completo, para que la puerta de un archivo nunca pueda quedar cerrada por un archivo dañado o un cambio fallido.
10. Seguridad de los datos
Las copias de seguridad son de primer rango: el custodio de un archivo puede crear copias ZIP con sello de fecha de la base de datos, del contenido de medios, de la instalación o de todo a la vez — bajo demanda, con una política de retención que conserva las más recientes y elimina las más antiguas. Cada copia puede replicarse además fuera del servidor, a cualquier proveedor de almacenamiento compatible con S3. La restauración está deliberadamente protegida: el sistema verifica que una copia corresponde a la instalación y crea una copia de seguridad preventiva nueva antes de tocar nada. Junto con el seguimiento versionado del esquema, esto significa que un archivo construido con cuidado puede mantenerse, trasladarse y repararse a largo plazo.
11. Principios de diseño
El repositorio está construido en torno a un pequeño conjunto de principios no negociables que guiaron cada decisión de arquitectura:
- Sin rastreo, sin analítica, sin peticiones a terceros — cada recurso, incluidas las fuentes tipográficas y las bibliotecas de scripts, se sirve desde el propio servidor del archivo. Nada sobre un visitante se envía a ninguna parte.
- Abiertamente rastreable por diseño — HTML limpio, un sitemap estructurado, metadatos descriptivos y un robots.txt que da la bienvenida a los motores de búsqueda y a los sistemas de IA, para que los hechos archivados puedan encontrarse y leerse ampliamente.
- Imprimible y descargable — los documentos están pensados para salir de la pantalla y entrar en el mundo real.
- Legible en muchos idiomas — 18 paquetes de idioma de la interfaz en preparación, 49 idiomas de contenido admitidos de forma nativa en la búsqueda y las facetas, y un selector de idioma en cada página pública (véase el apartado «Idiomas» más arriba).
- Dependencias mínimas y contenidas — un puñado de componentes autoalojados (un parser de Markdown en el servidor; bibliotecas de editor y de visor en el navegador), mantenidos estrictamente separados del código propio del sistema. Sin CDN, sin gestor de paquetes, sin paso de build.
- Agnóstico respecto al entorno — el código idéntico se ejecuta en cada instalación; solo un archivo de entorno difiere por servidor.
- Degradar con dignidad — las funciones opcionales comprueban sus requisitos y se desactivan limpiamente donde un servidor no puede sostenerlas, en lugar de romper el archivo.
12. Créditos de desarrollo
👥 Proyecto & contenido
Raven D. Pond & Keylam Folker — fundadores del proyecto Ta-Na-Si y custodios de este software de repositorio. Toda la dirección editorial, todas las decisiones curatoriales y la visión de proyecto detrás de este software provienen íntegramente de Raven y Keylam. Ellos definieron cada requisito, probaron cada función y guiaron el desarrollo de este sistema desde el concepto inicial hasta su forma actual; cada decisión de arquitectura fue tomada y aprobada por Keylam.
✨ Desarrollo del software
Claude (Anthropic) — el asistente de IA Claude actuó como el principal compañero de desarrollo de este repositorio. El backend en PHP, la capa de base de datos para varios motores, el motor de búsqueda y facetas, el panel de administración, el sistema de diseño del frontend y todas las herramientas auxiliares fueron diseñados y escritos en un proceso colaborativo entre los requisitos de Raven & Keylam y el trabajo de código de Claude. Este repositorio es un ejemplo de archivo independiente construido mediante ingeniería de software colaborativa directa entre humanos e IA para un proyecto del mundo real.
📅 Cronología del desarrollo
El desarrollo inicial comenzó a mediados de mayo de 2026 y ha continuado desde entonces en colaboración diaria. El software lleva la versión 1.0.0; esta página refleja su estado a julio de 2026.
13. Las reglas con las que viene este software
Cada instalación de este software lleva las mismas reglas, y quien instaló este archivo las aceptó antes de que se escribiera un solo archivo. Son cortas, y se escribieron para ser leídas por una persona, no para ser diseccionadas por un abogado: léelas aquí.
En una frase: el archivo que estás viendo pertenece por entero a las personas que lo llevan — su nombre, su colección, sus miembros, sus datos — y el proyecto detrás del software no guarda llave alguna de nada de ello. Lo que permanece, en cada instalación, es el nombre propio del software, los textos fundacionales y la mención de las dos personas que crearon el proyecto. No porque una licencia lo exija, sino porque un archivo que miente sobre su propio origen habría roto exactamente aquello para lo que existe.
14. Contacto & comentarios
Este es un sistema vivo — evoluciona con el proyecto. Si encuentras un problema técnico o un enlace roto, o tienes una sugerencia de mejora, escríbenos a través de la página de contacto enlazada en el pie de cada página, o deja un comentario en cualquiera de nuestros canales de plataforma. Lo leemos todo.