ORNITH ATLAS · Multimedia v4.2 · dos investigaciones independientes

Separar evidencia también es una decisión técnica.

Atlas autocontenido para operar, comparar y aprender sin convertir coincidencias en pruebas más fuertes. Cada ficha conserva estado, procedencia y fuente.

Servidor activollama.cpp · Ornith-1.5-9B Q4_K_L · KV Q4 · tres slots · sin mmproj externo
DFlashArchivo disponible; apagado y sin validación trazable
AWQ W4A16Una prueba cercana a 261K; no prueba concurrencia triple ni calidad equivalente

1 · Resumen ejecutivo

Estado operativo, sin extrapolaciones

Objetivo WCAG AA pendiente de auditoría manual. Sin analítica, backend, CDN ni dependencias externas.

Confirmado hoy: el servicio activo usa llama.cpp con Ornith-1.5-9B Q4_K_L, KV Q4, tres slots y sin mmproj externo. DFlash permanece apagado. Existe una prueba aislada AWQ W4A16 de contexto cercano a 261K. El head MTP puede estar presente, pero sus pesos, aceptación, VRAM, utilidad y compatibilidad con el GGUF activo no se han evaluado funcionalmente.

Regla central: combinar Fuente A y Fuente B nunca eleva el estado de evidencia. Coincidencia significa procedencia convergente, no reproducción adicional.

3 · Corte operativo

Lo confirmado hoy vs. lo que falta demostrar

Los huecos se mantienen visibles.

Lo confirmado hoy

  • Configuración activa: Q4_K_L, KV Q4, tres slots, sin mmproj externo.
  • DFlash está disponible como archivo, pero apagado.
  • AWQ W4A16 completó una sola prueba cercana a 261K.
  • El 9B es denso; la poda de expertos no aplica.
  • Pesos, KV y estado recurrente son memorias distintas.

Lo que falta demostrar

  • Trazabilidad de métricas históricas de velocidad, latencia y multicontexto.
  • Concurrencia larga real y calidad equivalente entre runtimes.
  • Contenido tensorial del GGUF: MTP y cualquier componente visual.
  • A/B de pesos, KV, MTP y DFlash, un factor por vez.
  • Calidad downstream de LoRA/QLoRA y toda poda.

2 · Matriz de técnicas

Filtrar por estado y procedencia

Buscador, fichas expandibles y comparador limitado a tres.

Estado
Procedencia

GGUF Q4_K_L + KV Q4DemostradoConsenso independiente
AlcanceCarga local y configuración operativa, no ranking de calidad.
RiesgoTres slots configurados no demuestran carga larga simultánea.
EvidenciaAmbos paquetes preservan el mismo baseline confirmado.
FaltaHashes, licencia, comandos, logs, repeticiones y A/B.
Fuentes por ficha
  • Agente 1 V3 ORNITH_DECISION_MATRIX.md
  • Agente 2 V2.1.1 ORNITH_DECISION_MATRIX-v2.1.md
  • fuente primaria llama.cpp
AWQ W4A16 + KV INT4Demostrado · 1 pruebaFuente A
AlcanceUna ejecución larga; no generalizar.
RiesgoConfundir retrieval aislado con equivalencia global.
EvidenciaFuente A aporta la observación local; B la cita como contexto interno, no como reproducción independiente.
FaltaDos o tres solicitudes largas, suite pareada y repeticiones.
Fuentes por ficha
  • Agente 1 V3 RESEARCH_LIBRARY.md
  • Agente 2 V2.1.1 mención contextual, sin verificación independiente
  • fuente primaria checkpoint AWQ
DFlash externoPendiente de trazabilidadDiscrepancia resuelta

A conserva únicamente archivo presente/no evaluado; B registra una medición histórica incompleta. Se adopta el mínimo común: no hay rendimiento demostrable.

Fuentes por ficha
MTP integradoCompatible sin probarDiscrepancia resuelta

No se acepta ni “entrenado/útil” ni “aleatorio/inútil”. Distribución tensorial no reemplaza un benchmark funcional.

Fuentes por ficha
Q4_K_M / IQ4_XS / controles Q5–Q6Compatible sin probarConsenso independiente

Comparar un factor por vez. Q3 permanece experimental; Q5/Q6 son controles de fidelidad, no candidatos de ahorro.

  • Agente 1 V3 inventario y matriz
  • Agente 2 V2.1.1 informe 08
  • fuente primaria artefactos GGUF
KV Q4 / Q8 / F16Compatible sin probarFuente B

La clasificación de variantes y la separación explícita del estado recurrente provienen de B; el soporte del runtime no eleva la calidad local.

  • Agente 1 V3 distingue pesos y KV
  • Agente 2 V2.1.1 cuantificación y plan A/B
  • fuente primaria llama.cpp
LoRA BF16 / QLoRACompatible sin probarConsenso independiente

Entrenar desde el BF16 original, no desde GGUF cuantizado. Inspeccionar módulos reales antes de fijar targets.

  • Agente 1 V3 biblioteca y matriz
  • Agente 2 V2.1.1 informe 02
  • fuente primaria LoRA · QLoRA
Poda estructurada densaHipótesisConsenso independiente

MLP primero; profundidad y otros ejes como ablations separadas. Un objetivo porcentual no es un resultado.

  • Agente 1 V3 línea comparativa
  • Agente 2 V2.1.1 informe 03
  • fuente primaria Minitron
Poda de expertos en Ornith 9BNo compatibleConsenso independiente
Visión externa / perfil textualPendiente de trazabilidadDiscrepancia resuelta

La ausencia del proyector externo ya forma parte del baseline. Cualquier ahorro adicional sigue sin cuantificar.

Eliminar idiomas / unlearning perfectoNo compatibleConsenso independiente

Comparador

Hasta tres técnicas

No produce una recomendación automática.

Ninguna técnica seleccionada.

4 · Plan por fases

Una variable cada vez

Orden obligatorio, reversible y trazable.

Trazabilidad

Congelar hashes, comandos, runtime, flags, datasets, logs y repeticiones.

Inspección GGUF

Listar tensores y tipos; comprobar MTP y cualquier contenido visual.

A/B de pesos

Q4_K_L → Q4_K_M → IQ4_XS; controles aparte.

A/B de KV

Q4 → Q8 → F16 con pesos y prompts congelados.

MTP o DFlash

Perfiles separados, nunca simultáneos; medir aceptación, memoria y latencia.

LoRA / QLoRA

BF16 original, targets inspeccionados, replay ES/EN y batería pareada.

Poda experimental

Rama separada, recovery y evaluación integral; no promover porcentajes teóricos.

5 · Gates por dominio

No existe un porcentaje global que lo resuma todo

Una mejora en un dominio no compensa una rotura crítica en otro.

Código

Cero regresiones nuevas en pruebas ejecutables fijadas.

JSON

Cero errores nuevos contra esquemas exactos.

Herramientas

Cero llamadas nuevas inválidas o argumentos corruptos.

ES/EN pareado

Casos pareados por idioma, intervalo de confianza y margen acordado.

Contexto largo

Misma longitud y concurrencia; cero OOM, corrupción o pérdida nueva.

Estabilidad

Repeticiones con p50/p95 y una prueba prolongada.

6 · Mapa de módulos

Qué se puede encender, apagar o sólo investigar

El mapa evita mezclar memorias y artefactos.

Pesos

Cambiar perfil: sí

Q4_K_L activo; otras variantes requieren A/B.

KV

Configurable

Q4 activo. No equivale al estado recurrente.

Estado recurrente

No con flags KV

Memoria distinta; cuantización completa no demostrada.

Visión externa / mmproj

Apagada

El servidor ya opera sin proyector externo; contenido del GGUF incierto.

MTP

Incierto

Posible head; falta inspección y prueba funcional.

DFlash / draft

Apagado

Artefacto auxiliar disponible; validar separado de MTP.

7 · Discrepancias y decisiones

Conservar ambas fuentes, decidir sólo el estado

Una hipótesis no se promociona por repetición.

D-01 · DFlash

A: archivo no evaluado. B: medición histórica incompleta. Decisión: conservar ambas narrativas y exigir trazabilidad antes de usar cifras.

D-02 · MTP

B contenía lecturas incompatibles sobre sus pesos; A confirma estructura, no utilidad. Decisión: presente o posible, funcionalmente desconocido.

D-03 · Visión

El perfil actual ya omite el proyector externo. Decisión: no atribuir reducción adicional sin inspección del GGUF y medición.

D-04 · Métricas históricas

Se conservan como registros pendientes. No se convierten en baseline hasta adjuntar artefactos reproducibles.

Datos no reconciliados: procedencia/licencia/hash del GGUF activo; contenido exacto del GGUF respecto a MTP y visión; validez reproducible de mediciones históricas de DFlash y multicontexto; compatibilidad funcional y utilidad del MTP; calidad relativa de AWQ y GGUF; licencia efectiva de pesos/derivados. El Atlas no decide estos puntos.

8 · Biblioteca de aprendizaje

Lectura, audios y vídeos

Narración con la voz Memo M. Los audios organizan la evidencia; no añaden pruebas.

Explorar 12 fuentes con audio

Cómo leer la evidencia

Distingue soporte upstream, fuente primaria, ejecución local trazada y compatibilidad.

Memorias separadas

Pesos, KV y estado recurrente requieren pruebas y controles distintos.

Ruta experimental

Trazar, inspeccionar, comparar, especializar y sólo después podar.

v4.2 · Biblioteca 02

Doce fuentes nuevas y doce resúmenes en audio

Curaduría primaria sobre baseline Q4_K_L, KV, cuantización, LoRA, evaluación, DFlash, poda y destilación.

Añadido: documentación y código de llama.cpp; K-quants; una receta comunitaria Q4_K_L claramente anecdótica; Minitron, Sheared LLaMA, LLM-Pruner y ShortGPT; LoRA, HELM y DFlash; y una guía QLoRA en español verificada por oEmbed.

Audio: 12 resúmenes de 60–90 segundos con Memo M y capítulos 9 y 10 del audiolibro.

Fuentes añadidas

Pendiente: hashes y trazabilidad completos del baseline; evaluación local de MTP, DFlash y visión; A/B de pesos y KV; y experimentos de especialización o poda con gates por dominio.

Explorar Biblioteca 02Leer CHANGELOG v4.2

9 · Fuentes por ficha

Tres etiquetas, sin fusión de evidencia

Los enlaces primarios se muestran dentro de cada ficha.

Agente 1 V3 investigación A y estado operativo conservador.

Agente 2 V2.1.1 investigación B independiente y registro de contradicciones.

fuente primaria configuración, código, documentación o paper enlazado.

Límite: “Consenso independiente” describe coincidencia entre análisis o apoyo primario; no añade una ejecución local ni mejora automáticamente el estado.