> registro de evolución
Sobre qué corre Maguyva
Construido para velocidad, capacidad de depuración y mejora continua: infraestructura probada en el núcleo, componentes diseñados a medida donde la inteligencia de código lo requiere.
> lsmod | grep production
Qué corre en producción
Estas son las capas centrales que sobrevivieron varias iteraciones. Cada una se ganó su lugar al facilitar la depuración o al quitar fricción de la ejecución del agente.
PostgreSQL + Lance
Almacenamiento e índices particionados por tenant. Tu código se mantiene aislado, sin mezcla de índices entre usuarios.
Voyage AI: voyage-4-large
Embeddings de código de alto recall para búsqueda, recuperación y fundamentación del agente.
Binary Quantized HNSW
Embeddings comprimidos a firmas de 2048 bits e indexados con HNSW. Reducción de almacenamiento de 32x, búsqueda de baja latencia, cero infraestructura extra.
Motor de lenguajes de código
Un stack de Tree-sitter fuertemente modificado, con gramáticas personalizadas, heurísticas de handlers y cobertura de extracción para 279 lenguajes
Protocolo MCP
Servidor MCP remoto para Claude Code, Claude Desktop, Cursor, VS Code, Windsurf y other MCP-compatible clients. Herramientas 11 en un Cloudflare Worker con TypeScript y transporte HTTP streamable nativo.
Lance columnar + R2
Embeddings en caché columnar, sincronizados en la nube
Cronología de arquitectura
El stack después de los callejones sin salida
Maguyva no llegó a esta forma de una sola vez. Cada capa sobrevivió porque hizo el sistema más fácil de razonar, más barato de operar o más fácil de depurar bajo presión.
Los experimentos de orquestación empezaron antes. Esta cronología arranca en septiembre de 2025, cuando el producto Maguyva en sí mismo tomó forma.
Empieza el desarrollo enfocado de Maguyva → Voyage voyage-code-3
La dirección del producto se consolida y empieza el ciclo de iteración rápida
Capa de recuperación vectorial binaria
Búsqueda cuantizada con índices compactos, sin un stack vectorial separado
El motor de lenguajes de código entra en línea
Consultas personalizadas, fallbacks de parser y heurísticas basadas en handlers en 279 lenguajes
Búsqueda de fusión multimodal
Recuperación clasificada en índices semánticos, de texto, AST y de grafo en una sola consulta
Sincronización Lance columnar + R2
Caché columnar del lado del servidor, arranques en frío más rápidos
Framework de validación para 279 lenguajes
Pruebas de extracción automatizadas en todos los lenguajes compatibles
Lanzamiento público en maguyva.ai
7 meses desde el desarrollo enfocado hasta la disponibilidad pública
Servicio MCP en Cloudflare Worker con TypeScript
Transporte HTTP streamable nativo, menor latencia, reemplazado sin interrumpir el tráfico en producción
Embeddings de producción → voyage-4-large
Búsqueda semántica con mayor recall tras migrar desde voyage-code-3
> ps aux | grep maguyva
Corremos sobre lo que lanzamos
Maguyva está construido por agentes que corren sobre Maguyva.
Nuestro sistema de orquestación coordina agentes de IA especializados que usan las mismas herramientas MCP, índices de búsqueda e infraestructura de producción que tú obtienes. No existe una versión interna. La página del equipo dice “1x Maguyva ($149) — nos pagamos a nosotros mismos.” Eso no es un chiste. Es la factura.
// el cliente cero lanza a producción a diario
> cat /etc/principles.d/*.conf
Las reglas que sobrevivieron a producción
Estas son las restricciones que siguieron siendo útiles en producción. Tienen menos que ver con la ideología y más con mantener el sistema comprensible mientras los agentes hacen cambios a toda velocidad.
Sin fallbacks silenciosos
Falla rápido, arregla rápido. Cada error sale a la superficie de inmediato. Sin degradación elegante que esconda bugs en producción.
// pánico > corrupción silenciosa
RPC primero
Lógica del lado de la base de datos para rendimiento. Las funciones de PostgreSQL se ejecutan cerca de los datos, eliminando idas y vueltas.
// funciones de PostgreSQL, 0 ORMs
CQRS
Rutas separadas de escritura y lectura. El pipeline de indexación escribe, las herramientas MCP leen. Estrategias de optimización distintas.
// escrituras: en lote | lecturas: en caché
UUIDs deterministas
Coherencia de caché sin consultas a la base de datos. Misma entrada = mismo ID. Operaciones idempotentes por diseño.
// uuid5(namespace, content_hash)
La mejor arquitectura es la que puedes depurar a las 3am.
(Ya lo probamos.)
// última actualización: 2026-07
> ssh infra@maguyva -- status
Dónde vive tu código
Sin misterios. Esto es exactamente lo que pasa con tu código cuando conectas un repo.
Servidores bare-metal, US East
Máquinas bare-metal en Ashburn, optimizadas para el throughput de indexación en lugar de instancias ruidosas de propósito general.
CDN global de Cloudflare
Las respuestas de API y MCP se cachean en el edge. Los assets estáticos se sirven desde la red global de Cloudflare.
Particionado por tenant en cada espacio de trabajo
Cada espacio de trabajo tiene índices de repositorio delimitados por tenant a lo largo del pipeline y la base de datos. Usamos el código de los clientes para ofrecer inteligencia de código, no para entrenar modelos ni vender datos.
Incorporada en Singapur
UT International PTE. LTD. Jurisdicción real, entidad real.
Elimina un repo, elimina el índice
Desconecta un repo y Maguyva elimina el código fuente indexado activo, los embeddings y los datos del grafo del servicio. Las copias de respaldo residuales caducan según el calendario de retención.
¿Necesitas UE o AU?
Las regiones de despliegue adicionales son una conversación para clientes con requisitos de residencia de datos.