> registro de evolução
No que o Maguyva roda
Construída para velocidade, capacidade de depuração e melhoria contínua: infraestrutura comprovada no núcleo, componentes personalizados onde a inteligência de código exige.
> lsmod | grep production
O que roda em produção
Estas são as camadas centrais que permaneceram após várias iterações. Cada uma delas conquistou seu lugar ao facilitar a depuração ou ao remover atrito da execução dos agentes.
PostgreSQL + Lance
Armazenamento e índices particionados por tenant. Seu código permanece isolado, sem mistura de índices entre usuários.
Voyage AI: voyage-4-large
Embeddings de código de alto recall para busca, recuperação e fundamentação dos agentes.
Binary Quantized HNSW
Embeddings comprimidos em assinaturas de 2048 bits e indexados com HNSW. Redução de 32x no armazenamento, busca de baixa latência, zero infraestrutura extra.
Motor de Linguagens de Código
Uma stack Tree-sitter fortemente modificada, com gramáticas personalizadas, heurísticas de handlers e cobertura de extração para 279 linguagens
Protocolo MCP
Servidor MCP remoto para Claude Code, Claude Desktop, Cursor, VS Code, Windsurf e other MCP-compatible clients. Ferramentas 11 em um Cloudflare Worker com TypeScript e transporte HTTP streamable nativo.
Lance colunar + R2
Embeddings em cache colunar, sincronizados na nuvem
Linha do Tempo da Arquitetura
A stack depois dos becos sem saída
O Maguyva não chegou a essa forma de uma vez só. Cada camada sobreviveu porque tornou o sistema mais fácil de entender, mais barato de operar ou mais fácil de depurar sob pressão.
Os experimentos de orquestração começaram antes. Esta linha do tempo começa em setembro de 2025, quando o produto Maguyva em si entrou em foco.
Começa o desenvolvimento focado do Maguyva → Voyage voyage-code-3
A direção do produto se solidifica e começa o ciclo de iteração rápida
Camada de recuperação vetorial binária
Busca quantizada com índices compactos, sem stack vetorial separada
O motor de linguagens de código entra em operação
Consultas personalizadas, fallbacks de parser e heurísticas baseadas em handlers em 279 linguagens
Busca de fusão multimodal
Recuperação classificada entre índices semânticos, de texto, AST e de grafo em uma única consulta
Sincronização Lance columnar + R2
Cache colunar no servidor, cold starts mais rápidos
Framework de validação para 279 linguagens
Testes automatizados de extração em todas as linguagens suportadas
Lançamento público em maguyva.ai
7 meses do desenvolvimento focado até a disponibilidade pública
Serviço MCP em Cloudflare Worker com TypeScript
Transporte HTTP streamable nativo, menor latência, substituído sem interromper o tráfego em produção
Embeddings de produção → voyage-4-large
Busca Semântica com maior recall após transição de voyage-code-3
> ps aux | grep maguyva
Rodamos no que lançamos
O Maguyva é construído por agentes que rodam no Maguyva.
Nosso sistema de orquestração coordena agentes de IA especialistas que usam as mesmas ferramentas MCP, índices de busca e infraestrutura de produção que você recebe. Não existe uma versão interna. A página da equipe lista “1x Maguyva ($149) — nós pagamos a nós mesmos.” Isso não é piada. É a nota fiscal.
// o cliente zero lança em produção todo dia
> cat /etc/principles.d/*.conf
As regras que sobreviveram à produção
Estas são as restrições que continuaram úteis em produção. Elas têm menos a ver com ideologia e mais com manter o sistema compreensível enquanto os agentes fazem mudanças em alta velocidade.
Sem Fallbacks Silenciosos
Falhe rápido, corrija rápido. Todo erro aparece imediatamente. Nenhuma degradação graciosa escondendo bugs em produção.
// pânico > corrupção silenciosa
RPC-First
Lógica no lado do banco de dados para desempenho. Funções do PostgreSQL executam perto dos dados, eliminando idas e voltas.
// funções do PostgreSQL, 0 ORMs
CQRS
Caminhos separados de escrita e leitura. O pipeline de indexação escreve, as ferramentas MCP leem. Estratégias de otimização diferentes.
// escritas: em lote | leituras: em cache
UUIDs Determinísticos
Coerência de cache sem consultas ao banco de dados. Mesma entrada = mesmo ID. Operações idempotentes por design.
// uuid5(namespace, content_hash)
A melhor arquitetura é aquela que você consegue depurar às 3 da manhã.
(Já testamos isso.)
// última atualização: 2026-07
> ssh infra@maguyva -- status
Onde o seu código mora
Sem mistério. Aqui está exatamente o que acontece com o seu código quando você conecta um repositório.
Servidores bare-metal, Leste dos EUA
Máquinas bare-metal em Ashburn, ajustadas para throughput de indexação em vez de instâncias genéricas barulhentas.
CDN global da Cloudflare
Respostas de API e MCP em cache na borda (edge). Ativos estáticos servidos pela rede global da Cloudflare.
Particionado por tenant, por workspace
Cada workspace recebe índices de repositório isolados por tenant em todo o pipeline e no banco de dados. Usamos o código do cliente para oferecer inteligência de código, não para treinar modelos ou vender dados.
Constituída em Cingapura
UT International PTE. LTD. Jurisdição real, entidade real.
Remova um repositório, remova o índice
Desconecte um repositório e o Maguyva remove o código-fonte indexado ativo, os embeddings e os dados de grafo do serviço. Os backups residuais expiram conforme o cronograma de retenção.
Precisa de UE ou AU?
Regiões de implantação adicionais são uma conversa para clientes com requisitos de residência de dados.