> journal d'évolution
Sur quoi tourne Maguyva
Conçue pour la vitesse, la facilité de débogage et l'amélioration continue : une infrastructure éprouvée au cœur du système, des composants sur mesure là où l'intelligence du code l'exige.
> lsmod | grep production
Ce qui tourne en production
Voici les couches essentielles qui ont survécu à de multiples itérations. Chacune a mérité sa place en facilitant le débogage ou en réduisant la friction dans l'exécution des agents.
PostgreSQL + Lance
Stockage et index partitionnés par tenant. Votre code reste isolé, sans mélange d'index entre utilisateurs.
Voyage AI: voyage-4-large
Embeddings de code à haut rappel pour la recherche, la récupération, et l'ancrage des agents.
Binary Quantized HNSW
Embeddings compressés en signatures de 2048 bits et indexés avec HNSW. Réduction de stockage par 32, recherche à faible latence, zéro infrastructure supplémentaire.
Moteur de langages de code
Une stack Tree-sitter fortement modifiée, avec grammaires personnalisées, heuristiques de handlers, et une couverture d'extraction sur 279 langages
Protocole MCP
Serveur MCP distant pour Claude Code, Claude Desktop, Cursor, VS Code, Windsurf et other MCP-compatible clients. Outils 11 exécutés dans un Cloudflare Worker TypeScript avec transport HTTP streamable natif.
Lance colonnaire + R2
Embeddings en cache colonnaire, synchronisés dans le cloud
Chronologie de l'architecture
La stack après les impasses
Maguyva n'a pas pris cette forme d'un seul coup. Chaque couche a survécu parce qu'elle rendait le système plus facile à raisonner, moins coûteux à exploiter, ou plus facile à déboguer sous pression.
Les expérimentations d'orchestration ont commencé plus tôt. Cette chronologie démarre en septembre 2025, quand le produit Maguyva lui-même a pris forme.
Début du développement ciblé de Maguyva → Voyage voyage-code-3
La direction produit se précise et la boucle d'itération rapide démarre
Couche de récupération vectorielle binaire
Recherche quantifiée avec index compacts, pas de stack vectorielle séparée
Le moteur de langages de code entre en service
Requêtes personnalisées, replis de parseur, et heuristiques à base de handlers sur 279 langages
Recherche par fusion multimodale
Récupération classée sur les index sémantique, texte, AST, et graphe en une seule requête
Synchro Lance colonnaire + R2
Cache colonnaire côté serveur, démarrages à froid plus rapides
Framework de validation sur 279 langages
Tests d'extraction automatisés sur chaque langage pris en charge
Lancement public sur maguyva.ai
7 mois entre le début du développement ciblé et la disponibilité publique
Service MCP sur Cloudflare Worker en TypeScript
Transport HTTP streamable natif, latence réduite, remplacé sans interrompre le trafic en production
Embeddings de production → voyage-4-large
recherche sémantique à rappel plus élevé après le basculement de voyage-code-3
> ps aux | grep maguyva
On tourne sur ce qu'on livre
Maguyva est construit par des agents qui tournent sur Maguyva.
Notre système d'orchestration coordonne des agents IA spécialisés qui utilisent les mêmes outils MCP, les mêmes index de recherche, et la même infrastructure de production que vous. Il n'existe pas de version interne. La page équipe indique “1x Maguyva (149 $) — on se paie nous-mêmes.” Ce n'est pas une blague. C'est la facture.
// le client zéro livre en production tous les jours
> cat /etc/principles.d/*.conf
Les règles qui ont survécu à la production
Voici les contraintes qui sont restées utiles en production. Il s'agit moins d'idéologie que de garder le système compréhensible pendant que les agents y apportent des changements à grande vitesse.
Pas de repli silencieux
Échouer vite, corriger vite. Chaque erreur remonte immédiatement. Pas de dégradation gracieuse pour cacher des bugs en production.
// panique > corruption silencieuse
RPC d'abord
Logique côté base de données pour la performance. Les fonctions PostgreSQL s'exécutent au plus près des données, ce qui élimine les allers-retours.
// fonctions PostgreSQL, 0 ORM
CQRS
Chemins d'écriture et de lecture séparés. Le pipeline d'indexation écrit, les outils MCP lisent. Des stratégies d'optimisation différentes.
// écritures : par lots | lectures : en cache
UUID déterministes
Cohérence de cache sans requêtes en base. Même entrée = même ID. Opérations idempotentes par conception.
// uuid5(namespace, content_hash)
La meilleure architecture, c'est celle qu'on peut déboguer à 3h du matin.
(On l'a testé.)
// dernière mise à jour : 2026-07
> ssh infra@maguyva -- status
Où vit votre code
Aucun mystère. Voici exactement ce qui arrive à votre code quand vous connectez un dépôt.
Serveurs bare-metal, US East
Machines bare-metal à Ashburn, optimisées pour le débit d'indexation plutôt que des instances génériques bruyantes.
CDN mondial Cloudflare
Réponses API et MCP mises en cache en périphérie. Les assets statiques sont servis depuis le réseau mondial de Cloudflare.
Partitionnement par tenant, par espace de travail
Chaque espace de travail dispose d'index de dépôts scopés par tenant, sur tout le pipeline et la base de données. Nous utilisons le code des clients pour fournir de l'intelligence de code, pas pour entraîner des modèles ou revendre des données.
Immatriculée à Singapour
UT International PTE. LTD. Juridiction réelle, entité réelle.
Retirez un dépôt, retirez l'index
Déconnectez un dépôt et Maguyva retire le code source indexé actif, les embeddings, et les données de graphe du service. Les sauvegardes résiduelles expirent selon le calendrier de rétention.
Besoin d'UE ou d'AU ?
Des régions de déploiement supplémentaires, ça se discute avec les clients ayant des exigences de résidence des données.