Passer au contenu

> journal d'évolution

Sur quoi tourne Maguyva

Conçue pour la vitesse, la facilité de débogage et l'amélioration continue : une infrastructure éprouvée au cœur du système, des composants sur mesure là où l'intelligence du code l'exige.

PostgreSQL + LanceRecherche vectorielle quantifiéeMoteur de langages de codeMCP partout279+ langages

> lsmod | grep production

Ce qui tourne en production

Voici les couches essentielles qui ont survécu à de multiples itérations. Chacune a mérité sa place en facilitant le débogage ou en réduisant la friction dans l'exécution des agents.

Base de données

PostgreSQL + Lance

Stockage et index partitionnés par tenant. Votre code reste isolé, sans mélange d'index entre utilisateurs.

Embeddings

Voyage AI: voyage-4-large

Embeddings de code à haut rappel pour la recherche, la récupération, et l'ancrage des agents.

Recherche vectorielle

Binary Quantized HNSW

Embeddings compressés en signatures de 2048 bits et indexés avec HNSW. Réduction de stockage par 32, recherche à faible latence, zéro infrastructure supplémentaire.

Moteur de langages

Moteur de langages de code

Une stack Tree-sitter fortement modifiée, avec grammaires personnalisées, heuristiques de handlers, et une couverture d'extraction sur 279 langages

Protocole

Protocole MCP

Serveur MCP distant pour Claude Code, Claude Desktop, Cursor, VS Code, Windsurf et other MCP-compatible clients. Outils 11 exécutés dans un Cloudflare Worker TypeScript avec transport HTTP streamable natif.

Cache

Lance colonnaire + R2

Embeddings en cache colonnaire, synchronisés dans le cloud

Chronologie de l'architecture

La stack après les impasses

Maguyva n'a pas pris cette forme d'un seul coup. Chaque couche a survécu parce qu'elle rendait le système plus facile à raisonner, moins coûteux à exploiter, ou plus facile à déboguer sous pression.

Les expérimentations d'orchestration ont commencé plus tôt. Cette chronologie démarre en septembre 2025, quand le produit Maguyva lui-même a pris forme.

1
2025-Q3fondation

Début du développement ciblé de Maguyva → Voyage voyage-code-3

La direction produit se précise et la boucle d'itération rapide démarre

2
2025-Q3stockage

Couche de récupération vectorielle binaire

Recherche quantifiée avec index compacts, pas de stack vectorielle séparée

3
2025-Q4moteur-ast

Le moteur de langages de code entre en service

Requêtes personnalisées, replis de parseur, et heuristiques à base de handlers sur 279 langages

4
2025-Q4recherche

Recherche par fusion multimodale

Récupération classée sur les index sémantique, texte, AST, et graphe en une seule requête

5
2026-Q1cache

Synchro Lance colonnaire + R2

Cache colonnaire côté serveur, démarrages à froid plus rapides

6
2026-Q1qualité

Framework de validation sur 279 langages

Tests d'extraction automatisés sur chaque langage pris en charge

7
2026-Q1lancement

Lancement public sur maguyva.ai

7 mois entre le début du développement ciblé et la disponibilité publique

8
2026-Q2protocol

Service MCP sur Cloudflare Worker en TypeScript

Transport HTTP streamable natif, latence réduite, remplacé sans interrompre le trafic en production

NOWembeddings

Embeddings de production → voyage-4-large

recherche sémantique à rappel plus élevé après le basculement de voyage-code-3

> ps aux | grep maguyva

On tourne sur ce qu'on livre

Maguyva est construit par des agents qui tournent sur Maguyva.

Notre système d'orchestration coordonne des agents IA spécialisés qui utilisent les mêmes outils MCP, les mêmes index de recherche, et la même infrastructure de production que vous. Il n'existe pas de version interne. La page équipe indique “1x Maguyva (149 $) — on se paie nous-mêmes.” Ce n'est pas une blague. C'est la facture.

// le client zéro livre en production tous les jours

> cat /etc/principles.d/*.conf

Les règles qui ont survécu à la production

Voici les contraintes qui sont restées utiles en production. Il s'agit moins d'idéologie que de garder le système compréhensible pendant que les agents y apportent des changements à grande vitesse.

!

Pas de repli silencieux

Échouer vite, corriger vite. Chaque erreur remonte immédiatement. Pas de dégradation gracieuse pour cacher des bugs en production.

// panique > corruption silencieuse

λ

RPC d'abord

Logique côté base de données pour la performance. Les fonctions PostgreSQL s'exécutent au plus près des données, ce qui élimine les allers-retours.

// fonctions PostgreSQL, 0 ORM

CQRS

Chemins d'écriture et de lecture séparés. Le pipeline d'indexation écrit, les outils MCP lisent. Des stratégies d'optimisation différentes.

// écritures : par lots | lectures : en cache

#

UUID déterministes

Cohérence de cache sans requêtes en base. Même entrée = même ID. Opérations idempotentes par conception.

// uuid5(namespace, content_hash)

La meilleure architecture, c'est celle qu'on peut déboguer à 3h du matin.
(On l'a testé.)

// dernière mise à jour : 2026-07

Essayez-le sur votre dépôt

> ssh infra@maguyva -- status

Où vit votre code

Aucun mystère. Voici exactement ce qui arrive à votre code quand vous connectez un dépôt.

Calcul

Serveurs bare-metal, US East

Machines bare-metal à Ashburn, optimisées pour le débit d'indexation plutôt que des instances génériques bruyantes.

Périphérie

CDN mondial Cloudflare

Réponses API et MCP mises en cache en périphérie. Les assets statiques sont servis depuis le réseau mondial de Cloudflare.

Isolation

Partitionnement par tenant, par espace de travail

Chaque espace de travail dispose d'index de dépôts scopés par tenant, sur tout le pipeline et la base de données. Nous utilisons le code des clients pour fournir de l'intelligence de code, pas pour entraîner des modèles ou revendre des données.

Entité

Immatriculée à Singapour

UT International PTE. LTD. Juridiction réelle, entité réelle.

Suppression

Retirez un dépôt, retirez l'index

Déconnectez un dépôt et Maguyva retire le code source indexé actif, les embeddings, et les données de graphe du service. Les sauvegardes résiduelles expirent selon le calendrier de rétention.

Régions

Besoin d'UE ou d'AU ?

Des régions de déploiement supplémentaires, ça se discute avec les clients ayant des exigences de résidence des données.