> Evolution-Log wird angezeigt
Worauf Maguyva läuft
Gebaut für Geschwindigkeit, Debugbarkeit und kontinuierliche Verbesserung: bewährte Infrastruktur im Kern, maßgeschneiderte Komponenten dort, wo Code Intelligence sie erfordert.
> lsmod | grep production
Was in Produktion läuft
Das sind die Kernschichten, die nach mehreren Iterationen übrig geblieben sind. Jede von ihnen hat sich ihren Platz verdient, indem sie das Debugging erleichtert oder Reibung bei der Agenten-Ausführung entfernt hat.
PostgreSQL + Lance
Mandantengetrennter Storage und Indizes. Dein Code bleibt isoliert, ohne Vermischung von Indizes zwischen Nutzern.
Voyage AI: voyage-4-large
Code-Embeddings mit hohem Recall für Agenten-Suche, Retrieval und Grounding.
Binary Quantized HNSW
Embeddings komprimiert zu 2048-Bit-Signaturen und mit HNSW indexiert. 32-fache Speicherreduktion, latenzarme Suche, keine zusätzliche Infrastruktur.
Code-Sprach-Engine
Ein stark modifizierter Tree-sitter-Stack mit eigenen Grammatiken, Handler-Heuristiken und Extraktionsabdeckung für 279 Sprachen
MCP-Protokoll
Remote-MCP-Server für Claude Code, Claude Desktop, Cursor, VS Code, Windsurf und other MCP-compatible clients. 11 Werkzeuge auf einem TypeScript Cloudflare Worker mit nativem streambarem HTTP-Transport.
Lance-Spaltenformat + R2
Spaltenweise gecachte, cloud-synchronisierte Embeddings
Architektur-Zeitleiste
Der Stack nach den Sackgassen
Maguyva hat diese Form nicht auf einen Schlag erreicht. Jede Schicht hat überlebt, weil sie das System leichter nachvollziehbar, günstiger zu betreiben oder unter Druck leichter zu debuggen gemacht hat.
Die Orchestrierungsexperimente begannen früher. Diese Zeitleiste beginnt im September 2025, als das Maguyva-Produkt selbst in den Fokus rückte.
Fokussierter Maguyva-Build startet → Voyage voyage-code-3
Die Produktrichtung verfestigt sich, und der schnelle Iterationsloop beginnt
Binäre Vektor-Retrieval-Schicht
Quantisierte Suche mit kompakten Indizes, kein separater Vektor-Stack
Code-Sprach-Engine geht online
Eigene Queries, Parser-Fallbacks und handler-basierte Heuristiken über 279 Sprachen hinweg
Multimodale Fusionssuche
Gerankte Suche über semantische, Text-, AST- und Graph-Indizes in einer einzigen Abfrage
Lance-Spaltenformat + R2-Sync
Serverseitiger spaltenbasierter Cache, schnellere Kaltstarts
279-Sprachen-Validierungs-Framework
Automatisiertes Extraktionstesting über jede unterstützte Sprache
Öffentlicher Launch auf maguyva.ai
7 Monate vom fokussierten Build bis zur öffentlichen Verfügbarkeit
MCP auf einem TypeScript Cloudflare Worker
Nativer streambarer HTTP-Transport, geringere Latenz, unter laufendem Datenverkehr ausgetauscht
Produktive Embeddings → voyage-4-large
Semantische Suche mit höherem Recall nach der Umstellung von voyage-code-3
> ps aux | grep maguyva
Wir laufen auf dem, was wir shippen
Maguyva wird von Agenten gebaut, die auf Maguyva laufen.
Unser Orchestrierungssystem koordiniert spezialisierte KI-Agenten, die dieselben MCP-Tools, Suchindizes und Produktionsinfrastruktur nutzen, die du auch bekommst. Es gibt keine interne Version. Die Team-Seite listet “1x Maguyva ($149) — wir bezahlen uns selbst.” Das ist kein Witz. Das ist die Rechnung.
// customer zero shippt täglich in Produktion
> cat /etc/principles.d/*.conf
Die Regeln, die die Produktion überlebt haben
Das sind die Einschränkungen, die in der Produktion nützlich geblieben sind. Es geht weniger um Ideologie und mehr darum, das System nachvollziehbar zu halten, während Agenten schnell Änderungen vornehmen.
Keine stillen Fallbacks
Fail fast, fix fast. Jeder Fehler wird sofort sichtbar. Kein Graceful Degradation, das Bugs in der Produktion versteckt.
// Panic > stille Korruption
RPC-First
Datenbankseitige Logik für Performance. PostgreSQL-Funktionen laufen nah an den Daten und eliminieren Round-Trips.
// PostgreSQL-Funktionen, 0 ORMs
CQRS
Getrennte Schreib- und Lesepfade. Die Indexierungs-Pipeline schreibt, MCP-Tools lesen. Unterschiedliche Optimierungsstrategien.
// Schreiben: batchverarbeitet | Lesen: gecacht
Deterministische UUIDs
Cache-Kohärenz ohne Datenbankabfragen. Gleicher Input = gleiche ID. Idempotente Operationen per Design.
// uuid5(namespace, content_hash)
Die beste Architektur ist die, die du um 3 Uhr morgens debuggen kannst.
(Wir haben das getestet.)
// zuletzt aktualisiert: 2026-07
> ssh infra@maguyva -- status
Wo dein Code lebt
Kein Geheimnis. Hier ist genau, was mit deinem Code passiert, wenn du ein Repo verbindest.
Metal-Server, US East
Bare-Metal-Maschinen in Ashburn, optimiert für Indexierungs-Durchsatz statt unruhiger General-Purpose-Instanzen.
Cloudflare Global CDN
API- und MCP-Antworten werden am Edge gecacht. Statische Assets werden aus dem globalen Netzwerk von Cloudflare ausgeliefert.
Mandantengetrennt pro Workspace
Jeder Workspace erhält mandantenbezogene Repository-Indizes über Pipeline und Datenbank hinweg. Wir nutzen Kundencode, um Code Intelligence bereitzustellen, nicht um Modelle zu trainieren oder Daten zu verkaufen.
In Singapur registriert
UT International PTE. LTD. Echte Jurisdiktion, echte Rechtspersönlichkeit.
Repo entfernen, Index entfernen
Trenne ein Repo, und Maguyva entfernt aktiven indexierten Quellcode, Embeddings und Graph-Daten aus dem Dienst. Verbleibende Backups laufen gemäß dem Aufbewahrungsplan ab.
EU oder AU gebraucht?
Zusätzliche Deployment-Regionen sind ein Gespräch für Kunden mit Residenzanforderungen.