Lompat ke konten
cd /blog

Orkestra: Mengorkestrasi Agen AI dalam Skala Besar

[Arsitektur][Open Source]

> Satu orchestrator merutekan pekerjaan ke agen AI spesialis, masing-masing dengan skill dan memori yang berbeda. Bagaimana Orkestra mengoordinasikan 46 agen dan 466 skill di produksi.

Angka dalam tulisan ini mencerminkan sistem pada saat publikasi (Januari 2026). Lihat halaman tim kami untuk angka terkini.

Ketika kami mulai membangun dengan Claude Code, kami menemui sebuah masalah yang akhirnya dihadapi setiap tim yang menggunakan asisten coding AI: satu agen tidak bisa melakukan segalanya dengan baik.

Anda bisa mem-prompt sebuah agen menjadi spesialis database. Atau auditor keamanan. Atau engineer frontend. Tetapi begitu Anda memintanya menjadi ketiganya sekaligus, kualitasnya menurun. Konteksnya terdilusi. Instruksinya saling bertentangan. Agennya menjadi generalis yang biasa-biasa saja di segalanya.

Jadi kami membangun Orkestra.

Apa itu Orkestra?

Orkestra adalah sistem orkestrasi agen untuk Claude Code dan tool coding AI serupa. Ia mengoordinasikan banyak agen terspesialisasi, masing-masing dengan keahlian yang berbeda, di bawah satu orchestrator yang merutekan pekerjaan ke spesialis yang tepat.

Bayangkan ini seperti agensi staffing untuk agen AI. Orchestrator menerima sebuah task, mengidentifikasi spesialis mana yang seharusnya menanganinya, dan mendelegasikannya dengan konteks yang tepat. Ketika pekerjaannya selesai, hasilnya mengalir kembali ke orchestrator untuk disintesis.

Angka-angkanya bercerita banyak:

Komponen Jumlah
Agen spesialis 46
Skill yang dapat digunakan ulang 466
Arketipe identitas 27
Mindset 11
Gaya komunikasi 10
Domain pengetahuan 21

Sistem Karakter: D&D untuk Agen

Wawasan inti di balik Orkestra adalah bahwa perilaku agen muncul dari tiga primitif yang bisa digabungkan:

Identity mendefinisikan apa agen ini. Seorang architect mendesain struktur sistem. Seorang debugger menelusuri kegagalan hingga akar penyebabnya. Seorang guardian menegakkan kepatuhan dan batas keamanan. Kami punya 27 arketipe identitas yang bisa dicampur.

Mindset mendefinisikan bagaimana agen berpikir. Sebuah mindset analitis menambatkan pernyataan pada bukti dan mengukur ketidakpastian. Sebuah mindset skeptis mempertanyakan asumsi dan mencari bukti yang membantah. Sebuah mindset eksploratif merangkul ambiguitas dan mencoba banyak pendekatan.

Style mendefinisikan bagaimana agen berkomunikasi. Gaya teknis menyertakan nilai persis dan merujuk file spesifik. Gaya ringkas memangkas basa-basi dan langsung ke jawaban. Gaya diplomatis menyeimbangkan kejujuran dengan kehalusan.

Sebuah agen menggabungkan primitif-primitif ini:

# architecture-advisor.yaml
identity:
  - knowledge-architect
  - architect
  - strategist
mindset: analytical
style: concise

Komposisi ini menciptakan sebuah agen yang mendesain sistem (architect), menghubungkan pengetahuan lintas domain (knowledge-architect), menetapkan arah strategis (strategist), berpikir dalam bukti dan data (analytical), dan berkomunikasi tanpa basa-basi (concise).

Kekuatannya ada pada ledakan kombinatorial. 27 identity dikali 11 mindset dikali 10 style menghasilkan hampir 3.000 kepribadian agen yang mungkin. Tetapi Anda hanya mendefinisikan kombinasi yang penting untuk pekerjaan Anda.

Skill: Modul Kapabilitas yang Dapat Digunakan Ulang

Skill adalah pengetahuan dan alur kerja yang bisa dipanggil oleh agen. Mereka mengikuti sistem bertingkat berdasarkan cakupan:

Tier Nama Cakupan Contoh
K0 Foundations Metodologi universal Disiplin test-first, penyelesaian berbasis bukti
K1 Identities Alur kerja berbasis peran Standar interface CLI, playbook performa
K2 Domains Pengetahuan spesifik domain Pola migrasi database, validasi autentikasi
K3 Stacks Spesifik teknologi Deployment Cloudflare, operasi Supabase
K4 Project Hanya basis kode ini Alur kerja dan konvensi khusus proyek

Skill dimuat secara lazy. Sebuah agen melihat nama dan deskripsi skill saat startup, tetapi konten skill lengkap baru dimuat saat dipicu. Ini menjaga konteks tetap ramping sembari membuat ratusan skill tetap bisa ditemukan.

Setiap skill mencakup:

  • Kondisi trigger yang jelas (“Gunakan saat memigrasikan skema database”)
  • Panduan langkah demi langkah
  • Tool yang diizinkan untuk alur kerja tersebut
  • Kriteria sukses dan jalur pemulihan kegagalan

466 skill dalam registry kami mencakup segalanya, dari isolasi git worktree hingga alur kerja riset web hingga validasi kesehatan deployment.

Mengapa Orkestrasi Itu Penting

Arsitektur agen tunggal cepat menabrak tembok:

Dilusi konteks. Jendela konteks 200 ribu token terdengar besar sampai Anda memuat skema database, dokumentasi API, fixture test, dan pengetahuan domain. Spesialis bisa bekerja dengan konteks yang ditargetkan.

Konflik instruksi. Meminta sebuah agen “teliti tapi cepat” dan “verifikasi segalanya tapi jangan over-engineer” menciptakan ketegangan. Spesialis menyelesaikan ini dengan memiliki cakupan yang jelas.

Kedalaman keahlian. Sebuah agen generalis tahu sedikit tentang segalanya. Sebuah agen spesialis, yang digabungkan dengan identity dan skill yang tepat, memahami domainnya secara mendalam.

Orkestra mengimplementasikan orkestrasi flat: satu orchestrator mengoordinasikan banyak spesialis. Spesialis tidak bisa menciptakan sub-spesialis. Ini mencegah ledakan kompleksitas sembari memungkinkan pekerjaan paralel.

Orchestrator punya akses ke 2,2 juta token kapasitas efektif: jendelanya sendiri 200 ribu ditambah 10 subagen konkuren dengan 200 ribu masing-masing. Pekerjaan yang akan menghabiskan satu agen berjalan dengan nyaman di seluruh armada.

Pipeline Rendering

Definisi agen hidup dalam YAML. Claude Code membaca Markdown. Orkestra menjembatani celah ini dengan pipeline rendering yang deterministik:

YAML Registries → Jinja Templates → .claude/agents/*.md

Operator mengedit sumber YAML. Jalankan orkestra sync. Markdown ter-render muncul di .claude/agents/. Claude Code mengambil perubahannya.

Pemisahan ini melayani audiens yang berbeda:

  • Sumber YAML mencakup metadata lifecycle, tag, aturan validasi, dan catatan deprecation untuk tooling
  • Markdown ter-render hanya mencakup apa yang dibutuhkan model: deskripsi, tool, skill, dan panduan perilaku

Pipeline-nya menggabungkan identity, mindset, style, dan skill menjadi satu prompt sistem yang koheren. Sebuah agen architect-analytical-concise mendapat prompt sistem yang sangat berbeda dari agen debugger-skeptical-technical, bahkan jika mereka berbagi beberapa skill dasar yang sama.

Pengetahuan Domain: Pola Empat File

Setiap domain pengetahuan mengikuti struktur yang konsisten:

domain-name/
  decisions.md      # Key choices, rationale, consequences
  patterns.md       # Step-by-step guidance and examples
  anti-patterns.md  # Failure modes and remediation
  evolution.md      # Dated log of changes

Struktur ini melayani pemuatan konteks agen. Sebuah agen yang bekerja pada autentikasi memuat authentication/patterns.md untuk panduan dan authentication/anti-patterns.md untuk menghindari jebakan yang sudah diketahui. File-filenya diukur untuk pemuatan konteks yang efisien: cukup fokus untuk berguna, cukup komprehensif untuk otoritatif.

Kami memelihara 21 domain tingkat-atas termasuk analitik, autentikasi, data science, infrastruktur, machine learning, performa, keamanan, dan lainnya. Setiap domain bisa punya sub-domain untuk granularitas yang lebih halus.

Values: Sistem Operasi

Semua agen berbagi lapisan values dasar yang mendefinisikan bagaimana mereka beroperasi:

Kesederhanaan lebih dulu. Gunakan solusi paling sederhana yang berhasil. Tambahkan kompleksitas hanya jika berdasar.

Perbaiki akar masalah. Jangan pernah menambal di sekitar kegagalan. Jika sebuah pipeline gagal, debug pipeline-nya. Jika sebuah test gagal, perbaiki kodenya atau test-nya.

Evidence-based. Berilah label pada klaim sebagai “terverifikasi” (dengan benchmark) atau “estimasi” (dengan asumsi). Pola terdeteksi tidak sama dengan masalah terkonfirmasi.

Context economics. Tool MCP menghabiskan 0,1% konteks. Pembacaan file menghabiskan 2% masing-masing. Terapkan keahlian domain sebelum menjelajahi kode.

Values ini merambat ke setiap spesialis lewat pipeline rendering. Sebuah agen tidak bisa melewatinya lewat komposisi.

CLI: Bidang Kendali

Orkestra dilengkapi CLI untuk mengelola ekosistem agen:

# Discovery
orkestra agents search "database"
orkestra agents info database-architect

# Validation
orkestra validate --show-warnings

# Rendering
orkestra sync --dry-run
orkestra sync

# Skills
orkestra skills list
orkestra skills info schema-migration-workflow

# Decisions
orkestra decisions search "authentication"

CLI ini adalah sumber kebenaran untuk agen apa yang ada, skill apa yang mereka miliki, dan apakah sistemnya sehat. Ia menjalankan validasi sebelum sync untuk menangkap masalah lebih awal.

Pertimbangan Open Source

Kami membangun Orkestra untuk memecahkan masalah kami sendiri: mengoordinasikan agen AI dalam skala besar untuk sebuah basis kode yang kompleks. Pola-pola yang kami temukan tidak spesifik untuk domain kami.

Sistem komposisi karakter (identity + mindset + style) berlaku untuk tim mana pun yang mendefinisikan kepribadian agen.

Sistem tier skill (K0-K4) menyediakan model mental untuk mengorganisasi kapabilitas yang bisa digunakan ulang berdasarkan cakupan.

Pola pipeline rendering (sumber YAML + template + artefak hasil generate) memisahkan kepentingan antara tooling dan konsumsi model.

Model orkestrasi flat (satu koordinator, banyak spesialis) menghindari kompleksitas sembari memungkinkan paralelisme.

Apakah Orkestra akan menjadi open source bergantung pada apakah pola-pola ini bernilai bagi orang lain yang membangun dengan Claude Code. Jika Anda menabrak tembok yang kami jelaskan, arsitektur ini mungkin bisa membantu.

Apa yang Kami Pelajari

Membangun Orkestra mengajarkan kami bahwa orkestrasi bukan soal membuat agen lebih pintar. Ini soal membuat mereka lebih fokus.

Satu agen dengan instruksi sempurna tetap kehabisan konteks. Satu agen dengan semua skill tetap kebingungan soal mana yang harus diterapkan. Satu agen yang mencoba menjadi segalanya menghasilkan hasil yang biasa-biasa saja di mana-mana.

Empat puluh spesialis, masing-masing unggul di domainnya, dikoordinasikan oleh sebuah orchestrator yang tahu kapan harus mendelegasikan: begitulah cara kami mengirimkan produk.

Angka-angkanya kurang penting dibandingkan arsitekturnya. Anda mungkin butuh lima agen atau lima puluh. Prinsipnya tetap sama: komposisi mengalahkan kapabilitas, spesialisasi mengalahkan generalisasi, koordinasi mengalahkan kepahlawanan individual.


Orkestra menggerakkan ekosistem agen di balik Maguyva, platform kecerdasan kode kami. Ingin tahu lebih lanjut? Hubungi tim kami.

Bacaan terkait

Lebih banyak dari build log Maguyva