> methodology.md
Miten mittaamme
Tämä sivu on kirjaimellisesti paikka, jossa kerrotaan, miten Maguyva perustelee laatu- ja kustannusväitteensä todellisella datalla. Sivu sisältää vain faktoja: mitä mittaamme, miten pisteytämme sen ja mitä emme väitä auditoineemme.
Voimassa 17. heinäkuuta 2026 alkaen. Täällä ei keksitä uusia auditoimattomia vertailuarvoja. Nykyiset luvut löytyvät tuotepinnoilta, jotka regeneroituvat lähdedatasta; tämä sivu selittää mittausmallin.
Tämä on tekoälyavusteinen käännös, joka tarjotaan käyttömukavuuden vuoksi. Virallinen englanninkielinen versio on ainoa sitova versio — kaikkia rekisteröitymisen yhteydessä syntyviä sopimuksia säätelee englanninkielinen teksti. Lue virallinen englanninkielinen versio
tl;dr — Laatuväitteet nojaavat fixture-julkaisuportteihin ja moniulotteisiin language-audit-tauluihin — ei yhteen ainoaan “100 %:n tarkkuuden” todisteeseen. Vihreä fixtureissa ei ole sama asia kuin riippumattomasti todennettu, oikein tehty extraktio. Kustannusväitteet ovat workspace-hinnoittelun matematiikkaa ja julkista läpinäkyvyyttä toimintakustannuksista, ei kolmannen osapuolen riippumaton kilpailuauditointi.
1. Miksi tämä sivu on olemassa
Skeptisten ostajien ei pitäisi joutua reverse-engineeraamaan markkinointitekstiä. Maguyva indeksoi repositoryjä ja näyttää tarkkuus-, kielikattavuus- ja kustannusväitteitä koko sivustolla. Nämä väitteet tarvitsevat menetelmäsivun, joka on rehellinen mittausalueesta: mikä on fixture-tuettua, mikä on arviointiin perustuvaa ja mikä on framingia riippumattoman sertifioinnin sijaan.
2. Mitä mittaamme
Koodiälyn laatua mitataan ensisijaisesti language enginessä — symbolien, suhteiden ja graafien extraktiossa lähdekoodista — ei subjektiivisilla “agent happiness” -pisteillä.
- Kielikohtaiset fixture-sarjat: odotetut edget ja symbolit, jotka handlerin täytyy extraktoida oikein
- Release gatet: kielet julkaistaan vasta, kun fixture-tarkkuus, recall ja F1 ylittävät julkaistut kynnysarvot (tarkkuus ≥ 0,95, recall ≥ 0,99, F1 ≥ 0,97 fixtureissa, minimimäärä edgejä tilastollista luotettavuutta varten)
- Language-audit-ulottuvuudet: tarkkuus, rakenteellinen eheys, kattavuus, laatu ja suorituskyky validointitaulussa
- Corpus- ja pistotarkastussilmukat: näytteistetyt edget oikeista repositoryistä, luokiteltuina rubriikin mukaan (oikein, false positive, tyyppi-/laajuus-/metadatavirhe) — kuvattu language-grind-blogijulkaisuissamme
- Product capability -liput: mitä palvelin ilmoittaa tukevansa (AST, locals, graafiextraktio) erillään katalogin koosta
Tärkeää: Fixturet validoidaan itse kirjoittamiamme fixtureita vasten. VIHREÄ tarkoittaa, että tunnetut tapaukset menevät läpi. Se ei automaattisesti tarkoita, että jokainen todellisen maailman idiomi extraktoituu puhtaasti. Tämä ero on tarkoituksellinen ja julkinen.
3. Vihreä vs. riippumattomasti todennettu
Language-audit-taulu käyttää useita akseleita, joten yhtä vihreää valoa ei voi tulkita “todistetusti täydelliseksi.” Taulun pääluvut jaetaan yleensä näin:
- overall_green — regressiopuhdas self-snapshot-fixtureita ja niihin liittyviä corpus gateja vasten (tarpeellinen, mutta ei riittävä)
- independently_verified — sisältää vahvan arviointisignaalin, kuten pistotarkastussiemenen (mukana kielet, joissa on yhä arvioituja virheitä)
- verified_clean / nolla arvioitua virhettä näytteistetyissä edgeissä — tiukempi osajoukko arvioiduista kielistä
- curation / oracle trust — kohdellaanko fixtureita itseään luotettuina oracleina
- structural flags — graafiextraktio ja AST-kyvykkyys eivät ole sama asia kuin katalogijäsenyys
Markkinoinnin kielimäärä (esimerkiksi “279+ kieltä”) on katalogin koko: konfiguroidut kielet ja palvelinmerkinnät. Katalogin koko ei ole AST-laadun SLA. Suosimme tasoitettua raportointia yhden ylpeilyluvun sijaan. Nykyisen tuotepinnan osalta katso Compatibility ja Language Guides; kerronnallisia yksityiskohtia varten katso blogin kirjoitus kielten rekursiivisesta itseparannuksesta.
4. Haun ja retrievalin laatu
Semanttisen haun laatu on monimodaalinen: teksti, AST, graafi ja embeddingit yhdistetään. Dokumentoimme tietoisia insinöörikompromisseja sen sijaan, että väittäisimme retrievalia voittamattomaksi:
- Embeddingit käyttävät kaupallista malliperhettä (voyage-4-large kesäkuun 2026 blogitilannekuvan mukaan), valittu julkisten retrieval-ranking-listojen perusteella päätöshetkellä
- Vektorit on binäärikvantisoitu tallennusta ja kustannuksia varten; tämä vaihtaa tietoisesti hieman retrieval-tarkkuutta halvempaan ja nopeampaan Hamming-hakuun ilman erillistä vektoritietokantaa
- Intent routing ja fusion weights ovat suunniteltuja heuristiikkoja, joilla on mitattuja operatiivisia vaikutuksia (esimerkiksi alhaisempi nollatulosten osuus intent routingin jälkeen), ei julkaistu riippumaton IR-arviointisarja asiakaskorpuksilla
- Blogijulkaisut sisältävät osiot “mikä on yhä epätäydellistä” — epätäydelliset signaalit ovat osa tallennetta, eivät piiloteltuja alaviitteitä
5. Kustannusväitteet
Maguyva:n kustannuskieli kertoo hinnoittelurakenteesta ja toiminnan läpinäkyvyydestä, ei kolmannen osapuolen sertifioimasta virallisesta TCO-tutkimuksesta.
- Workspace-hinnoittelu: laskutus perustuu repositoryihin, indeksoituihin riveihin ja rebuild-tiheyteen — ei ihmis- tai agenttipaikkoihin. FAQ ja suunnitelmateksti selittävät ulottuvuudet.
- “Noin 10–30x vähemmän” -tyyliset vertailut Pricing-sivulla ovat havainnollistavaa matematiikkaa tyypillisiä per-paikka-hintahaarukoita vasten, riippuen siitä, mihin per-paikka-hinnoiteltuun työkaluun vertaat. Ne eivät ole lukittu, riippumaton kilpailubenchmark-paketti.
- Toimintakustannusten rehellisyys: /team-sivu julkaisee todellisen kuukausittaisen ohjelmistokustannusten erittelyn (tilaukset, MCP-/hakutyökalut, käyttöpohjaiset kustannukset). Se on customer-zero-läpinäkyvyyttä, ei auditoitu tilinpäätös.
- Embedding- ja infrakustannukset ovat hyväksyttyjä tuotekustannuksia (premium-embeddingit, tallennustila, graafien rebuildit). Maksamme ne tarkoituksella ja kerromme siitä voyage-4-large-julkaisussa ja hinnoittelukertomuksessa.
6. Mitä emme väitä
Tämä sivu on myös lista ei-väitteistä. Jos jokin ei ole mittaustaululla, älä pidä markkinointisävyä todisteena.
- Ei yleistä absoluuttisen tarkkuuden takuuta jokaiselle kielelle. Fixture-kynnysarvot koskevat kutakin kieltä tunnetuissa tapauksissa; jäännösvirheitä todellisessa maailmassa odotetaan, ja ne ovat pohjautuvia.
- Ei väitettä, että overall_green vastaisi tuotantotasoisen täydellistä extraktiota jokaiselle repository-idiomille
- Ei kolmannen osapuolen compliance-sertifiointipakettia, jota väitettäisiin menetelmäartefaktiksi tällä sivulla (katso Security tietojenkäsittelyn faktoja varten, ei compliance-merkkejä)
- Ei riippumatonta usean toimittajan bake-offia jaetuilla korpuksilla julkaistuna pysyvänä tuloskorttina
- Hakutulokset ja analyysit pysyvät best-effort-tasoisina Terms of Servicen mukaisesti — Maguyva ei korvaa koodikatselmointia, testausta tai tietoturva-auditointeja
7. Miten voit todentaa itse
Ostajan odotettu liike on yhä tämä: indeksoi repo, jonka jo ymmärrät, esitä yksi oikea kysymys ja tarkasta viittaukset.
- Aloita ilmaiseksi: pienet edustavat repot voittavat koko yrityksen indeksin ensimmäisenä päivänä
- Käytä MCP-työkaluja (intelligent_search, find_symbol, dependency_search) ja avaa viitatut polut
- Lue How It Works ingestion- ja retrieval-arkkitehtuurista
- Lue Compatibility ja Language Guides kyvykkyystasoista, ei vain katalogin koosta
- Lue Security ja Privacy tietojenkäsittelystä; tämä sivu ei korvaa niitä