-
Notifications
You must be signed in to change notification settings - Fork 0
Vibe Coder Icin Deger
Reponun aklı şudur: sen "ne" istediğini söylersin (vibe), Divan "nasıl"ı kıdemli mühendis disipliniyle uygular. Kurulum öncesi ve sonrası fark:
| Durum | Divan'sız ajan | Divan'lı ajan |
|---|---|---|
| "Şu uygulamayı yap" | Doğrudan kod yazar, yarısı çalışmaz |
/ferman → önce plan, sonra TDD ile inşa, kanıtla teslim |
| Hata çıktı | Rastgele dener, semptomu yamar | systematic-debugging: 4 fazlı kök-neden analizi |
| Arayüz istedin | Jenerik "AI slop" tasarım | frontend-design + ui-ux-pro-max: özgün estetik yön |
| "Bitti" dedi | Sözüne inanmak zorundasın | verification-before-completion: test çıktısı göstermeden bitti diyemez |
| Fikrin dağınık | Ne sorduğunu unutuyor | brainstorming: seçenekleri tartıp gerekçeli seçer |
| İş büyüdü | Her şeyi aynı bağlamda karıştırır |
/sefer: tek oturum, sınırları belirli subagent veya izole worktree arasından en küçüğünü seçer |
| Repo yabancı | Her dosyayı okuyup bağlamı doldurur | arama-ustası: dar rg, gerekirse doğrulanmış AST araması ve dosya:satır kanıtı |
| Oturum uzadı | Eski loglar hedefi boğar | bağlam-muhafızı: hedefi/hataları korur, tekrarları dışarı alır, ölçemediği kazancı uydurmaz |
| Kaynak listesi geldi | Popüler olan her şeyi kurar | kaynak-küratörü: kimlik, lisans, köken, risk ve çakışma kapıları |
| PR açıldı | “Bitti” deyip merge'i sana bırakır | Yayın Kanunu: CHANGELOG + hazır PR + main + canlı doğrulama |
| Nereden başlayacağını bilmiyorsun | Skill kataloğunda kaybolursun | Beş niyetli seçici: en küçük paket + kopyalanabilir ferman + teslim akışı |
| “Bu skill daha iyi” dendi | Söze veya demo çıktısına güvenirsin | Aynı promptlu baseline/skill koşusu + A/B körleme + opsiyonel hakem/eşik |
Somut bir gün: sabah /ferman kullanıcı girişi ekle dersin — ajan planı
yazar, testleri önce yazar, kodu geçirir, tarayıcıda dener (webapp-testing =
Playwright), kanıtı gösterir, sonraki adımları önerir. Sen kahveni içersin.
Birden çok bağımsız parça varsa /sefer kullanırsın. Divan sırf “çok ajanlı”
görünmek için swarm kurmaz; çakışan yazımı ayırır, maliyet sınırı koyar ve
birleşik sonucu yeniden test eder.
Yeni vezirler de yalnızca “iyi prompt” oldukları için kabul edilmez. Eval
sözleşmesi gerçek kullanım örneklerini, beklenen çıktıyı ve nesnel beklentileri
tanımlar. python evals/run.py --check mevcut 4 özgün skill'deki 13 vakayı
denetler; gerçek adaptör verildiğinde aynı girdiyi baseline ve skill koşullarında
çalıştırıp kör A/B kanıtı üretir. Gerçek koşu yoksa başarı yüzdesi de yoktur.
Bağlam neden yönetilebilir kalır? Agent Skills aşamalı yüklenir: boşta yalnızca ad+açıklama; gövde ancak tetiklenince, ayrıntılı kaynaklar gerektiğinde okunur. Gerçek token maliyeti istemciye ve etkin skill'lere bağlıdır; ölçülmeden sabit tasarruf yüzdesi veya token sayısı iddia edilmez.