ücretsiz kurulum dokümanı

tek ajanın verdiği cevap kulağa mantıklı geliyor, doğru olduğunu bilmiyorsun.

claude code'ta beş rollü bir ajan takımı kurdum. dört rol birer teori savunuyor, matematikçi hiçbir teori savunmuyor ve elindeki veri dosyasındaki rakamla her teoriyi sınıyor. çürütülen rol ikinci turda çekiliyor, ayakta kalan teori cevabın oluyor.

dokümanı daha önce aldıysan

günlük sistemler mailine gelir. istediğin zaman abonelikten çıkabilirsin. gizlilik

ne işe yarıyor

elinde bir sonuç var ve sebebini bilmiyorsun. bir video beklenmedik şekilde yayıldı, bir ürün satmadı, bir mail açılmadı. kafanda dört beş açıklama dolaşıyor, hepsi kulağa mantıklı geliyor, hangisinin doğru olduğunu ayırt edemiyorsun.

tek bir ajana "sence neden böyle oldu" diye sorduğunda sana makul görünen bir cevap yazıyor. makul görünmek doğru olmakla aynı şey değil. bu sistem o cevabı bir hakeme sınattırıyor.

beş rol var. dördü birer teori savunuyor: pazarlamacı sonucu paketlemeye bağlıyor, editör işçiliğe, şüpheci dış etkene, psikolog izleyicinin niyetine. beşinci rol matematikçi ve hiçbir teori savunmuyor. onun tek işi veri dosyasındaki rakamla her teoriyi sınamak.

nasıl kullanıyorsun

terminal bilmene gerek yok. sistemi github'dan çekiyorsun, gerisi sohbette yürüyor.

çekmek için en kolay yol: claude code'u ya da codex'i açıp github.com/muhammedsevimli/sistemler/tree/main/ajan-takimi adresini ver ve "bunu bu klasöre kur" de. komut satırını biliyorsan npx degit tek satırla iner, istemezsen github'dan zip olarak indirirsin.

sonra o klasörde claude code'u ya da codex'i aç ve elindeki sonucu anlat: "geçen hafta paylaştığım kısa video bir günde 42 bin izlendi, önceki bölümler 5 binde kalıyordu, sebebini öğrenmek istiyorum" demen yeterli.

araç oradan devralıyor. soruyu netleştiriyor, hangi rakamlara ihtiyacı olduğunu madde madde yazıp senden istiyor. rakamları sohbete yazıyorsun, ekran görüntüsü atıyorsun ya da dışa aktardığın raporu veriyorsun. veri dosyasını araç kendisi yazıyor ve doğru okuduğundan emin olmak için sana gösteriyor. klasörlere, prompt dosyalarına ya da çıktı dosyalarına elle dokunmuyorsun.

nasıl çalışıyor

  1. rakamlar tek bir veri dosyasında toplanıyor. hiçbir rol o dosyada olmayan bir sayıyı kullanamıyor.
  2. beş ajan aynı anda açılıyor. her biri kendi bağlamında koşuyor, birbirinin içini görmüyor.
  3. birinci turda her rol teorisini yazıyor ve veriden iki üç rakam gösteriyor. matematikçi her teori için "veriyle uyumlu" ya da "veriyle çelişiyor" yazıyor, gerekçeyi hesapla veriyor.
  4. ikinci turda her rol diğerlerinin yazdıklarını okuyor. ikna olduysa ELENDİ yazıyor ve neden çekildiğini bir cümleyle söylüyor. ikna olmadıysa AYAKTA yazıp karşı kanıt getiriyor.
  5. ayakta kalan teori tek sayfalık rapora düşüyor ve sohbette özetleniyor.

matematikçi salt okunur araçlarla çalışıyor, hiçbir dosyaya yazmıyor. hakemin tartışmanın çıktısına dokunamaması bilerek böyle.

veri bir teoriyi sınamaya yetmiyorsa hakem "ayrıştırılamıyor" yazıyor ve o eksiği zayıf bir kanıta çevirmiyor. bu, sistemin en önemli davranışı.

gerçekten çalıştığının kanıtı

kurulduğu gün gerçek bir soruya koşturdum. bir kısa video serisinin bir bölümü, yayından bir gün sonra 85.064 görüntüleme aldı. aynı serinin bir önceki bölümü aynı kalıpla kurulmuştu ve 5,8 binde kalmıştı. soru: bu bölüm neden bu kadar yayıldı.

beş rol koştu, iki tur döndü, üç teori elendi.

editör elendi. iki bölümün kurgu ve ses ölçüleri neredeyse eşitti. müzik ile konuşma arası ayrım ikisinde de 22,0 lu, miks -16,0 ve -16,3 lufs, tam siyah kare sıfır. sabit kalan bir değişken 14,7 katlık farkı üretemez.

şüpheci elendi. takipçi olmayan oranı yüzde 95,9. takipçi olan tekil izleyici 67.051 × 0,041 ≈ 2.749. bu kitlenin 67.051 tekil izleyiciyi taşıması için kişi başına 24 izleyici getirmesi gerekirdi, toplam paylaşım ise 1.150.

pazarlamacı kendi kararıyla çekildi. hakem bu teoriyi elemedi, "veriyle ayrıştırılamıyor" dedi: serinin başka bir bölümü aynı giriş biçimi olmadan 102 bin almıştı. ajan bunu görüp teorisini geri çekti.

psikolog ayakta kaldı. kaydetme 3.721, beğeninin (1.100) 3,38 katı. yorum 2.927, beğeninin 2,66 katı. 8.919 etkileşimin 6.648'i, yani yüzde 74,5'i kaydetme ve yorum. beğeni duyguyu ölçüyor, kaydetme ve yorum niyeti ölçüyor.

koşu beş ajan, iki tur, yaklaşık dört dakika ve yaklaşık 570 bin token sürdü. beş ajan aynı anda koştuğu için maliyet tek ajanın yaklaşık beş katına çıkıyor. üç ajanla başlamanı öneririm, iki teori artı hakem.

test edilmeyenleri de yazdım: iki teorinin birden ayakta kaldığı senaryo bu koşuda çıkmadı, hiçbir ajan rakam uydurmaya kalkışmadığı için tur bir kapısındaki düzeltme mekanizması tetiklenmedi ve farklı model kademeleriyle karışık kurulum denenmedi.

kodun tamamı açık: github.com/muhammedsevimli/sistemler

teslim

yukarıya e-postanı bırak. adım adım kurulum dokümanını hem buradan hem mailinden açarsın. beş rol dosyası ve dört hazır senaryo (video neden yayıldı, ürün neden satmadı, mail neden açılmadı, reklam neden tıklanmadı) içinde hazır. kurarken takıldığın yeri yaz, bakarım.