Ana Sayfa
>
İçerikler
>
Ölçeklenen ajan değil, gözlem aracın

Ölçeklenen ajan değil, gözlem aracın

August 31, 2026
3
DK OKUMA
Brick Institute
Brick Institute
Ekip

Bir uygulamacı dörtten fazla eşzamanlı ajan oturumunda kaybolduğunu yazdı; bir başkası 50 oturum çalıştırdığını söyleyip cevap verdi. İkinci cevabın içinde asıl bilgi var: yarım yıldır yazdığı kendi kontrol katmanı.

Yarım düzine ajan arayüzü denedikten sonra geriye kalan cümle şu: dörtten fazla oturumda kayboluyorum.

OpenRouter'da çalışan Jacky, hafta sonu X'te basit bir gözlem paylaştı. Slack, Devin, Conductor, Warp, Claude Code — hepsini denemiş. Vardığı yer, çok sayıda ajan oturumuyla çalışırken kimsenin arayüz tarafını çözmemiş olması.

Jacky'nin tweet'i: yarım düzine ajan arayüzü denedikten sonra dörtten fazla eşzamanlı oturumda hâlâ kaybolduğunu, bunun çözülmemiş bir problem olduğunu yazıyor
“Dörtten fazlasıyla çalışırken hâlâ kayboluyorum.” Kaynak: @jjacky, 30 Ağustos 2026.

Altına gelen cevaplar tartışmayı ikiye böldü. Bir taraf araç önerdi, bir taraf sınırın nerede olduğunu tartıştı. İlginç olan ikincisi.

Hâkim okuma: sınır modelde

Yaygın kabul şöyle: daha çok ajan çalıştırmak daha çok iş demek, tavanı da modelin kapasitesi belirliyor. Bu okuma araç dilinin içine yerleşmiş durumda — paralel oturum sayısı bir kapasite göstergesi gibi sunuluyor, limit artışları da müjde olarak duyuruluyor.

Mantığı basit: bir ajan bir iş yapıyorsa, on ajan on iş yapar. Darboğaz da ajanın ne kadar iyi olduğudur.

Karşı cephe: sınır insanda

Jacky'nin cümlesi tam buna itiraz ediyor. Ajanlar çalışıyor; izleyemeyen sensin. Dörtten sonra hangi oturumun nerede olduğunu, hangisinin saptığını, hangisinin cevap beklediğini takip edemiyorsun.

Aynı thread'de bunun tam tersini yaşayan biri çıktı. Nate, güvenle 50'ye kadar eşzamanlı oturum çalıştırdığını, günlük ortalamasının 20 olduğunu yazdı. İlk bakışta Jacky'yi çürütüyor.

Nate'in cevabı: yaklaşık yarım yıldır kendi kontrolcüsü üzerinde çalıştığını, artık 50'ye kadar eşzamanlı oturumu güvenle çalıştırdığını, günlük ortalamasının 20 olduğunu ve ileride açık kaynak yapmayı planladığını yazıyor
Aynı thread'den karşı örnek — ve içindeki asıl bilgi. Kaynak: @natebirdman, 30 Ağustos 2026.

Detaya bakınca çürütmüyor, doğruluyor. O rakamın arkasında yarım yıldır yazdığı kendi kontrol katmanı var — ve kendi ifadesiyle hâlâ üzerinde çalışıyor.

Sınır modelde diyen taraf
  • Daha iyi model, daha çok paralel iş
  • Çözüm bir sonraki sürümde
  • Metrik: kaç oturum açabiliyorsun
Sınır takipte diyen taraf
  • Model zaten yeterli, sen yetişemiyorsun
  • Çözüm arayüzde ve iş akışında
  • Metrik: kaç oturumu gerçekten okuyorsun

Üçüncü okuma: ikisi de aynı şeyi söylüyor

Nate'in aynı günlerde paylaştığı diğer notlar bu okumayı somutluyor. Her oturuma bir “sidecar” özetleyici bağlamış; bunlar her turda dört-beş kelimelik durum özeti üretiyor ve oturumlara “watching ci” gibi dinamik etiketler basıyor. Gelen mesajları kuyruğa alan bir throttle yazmış. Yönetici ajanların yüzlerce küçük bildirimle boğulmasını engellemek için bildirimi push'tan pull'a çeviren bir çalışma biçimi kurmuş.

Bu listede tek bir model iyileştirmesi yok. Hepsi arayüz, özet ve dikkat yönetimi. Yani Nate 50 oturuma modelin izin verdiği için değil, kendine bir gözlem aracı yazdığı için çıkabiliyor.

Ölçeklenen şey ajan değil, senin gözlem aracın.

Üç aşamalı akış: 1-2 oturumda hem çalıştırıp hem okuyorsun, 3-4 oturumda pratik tavana geliyorsun, 20 ve üstünde kendi kontrol katmanın olmadan takip kopuyor
Sayı arttıkça katlanan şey iş değil, takip yükü.
Kaynağın sınırı

Buradaki eşikler ölçüm değil, iki uygulayıcının kendi beyanı. “Dört” evrensel bir sınır değil; işin türüne, oturumların ne kadar bağımsız olduğuna ve kişinin çalışma biçimine göre değişir. Nate'in kontrol katmanı da henüz açık kaynak değil, yani kimse dışarıdan inceleyemedi. Yönü ciddiye al, rakamı ezberleme.

Bizim duruşumuz

Yanlış soruyu iyi cevaplıyoruz

Tartışma ajanın yeteneğinde sıkışmış durumda: hangi model daha iyi, kaç paralel oturum açabiliyorum. Oysa iki taraf da aynı yere işaret ediyor — darboğaz arayüzde ve dikkatte.

Bunun ekip için pratik karşılığı var. Ajan sayısı bir kapasite metriği değil; kimsenin okumadığı bir çıktı üretilmemiş sayılır. Hatta üretilmemişten kötüdür, çünkü review kuyruğuna girer ve birinin zamanını alır. Soru “kaç ajan çalıştırıyoruz” değil, “kaçının çıktısını gerçekten okuyoruz”.

Kapsam da genişliyor. Anthropic geçen hafta, ajanların fiziksel cihazları keşfedip kontrol etmesi için Model Hardware Standard'ı araştırma önizlemesine açtı. Ajan yazılımın dışına çıktıkça “ne yaptığını nereden anlayacağım” sorusu kolaylaşmıyor, zorlaşıyor. Gözlem aracı bugün eksikse, yarın daha eksik olacak.

İpucu

Bu hafta ajan sayısını artırmak yerine bir hafta boyunca iki sayıyı yan yana tut: kaç oturum başlattın, kaçının çıktısını baştan sona okudun. Aradaki fark senin gerçek kapasiten. Fark büyükse çözüm daha çok ajan değil — her oturumun ne yaptığını tek satırda söyleyen bir özet, bir durum etiketi ve “şu an neyi bekliyorum” listesi. Üçü de bir öğleden sonrada kurulur.

Sen kaç oturumdan sonra kayboluyorsun — ve o eşiği aşmak için ajanı mı değiştirdin, kendi takip biçimini mi? Bize kalırsa önümüzdeki bir yılın asıl aracı daha iyi bir ajan değil, ajanları izlenebilir kılan arayüz olacak. 🧱

Yaklaşan etkinlik

Alive Konf BAKU — Biletler Satışta

1-2 Ekim 2026
Hilton Baku
20+ konuşmacı, 2 gün
0
Gün
00
Saat
00
Dakika
Konular
design-2
product-2
ai-2
AI Ajanları
ai-agent
erisilebilirlik
arastirma-raporlari
pazarlama
liderlik
design
product
Yapay Zeka
ai

Diğer İçerikler

Tüm yazılar
Haftalık bülten

Canlı kalmanın haftalık dozu.

Tasarım, ürün ve yapay zekâdan seçtiğimiz en iyi okumalar — her cuma, posta kutunda.

E-posta
Teşekkürler! Kaydın alındı — ilk bülten cuma posta kutunda.
Bir şeyler ters gitti. Lütfen tekrar dene.