İçeriğe geç
Tüm yazılar

ÜRÜN

Kimene: yapay zekâ iş gücünüz gerçek makinelere kavuştu. Şimdi bir kontrol düzlemi gerekiyor

5 dk okuma

2025, terminal ajanını sıradanlaştırdı: Claude Code, Codex CLI ve benzerleri artık gerçek makinelerde saatlerce koşuyor ve ekipler sessizce bunların filolarını işletiyor. Kimsenin yanında vermediği şey operasyon katmanı — hangi hesap neyi, hangi sunucuda çalıştırdı, o rota neden seçildi ve bittiğini kim söylüyor. Kimene o katman: havuzlanmış hesap, model ve makineler; değiştirilemez karar kaydı; kanıta bağlı tamamlanma ve kapattığınız her şeye dayanan tmux oturumları.

2025, kod ajanının terminale taşınıp oraya yerleştiği yıldı. Claude Code, OpenAI’ın Codex CLI’ı, Gemini CLI ve benzerleri “modele soru sor”u “ajana görev ver”e çevirdi ve görev artık sohbet penceresine sığmıyordu: gerçek depolar, gerçek test takımları, saatlerle ölçülen koşular. Ekipler fark etti ve doğal olanı yaptı — çoğalttılar. Bir ajan birkaç ajana, birkaç sağlayıcı hesabına, birkaç makineye dönüştü; farklı işe farklı model. Yani 2025’in bir yerinde, manşete çıkmadan, kurumlar bir iş gücü edindi. Edinmedikleri şey, bir iş gücünün normalde beraberinde geldiği her şey: organizasyon şeması, görevlendirme mantığı, tamamlanma standardı, denetim izi. İş, o an el altındaki hesabın altında, uyanık olan makinede koşuyor; “bitti” ise ajanın en son yazdırdığı cümle. 2026’nın ilginç sorusu ajanın işi yapıp yapamayacağı değil. Şu: işi hangi hesap, hangi model, hangi makine yaptı — buna kim, hangi gerekçeyle karar verdi ve bittiğini kim söylüyor?

Organizasyon şeması olmayan bir iş gücü

Bir filoyu bir ay işletin; boşluklar kendiliğinden bir listeye dizilir. Bağlar fosilleşir: bir zamanlar bir projeyi çalıştırmış hesap “projenin hesabı” olur, kimsenin dokunmaya cesaret edemediği bir yapılandırmaya kaynar — bir yanda kapasite boş dururken öbür yanda kuyruk büyür. Dört ayrı şey — sağlayıcı kapasitesi, eşzamanlılık politikası, kaynak kiralaması, öncelik — tek bir “kota” kelimesine sıkıştırılır ve o günden sonra kimse hangi sınıra çarptığını bilemez. Yönlendirme yapılır, çünkü hesabı ve modeli her zaman bir şey seçer; ama örtük yapılır — bu koşu neden o hesaptan geçti diye sorduğunuzda dürüst cevap, “yapay zekâ öyle seçti” diye yazıya dökülmüş bir omuz silkmedir. Durum öz-bildirimdir: işi yapan işçi, kendi notunu da kendisi yazar. Bu listenin güvenlik sürümünü zaten yazmıştık: eylüldeki ajan-saldırganlar yazısında, aracısız erişimi olan bir ajanın kime çalışırsa çalışsın bir tedarik zinciri aktörü olduğunu savunduk. Operasyonel sürüm daha sessiz ama aynı biçimde — hesabı verilemeyen bir iş gücü, hiçbir şey ters gitmese bile bir yükümlülüktür; çünkü bir iş gücünün var olma sebebi olan soruları cevaplayamazsınız.

Bittiğini kim söylüyor? · iki durum makinesi

Öz-bildirim: işçi kendi notunu veriyor

@agent — “bitti, bütün testler yeşil” (kendi sözü)
kim doğruluyor ajanın kendisi
API’den durum yazımı token’ı olan herkese açık
kayıt tutulduysa bir sohbet dökümü
durum değil, iddia

Kanıt kapısı: durum, kanıt istiyor

görev türü: kod değişikliği → sözleşme: inceleme + geçen koşu
kim doğruluyor tasarım gereği inceleme ya da onay
API’den durum yazımı doğrudan yol yok
kayıt kanıtı ekli, değiştirilemez
bitti = kanıtlandı
METR’in rastgele atamalı deneyinde deneyimli geliştiriciler yapay zekânın kendilerini ~%20 hızlandırdığına inanıyordu — ölçüm %19 yavaşladıklarını söyledi. Öz-bildirim yanıltır; insan da makine de. “Bitti” ilan edilmez, hak edilir.
Aynı bitmiş görev, iki durum makinesi altında — ve METR’in rahatsız edici dipnotu: “hızlandık” hissi ile “yavaşladılar” ölçümü aynı geliştiricilerden geldi.

“Yapay zekâ öyle seçti” bir açıklama değildir

Kimene’nin ilk disiplini şu: görevlendirme bir karardır ve kararlar yazılır. Ham madde havuzlardır: hesaplar, modeller, sunucular, projeler, roller ve araçlar, aralarında kalıcı bağ olmadan yan yana durur — projeye sabitlenmiş hesap yok, hesaba kaynatılmış model yok. Eşleşme yürütme anında kurulur, o tek koşu için geçerlidir ve kayda geçer. Eşleştirme iki dürüst aşamadır: önce sert uygunluk — eşzamanlılık sınırındaki hesap, çevrimdışı sunucu, o hesapta bulunmayan model, her biri gerekçe koduyla elenir — sonra kalanlar üzerinde ağırlıklı puanlama: doğrulanmış model, sağlayıcı kapasitesi, yetenek eşleşmesi, oturum sürekliliği, yerellik, tercih; eksi, hız sınırına yakınlık gibi cezalar. Seçilen rota da elenen her aday da bileşen bileşen değiştirilemez bir kayda yazılır: toplam = bileşenler eksi cezalar; üçüncü bir yol yok. Rota simülatörü aynı puanlamayı varsayımsal girdilerle yeniden oynatır — o sunucu düşseydi ne olurdu — böylece cevap tahmin değil, hesaptır. Bunların hiçbiri seçimi sihirle akıllandırmaz. Seçimi savunulabilir, geri döndürülebilir ve denetlenebilir kılar — bir operasyon katmanını piyangodan ayıran da budur.

“Bitti” bir iddiadır. Kanıt bir olgudur

İkinci disiplin, ajan operasyonlarının en hassas yerine dokunur: işin bittiğini kim söylüyor. Öz-bildirim sorunu varsayımsal değil; makinelere özgü bile değil. METR’in geçen yılki rastgele atamalı deneyinde, yapay zekâ desteği kullanan deneyimli açık kaynak geliştiricileri kendilerini yaklaşık %20 hızlanmış sanıyordu; ölçüm %19 yavaşladıklarını söyledi. İnsanın öz-algısı kırk puan şaşıyorsa, kendi ödevine not veren bir ajan bir durum sistemi değildir — bir umuttur. Kimene’nin cevabı yapısaldır: bir görev yalnızca inceleme ya da onay üzerinden tamamlanır; kanıt sözleşmesi görev türünün kendisinden gelir — bir kod değişikliği, kendinden emin bir cümle değil, inceleme ve geçen bir koşu ister — ve API’de durumu doğrudan yazacak bir yol yoktur. Kimlik bilgileri de aynı sınır muamelesini görür: kontrol düzlemi kimlik bilgisi gövdesi tutmaz, makineler arasında taşımaz; yalnızca yolları ve referansları bilir, sağlayıcı yalıtımı süreç ortamıyla kurulur. Her şeye karar veren düzlem, herkesin endişelendiği o tek şeyi sızdıramayacak biçimde inşa edilmiştir.

Kimene nerede duruyor

Kimene bizim yapay zekâ iş gücü kontrol düzlemimiz ve en kolay küçümsenen yanı, en dibe kadar gerçek olması. Her oturum gerçek bir sunucuda, sağlayıcının kendi komut satırı aracıyla, o makinedeki düğüm ajanının başlattığı bir tmux oturumunun içinde koşar — kontrol düzlemi hiçbir sağlayıcı CLI’ına doğrudan konuşmaz. Kesintileri zararsız kılan bu dolaylılıktır: tarayıcıyı kapatın, sunucuyu dağıtın, SSH’ı düşürün — oturum ayakta kalır, ekran bıraktığınız yerden yeniden çizilir ve gönderdiğiniz her tuş tam olarak bir kez uygulanır. Duvar, filoyu yan yana gösterir — bir döşeme yazıyor, biri onay bekliyor, biri bitmiş — ve operatör istediği anda klavyeyi devralır; çünkü gözetimli olmak, ortada olmamak demek değildir. Kendi altyapınızda, kendi sağlayıcı hesaplarınızla çalışır ve ODTÜ Teknokent’teki mühendislik ekibimizce Go, React ve tmux ile geliştirilir — bu sitenin her yerde anlattığı platform inancının, yapay zekânın fiilen iş yaptığı katmana uygulanmış hâli.

  • Ayrı havuzlar — hesap, model, sunucu, proje, rol — yalnız çalışma anında ve kayıtla eşleşir
  • Değiştirilemez rota kararları: puan bileşenleri, cezalar ve gerekçesiyle her eleme
  • Gerçek yürütme: sağlayıcıların kendi CLI’ları; tarayıcı, dağıtım ve SSH kopmalarına dayanan tmux oturumları
  • Tamamlanma yalnızca inceleme ya da onayla — API’de durumu doğrudan yazan yol yok
  • Kontrol düzleminde kimlik bilgisi gövdesi yok; kendi makinelerinizde, kendi kurulumunuz
Yazıya geçmiş tek bir rota kararı: altı bileşen, cezalar, toplam — seçilen hesap halkalı, elenenler gerekçe kodlarıyla.

Neyi iddia etmeyeceğiz

Üç dürüst sınır. Birincisi, Kimene ajanlarınızı akıllandırmaz. Kontrol düzlemi işi yönetir; işi yapan modeli iyileştirmez. Ajan kötü kod yazarsa Kimene’nin katkısı, bunu üretimde değil incelemede — koşu, rota ve kayıt önünüzdeyken — öğrenmenizdir. İkincisi, Kimene sağlayıcı sınırlarını dolaşmanın bir yolu değildir ve bunu ürünün kendisi kadar açık söylüyoruz: operatörün kendi güvendiği profillerini yönetir; kimlik bilgisi paylaşan bir servis değildir, çok kiracılı bir vekil değildir ve sağlayıcıların kullanım koşullarına uymak operatörün sorumluluğudur. Karar kaydı, kullanımınızı daha az görünür değil, daha hesap verebilir kılmak için vardır. Üçüncüsü, kendi sunucunuzda demek kendi işletmeniz demek: düzlem sizin makinelerinizde yaşar; çalışırlık, yedekleme ve yamalama da onunla birlikte yaşar — Talky için tarif ettiğimiz takasın aynısı, aynı sebeple söylenmiş. Kimene genç bir ürün ve self-servis deneme yerine demo üzerinden satılıyor; çünkü filolar birbirine benzemez ve dürüst kapsam çıkarma, kayıt formunu döver.

“Yapay zekâ öyle seçti” bir açıklama değildir. Tek rota, tek karar, tek kayıt — ve “bitti”, ancak kanıt öyle dediğinde.

Türkiye’deki ekipler için bu, yıl boyunca kurduğumuz bir savın operasyonel yarısı. Haziranda ajanların araçlara yönetilen bir katmandan ulaşması gerektiğini, eylülde saldırgan makine temposunda çalışırken hendeğin yol olduğunu savunduk — KVKK’nın 12. maddesi ile 7545 sayılı Siber Güvenlik Kanunu da tam bu tür yüzeyler üzerinde kontrol gösterebilmenizi zaten bekliyor. Qevron yapay zekânızın neyi çağırdığını yönetir; Kimene ne yaptığını: kim çalışıyor, nerede, kimin hesabıyla, hangi tamamlanma kanıtıyla — hepsi kendi çevrenizin içinde, çünkü kontrol düzlemi de inşa ettiğimiz her şey gibi kendi sunucunuzda çalışır. Filonuz zaten var; tek soru, kararlarının yazılıp yazılmadığı. Ankara’da, ODTÜ Teknokent’te geliştiriliyor — Arpanet Bilişim A.Ş.’den. Demo planlayın, birlikte kapsamını çıkaralım.