Yapay Zeka Ajanınızın Kodunu Hala Gözden Geçirmeli Misiniz?

Ajanlarınız, bir zamanlar birleştirdiğiniz pull request'lerin yarısından daha iyi kod yazıyor. Peki, hala her satırı okur musunuz? Her iki taraf için dürüst bir durum, bir ajanın hata yaptığını gösteren 10 sinyal ve her değişikliğin gerçekten ne kadar gözden geçirilmesi gerektiği.

Tartışma her ekipte aynı şekilde başlar. Bir taraf, ajanların artık onayladığımız çekme isteklerinin yarısından daha temiz kod gönderdiğini, bu yüzden neden her satırı okumaya devam ettiğimizi sorar. Diğer taraf ise, onay verenlerin biz olduğunu söyler.

Her iki taraf da haklı. İşte tam da bu yüzden tartışma asla bitmez. Soru yanlış olduğu için bitmez ve soruyu düzelttiğinizde cevap neredeyse sıkıcı hale gelir.

Her Satırı Okumadan Gönderim Yapmanın Gerekçesi

En güçlü iyimser argümanla başlayın, çünkü bu, çoğu gözden geçirenin kabul ettiğinden daha güçlüdür.

Açık bir spesifikasyona ve bir test setine sahip bir görevde, modern bir kodlama ajanı, bir son tarih altında çalışan ortalama bir insandan daha tutarlı kod üretir. Hata yolunda sıkılmaz. Cuma günü saat 18:00'de null kontrolünü yazar. Verilen proje kurallarına her seferinde uyar, yorgun bir geliştiricinin kendine izin verdiği küçük sessiz isyanlar olmadan.

İnsan incelemesi, ajanlar gelmeden önce de zaten bozulmuştu. Gerçek bir ekipte çalışan herkes LGTM refleksini bilir: gözden geçirenin dikkati birkaç yüz satırdan sonra dağılır ve ardından gelen onaylar sosyal, teknik değil. Altın çağda titiz bir inceleme kaybetmedik. Zaten çoğunlukla tiyatro olan bir ritüeli kaybettik.

Sonra bir de hacim var. Paralel çalışan beş ajanı olan bir geliştirici, her saat başına okunabilir bir insanın dikkatlice okuyabileceğinden daha fazla fark üretir. Eğer kuralınız "her şeyi oku" ise, sessizce otomatikleştirdiğiniz darboğazı yeniden kurmuşsunuz demektir. 900 satırlık bir farkı gözden geçiren bir insan, bilgi üretmeden bir imza üretir ve bu, hiç inceleme yapmamaktan daha kötüdür, çünkü güvenilirlik üretir.

Farkta Bir İnsanı Tutmanın Gerekçesi

Şimdi diğer taraf, bu da tutkunların kabul ettiğinden daha güçlü.

Sorumluluk devredilemez. Model, sabah 3'te çağrılmaz. O, olay incelemesinde yoktur, verileri sızan müşteriyle konuşmaz ve değişikliğin sonuçlarını bir sonraki çeyreğe taşımaz. Birleştiren, sonucu sahiplenir ve inceleme, sahipliğin nasıl kullanıldığını belirten bir eylemdir, sadece ilan edilen değil.

Ajan gözden geçirenler, ajan yazarlarla aynı yönde başarısız olur. Bu, "başka bir ajanın incelemesine izin ver" önerisini gerçekten çözen argümandır. Aynı model ailesinden iki ajan, aynı bağlamda verildiğinde, ön yargıları paylaşır, eğitim verilerini paylaşır ve kör noktaları paylaşır. Hataları ilişkilidir. İkinci bir ajan, kaybolan bir testi veya ele alınmamış bir hatayı mutlu bir şekilde yakalar ve ilk başta hatayı üreten alanını yanlış anlama konusunda mutlu bir şekilde onay verir, çünkü aynı yanlış anlamayı yapmıştır. Aynı yönde yanlış olan iki gözden geçiren, bir inceleme oluşturmaz.

Ölçümler de pek iç açıcı değil. Sektör verileri, gözden geçirenlerin AI tarafından üretilen değişikliklerde, insan tarafından yazılanlardan anlamlı şekilde daha fazla tur değiştirdiğini gösteriyor: kod daha hızlı gelir ve güvenilir hale gelmesi daha uzun sürer. Ocak 2026'da yapılan bir çalışma daha ileri giderek, ajan tarafından üretilen değişikliklerin, insan tarafından yazılanlardan daha fazla fazlalık ve birikmiş teknik borç taşıdığını buldu; gözden geçirenler ise onaylamaktan daha iyi hissettiklerini bildiriyor. Kodun ne kadar iyi hissettirdiği ile ne kadar iyi olduğu arasındaki bu fark, bir cümledeki tüm riski ifade eder.

Tartışma Yanlış Çerçeveleniyor

İşte toplantıyı sona erdiren yeniden çerçeveleme.

Kodunuzu gözden geçirmiyorsunuz çünkü yazara güvenmiyorsunuz. Onu gözden geçiriyorsunuz çünkü onay veren sizsiniz. Bunlar tamamen farklı etkinliklerdir ve tüm tartışma bunları karıştırmaktan kaynaklanmaktadır.

Bunu böyle gördüğünüzde, "ajan bir insandan daha iyi mi" sorusu belirleyici bir soru olmaktan çıkar. Belirleyici soru şudur: bu değişiklik yanlışsa, bunu bulmanın maliyeti ne kadar ve geri almanın maliyeti ne kadar? Bir pazarlama başlığındaki yazım hatası birkaç saniyede keşfedilir ve birkaç saniyede geri alınır. Yetkilendirme ara katmanında tersine dönen bir izin kontrolü, bir müşteri veya bir düzenleyici tarafından keşfedilir ve asla gerçekten geri alınamaz, çünkü o noktada veriler zaten okunmuştur.

Yani cevap ne "her şeyi gözden geçir" ne de "ajanı güven"dir. Cevap:

Satırları gözden geçirmeyi bırakın. Riskleri gözden geçirmeye başlayın.

Somut olarak, inceleme işin ortasından iki sınırına kayar. Önce: planı okuyun, çünkü yanlış bir planın mükemmel bir şekilde uygulanması, en pahalı hata modudur ve bir plan on beş satırdır, dokuz yüz değil. Sonra: patlama alanına orantılı olarak farkı okuyun. Arada, satırlar makineye aittir.

"Ajan berbat etti" gerçekte nasıl görünür

Ekibinize geri getirebileceğiniz en yararlı şey bir görüş değil, nesnel işaretlerin bir listesidir. "Kod garip geliyor" değil, bir fark üzerinde bir dakikadan kısa sürede kontrol edebileceğiniz sinyaller. İşte yerlerini kazanmış olanlar.

  1. Testler, kapsadığı kodla aynı committe değişti. Yeşil, gözlemlenmedi, inşa edildi. Bu listedeki en yüksek sinyal işareti ve kontrol edilmesi gereken ilk şey budur.
  2. Bir doğrulama zayıflatıldı veya bir test devre dışı bırakıldı. Bir skip, bir only, yeni kodun döndürdüğü şeyi kabul etmek için genişletilmiş bir doğrulama, testin açığa çıkarması gereken hatayı yutan bir try/catch.
  3. Fark, görevden daha büyük. Hiç kimsenin istemediği dosyalar dokunuldu. Bir ajandaki kapsam kayması, heves değil, ajanın hedefi bir yerlerde yeniden yorumladığının işareti.
  4. İcat edilmiş bir yüzey. Var olmayan bir API yöntemi, bir yapılandırma seçeneği veya bir yol. Ajanın kafasında derlenir ve başka hiçbir yerde değil.
  5. Kod yerine ortam düzeltildi. Sabit kodlanmış bir mutlak yol, makineye özgü bir değer, kişisel bir token, bir kullanıcı adı. Belirti, ajanın makinesinde kayboldu ve diğerlerinin hepsine taşındı.
  6. İstenmeden bir bağımlılık ortaya çıktı. Yeni tedarik zinciri, yeni lisans, yeni bakım yüzeyi, bunu sürdürecek bir şey tarafından kararlaştırıldı.
  7. Yeniden kullanım yerine çoğaltma. Zaten yirmi satır uzakta var olan bir yardımcıyı yeniden uyguladı. Bu, ölçülen borcun arkasındaki mekanizmadır: her değişiklik yerel olarak makul görünür ve kod tabanı sessizce aynı şeyi yapmanın üçüncü bir yolunu kazanır.
  8. Özet, farkla eşleşmiyor. "Düzeltildi ve test edildi" oysa hiçbir test çalışmadı. Anlatım, işin gerçekleşip gerçekleşmediğine bakılmaksızın aynı güvenle üretilir, bu yüzden bunu doğrulamak için bir iddia olarak ele alın, asla bir rapor olarak değil.
  9. Talimatlar takip edilmemeye başlandı. Küçük kuralların sessizce bırakılması, bir oturumun başlamadan önce nasıl bozulduğunun işaretidir. Eğer bağlam dosyanızda bir kanarya kullanıyorsanız, bu tam olarak yakalamak için oradadır.
  10. Geçici olarak hassas bir alana dokunuldu. Bir .env okuma, yeni bir dış ağ çağrısı, kullanıcı verilerini taşıyan yeni bir günlük satırı, bir özelliğin içine yerleştirilmiş bir göç.

Listede olmayan şeylere dikkat edin: stil, isimlendirme, biçimlendirme, "ben farklı yapardım". Bunlar her zaman insan incelemesinin en zayıf kısmıydı ve şimdi gerçekten bir insanın israfıdır. Bunları incelemenizden silin ve yukarıdaki on madde için ihtiyaç duyduğunuz dikkati geri kazanırsınız.

Bir Değişiklik Ne Kadar İnceleme Gerektirir?

Patlama alanı, fark boyutunu değil, belirler. Ekibinizin bu öğleden sonra benimseyebileceği tablo:

Değişikliğin Doğasıİnceleme Seviyesi
Metinler, CSS, belgeler, izole araçlarFarkı gözden geçirin, gönderin
Bir bayrak arkasındaki özellik, testler yeşilPlanı ve fark özetini okuyun
Paylaşılan modül, dosyalar arasında yeniden yapılandırmaBir sınırı geçen her satırı okuyun
Kimlik doğrulama, ödemeler, izinler, kişisel verilerSatır satır, bir insan tarafından, istisnasız
Göç, silme yolu, altyapıSatır satır, ikinci bir göz, geri alma planı

AI tarafından üretilen kod için inceleme merdiveni: metinler ve CSS'nin gözden geçirilmesi ile başlayıp, geri alma planı ile satır satır insan incelemesi gerektiren göçler ve altyapıya kadar beş seviyeden oluşmaktadır.

Farkın boyutu, incelemenin ne kadar sürdüğünü söyler. Patlama alanı, bunun isteğe bağlı olup olmadığını söyler.

Satırlar güven seviyeleriyle ilgili değildir. Yanlış olmanın maliyetiyle ilgilidir, bu da kodun bir özelliğidir ve kimin yazdığıyla ilgili değildir. Bu, tabloyu kullanılabilir kılan şeydir: kimsenin ajanların ne kadar iyi olduğu konusunda hemfikir olmasına gerek yoktur, tablo üzerinde hemfikir olmak için. Ekibiniz felsefi bir soruda kilitlenmişse, bunu atlayın ve satırları müzakere edin. Ne kadar hızlı bir şekilde birleştiğinize şaşıracaksınız.

Eğer ürününüz Avrupa'da kişisel verileri işliyorsa, bir satır daha sizin için yasalar tarafından yazılmıştır, zevk değil: bir AI tarafından oluşturulan özelliğin GDPR altında saygı göstermesi gerekenler bir yargı çağrısı değildir ve "bir ajan yazdı" asla bir savunma olmamıştır.

Beş Ajan Aynı Anda Çalıştığında Ne Değişir

Yukarıdaki her şey, değişikliği görebileceğinizi varsayıyor. Paralel ajanlarla bu varsayım ilk olarak bozulur ve belirli bir şekilde bozulur: farkın tek bir yazarı yoktur. Son commitinizden bu yana çalışma ağacını üç ajan değiştirmiştir ve "bu dosyayı kim değiştirdi ve hangi görev kapsamında" sorusunun artık belirgin bir yanıtı yoktur. Atıf olmadan inceleme, inceleme değildir, arkeolojidir.

Bu bir araç sorunudur ve AgentsRoom incelemeyi ajanların bulunduğu yerde yapar, bir çekme isteğinin sonunda değil:

  • Review Mode, ajanlarınızın yaptığı her değişikliği, herhangi bir şey taahhüt edilmeden önce okunabilir bir fark olarak gösterir. Bu, "patlama alanına orantılı olarak farkı okuyun" adımıdır ve insanlar bunu gerçekten yapacak kadar ucuz hale getirilmiştir.
  • Ajan başına inceleme, o farkı ajana göre filtreler ve her ajanın işini ayrı ayrı taahhüt etmenizi sağlar. Beş paralel ajan, okunamaz bir çalışma ağacı yerine beş gözden geçirilebilir birim haline gelir ve kötü bir değişiklik, onu üreten görevle ilişkilendirilmeye devam eder.
  • Commit mesajı, gerçek farktan taahhüt alanındaki parıltı düğmesi ile üretilir, böylece tarih neyin değiştiğini tanımlar, ajanın ne yaptığını söylemek yerine. Bu ayrım, sabah 3'te, altı ay sonra önemlidir.

Bunların hiçbiri yargıyı değiştirmez. Yargı kullanmamak için bahaneleri ortadan kaldırır.

Makinenin Satırları Sahiplenmesini Sağlayın

Eğer satırları okumayı bırakmak istiyorsanız, başka bir şeyin onları okuması gerekir. Pratikte, bu yükü taşıyan dört şey vardır:

Ajanın kodla aynı nefeste yazmadığı testler. İlk yazılan, farklı bir ajan tarafından yazılan veya en azından kendi değişiklikleri olarak gözden geçirilen. Kod ve testleri aynı nesilden geldiği anda, bağımsız kanıt olmaktan çıkarlar.

Farklı bir modelden bir gözden geçiren. Bu, ilişkili hata sorununa pratik bir cevaptır. İkinci bir ajan incelemesi yapıyorsanız, onu yazarın model ailesinden veya sağlayıcısından farklı bir yerde çalıştırın. Hataları tamamen ilişkilendiremeyeceksiniz, ancak Claude tarafından yazılan kod üzerinde bir Codex ailesi gözden geçiren, aynı model gözden geçirenin yakalayamayacağı ölçüde farklı bir problem sınıfını yakalar, tam olarak yazarın ön yargılarını paylaşmadığı için.

Yorgun düşmeyen kapılar. Türler, lint, gizli tarama, kapsama tabanları, bir özelliğin yanında bir göçü reddeden bir CI. Kapı olarak ifade edebileceğiniz her kural, bir daha asla fark etmeniz gerekmeyen bir kuraldır.

Kendine kapanan bir döngü. Bir ajan, planla kendi işini inşa eden, çalıştıran ve herhangi bir şeyi teslim etmeden önce yineleyen bir ajan, incelemenizden "hiç çalışmadı" kategorisini ortadan kaldırır. Bu, kendini düzelten ajan döngüsüdir ve bir fark üreten bir ajan ile bir sonuç üreten bir ajan arasındaki farktır. Bu, bir insanın imza atıp atmayacağı sorusunu yanıtlamaz. Sadece insanın zaten çalışan bir şeyi imzaladığını ifade eder.

Peki, hala gözden geçiriyor musunuz?

Evet, ama bugün yaptığınızdan daha az.

Sorumlu hissetmek için satır okumayı bırakın. Önce planı okuyun, çünkü pahalı hataların yapıldığı yer burasıdır. Sonra, patlama alanına orantılı olarak farkı okuyun, ruh halinize göre değil, merdiveni kullanarak. Kimlik doğrulama, ödemeler, izinler, kişisel veriler ve geri alınamaz herhangi bir şey için kişisel olarak bir insan bulundurun, çünkü bir model sorumluluk taşıyamaz ve ikinci bir ajan, birincisinin kör noktalarını paylaşır. Diğer her şeyi testlere, türlere, kapılara ve yazarın modelini paylaşmayan bir gözden geçiren kişiye verin.

Bunu yanlış yapan ekipler, iki yönde başarısız olur ve her ikisi de önlenebilir. Biri her şeyi gözden geçirir, darboğaz haline gelir ve sessizce okumadan onaylamaya başlar, bu da her iki dünyanın en kötüsüdür. Diğeri hiçbir şeyi gözden geçirmez, iki ay hızlı gönderim yapar ve sonra bir çeyrek boyunca hiç görmediği borcu ödemekle geçer.

Standup'taki tartışma, aslında ajanların iyi olup olmadığıyla ilgili değildir. Kimin imzalamaya istekli olduğu ile ilgilidir. Bunu yanıtlayın ve inceleme politikası kendiliğinden yazılır.

Sıkça Sorulan Sorular

AI tarafından üretilen kodu hala gözden geçirmeli misiniz?

Evet, ama her şeyde satır satır değil. Ajan başlamadan önce planı gözden geçirin, ardından değişikliğin neyi bozabileceğine orantılı olarak farkı gözden geçirin. Metinler ve CSS için bir göz atın. Kimlik doğrulama, ödemeler, izinler, kişisel veriler ve göçler her zaman bir insan tarafından satır satır okunmalıdır.

Bir AI ajanı başka bir AI ajanının kodunu gözden geçirebilir mi?

Yardımcı olur, ama riskli kodda bir insanın yerini almaz. Aynı model ailesinden iki ajan, aynı bağlamda verildiğinde genellikle aynı yönde başarısız olurlar. Hataları ilişkilidir, bu nedenle ikinci bir ajan yazım hatalarını ve kaybolan testleri yakalar, ancak hatayı üreten kör noktaları paylaşır. Eğer bir ajan gözden geçiren kullanıyorsanız, onu yazarın modelinden farklı bir modelde çalıştırın.

Bir AI ajanının hata yaptığını nasıl anlarsınız?

Stil okumak yerine farkta nesnel işaretler arayın. En güçlü olanı: testler, kapsadığı kodla aynı committe değişti, bu da yeşilin inşa edildiği ve gözlemlenmediği anlamına gelir. Diğerleri arasında kapsam kayması, devre dışı bırakılmış veya zayıflatılmış bir doğrulama, icat edilmiş bir API, sabit kodlanmış bir yerel yol ve özetin farkla eşleşmemesi yer alır.

AI ajanları insan kod gözden geçirenlerin yerini alacak mı?

Zaten çoğu satır okumayı değiştirdiler. İmza yerini alamazlar. Sorumluluk bir modele devredilemez, bu nedenle bir insan, geri alınması zor olan herhangi bir şey için birleştirme kararını hala sahiplenir.

AI kodunu satır satır gözden geçirmeli misiniz?

Sadece patlama alanının bunu haklı çıkardığı yerlerde. Satır satır inceleme, birkaç ajanın paralel çalışmasından öteye ölçeklenemez ve akşam 6'da 900 satırlık bir farkı gözden geçiren bir insan, bilgi üretmeden bir imza üretir. O dikkati geri alınması pahalı olan değişikliklere harcayın.

Hangi değişiklikler insan incelemesi olmadan asla birleştirilmemelidir?

Kimlik doğrulama, ödemeler, izinler, kişisel veriler, veritabanı göçleri, silme yolları ve altyapıyla ilgili olan her şey. Bunların hepsi bir özelliği paylaşır: yanlış olmanın maliyeti, farkın boyutuyla orantılı değildir.

AgentsRoom'u Indirin

Yapay zeka ajanlarınızı (Claude, Codex, Antigravity CLI, OpenCode, Aider, Grok Build, Mistral Vibe, Kimi Code) tüm projelerinizde tek bir pencereden çalıştırın.

ÜcretsizAgentsRoom'u Indir

Yardımcı uygulama: hareket halindeyken ajanlarinizi izleyin

Claude, Codex, Antigravity CLI veya başka bir AI sağlayıcı kullan.

Uzantıyı yükleyin
Chrome Web Store

Hataları ve istekleri doğrudan genel backlogunuza gönderin.

AgentsRoom'a kısa bir bakış.

Çoklu proje
Çoklu sağlayıcı
Çoklu ajan
Canlı durum
Diff ve commit
Mobil uygulama
Canlı önizleme
Ajan ekipleri
Tarayıcı otomasyonu
Backlog odaklı dev
Prompt kütüphanesi
Beceri kütüphanesi
Tüm özellikleri gör