Kaynaklara dön
Sistemler15 min readJune 14, 2026

Son doğrulama: June 14, 2026

Yapay Zeka Kanaryaları: AI Sana Ne Zaman Yalan Söylemeye Başlar?

Yapay zeka bir gecede kusursuzdan bozuğa dönüşmez, yavaşça kayar. Bu rehber, tamamen uydurma çıktılara güvenmeye başlamadan önce bu kaymayı nasıl yakalayacağını gösteriyor.

Rehberin tamamını PDF olarak alÜCRETSİZ

Bültene katıl, tüm rehberi PDF olarak indir.

PDF indir

Yapay zeka bir gecede kusursuzdan bozuğa dönüşmez; yavaşça kayar, raydan çıkar. Bir mesajda verdiğin her talimata harfiyen uyan model, elli mesaj sonra tamamen uydurduğu bilgileri sana inanılmaz bir özgüvenle satmaya başlar. Ses tonu asla değişmez. Özgüveni zerre sarsılmaz. İşin tehlikeli yanı da tam olarak bu; işte bu yüzden kanaryalar hayat kurtarır.

Kanarya Nedir?

1800'lü yıllarda madenciler yer altına yanlarında kanaryalarla inerdi. Kuşlar zehirli gazlara karşı inanılmaz derecede hassastı. Havada zehir birikmeye başladığında, gaz insanlar için tehlikeli seviyeye gelmeden önce kanarya ötmeyi bırakır ve düşüp bayılırdı. Kanarya sustuğu an madenciler derhal orayı terk etmeleri gerektiğini anlardı.

Aynı mantık teknoloji dünyasının her yerine uyarlandı. Yazılım geliştirmede "canary deployment", yeni bir özelliği önce kullanıcıların ufak bir yüzdesine açmak demektir. Bir şeyler kırılırsa herkes etkilenmeden erkenden yakalarsın.

OpenClaw'ın yaratıcısı Peter Steinberger, bu tekniği Claude için popüler hale getirdi. Mantık oldukça basit: Sistem prompt'una veya CLAUDE.md dosyana "Yanıtlarına her zaman adımla başla" gibi ufacık bir kural eklersin. Model bunu yapmaya devam ettiği sürece oturumun sağlıklı olduğunu bilirsin. Bıraktığı an, bir şeylerin ters gittiğinin işaretidir.

Yapay Zeka Oturumları Neden Bozulur?

Yapay zekadaki bu bozulma aniden yaşanmaz. Karşına bir uyarı veya hata mesajı çıkmaz; kalite sessizce ve derinden erir. Bunun arkasında dört temel sebep var:

Context window sınırları. Her modelin belirli bir bağlam penceresi (context window) vardır. Araştırmalar, en baştaki ve en sondaki bilgilerin her zaman en çok dikkati çektiğini net bir şekilde gösteriyor. Ortadaki bilgiler ise daha az ağırlık alır. Sohbet uzadıkça, ilk başta verdiğin temel talimatlar o dikkat görmeyen ölü bölgede kaybolup gider.

Talimat seyreltmesi (Instruction dilution). Sohbete ilk başladığında modelin odaklanacağı sadece bir iki mesaj vardır. Elli mesaj sonra ise asıl talimatların binlerce token'ın altına gömülür. Model, önündeki anlık göreve odaklanırken küçük kural ve kısıtlamaları farkında olmadan arka plana iter.

Dikkat kayması (Attention drift). Model her yeni yanıt ürettiğinde bütün sohbet geçmişini tekrar işler. Sohbet uzadıkça dikkatini çok daha fazla içeriğe paylaştırmak zorunda kalır. İlk mesajda sistem prompt'un toplam bağlamın %100'üyken, ellinci mesaja geldiğinde belki de sadece %2'sini oluşturur.

Bileşik hatalar (Compounding errors). Model 10. mesajda ufak bir hata yapar ve sen bunu fark etmezsen, o hata artık sohbet geçmişinin kalıcı bir parçası haline gelir. Model kendi ürettiği yanlış cevabı kesin bir gerçek gibi kabul eder ve sonraki adımlarını bu yalanın üzerine inşa eder.

Bozulmanın Zaman Çizelgesi

Yapay zeka oturumları tahmin edilebilir bir rota izler. Bu döngüyü anlamak, kanaryaların neden bu kadar iyi çalıştığını kavramanın anahtarıdır.

1. Adım: Balayı Evresi (1-15. Mesajlar). Her şey tıkır tıkır çalışır. Model her talimata uyar, kanaryan her yanıtta öter. Format kusursuzdur, ton tam istediğin gibidir, yanıtlar doğrudur.

2. Adım: Ufak Sapmalar (15-40. Mesajlar). Model gözden kaçması kolay, küçük değişiklikler yapmaya başlar. Yanıtları biraz kısaltabilir, belirli bir format kuralını atlayabilir. Görünürde bariz bir hata yoktur ama her şey biraz daha özensizleşir. Çoğu insan bu evreyi fark etmez bile.

3. Adım: Kanaryanın Ölümü (30-60. Mesajlar). Kanarya kuralın tamamen unutulur. Model artık adınla hitap etmeyi bırakır, format kuralını çiğner veya bir kısıtlamayı görmezden gelir. İşte senin kırmızı alarmın budur: Model artık talimatlarını güvenilir şekilde takip edemiyordur.

4. Adım: Kayma Bölgesi (40-80. Mesajlar). Model yapmaması gereken varsayımlarda bulunmaya başlar. Bilmediği boşlukları kulağa mantıklı gelen ama yanlış bilgilerle doldurur. Netleştirici sorular sormayı bırakır. Çıktılar hâlâ kendinden emin ve düzgün görünür ama içerik doğruluğu hızla yokuş aşağı iner.

5. Adım: Tam Halüsinasyon (60+ Mesajlar). Model artık kısmen veya tamamen uydurma bilgileri müthiş bir özgüvenle üretir. Olmayan fonksiyon isimleri yazabilir, hiç yayınlanmamış makalelere atıfta bulunabilir ya da son derece otoriter tınlayan ama baştan aşağı yanlış teknik açıklamalar yapabilir.

Kullanabileceğin 7 Farklı Kanarya Türü

1. İsim Kanaryası

Neyi test eder: Sistem prompt'unun hâlâ dikkate alınıp alınmadığını. En iyi kullanım: Genel kullanım, CLAUDE.md dosyaları, ChatGPT custom instructions.

PROMPT
Yanıtlarına her zaman benim adımla başla.

2. Kapanış Kanaryası

Neyi test eder: Modelin yanıtın sonuna kadar biçimlendirme kurallarına uyup uyamadığını. En iyi kullanım: Kodlama oturumları, uzun metin yazımları, çok adımlı karmaşık görevler.

PROMPT
Her yanıtın sonuna yatay bir çizgi çek ve alt satıra sadece 'Hazır' yaz.

3. Format Kanaryası

Neyi test eder: Modelin stil kurallarına hâlâ sadık kalıp kalmadığını. En iyi kullanım: İçerik üretimi, rapor yazımı, çıktı formatının kritik olduğu işler.

PROMPT
Her zaman madde işaretleri (-) kullan, asla numaralı liste yapma. Her paragrafın ilk cümlesini mutlaka kalın (bold) yaz.

4. Dil Kanaryası

Neyi test eder: Modelin kendi varsayılan ezberlerini bastırıp bastıramadığını. En iyi kullanım: Metin yazarlığı, marka dili çalışmaları, editöryal düzenlemeler.

PROMPT
Yanıtlarında asla 'kesinlikle', 'şüphesiz' veya 'tabii ki' kelimelerini kullanma.

5. Rol Kanaryası

Neyi test eder: Modelin belirlediğin rolden çıkıp çıkmadığını. En iyi kullanım: Uzman danışmanlığı, niş araştırmalar, roleplay odaklı çalışmalar.

PROMPT
Sen kıdemli bir backend mühendisisin. Problemleri her zaman önce sistem mimarisi perspektifinden ele alarak akıl yürüt.

6. Kısıtlama Kanaryası

Neyi test eder: Modelin katı kurallara ve sınırlara uyma yeteneğini. En iyi kullanım: Yapılandırılmış çıktılar, otomasyon süreçleri, hassasiyet gerektiren durumlar.

PROMPT
Tüm yanıtları 200 kelimenin altında tut. Her yanıtında tam olarak 3 adet eylem maddesi belirt.

7. Meta Kanarya

Neyi test eder: Modelin senin talimatların konusundaki öz farkındalığının sürüp sürmediğini. En iyi kullanım: Araştırma görevleri, kritik projeler, hataya tahammülü olmayan işler.

PROMPT
Her yanıtın sonunda, tüm talimatlarıma ne kadar uyduğuna dair kendine 1-10 arasında bir güven puanı ver.

Farklı Araçlarda Kanarya Nasıl Kurulur?

Claude (claude.ai, Masaüstü Uygulaması): Proje ayarlarına git ve kanaryanı "Custom Instructions" alanına ekle. Bu, o projedeki her mesaja uygulanır.

Claude Code (Terminal): Kanaryanı projenin ana dizinindeki CLAUDE.md dosyasına ekle. Bu dosya, Claude'un her oturum başında okuduğu kalıcı bir sistem prompt'u gibi çalışır.

ChatGPT: Ayarları aç, "Personalization" bölümüne git ve "Custom Instructions" seçeneğine tıkla. Kanaryanı "ChatGPT'nin nasıl yanıt vermesini istersiniz?" alanına yaz.

Diğer araçlar (Gemini, Copilot, yerel modeller): Sistem prompt'u ayarlamana izin veren her araç kanaryaları destekler. API çağrılarında bunu system rolü mesajına eklemen yeterli.

Kanaryan Öldüğünde Ne Yapacaksın?

Kanaryan az önce ötmeyi bıraktı. Şimdi ne olacak?

1. Seçenek: Yeni bir oturum başlat. En güvenli yol budur ve varsayılan tercihin olmalıdır. Temiz bir oturum, modele talimatlarının en başta yer aldığı yepyeni bir context window sağlar. Claude Chat'te yeni sohbet aç; Claude Code'da /clear veya /compact komutunu çalıştır; ChatGPT'de yeni bir sohbet başlat.

2. Seçenek: Modele hatırlat. Şöyle bir mesaj at: "Adımı kullanmayı bıraktın. Lütfen talimatlarını tekrar oku ve onlara uymaya devam et." Bu yöntem seni birkaç mesaj daha idare edebilir ama geçici bir çözümdür. Hatırlatmana rağmen kanarya tekrar ölürse, direkt yeni oturuma geç.

3. Seçenek: Kaydet ve taşı. Uzun kodlama veya yazma oturumlarında, modelden mevcut oturumdaki tüm önemli noktaları özetlemesini iste. Yeni ve temiz bir oturum aç, bu özeti yapıştır ve kanarya talimatını en başa tekrar ekle.

Üretim ve İleri Düzey Kullanım İçin Stratejiler

Birden fazla kanarya kullan. Tek bir kanarya sana bir şeylerin yanlış gittiğini söyler. İki kanarya ise durumun ne kadar vahim olduğunu gösterir. İsim kanaryan öldü ama format kanaryan hâlâ yaşıyorsa, sistem prompt'un solmaya başlamıştır ama henüz bitmemiştir. İkisi birden öldüyse o oturum artık tamamen çökmüştür.

Kanaryanın kaç mesaj dayandığını takip et. Her kanaryanın kaç mesaj hayatta kaldığının ufak bir çetelesini tut. Zamanla kendi kişisel bozulma eğrini öğrenirsin ve kalite düşmeden önce oturumu ne zaman sıfırlaman gerektiğini önceden kestirebilirsin.

Otomasyon sistemlerine kanarya eşikleri koy. Yapay zekayı otomatik bir pipeline içinde kullanıyorsan, kanarya başarısız olduğu anda süreci otomatik olarak yeniden başlatacak kontroller ekle. Bozulmuş bir modelin kararlar almasına asla izin verme.

Kanaryaları çıktı doğrulama (validation) ile birleştir. Kanarya sana modelin kaymaya başladığını haber verir. Çıktı doğrulayıcılar ise (örneğin bir regex kontrolü veya ikinci bir model denetimi) asıl hataları yakalar. Kritik işlerde her iki yöntemi birlikte kullan.

Kopyala-Yapıştır Kanarya Prompt'ları

Temel isim kanaryası:

PROMPT
Her yanıtına mutlaka şu adımla başla: [Adın]. Bu bir oturum sağlık kontrolüdür. Bunu yapmayı bıraktığın an oturumun bozulmaya başladığını ve sıfırdan başlamam gerektiğini anlayacağım.

Gelişmiş kanarya paketi:

PROMPT
Her yanıtına mutlaka şu adımla başla: [Adın].
Yanıtlarında asla 'kesinlikle', 'şüphesiz' veya 'memnuniyetle yardımcı olurum' gibi ifadeler kullanma.
Her yanıtın sonuna yatay bir çizgi çek ve alt satıra sadece 'Hazır' yaz.
Tüm yanıtları 200 kelimenin altında tut.
Her yanıtın en sonunda, tüm talimatlarıma ne kadar uyduğuna dair kendine 1-10 arasında bir puan ver.

Araştırma kanaryası (kritik ve hatasız işler için):

PROMPT
Araştırma oturumu kuralları:
1. Her yanıta adımla başla: [Adın]
2. Her yanıtın sonunda 1-10 arasında güven puanını belirt
3. Yüzde yüz emin olmadığın her iddiayı açıkça [DOĞRULANMADI] şeklinde etiketle
Bu kurallardan herhangi birini çiğnediğin an, bu oturumun artık güvenilir olmadığını kabul edeceğim.

En iyi iş akışları, kanaryaları iş işten geçtikten sonra hata ayıklamak için değil, erken uyarı sistemi olarak kullanır. Onları daha ihtiyaç duymadan kur, gözünü üzerlerinden ayırma ve ötmeyi bıraktıkları an durumu ciddiye al.

Bu rehberi PDF olarak sakla

Bültene ücretsiz katıl; bu rehberin tamamını ve her hafta yeni yapay zeka ipuçlarını doğrudan gelen kutuna gönderelim.

Tam PDF'i indir (Ücretsiz)