Uzun Sohbetlerde Yapay Zeka Neden Bozulur
Yazar Chatday Editorial Team ·
İlk on dakika harikadır. Yapay zeka ne istediğini anlar, cevaplar yerini bulur ve sonunda gerçek bir çalışma arkadaşı bulduğunu düşünürsün.
Sonra, otuzuncu mesaj civarında iş sarpa sarar. Başta koyduğun bir kuralı unutur. Zaten reddettiğin bir şeyi tekrar önüne koyar. Düzeltirsin, özür diler, iki cevap sonra aynı hatayı yapar.
Bu senin sabrının tükenmesi değil, modelin de kötü bir günü yok. Uzun sohbetler gerçekten bozuluyor, piyasadaki her modelin başına geliyor ve araştırmacılar artık ne kadar bozulduğunu ölçtü.
Uzun bir sohbette yapay zekanın cevaplarına ne oluyor
Microsoft ve Salesforce’taki araştırmacılar anlatması kolay bir deney yaptı. Bir modelin normalde rahatça yaptığı işleri aldılar, örneğin biraz kod yazmak ya da birkaç belgeye dayanarak bir soruyu yanıtlamak, ve bunları iki şekilde istediler.
İlk versiyonda isteğin tamamı tek ve eksiksiz bir mesajda geliyordu. İkincisinde tam olarak aynı bilgi, gerçek bir insanın konuştuğu gibi birkaç turda parça parça veriliyordu: belirsiz bir açılış isteği, sonra bir ayrıntı, sonra bir düzeltme, sonra bir ayrıntı daha.
Aynı model, aynı bilgi, aynı hedef. Değişen tek şey teslim biçimiydi.
200.000’den fazla simüle edilmiş sohbette ve altı iş türünde, test edilen tüm üst düzey modeller parçalı versiyonda belirgin biçimde daha kötü sonuç verdi. Ortalama düşüş %39 oldu. Çalışma Mayıs 2025’te yayımlandı ve nisan ayında alanın önde gelen konferanslarından ICLR 2026’da sözlü bildiri olarak sunuldu.
Daha ilginç olan, nasıl başarısız olduğu. Modeller daha yeteneksiz hale gelmedi. Daha güvenilmez hale geldiler ki bu farklı ve daha sinir bozucu bir sorun. Aynı parçalı soruyu aynı modele on kez sor, kalite tek mesajdakinden çok daha geniş bir aralıkta savrulur.
Nedeni gözünde canlandırması kolay. İlk mesajın belirsiz olduğunda model netleşmeyi beklemez. Boşlukları sessizce bir tahminle doldurur, o tahmine bağlanır ve üstüne kurulu bir cevap üretmeye başlar. Tahmin yanlışsa, sonrasında gelen her şey o hatayı devralır. Araştırmacılar, bir model sohbetin başında yanlış yöne saptığında genelde geri dönmediğini, sen doğrudan düzeltsen bile toparlanmadığını buldu.
Daha büyük hafıza uzun sohbetleri neden kurtarmıyor
Akla gelen itiraz şu: modellerin artık devasa hafızaları var. Bazıları bir milyon kelimeyi bir anda okuyor. Elli mesajlık bir sohbet hiçbir şey olmamalı.
Bu kapasite açısından doğru, kalite açısından yanlış ve bütün hikaye bu ikisi arasındaki boşlukta. O hafızanın nasıl çalıştığının tam resmini istiyorsan, bağlam penceresinin gerçekte ne olduğunu ayrıca anlattık. Kısacası: modelin cevap verirken önünde tutabildiği metin miktarı.
Metni önünde tutmak, onu iyi kullanmakla aynı şey değil. Chroma’daki bir araştırma ekibi Temmuz 2025’te 18 önde gelen modeli test etti ve hepsinde aynı örüntüyü buldu. Girdi uzadıkça doğruluk düşüyordu ve ilan edilen sınıra yaklaşmadan çok önce düşüyordu. Teknik olarak bir milyon kelime kabul eden bir model, elli binde bile gözle görülür biçimde kötüleşebiliyor.
O çalışmadan iki ayrıntı sezgiye ters düştüğü için öne çıkıyor:
- Konuyla ilgisiz tek bir pasaj bile zarar veriyor. Yüz değil, tek bir dikkat dağıtıcı metin bloğu eklemek doğruluğu ölçülebilir biçimde düşürüyordu.
- Düzenli sıralanmış metin, karışık bir yığından daha kötü olabiliyor. Modeller, çevredeki malzeme mantıklı sıralandığında değil karıştırıldığında daha yüksek puan aldı.
Bir de günlük hayattaki sıkıntının büyük kısmını açıklayan, daha eski ve defalarca doğrulanmış bir bulgu var. Stanford öncülüğündeki 2023 tarihli bir çalışma, modellerin uzun bir girdinin en başındaki veya en sonundaki bilgiyi en iyi yakaladığını, ortadakini ise çok daha kötü bulduğunu gösterdi. Sekizinci mesajdaki özenli talimatın şimdi yığının tam ortasına gömüldü. Olabilecek en kötü yer.
İkisini bir araya koy, tablo oturuyor. Uzun sohbetin, yapay zekanın başvurduğu düzenli bir dosya değil. Büyüyen bir metin yığını ve senin önemli satırın orada kırk mesajlık lafın gelişi, çıkmaz sokak ve çoktan geride bıraktığın düzeltmelerle yarışıyor.
Yapay zeka laboratuvarları biliyor ve bir çözüm yolu kurdu
Bu kenarda kalmış bir şikayet değil. Şirketlerin kendisi belgeliyor.
Anthropic’in geliştirici belgeleri, sohbet uzadığında eski bölümleri otomatik olarak özetleyen compaction adlı bir özelliği anlatıyor. Verilen gerekçe açık: «bir sohbet büyüdükçe cevap kalitesi düşer», bu yüzden eski malzeme kısa bir özetle değiştiriliyor.
Bunu bir daha oku, çünkü işe yarar kısım orada. Uzun bir sohbet için resmi çözüm, sohbetin çoğunu çöpe atıp bir özet saklamak. Aynısını elinle, ücretsiz, herhangi bir sohbet uygulamasında yapabilirsin ve bunu senin için yapacak bir özelliği beklemene gerek yok.
Sohbet dağılmaya başlayınca ne yapmalı
İşin pratik karşılığı şu. Belirtiyi gerçekte olan şeyle eşleştir.
| Fark ettiğin şey | Aslında olan | Ne yapmalı |
|---|---|---|
| Başta koyduğun bir kuralı unutuyor | Talimat uzun bir sohbetin ortasına gömülü | Kuralı en yeni mesajında tekrar yaz, hatırlatma olarak değil talimatın kendisi olarak |
| Reddettiğin bir öneriyi tekrar getiriyor | Reddedilen sürüm hala geçmişte ve hala bağlam sayılıyor | Yeni bir sohbet aç ve yalnızca istediğini anlat, elediğini asla |
| Cevaplar daha belirsiz ve genel oluyor | Pencerede birbiriyle yarışan fazla malzeme var | Durumu tek mesajda özetle ve oradan devam et |
| Düzeltmelere rağmen aynı hatayı yapıyor | Erkenden yanlış bir tahmine bağlandı | Konuyu bırak. Bir düzeltme, üstünde durduğu sohbetten nadiren ağır basar |
| Olgularda kendinden emin biçimde yanılıyor | Bu ayrı bir sorun, sohbet uzunluğuyla ilgisi yok | Bak: yapay zeka neden kendinden emin şekilde uyduruyor |
Ve bunların çoğunu baştan önleyen beş alışkanlık:
- İsteğin tamamını başa koy. Bu araştırmanın en güçlü bulgusu, eksiksiz tek bir mesajın aynı bilgiyi parça parça vermeye üstün geldiği. Tam isteği yazmak için otuz saniye fazladan harca.
- Tartışmak yerine baştan başla. Bir sohbet bozulduğunda yenisini açmak sana hiçbir şeye mal olmaz. İçine yalnızca iyi parçaları yapıştır.
- Uzun bir oturumun sonunda kendi özetini yaz. Yapay zekadan alınan kararların kısa bir dökümünü iste, kontrol et, yeni bir sohbet aç ve ilk mesaj olarak yapıştır.
- Farklı konuları ayrı sohbetlerde tut. İş projesi için bir konu, tatil için başka bir konu. Karıştırmak ikisine de dikkat dağıtıcı ekliyor.
- Biri takıldığında modeli değiştir. Farklı bir modelin son sohbetinin kötü gittiğinden haberi yok. Soruna tertemiz geliyor ve çoğu zaman ilkiyle işe yarar biçimde anlaşmazlığa düşüyor. Buna yapay zeka modelleri neden farklı cevaplar veriyor yazısında bakmıştık.
Sonuncusu hepsinin en ucuz numarası ve insanların atladığı numara, çünkü açık tek bir yapay zeka uygulamaları var.
Bu tavsiyenin yetmediği yerler
Birkaç dürüst uyarı, çünkü çözüm her yere uymuyor.
Sıfırdan başlamanın gerçek bir bedeli var. Bir yapay zekaya bülteninin tonunu öğretmek için bir saat harcadıysan bunu atmak canını yakar ve bir özet asla her şeyi yakalamaz. O durumda bilgisayarında bir notta kısa ve tekrar kullanılabilir bir brifing tut ve her yeni sohbete yapıştır. İşe yarayan kısmı tutmuş, dağınıklığı bırakmış olursun.
Araştırma ayrıca modelleri, bir senaryoyu izleyen simüle edilmiş kullanıcılara karşı test etti; yanlış bir sapmayı fark edip durdurabilen gerçek bir insanın dağınık gidiş gelişine karşı değil. Dikkatli olup hatayı üçüncü mesajda yakalayan biri, bu rakamların ima ettiğinden iyi sonuç alır. Bu da düzeltmenin hala neredeyse hiçbir şeye mal olmadığı ilk cevapları dikkatle okumak için bir gerekçe.
Bazı işler de gerçekten uzun tek bir konu gerektiriyor, örneğin özetlediğinde anlamını kaybedeceğin büyük bir belgede ilerlemek. Uzun belgeler için yapılmış bir model, mesela Claude Opus 4.7, bunu çoğundan daha iyi kaldırıyor ama sorunu ortadan kaldırmıyor. Bu işlerde konuyu koru ve ana talimatını birkaç mesajda bir tekrarla ki yığının sonuna yakın dursun, çünkü model orada en dikkatli bakıyor.
Kısacası
Uzun yapay zeka sohbetleri makine yorulduğu için bozulmuyor. Model başta sessiz bir varsayım yaptığı, her şeyi onun üstüne kurduğu ve sonra en iyi talimatını eşit okumadığı bir metin yığınının ortasına gömdüğü için bozuluyor.
Bunu bildiğinde alışkanlıklar kendiliğinden çıkıyor. Hepsini tek seferde söyle. Dağılınca sıfırdan başla. Brifingini yeniden yapıştırabileceğin bir yerde tut. Ve bir model döngüye takıldığında onunla tartışmayı bırak, aynı soruyu başkasına ver.