Robert Stalnaker'ın 'ortak zemini' makinelerin sınavında: Yapay zekâ pragmatiği 1978 tarihli bir makaleye dönüyor
Seksen altı yaşındaki MIT filozofu Robert Stalnaker'ın konuşmayı 'bağlam kümesini daraltma' olarak modelleyen kuramı, 2026'da beklenmedik bir yerde yeniden merkeze oturdu: Büyük dil modellerinin pragmatik yeterliğini ölçen EACL 2026 ve CoNLL 2026 çalışmaları ile ağustosta yayımlanan 'pragmatik saldırı yüzeyi' makalesi, Stalnaker'ın ortak zemin ve pragmatik önvarsayım kavramlarını doğrudan ödünç alıyor. Bir dil modeli ortak zemini takip edebilir mi, yoksa yalnızca taklit mi eder?
Robert Stalnaker, 2017 · Fotoğraf: Dipartimento di Filosofia 'Piero Martinetti', Università degli Studi di Milano, CC BY 3.0 · Wikimedia Commons
Felsefede bazı makaleler yazıldıkları anda değil, onlarca yıl sonra, beklenmedik bir alanın onlara ihtiyaç duymasıyla "güncel" olur. Robert Stalnaker'ın 1978'de yayımlanan "Assertion" (İddia) makalesi bu türden. Kırk sekiz yıl önce dil felsefecileri için yazılmış, konuşmanın nasıl ilerlediğini olası dünyalar kümeleriyle modelleyen bu on beş sayfalık metin, 2026'da yapay zekâ araştırmacılarının, sohbet robotlarının "söylenmeyeni anlayıp anlamadığını" ölçmek için başvurduğu ortak dile dönüştü. Bu yıl Rabat'taki EACL konferansında sunulan "The Pragmatic Mind of Machines" makalesi, ağustosta yayımlanan "Pragmatic Attack Surface" çalışması ve dil modellerinin pragmatik akıl yürütmesini ölçen bir dizi araştırma, Stalnaker'ın "ortak zemin" (common ground) ve "pragmatik önvarsayım" kavramlarını doğrudan kuramsal çerçeve olarak kullanıyor. Seksen altı yaşındaki MIT emeritus profesörü, kendisi bu tartışmaya katılmış değil; ama kavramları, hiç tasarlanmadıkları bir makinenin içinde çalışıp çalışmadığı sorusuyla sınanıyor.
Kırk sekiz yıllık bir fikir: Konuşma, dünyaları eleme işidir#
Stalnaker'ın modeli sade bir sezgiye dayanır. İki kişi konuşurken, ikisinin de doğru saydığı, karşısındakinin de doğru saydığını bildiği ve bunun karşılıklı bilindiğini bildiği bir önermeler kümesi vardır: ortak zemin. Bu önermelerin hepsinin doğru olduğu olası dünyalar kümesine Stalnaker "bağlam kümesi" der. Bir şey iddia etmek, bu kümeyi daraltmaktır: "Yarın toplantı iptal" dediğimde ve karşımdaki itiraz etmediğinde, toplantının yapıldığı dünyalar bağlam kümesinden elenir ve konuşma daralmış bir dünyalar kümesi içinde sürer. Konuşmanın bilgi verici olması, kümeyi daraltması demektir; zaten ortak zeminde olanı söylemek boş, ortak zeminle çelişeni söylemek anlamsızdır. Bu modelin gücü, Grice'ın "konuşmacı niyeti" kavramını ve Austin'in söz edimlerini tek bir formel yapıya bağlamasıydı: Önvarsayım, ortak zeminde zaten bulunan şeydir; imalar, dinleyicinin konuşmacının kümeyi neden bu biçimde daralttığını sormasıyla çıkarılır; belirsizlik, bağlam kümesinin hangi dünyaları içerdiğine göre çözülür.
Stalnaker, 2002'de "Common Ground" makalesiyle kuramı yeniden kurdu ve ortak zeminin "gerçekten inanılan" değil "konuşma amacıyla kabul edilen" önermelerden oluştuğunu netleştirdi; bu ayrım, yalan söylemenin, varsayımsal konuşmanın ve kurgunun nasıl mümkün olduğunu açıklar. Dilbilimde Irene Heim'ın dosya değişimi semantiği, Hans Kamp'ın söylem temsili kuramı ve Frank Veltman'ın güncelleme semantiği, "dinamik semantik" olarak anılan bütün bir program, Stalnaker'ın bağlam kümesi fikrinden türedi. Hesaplamalı dilbilimde ise diyalog sistemleri 1990'lardan bu yana "ortak zemin"i bir veri yapısı olarak modellemeye çalıştı.
Öğrencisi olduğu Althusser'den koparak 'cahillerin özgürleşmesi'ni, işçi arşivlerini, demokrasiyi, edebiyatı ve sinemayı aynı felsefi sorunun parçaları hâline getiren düşünür. Sorusu hep aynı: Kim konuşabilir — ve kimin konuşması 'gerçekten konuşma' sayılır? Algoritmaların görünürlüğü dağıttığı çağda, 'duyulur olanın paylaşımı' kavramı yeni bir hayat buluyor.
Büyük dil modelleri bu tabloyu değiştirdi, çünkü ortak zemini açıkça modellemeyen, yalnızca sonraki sözcüğü tahmin eden sistemlerin pragmatik davranış sergilemesi, Stalnaker'ın kuramına iki yönden meydan okuyor. Modeller ortak zemini "takip etmiyorsa" pragmatik davranışları nereden geliyor? Ve takip ediyorlarsa, bu, ortak zeminin bir "ortak inanç" değil, dilin istatistiksel yapısında kodlanmış bir düzenlilik olduğu anlamına mı geliyor?
Kefan Yu, Rob Voigt ve arkadaşlarının EACL 2026'da sunduğu "The Pragmatic Mind of Machines" makalesi, bu soruyu ampirik olarak ele alıyor. Yazarlar, "alternatifler" kavramına dayanan ALTPRAG adlı bir veri seti kurdular: Her örnek, aynı derecede makul ama pragmatik olarak farklı iki devamı eşliyor ve modelden hem konuşmacının kastını çıkarmasını hem de konuşmacının neden bir sözü ötekine tercih edeceğini açıklamasını istiyor. Yirmi iki modeli eğitimin üç aşamasında, ön eğitim, denetimli ince ayar ve tercih optimizasyonu sonrasında, sınayan çalışma, temel modellerin bile pragmatik ipuçlarına "dikkat çekici bir duyarlılık" gösterdiğini, bunun model ve veri ölçeğiyle tutarlı biçimde arttığını ve ince ayar ile insan geri bildirimiyle pekiştirmeli öğrenmenin özellikle "bilişsel-pragmatik" senaryolarda ek kazanç sağladığını buldu. Sonuç, yazarların deyişiyle, pragmatik yeterliğin dil modeli eğitiminin "beliren ve bileşimsel" bir özelliği olduğu.
Ağustosta arXiv'de yayımlanan "Pragmatic Attack Surface: Vulnerabilities of Implicit Context in Large Language Models" ise madalyonun öteki yüzüne bakıyor. Makale, Stalnaker'ın "pragmatik önvarsayım" kavramından, konuşmacıların iletişimde doğal olarak kabul ettiği arka plan varsayımlarından, yola çıkarak dil modellerinin "örtük bağlam"ı nasıl işlediğini hem dilbilimsel hem istatistiksel açıdan inceliyor ve bunun bir güvenlik açığı olduğunu gösteriyor: Bir modelin ortak zemine yerleştirdiği önvarsayımları manipüle ederek, açık komutlarla yapılamayan şeyleri örtük bağlamla yaptırmak mümkün. Stalnaker'ın kuramında önvarsayımın "kabul edilen" olması, yani sorgulanmadan bağlam kümesine girmesi, insan konuşmasının verimliliğinin kaynağıydı; makinede aynı özellik bir saldırı yüzeyi oluyor. Eylül başında yayımlanan bir başka çalışma, "On the Same Wavelength?", modellerin geniş bir kavram yelpazesinde pragmatik akıl yürütmesini, yine Stalnaker'ın iddia kuramını referans alarak ölçüyor.
Bu araştırmalar bir felsefe profesörü için iki nedenle ilginç. Birincisi, Stalnaker'ın modelinin ne kadar "gerçek" olduğunu sınıyorlar. Stalnaker, ortak zemini konuşmacıların zihinsel durumlarıyla, karşılıklı kabul ile tanımlamıştı; bu, kuramın psikolojik bir iddia taşıdığı anlamına gelir. Eğer zihinsel durumu olmayan bir sistem ortak zemini takip ediyormuş gibi davranabiliyorsa, ya ortak zemin zihinsel değil yapısal bir şeydir (dilin kendisinde kodludur), ya da model gerçekten takip etmiyor, yalnızca takip edenlerin ürettiği metinleri taklit ediyordur. Yu ve arkadaşlarının "temel modellerde bile duyarlılık" bulgusu ilk yorumu, "ince ayarla artan yeterlik" bulgusu ikincisini destekliyor; ampirik veri, felsefi soruyu çözmüyor, keskinleştiriyor.
İkincisi, Stalnaker'ın kuramı, geçen hafta Searle'ü anarken hatırladığımız Çin Odası tartışmasına yeni bir zemin sunuyor. Searle, sözdizimini işleyen bir sistemin anlambilimi olamayacağını söylemişti. Stalnaker'ın modeli, anlamı sözdiziminde değil, konuşmanın dünyalar kümesi üzerindeki etkisinde arar: Bir sözcenin içeriği, bağlam kümesini nasıl daralttığıdır. Bu tanımla, bağlam kümesini doğru biçimde daraltan bir sistemin, iç dünyası olsun olmasın, "iddiada bulunduğu" söylenebilir; ya da tam tersine, kabul edilen önermelerin yokluğunda hiçbir şeyin daralmadığı ve makinenin yalnızca daralma taklidi yaptığı. Stalnaker'ın kendisinin bu soruya vereceği cevap, muhtemelen, Quine'cı bir sükûnetle, "kuramın ne öngördüğüne bakalım" olurdu; 2022 tarihli Propositions kitabında önermeleri Quine'cı bir temelde, zihinsel değil mantıksal nesneler olarak kurmuştu.
Robert Culp Stalnaker 1940'ta Princeton'da doğdu; Wesleyan'da okudu, Princeton'da doktora yaptı, Yale, Illinois ve Cornell'den sonra 1988'de MIT'ye geçti ve Laurance S. Rockefeller Profesörü olarak emekli oldu. Üç kurucu katkısı var: "A Theory of Conditionals" (1968), "p olsaydı q olurdu" biçimindeki koşulluları en yakın olası dünyada değerlendiren semantiği kurdu ve David Lewis'inkiyle birlikte koşullular kuramının standardı oldu; "Assertion" ve "Common Ground" pragmatiği formelleştirdi; Ways a World Might Be (2003) ve Mere Possibilities (2012), olası dünyaları Lewis gibi somut evrenler değil, dünyanın "olabileceği yollar" olarak düşünen ılımlı modal gerçekçiliği savundu. Sitemizde dün David Lewis'i anarken bu karşıtlığa değinmiştik: Lewis'in "inanmazlık bakışı"na karşı Stalnaker, olası dünyaları metafizik değil, konuşmanın ve düşüncenin araçları olarak tuttu. İki boyutlu semantik ve "köşegen önerme" kavramı, David Chalmers'ın bilinç felsefesindeki iki boyutlu çerçevesinin kaynaklarındandır. Stalnaker bugün Filozof Dizini'ne eklendi.
Yapay zekâ tartışmasında felsefeye genellikle iki rol biçiliyor: ya etik bekçi ya da "bilinç var mı" sorusunun sahibi. Stalnaker örneği üçüncü bir rolü gösteriyor: Kavramsal altyapı sağlayıcı. Dil modellerinin ne yaptığını ölçmek isteyen araştırmacılar, "pragmatik yeterlik" derken neyi kastettiklerini tanımlamak zorunda; ve elli yıl önce bir dil felsefecisinin olası dünyalarla kurduğu model, bugün bu tanımın en kullanışlı hâli. Sitemizde bu ay Britanya'da felsefe bölümleri kapanırken yapay zekâ şirketlerinin filozof istihdam ettiğini yazmıştık; Stalnaker'ın 1978 makalesinin 2026'daki kaderi, bu paradoksun içeriğini gösteriyor. Şirketlerin aradığı şey, tam olarak, hiçbir pratik amaçla yazılmamış bir kuramın açıklayıcı gücü.
Felsefeyi "kim haklı?" sorusundan "kimin sözüne neden inanıyoruz?" sorusuna çevirdi. Epistemik adaletsizlik kavramının yaratıcısı, iki hafta sonra Columbia'da Dewey Konferansları'nı verecek: Suçlama ve özür talebi, ahlaki 'baskı' olmadan mümkün mü? Fricker'ın yirmi yıllık yolculuğu — bilgi etiğinden ahlaki failliğin biçimlendirilmesine.
"Bilinç bir sır değilse nedir?" Dennett felsefeyi laboratuvara soktu; ama laboratuvarı da felsefeye teslim etmedi. Ryle'ın öğrencisi, Darwin'in savunucusu, 'içimizdeki küçük ben' sezgisinin en inatçı düşmanı. Ölümünden iki yıl sonra, yapay zekâ çağının en çok ihtiyaç duyduğu kavram onun: kavrayışsız yetkinlik.