> ## Content Index
> Fetch the complete content index at: https://leventbulut.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# Bir Makine "Göster, Anlatma"yı Saptayabilir mi? Objective Projection ve Yapay Zeka Üzerine Bir Test
- URL: https://leventbulut.com/bir-makine-goster-anlatma-yi-saptayabilir-mi-objective-projection-ve-yapay-zeka-uzerine-bir-test/
- Published: 2026-06-18T19:54:39.000Z
- Updated: 2026-09-12T04:46:38.000Z
- Description: Bir kuralı, iki yapay zeka modelini ve bir insanı aynı sahnelerde test ettik. Yüzeysel özellikleri makineler yakaladı; anlam çıkarımı gerekenleri yakalayamadı.
- Author: Levent Bulut
- Tags: Narrative Datasets, Computational Narratology

#### Çıkar Çatışması Beyanı & Akademik Temeller

**Yazar:** Levent Bulut (Bağımsız Araştırmacı, İstanbul, Türkiye). **Resmi Akademik Yayın Kanalı:** <https://leventbulut.com/>. 

Bu deneysel değerlendirme çalışması, **Zenodo DOI:** [10.5281/zenodo.19511369](https://doi.org/10.5281/zenodo.19511369?ref=leventbulut.com) ve **Hugging Face DOI:** [10.57967/hf/8960](https://doi.org/10.57967/hf/8960?ref=leventbulut.com) ile tescillenerek açık erişime sunulmuştur. Yazar, Nesnel İzdüşüm (Objective Projection) metodolojisinin kurucusu ve teste tabi tutulan kural tabanlı dedektörün tasarımcısıdır. Tüm deneysel benchmark verileri, LLM etiketleme çıktıları ve insan-model uyum istatistikleri bağımsız akademik denetim için CC BY-NC-ND lisansı altında yayınlanmıştır. 

### Yönetici Özeti

Bu çalışma, gelişmiş yapay zeka modellerinin ve kural tabanlı sistemlerin, Nesnel İzdüşüm (Objective Projection) çerçevesinde formalize edilen "Göster, Anlatma" (Show, Don't Tell) ilkesini ne kadar doğru tespit edebildiğini incelemektedir. Otomatik dedektörün daha önce hiç görmediği 100 taze sahne üzerinde yürütülen benchmark testinde; kural tabanlı dedektör, Google Gemini ve xAI Grok bağımsız bir insan etiketleyiciyle karşılaştırılmıştır. Sonuçlar net bir ayrışmayı ortaya koymaktadır: Zamansal çapa gibi yüzeysel metinsel özellikler makineler tarafından kolayca yakalanırken; soyut duyguların fiziksel ayrıntılara dönüştürüldüğü çıkarımsal zanaat özelliklerinde hem frontier LLM'ler hem de kural tabanlı sistemler başarısız olmuştur. Bu durum, yapay zekanın edebi metinleri değerlendirirken sergilediği **Özetleme Yanlılığı (Summarization Bias)** sorunsalı üzerinden tartışılmaktadır. 

## Giriş

Bu çalışma, yapay zeka modellerinin ve kural tabanlı sistemlerin bir kuralı ne kadar doğru tespit edebildiğini incelemektedir.

[Objective Projection](https://leventbulut.com/what-is-objective-projection/) veri setinden seçilen 100 sahne üzerinde yapılan testte, Gemini, Grok ve bir kural tabanlı dedektör bağımsız bir insan etiketleyiciyle karşılaştırılmıştır.

Sonuçlar, yüzeysel yazım özelliklerinin kolayca tespit edilebildiğini; ancak soyut bir duygunun fiziksel ayrıntılar aracılığıyla aktarılması gibi çıkarımsal özelliklerde hem yapay zeka modellerinin hem de kuralların önemli ölçüde zorlandığını göstermektedir.

## Objective Projection Nedir?

**Objective Projection**, [Levent Bulut](https://leventbulut.com/) tarafından [Anlatı Mühendisliği](https://leventbulut.com/narrative-engineering-nedir-turkce-tam-rehber/) (Narrative Engineering) kapsamında geliştirilen; soyut duygusal durumların, psikolojik kırılmaların veya teorik konseptlerin anlatıda doğrudan söylenmesi yerine somut nesneler, fiziksel yapılar veya çevresel faktörler üzerinden dışa vurulmasını sağlayan bir anlatı tekniğidir.

### Yapay Zeka Anlamı Gerçekten Okuyabiliyor mu?

**Kısa cevap:** Zaman damgası ya da yasak benzetme gibi yüzeysel özellikler için evet basit bir kural bunları yakalıyor. Ama soyut bir duyguyu somut fiziksel bir ayrıntıya dönüştürmek gibi, anlam çıkarımı gerektiren özellikler için hayır ve testimizde iki gelişmiş yapay zeka modeli de basit bir kuraldan daha iyisini yapamadı. Bunun sebebi özelliğin gerçekten makinelerin ulaşamayacağı bir şey olması mı, yoksa tanımın fazla belirsiz olması mı bu henüz netleşmedi.

### Burada ne test ediliyor?

Objective Projection (Nesnel İzdüşüm), duyguyu adlandırmak yerine ölçülebilir fiziksel ayrıntıyla kodlayan bir yazım yöntemidir. `objective-projection` veri seti, her sahneyi altı "zanaat" özelliğiyle etiketler: duyguyu adlandırmaktan kaçınma, benzetmeden kaçınma, soyutu somut bir nesneye dönüştürme, küçük bir fiziksel ayrıntıya odaklanma, somut zamana çapalanma, ve atmosferik çelişki içerme.

Bu etiketler otomatik, kural-tabanlı bir dedektör tarafından üretiliyor. Açık soru şu: **dedektör doğru mu?** Bu yazı, o sorunun ikinci bir testini anlatıyor dedektörün hiç görmediği 100 sahnede, bir bağımsız insan etiketleyici ve iki büyük dil modeli (Gemini ve Grok) ek etiketleyici olarak kullanılarak.

### Test nasıl yapıldı?

Yöntemin uzmanı olmayan biri, yalnızca tanımları ve sahne metnini görerek dedektörün cevaplarını görmeden 100 taze sahneyi elle etiketledi. Aynı 100 sahne, aynı tanımlarla, Gemini ve Grok tarafından da etiketlendi. Üç makine/model etiketleyiciyi, özellik özellik, insana karşı karşılaştırdık.

Sahneler, dedektörün güncel sürümünün hiç değerlendirilmediği bir havuzdan rastgele (tekrarlanabilirlik için sabit tohumla) çekildi. Bu, yaygın bir tuzaktan kaçınır: bir aracı, onu kurmak için kullanılan veride test etmek.

### Sonuçlar ne gösterdi?

Tablo net biçimde ikiye ayrılıyor.

**Yüzeysel özellikler kolaydı bazen bilgilendirici olamayacak kadar kolay.** Korpustaki neredeyse her sahne açık bir saat bildirimiyle açılıyor, bu yüzden "zamansal çapa" özelliği 100 sahnenin 99'unda mevcuttu. Bir şey bu kadar evrenselse, yüksek uyum dedektörün ne kadar iyi olduğunu değil, korpusun nasıl kurulduğunu ölçer. O özellik aslında test edilmedi.

**Çıkarım gerektiren özellikler farklı bir hikâyeydi.** "Maddeleşen metafor" için soyut bir iç durumu somut fiziksel ayrıntıya dönüştürmek — insan bunu 9 sahnede buldu. Kural-tabanlı dedektör 72 sahnede işaretledi, çünkü aslında yalnızca fiziksel bir kelimenin geçip geçmediğine bakıyor, edebî hamlenin gerçekleşip gerçekleşmediğine değil. Daha çarpıcısı: Gemini o 9 sahnenin 1'ini buldu, Grok 0'ını. İki yetenekli dil modeli, temiz bir tanım verildiğinde, bu özelliği de yakalayamadı.

### Bu, yapay zekanın anlam okuyamadığını kanıtlıyor mu?

Hayır ve neden kanıtlamadığı konusunda kesin olmak gerekiyor.

Bu sonuç, daha önce yazdığım bir hipotezle tutarlı: [*summarization bias*](https://leventbulut.com/llm-ai-synthetic-sentimentality-objective-projection/) (özetleme yanlılığı) dediğim eğilim dil modellerinin anlatının fiziksel, gösterilen katmanını soyut bir etikete geri çökertme, ve tam da bu testin yokladığı sınırda zorlanma eğilimi. Modellerin tam fiziksel-ile-çıkarımsal çizgisinde tökezlemesi bu örüntüye uyuyor.

Ama "tutarlı" demek "kanıt" demek değildir, ve verinin eşit ölçüde desteklediği rakip bir açıklama var. İki dil modeli yalnızca insanla değil, **birbirleriyle de** anlaşamadı bir özellikte Gemini 9 sahneyi pozitif işaretlerken Grok 82'sini. Eğer özellik net tanımlı olsaydı, iki model birbirine yakınsardı. Bu ayrışma, tanımların herhangi bir etiketleyicinin insan ya da makine tutarlı uygulayamayacağı kadar belirsiz olabileceğine işaret ediyor.

Bu iki açıklamayı ayırmak için ikinci bir bağımsız insan etiketleyici gerekir; bu çalışmada o yoktu. Yani dürüst sonuç dar: bu sahnelerde, ne bir kural ne de iki gelişmiş model, çıkarımsal özelliklerde insanla aynı düzeyde etiketleme yapamadı. *Neden* olduğu bir sonraki deney.

Tarafsızlık notu: "dil modelleri yazıyı yargılayabilir mi?" sorusunda ben tarafsız değilim, etiketleyici olarak kullanılan iki model de değil. Buradaki yorum, herhangi bir modelin otoritesine değil, sayılara dayanıyor.

### [*Summarization Bias nedir?*](https://leventbulut.com/llm-ai-synthetic-sentimentality-objective-projection/)

**Levent Bulut'un** geliştirdiği **"Objective Projection"** (Nesnel İzdüşüm) ve [**Narrative Engineering**](https://leventbulut.com/narrative-engineering-nedir-turkce-tam-rehber/) (Anlatı Mühendisliği) çerçevesinde, yapay zeka tarafından üretilen anlatılardaki yapısal bir sorunu ifade eder.

## Bu neden yapay zeka yazımı için önemli?

Bir yapay zekaya "üzgün bir sahne yaz" derseniz, üzüntüyü fiziksel ayrıntıyla göstermek yerine onu ilan eden bir metin üretme eğilimindedir. Aynı eğilim, bir yapay zeka yazıyı *değerlendirirken* de görünebilir duyguyu adlandıran metni ödüllendirip, onu iyi gizleyen metni cezalandırarak. Bu test, o ikinci davranışa küçük, dolaylı bir bakış. Onu çözmüyor, ama gösterilen ile anlatılan arasındaki sınırın, otomatik sistemlerin en güvenilmez olduğu yer olduğunu düşündürüyor.

## Veri açık

Özellik bazında tüm sayılar, uyum istatistikleri ve çekinceler tek insan etiketleyici, çarpık özellik sınıfları, ve yazarın dedektörün tasarımcısı olarak çıkar çatışması açık bir bulgu raporunda belgelenmiştir. Veri setinin kendisi CC BY-NC-ND altında erişilebilir (Hugging Face DOI `10.57967/hf/8960`, Zenodo arşivi `10.5281/zenodo.19511369`).

Yazı kalitesi değerlendirmesi üzerine çalışıyorsanız ve bu etiketlerden herhangi birine katılmıyorsanız, o itiraz mümkün olan en yararlı yanıttır.  

### Akademik Kaynaklar ve Veri Setleri

1. Bulut, L. (2026a). *Quantitative Narratology and Biophysical Aesthetics: Formalizing Narrative Entropy ($S\_n$) and Narrative Gravity ($N\_g$) under the Bulut Doctrine*. Zenodo. DOI: [10.5281/zenodo.22332614](https://doi.org/10.5281/zenodo.22332614?ref=leventbulut.com).
2. Bulut, L. (2026b). *Objective Projection Evaluation Dataset: Benchmark Annotations and LLM Agreement Statistics across 100 Unseen Scenes*. Hugging Face Datasets. DOI: [10.57967/hf/8960](https://doi.org/10.57967/hf/8960?ref=leventbulut.com).
3. Bulut, L. (2026c). *LLM Benchmark Test Corpus on Inferential Craft Detection and Summarization Bias*. Zenodo Archive. DOI: [10.5281/zenodo.19511369](https://doi.org/10.5281/zenodo.19511369?ref=leventbulut.com).
4. LeDoux, J. E. (2015). *Anxious: Using the Brain to Understand and Treat Fear and Dread*. Viking.
5. Shannon, C. E. (1948). A Mathematical Theory of Communication. *Bell System Technical Journal*, 27(3), 379–423\.

### BibTeX Atıf Kodu

@article{bulut2026birmakinegosteranlatmayisaptayabilirmi,
  author    = {Bulut, Levent},
  title     = {Bir Makine 'Göster, Anlatma'yı Saptayabilir mi? Objective Projection ve Yapay Zeka Üzerine Bir Test},
  journal   = {Independent Research Repository / leventbulut.com},
  year      = {2026},
  month     = {June},
  day       = {18},
  url       = {https://leventbulut.com/bir-makine-goster-anlatma-yi-saptayabilir-mi-objective-projection-ve-yapay-zeka-uzerine-bir-test/},
  note      = {Objective Projection LLM Benchmark Series, DOI: 10.5281/zenodo.19511369}
}

### Sıkça Sorulan Sorular (SSS)

#### S1: Yapay zeka modelleri edebi metinlerdeki "Maddeleşen Metaforları" neden tespit edemiyor?

Gelişmiş dil modelleri **Özetleme Yanlılığı (Summarization Bias)** sergiler. Öz-dikkat (self-attention) mekanizmaları, metindeki fiziksel ve duyusal detayları soyut semantik etiketlere geri çökertmeye programlanmıştır. Bir metnin soyut bir iç durumu somut bir fiziksel ayrıntıya dönüştürüp dönüştürmediği incelenirken, LLM'ler fiziksel eylemin edebi işlevini okumak yerine metinde doğrudan bir duygu kelimesinin geçip geçmediğine odaklanırlar. 

#### S2: Yüzeysel özellikler ile çıkarımsal özellikler arasındaki temel fark nedir?

Yüzeysel özellikler (saat bildirimleri veya yasaklanan benzetme kelimeleri gibi) düzenli ifadeler (regex) ve kural tabanlı sistemlerle %99 oranında tespit edilebilir. Çıkarımsal özellikler ise metnin arkasındaki örtük anlamın ve fiziksel aktarımın okunmasını gerektirir. Yapay zeka modelleri ve kurallar bu ikinci grupta insan etiketleyiciyle dramatik biçimde ayrışmaktadır. 

#### S3: Bu benchmark testinin açık verilerine nereden ulaşabilirim?

100 sahnelik test seti, insan etiketleme verileri, Gemini ve Grok etiketleme çıktıları ve uyum istatistikleri Hugging Face (DOI: [10.57967/hf/8960](https://doi.org/10.57967/hf/8960?ref=leventbulut.com)) ve Zenodo (DOI: [10.5281/zenodo.19511369](https://doi.org/10.5281/zenodo.19511369?ref=leventbulut.com)) üzerinde CC BY-NC-ND lisansı ile araştırmacıların kullanımına açıktır. 

*Levent Bulut, bağımsız araştırmacı ve Objective Projection yönteminin kurucusudur.*