GEO Optimizasyonunda En Önemli Ölçümler ve Karar Çerçevesi (2026)
Hangi metrik hangi kararı verdirir: teşhisten önceliklendirmeye bir çalışma sistemi
GEO'da izlenmesi gereken metrikler üç katmana ayrılır: sonuç metrikleri (AI görünürlük skoru, kaynak payı, AI kaynaklı dönüşüm), teşhis metrikleri (sorgu kapsamı, motorlar arası sapma, rakip yer değiştirme) ve altyapı metrikleri (tarayıcı erişimi, şema kapsamı, cevap pasajı oranı, tazelik). Karar kuralı basittir: önce altyapı, sonra teşhis, en son sonuç metriklerine bakılır.
Nasıl Yapılır? Adım Adım
- 1Altyapı metriklerinden başlayın: AI tarayıcılarının (GPTBot, ClaudeBot, PerplexityBot, Google-Extended, CCBot) erişimi açık mı, sayfalar statik olarak sunuluyor mu, şema kapsamı yüzde kaç. Bu katman kırıkken diğer ölçümler yalnızca semptomu gösterir.
- 2Teşhis metriklerini çıkarın: sorgu setinizin hangi niyet kovaları boş dönüyor, hangi motorda sapma var, sizin yerinize hangi rakip ve hangi sayfa alıntılanıyor.
- 3Sonuç metriklerini bir temel (baseline) olarak sabitleyin: ağırlıklı AI görünürlük skoru, kaynak payı ve AI kaynaklı trafiğin dönüşüm oranı. Temel alınmadan yapılan iyileştirme ölçülemez.
- 4Her boşluğu etki × maliyet ile puanlayın. Yüksek etki ve düşük maliyetli işler (şema, doğrudan cevap bloğu, ön-render) her zaman ilk sıraya girer; site dışı otorite çalışmaları uzun kuyruktadır.
- 5Tek bir değişkeni değiştirip yeniden ölçün. Aynı hafta hem şema hem içerik hem site dışı çalışma yayına alınırsa hangisinin işe yaradığı öğrenilemez.
- 6Her döngüde değişim nedenini etiketleyin (kendi yayınımız, rakip yayını, model güncellemesi) ve kararı yazıya dökün. Etiketlenmemiş dalgalanma üç ay sonra karar üretmez.
2026'da ölçüm önceliklerini değiştiren gelişmeler
GEO ölçümü 2026'da 'ne kadar trafik' sorusundan 'yanıt içinde ne kadar varlık' sorusuna kaydı. Karar çerçevesini etkileyen üç gelişme:
- Zero-click gerçeği: Bilgi amaçlı sorguların yaklaşık %60'ı tıklama olmadan sonuçlanıyor; bu nedenle trafik tek başına başarı ölçüsü değil, gecikmeli bir ikincil göstergedir.
- Trafik kalitesi ayrıştı: AI kaynaklı trafik, organik aramaya kıyasla ölçümlerimizde %23 daha düşük hemen çıkma oranı gösteriyor; yani daha az ama daha nitelikli ziyaretçi.
- İçerik biçimi ölçülebilir hale geldi: Aggarwal vd. (KDD 2024) çalışması, alıntı zengini yazımın görünürlüğü +%40,8, istatistik yoğunluğunun +%30,6, alıntılanabilir kaynak eklemenin +%115,1 artırdığını; anahtar kelime doldurmanın ise -%8,3 zarar verdiğini gösterdi. Bu, içerik kararlarını fikirden ölçüme taşıdı.
Üç metrik katmanı ve hangi soruyu yanıtladıkları
GEO ölçümünde en sık yapılan hata, tüm metrikleri aynı panele koyup eşit ağırlıkta okumaktır. Metrikler aslında farklı sorulara cevap verir ve farklı hızlarda hareket eder:
| Katman | Metrikler | Yanıtladığı soru | Hareket hızı |
|---|---|---|---|
| Altyapı | Tarayıcı erişimi, statik render, şema kapsamı, cevap pasajı oranı, tazelik | AI motorları içeriğimi görebiliyor ve ayrıştırabiliyor mu? | Günler |
| Teşhis | Sorgu kapsamı, motorlar arası sapma, rakip yer değiştirme, kaynak payı | Neden görünmüyorum, boşluk tam olarak nerede? | Haftalar |
| Sonuç | AI görünürlük skoru, mention rate, citation, AI kaynaklı dönüşüm | Yaptıklarım işe yaradı mı? | Haftalar-aylar |
Okuma sırası da bu tablodaki sıradır. Altyapı katmanı kırıkken (örneğin sayfalar yalnızca istemci tarafında render ediliyorsa) sonuç metriklerine bakıp içerik stratejisi tartışmak, motoru çalışmayan arabanın lastik basıncını konuşmaya benzer.
Sonuç metrikleri: neyi başarı sayacaksınız?
Sonuç metrikleri yönetime raporlanan, yavaş hareket eden metriklerdir. Dördü yeterlidir; daha fazlası panel şişkinliği yaratır.
- Ağırlıklı AI görünürlük skoru: Mention Rate (%40), Position (%30), Sentiment (%20) ve Citation (%10) boyutlarının ağırlıklı ortalaması. Tek sayıya indirgenmesi, dönemler arası karşılaştırmayı mümkün kılar.
- Kaynak payı (share of citation): Yanıtlarda alıntılanan URL'ler içinde sizin payınız. Görünürlüğün en zor kazanılan ve en dayanıklı biçimidir.
- AI kaynaklı dönüşüm oranı: AI motorlarından gelen ziyaretçinin dönüşüm performansı. Ölçümlerimizde bu trafik, organik aramaya kıyasla %23 daha düşük hemen çıkma oranı ve %4,1 dönüşüm oranı düzeyinde performans gösterdi.
- Kapsanan sorgu oranı: Tanımladığınız ticari sorgu setinin yüzde kaçında herhangi bir görünürlüğünüz var. Sıfırdan çıkış dönemlerinde en dürüst ilerleme göstergesidir.
Teşhis metrikleri: kararı asıl bunlar verdirir
Sonuç metrikleri 'iyi mi kötü mü' der; teşhis metrikleri 'ne yapmalı' der. GEO çalışmasının haftalık gündemi bu katmandan çıkar.
- Sorgu kapsamı boşlukları: Kategori, problem, karşılaştırma ve satın alma kovalarından hangileri boş dönüyor. Boş kova, doğrudan içerik takvimi maddesidir.
- Motorlar arası sapma: Bir motorda görünüp diğerinde görünmemek genellikle teknik bir nedeni işaret eder (tarayıcı engeli, render, şema). Tüm motorlarda görünmemek otorite ve içerik sorununu işaret eder. Bu ayrım, teknik ekiple içerik ekibi arasındaki iş bölümünü belirler.
- Rakip yer değiştirme: Sizin yerinize kim, hangi sayfasıyla anılıyor. Rakibin alıntılanan sayfasının biçimi (karşılaştırma tablosu, fiyat sayfası, liste içeriği) ne üretmeniz gerektiğini doğrudan söyler.
- Üçüncü taraf kaynak payı: Yanıtlar sizi veya rakibi değil de bağımsız 'en iyi X' liste içeriklerini alıntılıyorsa sorun sitenizde değil, site dışı ayak izinizdedir; çözüm de site içi değil, site dışıdır.
- Ton kırılması: Anılıyorsunuz ama 'pahalı', 'karmaşık', 'sınırlı' gibi çerçevelerle. Bu, görünürlük değil konumlandırma sorunudur ve içerik değil mesaj düzeltmesi gerektirir.
Altyapı metrikleri: en ucuz ve en hızlı kazanç
Altyapı katmanı, GEO'da etki/maliyet oranı en yüksek işlerin bulunduğu yerdir. Beş metrik yeterlidir ve hepsi kısa sürede ölçülüp düzeltilebilir:
- AI tarayıcı erişimi: GPTBot, ClaudeBot, PerplexityBot, Google-Extended ve CCBot robots.txt'te izinli mi. Kapalıysa diğer her şey teoriktir.
- Statik erişilebilirlik: İçerik JavaScript çalıştırılmadan görünüyor mu. AI tarayıcıları genelde JS çalıştırmaz; ön-render edilmemiş SPA'lar pratikte boş sayfa olarak görülür.
- Şema kapsamı: Sayfaların yüzde kaçında geçerli JSON-LD var (Organization, Article, FAQPage, HowTo) ve doğrulamadan hatasız geçiyor mu.
- Cevap pasajı oranı: Sayfaların yüzde kaçı, başlıktaki soruya ilk 40-60 kelimede doğrudan cevap veren alıntılanabilir bir blokla açılıyor.
- Tazelik: Görünür 'son güncelleme' tarihi ve şemadaki dateModified tutarlı mı; içerik son 12 ayda revize edildi mi.
Karar çerçevesi: dört adımda önceliklendirme
Metrikler toplandıktan sonra soru 'ne biliyoruz' değil, 'bu hafta ne yapıyoruz' olur. Kullandığımız çerçeve dört adımdır ve sırası önemlidir.
1. Kapı kontrolü (gate). Altyapı metriklerinden herhangi biri kırıksa gündem otomatik olarak odur. Tarayıcı engeli veya render sorunu varken içerik üretmek, kapalı bir dükkâna vitrin yapmaktır.
2. Boşluk tespiti. Teşhis metriklerinden boş sorgu kovaları ve kaynak payı tablosu çıkarılır. Her boşluk tek bir cümleyle yazılır: 'Karşılaştırma sorgularında görünmüyoruz, yanıtlar üçüncü taraf listeleri alıntılıyor.'
3. Etki × maliyet puanlaması. Her boşluk için beklenen etki (kaç sorguyu kapatır, hangi niyet kovasına dokunur) ve maliyet (adam-gün) puanlanır. Deneyimimizde sıralama genellikle şöyle oluşur: ön-render ve şema (yüksek etki, düşük maliyet) → doğrudan cevap pasajları → karşılaştırma ve fiyat içerikleri → varlık haritalama → site dışı ayak izi (yüksek etki, yüksek maliyet, uzun vade).
4. Tek değişkenli doğrulama. Bir döngüde tek bir tür değişiklik yayına alınır ve aynı sorgu setiyle yeniden ölçülür. Bu disiplin yavaş görünür ama üç ay sonra elinizde 'bizim sitemizde ne işe yarıyor' bilgisi olur; aksi halde yalnızca bir dalgalanma grafiği kalır.
Çerçevenin tek katı kuralı şudur: ölçüm bir eylem listesi üretmiyorsa o ölçüm gereksizdir.
Örnek kullanım: aynı skorun iki farklı kararı
İki markanın da ağırlıklı AI görünürlük skoru düşük çıksın. Aynı sayı, tamamen farklı iki karar üretir.
A markası: Sekiz motorun tamamında mention rate sıfıra yakın. Altyapı kontrolünde sayfaların istemci tarafında render edildiği ve şema bulunmadığı görülüyor. Karar: içerik üretimi durdurulur, önce ön-render ve JSON-LD şema devreye alınır, ardından her sayfaya doğrudan cevap bloğu eklenir. Bu tipik profilde ilk ölçülebilir sıçrama haftalar içinde gelir; benzer bir vakada ChatGPT mention rate %0'dan %73'e çıkmıştır.
B markası: Perplexity ve ChatGPT'de görünüyor, Gemini ve Copilot'ta görünmüyor; ayrıca yanıtlar çoğunlukla üçüncü taraf 'en iyi X araçları' listelerini alıntılıyor. Altyapı temiz. Karar: teknik iş yok; gündem site dışı ayak izi ve varlık haritalamadır — inceleme platformları, liste içeriklerinde yer alma, Wikidata/Wikipedia tutarlılığı ve kurucu Person varlığının sameAs bağlantıları.
Aynı sonuç metriği, teşhis katmanı olmadan okunduğunda her iki markayı da aynı yanlış işe yönlendirirdi.
Botfusions'ın yaklaşımı
Botfusions'ta ölçüm, rapor üretmek için değil karar üretmek için yapılır. Sistemin üç sabiti vardır.
Tek skor, açık formül. AI Visibility Score, Mention Rate (%40), Position (%30), Sentiment (%20) ve Citation (%10) boyutlarının ağırlıklı ortalamasıdır. Formül kamuya açıktır ve müşteri raporlarında da benchmark çalışmamızda da aynıdır; 80 ticari sorgu 7 modelde test edilerek 560 veri noktası toplanan çalışma bunun yayımlanmış hâlidir.
Sekiz motor. Ölçüm ChatGPT, Perplexity, Gemini, Claude, Copilot, Meta AI, Google AI Overviews ve DeepSeek'i kapsar; motorlar arası sapma bizim için bir gürültü değil, teşhis aracıdır.
Kapı kuralı. Altyapı metriklerinden biri kırıkken içerik üretimi başlatmayız. Ön-render, şema ve doğrudan cevap blokları tamamlanmadan yapılan içerik yatırımı, ölçülemeyen bir harcamaya dönüşür. Bu yüzden çalışmalarımız denetimle başlar, içerikle değil.
Dürüst sınır: GEO bir sıralama garantisi değildir. Model güncellemeleri kısa vadeli dalgalanma yaratır; bizim iddiamız dalgalanmayı yok etmek değil, dalgalanmanın ortalamasını yukarı taşımak ve her hareketin nedenini etiketleyebilmektir.
İlgili kaynaklar ve vaka çalışmaları
Karar çerçevesini uygulamaya dönüştürmek için:
- AI görünürlük izleme nasıl çalışır — ölçüm boru hattının mekaniği ve dört boyut
- AEO araçları ne yapar, ne yapmaz — hangi katmanı hangi araç kapatır
- AI arama optimizasyonu rehberi — GEO'nun temel disiplinleri
- Ölçüm metodolojimiz — skor hesabı ve veri toplama kuralları
- AI Görünürlük Benchmark Raporu 2026 — metodolojinin kamuya açık uygulaması
- Vaka çalışmaları — anonimleştirilmiş öncesi/sonrası ölçümler
- GEO hizmeti, AI SEO hizmeti ve fiyatlandırma — kapsam ve çalışma modeli
Sıkça Sorulan Sorular
GEO'da en önemli metrik hangisidir?
Tek bir metrik yoktur; katmana göre değişir. Sonuç düzeyinde ağırlıklı AI görünürlük skoru (Mention %40, Position %30, Sentiment %20, Citation %10) en özet göstergedir. Ancak karar aldıran metrikler teşhis katmanındadır: sorgu kapsamı boşlukları, motorlar arası sapma ve kaynak payı. Altyapı katmanı kırıkken hiçbir sonuç metriği anlamlı değildir.
GEO sonuçları ne zaman görünür?
Altyapı düzeltmeleri (ön-render, şema, doğrudan cevap blokları) genellikle haftalar içinde ölçülebilir fark yaratır çünkü motorların içeriği görebilmesini sağlarlar. Site dışı otorite ve varlık çalışmaları aylar sürer. Model güncellemeleri kısa vadeli dalgalanma yarattığı için tek haftalık okumalar yerine çok haftalı ortalamalara bakılmalıdır.
Trafik artmadı ama skor yükseldi, bu başarı mı?
Evet, olabilir. Bilgi amaçlı sorguların yaklaşık %60'ı tıklama olmadan sonuçlandığı için yanıt içindeki varlık, trafiğe dönüşmeden de marka etkisi üretir. Kontrol edilmesi gereken şey trafiğin miktarı değil kalitesidir: AI kaynaklı ziyaretçi ölçümlerimizde organik aramaya kıyasla %23 daha düşük hemen çıkma oranı ve %4,1 dönüşüm oranı gösterdi.
Önceliklendirmeyi nasıl yapmalıyım?
Dört adım: (1) altyapı kapısını kontrol edin, kırıksa gündem odur; (2) teşhis metriklerinden boşlukları tek cümleyle yazın; (3) her boşluğu etki × maliyet ile puanlayın — ön-render ve şema neredeyse her zaman ilk sıradadır; (4) bir döngüde tek tür değişiklik yayınlayıp aynı sorgu setiyle yeniden ölçün.
İçerik biçimi ölçüme nasıl yansır?
Doğrudan yansır. Aggarwal vd. (KDD 2024) çalışması, alıntı zengini yazımın AI görünürlüğünü +%40,8, istatistik yoğunluğunun +%30,6, alıntılanabilir kaynak eklemenin +%115,1 artırdığını; anahtar kelime doldurmanın ise -%8,3 zarar verdiğini gösterdi. Bu nedenle içerik kararları biçim düzeyinde ölçülebilir ve A/B mantığıyla doğrulanabilir.
Kaç sorgu ile ölçüm yapmalıyım?
Çoğu B2B ekip için 30-80 ticari niyetli sorgu yeterlidir; benchmark çalışmamızda 80 sorgu 7 modelde çalıştırılarak 560 veri noktası toplanmıştır. Sorgu sayısını artırmaktan daha önemlisi, seti niyet kovalarına (kategori, problem, karşılaştırma, satın alma) dengeli dağıtmak ve dönemler boyunca sabit tutmaktır.
Ölçümleriniz Karar Üretiyor mu?
Yapay zeka modellerinin markanızı nasıl algıladığını ve rakiplerinizle arasındaki farkı bugün keşfedin.