Tasarım gereği şeffaf

Bir skor
açıklanabilir olmalı.

Bu sayfa nelerin sorulduğunu, hangi yüzeylerin ölçüldüğünü, öneri durumlarının nasıl sınıflandırıldığını, rakiplerin nasıl tespit edildiğini, kısa listedeki payınızın nasıl hesaplandığını, prompt sürümlerinin nasıl dondurulduğunu, sistemin neyi ilişkilendirip neyi ilişkilendiremediğini ve VISIBLE'ın üçüncü taraf yapay zekâ sıralamalarını neden asla garanti etmediğini açıklar.

Ücretsiz kontrol için kredi kartı gerekmez. 99 $'lık İstihbarat, Autopilot'a 30 günlük Erken Erişim içerir.

Puan, dört ölçülen sorudan oluşur, ağırlıklandırılmış ve ortalaması alınmış.

Her bölüm motor başına hesaplanır ve onu ölçen motorlar arasında ortalaması alınır. Arkasında kanıt bulunmayan bir bölüm çıkarılır ve kalan ağırlıklar yeniden normalize edilir — asla sıfır olarak gösterilmez, çünkü "hiçbir motor bir şey alıntılamadı" ile "hiçbir şey sizi desteklemedi" farklı bulgulardır.

  1. 35%Yanıtta hiç yer alıyor musunuz?
  2. 30%Gerçekten öneriliyor musunuz, yoksa sadece adınız mı geçiyor?
  3. 20%Varlığınızı destekleyen güvenilir kaynaklar var mı?
  4. 15%Yapay zekâ markanızı doğru anlıyor mu?

Başlık rakamı bir tam sayıdır. Motor başına soru başına tek bir geçiş, bir ondalık puanı desteklemez ve 45,8 yazdırmak örneklemin taşıyamayacağı bir kesinlik iddia eder.

Bugün aldığınız rapor ve panel, bu dört bölümü hâlâ denetim motorunun özgün adlarıyla etiketliyor. Bu terminolojiyi bu sitenin kullandığı beş ölçüte taşımak ayrı bir çalışmadır ve bu tamamlanana kadar ikisi kelimesi kelimesine örtüşmeyecektir.

Dokuz modül, ve her birinin ne yaptığı.

Ürünün bir şey yaptığı yerde bu, ne yaptığını söyler. Henüz yapmadığı yerde ise bunu söyler.

Money Prompt seçimi ve sürümlemesi

Her kategorinin sürümlü bir dosya olarak tutulan bir prompt kütüphanesi vardır ve her soru geldiği setin sürümünü taşır.

Ücretli denetim; keşif, sorun ve kullanım senaryosu, karşılaştırma, güven, ticari niyet, marka algısı ve uzun kuyruk genelinde otuz soru sorar; ücretsiz kontrol sekiz soru sorar. Otuz sorunun onu ticari çekirdektir ve birden fazla kez sorulur.

Hatalı biçimlendirilmiş, eksik veya aynı kimliği paylaşan iki soru içeren bir kütüphane, kısmen yüklenmek yerine tamamen reddedilir — sessizce kısaltılmış bir araç, sessizce yanlış bir puan üretir.

Önerilme sınıflandırıcısı

Her yanıttaki her marka beş puanlık bir ölçekte değerlendirilir: yok, bahsedildi, değerlendirildi, önerildi, en üst öneri — bu sitenin Yok, Bahsedildi, Değerlendirildi, Önerildi ve İlk Tercih olarak yazdığı merdiven.

Puan, çıkarım katmanının yanıtı kendi okumasından türetilir, bu yüzden ekstra bir model çağrısına mal olmaz ve zaten çalıştırılmış denetimler saklanan satırlardan yeniden puanlanabilir.

Bir soru, Önerildi ve üzeri düzeyden itibaren kazanılmış sayılır. Seçenekler arasında listelenmek önerilmek anlamına gelmez ve ölçütün asıl değerini kazandığı yer bu ikisi arasındaki farktır.

Share of Shortlist hesaplaması

İzlenen markalar arasında dağıtılan her önerinin, sizinkine giden payı budur — yalnızca öneriler, asla ham bahsetmeler değil; böylece her yanıtta küçümseyerek anılan bir marka iyi puan almaz.

Payda, siz ve izlenen rakipleriniz üzerinden kapatılır; bu da rakamın yalnızca aynı rekabet setinin çalıştırmaları arasında karşılaştırılabilir olduğu anlamına gelir. Daha sonra bir rakip eklemek tüm geçmiş rakamları değiştirir, bu yüzden set kasıtlı olarak sabittir.

Setteki hiçbir marka hiçbir yerde önerilmediğinde, hizmet herkes için %0 yazdırıp ölçülmüş bir beraberlik ima etmek yerine, bölünecek bir şey olmadığını bildirir.

Brand Truth karşılaştırması

planlanan

Modellerin şirketiniz hakkında yaptığı iddialar, kendi web sitenizin metnine karşı değerlendirilir: desteklenmiş, çelişen veya ele alınmamış.

Sitenizin hiç değinmediği bir iddia doğrulanmamış kalır. "Siteniz bunu söylemiyor" ile "model yalan söyledi" aynı şey değildir; ikisini birbirine karıştırmak, 300 zararsız yeniden ifadeden oluşan bir kaydın bir suçlamaya dönüşmesinin yoludur.

Doğrulama çalıştırılamıyorsa — site erişilemez, değerlendirici kullanılamıyor — kayıt dokunulmadan bırakılır. Bir satırı doldurmak için asla bir hüküm uydurmaz.

Henüz yapılmadıEksik, güncel değil ve tutarsız, makine tarafından atanan ayrı durumlar olarak. Bugün hizmet yalnızca doğrulanmış, yanlış ve doğrulanmamış olarak ayırıyor.

Makine okunabilirliği kontrolleri

Hizmet, sitenin kırk sayfasına kadarını tarar ve yanıt motorlarının kendi tarayıcılarının içeri alınıp alınmadığını kontrol eder — GPTBot, ClaudeBot, PerplexityBot, Google-Extended ve diğerleri isim isim kontrol edilir.

Ham HTML'yi işlenmiş sayfayla karşılaştırır, sayfa yapısını okur ve modellerin bir şirketi tanımlarken dayandığı üçüncü taraf kaynaklarda markayı arar. Her bulgu bir önem derecesi ve ne yapılması gerektiğine dair açık bir açıklama taşır.

Bu, puanın yanında bildirilir ve kasıtlı olarak puanın dışında tutulur: iyi kurulmuş bir web sitesi, hiçbir modelin önermediği bir markayı gizleyebilmemelidir.

Eylem risk politikaları

planlanan

Yeşil, Turuncu ve Kırmızı, bir eylemin kendi başına ne kadarını yapabileceğini tanımlar: otomatik yayınlanma, tek tıkla onay bekleme veya asla otomatik yayınlanmama.

Bugün çalışan denetim hizmeti ölçer ve teşhis eder. Bulgular, sıralanmış öncelikler ve 90 günlük bir plan üretir; sitenize hiçbir şey yayınlamaz.

Henüz yapılmadıBu politikaları taşıyan uygulama katmanı. Bu katman yayınlanana kadar VISIBLE'ın önerdiği her eylemi bir kişi uygular.

Doğrulama pencereleri

planlanan

Doğrulama, yeni sorular sormak yerine aynı dondurulmuş soruları yeniden sormak anlamına gelir. Araç sürümlendiği için, sonraki bir çalıştırma yapısı gereği önceki bir çalıştırmayla karşılaştırılabilir.

Tekrarlanan araç, çekirdek ticari sorularını her çalıştırmada birden fazla kez sorar. Tekrarlar, "aynı yanıt, tekrar sorulduğunda"nın ölçülebilir olmasını sağlayan ve bir rakamın etrafındaki aralığı daraltan şeydir.

Ücretsiz kontrol, motor başına soru başına tek bir geçiş yapar, bu yüzden bir güven aralığı veya trend taşımaz — ve bunu kendi raporunda belirtir.

Henüz yapılmadıBir eylemin tarihinden itibaren planlanan yeniden test pencereleri; böylece belirli bir değişiklik hedeflediği sorulara karşı ölçülebilir.

Deney sonuç durumları

planlanan

İyileşti, Hareket Yok, Belirsiz ve Geriledi, bir deneyin sonuçlanabileceği tek dört hükümdür ve bunlardan üçü kazanım değildir.

Hizmet içinde bugün bu durumları hiçbir şey atamıyor. Bunlar, henüz var olmadan önce burada yayınlanan ve ona uyulmasını sağlayan doğrulama döngüsünün sözleşmesidir.

Henüz yapılmadıBir temel çizgiyi, bir eylem tarihini ve bir yeniden testi kaydeden deney kaydı.

Bilinen sınırlamalar ve yüzey erişilebilirliği

Ücretli denetim yedi yüzeyi ölçer: ChatGPT, Claude ve Gemini'nin her biri hem hafızadan hem de canlı web aramasıyla yanıt verir, artı Perplexity. Ücretsiz kontrol bunların dördünü ölçer. Google AI Overviews inşa edilmiştir ancak ücretli bir arama sağlayıcısı yapılandırılana kadar kapalıdır ve rapor her zaman hangi yüzeylerin gerçekten yanıt verdiğini belirtir.

Her motor eşit şekilde ağırlıklandırılır. Bir yüzeyi diğerinden daha ağır tutmak, alıcıların nerede soru sorduğuna dair olgusal bir iddiadır ve böyle bir iddianın arkasında doğrulanmış veri yoktur, bu yüzden hizmet böyle bir iddiada bulunmaz.

Yapay zekâ yanıtları olasılıksaldır ve üçüncü taraf kaynaklıdır. VISIBLE ölçülen hareketi ve güveni bildirir; nedensellik, alıntı veya sıralama sonuçlarını garanti etmez.

Ücretsiz keşfet

Müşterileriniz zaten yapay zekâya soruyor.

Yapay zekânın sizi mi — yoksa rakiplerinizi mi — kısa listeye koyduğunu öğrenin.

  • Kart gerekmez
  • Rapor e-postayla gönderilir
  • Verilerinizi istediğiniz zaman silin

Bir sorununuz olduğunu zaten biliyor musunuz?