Konu Başlıkları
Yükleniyor...

Kullanılabilirlik Testi: Kaç Katılımcı, Hangi Görevler, Hangi Bulgular

Beş Katılımcı Kuralı Ne Zaman Çalışır, Ne Zaman Yanıltır

Kullanılabilirlik testinin işi tasarımı onaylatmak değil, tasarımın nerede çöktüğünü görmek. Bu ayrımı kaçıran ekipler testten memnun ayrılır ve üç ay sonra aynı ekranı destek talepleriyle öğrenir. Aşağıda testin kurulumu kadar, herkesin ezbere tekrarladığı beş katılımcı kuralının nerede kırıldığı da var.

Görev yazımı, testin en belirleyici kısmı

Kötü kurulmuş bir test, iyi kurulmuş bir testten daha zararlıdır: yanlış veriyi kesinlik havasıyla üretir. Zararın büyük kısmı görev metninden gelir.

Görev, arayüzdeki kelimeleri içeriyorsa cevabı da veriyor demektir. "Filtreler bölümünden fiyat aralığını daralt" diye yazılan bir görevde katılımcı filtreyi bulur, çünkü adını siz söylediniz. Aynı görevin işe yarar hali şudur: "İki bin liranın altında, kargosu ücretsiz bir tane bulmaya çalış." İlk cümlede navigasyonu test etmiş olmazsınız, okuma becerisini test edersiniz.

Kolaylaştırıcının tarafsızlığı da aynı yere bakar. Katılımcı takıldığında yardım etmek refleksi güçlüdür, ve o refleks o oturumun verisini bitirir. Katılımcı sesli düşünmeyi bıraktığında tek meşru müdahale, ne yapmaya çalıştığını sormaktır; nereye bakması gerektiğini söylemek değil.

Beş katılımcı kuralı ve dayandığı varsayım

"Beş kişi yeter" cümlesi bir gözlemden değil, bir modelden geliyor. Nielsen'in formülü, tek bir katılımcının sorunların yaklaşık %31'ini ortaya çıkardığını varsayar. Beş kişide bulunamayan sorun oranı 0,69 üzeri 5, yani yaklaşık 0,16. Buradan çıkan sonuç: beş kişiyle sorunların yaklaşık %85'ini görürsünüz.

İki şey hemen görünür hale geliyor. Birincisi, kalan %15 kaybolmaz; kuyruğu kovalamak isteyen ekibin dokuz katılımcıya çıkması gerekir, çünkü %95'in altına inen ilk sayı odur. İkincisi ve daha önemlisi, model tek ve homojen bir kullanıcı grubu varsayar.

Üç ayrı segmentiniz varsa, örneğin yeni kayıt olan, düzenli kullanan ve yönetici yetkisiyle giren kullanıcılar, beş sayısı segment başına geçerlidir. Toplam on beş oturum eder. Planlama, kayıt, analiz ve raporlama eklendiğinde bunun "üç günde bitirilecek küçük bir çalışma" olmadığı açıktır. Kullanılabilirlik testini ucuz gösteren bütün anlatılar bu çarpanı görmezden gelir.

Beş kişilik turu tek seferde harcamak yerine ikiye bölerim: iki katılımcıyla başlar, ortaya çıkan bariz engelleri düzeltir, kalan üçünü düzeltilmiş sürümle test ederim. Aynı bütçeyle iki tur veri toplamış olursunuz, üstelik ikinci turda ilk turun gölgesinde kalan sorunlar görünür hale gelir.

Nitel mi nicel mi, moderasyonlu mu değil mi

Bu iki seçim genellikle karıştırılır. Nitel test sorunu bulur, nicel test sorunun büyüklüğünü ölçer. Elinizde henüz düzeltilmemiş bir akış varken tamamlanma süresi ölçmek zaman kaybıdır: neyi ölçtüğünüzü daha bilmiyorsunuz. Metrik toplamak, tasarımın bir sürümünü ikinciyle karşılaştıracağınız aşamanın işidir.

Moderasyon seçiminde tarafım net. Yeni bir akışı ilk kez sınıyorsanız modere test kurun; katılımcının neden durduğunu sorabilmek, o oturumdaki en değerli veridir. Modere olmayan uzaktan testler ise bilinen bir akışta değişiklik doğrulamak ya da çok sayıda katılımcıya hızla ulaşmak için doğru araçtır. Sırayı ters çevirenler, elinde otuz oturumluk kayıt olan ama hiçbirinde "neden" sorusunun cevabı bulunmayan ekiplerdir.

Bulguları düzeltme maliyetine göre ayırın

Test raporlarının çoğu bulguları ciddiyete göre sıralar ve orada bırakır. Eksik olan ikinci eksen, düzeltmenin nereye dokunduğu.

  • Metin ve etiket sorunları: aynı gün çözülür, kimseyle pazarlık gerektirmez.
  • Ekran içi düzen ve durum sorunları: bir sprint içinde çözülür.
  • Akış ve veri modeli sorunları: "kayıt yarıda kalınca ne oluyor" sınıfındaki her bulgu buraya düşer ve arka uçta karşılığı vardır.

Üçüncü gruptaki bir bulguyu "küçük bir düzeltme" diye rapora yazmak, tasarım ekibinin geliştirme ekibi nezdindeki güvenilirliğini aşındırır. Bir adımı kaldırmak arayüzde tek ekranın silinmesi gibi görünür; arkada iki doğrulama noktasının tek işleme toplanması ve yarım kalan kaydın akıbetine karar verilmesi anlamına gelir. Ekran sayısı azalır, hata durumlarının sayısı artar. Raporda bu ayrımı yapan tasarımcının önerileri uygulanır, yapmayanınki sıraya alınır.

Araçlar

Uzaktan test için UserTesting ve Lookback yaygın seçenekler. Kayıt için ekranı ve sesi alan herhangi bir araç iş görür; OBS Studio ücretsiz ve yeterlidir. Ön anket için form aracı seçmekle vakit kaybetmeyin, o kısmın veriye katkısı en düşük olanıdır.

Asıl eksik olan araç değil, kaydı izleyen kişi sayısı. Bulguyu raporda okuyan ekip üyesi ikna olmaz, oturumun iki dakikalık kesitini izleyen ekip üyesi olur.