YAYIN

Yapay Zekâ ile 8,3 Milyar Sanal Persona Oluşturuldu

Harvard, MIT, Stanford ve diğer kurumlardan araştırmacıların geliştirdiği MatrAIx, dijital ürünleri ve yapay zekâ sistemlerini farklı kullanıcı profilleriyle test etmek için 8,3 milyar persona kaydından oluşan simülasyon altyapısı sunuyor. Ancak sistem 8,3 milyar gerçek insanın birebir dijital kopyasını oluşturmuyor; Persona 8B, 1.290 özellik boyutuyla tanımlanan sentetik ve insan profillerinden türetilmiş persona kayıtlarından oluşuyor.

İçindekiler Ne Oldu? Neden Önemli? Kimleri Etkiliyor? Olası Etkileri Kaynaklar
Yapay Zekâ ile 8,3 Milyar Sanal Persona Oluşturuldu

Ne Oldu?

Harvard, MIT, Stanford ve farklı araştırma kurumlarından bilim insanlarının yer aldığı ekip, yapay zekâ sistemlerini ve dijital ürünleri büyük ölçekte sanal kullanıcılarla değerlendirmek amacıyla MatrAIx adlı yeni bir araştırma altyapısı geliştirdi. Çalışmanın makalesi 4 Ağustos 2026 tarihinde arXiv üzerinde yayımlandı.

MatrAIx'in merkezinde Persona 8B adı verilen ve toplam 8,3 milyar persona kaydını kapsayan bir yapı bulunuyor. Her persona; demografik özelliklerden davranışlara, yeteneklerden yaşam tarzına kadar uzanan 1.290 kategorik boyut üzerinden tanımlanıyor.

Buradaki 8,3 milyar rakamının doğru yorumlanması önem taşıyor. Araştırmacılar dünya üzerindeki 8,3 milyar gerçek insanın birebir dijital kopyalarını oluşturmadı. Persona 8B, farklı özellik kombinasyonları kullanılarak oluşturulan veya insan tarafından hazırlanmış profillerden türetilen persona kayıtlarından oluşuyor. Bu kayıtlar, büyük dil modelleriyle bir araya getirildiğinde farklı kullanıcı davranışlarını temsil eden yapay zekâ ajanları olarak kullanılabiliyor.

Sentetik kayıtlar oluşturulurken özellikler tamamen rastgele bir araya getirilmiyor. Araştırmacılar, gerçek dünyadaki bağlantılı özelliklerin ilişkilerini korumak amacıyla bir bağımlılık grafiğinden yararlanıyor. İnsanlar tarafından hazırlanmış profillerden türetilen kayıtlar da sistem içerisinde bulunuyor.

Araştırma ekibi 8,3 milyarlık yapının tamamının yanında yaklaşık 1 milyon personadan oluşan kalite filtreli bir veri kümesini de yayımladı. Bu veri setinde 599 bin 847 insan temelli ve 400 bin sentetik persona kaydı bulunuyor.

Sanal Kullanıcılar Dijital Ürünleri Test Edebiliyor

MatrAIx yalnızca persona kayıtlarından oluşan büyük bir veri tabanı değil. Sistemin MatrAIx Playground adlı bölümü, persona ajanlarının farklı dijital ortamlarda etkileşime girmesine imkân sağlıyor.

Araştırmacılar dört temel test ortamı oluşturdu: anket, yapay zekâ sohbet botu, web ve uygulama. Böylece persona ajanları bir soruya yalnızca metin yanıtı vermek yerine bir web sitesini değerlendirebiliyor, sohbet botuyla iletişim kurabiliyor veya dijital uygulamalarla etkileşime girebiliyor.

MatrAIx kapsamında ticaret, yazılım, finans ve sağlık dahil 25'ten fazla alana yayılan 1.010 değerlendirme görevi bulunuyor. Araştırmacılar sistem üzerinde sekiz temsili görev kapsamında toplam 18 bin 189 değerlendirme denemesi gerçekleştirdi.

Deneylerde persona ajanlarını çalıştırmak için GPT 5.5, Claude Opus 4.8 ve Claude Haiku 4.5 modellerinden yararlanıldı. Persona kayıtları kullanıcının özelliklerini tanımlarken, büyük dil modeli bu özellikler doğrultusunda görev sırasında ortaya çıkan karar ve etkileşimleri üretiyor.

Sistem sayesinde farklı kullanıcı profillerinin aynı ürün karşısında nasıl davranabileceği incelenebiliyor. Örneğin bir fiyat artışının ardından kullanıcının tereddüt edip etmediği, yapay zekâ asistanının hata yapmasının ardından hizmeti kullanmaya devam edip etmeyeceği veya bir uygulamadaki gecikmeye ne kadar tolerans göstereceği değerlendirilebiliyor.

Persona Tutarlılığı Yüzde 91,5 Olarak Ölçüldü

Araştırmacılar oluşturulan persona ajanlarının kendilerine tanımlanan özelliklere ne ölçüde bağlı kaldığını görmek amacıyla kontrollü bir doğrulama çalışması da gerçekleştirdi. Dört farklı ortam ve 10 davranışsal özellik üzerinde yapılan 400 denemenin 366'sında tanımlanan davranışın doğru biçimde ortaya çıktığı veya gerektiğinde doğru şekilde bastırıldığı bildirildi.

Bu sonuç yüzde 91,5 persona uyumuna karşılık geliyor. Bununla birlikte bu oran, yapay zekâ ajanlarının gerçek insanların davranışlarını yüzde 91,5 doğrulukla tahmin ettiği anlamına gelmiyor. Ölçüm, ajanların kendilerine tanımlanan persona özelliklerine ne kadar tutarlı davrandığını gösteriyor.

Neden Önemli?

Dijital ürünlerin gerçek kullanıcılarla test edilmesi şirketler açısından zaman ve maliyet gerektirebiliyor. Ayrıca sınırlı sayıdaki kullanıcıyla gerçekleştirilen testlerin farklı demografik ve davranışsal grupları yeterince temsil etmesi her zaman mümkün olmayabiliyor.

MatrAIx, yapay zekâ ajanlarını kullanarak bu süreci çok daha geniş bir persona çeşitliliğiyle gerçekleştirmeyi amaçlıyor. Bir şirket, geliştirdiği uygulamanın veya yapay zekâ hizmetinin farklı kullanıcı grupları karşısındaki olası davranışlarını gerçek kullanıcı testlerinden önce sanal ortamda inceleyebilir.

Bu yaklaşım özellikle yapay zekâ ürünlerinin piyasaya çıkmadan önce stres testlerinden geçirilmesi açısından yeni bir yöntem oluşturabilir. Farklı kullanıcı profillerinin aynı sistemle etkileşime girmesi, geliştiricilerin yalnızca ortalama kullanıcı davranışına değil farklı ihtiyaçlara ve kullanım biçimlerine göre de ürünlerini değerlendirmesine yardımcı olabilir.

Araştırmacılar ise MatrAIx'in gerçek insanlardan elde edilen kanıtların yerine geçmesi için tasarlanmadığının altını çiziyor. Sistem daha çok hipotez oluşturma, ön test gerçekleştirme ve çok sayıda farklı kullanıcı senaryosunu hızlı biçimde değerlendirme amacı taşıyor.

Kimleri Etkiliyor?

  • Yapay zekâ modeli geliştiren şirketler
  • Web ve mobil uygulama geliştiricileri
  • UX ve kullanıcı araştırması ekipleri
  • SaaS ve dijital ürün şirketleri
  • E-ticaret ve dijital pazarlama ekipleri
  • Yapay zekâ güvenliği ve değerlendirme araştırmacıları
  • Ürün geliştirme ve veri analitiği ekipleri

Olası Etkileri

MatrAIx benzeri sistemlerin gelişmesi, dijital ürünlerin piyasaya çıkmadan önce test edilme yöntemlerini değiştirebilir. Şirketler gerçek kullanıcı araştırmalarından önce binlerce farklı persona üzerinde senaryolar çalıştırarak olası sorunları ve kullanıcı davranışlarını daha erken aşamada değerlendirebilir.

Özellikle e-ticaret, SaaS ve dijital pazarlama alanlarında fiyat değişiklikleri, kullanıcı deneyimi tasarımları veya yapay zekâ destekli hizmetler farklı sanal kullanıcı profilleri üzerinde önceden test edilebilir. Bu durum ürün ekiplerinin gerçek kullanıcılarla yapılacak araştırmalara hangi sorularla yaklaşması gerektiğini belirlemesine yardımcı olabilir.

Bununla birlikte sentetik persona davranışlarının gerçek insanların davranışlarıyla aynı kabul edilmesi önemli hatalara yol açabilir. Büyük dil modelleri gerçek kullanıcıların ekonomik, kültürel ve psikolojik davranışlarını eksiksiz biçimde temsil etmiyor. Bu nedenle bu sistemlerin gerçek kullanıcı araştırmalarının yerine değil, onları destekleyen bir araç olarak kullanılması beklenebilir.

MatrAIx'in daha fazla araştırmacı tarafından kullanılmasıyla yapay zekâ tabanlı sanal kullanıcı testlerinin ne kadar güvenilir olduğu konusunda daha kapsamlı veriler ortaya çıkabilir. Başarılı sonuçlar alınması hâlinde sentetik kullanıcı simülasyonları, yapay zekâ ürünlerinin geliştirilmesi ve değerlendirilmesinde yeni bir test katmanı oluşturabilir.

Kaynaklar

Bağlantı panoya kopyalandı.