Ajanlar ve simülasyon6 dk
8,3 milyar persona kaydı ve 1.010 hazır görevle yapay zekâ sistemlerini ve dijital ürünleri popülasyon ölçeğinde test eden simüle kullanıcı değerlendirme altyapısı.
Öne çıkan bulgu400 denemelik kontrollü davranış çalışmasında atanan davranış, denemelerin %91,5'inde ya ifade edildi ya da doğru biçimde bastırıldı.
Özeti okuyunProfiller ve temsil5 dk
Demografik bilgiler ve inanç ağları kullanımıyla LLM ajanlarının insan görüşlerini taklit doğruluğu.
Öne çıkan bulguSadece demografik bilgi kullanıldığında LLM–insan görüş uyumu sağlanamadı.
Özeti okuyunAjanlar ve simülasyon5 dk
LLM'lerin sosyal etkileşim davranışları; grup kimliği, karşılıklılık mekanizmaları ve CoT süreçlerinin rolü.
Öne çıkan bulguLLM’ler yalnızca kendi çıkarlarını gözetmiyor; sosyal refah ve karşılıklılık eğilimleri gösteriyor.
Özeti okuyunÖlçüm ve kalibrasyon5 dk
Belirsizlik altında rasyonel karar; faktör profilleri ve tarihsel analojilerle doğruluğun artırılması.
Öne çıkan bulguDEFINE çerçevesi, diğer yöntemlere göre daha yüksek doğruluk ve F1 skorları elde etti (Acc 29.6%, F1 23.7%).
Özeti okuyunTüketici tercihleri5 dk
LLM'lerin davranışsal ekonomi deneylerindeki insan ajanlarını taklit etme kapasitesi; endowment etkisi ve yeniden üretilebilirlik.
Öne çıkan bulguGPT-3, davranışsal ekonomi deneylerindeki insan bulgularını niteliksel olarak yeniden üretebildi.
Özeti okuyunProfiller ve temsil5 dk
Alt-popülasyon temsil modelleri olarak LLM kullanımı, toplumsal görüşleri ölçme potansiyeli ve risk-fayda değerlendirmesi.
Öne çıkan bulguLLM’ler toplum görüşlerini toplamada ve alt-popülasyonları temsil etmede güçlü bir araç olabilir.
Özeti okuyunAjanlar ve simülasyon5 dk
Ajan tabanlı modelleme ve simülasyonda LLM rolü; simülasyon paradigmasını dönüştürme kapasitesi.
Öne çıkan bulguPlanlama, bellek ve geri bildirim, dil modeli tabanlı ajanların simülasyonlarda kullanılan temel mekanizmaları arasında.
Özeti okuyunProfiller ve temsil5 dk
Sentetik veriyle bireysel görüşlerin öğrenilmesi ve taklit edilmesi; doğruluk ve heterojenlik.
Öne çıkan bulguDoppelgänger modeli, bireysel görüşleri yüksek doğrulukla taklit edebildi.
Özeti okuyunAjanlar ve simülasyon5 dk
GABM'lerle karmaşık sosyal dinamiklerin modellenmesi; insan benzeri davranış taklidi.
Öne çıkan bulguLLM’ler adalet, işbirliği, sosyal normlara uyum gibi insan benzeri davranışlar üretebiliyor.
Özeti okuyunProfiller ve temsil5 dk
Kullanıcı personalarının algılanması; kültürel bağlamın etkisi ve demografik profilleri yeniden oluşturma kapasitesi.
Öne çıkan bulguGPT-3.5 ve GPT-4, seçilen üç Hindistan merkezli persona için yüksek uyum gösterdi.
Özeti okuyunÖlçüm ve kalibrasyon5 dk
Human Mimicry Calibration (HMC) yöntemiyle demografik gruplara göre kalibrasyon.
Öne çıkan bulguHuman Mimicry Calibration (HMC), LLM yanıtlarını insan verileriyle hizalamada önemli iyileşme sağladı.
Özeti okuyunProfiller ve temsil5 dk
LLM'lerde persona kullanımı; role-playing ve personalization ayrımı, uygulama alanları.
Öne çıkan bulguPersona araştırmalarındaki temel ayrım: Role-Playing (LLM’in bir persona oynaması) ve Personalization (LLM’in kullanıcı personasıyla kişiselleşmesi).
Özeti okuyunÖlçüm ve kalibrasyon5 dk
LLM'lerin klasik deneyler ve farklı demografik profiller üzerinden insan davranışlarını simüle etme kapasitesi.
Öne çıkan bulguLLM’ler bazı insan davranış kalıplarını başarıyla taklit edebildi.
Özeti okuyunTüketici tercihleri2 dk
LLM'lerin markalara yönelik yanlılık (bias) ve tutarlılık düzeylerinin değerlendirilmesi.
Öne çıkan bulguTüm LLM’ler marka tercihlerinde tutarlı (transitive) davrandı ve Apple > Samsung > Huawei sıralaması ortaya çıktı.
Özeti okuyunTüketici tercihleri2 dk
LLM'lerin insan tercihlerini taklit etme yeteneği; dil ve chain-of-thought yöntemlerinin etkisi.
Öne çıkan bulguLLM’ler (GPT-3.5 ve GPT-4) insanlara kıyasla daha sabırsız çıktı; GPT-4’ün indirim oranları insan seviyesinin çok üzerindeydi.
Özeti okuyunTüketici tercihleri4 dk
LLM tabanlı aramanın verimlilik, doğruluk ve kullanıcı algısına etkisi; güven vurgularının rolü.
Öne çıkan bulguLLM tabanlı arama, görev tamamlama süresini yarı yarıya kısalttı (1,6 dk vs. 3,4 dk).
Özeti okuyunBu aramayla eşleşen çalışma yok. Başka bir kelime deneyin veya “Tümü”nü seçin.