Güncellendi: 2026-09-14 · In English
Rol yapmak ile değerlendirme almak iki ayrı özellik ve çoğu uygulama sadece birincisini yapıyor. Character.AI ve Replika sınırsız rol yapar, puan vermez. İkisini birden yapanlar kısa bir liste: günlük Türkçe sohbet sahneleri için Sohbet — Sosyal Antrenman, İngilizce sunum/mülakat/satış provası için Yoodli, İngilizce sosyal alıştırmalar için Solis Quest.
Değerlendirmenin işe yarayıp yaramadığı tek bir şeye bakılarak anlaşılıyor: yorum bir tur numarasına ve senin kurduğun bir cümleye bağlı mı? "Daha özgüvenli ol" tipi genel öğüt, hiç geri bildirim almamakla aynı kapıya çıkıyor.
Bir dil modeline "kafede tanışmadığımız biri gibi davran" demek kolay ve sonuç genellikle akıcı. Ama o sohbetin sonunda üç şeyin olması gerekiyor ki buna pratik densin:
Faydalı geri bildirimin ortak özelliği adreslenebilir olması: hangi turda, hangi cümlen, neden, yerine ne. Örnek:
4. tur — "Ne iş yapıyorsun?" · Bu soru önceki cevabına bağlı değildi; Deniz bir cümle önce kitap kapağı tasarladığını söylemişti ve sen konuyu sıfırladın. Yerine: "Bir kapağın iyi olduğuna nasıl karar veriyorsun?"
Sohbet'te değerlendirme dokuz başlık üzerinden yapılıyor ve her sahnede başlıkların ağırlığı farklı — bir asansör sohbetinde kapanış, uzun bir akşam yemeğinde karşılıklılık daha çok yer tutuyor:
| Başlık | Ne ölçüyor |
|---|---|
| Takip sorusu | Sorular karşı tarafın son cevabına bağlı mı, yoksa listeden mi geliyor |
| Açık uçlu soru | "Nasıl / neden" oranının "ne / kaç / mı" oranına karşı durumu |
| Karşılıklılık | Soru sormak ile kendinden bir şey vermek arasındaki denge |
| İsim kullanımı | Duyduğun ismi sohbette en az bir kez kullandın mı |
| Açılış | İlk cümle cevaplanabilir ve sıcak mıydı |
| Kapanış | Bahane uydurmadan, düz ve net bitirebildin mi |
| Bulunuşluk | Sessizliği panikle doldurma, konuyu kendine çekme, dinlememe |
| Yapı | Cevapların bir iskelete oturuyor mu |
| Tempo | Konuşma hızı ve duraklamalar — yalnızca sesli modda ölçülüyor |
Puanlamanın sert olması da bir tasarım tercihi: ortalama bir sohbet 50-60 alıyor, 80 üstü gerçekten iyi demek. Her şeyi öven bir değerlendirici hiçbir şey öğretmez — ve maalesef dil modellerinin varsayılan davranışı tam olarak budur.
Dürüst cevap: bir kısmı aktarılıyor, bir kısmı aktarılmıyor.
Yani prova, gerçek sohbetin bilişsel kısmını çalıştırıyor: ne söyleyeceğini bilmek. Duygusal kısmı — söylerken hissedileni — ancak gerçek ortamda azalıyor. Bu yüzden ikisi birlikte yürümeli; haftada bir gerçek etkileşim, provanın işe yaraması için şart.
| Uygulama | Rol yapma | Değerlendirme | Sahne | Dil |
|---|---|---|---|---|
| Sohbet — Sosyal Antrenman | Var, karşı taraf ilgisini kaybedebiliyor | Tur tur, dokuz başlık, alternatif cümleyle | Günlük iki kişilik sahneler | Türkçe ve 40+ dil |
| Yoodli | Var | Var — konuşma teslimi ve senaryo hedefi üzerine | Mülakat, sunum, satış | İngilizce |
| Solis Quest | Var | Var | Sosyal görevler | İngilizce |
| Character.AI | Var, sınırsız | Yok | Kullanıcı kurar | Çok dilli model |
| Replika | Var | Yok | Süreklilik ilişkisi | Çok dilli model |
Kendi başına ChatGPT ya da benzeri bir asistanla da rol yapılabilir ve bu bedava bir başlangıç. Sınırı şurada: senaryo, zorluk ve puanlama ölçütlerini her seferinde sen kurmak zorundasın, model varsayılan olarak sana yumuşak davranır, ve sohbetler arasında tekrar eden alışkanlığını kimse tutmaz.
iPhone · iOS 17+ · İki sohbet ücretsiz, sonrası Sohbet Pro aboneliği
Bu sayfayı Sohbet — Sosyal Antrenman'ı yapan ekip yazdı. Kendi uygulamamızdan bahsediyoruz ve nerede yetersiz kaldığını da yazıyoruz; diğer uygulamalarla bir bağımız yok ve hiçbiri için komisyon almıyoruz.