Lovable vs v0 vs Bolt: Türkçe prompt'la kim daha iyi çalışıyor?
Araçlar hızla değiştiği için kalıcı değer kazanan şey tek seferlik kazanan değil, aynı koşullarda tekrar edilebilen test yöntemidir.
Lovable, v0 ve Bolt karşılaştırmaları çoğu zaman demo hissine dayanıyor. Daha anlamlı soru şu: aynı Türkçe ürün brief'i verildiğinde hangisi daha az düzeltmeyle kullanılabilir sonuç üretiyor?
Bu yazı kanıtlanmamış bir kazanan ilan etmiyor; aynı testi yeni sürümlerde tekrar çalıştırabileceğimiz bir protokol tanımlıyor.
Tek prompt, tek kapsam
Her araca aynı brief verilir: Türkçe SaaS dashboard, mobil responsive yapı, form validation, dark/light theme, gerçek empty state ve erişilebilir navigation. Araçlara özel ek ipucu verilmez.
- Kriter
- Türkçe copy tutarlılığı
- Ağırlık
- 20
- Kriter
- Responsive doğruluk
- Ağırlık
- 20
- Kriter
- Kod yapısı
- Ağırlık
- 20
- Kriter
- Görsel hiyerarşi
- Ağırlık
- 15
- Kriter
- Erişilebilirlik
- Ağırlık
- 10
- Kriter
- Edge state kapsamı
- Ağırlık
- 10
- Kriter
- Düzeltme prompt'u sayısı
- Ağırlık
- 5
| Kriter | Ağırlık |
|---|---|
| Türkçe copy tutarlılığı | 20 |
| Responsive doğruluk | 20 |
| Kod yapısı | 20 |
| Görsel hiyerarşi | 15 |
| Erişilebilirlik | 10 |
| Edge state kapsamı | 10 |
| Düzeltme prompt'u sayısı | 5 |
Türkçe için özel hata listesi
- Sen/siz karışıyor mu?
- Büyük I/İ bozuluyor mu?
- Uzun Türkçe butonlar taşıyor mu?
- İngilizce placeholder kalıyor mu?
- Tarih ve para formatı locale'e uyuyor mu?
- Aynı kavram farklı kelimelerle mi yazılıyor?
Sonuç nasıl yayınlanmalı?
"X daha güzel tasarladı" demek yerine her kriterde kaç düzeltme gerektiğini raporlamak gerekir. Test tarihi, model/sürüm ve kullanılan prompt da sonuçla birlikte yayınlanmalıdır.
Araçların sürümü değişir. İyi benchmark ise yeniden çalıştırılabilir.