OpenDesignArena

Tasarım için doğru yapay zekâ modelini bulun.

Gerçek değerlendirmelerle kalite, hız ve maliyeti karşılaştırın.

En iyi fiyat-performans

DeepSeek V4.1 Flash

En düşük maliyetle güçlü tasarım performansı.

Bu değerlendirmede DeepSeek V4.1 Flash, lider GPT-6 Astra modelinin ortalama puanının %98 düzeyine, ortalama maliyetinin yaklaşık %1 tutarıyla ulaştı.

Çıktı başına maliyet
$0.023$1.61 ile karşılaştırma
Değerlendirme ortalaması / 100
81.282.7 ile karşılaştırma

En yüksek puan

En hızlı teslimat

Modelleri karşılaştırın

İki veya üç model seçerek beş boyutun tamamını tek grafikte görün. Farklı şekiller farklı güçlü yönleri gösterir.

Beş boyutta performans

Beş eksenin tamamında dışa doğru ilerlemek daha iyi sonuç, daha hızlı tamamlama ve daha düşük maliyet demektir.

GereksinimlerTasarım kalitesiTeslim edilebilirlik oranıTamamlama hızıMaliyet verimliliği

    Tüm 13 modelin her eksendeki ortalaması

    Önceliklerinize göre seçin

    İhtiyaçlarınıza uygun modeli bulmak için değerlendirilen kalite, maliyet ve hız arasında denge kurun.

    Sizin için en önemli olan nedir?
    Kalite
    50%
    Maliyet
    30%
    Hız
    20%
    1. 1 DeepSeek V4.1 Flash 78.8 Ortalama puan: 81.2/100; Ortalama maliyet: $0.023; Ortalama süre: 5.3 dk
    2. 2 DeepSeek V4 Flash 68.6 Ortalama puan: 70.6/100; Ortalama maliyet: $0.031; Ortalama süre: 11.1 dk
    3. 3 GPT-5.6 Sol 65.7 Ortalama puan: 77.6/100; Ortalama maliyet: $0.544; Ortalama süre: 3.2 dk
    4. 4 Gemini 3.8 Flash 64.7 Ortalama puan: 68.9/100; Ortalama maliyet: $0.210; Ortalama süre: 3.8 dk
    5. 5 DeepSeek V4 Pro 64.6 Ortalama puan: 72.9/100; Ortalama maliyet: $0.061; Ortalama süre: 17.7 dk
    6. 6 Muse Spark 1.3 63.2 Ortalama puan: 66.6/100; Ortalama maliyet: $0.267; Ortalama süre: 3.3 dk
    7. 7 GLM-5.3 Flash 61.4 Ortalama puan: 69.8/100; Ortalama maliyet: $0.064; Ortalama süre: 23.5 dk
    8. 8 GPT-6 Astra 57.5 Ortalama puan: 82.7/100; Ortalama maliyet: $1.61; Ortalama süre: 11.1 dk
    9. 9 Grok 4.6 56.5 Ortalama puan: 72.4/100; Ortalama maliyet: $0.599; Ortalama süre: 11.4 dk
    10. 10 Hunyuan H4 Preview 54.6 Ortalama puan: 74.6/100; Ortalama maliyet: $0.418; Ortalama süre: 29.2 dk
    11. 11 Qwen 3.8-Max 52.3 Ortalama puan: 72.0/100; Ortalama maliyet: $0.595; Ortalama süre: 26.4 dk
    12. 12 Claude Fable 5.1 52.1 Ortalama puan: 80.3/100; Ortalama maliyet: $3.66; Ortalama süre: 12.8 dk
    13. 13 Kimi K3 52.1 Ortalama puan: 65.7/100; Ortalama maliyet: $0.614; Ortalama süre: 14.0 dk

    Kullanım amacına göre seçin

    Bir tasarım senaryosu seçin; aşağıdaki beş boyutun her biri için bir model önerilir.

    Genel performans

    GPT-6 Astra

    Gereksinimler · 26.5/30Tasarım kalitesi · 56.2/70Teslim edilebilirlik oranı · 60.0%Tamamlanma süresi · 11.1 dkÇalıştırma başına maliyet · $1.61 Gereksinimler 26.5/30 Tasarım kalitesi 56.2/70 Teslim edilebilirlik oranı 60.0% Tamamlanma süresi 11.1 dk Çalıştırma başına maliyet $1.61
    Ort. puan
    82.7/100
    Ort. gereksinim puanı
    26.5/30
    Ort. tasarım kalitesi
    56.2/70
    Ort. teslim edilebilirlik oranı
    60.0%
    Ort. süre
    11.1 dk
    Ort. maliyet / çıktı
    $1.61/çalıştırma
    Tasarım kalitesi

    Claude Fable 5.1

    Ort. tasarım kalitesi
    53.2/70
    Ort. puan
    80.3/100
    Ort. teslim edilebilirlik oranı
    56.7%
    Ort. gereksinim puanı
    27.1/30
    Ort. süre
    12.8 dk
    Ort. maliyet / çıktı
    $3.66/çalıştırma
    Gereksinimleri karşılama

    DeepSeek V4.1 Flash

    Ort. gereksinim puanı
    28.4/30
    Ort. puan
    81.2/100
    Ort. teslim edilebilirlik oranı
    57.7%
    Ort. tasarım kalitesi
    52.8/70
    Ort. süre
    5.3 dk
    Ort. maliyet / çıktı
    $0.023/çalıştırma
    Tamamlanma hızı

    GPT-5.6 Sol

    Ort. süre
    3.2 dk
    Ort. puan
    77.6/100
    Ort. teslim edilebilirlik oranı
    53.3%
    Ort. gereksinim puanı
    25.8/30
    Ort. tasarım kalitesi
    51.8/70
    Ort. maliyet / çıktı
    $0.544/çalıştırma
    Maliyet verimliliği

    Hunyuan H4 Preview

    Ort. maliyet / çıktı
    $0.418/çalıştırma
    Ort. puan
    74.6/100
    Ort. teslim edilebilirlik oranı
    40.0%
    Ort. gereksinim puanı
    26.8/30
    Ort. tasarım kalitesi
    47.8/70
    Ort. süre
    29.2 dk

    Kalite ve maliyet

    Modellerin performansını ve bu performansa ulaşmanın maliyetini karşılaştırın.

    Kalite sıralaması

    82.7/100 GPT-6 Astra
    81.2/100 DeepSeek V4.1 Flash
    80.3/100 Claude Fable 5.1
    77.6/100 GPT-5.6 Sol
    74.6/100 Hunyuan H4 Preview
    72.9/100 DeepSeek V4 Pro
    72.4/100 Grok 4.6
    72.0/100 Qwen 3.8-Max
    70.6/100 DeepSeek V4 Flash
    69.8/100 GLM-5.3 Flash
    68.9/100 Gemini 3.8 Flash
    66.6/100 Muse Spark 1.3
    65.7/100 Kimi K3

    Maliyet–kalite sınırı

    Ortalama puan Çıktı başına maliyet (USD) GPT-6 Astra GPT-6 Astra Ortalama puan 82.7 · $1.61 DeepSeek V4.1 Flash DeepSeek V4.1 Flash Ortalama puan 81.2 · $0.023 Claude Fable 5.1 Claude Fable 5.1 Ortalama puan 80.3 · $3.66 GPT-5.6 Sol GPT-5.6 Sol Ortalama puan 77.6 · $0.544 Hunyuan H4 Preview Hunyuan H4 Preview Ortalama puan 74.6 · $0.418 DeepSeek V4 Pro DeepSeek V4 Pro Ortalama puan 72.9 · $0.061 Grok 4.6 Grok 4.6 Ortalama puan 72.4 · $0.599 Qwen 3.8-Max Qwen 3.8-Max Ortalama puan 72.0 · $0.595 DeepSeek V4 Flash DeepSeek V4 Flash Ortalama puan 70.6 · $0.031 GLM-5.3 Flash GLM-5.3 Flash Ortalama puan 69.8 · $0.064 Gemini 3.8 Flash Gemini 3.8 Flash Ortalama puan 68.9 · $0.210 Muse Spark 1.3 Muse Spark 1.3 Ortalama puan 66.6 · $0.267 Kimi K3 Kimi K3 Ortalama puan 65.7 · $0.614

    Pembe alandaki 11 model, DeepSeek V4.1 Flash modelinden daha pahalı ve daha düşük puanlı.

    Senaryoya göre performans

    Web uygulaması sıralaması

    83.1/100 GPT-5.6 Sol
    82.6/100 Claude Fable 5.1
    82.4/100 DeepSeek V4.1 Flash
    77.1/100 GPT-6 Astra
    68.5/100 Grok 4.6
    68.4/100 Gemini 3.8 Flash
    62.0/100 Muse Spark 1.3
    60.6/100 GLM-5.3 Flash
    60.5/100 Hunyuan H4 Preview
    57.0/100 Qwen 3.8-Max
    56.4/100 DeepSeek V4 Flash
    51.8/100 DeepSeek V4 Pro
    35.9/100 Kimi K3

    Web uygulaması · Maliyet–kalite sınırı

    Ortalama puan Çıktı başına maliyet (USD) GPT-5.6 Sol GPT-5.6 Sol Ortalama puan 83.1 · $0.537 Claude Fable 5.1 Claude Fable 5.1 Ortalama puan 82.6 · $5.55 DeepSeek V4.1 Flash DeepSeek V4.1 Flash Ortalama puan 82.4 · $0.030 GPT-6 Astra GPT-6 Astra Ortalama puan 77.1 · $1.87 Grok 4.6 Grok 4.6 Ortalama puan 68.5 · $0.818 Gemini 3.8 Flash Gemini 3.8 Flash Ortalama puan 68.4 · $0.185 Muse Spark 1.3 Muse Spark 1.3 Ortalama puan 62.0 · $0.293 GLM-5.3 Flash GLM-5.3 Flash Ortalama puan 60.6 · $0.093 Hunyuan H4 Preview Hunyuan H4 Preview Ortalama puan 60.5 · $0.609 Qwen 3.8-Max Qwen 3.8-Max Ortalama puan 57.0 · $0.552 DeepSeek V4 Flash DeepSeek V4 Flash Ortalama puan 56.4 · $0.041 DeepSeek V4 Pro DeepSeek V4 Pro Ortalama puan 51.8 · $0.067 Kimi K3 Kimi K3 Ortalama puan 35.9 · $0.486

    Pembe alandaki 10 model, DeepSeek V4.1 Flash modelinden daha pahalı ve daha düşük puanlı.

    Model verimliliği

    Tamamlanma süresini, önbellek isabet oranını ve token tüketimini karşılaştırın. Tüm değerler ölçülen ortalamalardır.

    Senaryo
    Ortalama puanTamamlanma süresi
    Yüksek puan · Yüksek verimlilik

    Değerlendirme yöntemi

    Gereksinimleri karşılama ve tasarım kalitesi puanlanır; verimlilik ve maliyet ayrı sunulur.

    Görevler ve örneklem

    Modeller beş senaryoda ortak tasarım görevleriyle değerlendirilir: web uygulamaları, mobil uygulamalar, masaüstü uygulamaları, gösterge panoları ve yönetim panelleri, web siteleri ve açılış sayfaları. Bu sonuçlar, modellerin genel yeteneklerini değil, pratik prototip oluşturma görevlerindeki performanslarını gösterir.

    Sayfa görüntüleme kontrolleri

    Puanlamadan önce her çıktının web sayfası olarak açılıp açılmadığını kontrol eder; boş sayfaları, kesilmiş içeriği ve kritik çalışma zamanı hatalarını inceleriz. Görüntülenemeyen çıktılar sıfır puan alır; sonuçları yeniden test edilerek değiştirilmez. Başarıyla açılmak yalnızca sonraki değerlendirme için bir ön koşuldur; gereksinimlerin karşılandığını veya çıktının teslim edilebilir olduğunu kanıtlamaz.

    Gereksinimleri karşılama ve tasarım kalitesi

    Her çıktı 100 üzerinden puanlanır. Gereksinimleri karşılama 30 puandır: sayfalar ve modüller, gerekli içerik, arayüz durumları ve etkileşimler görev tanımına göre kontrol edilir ve tamamlandı, kısmen tamamlandı veya tamamlanmadı olarak değerlendirilir. Tasarım kalitesi, eşit ağırlıklı beş boyutta toplam 70 puandır: düzen ve okunabilirlik, bilgi hiyerarşisi, stilin göreve uygunluğu, renk ve kontrast, görsellerin uygunluğu ve içerikle ilgisi. Her boyut karşılandı, kısmen karşılandı veya karşılanmadı olarak değerlendirilir.

    Ortalama puan ve teslim edilebilirlik oranı

    Ortalama puan, bir modelin puanlanan tüm çıktılarının aritmetik ortalamasıdır. Bu değerlendirmede 80 ve üzeri puan alan bir çıktı teslim edilebilir kabul edilir. Teslim edilebilirlik oranı, puanlanan çıktılar arasında bu eşiğe ulaşanların oranıdır ve modelin uygun sonuçları ne kadar tutarlı ürettiğini gösterir. Teslim edilebilirlik, bu değerlendirmenin prototip kalite standardını ifade eder; üretim ortamında kullanıma hazır olunduğu anlamına gelmez.

    Verimlilik ve maliyet

    Tamamlanma süresi, önbellek isabet oranı, girdi ve çıktı token tüketimi ile araç çağrılarının ölçülen ortalamalarını kalite puanlarından ayrı sunarız. Her çıktının maliyeti, kayıtlı token tüketimi ve standart girdi, çıktı ve önbellek okuma fiyatları kullanılarak tahmin edilir; ardından ortalaması alınır. Bu tahminler kaynak tüketimini karşılaştırmak içindir; fatura tutarı değildir ve kaydedilmemiş ücretleri içermez. Verimlilik ve maliyet değerlendirme puanına katılmaz. Seçim önceliklerini değiştirmek, özgün değerlendirme sonuçlarını değil, öneri sıralamalarını etkiler.

    OpenDesign Masaüstü

    Tek tasarım sistemi. Her çıktıda tutarlı bir marka

    Tam Vibe Design Workspace içinde aynı marka kurallarını web sitelerine, sunumlara, etkileşimli prototiplere, panolara, görsellere ve HTML videolara uygulayın. Yerel Codex, Claude Code, Cursor ve diğer kodlama ajanlarını bağlayıp ücretsiz üretin.

    • Web, sunum, prototip, pano, görsel ve video
    • 140+ tasarım sistemi ve eksiksiz şablon ile beceri kitaplığı
    • Yerel Codex ve 21+ kodlama ajanını bağlayın · Ücretsiz
    Ücretsiz indir

    macOS ve Windows için