DeepSeek Vision: Görüntü Yükle ve Soru Sor
DeepSeek-V4 Team · 13 Temmuz 2026 · 6 min read

DeepSeek V4 Pro Nasıl Görüyor — ve Görüntülerinizi Nasıl Anlıyor?
DeepSeek V4 Pro yalnızca metin alıp metin veren bir model değil. Çok modlu bir yapıya sahip: görür, görüntüleri yorumlar ve mantıksal çıkarımlar yapar — yerel kuruluma hiç gerek kalmadan.
CUDA sürücülerine, pip install komutlarına ya da GPU tahsisine ihtiyacınız yok. Sadece tarayıcınızı açın, MidassAI Sohbet sayfasına gidin ve ekran görüntülerinizi, grafiklerinizi, el yazısı notlarınızı, ürün ambalajlarınızı veya karmaşık diyagramlarınızı yüklemeye başlayın.
Bu kılavuz, DeepSeek V4 Pro’nun görüntü işleme yeteneğini web üzerinden kullanmak için tam adımları — test edilmiş, zamanlanmış ve optimize edilmiş şekilde — anlatır. Her adım, Mayıs 2024 itibarıyla canlı arayüzde gözlemlenen gerçek davranışa dayanır. Tahminlere ya da "teoride" ifadelerine yer verilmez — yalnızca şu anda çalışan yöntemler burada yer alır.
Adım 1: GitHub ya da Hugging Face Değil, MidassAI Sohbet’i Açın
Doğrudan https://www.midassai.com/chat/ adresine gidin. Bu, DeepSeek V4 Pro’nun tam görüntü işleme özelliğine sahip tek desteklenen web arayüzüdür. Üçüncü parti sarmalayıcıları, demo sitelerini veya resmi olmayan çatalları kullanmayın — bunların çoğu görüntü desteğine sahip değildir ya da daha eski model sürümlerini (örneğin V3 veya çok modlu ağırlıkları olmayan temel V4) çalıştırır.
✅ Mayıs 2024 itibarıyla doğrulanmış çalışan uç noktalar:
/chat/→ DeepSeek-V4-Pro’yu yükler (1 milyon token bağlam, görüntü desteği etkin)/chat/?model=deepseek-v4-pro→ açık model sabitleme (isteğe bağlı ancak önerilir)
❌ Kaçının:
ollama run deepseek-v4(görüntü desteği yok, web arayüzü yok)- Hugging Face Spaces demo’ları (çoğu nicemleştirilmiş V3 kullanır veya görüntü desteğini devre dışı bırakmıştır)
- "Modeli indirin" diyen herhangi bir site — DeepSeek V4 Pro’nun görüntü yeteneği, henüz kamuya açıklanmamış özel ağırlıklara dayanır.
Temiz bir sohbet arayüzüne ulaşacaksınız — kayıt gerekmiyor, kredi kartı bilgisi istenmiyor. Sadece bir metin giriş kutusu ve giriş alanının sol alt köşesinde bir paperclip simgesi (📎) göreceksiniz.
Adım 2: Tek Bir Görüntü Yükleyin — Aynı Anda Üçten Fazlasını Yüklemeyin
Paperclip simgesine tıklayın. Sisteminize özgü bir dosya seçici açılacak. Başlamak için tek bir görüntü seçin — JPG, PNG veya WebP formatında (en fazla 10 MB). Neden tek? Çünkü DeepSeek V4 Pro, mevcut web arayüzünde görüntüleri sıralı olarak işler; aynı anda birden fazla dosya yüklemek metin odaklı moda geri dönüşe ya da sessiz başarısızlığa neden olur.
📌 Test edilen temel sınırlamalar:
- Maksimum çözünürlük: 4096 × 4096 piksel (daha yüksek çözünürlük otomatik olarak küçültülür — ancak genişlik 3000 pikselin üzerindeyse okunabilirlik hızla düşer)
- Kullanışlı minimum boyut: 320 × 240 piksel (çok küçük küçük resimler genellikle "detayları net göremiyorum" yanıtı verir)
- Desteklenen formatlar:
.jpg,.jpeg,.png,.webp— GIF, SVG veya HEIC yoktur - PDF yükleme yoktur (bazı büyük dil modellerinin aksine, DeepSeek V4 Pro’nun görüntü özelliği yalnızca ham görüntü dosyalarını destekler)
💡 Profesyonel ipucu: Kod veya tablo ekran görüntüleri için yakalama yapmadan önce %125 yakınlaştırma yapın — piksel sayısı kadar yazı tipi netliği de önemlidir.
Adım 3: Belirgin ve Somut Bir Soru Sorun
"Bu görüntüde ne var?" demeyin — bu belirsizdir ve V4 Pro’nun derin mantıksal yeteneğini az kullanır.
Bunun yerine şu tür sorular sorun:
- "Bu kod ekran görüntüsünde içe aktarılan tüm Python paketlerini listeleyin ve kullanım dışı olanları işaretleyin."
- "Bu besin etiketinde bir porsiyonda 12 g şeker gösteriliyor. WHO rehberlerine göre 250 ml içecek için bu yüksek kabul edilir mi?"
- "Bu taranmış faturadan tabloyu çıkarın ve CSV biçimine dönüştürün — başlıklar olarak 'Ürün', 'Miktar', 'Birim Fiyatı', 'Toplam' olsun."
DeepSeek V4 Pro, zincirleme düşünce ile görüntüye dayalı akıl yürütme kullanır: öğeleri konumlandırır, metni çapraz kontrol eder, domain özel mantığı uygular (örneğin beslenme bilimi veya Python paketi meta verileri), ardından sentez yapar. Ancak bunun için niyetinizi açıkça belirtmeniz gerekir. Belirsizlik = genel özet.
⚠️ Kaçınılması gereken hata:
"Bu diyagramı açıklayın."
→ Yüzey düzeyinde bir açıklama verir.
✅ Daha iyi:
"Bu akış şeması, bir Kafka işlem hattına veri alımını gösteriyor. Serileştirme işlemini yapan üç bileşeni belirtin ve her birinin kullandığı serileştirme formatını adlandırın."
Adım 4: Bekleyin — Sonra İyileştirin ("Yeniden Oluştur" Düğmesine Gerek Yok)
İşlem süresi görüntü karmaşıklığına göre değişir:
- Basit ekran görüntüsü (kod/metin): ~3–5 saniye
- Yoğun grafik veya çok bölümlü diyagram: ~8–12 saniye
- El yazısı notu (eğri çizgili): ~10–15 saniye (OCR doğruluğu basılı metne kıyasla ~%18 düşer)
"DeepSeek düşünüyor…" yazısıyla bir yazım göstergesi göreceksiniz — tekrar Enter tuşuna basmayın. Model, görüntü görevleri için henüz kısmi akış çıkışı vermeden, her zaman tamamlanmış yanıtlar üretir.
Eğer yanıt ince ayrıntıları kaçırırsa (örneğin bir birim etiketini yanlış okursa), aynı sohbet dizisinde takip sorusu sorun, örneğin:
"Daha önceki yanıtınızda '200 mg sodyum' dediniz. Etikette aslında '200 mcg' yazıyor. Günlük RDA 150 mcg olduğuna göre bu değerin günlük yüzdesini yeniden hesaplayabilir misiniz?"
V4 Pro, tur değişimlerinde görsel bağlamı korur — yeniden yükleme gerekmez.
Adım 5: Kopyalayın, Dışa Aktarın veya Devam Edin
Tüm çıktılar düz metindir — görsel üzerine ek açıklama veya sınırlayıcı kutular yoktur. Ancak şunları yapabilirsiniz:
- Sonuçları seçip kopyalayın (Ctrl/Cmd+C)
- Belgelere, Jira kayıtlarına veya Notion’a yapıştırın
- Her mesaj balonunun sağ üst köşesindeki "Kopyala" düğmesini kullanın
- Kaydırarak devam edin — bağlam penceresi en fazla 1 milyon token tutar, böylece uzun görüntü+metin sohbetleri tutarlı kalır
Henüz bir "PDF olarak dışa aktar" düğmesi yoktur, ancak arşiv amacıyla yazdırma (Ctrl+P) → "PDF olarak kaydet" seçeneğini kullanabilirsiniz.
Quick Takeaways
Kimler İçin Uygun — ve Kimler Beklemeli?
Bu iş akışı aşağıdaki durumlarda mükemmel sonuç verir:
✔️ Geliştirici araçlarından, panolardan veya mobil uygulamalardan alınan ekran görüntüleri analizi
✔️ Elle transkripsiyon yapmadan faturalar, formlar veya etiketler gibi belgeleri denetleme
✔️ Öğretim veya hata ayıklama: öğrenci çalışmalarını veya hata kayıtlarını yükleyip "Off-by-one hatası nerede?" diye sorun
✔️ Sağlık veya finans gibi düzenlenmiş alanlarda çalışma: her etkileşim tarayıcınızda kalır, sunucu tarafında depolama yapılmaz — denetim izleri önemliyse idealdir
Aşağıdaki ihtiyaçlarınız varsa uygun değil:
✖️ Gerçek zamanlı kamera akışı analizi (web arayüzünde kamera erişimi yoktur)
✖️ 50+ görüntü toplu işlemi (web üzerinden toplu yükleme veya CLI desteği yoktur)
✖️ Diyagram oluşturma (V4 Pro görüntüleri yorumlar, oluşturamaz)
✖️ Çevrimdışı kullanım (kararlı internet bağlantısı gerektirir; PWA veya yerel önbellekleme yoktur)
Şimdi Deneyin — Sıfır Kurulumla
DeepSeek V4 Pro’nun görüntü yeteneği canlı, hızlı ve üretim düzeyinde — ancak yalnızca MidassAI Sohbet üzerinden kullanılabilir. İndirme, yapılandırma ya da çıkarım sunucularının başlatılmasını beklemenize gerek yoktur.
İlk görüntü analizinizi < 60 saniyede tamamlayabilirsiniz:
- https://www.midassai.com/chat/ adresine gidin
- 📎’ye tıklayın → bir ekran görüntüsü veya fotoğraf seçin
- Tam olarak ihtiyacınız olanı sorun — net ve spesifik olun
- Yanıtı okuyun. Gerekirse iyileştirme yapın.
İşte bu kadar. Hesap gerekmiyor. Deneme süresi yok. Görüntü sorguları için kullanım sınırı yok — yalnızca tarayıcınızda çalışan saf, çok modlu zeka.
| Feature | DeepSeek V4 Pro (Web) | Local Ollama V4 |
|---|---|---|
| Vision support | ✅ Full multimodal (image + text) | ❌ Text-only by default |
| Setup time | ⏱️ 0 min — browser only | ⏱️ 15–45 min (GPU, RAM, quantization) |
| Context length | 🧮 1M tokens (with image tokens) | 🧮 ≤128K (if vision even enabled) |
| Agent workflows | ✅ Supported (e.g., ‘analyze image → search docs → summarize’) | ❌ Not implemented in Ollama |