Yapay Zeka Kütüphanesi
HAZIRPROMPTLAR
Bildirimler

Son eklenen içerikler

İleri Teknikler Öne Çıkan

Multimodal Prompting: Metin Ötesi

Görsel, ses, video ve doküman gibi farklı veri türlerini yapay zeka ile işleme tekniklerini kapsamlı şekilde öğrenin. GPT-4V, Claude Vision, Gemini Pro Vision gibi multimodal modellerin yeteneklerini keşfedin. Görsel analiz, belge işleme, grafik yorumlama ve çoklu modalite kombinasyonları için profesyonel prompt stratejilerini bu detaylı rehberde bulacaksınız.

16 dakika okuma 415 görüntülenme 03 Şub 2026

Puan ver

Henüz puan yok

Paylaş

Multimodal AI: Tek Modaliteden Çoklu Algıya

Multimodal yapay zeka, birden fazla veri türünü (modalite) aynı anda anlayabilen, işleyebilen ve üretebilen sistemleri ifade eder. Geleneksel dil modelleri yalnızca metinle çalışırken, multimodal modeller görsel, ses, video ve diğer veri türlerini de anlayabilir. Bu gelişme, AI'nın dünyayı algılama ve anlama kapasitesinde devrim niteliğinde bir sıçramayı temsil etmektedir.

İnsan iletişimi doğası gereği multimodaldır: Konuşurken jest ve mimikler kullanırız, yazarken görseller ekleriz, öğrenirken birden fazla duyumuzu kullanırız. Multimodal AI, yapay zekanın bu zengin, çok katmanlı iletişim biçimini anlamasını ve ona yanıt verebilmesini sağlar. Bu rehberde, multimodal AI sistemleriyle etkili çalışmanın tüm inceliklerini öğreneceksiniz.


👁️ Temel Kavram: Multimodal = Multi (çok) + Modal (biçim/tür). Metin + Görsel + Ses + Video gibi farklı veri türlerinin birlikte işlenmesi. "Bir resim bin kelimeye bedeldir" atasözü, multimodal AI ile gerçeğe dönüşüyor.


Modalite Türleri ve Yetenekler

Modalite Haritası

┌─────────────────────────────────────────────────────────────────┐
│                    MULTİMODAL AI MODALİTELERİ                   │
├─────────────────────────────────────────────────────────────────┤
│                                                                 │
│  ┌─────────────┐  ┌─────────────┐  ┌─────────────┐             │
│  │   METİN     │  │   GÖRSEL    │  │    SES      │             │
│  │   (Text)    │  │   (Vision)  │  │   (Audio)   │             │
│  ├─────────────┤  ├─────────────┤  ├─────────────┤             │
│  │ • Doğal dil │  │ • Fotoğraf  │  │ • Konuşma   │             │
│  │ • Kod       │  │ • Çizim     │  │ • Müzik     │             │
│  │ • Yapısal.  │  │ • Grafik    │  │ • Ses efekt │             │
│  │   veri      │  │ • Ekran gör.│  │ • Ortam sesi│             │
│  │ • Markdown  │  │ • Doküman   │  │             │             │
│  └─────────────┘  └─────────────┘  └─────────────┘             │
│                                                                 │
│  ┌─────────────┐  ┌─────────────┐  ┌─────────────┐             │
│  │   VİDEO     │  │   DOKÜMAN   │  │    3D       │             │
│  │   (Video)   │  │(Structured) │  │  (Spatial)  │             │
│  ├─────────────┤  ├─────────────┤  ├─────────────┤             │
│  │ • Kısa klip │  │ • PDF       │  │ • 3D model  │             │
│  │ • Uzun video│  │ • Excel     │  │ • Nokta bul.│             │
│  │ • Canlı akt.│  │ • Sunum     │  │ • Mekansal  │             │
│  │ • Animasyon │  │ • Tablo     │  │   veri      │             │
│  └─────────────┘  └─────────────┘  └─────────────┘             │
│                                                                 │
└─────────────────────────────────────────────────────────────────┘

GİRDİ → İŞLEME → ÇIKTI

Girdi Modaliteleri:     İşleme:           Çıktı Modaliteleri:
- Metin                 • Anlama          • Metin
- Görsel                • Analiz          • Görsel (bazı modeller)
- Ses                   • Sentez          • Ses (bazı modeller)
- Video                 • Dönüştürme      • Kod
- Doküman               • Üretme          • Yapılandırılmış veri

Güncel Multimodal Modeller

┌─────────────────────────────────────────────────────────────────┐
│                    MULTIMODAL MODEL KARŞILAŞTIRMASI             │
├─────────────┬─────────────┬─────────────┬─────────────┬─────────┤
│ Model       │ Görsel      │ Ses         │ Video       │ Doküman │
├─────────────┼─────────────┼─────────────┼─────────────┼─────────┤
│ GPT-4V/4o   │ ✅ Güçlü    │ ✅ (4o)     │ ⚠️ Sınırlı  │ ✅      │
│ Claude 3.5  │ ✅ Güçlü    │ ❌          │ ❌          │ ✅      │
│ Gemini Pro  │ ✅ Güçlü    │ ✅          │ ✅ Güçlü    │ ✅      │
│ Gemini 1.5  │ ✅ Çok güçlü│ ✅          │ ✅ 1 saat+  │ ✅      │
│ LLaVA       │ ✅ Açık kay.│ ❌          │ ❌          │ ⚠️      │
│ Qwen-VL     │ ✅ Açık kay.│ ❌          │ ⚠️          │ ✅      │
└─────────────┴─────────────┴─────────────┴─────────────┴─────────┘

✅ = Güçlü destek   ⚠️ = Kısıtlı destek   ❌ = Destek yok

NOT: Bu alan hızla gelişiyor, yetenekler sürekli genişliyor.

Görsel Anlama (Vision) Teknikleri

Görsel Prompt Yapısı

TEMEL GÖRSEL PROMPT FORMATI:

┌─────────────────────────────────────────────────────────────────┐
│ [GÖRSEL] + [METİN TALİMATI]                                     │
├─────────────────────────────────────────────────────────────────┤
│                                                                 │
│  ┌─────────────────┐                                           │
│  │                 │                                           │
│  │    [GÖRSEL]     │  +  "Bu görseli analiz et ve..."         │
│  │                 │                                           │
│  └─────────────────┘                                           │
│                                                                 │
│  Etkili Görsel Prompt Bileşenleri:                             │
│  1. Bağlam: Görselin ne olduğunu/nereden geldiğini belirt      │
│  2. Odak: Hangi detaylara dikkat edilmesini istediğinizi söyle │
│  3. Görev: Spesifik olarak ne yapılmasını istediğinizi tanımla │
│  4. Format: Çıktının nasıl olmasını istediğinizi belirtin      │
│                                                                 │
└─────────────────────────────────────────────────────────────────┘

Görsel Analiz Türleri ve Prompt Örnekleri

1. Genel Görsel Tanımlama

ZAYIF PROMPT:
"Bu resimde ne var?"

GÜÇLÜ PROMPT:
"Bu görseli detaylı olarak tanımla:

1. ANA ÖĞELER: Görseldeki ana nesne veya kişileri listele
2. ORTAM: Mekan, arka plan ve atmosferi açıkla
3. RENKLER: Baskın renk paletini belirt
4. KOMPOZİSYON: Görsel düzenleme ve dengeyi değerlendir
5. DUYGU: Görselin aktardığı his veya ruh halini tanımla
6. DETAYLAR: Dikkat çekici küçük detayları not et

Yanıtını bu başlıklar altında yapılandır."

2. Teknik Görsel Analizi

FOTOĞRAF ANALİZİ:
"Bu fotoğrafı profesyonel bir fotoğrafçı gözüyle analiz et:

TEKNİK DEĞERLENDİRME:
- Pozlama: Doğru mu, açık mı, karanlık mı?
- Odak: Keskin mi, bulanık alanlar var mı?
- Kompozisyon: Üçler kuralı, altın oran uygulanmış mı?
- Işık: Işık kaynağı, yönü, kalitesi (sert/yumuşak)
- Derinlik: Alan derinliği tercihi

GÜÇLÜ YÖNLER:
[En az 3 madde]

GELİŞTİRİLEBİLİR ALANLAR:
[En az 3 madde]

ÖNERİLER:
Benzer bir kareyi çekerken nelere dikkat edilmeli?"

3. Nesne Tespiti ve Sayma

NESNE TESPİT PROMPT:
"Bu görseli dikkatlice incele ve şunları yap:

1. TÜM NESNELERİ LİSTELE:
   Her nesne için: [nesne adı] - [konum] - [sayı]
   
2. KATEGORİZE ET:
   • Canlılar: 
   • Araçlar:
   • Yapılar:
   • Doğal öğeler:
   • Diğer:

3. SAYISAL ÖZET:
   Toplam nesne sayısı: X
   Benzersiz nesne türü: Y

4. GÜVENİLİRLİK:
   Her tespit için güvenilirlik seviyesi belirt (kesin/muhtemel/belirsiz)

Küçük veya kısmen görünen nesneleri de dahil et."

4. OCR ve Metin Çıkarma

METİN ÇIKARMA PROMPT:
"Bu görseldeki tüm metinleri çıkar:

GÖREVLER:
1. Tüm görünür metinleri oku ve listele
2. Her metin için konumunu belirt (üst/alt/sol/sağ/merkez)
3. Metin türünü sınıflandır:
   • Başlık
   • Alt yazı
   • Etiket
   • Logo/marka
   • El yazısı
   • Diğer

4. Okunması zor metinler için en iyi tahminini yap ve 
   [belirsiz] olarak işaretle

5. Metinlerin dilini belirt

ÇIKTI FORMATI:
| Metin | Konum | Tür | Dil | Güvenilirlik |
|-------|-------|-----|-----|--------------|"

5. Karşılaştırmalı Analiz

İKİ GÖRSEL KARŞILAŞTIRMA:
"Bu iki görseli karşılaştır:

[Görsel 1] ve [Görsel 2]

ANALİZ:
1. BENZERLİKLER:
   • Konu/içerik benzerlikleri
   • Stil benzerlikleri
   • Teknik benzerlikler

2. FARKLILIKLAR:
   • Belirgin farklılıklar
   • İnce nüanslar
   • Kalite/çözünürlük farkları

3. DEĞİŞİM ANALİZİ (eğer önce/sonra ise):
   • Ne değişmiş?
   • Ne aynı kalmış?
   • Değişimin yönü (iyileşme/kötüleşme/nötr)

4. TERCİH:
   Belirli bir amaç için hangisi daha uygun ve neden?"

Doküman ve Yapılandırılmış Görsel İşleme

PDF ve Doküman Analizi

DOKÜMAN ANALİZ PROMPT:
"Bu doküman görselini analiz et:

DOKÜMAN TİPİNİ BELİRLE:
□ Fatura          □ Sözleşme       □ Form
□ Rapor           □ Mektup         □ Tablo
□ Sunum sayfası   □ Sertifika      □ Diğer: ___

BİLGİ ÇIKARIMI:
1. ANA BİLGİLER:
   • Başlık/Konu:
   • Tarih:
   • Gönderen/Alıcı:
   • Referans numaraları:

2. İÇERİK ÖZETİ:
   [Dokümanın ana içeriğini 3-5 cümlede özetle]

3. ÖNEMLİ VERİLER:
   • Sayısal değerler (tutarlar, miktarlar):
   • Tarihler ve süreler:
   • İsimler ve kuruluşlar:
   • İletişim bilgileri:

4. YAPI ANALİZİ:
   • Bölüm sayısı:
   • Tablo var mı:
   • İmza/mühür var mı:
   • Logo/marka öğeleri:

JSON formatında yapılandırılmış çıktı ver."

Tablo ve Grafik Yorumlama

TABLO ANALİZ PROMPT:
"Bu tablodaki verileri analiz et:

1. TABLO YAPISI:
   • Satır sayısı:
   • Sütun sayısı:
   • Sütun başlıkları:

2. VERİ ÇIKARIMI:
   Tüm verileri şu formatta çıkar:
   | Sütun1 | Sütun2 | Sütun3 | ... |
   |--------|--------|--------|-----|
   | veri   | veri   | veri   | ... |

3. İSTATİSTİKSEL ÖZET (sayısal sütunlar için):
   • Toplam:
   • Ortalama:
   • Min/Max:

4. GÖZLEMLER:
   • Öne çıkan trendler
   • Anomaliler
   • Dikkat çekici noktalar"

─────────────────────────────────────────────────

GRAFİK YORUMLAMA PROMPT:
"Bu grafiği yorumla:

1. GRAFİK TİPİ:
   □ Çizgi grafik    □ Bar/sütun grafik
   □ Pasta grafik    □ Dağılım grafiği
   □ Alan grafik     □ Diğer: ___

2. EKSENLER VE ETİKETLER:
   • X ekseni: [ne gösteriyor, birim]
   • Y ekseni: [ne gösteriyor, birim]
   • Başlık:
   • Lejant:

3. VERİ OKUMA:
   • Başlangıç değeri:
   • Bitiş değeri:
   • Maksimum nokta:
   • Minimum nokta:
   • Önemli dönüm noktaları:

4. TREND ANALİZİ:
   • Genel yön: Artış / Azalış / Sabit / Dalgalı
   • Değişim oranı:
   • Mevsimsellik veya döngüsellik var mı?

5. YORUMLAMA:
   Bu grafik ne anlatıyor? (2-3 cümle)
   
6. TAHMİN (varsa):
   Trend devam ederse gelecek dönem tahmini"

UI/UX Ekran Görüntüsü Analizi

UI ANALİZ PROMPT:
"Bu uygulama/web sitesi ekran görüntüsünü UX uzmanı 
gözüyle değerlendir:

1. GENEL İZLENİM:
   • İlk bakışta ne hissettiriyor?
   • Amacı hemen anlaşılıyor mu?
   • Hedef kitle tahmini

2. GÖRSEL TASARIM:
   • Renk kullanımı ve uyumu
   • Tipografi seçimleri
   • Boşluk ve hizalama
   • Görsel hiyerarşi
   • Tutarlılık

3. KULLANILABILIRLIK:
   • Navigasyon netliği
   • CTA (Call-to-Action) belirginliği
   • Form elemanları (varsa)
   • Okunabilirlik

4. MODERN STANDARTLARA UYUM:
   • Responsive görünüm ipuçları
   • Erişilebilirlik (kontrast, boyutlar)
   • Platform kurallarına uyum (iOS/Android/Web)

5. GÜÇLÜ YÖNLER: [3 madde]

6. İYİLEŞTİRME ÖNERİLERİ: [3 madde, öncelik sırasıyla]

7. PUAN: /10 (gerekçesiyle)"

Özel Kullanım Senaryoları

E-Ticaret Ürün Analizi

ÜRÜN FOTOĞRAFI ANALİZ:
"Bu ürün fotoğrafını e-ticaret perspektifinden analiz et:

ÜRÜN TANIMLAMA:
- Ürün kategorisi:
- Tahmini ürün adı:
- Ana malzeme/materyal:
- Renk(ler):
- Tahmini boyut:

ÜRÜN AÇIKLAMASI OLUŞTUR:
[SEO uyumlu, 150-200 kelimelik ürün açıklaması yaz.
Özellikler, faydalar ve kullanım alanlarını vurgula.]

ANAHTAR KELİMELER:
[Bu ürün için 10 adet SEO anahtar kelime öner]

FOTOĞRAF KALİTESİ:
- E-ticaret için uygun mu?
- Arka plan:
- Aydınlatma:
- Çözünürlük tahmini:
- İyileştirme önerileri:

BENZER ÜRÜN ÖNERİLERİ:
[Cross-sell için 3 ürün kategorisi öner]"

Tıbbi/Sağlık Görseli Analizi

⚠️ ÖNEMLİ UYARI: AI tıbbi teşhis aracı DEĞİLDİR. 
Tüm sağlık kararları için profesyonel sağlık 
uzmanlarına danışılmalıdır.

GENEL SAĞLIK GÖRSELİ PROMPT:
"Bu sağlıkla ilgili görseli eğitim amaçlı analiz et:

DİKKAT: Bu analiz yalnızca bilgilendirme amaçlıdır ve 
tıbbi tavsiye yerine geçmez. Herhangi bir sağlık endişesi 
için mutlaka bir sağlık uzmanına başvurun.

GÖRSEL TİPİ:
□ Anatomi şeması     □ Tıbbi cihaz
□ İlaç/ambalaj       □ Egzersiz gösterimi
□ Beslenme görseli   □ Diğer: ___

GÖRSEL İÇERİĞİ:
[Görselde ne gösterildiğini objektif olarak tanımla]

EĞİTİMSEL BİLGİ:
[Konuyla ilgili genel bilgi - kesinlikle teşhis değil]

PROFESYONEL DANIŞMA:
Bu konuda hangi uzmana başvurulmalı?"

Gayrimenkul ve Mekan Analizi

GAYRİMENKUL FOTOĞRAF ANALİZ:
"Bu ev/mekan fotoğrafını analiz et:

MEKAN ÖZELLİKLERİ:
- Oda tipi: (salon, yatak odası, mutfak, vb.)
- Tahmini alan (m²):
- Tavan yüksekliği:
- Pencere/doğal ışık:
- Zemin tipi:

STİL VE DEKORASYON:
- Tasarım stili: (modern, klasik, minimalist, vb.)
- Renk paleti:
- Mobilya kalitesi tahmini:
- Dikkat çekici öğeler:

DURUM DEĞERLENDİRMESİ:
- Genel bakım durumu: /10
- Görünür sorunlar:
- Yenileme ihtiyacı:

PAZARLAMA AÇIKLAMASI:
[Emlak ilanı için çekici 100 kelimelik açıklama yaz]

FOTOĞRAF ÖNERİLERİ:
Bu mekanın daha iyi fotoğraflanması için öneriler"

Çoklu Görsel ve Sıralı Analiz

Çoklu Görsel Karşılaştırma

ÇOKLU GÖRSEL PROMPT:
"Bu [X] görseli birlikte analiz et:

[Görsel 1] [Görsel 2] [Görsel 3] ...

GÖREV: [Seçeneklerden birini seç]

A) SIRALAMA:
"Bu görselleri [kritere göre] sırala.
Her görsel için sıralama gerekçesi ver.
1. [En iyi] - Gerekçe
2. ...
3. [En zayıf] - Gerekçe"

B) GRUPLAMA:
"Bu görselleri benzerliklerine göre grupla.
Grup 1: [Görsel X, Y] - Ortak özellik: ...
Grup 2: [Görsel Z] - Ortak özellik: ..."

C) TUTARLILIK KONTROLÜ:
"Bu görseller aynı ürün/mekan/kişiye ait mi?
Tutarlılık puanı: /10
Tutarsızlıklar: ..."

D) EN İYİ SEÇİM:
"[Amaç için] en uygun görseli seç ve gerekçelendir.
Seçim: Görsel [X]
Gerekçe: ...
Diğerlerinin eksikleri: ..."

Görsel Hikaye/Sıra Analizi

GÖRSEL SIRA ANALİZİ:
"Bu görseller bir sıra/süreç oluşturuyor. Analiz et:

[Görsel 1] → [Görsel 2] → [Görsel 3] → ...

1. SÜREÇ TANIMLAMA:
   Bu görseller hangi süreci/hikayeyi anlatıyor?

2. ADIM ADIM AÇIKLAMA:
   Adım 1: [Görsel 1'in açıklaması]
   Adım 2: [Görsel 2'nin açıklaması]
   ...

3. GEÇİŞ ANALİZİ:
   Görsel 1→2: Ne değişti?
   Görsel 2→3: Ne değişti?
   ...

4. EKSİK ADIM KONTROLÜ:
   Mantıksal boşluk var mı? 
   Eksik görsel/adım olabilir mi?

5. SÜREÇ ÖZET:
   [Tüm süreci 2-3 cümlede özetle]"

Ses ve Video Modaliteleri

Ses İşleme (Destekleyen Modeller İçin)

SES/KONUŞMA ANALİZ PROMPT:
"Bu ses kaydını analiz et:

1. TRANSKRİPSİYON:
   [Konuşmayı metne çevir]

2. KONUŞMACI ANALİZİ:
   • Konuşmacı sayısı:
   • Her konuşmacının tahmini özellikleri
   • Konuşma süresi dağılımı

3. İÇERİK ANALİZİ:
   • Ana konu:
   • Anahtar noktalar:
   • Alınan kararlar (varsa):
   • Aksiyon maddeleri:

4. TON VE DUYGU:
   • Genel ton: (resmi/gayri resmi/gergin/rahat)
   • Duygusal durum:
   • Önemli ton değişimleri:

5. KALİTE DEĞERLENDİRME:
   • Ses netliği:
   • Arka plan gürültüsü:
   • Anlaşılabilirlik:"

Video Analizi (Destekleyen Modeller İçin)

VIDEO ANALİZ PROMPT (Gemini 1.5 vb.):
"Bu videoyu analiz et:

1. GENEL BAKIŞ:
   • Video süresi:
   • Video türü: (eğitim/tanıtım/vlog/haber/diğer)
   • Ana konu:
   • Hedef kitle:

2. YAPI ANALİZİ:
   • Giriş (0:00-X:XX): [Özet]
   • Gelişme bölümleri:
     - Bölüm 1 (X:XX-X:XX): [Özet]
     - Bölüm 2 (X:XX-X:XX): [Özet]
   • Sonuç (X:XX-X:XX): [Özet]

3. GÖRSEL ELEMENTLER:
   • Çekim kalitesi:
   • Kullanılan grafikler/metin:
   • B-roll kullanımı:
   • Geçiş efektleri:

4. SES ELEMENTLER:
   • Anlatım kalitesi:
   • Müzik kullanımı:
   • Ses efektleri:

5. ÖNEMLİ ANLAR:
   [Timestamp ile önemli anları listele]
   • X:XX - [Önemli nokta]
   • X:XX - [Önemli nokta]

6. ÖZET:
   [30 saniyelik video özeti yaz]

7. DEĞERLENDİRME:
   Güçlü yönler:
   Geliştirilebilir alanlar:
   Genel puan: /10"

Modalite Kombinasyonları

Metin + Görsel Birlikte Kullanım

BAĞLAMLI GÖRSEL ANALİZ:
"Aşağıdaki bağlam bilgisini kullanarak görseli analiz et:

BAĞLAM:
'''
[Ürün spesifikasyonları / Olay açıklaması / Teknik detaylar]
'''

GÖRSEL:
[Görsel]

GÖREV:
1. Görsel, verilen bağlamla uyumlu mu?
2. Bağlamdaki hangi bilgiler görselde doğrulanıyor?
3. Görselde olup bağlamda olmayan detaylar var mı?
4. Bağlamda olup görselde görünmeyen şeyler var mı?
5. Tutarsızlıklar veya sorunlar var mı?"

─────────────────────────────────────────────────

GÖRSEL + METİN ÜRETME:
"Bu görsele dayanarak şunları oluştur:

1. SOSYAL MEDYA İÇERİĞİ:
   • Instagram caption (emoji dahil, 150 karakter)
   • Twitter/X postu (280 karakter limit)
   • LinkedIn profesyonel paylaşım

2. PAZARLAMA METNİ:
   • Başlık (dikkat çekici, 10 kelime max)
   • Alt başlık (değer önerisi, 20 kelime max)
   • Gövde metin (100 kelime, ikna edici)

3. ALTERNATİF METİN (Accessibility):
   [Görme engelli kullanıcılar için detaylı açıklama]"

Çoklu Modalite Entegrasyonu

KAPSAMLI ÇOK MODALİTE PROMPT:
"Şu materyalleri birlikte değerlendir:

MATERYALLER:
- Metin: [Ürün açıklaması/Rapor/Makale]
- Görsel 1: [Ürün fotoğrafı/Grafik]
- Görsel 2: [Tablo/Şema]
- (Varsa) Ses/Video: [Açıklama]

ENTEGRE ANALİZ:
1. TUTARLILIK KONTROLÜ:
   Tüm materyaller birbiriyle tutarlı mı?
   Çelişkiler var mı?

2. BİLGİ SENTEZİ:
   Tüm kaynaklardan elde edilen ana bulgular:
   • Bulgu 1 (Kaynak: metin + görsel 1)
   • Bulgu 2 (Kaynak: görsel 2)
   • ...

3. BOŞLUK ANALİZİ:
   Hangi bilgiler eksik?
   Ek materyal gerekli mi?

4. ÖZET RAPOR:
   [Tüm materyalleri sentezleyen 200 kelimelik özet]

5. AKSİYON ÖNERİLERİ:
   Bu materyallere dayanarak öneriler"

En İyi Uygulamalar

Görsel Kalitesi ve Hazırlık

GÖRSEL OPTİMİZASYON KONTROL LİSTESİ:

✅ ÇÖZÜNÜRLÜK:
   • Minimum 512x512 piksel önerilir
   • Çok yüksek çözünürlük gereksiz (maliyet artırır)
   • Optimal: 1024x1024 - 2048x2048 arası

✅ NETLİK:
   • Bulanık görseller analiz kalitesini düşürür
   • Odak sorunu varsa belirtin
   
✅ AYDINLATMA:
   • Çok karanlık veya çok parlak görseller sorunlu
   • Düzgün aydınlatma tercih edilmeli

✅ KADRAJ:
   • Analiz edilecek öğe net görünmeli
   • Gereksiz boşluklardan kaçının
   • Önemli detaylar kesilmemiş olmalı

✅ FORMAT:
   • JPEG, PNG, WebP genellikle desteklenir
   • GIF: sadece ilk frame analiz edilebilir
   • PDF: sayfa sayfa görsel olarak işlenir

✅ DOSYA BOYUTU:
   • Model limitlerini kontrol edin
   • Çok büyük dosyalar sıkıştırılabilir

Prompt Yazım İpuçları

ETKİLİ MULTİMODAL PROMPT İÇİN:

1. SPESİFİK OLUN:
   ❌ "Bu resmi açıkla"
   ✅ "Bu ürün fotoğrafındaki tüm görünür özellikleri, 
      malzemeyi ve renkleri listele"

2. ODAK BELİRTİN:
   ❌ "Ne görüyorsun?"
   ✅ "Sol üst köşedeki logoya odaklan ve markayı tanımla"

3. FORMAT İSTEYİN:
   ❌ "Analiz et"
   ✅ "Analiz et ve sonuçları tablo formatında sun"

4. BAĞLAM VERİN:
   ❌ [Sadece görsel]
   ✅ "Bu bir 2023 model arabanın iç mekan fotoğrafı. 
      Güvenlik özelliklerini değerlendir."

5. ÇOK ADIMLI GÖREVLER:
   ❌ "Her şeyi yap"
   ✅ "Önce X yap, sonra Y yap, son olarak Z yap"

6. BELİRSİZLİK YÖNETİMİ:
   ✅ "Emin olmadığın detayları [belirsiz] olarak işaretle"
   ✅ "Görünmeyen kısımlar için varsayım yapma"

Sık Yapılan Hatalar

KAÇINILMASI GEREKEN HATALAR:

❌ AŞIRI GENEL PROMPT:
   "Bu resme bak" → Belirsiz, yönsüz
   
❌ GÖRSELSİZ GÖRSEL REFERANSI:
   "Gönderdiğim resimde..." (ama resim yok)
   
❌ MODEL YETENEKLERİNİ AŞAN BEKLENTI:
   "Bu röntgende hastalığı teşhis et" (Tıbbi teşhis yapamaz)
   
❌ DÜŞÜK KALİTE GÖRSEL:
   Bulanık, karanlık, çok küçük görseller
   
❌ YANLIŞ MODALİTE:
   Ses dosyasını görsel olarak göndermeye çalışmak
   
❌ ÇOK FAZLA GÖRSEL:
   Token limitini aşan çok sayıda görsel
   
❌ BAĞLAM EKSİKLİĞİ:
   Yoruma açık görseller için bağlam vermemek

Multimodal AI'ın Geleceği

GÜNCEL TRENDLER VE BEKLENTİLER:

2024-2025 TRENDLERİ:
┌─────────────────────────────────────────────────────────────────┐
│ • Gerçek zamanlı video anlama ve işleme                        │
│ • Daha uzun video/ses desteği (saatler mertebesinde)           │
│ • 3D ve mekansal veri anlama                                   │
│ • Çoklu modalite üretimi (metin→görsel→video→ses)              │
│ • Daha düşük gecikme süresi                                    │
│ • On-device multimodal modeller                                │
│ • Daha iyi fine-grained görsel anlama                          │
└─────────────────────────────────────────────────────────────────┘

UYGULAMA ALANLARI GENİŞLEMESİ:
- Otonom araçlar (görsel+lidar+radar)
- Akıllı perakende (görsel ürün tanıma)
- Sağlık (çok modaliteli hasta verileri)
- Eğitim (interaktif multimedya öğrenme)
- Erişilebilirlik (görsel→ses dönüşümü)
- İçerik moderasyonu (metin+görsel+ses)
- Yaratıcı endüstriler (AI destekli tasarım)

Sonuç

Multimodal prompting, AI ile etkileşimimizi metin ötesine taşıyarak çok daha zengin, bağlamsal ve gerçek dünyaya yakın bir deneyim sunmaktadır. Görsel analiz, doküman işleme, ses ve video anlama gibi yetenekler, AI'ı gerçek anlamda çok yönlü bir asistana dönüştürür. Bu rehberde öğrendiğiniz teknikleri - doğru görsel hazırlama, etkili prompt yapılandırma, modalite kombinasyonları ve özel kullanım senaryoları - projelerinizde uygulayarak AI'dan maksimum verim alabilirsiniz. Multimodal AI hızla gelişen bir alan olduğundan, yeni model yeteneklerini ve en iyi uygulamaları takip etmeyi sürdürün. Geleceğin AI etkileşimi şüphesiz multimodal olacaktır.

Son güncelleme: 03 Şubat 2026
Faydalı mıydı?

Topluluk Görüşleri

Bu içerik hakkında üyeler neler düşünüyor?

Topluluğa Katılın

Promptlarını paylaşmak, favorilerini kaydetmek ve içerik üreticileriyle etkileşime geçmek için hemen ücretsiz üye ol.

4,550 üye 1,700 yorum 1,133 içerikte tartışma