Yapay Zeka Kütüphanesi
HAZIRPROMPTLAR
Bildirimler

Son eklenen içerikler

Yapay Zeka Nedir?

Doğal Dil İşleme ve Büyük Dil Modellerinin Temelleri

Büyük dil modelleri nasıl çalışır? Doğal dil işlemenin temellerini, token yapısını ve transformatör mimarisini sade bir dille öğrenin.

8 dakika okuma 391 görüntülenme 22 Mar 2026

Puan ver

Henüz puan yok

Paylaş

Doğal Dil İşleme ve Büyük Dil Modellerinin Temelleri

ChatGPT'ye bir soru sorduğunuzda veya Claude'dan bir metin yazmasını istediğinizde, arka planda son derece karmaşık matematiksel süreçler işlemeye başlar. Peki bu süreçler tam olarak nasıl çalışır? Bilgisayarlar, insan dilini nasıl anlıyor ve anlamlı yanıtlar üretebiliyor? Bu rehberde, modern yapay zeka asistanlarının temelini oluşturan Doğal Dil İşleme (NLP) ve Büyük Dil Modelleri (LLM) kavramlarını, teknik detaylardan kaçınmadan sade bir dille açıklayacağız.

Doğal Dil İşleme Nedir ve Neden Zordur

Doğal dil işleme (Natural Language Processing - NLP), bilgisayarların insan dilini anlamasını, yorumlamasını ve üretmesini sağlayan yapay zeka dalıdır. Kulağa basit gelir; ancak insan dili, bilgisayarlar için son derece çetrefilli bir yapıya sahiptir.

Bir cümleyi düşünün: "Bankaya gittim." Bu cümlede "banka" nehir kıyısı anlamına mı geliyor, yoksa finans kurumu mu? Bağlamı bilmeden cevaplamak imkânsızdır. İşte bu tür belirsizlikler, doğal dil işlemeyi onlarca yıl boyunca bilgisayarlar için neredeyse aşılmaz bir engel haline getirdi.


  • Sözdizimsel belirsizlik: Aynı cümlenin birden fazla gramer yapısına sahip olması
  • Anlamsal belirsizlik: Bir kelimenin farklı bağlamlarda farklı anlamlara gelmesi
  • Bağlam bağımlılığı: Önceki cümlelere göre anlam değişikliği
  • Kültürel ve deyimsel ifadeler: "Bardaktan boşanırcasına yağmur yağdı" gibi cümleler
💡 İpucu: Doğal dil işlemenin ne kadar zor olduğunu anlamak için şunu deneyin: "Bu filmi izlemek gerekiyor mu?" sorusunu bir bilgisayara açıklamaya çalışın. Sorunun tavsiye mi, eleştiri mi, yoksa merak mı içerdiğini belirlemek için tonlarca bağlam bilgisi gereklidir.

Token Nedir ve Dil Modelleri Metni Nasıl Görür

Büyük dil modelleri, metni doğrudan harf harf ya da kelime kelime işlemez. Bunun yerine token adı verilen parçalar kullanır. Token, bir kelimenin tamamı, bir hecesi veya bir noktalama işareti olabilir.

Örneğin "merhaba" kelimesi tek bir token iken, "yapay zeka" iki ayrı token olarak işlenebilir. Türkçe gibi eklemeli dillerde ise durum daha karmaşıktır: "geliyorsunuz" kelimesi birden fazla tokena bölünebilir çünkü model, bu yapıyı daha küçük anlam birimlerine ayırarak işler.

Örnek token ayrıştırması:

"Yapay zeka modelleri metni token'lara böler."

Token 1: "Yapay"
Token 2: " zeka"
Token 3: " modelleri"
Token 4: " metni"
Token 5: " token"
Token 6: "'lara"
Token 7: " böler"
Token 8: "."

Bu cümle yaklaşık 8 token içerir.
Genel kural: 1 token ≈ 0.75 İngilizce kelime
Türkçe için bu oran değişkendir.

Neden tokenlar önemlidir? Çünkü modellerin bağlam penceresi (context window) token sayısıyla ölçülür. Bir modelin aynı anda işleyebildiği maksimum token sayısı ne kadar yüksekse, o kadar uzun metinleri analiz edebilir ve o kadar çok bağlamı aklında tutabilir.

⚠️ Uyarı: Türkçe metinler, aynı anlamı taşıyan İngilizce metinlere kıyasla genellikle daha fazla token tüketir. Bu durum, özellikle token başına ücretlendirilen API kullanımlarında maliyeti etkileyebilir.

Transformatör Mimarisi ve Dikkat Mekanizması

Modern büyük dil modellerinin hemen tamamı transformatör mimarisi üzerine inşa edilmiştir. Bu mimari, 2017 yılında Google araştırmacıları tarafından "Attention Is All You Need" başlıklı makaleyle tanıtıldı ve yapay zeka dünyasında devrim yarattı.

Transformatör mimarisinin özünde öz-dikkat mekanizması (self-attention) yatar. Bu mekanizma, modelin bir kelimeyi yorumlarken cümledeki diğer kelimelere ne kadar "dikkat" edeceğini belirlemesini sağlar.

Öz-Dikkat Nasıl Çalışır

"Ali elmayı yedi çünkü acıkmıştı" cümlesini düşünün. Model "o" zamirini gördüğünde bunun kimi ifade ettiğini anlaması gerekir. Öz-dikkat mekanizması, "o" kelimesinin "Ali" ile yüksek, "elma" ile düşük ilişki içinde olduğunu öğrenir ve bağlamı doğru yorumlar.


  • Encoder: Girdi metnini anlamlı bir temsile (vektör) dönüştürür
  • Decoder: Bu temsili kullanarak çıktı metnini kelime kelime üretir
  • Çok başlı dikkat (Multi-head attention): Metnin farklı özelliklerine aynı anda odaklanır
💡 İpucu: Transformatör mimarisini bir çeviri ekibine benzetebilirsiniz. Ekibin bir kısmı gramer kurallarına, bir kısmı kelime anlamlarına, bir kısmı ise tonlamaya odaklanır. Hepsi aynı anda çalışarak en doğru çeviriyi üretir. Transformatörde bu "uzmanlar" dikkat başlıklarıdır.

Büyük Dil Modelleri Nasıl Eğitilir

Bir büyük dil modeli oluşturmak, üç temel aşamadan geçer:

1. Ön Eğitim (Pre-training)

Model, internet, kitaplar, makaleler ve çeşitli yazılı kaynaklardan derlenen devasa bir metin veri kümesiyle eğitilir. Bu aşamada modelin tek görevi, bir sonraki tokeni tahmin etmektir. Milyarlarca parametre, bu tahminleri giderek daha doğru yapabilmek için güncellenir.

2. İnce Ayar (Fine-tuning)

Ön eğitim tamamlandıktan sonra model, belirli görevler için özelleştirilir. Örneğin bir müşteri hizmetleri asistanı için ince ayar yapılırken, modele o sektöre özgü diyaloglar ve yanıt biçimleri öğretilir.

3. İnsan Geri Bildirimiyle Pekiştirmeli Öğrenme (RLHF)

ChatGPT ve benzeri modellerin kullanıcı dostu olmasının sırrı bu aşamadadır. İnsan değerlendiriciler, modelin ürettiği farklı yanıtları karşılaştırır ve hangisinin daha yararlı, daha güvenli ve daha doğru olduğunu belirler. Model, bu geri bildirimlere göre davranışını iyileştirir.

Büyük Dil Modeli Eğitim Süreci (Özet):

[1] Veri Toplama
→ Milyarlarca kelime: web, kitap, makale

[2] Ön Eğitim
→ Görev: "Bir sonraki token ne olacak?"
→ Yüzlerce GPU, haftalar veya aylar

[3] İnce Ayar
→ Görev: "Kullanıcı isteklerine nasıl yanıt verilir?"
→ Etiketli veri kümeleri kullanılır

[4] RLHF
→ İnsan değerlendirmesi
→ Güvenli ve yararlı yanıt tercihi

[5] Dağıtım
→ Model kullanıcılara sunulur

Parametre Sayısı ve Ölçek Neden Önemlidir

Büyük dil modellerini birbirinden ayıran en önemli özelliklerden biri parametre sayısıdır. Parametreler, modelin eğitim sırasında öğrendiği ağırlık değerleridir; bir anlamda modelin "bilgisi" bu değerlerde saklanır.

GPT-2, 2019 yılında 1.5 milyar parametreyle çıktığında çığır açıcı bulunmuştu. Bugün ise milyarlarca hatta trilyonlarca parametreye sahip modeller konuşulmaktadır. Ancak parametre sayısı tek başına yeterli değildir; eğitim verilerinin kalitesi, mimari seçimler ve RLHF süreci de en az parametre sayısı kadar belirleyicidir.


  • Az parametreli modeller: Daha hızlı, daha az kaynak tüketir, belirli görevlerde etkili
  • Çok parametreli modeller: Daha geniş bilgi, daha iyi bağlam anlama, daha yüksek hesaplama maliyeti
  • Ölçek yasası: Genel bir kural olarak, daha büyük modeller daha iyi performans gösterir; ancak bu artış belirli bir noktadan sonra yavaşlar
💡 İpucu: Parametre sayısını bir insan beynindeki sinaptik bağlantı sayısına benzetebilirsiniz. Daha fazla bağlantı, daha karmaşık düşünce kalıplarına olanak tanır. Ancak ne kadar çok bağlantı varsa, o kadar çok enerji gerekir.

Doğal Dil İşleme ve LLM Alanında Nereden Başlamalısınız

Bu temel kavramları kavramak, yapay zeka araçlarını çok daha bilinçli kullanmanızı sağlar. Bir dil modelinin tokenlarla çalıştığını bilmek, daha kısa ve net prompt yazmaya teşvik eder. Bağlam penceresinin sınırlı olduğunu anlamak, uzun belgeleri doğru bölümlere ayırmanızı kolaylaştırır. RLHF'in modelleri şekillendirdiğini görmek ise yanıtların neden bazen temkinli ya da tarafsız göründüğünü açıklar.

Bu alanda daha derine inmek isteyenler için önerilen yol haritası:


  1. Temel NLP kavramlarını (tokenizasyon, vektör temsili, dikkat mekanizması) öğrenin
  2. Transformatör mimarisinin çalışma mantığını görsel kaynaklarla pekiştirin
  3. Açık kaynaklı modelleri (Llama, Mistral) inceleyerek pratik deneyim edinin
  4. Hugging Face gibi platformlarda küçük ölçekli denemelere başlayın
  5. Akademik gelişmeleri arXiv ve Google Scholar üzerinden takip edin

Doğal dil işleme ve büyük dil modelleri, yapay zekanın en dinamik ve hızlı gelişen alanlarından biridir. Temel kavramları sağlam bir şekilde öğrenmek, bu alandaki her yeni gelişmeyi çok daha hızlı anlamanızı sağlayacaktır. Bir sonraki adımda, vektör temsilleri ve gömme (embedding) kavramlarını keşfederek bu bilgileri genişletebilirsiniz.

Son güncelleme: 22 Mart 2026
Faydalı mıydı?

Topluluk Görüşleri

Bu içerik hakkında üyeler neler düşünüyor?

Topluluğa Katılın

Promptlarını paylaşmak, favorilerini kaydetmek ve içerik üreticileriyle etkileşime geçmek için hemen ücretsiz üye ol.

5,492 üye 1,736 yorum 1,157 içerikte tartışma