LLM
Büyük metin verisiyle eğitilmiş, verilen bağlamın en olası devamını üreten yapay zekâ modeli.
Kısa tanım
LLM (Large Language Model, büyük dil modeli), çok büyük miktarda metinle eğitilmiş ve verilen bir metnin en olası devamını tahmin eden yapay zekâ modelidir. Bu basit yetenek üzerine metin üretme, özetleme ve soru-yanıt gibi işler kurulur.
Nasıl çalışır
- Metni token denen küçük parçalara böler.
- Her adımda bir sonraki token'ı olasılıkla tahmin eder.
- Verilen tüm metni (bağlam / context) dikkate alır; bağlam penceresi sınırlıdır.
Sık karıştırılan noktalar
- Hatırlamaz, üretir: Model bilgiyi bir veritabanından çekmez; örüntüye göre tahmin eder. Bu yüzden kendinden emin bir yanlış (hallucination) üretebilir.
- Güncel değildir: Bilgisi eğitim verisiyle sınırlıdır; güncel/özel veri için RAG gibi teknikler kullanılır.
İlgili içerikler
Kavramı adım adım öğrenmek için LLM Nedir? Büyük Dil Modellerine Giriş dersine, gerçek bir uygulama için API'ye Bağlanmadan AI İçerik Asistanı Tasarlamak yazısına bakabilirsin.
İlgili Makaleler
API'ye Bağlanmadan AI İçerik Asistanı Tasarlamak: DummyProvider ile Güvenli Akış
Hiçbir dış API'ye bağlanmadan çalışan bir AI içerik asistanı: DummyProvider, sağlayıcı soyutlaması,...
İlgili Öğren İçerikleri
LLM Nedir? Büyük Dil Modellerine Giriş
Büyük dil modeli nedir, nasıl çalışır ve token ne demektir — matematiğe boğulmadan.
Detay →
