Telefon: 0 (552) 380 25 25  |  Hafta içi 10:00–18:00 · Teknik destek 7/24

🇬🇧 EN

Digital Bridge Blog

Yapay Zeka

Türkçe Doğal Dil İşleme: Şirket Metinlerini Anlayan Yapay Zeka Nasıl Kurulur?

Türkçe doğal dil işleme; e-posta, talep ve belgeleri sınıflandırıp özetleyen yapay zekadır. Türkçenin zorluklarını, yöntemleri ve pilot adımlarını anlattık.

7 dk okuma  · Digital Bridge Mühendislik Ekibi
Türkçe Doğal Dil İşleme: Şirket Metinlerini Anlayan Yapay Zeka Nasıl Kurulur?

Türkçe doğal dil işleme (NLP), bilgisayarın Türkçe yazılmış e-posta, müşteri talebi, sözleşme ya da yorum gibi metinleri anlayıp sınıflandırmasını, içinden bilgi çıkarmasını, özetlemesini ve soru yanıtlamasını sağlayan yapay zeka alanıdır. Türkçenin eklemeli yapısı ve günlük yazımdaki düzensizlik nedeniyle İngilizce için kurulmuş hazır çözümler çoğu zaman yeterli doğrulukta çalışmaz.

Şirketinizde metin nerede birikiyor?

Bir işletmede her gün onlarca, çoğu zaman yüzlerce metin gelip gider: müşteri e-postaları, WhatsApp mesajları, destek talepleri, anket yorumları, teklif dosyaları, sözleşmeler. Bu metinlerin çoğu bir insan tarafından okunup elle bir yere işlenir. Talep hangi birime gidecek, şikâyet mi yoksa bilgi talebi mi, içinde vergi numarası ya da sipariş numarası var mı; hepsi okuyan kişinin dikkatine kalır. Belediyelere gelen vatandaş dilekçeleri de aynı okuma yükünü taşır; örneklerini belediyelerde yapay zeka yazımızda ele aldık.

Doğal dil işleme bu okuma işini üstlenir. Gelen talebi konusuna göre ayırır, önemli alanları (tarih, tutar, ürün, kişi, kurum) çıkarır, uzun metni özetler, belgeler arasında anlamca arama yapar. Müşteri hizmetleri chatbot ya da kurumsal LLM asistanı gibi uygulamaların altında da aynı teknoloji çalışır. Ancak Türkçede bu işi doğru yapmak, dilin kendi özelliklerini hesaba katmayı gerektirir.

Çözmemenin maliyeti: metin var, kullanan az

Avrupa'da bile metin işleme yaygın değil. Eurostat'ın "Use of artificial intelligence in enterprises" raporuna göre 2025'te AB'de 10+ çalışanlı işletmelerin %11,75'i yazılı dili analiz eden yapay zeka (metin madenciliği) kullandı ve bu, yapay zeka türleri arasında en yaygın olanıydı. Yani en çok kullanılan yapay zeka türü bile işletmelerin sekizde birine ulaşmıyor.

Türkiye'de öne çıkan engeller teknolojiden çok uzmanlık, maliyet ve hukuki belirsizlikle ilgili. TÜİK Yapay Zeka İstatistikleri 2025 bültenine göre yapay zekayı kullanmayı düşünüp kullanmayan girişimlerin %74,2'si uzmanlık eksikliğini, %67,4'ü yüksek maliyeti, %62,4'ü hukuki sonuçların net olmamasını gerekçe gösterdi. Ticaret Bakanlığı'nın Türkiye'de E-Ticaretin Görünümü Raporu 2025 kapsamında e-ticaret işletmeleriyle yapılan ankette de en büyük iki engel %70,3 ile hukuki belirsizlik ve %70,2 ile veri gizliliği/güvenliği endişesiydi.

Yanlış kurulan sistem de maliyet üretir:

Stanford AI Index 2026'ya göre AA-Omniscience bilgi testinde 26 önde gelen modelin halüsinasyon oranı %22 ile %94 arasında değişti. (Stanford HAI AI Index Report 2026)

Kendi verinize dayanmayan, ölçülmeden devreye alınan bir dil modeli, metni yanlış sınıflandırır ya da olmayan bilgiyi üretir. Bu yüzden doğal dil işleme projesi, "bir model bağlayalım" diye değil, ölçülebilir bir görevle başlamalıdır.

Türkçe makineler için neden zor?

Türkçe doğal dil işlemede dört özellik doğruluğu doğrudan etkiler:

  • Eklemeli yapı. "Siparişlerinizden" tek kelimedir ama kök, çoğul, iyelik ve hâl eki taşır. Bir kök yüzlerce farklı biçimde görünebilir; kelime sayan basit yöntemler bu yüzden çabuk tıkanır.
  • Serbest sözcük dizimi. "Faturayı dün gönderdik" ile "Dün gönderdik faturayı" aynı anlamdadır. Model, sıraya değil anlama bakmak zorundadır.
  • Günlük yazım. Müşteriler "ı/i", "ş/s", "ğ/g" ayrımı yapmadan, kısaltma ve yazım hatasıyla yazar: "kargom nerde", "iade yapcam". Resmî metinle eğitilmiş model bu dili kaçırır.
  • Karışık dil ve alan terimleri. Sektör dili İngilizce terim, ürün kodu ve kurum içi kısaltma içerir. Bir lojistik firmasında "konşimento", bir hastanede "epikriz" modelin tanıması gereken terimlerdir. Bu iki sektördeki kullanım alanlarını lojistik ve depoda yapay zeka ve hastanelerde yapay zeka yazılarımızda ele aldık.

Taranmış belgelerde bir sorun daha vardır: metin önce görüntüden okunmalıdır. Bu aşamayı OCR ile fatura okuma yazısında ayrıca anlattık.

Türkçe doğal dil işlemede yöntem seçimi

Her iş için en büyük model gerekmez. Görev, veri miktarı ve gizlilik ihtiyacı yöntemi belirler:

YöntemNe zaman uygun?Güçlü yanıZayıf yanı
Kural ve kalıp (regex, sözlük)Vergi no, IBAN, sipariş no gibi biçimi belli alanlarHızlı, açıklanabilir, ucuzSerbest metinde kırılgan
Klasik makine öğrenmesiEtiketli geçmiş verisi olan sınıflandırmaHafif, kurum içinde çalışırÖzellik mühendisliği ister
Türkçe önceden eğitilmiş modellerin ince ayarıKurum diline özgü sınıflandırma, varlık tanımaKurum dilinde çoğu zaman en yüksek doğruluk, veri kurum içinde kalabilirEtiketli veri ve eğitim gerekir
Büyük dil modeli + kendi belgeleriniz (RAG)Özetleme, soru-cevap, serbest yanıt üretimiAz veriyle hızlı başlangıçMaliyet, gizlilik ve halüsinasyon yönetimi

Pratikte en iyi sonuç çoğu zaman karma yapıdan gelir: biçimi belli alanlar kuralla, konu sınıflandırma ince ayarlı modelle, serbest soru-cevap büyük dil modeliyle çözülür; belgeler arasında anlamca arama ise yapay zeka ile kurumsal aramanın konusudur. Hazır modelin yetmediği durumları firmaya özel yapay zeka modeli yazısında ele aldık.

Adım adım bir NLP projesi

  1. Tek bir görev seçin. "Gelen talepleri altı konuya ayır" ya da "sözleşmeden taraf, süre ve cezai şartı çıkar" gibi ölçülebilir bir iş. "Metinleri anlasın" bir hedef değildir. İlk göreve somut örnek olarak yapay zeka ile e-posta sınıflandırma ve yapay zeka ile sözleşme inceleme yazılarımıza bakabilirsiniz.
  2. Örnek veri toplayın. Son aylardan gerçek metinleri alın; kişisel verileri maskeleyin. Hangi verinin modele gidebileceğini yapay zeka ve KVKK yazısındaki ilkelerle belirleyin.
  3. Altın küme hazırlayın. Birkaç yüz metni işi bilen kişiler doğru cevapla etiketlesin. Her yöntem bu kümeyle ölçülür; etiketlerin tutarlı olması, verinin temiz olmasına bağlıdır (veri kalitesi ve mükerrer kayıt).
  4. Yöntemleri kıyaslayın. Kural, ince ayarlı model ve büyük dil modelini aynı küme üzerinde deneyin; sınıf bazında kesinlik (precision) ve duyarlılık (recall) değerlerine bakın. Ortalama doğruluk, nadir ama önemli sınıftaki hatayı gizleyebilir.
  5. İnsanı döngüde tutun. Modelin emin olmadığı metinler bir kişiye düşsün; düzeltmeler bir sonraki eğitim turunun verisi olsun.
  6. Sisteme bağlayın ve izleyin. Sonuç, e-posta, CRM ya da belge sistemine yazılmadıkça değer üretmez. Canlıya geçtikten sonra doğruluk aylık ölçülür; dil ve ürün yelpazesi değiştikçe model güncellenir.

Digital Bridge'de bu işi nasıl yapıyoruz?

  • Keşif ve ihtiyaç analizi. Hangi metnin nerede biriktiğini, kimin okuyup nereye işlediğini ve hatanın maliyetini birlikte çıkarıyoruz. Sonunda kapsamı, aşamaları ve bedeli yazan bir teklif sunuyoruz.
  • Pilot. Tek görev ve altın kümeyle başlıyoruz; farklı yöntemleri aynı veride ölçüp sonucu size tabloyla gösteriyoruz.
  • Model ve uygulama. Müşteriyle konuşan senaryolarda chatbot ve NLP, şirket içi belge ve prosedürlerde kurumsal LLM asistan hizmetimizi kullanıyoruz. Kurum diline özgü sınıflandırma ve varlık tanıma gerektiğinde firmaya özel yapay zeka eğitimi ile modeli kendi verinizle eğitiyoruz; gerekirse model kurum içinde çalışır.
  • Belge girdisi. Taranmış evrak söz konusuysa doküman OCR katmanını NLP'nin önüne koyuyoruz.
  • Entegrasyon ve izleme. Sonuçları e-posta, CRM, ERP ya da belge sisteminize yazıyor, doğruluğu canlı veriyle izliyoruz.

Müşteri mesajlarınız ağırlıkla WhatsApp'tan geliyorsa WhatsApp chatbot rehberine, konuşma kayıtlarını işlemek istiyorsanız Türkçe konuşmayı yazıya çevirme yazısına bakın.

Hazır bir örnek: Smart360

Kendi geliştirdiğimiz Smart360 ailesinde doğal dil işleme günlük iş akışına gömülüdür. SmartMail gelen postayı özetler; iletişim, fatura/ödeme, teklif/ihale, resmî yazışma, promosyon ve güncelleme olarak otomatik sınıflandırır, mesaja soru sormayı ve 30 dile çeviriyi destekler. Fatura PDF ekinden taraflar, tarihler, toplamlar ve vergi numarası dosya indirilmeden çıkarılır.

SmartFiles ise yüklenen belgeyi kimse istemeden analiz eder ve Özet, Ana Noktalar, Yapı, Dikkat Çeken Detaylar bölümlerinden oluşan bir rapor üretir; belgeye ya da klasörün tamamına soru sorulabilir. Özel bir NLP projesine başlamadan önce, e-posta ve belge tarafındaki ihtiyacın bir kısmını bu ürünlerle karşılayıp karşılayamayacağınızı görmek iyi bir başlangıçtır. Konuyu yapay zeka ile belge analizi yazısında örneklerle anlattık.

Sonraki adım

Metin yükünüzün en ağır olduğu tek bir kanalı seçin, bir haftalık örnek toplayın ve bu metinlerle ne yapıldığını yazın. Ardından iletişim sayfamızdan bize ulaşın; hangi yöntemin sizin verinizde işe yarayacağını pilotla birlikte ölçelim. Diğer kullanım alanları için şirketlerde yapay zekaya nereden başlanır yazısına ve Yapay Zeka rehberimize göz atabilirsiniz.

Sizin durumunuza birlikte bakalım

Sürecinizi anlatın; ihtiyaç analizinin ardından kapsamı, aşamaları ve bedeli içeren yazılı teklif gönderelim.

Teklif İsteyin 0 (552) 380 25 25

Okumaya devam edin

Tüm Yapay Zeka rehberleri
En çok sorulan sorular

Sık Sorulan Sorular

Doğal dil işleme ile ChatGPT aynı şey mi?

Hayır. Doğal dil işleme, bilgisayarın insan dilini işlemesiyle ilgili geniş bir alandır; metin sınıflandırma, varlık tanıma, duygu analizi, özetleme ve arama bu alana girer. ChatGPT gibi büyük dil modelleri bu alanın araçlarından biridir. Birçok kurumsal görev, daha küçük ve kurum içinde çalışan modellerle daha düşük maliyetle çözülebilir.

Türkçe NLP için ne kadar veri gerekir?

Göreve bağlıdır. Biçimi belli alanları çıkarmak için kural yeterlidir ve veri gerekmez. Konu sınıflandırmada, önceden eğitilmiş Türkçe bir modelin ince ayarı için sınıf başına birkaç yüz etiketli örnek çoğu zaman iyi bir başlangıçtır. Büyük dil modeliyle soru-cevap ise etiketli veri yerine düzenli, güncel belgeler ister.

Şirket metinleri yapay zeka modeline gönderilirken KVKK riski var mı?

Var. Metinler müşteri, çalışan ya da tedarikçiye ait kişisel veri içerebilir. Verinin hangi amaçla ve hangi hukuki sebebe dayanarak işlendiği, nerede saklandığı ve yurt dışındaki bir servise gidip gitmediği belirlenmelidir; yurt dışındaki bir servise gönderim, KVKK'nın yurt dışına aktarım kurallarına tabidir. Kişisel veriyi maskelemek, kurum içinde çalışan modeller kullanmak ve erişimi rol bazında kısıtlamak riski belirgin biçimde azaltır.

Doğruluk nasıl ölçülür?

İşi bilen kişilerin doğru cevapla etiketlediği bir altın küme hazırlanır ve model bu küme üzerinde test edilir. Sınıflandırmada sınıf bazında kesinlik ve duyarlılığa, bilgi çıkarmada alan bazında doğruluğa bakılır. Ölçüm canlıya geçtikten sonra da düzenli tekrarlanmalıdır, çünkü müşteri dili ve ürün yelpazesi zamanla değişir.

Yazım hatalı ve kısaltmalı mesajları anlayabilir mi?

Gerçek müşteri mesajlarıyla eğitilen ya da test edilen bir model anlayabilir. "Kargom nerde" ile "siparişimin durumu nedir" aynı niyet olarak etiketlenirse model bu eşleşmeyi öğrenir. Resmî metinlerle eğitilmiş hazır modeller ise günlük yazımda zorlanır; bu yüzden pilot mutlaka kendi mesajlarınızla yapılmalıdır.

Türkçe doğal dil işleme hangi sektörlerde kullanılır?

Metnin yoğun olduğu her sektörde kullanılır. Müşteri hizmetleri ve e-ticarette talepler konuya göre ayrılır; lojistikte konşimento ve gümrük evrakından alan çıkarılır; hukuk ve mali müşavirlik bürolarında sözleşme ile yazışmalar özetlenir; sağlıkta epikriz gibi raporlardan bilgi alınır. Ortak nokta, bugün bir insanın okuyup elle bir sisteme işlediği Türkçe metinlerin bulunmasıdır.

Türkçe NLP projesinin süresi ve maliyeti neye bağlıdır?

Dört etkene bağlıdır: görevin kapsamı, etiketli verinin olup olmadığı, modelin bulutta mı kurum içinde mi çalışacağı ve sonucun hangi sistemlere yazılacağı. Tek görevle başlayan bir pilot, kapsamı ve riski küçük tutar; yöntem ve veri ihtiyacı netleşince sonraki aşamalar daha doğru planlanır. Bu yüzden keşif sonunda kapsam, aşama ve bedel yazılı olarak çıkarılır.

Sorunuz burada yok mu? Bize Sorun

Bir Mühendisle Konuşun

Çözmek istediğiniz işi anlatın, yazılı teklifle dönelim.