← Sözlüğe Dön Yapay Zeka & GEO

Inference Nedir?

Yapay Zekada Çıkarım

Çıkarım (inference), eğitimi tamamlanmış bir yapay zeka modelinin yeni bir girdiye yanıt üretmesi, yani modelin gerçek kullanımda çalıştırılması aşamasıdır; yapay zeka hizmetlerinin hız ve işletme maliyeti büyük ölçüde bu aşamada belirlenir.

Yazan: Adem Demir Son güncelleme:

Inference (Yapay Zekada Çıkarım) = Eğitilmiş bir modelin yeni bir girdiyi işleyip tahmin, sınıflandırma ya da metin, görsel gibi bir çıktı ürettiği kullanım aşaması · eğitimle farkı: eğitim bir kez ya da dönemsel yapılır, çıkarım her kullanıcı isteğinde tekrarlanır · ölçütleri: gecikme (yanıt süresi), verim (saniyedeki işlem), istek ya da token başına maliyet · çalıştığı yerler: bulut veri merkezleri, şirket sunucuları, telefon ve bilgisayar gibi cihazlar · maliyeti artıranlar: model büyüklüğü, uzun girdiler, uzun çıktılar, akıl yürütme adımları

Eğitim ile çıkarım arasındaki fark ne?

Bir yapay zeka modelinin hayatı iki aşamadan oluşur. Eğitimde model, çok büyük bir veriden örüntüleri öğrenir; bu aşama pahalıdır ama bir kez ya da belirli aralıklarla yapılır. Çıkarımda ise eğitilmiş model gerçek dünyada çalışır: bir müşteri soru sorduğunda yanıt yazar, bir fotoğraf yüklendiğinde içindekileri tanır, bir reklam gösterimi öncesinde dönüşüm olasılığını tahmin eder.

Eğitim bir restoranın mutfağını kurmaya, çıkarım ise her siparişte yemek pişirmeye benzer. Mutfak bir kez kurulur; ama yemek her sipariş için yeniden pişirilir. Bu yüzden milyonlarca kullanıcıya hizmet veren bir yapay zeka ürününde toplam maliyetin büyük kısmı çıkarımdan gelir ve sağlayıcılar fiyatlarını genellikle işlenen token ya da istek sayısı üzerinden belirler.

Sayılarla bir örnek: Bir e-ticaret sitesinin sohbet asistanı günde 3.000 konuşma yapıyor ve her konuşma ortalama 2.500 token harcıyor olsun. Bu, günde 7,5 milyon, ayda yaklaşık 225 milyon token eder. Model fiyatındaki küçük bir fark bile bu hacimde aylık faturayı belirgin biçimde değiştirir. Aynı iş için daha küçük bir modele geçmek ya da konuşma geçmişini kısaltmak, çıkarım maliyetini doğrudan düşürür.

Eğitim ve çıkarım karşılaştırması

ÖzellikEğitimÇıkarım
Ne olur?Model veriden öğrenirModel yeni girdiye yanıt üretir
SıklıkBir kez ya da dönemselHer kullanıcı isteğinde
Kim yapar?Çoğunlukla model sağlayıcısıModeli kullanan her uygulama
Maliyet biçimiTek seferlik büyük yatırımKullanıma bağlı sürekli gider
Hızlandırma yoluDaha fazla işlem gücüKüçük model, kısa girdi, önbellek

Klasik makine öğrenmesi modellerinde çıkarım çok ucuzdur; büyük dil modellerinde ise her yanıt ciddi bir hesaplama gerektirir.

Çıkarım maliyetini düşürmenin yolları

  1. Görevi doğru modele ver. Basit sınıflandırma ve kısa yanıtlar için küçük ve hızlı modeller kullan.
  2. Girdiyi kısalt. Uzun sohbet geçmişlerini özetle, gereksiz belgeleri isteme ekleme.
  3. Çıktıyı sınırla. Yanıt uzunluğunu ihtiyaç kadar tut.
  4. Tekrarlayan istekleri önbelleğe al. Sık sorulan soruların yanıtlarını saklamak, aynı hesaplamanın tekrarını önler.
  5. Toplu işlem kullan. Anlık yanıt gerekmeyen işler (gece rapor özetleri gibi) için sağlayıcıların indirimli toplu işlem seçeneklerini değerlendir.

Çıkarımla ilgili yanlış bilinenler

  • "Asıl maliyet eğitimdir." Yaygın kullanılan ürünlerde toplam çıkarım maliyeti eğitim maliyetini geçebilir.
  • "Hız yalnızca internete bağlıdır." Yanıt süresini asıl belirleyen, model büyüklüğü ve üretilen token sayısıdır.
  • "Düşünen model aynı fiyata daha iyi yanıt verir." Akıl yürüten modeller çıkarım sırasında daha fazla hesaplama yapar; bu hem süreyi hem maliyeti artırır.
  • "Cihazda çalışan yapay zeka ücretsizdir." Bulut faturası olmasa da pil, işlemci ve model boyutu sınırları vardır.

Sıkça sorulan sorular

"Inference" kelimesi Türkçede nasıl kullanılır?

Yapay zeka bağlamında "çıkarım" olarak çevrilir. Günlük dilde "modeli çalıştırma" ya da "modelin yanıt üretmesi" de aynı anlama gelir.

Yapay zeka botlarının sitemi taraması çıkarım mıdır?

Doğrudan değil. Tarama, veri toplama ya da gerçek zamanlı arama sürecidir. Model bu veriyi kullanarak kullanıcıya yanıt ürettiğinde çıkarım gerçekleşir. İkisi arasındaki ilişki üretken arama sistemlerinin temelini oluşturur.

Çıkarım hızı neden önemli?

Kullanıcılar yanıtı birkaç saniye içinde bekler. Yavaş yanıt veren bir sohbet asistanı ya da ürün arama özelliği, terk oranını artırır.

Çıkarımın teknik ayrıntıları için IBM: What is AI inference? sayfası anlaşılır bir özet sunar.

Yapay zeka sistemlerinin yanıt üretirken siteni ne zaman ve nasıl okuduğunu GEO rehberinde tarama ve alıntılama başlıklarıyla ayrıntılandırdım.

Yapay zekanın faturası her yanıtta yeniden yazılır; çıkarımı yönetmeyen proje ölçeklenince zorlanır.
GEO Danışmanlığı

ChatGPT, Gemini ve Google AI Modu'nda markanızın doğru bilgiyle anılmasını ve kaynak gösterilmesini sağlayan, ölçülebilir GEO danışmanlığı.

Hizmeti İncele
Adem Demir
Yazar

Adem Demir

10+ yıldır e-ticaret markalarının performans pazarlamasını yönetiyorum. Sözlükteki her maddeyi bu sahadaki deneyimimle yazıyor ve düzenli olarak güncelliyorum.

Ücretsiz Ön Görüşme

Reklam bütçeniz harcanıyor, kâr nerede?

E-ticaret kurulumundan kârlı ölçeklemeye — hesabınızı denetleyip nerede bütçe kaybettiğinizi netçe gösteriyorum. 30 dakikalık ön görüşme ücretsiz.

Ücretsiz Ön Görüşme Planla 10+ yıl deneyim · Satış baskısı yok, net teşhis var