LLM

17 yazı bu etiketle etiketlendi.

TypeSafe AI'ın duyurduğu Jev modeli, LLM dünyasında yeni bir çağ açıyor. Metin yazmayan, yazılım için doğrudan tipli kararlar ve olasılıklar üreten System-1 model mimarisi, RLCD ve kullanım senaryoları rehberi.

Google Gemini model ailesinin kapsamlı mimari analizi. Gemini Flash ile Pro arasındaki farklar, 2M+ token bağlam penceresi, Context Caching ve iki yönlü Multimodal Live API geliştirici rehberi.

Yapay zeka sektörü model büyütme yarışından (pre-training) çıkarım anında düşünme yarışına (test-time compute) geçti. Inference scaling laws, Process Reward Modelleri (PRM) ve akıl yürütme mimarisi tam rehberi.

xAI, kodlama, ajan görevleri ve bilgi işi için optimize edilmiş Grok 4.6'yı duyurdu. 500 bin token bağlam penceresi ve Elon Musk'ın Grok 4.7 için verdiği tarih.

Anthropic, Claude Opus 5'i duyurdu: Fable 5'in performansına CursorBench'te 0,5 puan yaklaşırken yarı fiyatına geliyor. Beş kademeli 'effort' sistemi, fiyatlandırma ve Claude Max'teki yeni rolü.

Meta Superintelligence Labs, kodlama pazarında Anthropic ve OpenAI'ı yakalamak için Muse Spark 1.1'i piyasaya sürdü. 1 milyon token bağlam penceresi, çoklu-ajan orkestrasyonu ve Gemini'yi geride bırakan benchmarklar.

OpenAI'nin yeni model ailesi GPT-5.6, piyasaya çıkmadan önce Beyaz Saray'ın incelemesinden geçen ilk model oldu. Sol, Terra ve Luna arasındaki farklar ve genel kullanıma açılış süreci.

xAI, Cursor'dan alınan gerçek dünya kodlama verileriyle eğitilmiş 1.5 trilyon parametreli Grok 4.5'i piyasaya sürdü. İşte fiyatı, yetenekleri ve rakiplerinden farkı.

Bağlam penceresini yönetmekten paralel oturumlara, CLAUDE.md yazmaktan otomasyon pipeline'larına kadar Claude Code'dan maksimum verim almanın kanıtlanmış yolları.

DeepSeek, 24 Nisan 2026'da V4-Pro ve V4-Flash modellerini duyurdu. İkisi de açık kaynak, MIT lisanslı, 1M token bağlam pencereli. V4-Pro, LiveCodeBench'te 93,5% ile tüm modelleri geçiyor. V4-Flash, GPT-5.4 Nano'dan daha ucuz. Eski modeller 24 Temmuz'da kapanıyor.

OpenAI, GPT-5.4'ten 6 hafta sonra GPT-5.5'i duyurdu. Model, daha az tokenla daha iyi sonuçlar üretiyor. Codex'te 400K bağlam penceresi, bilimsel araştırma ve ajansal kodlamada kayda değer kazanımlar. API fiyatlandırması GPT-5.4'ün 2 katı.

Anthropic, Claude Opus 4.7'yi duyurdu. Gerçek benchmark verileriyle GPT-5.4 ve Gemini 3.1 Pro karşılaştırması, 3,75 megapiksel görüntü işleme ve yeni xhigh effort seviyesi — tam analiz.

Bir modeli nasıl değerlendirirsin? Entropy, perplexity, embedding metrikleri ve AI hakemliği — foundation model değerlendirmesinin tüm boyutlarını ele aldık.

KV Cache (Key-Value Cache) nedir? Transformer dikkat mekanizmasında K ve V tensörlerini önbelleğe alarak LLM inference gecikmesini O(n²)'den O(n)'e nasıl düşürdüğünü ve API maliyet tasarrufunu keşfedin.

TurboQuant, LLM KV önbelleğini doğruluk kaybı olmadan 3 bite sıkıştıran Google Research algoritmasıdır. H100'lerde 8x hız artışı sağlar, eğitim gerektirmez.

Transformer mimarisi ve dikkat (attention) mekanizması nasıl çalışır? Self-attention formülü, Q-K-V matrisleri, multi-head attention ve model ölçekleme (scaling laws) detaylı rehberi.

Bu seride baştan sona yapay zeka mühendisliği sürecine değineceğiz. Dil modeli nedir, token nedir, autoregressive ve masked modeller arasındaki fark ne?

← Tüm yazılar