BLOG

LLM geliştirme, fine-tuning ve veri mühendisliği üzerine Medium'da yayınladığım teknik yazılar.

OpenAI Benchmark Temmuz 2026

Yapay Zeka Gerçek Biyoloji Sorularının Üçte Birini Çözebiliyor: GeneBench-Pro Ne Gösteriyor

OpenAI'ın genomik, kantitatif biyoloji ve translasyonel tıptan 129 problemle oluşturduğu GeneBench-Pro benchmark'ında en güçlü modeli GPT-5.6 Sol, en yüksek akıl yürütme seviyesinde yüzde 28.7 başarı oranına ulaştı, Pro modda bu oran yüzde 31.5'e çıkıyor. Sonuçların yapay zekanın bilimsel araştırmaya katkısı için ne anlama geldiğini yazdım.

BM Yapay Zeka Politikası Temmuz 2026

BM, Yapay Zeka Yönetişimi İçin Cenevre'de Toplandı

169 ülkenin katıldığı ilk BM Global Dialogue on AI Governance toplantısını, gündemdeki dört başlığı ve Türkiye'deki geliştiriciler için ne anlama geldiğini yazdım.

Meta Kodlama Modelleri Temmuz 2026

Meta, Kodlama Yarışına Geri Döndü

Meta'nın yeni Muse Spark modeli SWE-Bench Pro'da GPT-5.5'i yakaladı ama Claude Opus 4.8 hâlâ önde. Kodlama modelleri yarışında güncel tabloyu, Meta'nın olası altyapı kiralama planlarını ve Türkiye'deki geliştiriciler için ne anlama geldiğini yazdım.

LoRA DPO Qwen3.5

En Büyük Model Neden Kaybetti? Qwen3.5'in 4 Varyantını Dijital Pazarlama İçin Fine-Tune Etmek

2B'den 27B'ye dört Qwen3.5 varyantını aynı veri setiyle fine-tune ettiğimiz denemede en büyük model en iyi sonucu vermedi. Donanım kısıtlarının ve veri kalitesinin performansı nasıl şekillendirdiğini, 9B modelin neden en dengeli seçim olduğunu anlattım.

Medium profilimin tamamı →