Claude Sonnet 5: solo geliştirici için amiral gemisi değil, doğru varsayılan
Anthropic, Sonnet 5'i daha pahalı modellerin birkaç ay önce yaptığı ajan işlerini daha düşük maliyetle taşıyan model olarak konumlandırıyor. Asıl soru benchmark değil: günlük iş akışının ne kadarını varsayılan olarak ona bırakmalı?
- [01]Anthropic — Introducing Claude Sonnet 52026-07-20
- [02]Anthropic — Claude Sonnet 5 system card2026-07-20
Anthropic 30 Haziran'da Claude Sonnet 5'i yayımladı. Duyurunun merkezinde 'en güçlü model' iddiası yok. Daha ilginç iddia şu: birkaç ay önce daha büyük ve pahalı Opus sınıfı gerektiren planlama, araç kullanımı ve otonom çalışma artık Sonnet katmanında yapılabiliyor.
Varsayılan model neden önemli?
Bir solo geliştiricinin gün içindeki görevlerinin çoğu frontier zeka istemiyor. Dosya bulmak, küçük bir düzeltme yapmak, test yazmak, dokümantasyon güncellemek veya araştırmayı düzenlemek gibi işler için ihtiyaç; yeterli muhakeme, araç kullanımı ve tutarlılık. Her görevi en pahalı modele göndermek maliyeti artırdığı gibi bazen gereksiz derecede ağır bir akış da yaratıyor.
Sonnet 5 burada 'çoğu işi taşıyan varsayılan' olmayı hedefliyor. Anthropic'e göre model plan kurabiliyor, tarayıcı ve terminal gibi araçları kullanabiliyor ve önceki Sonnet sürümüne göre ajan görevlerinde belirgin biçimde güçleniyor. Yüksek efor seviyelerinde bazı görevlerde Opus 4.8'e yaklaşması, model seçimini isimden çok efor ve bütçe ayarına bağlayan bir değişim.
Fiyat avantajı geçici olarak daha belirgin
Lansman fiyatı 31 Ağustos'a kadar milyon giriş tokenı başına 2 dolar ve çıkış tokenı başına 10 dolar. Sonrasında standart fiyat 3 ve 15 dolara çıkıyor. Bu rakamlar tek başına karar vermek için yeterli değil; fakat aynı işin kaç denemede bittiğiyle birlikte ölçüldüğünde Sonnet 5'in neden varsayılan aday olduğu daha netleşiyor.
Ben olsam görevleri üç katmana ayırırım
Birinci katman, geri alınabilir ve kabul kriteri net işler: Sonnet 5 varsayılan. İkinci katman, mimari karar, zor hata ayıklama veya uzun araştırma: önce Sonnet 5, sonuç zayıfsa daha güçlü modele yükseltme. Üçüncü katman, geri döndürülemez yayın, ödeme, veri silme veya güvenlik kararı: model ne olursa olsun insan onayı ve bağımsız doğrulama.
Bu ayrım model fanatikliğini azaltıyor. Amaç her işi Claude'a vermek değil; görevin riskini ve belirsizliğini doğru katmana yerleştirmek. Daha ucuz modelin başarısı da ancak başarısız denemeler ve inceleme süresi dahil toplam maliyetle ölçülür.
Bu nedenle Sonnet 5'i, 2026 ortası kodlama ajanı seçimi yazımdaki kontrol ve maliyet eksenlerinin güncel cevabı olarak görüyorum.
Kısa sonuç: Sonnet 5'in önemli tarafı Opus'u tamamen yenmesi değil. Günlük ajan işlerinin büyük bölümünde 'önce bunu dene' denebilecek kadar güçlü ve ayarlanabilir olması. Solo geliştirici için verim çoğu zaman en üst modelden değil, doğru varsayılandan geliyor.