GPT-5.6'nın sınır zekasını sınır verimliliği ile nasıl birleştirdiği – OpenAI
Özgün başlık: The way GPT-5.6 fuses frontier intelligence with frontier efficiency – OpenAI
GPT‑5.6 model ailesini, insanların modellerimizi kullandığı çeşitli görevlerde kapasite ve maliyeti dengelemek için tasarladık. Amiral gemisi modelimiz GPT‑5.6 Sol, maksimum muhakeme ile Yapay Analiz Kodlama Aracısı Endeksi'nde yarı fiyatından daha düşük bir maliyetle Claude Fable 5'ten daha iyi performans gösteriyor. Terra, istihbarat kıyaslamalarında yarı fiyatına GPT‑5.5 kadar iyi performans gösteriyor ve Luna, Sol'un maliyetinden %80 daha düşük fiyatıyla en hızlı ve en uygun fiyatlı modelimizdir. Bu verimliliği sağlamak için araştırma ve teknik ekiplerimiz yığınımızın her önemli katmanında önemli optimizasyonlar yaptı. Bu iyileştirmeler modellerimizi, çıkarımlarımızı (çıktı üretmek için modelleri nasıl çalıştırdığımızı) ve hem Codex hem de ChatGPT Work tarafından kullanılan aracılık donanımımızı kapsar. Son dört yılda modellerimizi 1 milyar aktif kullanıcıya ve 2 milyondan fazla işletmeye ölçeklendirdiğimiz için verimlilik, zekanın faydalarını herkese dağıtmada merkezi bir rol oynadı. Misyonumuz yapay genel zekanın tüm insanlığa fayda sağlamasını sağlamaktır. Bu yıllar boyunca, maliyet-istihbarat eğrisinin her noktasında en performanslı modelleri sunmak amacıyla grubumuz genelinde sürekli olarak daha iyi optimizasyonların kilidini açmak için çalıştık. Token başına daha fazla iş elde etmek üzere eğitilmiş GPT-5.6 aracılığıyla şimdiye kadarki en yüksek token başına zeka verimliliğine ulaştık. Eğitimde, modeli görev boyunca daha doğrudan bir yol izleyecek şekilde şekillendirerek hem görev başarısı hem de verimlilik için optimizasyon yaparız.
Bu yazı, 1) aynı donanımdan daha fazla çıktı elde etmek için yük dengeleme, spekülatif kod çözme, önbelleğe alma ve çekirdek optimizasyonu gibi süreçleri optimize ederek çıkarım ve 2) bağlam şişkinliğini, araç kullanımını ve tekrarlanan çalışmayı daha iyi yönetme dahil olmak üzere ajans koşumumuz dahil olmak üzere yığının diğer iki ana bölümündeki gelişmeler aracılığıyla verimlilik için nasıl tasarladığımızı paylaşmak üzere modellerimizin ötesine geçiyor. Ayrıca bu kazanımların birçoğunun bağımsız olarak elde edilmesinde GPT‑5.6 Sol'un rolünü de paylaşacağız. Herhangi bir izole gelişme sınırlı gibi görünse de, bu kazanımlar birleşerek hem zeka hem de verimlilik açısından sınırları aşmamıza olanak tanıyor. GPT‑5.6 Sol ile çıkarımı hızlandırma Model talebinin kapasiteden daha hızlı arttığı, bilgi işlem kısıtlamalı bir dünyada, verimlilik her sistem tasarımının temelini oluşturur. Bu, özellikle yanıtlar oluşturmak için eğitimli modelleri çalıştıran çıkarım yığınımız için geçerlidir.