Eski OpenAI CTO’su Mira Murati’nin kurduğu Thinking Machines Lab, ilk büyük dil modelini kamuoyuna sundu. Şirketin Inkling modeli, Apache 2.0 lisansıyla açık ağırlıklı (open weights) olarak yayınlanırken 975 milyar parametreye ulaşan yapısıyla ABD’ geliştirilen en büyük açık yapay zekâ modellerinden biri olmayı başardı. Yeni model, geliştiricilere özelleştirme ince ayar konusunda daha geniş özgürlük sunmayı hedefliyor.

Inkling Büyük Ölçekli Yapısıyla Açık Model Rekabetine Katılıyor

Thinking Machines Lab, 2025 yılında OpenAI’ın eski teknoloji yöneticisi Mira Murati tarafından kuruldu. Şirketin ilk modeli olan Inkling, 975 milyar parametreyle DeepSeek V4, GLM 5.2 Kimi K2.6 gibi Çin merkezli açık modellerle aynı sınıfta konumlanıyor. Şirket, modeli tam hassasiyetle çalıştırabilmek için 2 TB’tan fazla GPU belleği gerektiğini, bunun yaklaşık sekiz Nvidia B300 veya 16 Nvidia H200 hızlandırıcısına karşılık geldiğini belirtiyor.

Donanım gereksinimini azaltmak amacıyla NVFP4 kuantize edilmiş sürüm yayınlandı. sürüm, daha az GPU kullanarak aynı modeli çalıştırabilmeye imkân tanıyor. Açık ağırlıklı model yapısı sayesinde geliştiriciler, modeli kendi ihtiyaçlarına göre yeniden eğitebiliyor veya farklı görevler için optimize edebiliyor.

Thinking Machines Lab, Inkling modelini özellikle yapay zekâ uygulamaları geliştiren ekipler için tasarladığını belirtiyor. Model, sohbet uygulamalarından yazılım geliştirmeye kadar farklı senaryolarda kullanılabiliyor. Apache 2.0 lisansı sayesinde ticari kullanımın önündeki birçok kısıtlama ortadan kalkıyor.

Modelin dikkat çeken özelliklerinden biri 1 milyon belirteçlik (token) bağlam penceresi sunması. Uzun bağlam desteği, büyük kod tabanlarının analiz edilmesi, uzun belgelerin işlenmesi geniş veri kümeleri üzerinde çalışan uygulamalarda önemli avantaj sağlayabiliyor. Şirket ayrıca Tinker platformu üzerinden özelleştirme ince ayar araçlarını geliştiricilere sunuyor.

Thinking Machines Lab, Inkling modelinin DeepSeek-V3’ten ilham alan Mixture of Experts (MoE) mimarisiyle geliştirildiğini ancak eğitimin tamamen sıfırdan gerçekleştirildiğini ifade ediyor. Model, Nvidia GB300 NVL72 sistemleri üzerinde yaklaşık 45 trilyon token kullanılarak eğitildi. Eğitim verileri metinlerin yanı sıra görüntü, ses videolardan oluşuyor.

Toplam 256 yönlendirilmiş uzman iki ortak uzmandan oluşan yapı içinde her token yalnızca altı uzman tarafından işleniyor. Yaklaşık 41 milyar aktif parametre kullanan yaklaşım, çok büyük model olmasına rağmen çıkarım performansının benzer sınıftaki modellerle rekabet edebilmesini sağlıyor.

Thinking Machines Lab, Inkling’in muhakeme (reasoning) yeteneklerini güçlendirmek amacıyla pekiştirmeli öğrenme yöntemlerinden yararlandığını açıkladı. Şirket, modelin düşünme sürecinde kullandığı tokenleri daha verimli kullanacak şekilde optimize edildiğini bazı testlerde Nvidia Nemotron 3 Ultra benzer performans sergilediğini iddia ediyor. Bağımsız doğrulamalar tamamlanmadan sonuçların ihtiyatla değerlendirilmesi gerekiyor.

Şirket, Inkling modelini Tinker platformunun yanı sıra Hugging Face üzerinden erişime. TogetherAI, Fireworks, Modal, Databricks Baseten gibi üçüncü taraf servisler için destek hazırlanıyor. Ayrıca daha düşük gecikme sürelerine ihtiyaç duyan geliştiriciler için 276 milyar parametreli Inkling-Small modeli üzerinde çalışmalar devam ediyor. OpenAI, Anthropic, Nvidia, DeepSeek Thinking Machines Lab arasında hızlanan açık model rekabeti, geliştiricilerin kapalı yapay zekâ platformlarına alternatif seçeneklere erişimini artırabilir.