ByteDance, Financial Times'a göre 10 trilyona kadar parametreye sahip bir yapay zeka modeli eğitiyor. Bu büyüklük, şirketi Anthropic'in en gelişmiş sistemine yaklaştırıyor. Küresel yapay zeka yarışını takip eden herkesin bunu izlemesi gerekiyor, çünkü bu gelişme Çinli laboratuvarların ABD liderleriyle arasındaki farkı ne kadar hızlı kapattığının bir göstergesi.
Gerçekte Ne Oldu
Ars Technica'nın konuya yakın üç kişiye dayandırdığı habere göre model, şu ana kadar yayınlanan en büyük Çin modeli olan Moonshot'ın Kimi K3'ünden üç kat daha büyük. Ön eğitim süreci genellikle üç ila altı ay sürüyor ve modelin nihai boyutu daha sonra belirlenecek. Anthropic parametre sayılarını açıklamıyor ancak sektör tahminlerine göre Mythos 5 yaklaşık 8 trilyon, Fable 5 ise yaklaşık 5 trilyon parametreye sahip. Mythos 5, Haziran ayındaki bir güvenlik yasağından sonra sadece onaylı kuruluşlara açık durumda. ByteDance'ın tüketici uygulaması Doubao, Çin'de en fazla aylık aktif kullanıcıya sahip uygulama olup 324 milyon kullanıcıya ulaşıyor. Eski Google DeepMind bilim insanı Wu Yonghui'nin liderliğindeki Seed araştırma ekibi yaklaşık 2.000 kişiden oluşuyor. Kurucu Zhang Yiming, iki hafta önce yapılan bir iç toplantıda Seed ekibine kısa vadeli aksaklıklardan çekinmeden "dünya lideri model yetenekleri" hedeflemelerini söyledi.
Buraya Nasıl Gelindi
Çinli laboratuvarlar bu yıl hızla ilerleme kaydetti. Moonshot ve Alibaba'nın modelleri, bazı alanlarda sadece Anthropic'in Fable 5'inin gerisinde kalan benchmark skorları elde etti. ByteDance, rakiplerine kıyasla kamuoyunda daha düşük profilli kaldı; modellerinin çoğunu kapalı tutarken kaynaklarını Volcano Engine bulut birimine ve özel yapay zeka çip planlarına yönlendirdi. Bazı rakiplerinin aksine, ByteDance'ın Seed ekibi bir yıldan fazla süredir diğer laboratuvarların modellerinden bilgi damıtma yapmaktan kaçındı; bu daha yavaş ama daha bağımsız bir yol. Bu yaklaşım, ByteDance'ın Batılı öncü laboratuvarlara yetişme yarışında zaman kaybettirip kaybettirmediği konusunda şirket içinde tartışmalara yol açtı.
Bunun Sizin İçin Önemi
Geliştiriciler için daha büyük bir ByteDance modeli, Çin ve ABD yapay zeka platformları arasında seçim yapan geliştiriciler arasında daha sert bir rekabet anlamına gelebilir. Kullanıcılar için daha yetenekli Çin modelleri, özellikle açık şekilde yayınlanırsa, gelişmiş yapay zekaya erişim maliyetini düşürebilir. Yapay zeka altyapı sağlayıcıları ve çip üreticileri için ByteDance'ın bu hamlesi, işlem gücü ve özel silikon için yarışan bir alıcı daha ekliyor. Erişim de önemli: Mythos 5 hâlâ onaylı kuruluşlarla sınırlı, dolayısıyla öncü teknolojinin büyük kısmı kapalı kapılar ardında kalıyor. ByteDance'ın modeli iyi performans gösterirse, sektörde daha hızlı yineleme döngüleri ve Anthropic ile emsallerinin sadece verimlilik değil, eğitim ölçeğinde de rekabet etmesi yönünde artan baskı beklenebilir.
Büyük Soru
ByteDance'ın modeli Anthropic'in ölçeğine ulaşırsa, ham parametre sayısı hangi yapay zeka sisteminin dünyaya liderlik edeceğini belirlemeye devam eder mi, yoksa veri kalitesi ve eğitim yöntemi mi daha büyük bir faktör haline geliyor? Rapor her ikisinin de önemli olduğunu belirtiyor, ama şirketler yine de büyüklük için yarışmayı sürdürüyor. Daha fazla laboratuvar 10 trilyon parametreye yaklaşırken, sektörün öncü bir modeli sadece büyük bir modelden ayıran şeyin ne olduğuna dair daha açık bir cevaba ihtiyacı olabilir.
Neye Dikkat Etmeli
ByteDance'ın ön eğitim aşaması genellikle üç ila altı ay sürüyor, bu da modelin ince ayarlanmış halinin ve gerçekleşirse yayınının 2026'nın sonu veya 2027'nin başında gelebileceği anlamına geliyor. Nihai parametre sayısının doğrulanmasını, Anthropic'in Mythos 5 ve Fable 5 modelleriyle yapılacak benchmark karşılaştırmalarını ve ByteDance'ın modeli açık mı yoksa kapalı mı tutacağını izlemeye değer. Bonuz, bunun giyilebilir teknolojiler de dahil olmak üzere yeni nesil yapay zeka cihazlarını güçlendiren donanım ve çipleri nasıl etkileyeceğini takip edecek.



