DeepSeek’i nasıl okumak lazım? Dünyayı sarsacak bir model mi? Masayı dağıtıyor mu, büyütüyor mu?
ABD’nin bunca çip kısıtlamasına rağmen nasıl bu kadar yetenekli?
Olayı ne? Deepseek’in R1'i OpenAI'ın o1'ine birçok noktada benzer yetenekte hatta bazı metriklerde onu geçiyor, ancak maliyeti çok daha düşük.🫰
Bu sefer kopyalama yok, sınırları zorlama var. Peki nasıl?
DeepSeek, R1 modelinin geliştirilmesi sırasında eğitim sürecini yeniden yapılandırmak zorunda kaldı. Bunun temel nedeni, Nvidia'nın Çin pazarına sunduğu çiplerin performansının, şirketin en üst düzey ürünlerinin yalnızca yarısı kadar hızlı olmasıydı. ABD'nin Nvidia'nın en güçlü çipleri olan H100'leri Çin'e ihraç etmesini yasaklaması Çin’in konuya daha çok sarılmasına neden oldu belli ki. Bu nedenle, Çin'de kullanılan grafik işlem birimleri (GPU) üzerindeki yükü azaltmak için eğitim süreci optimize edildi.
Başka bir ifadeyle, ABD'nin uyguladığı ihracat kontrolleri, R1 geliştiricilerini daha az hesaplama gücüyle çalışabilecek, aynı zamanda daha enerji verimli ve akıllı algoritmalar tasarlamaya itti. Örneğin, ChatGPT'nin eğitim verilerini işlemek için yaklaşık 10.000 Nvidia GPU'ya ihtiyaç duyduğu tahmin edilirken, DeepSeek mühendisleri sadece 2.000 GPU kullanarak benzer sonuçlar elde edebildiklerini ifade ediyor.
Sektörün vazgeçilmez ismi aslında vazgeçilir miymiş?
Nvidia yapay zeka rüzgarını arkasına almış bir şirket, adeta ABD borsalarının yıldızı. Son 4 çeyrekte 113 milyar dolar satış, 75 milyar dolar FAVÖK ve 63 milyar dolar net kâr sağlamış. Şirketin piyasa değeri haziran ayında 3 trilyon doları aştı mevcutta 3.5 trilyon dolara yakın ve hisseleri 2024’te 170%’ten fazla yükseldi. Zaten Nvidia, 2023 ve 2024’te art arda %100’e yakın satış büyümesi gerçekleştirdi. Haliyle yıllık kârının 56 katı piyasa değeriyle işlem görüyor. FK’sı oldukça yüksek ama büyüye bir şirket olduğu için de makûl kabul ediliyor. En azından bu zamana kadar öyleydi. Nasdaq ortalamasının iki katı çarpanla fiyatlanıyordu şirket.
Ben bu gelişmenin Nvidia’nın pahalı çiplerine olan talebi azaltabileceğinden endişelenenlerdenim. Fakat endişelerim "Çin, Nvidia’yı yok etti, Microsoft’un ChatGPT’sine by by" boyutunda değil. Aksine sektöre ilişkin dev beklentileri hızlandırabilecek bir oyuncunun masaya katıldığına inanıyorum.
Tıpkı
@satyanadella 'nın bugün işaret ettiği gibi. Bu konu Jevons Paradox’una neden olabilir.
Yani, teknolojik ilerlemenin bir kaynağının kullanım verimliliğinin artırıp maliyetinin düşmesi, talepte büyük bir artışa yol açabilir. Dolayısıyla Çin masayı dağıtmıyor, aksine büyütüyor bence. Kısa vadeli hisse satışlarını görsek bile özellikle de sektördeki gelişmeler, Trump yönetiminin Stargate desteği derken masa önümüzdeki günlerde toparlanacak, uzun vadede büyüyecektir. DeepSeek’in piyasada yarattığı kaosun ise teknoloji severler için fırsat olabileceğini düşünüyorum. DeepSeek dibi yani :)
Peki Çin, uzun yıllar “kopyalama” etiketiyle anılırken, nasıl oldu da küresel inovasyon yarışında öne çıkmaya başladı?
DeepSeek’in kurucusuna göre cevap basit: Artık liderlik zamanı. Çin’in ekonomik gücü ve teknoloji devleri, yapay zeka alanında Batı’ya meydan okumaya hazır. Ancak bu dönüşüm, sadece para değil, köklü bir zihniyet değişimi gerektiriyor.
Yapay zeka yarışı, sadece teknoloji değil, aynı zamanda yetenek savaşı. DeepSeek, Çin’in “yüksek yoğunluklu yetenekleri” organize etme kapasitesine dikkat çekiyor. Tencent ve Alibaba gibi devlerin küresel varlığı, bu hedefe ulaşmak için kritik bir altyapı sunuyor. Ancak Çin’in önündeki engel, hâlâ Batı’ya kıyasla düşük olan orijinal fikir üretme kapasitesi. Örneğin, Silicon Valley’deki girişimcilik kültürü, Çin’de henüz tam anlamıyla filizlenmedi. DeepSeek V2’nin başarısı, bu açığı kapatmak için atılan ilk adım olarak görülüyor.
OpenAI ve Google gibi önemli oyuncuların yapay zeka modellerine eğitim verileri sağlayan ScaleAI firmasının CEO'su Alexandr Wang, perşembe günü İsviçre’nin Davos kentinde düzenlenen Dünya Ekonomik Forumu’nda yaptığı konuşmada DeepSeek'in ürününü "dünyayı sarsacak bir model" diye niteledi. Microsoft'un CEO'su Satya Nadella da 22 Ocak'ta Dünya Ekonomik Forumu'nda yaptığı açıklamada, "Çin'deki gelişmeleri çok ama çok ciddiye almalıyız." dedi.
API masraflarını 98% azaltmak mı?
DeepSeek kullanmaya başlayan şirketlerin yorumları da dikkat çekici. Deepseek R1 kullanmaya başlayan bir startup API masraflarını 98% azaltmış, üstelik kalitenin de arttığına vurgu yapıyorlar.
Üstelik bu denli güçlü bir araç olmasına rağmen DeepSeek-R1 büyük ölçüde açık kaynaklı olarak yayınlandı. Yani isteyen herkes aracın kodlarına erişebiliyor ve bu kodları kullanarak LLM'i kişiselleştirebiliyor. Eğitim verileri ise patentli.
Öte yandan OpenAI, o1 modelini kapalı olarak piyasaya sürmüştü ve halihazırda sadece kullanıcılara bile aylık 200 dolarlık paketle satıyor.
Buarada şirketin CEO'su, 8 milyar dolarlık High-Flyer hedge fonunu yöneten Liang Wenfeng. Bu ismi ve fonun hareketlerini detaylı araştırmayı da kendime not ettim.