Yapay Zekâ

A20 Pro, iPhone'da 27 Milyar Parametreli Modeli İki Kat Hızlı Çalıştırdı

A20 Pro'nun cihaz üstü yapay zekâ tarafında ne yapabildiğine dair ilk somut ölçüm geldi.

Teknokutu Editör4 dakikalık okuma
iPhone 18 Pro içindeki A20 Pro çip görseli

A20 Pro'nun cihaz üstü yapay zekâ tarafında ne yapabildiğine dair ilk somut ölçüm geldi. Geliştirici Adrien Grondin, iPhone 18 Pro'da 27 milyar parametreli bir dil modelini çalıştırdı ve token üretim hızının iPhone 17 Pro'nun iki katı olduğunu gösterdi. Ama demonun asıl öğrettiği şey hız değil: artık darboğaz işlemci değil, bellek.

Ne ölçüldü?

CihazÇipToken üretim hızı
iPhone 17 Pro MaxA19 Pro~11 token/sn
iPhone 18 ProA20 Pro~2 kat (yaklaşık 22 token/sn)
MacBook (M5 Pro)M5 Pro44,2 token/sn
Nvidia H100 (veri merkezi)H100104,8 token/sn

Saniyede 22 token, okuma hızının üzerinde. Yani model yazarken beklemiyorsunuz — cevap siz okudukça akıyor. Bunun bir telefonda, internet bağlantısı olmadan oluyor olması birkaç yıl önce makul bir beklenti değildi.

Ölçek için: aynı model, masaüstü sınıfı bir MacBook'ta iki kat, veri merkezi kartında beş kat daha hızlı. Telefon artık aynı ligde değil ama aynı sahada.

iPhone 18 Pro ve iPhone 18 Pro Max yan yana
iPhone 18 Pro ve Pro Max, 96 bit veri yoluna bağlı 12 GB LPDDR5X bellekle geliyor. Görsel: Apple

Bonsai 27B nedir?

Testte kullanılan model PrismML'in Bonsai 27B'si. Alibaba'nın Qwen3.6-27B modelinden türetilmiş ve telefona sığması için agresif biçimde sıkıştırılmış.

ÖzellikDeğer
Parametre sayısı27,3 milyar
SıkıştırmaAğırlık başına 1,125 bit (ikili, grup bazlı ölçekleme)
Disk boyutu~3,9 GB (FP16 hâli 54 GB — 14,2 kat küçülme)
Korunan yetenek15 akıl yürütme testinde FP16'nın %89,5'i
LisansApache 2.0 (ticari kullanıma açık)

Buradaki numara 1-bit nicemleme. Normalde her ağırlık 16 bitlik bir sayıyla tutulur; Bonsai'de her ağırlık tek bir işaret bitine indirgeniyor ve gruplar hâlinde bir ölçek katsayısıyla düzeltiliyor. Sonuç 14 kat küçük bir dosya ve zekânın yaklaşık onda dokuzunun korunması.

Bu, telefonda yapay zekânın bugünkü gerçeği: modeli küçültmek artık modeli eğitmek kadar önemli bir mühendislik alanı. Chrome'un arka planda indirdiği 4 GB'lık model de aynı mantığın ürünü.

A20 Pro bu hızı nereden alıyor?

İki ayrı yükseltme üst üste biniyor.

Çift 16 çekirdekli Neural Engine. A20 Pro, Apple Silicon tarihinde ilk kez iki adet 16 çekirdekli sinir motoruyla geliyor. Yapay zekâ için tasarlanmış iş yüklerinde bu birimin tepe verimi çipin 7 çekirdekli GPU'sunu geçiyor — yani model artık grafik biriminde değil, kendisi için yapılmış donanımda çalışıyor.

Daha hızlı bellek. iPhone 18 Pro ve Pro Max, 96 bit veri yoluna bağlı 12 GB LPDDR5X bellekle geliyor; birleşik bellek bant genişliği 115,2 GB/sn. Dil modellerinde token üretim hızı büyük ölçüde belleğin ne kadar hızlı okunabildiğine bağlı olduğu için bu artış doğrudan hıza yansıyor. Apple'ın bu bellek için ödediği fiyatın ne kadar arttığı ayrı bir haberdi.

Ham işlemci tarafındaki sıçramayı da hatırlatalım: A20 Pro, Geekbench 7'de masaüstü Core i9 ve Ryzen 9'u geride bırakmıştı.

iPhone 18 Pro'nun gövdesi içindeki buhar odasının ısınan hâlini gösteren kesit görseli
Uzun yapay zekâ oturumları çipi ısıtıyor; A20 Pro'nun etrafındaki buhar odası hızın korunmasını sağlıyor. Görsel: Apple

Asıl sınır artık bellek

Haberin gölgede kalan kısmı burası. Aynı geliştirici, modelin yeni sürümü Bonsai 2'nin 2-bit nicemlenmiş hâlinin iPhone 18 Pro'ya sığmadığını söylüyor. Sığmayınca da performans düşüyor.

Sebep aritmetik. Bonsai 27B'nin dosyası 3,9 GB ama çalışırken tepe bellek kullanımı — uzun bir sohbet geçmişiyle, 100 bin token bağlamda — 11,6 ile 12,2 GB arasına çıkıyor. Telefonun toplam RAM'i 12 GB ve bunun bir kısmını işletim sistemi kullanıyor.

Yani tablo şu: Apple işlem gücünü ikiye katladı, ama modelin çalışabileceği alan aynı kaldı. Bir sonraki adım daha hızlı bir sinir motoru değil, daha çok bellek.

Bu, sürekli performans meselesiyle de birleşiyor. Uzun bir yapay zekâ oturumu çipi ısıtır ve ısınan çip yavaşlar; iPhone 18 Pro Max'in üç kat büyük buhar odası tam da bu yüzden önemli. Hız tek başına yetmiyor, o hızı koruyabilmek gerekiyor.

Bu neden cebinizdeki parayla ilgili?

Burası demoyu teknik meraktan çıkarıp pratik bir meseleye çeviriyor.

Apple, sunucu tabanlı yapay zekâ özelliklerine günlük kota getiriyor ve kotanın ötesi için ileride ücretli bir seçenek sunacağını yazdı. Ama o limit yalnızca isteği Apple'ın sunucularına gönderen özellikleri kapsıyor — cihazın kendi işlemcisinde çalışanlar limitten etkilenmiyor.

Aynı şekilde yeni Siri'nin motorunda Google Gemini var ve o da bulutta çalışıyor.

Sonuç ilginç bir tersine dönme: Apple'ın kendi asistanı buluta bağımlı ve ücretli olmaya hazırlanırken, elinizdeki telefon 27 milyar parametreli bir modeli çevrimdışı, kotasız ve ücretsiz çalıştırabiliyor. Cihaz üstü yapay zekâ artık yalnızca gizlilik meselesi değil, abonelik ödememenin yolu.

Tabii bugün bunun için App Store'dan üçüncü taraf bir uygulama kurmanız gerekiyor; Apple bu gücü henüz kendi arayüzünde kullanıcıya açmış değil.

Kimi ilgilendiriyor?

DurumAnlamı
Yerel model çalıştırmak istiyorumiPhone 18 Pro bugün bunu yapabilen en hızlı telefon; 27B sınıfı modeller akıcı çalışıyor.
Sadece Siri kullanıyorumBu gelişme sizi şimdilik etkilemiyor — Siri bulutta çalışıyor ve kotaya tabi.
17 Pro'dan geçmeyi düşünüyorumYapay zekâ tek gerekçeyse acele etmeyin; asıl sıçrama bellek arttığında gelecek.
Gizlilik önceliğimÇevrimdışı model, verinin telefondan hiç çıkmaması demek.

Geçiş kararını tartıyorsanız iPhone 18 Pro ile 17 Pro karşılaştırmamız ve alım rehberimiz aradaki farkın karşılığı olup olmadığını ayrıntılı anlatıyor. Türkiye fiyatları da ayrı bir yazıda.

Sonuç

A20 Pro'nun cihaz üstü yapay zekâ performansı, bir telefon çipi için etkileyici bir yerde. İki kat hız artışı gerçek ve ölçülebilir.

Ama bu demo aynı anda bir sonraki sınırı da işaret ediyor. 12 GB bellek, 27 milyar parametreli bir modeli çalıştırmaya ancak yetiyor; bir üst sıkıştırma seviyesine geçmeye yetmiyor. Apple bellek konfigürasyonlarını büyütmediği sürece, önümüzdeki nesillerde daha hızlı sinir motorları göreceğiz ama daha yetenekli yerel modeller görmeyeceğiz.

PaylaşXFacebookLinkedInWhatsApp

Kaynaklar

Sıkça Sorulan Sorular

A20 Pro cihaz üstü yapay zekâda ne kadar hızlı?
Geliştirici Adrien Grondin'in testinde iPhone 18 Pro, 27 milyar parametreli Bonsai 27B modelini iPhone 17 Pro'nun yaklaşık iki katı hızda çalıştırdı. Modelin resmî kartında iPhone 17 Pro Max için saniyede ~11 token yazıyor, yani 18 Pro tarafında saniyede 22 token civarı bir hızdan söz ediyoruz.
Bonsai 27B nedir?
PrismML'in geliştirdiği, Alibaba'nın Qwen3.6-27B modelinden türetilmiş 27,3 milyar parametreli bir dil modeli. Ağırlık başına 1,125 bitlik agresif bir sıkıştırmayla 54 GB'lık orijinalinden 3,9 GB'a inmiş, buna rağmen 15 akıl yürütme testinde orijinalin %89,5'ini koruyor. Apache 2.0 lisanslı.
A20 Pro bu hızı nereden alıyor?
İki yükseltme üst üste biniyor. Birincisi, Apple Silicon tarihinde ilk kez çift 16 çekirdekli Neural Engine kullanılması; yapay zekâ iş yüklerinde bu birimin tepe verimi çipin 7 çekirdekli GPU'sunu geçiyor. İkincisi, 115,2 GB/sn birleşik bant genişliğine sahip daha hızlı bellek — dil modellerinde hız büyük ölçüde belleğin okunma hızına bağlı.
iPhone 18 Pro daha büyük modelleri çalıştırabilir mi?
Hayır, sınır burada. Bonsai'nin 2-bit nicemlenmiş yeni sürümü Bonsai 2, iPhone 18 Pro'ya sığmıyor. Sebep aritmetik: model 100 bin token bağlamda çalışırken tepe bellek kullanımı 11,6-12,2 GB'a çıkıyor, telefonun toplam RAM'i ise 12 GB ve bunun bir kısmını işletim sistemi kullanıyor.
Bu gelişme Siri'yi etkiliyor mu?
Doğrudan etkilemiyor, çünkü Siri bulutta çalışıyor. Apple sunucu tabanlı yapay zekâ özelliklerine günlük kota getiriyor ve kotanın ötesi ileride ücretli olacak. Ancak bu limit yalnızca sunucuya giden istekleri kapsıyor; cihazın kendi işlemcisinde çalışan modeller kotaya tabi değil.
Yerel model çalıştırmak için ne gerekiyor?
App Store'dan üçüncü taraf bir uygulama kurmanız gerekiyor. Apple bu gücü henüz kendi arayüzünde doğrudan kullanıcıya açmış değil. Model dosyası 3,9 GB olduğu için depolama alanı ayırmanız da gerekir.

Teknokutu Editör

Genel Yayın Yönetmeni

Teknokutu yayın ekibi.

Nvidia N1 ÇipiTeknoloji

Nvidia N1 Çipi: 128GB LPDDR5X ile Gerçek mi Oldu?

Sık sık dedikodulara konu olan Nvidia N1 Çipi sonunda gün yüzüne çıkmış olabilir. Yeni bir sızıntı, bu efsane çipin 128GB LPDDR5X bellekle geldiğini ortaya koyuyor ve bu birleşim, teknoloji dünyasında heyecan yaratıyor. Peki, neden bu kadar önemli? Nvidia N1 Çipi ve Bellek Özellikleri Aylardır teknoloji tutkunlarının radarında olan Nvidia N1 Çipi, şimdiye kadar daha çok…

Semih Ateşçi · · 3 dakikalık okuma

Samsung LPCAMM2 LPDDR5X modülleriTeknoloji

Samsung’un Yeni LPCAMM2 LPDDR5X Modülleri: 96GB ve 9600 MT/s

Teknoloji dünyasında yenilikler hız kesmeden devam ediyor. Son olarak, Samsung, mobil ve ultra ince sistemler için tasarlanan yeni LPCAMM2 LPDDR5X modüllerini tanıttı. Bu modüller, 96GB’a kadar kapasite sunarak, kullanıcıların bellek ihtiyaçlarını karşılamada önemli bir adım atıyor. Ayrıca, 9600 MT/s hızına ulaşarak, performansı da artırmayı hedefliyor. Bu yazıda, LPCAMM2 modüllerinin teknik özellikleri, avantajları ve potansiyel kullanım…

Semih Ateşçi · · 3 dakikalık okuma

Yorumlar

Henüz yorum yok. İlk yorumu siz yazın.

Yorum yaz