A20 Pro, iPhone'da 27 Milyar Parametreli Modeli İki Kat Hızlı Çalıştırdı
A20 Pro'nun cihaz üstü yapay zekâ tarafında ne yapabildiğine dair ilk somut ölçüm geldi.

A20 Pro'nun cihaz üstü yapay zekâ tarafında ne yapabildiğine dair ilk somut ölçüm geldi. Geliştirici Adrien Grondin, iPhone 18 Pro'da 27 milyar parametreli bir dil modelini çalıştırdı ve token üretim hızının iPhone 17 Pro'nun iki katı olduğunu gösterdi. Ama demonun asıl öğrettiği şey hız değil: artık darboğaz işlemci değil, bellek.
Ne ölçüldü?
| Cihaz | Çip | Token üretim hızı |
|---|---|---|
| iPhone 17 Pro Max | A19 Pro | ~11 token/sn |
| iPhone 18 Pro | A20 Pro | ~2 kat (yaklaşık 22 token/sn) |
| MacBook (M5 Pro) | M5 Pro | 44,2 token/sn |
| Nvidia H100 (veri merkezi) | H100 | 104,8 token/sn |
Saniyede 22 token, okuma hızının üzerinde. Yani model yazarken beklemiyorsunuz — cevap siz okudukça akıyor. Bunun bir telefonda, internet bağlantısı olmadan oluyor olması birkaç yıl önce makul bir beklenti değildi.
Ölçek için: aynı model, masaüstü sınıfı bir MacBook'ta iki kat, veri merkezi kartında beş kat daha hızlı. Telefon artık aynı ligde değil ama aynı sahada.

Bonsai 27B nedir?
Testte kullanılan model PrismML'in Bonsai 27B'si. Alibaba'nın Qwen3.6-27B modelinden türetilmiş ve telefona sığması için agresif biçimde sıkıştırılmış.
| Özellik | Değer |
|---|---|
| Parametre sayısı | 27,3 milyar |
| Sıkıştırma | Ağırlık başına 1,125 bit (ikili, grup bazlı ölçekleme) |
| Disk boyutu | ~3,9 GB (FP16 hâli 54 GB — 14,2 kat küçülme) |
| Korunan yetenek | 15 akıl yürütme testinde FP16'nın %89,5'i |
| Lisans | Apache 2.0 (ticari kullanıma açık) |
Buradaki numara 1-bit nicemleme. Normalde her ağırlık 16 bitlik bir sayıyla tutulur; Bonsai'de her ağırlık tek bir işaret bitine indirgeniyor ve gruplar hâlinde bir ölçek katsayısıyla düzeltiliyor. Sonuç 14 kat küçük bir dosya ve zekânın yaklaşık onda dokuzunun korunması.
Bu, telefonda yapay zekânın bugünkü gerçeği: modeli küçültmek artık modeli eğitmek kadar önemli bir mühendislik alanı. Chrome'un arka planda indirdiği 4 GB'lık model de aynı mantığın ürünü.
A20 Pro bu hızı nereden alıyor?
İki ayrı yükseltme üst üste biniyor.
Çift 16 çekirdekli Neural Engine. A20 Pro, Apple Silicon tarihinde ilk kez iki adet 16 çekirdekli sinir motoruyla geliyor. Yapay zekâ için tasarlanmış iş yüklerinde bu birimin tepe verimi çipin 7 çekirdekli GPU'sunu geçiyor — yani model artık grafik biriminde değil, kendisi için yapılmış donanımda çalışıyor.
Daha hızlı bellek. iPhone 18 Pro ve Pro Max, 96 bit veri yoluna bağlı 12 GB LPDDR5X bellekle geliyor; birleşik bellek bant genişliği 115,2 GB/sn. Dil modellerinde token üretim hızı büyük ölçüde belleğin ne kadar hızlı okunabildiğine bağlı olduğu için bu artış doğrudan hıza yansıyor. Apple'ın bu bellek için ödediği fiyatın ne kadar arttığı ayrı bir haberdi.
Ham işlemci tarafındaki sıçramayı da hatırlatalım: A20 Pro, Geekbench 7'de masaüstü Core i9 ve Ryzen 9'u geride bırakmıştı.

Asıl sınır artık bellek
Haberin gölgede kalan kısmı burası. Aynı geliştirici, modelin yeni sürümü Bonsai 2'nin 2-bit nicemlenmiş hâlinin iPhone 18 Pro'ya sığmadığını söylüyor. Sığmayınca da performans düşüyor.
Sebep aritmetik. Bonsai 27B'nin dosyası 3,9 GB ama çalışırken tepe bellek kullanımı — uzun bir sohbet geçmişiyle, 100 bin token bağlamda — 11,6 ile 12,2 GB arasına çıkıyor. Telefonun toplam RAM'i 12 GB ve bunun bir kısmını işletim sistemi kullanıyor.
Yani tablo şu: Apple işlem gücünü ikiye katladı, ama modelin çalışabileceği alan aynı kaldı. Bir sonraki adım daha hızlı bir sinir motoru değil, daha çok bellek.
Bu, sürekli performans meselesiyle de birleşiyor. Uzun bir yapay zekâ oturumu çipi ısıtır ve ısınan çip yavaşlar; iPhone 18 Pro Max'in üç kat büyük buhar odası tam da bu yüzden önemli. Hız tek başına yetmiyor, o hızı koruyabilmek gerekiyor.
Bu neden cebinizdeki parayla ilgili?
Burası demoyu teknik meraktan çıkarıp pratik bir meseleye çeviriyor.
Apple, sunucu tabanlı yapay zekâ özelliklerine günlük kota getiriyor ve kotanın ötesi için ileride ücretli bir seçenek sunacağını yazdı. Ama o limit yalnızca isteği Apple'ın sunucularına gönderen özellikleri kapsıyor — cihazın kendi işlemcisinde çalışanlar limitten etkilenmiyor.
Aynı şekilde yeni Siri'nin motorunda Google Gemini var ve o da bulutta çalışıyor.
Sonuç ilginç bir tersine dönme: Apple'ın kendi asistanı buluta bağımlı ve ücretli olmaya hazırlanırken, elinizdeki telefon 27 milyar parametreli bir modeli çevrimdışı, kotasız ve ücretsiz çalıştırabiliyor. Cihaz üstü yapay zekâ artık yalnızca gizlilik meselesi değil, abonelik ödememenin yolu.
Tabii bugün bunun için App Store'dan üçüncü taraf bir uygulama kurmanız gerekiyor; Apple bu gücü henüz kendi arayüzünde kullanıcıya açmış değil.
Kimi ilgilendiriyor?
| Durum | Anlamı |
|---|---|
| Yerel model çalıştırmak istiyorum | iPhone 18 Pro bugün bunu yapabilen en hızlı telefon; 27B sınıfı modeller akıcı çalışıyor. |
| Sadece Siri kullanıyorum | Bu gelişme sizi şimdilik etkilemiyor — Siri bulutta çalışıyor ve kotaya tabi. |
| 17 Pro'dan geçmeyi düşünüyorum | Yapay zekâ tek gerekçeyse acele etmeyin; asıl sıçrama bellek arttığında gelecek. |
| Gizlilik önceliğim | Çevrimdışı model, verinin telefondan hiç çıkmaması demek. |
Geçiş kararını tartıyorsanız iPhone 18 Pro ile 17 Pro karşılaştırmamız ve alım rehberimiz aradaki farkın karşılığı olup olmadığını ayrıntılı anlatıyor. Türkiye fiyatları da ayrı bir yazıda.
Sonuç
A20 Pro'nun cihaz üstü yapay zekâ performansı, bir telefon çipi için etkileyici bir yerde. İki kat hız artışı gerçek ve ölçülebilir.
Ama bu demo aynı anda bir sonraki sınırı da işaret ediyor. 12 GB bellek, 27 milyar parametreli bir modeli çalıştırmaya ancak yetiyor; bir üst sıkıştırma seviyesine geçmeye yetmiyor. Apple bellek konfigürasyonlarını büyütmediği sürece, önümüzdeki nesillerde daha hızlı sinir motorları göreceğiz ama daha yetenekli yerel modeller görmeyeceğiz.
Kaynaklar
Sıkça Sorulan Sorular
A20 Pro cihaz üstü yapay zekâda ne kadar hızlı?
Bonsai 27B nedir?
A20 Pro bu hızı nereden alıyor?
iPhone 18 Pro daha büyük modelleri çalıştırabilir mi?
Bu gelişme Siri'yi etkiliyor mu?
Yerel model çalıştırmak için ne gerekiyor?
İlgili İçerikler
DonanımFramework'ün Modüler LPCAMM2 Belleği mi Yoksa M5 MacBook Pro'nun Lehimli RAM'i mi Daha Hızlı?
Dizüstü bilgisayar dünyasında bellek tartışması yeniden gündemde. M5 MacBook Pro'nun lehimli LPDDR5X belleği ile Framework Laptop 13 Pro'nun modüler LPCAMM2…
Teknokutu Editör · · 2 dakikalık okuma
TeknolojiNvidia N1 Çipi: 128GB LPDDR5X ile Gerçek mi Oldu?
Sık sık dedikodulara konu olan Nvidia N1 Çipi sonunda gün yüzüne çıkmış olabilir. Yeni bir sızıntı, bu efsane çipin 128GB LPDDR5X bellekle geldiğini ortaya koyuyor ve bu birleşim, teknoloji dünyasında heyecan yaratıyor. Peki, neden bu kadar önemli? Nvidia N1 Çipi ve Bellek Özellikleri Aylardır teknoloji tutkunlarının radarında olan Nvidia N1 Çipi, şimdiye kadar daha çok…
Semih Ateşçi · · 3 dakikalık okuma
TeknolojiSamsung’un Yeni LPCAMM2 LPDDR5X Modülleri: 96GB ve 9600 MT/s
Teknoloji dünyasında yenilikler hız kesmeden devam ediyor. Son olarak, Samsung, mobil ve ultra ince sistemler için tasarlanan yeni LPCAMM2 LPDDR5X modüllerini tanıttı. Bu modüller, 96GB’a kadar kapasite sunarak, kullanıcıların bellek ihtiyaçlarını karşılamada önemli bir adım atıyor. Ayrıca, 9600 MT/s hızına ulaşarak, performansı da artırmayı hedefliyor. Bu yazıda, LPCAMM2 modüllerinin teknik özellikleri, avantajları ve potansiyel kullanım…
Semih Ateşçi · · 3 dakikalık okuma
Akıllı TelefoniPhone 18 Pro mu iPhone 17 Pro mu? 30.000 TL Farkın Karşılığı Var mı?
iPhone 18 Pro mu iPhone 17 Pro mu? Bu soruyu sorarken aslında tek bir şeye karar veriyorsunuz: aradaki 30.000 TL .
Teknokutu Editör · · 6 dakikalık okuma
Yorumlar
Henüz yorum yok. İlk yorumu siz yazın.