deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak Hacker News – Front Page (hnrss.org)

MacStories: M5 Ultra Mac Studio, yerel yapay zeka ajanlarını günlük kullanım için yeterince hızlı hale getiriyor

MacStories'ın elde ettiği deneyim incelemesine göre, 256GB birleşik belleğe sahip M5 Ultra Mac Studio, yüzde 50 daha fazla bellek bant genişliği ve çok daha hızlı bir GPU sayesinde yerel yapay zeka ajanlarını gerçekten kullanılabilir hızlarda çalıştırıyor.

MacStories: M5 Ultra Mac Studio, yerel yapay zeka ajanlarını günlük kullanım için yeterince hızlı hale getiriyor

MacStories tarafından yayımlanan ve şu anda Hacker News ana sayfasında yer alan bir kullanım incelemesi çarpıcı bir iddiada bulunuyor: 256GB birleşik bellekle yapılandırılmış yeni M5 Ultra Mac Studio, yerel yapay zeka ajanlarını günlük kişisel asistanlar olarak çalıştırmak için yeterince iyi — hızlı, sessiz ve yinelenen bir bulut faturası olmadan.

Kendisini profesyonel bir yapay zeka geliştiricisinden çok yerel modellerle uzun süredir uğraşan bir meraklısı olarak tanımlayan incelemeci, makineyi dört gün boyunca öncülü olan 512GB RAM'li bir M3 Ultra Mac Studio ve NVIDIA RTX 5090 etrafında kurulmuş büyük bir oyun bilgisayarına karşı test etti.

Kazanımların kaynağı

MacStories'a göre M5 Ultra, UltraFusion kullanarak iki çift-die M5 Max çipini dört-die'lık tek bir pakette birleştiren ilk Apple çipi. Yerel model çıkarımı için inceleme iki teknik özelliğe odaklanıyor: GPU işlem gücü ve bellek bant genişliği. 80 çekirdekli GPU, her çekirdeği bir Neural Accelerator ile eşleştiriyor; Apple bunun M3 Ultra'ya kıyasla yapay zeka için en yüksek GPU işlem gücünde 4.5 kata kadar artış sağladığını belirtiyor. Bellek bant genişliği ise 819 GB/s'den 1.2 TB/s'ye çıkıyor — yüzde 50'lik bir sıçrama. Birleşik bellek hâlâ en fazla 512GB olabiliyor ancak bu yapılandırmanın gönderimleri Ekim sonuna kadar başlamayacak.

Uygulamada incelemeye göre makine, üretim başlamadan önce bir prompt'u işleme süresini çok daha kısa tutuyor ve ardından metni belirgin biçimde daha hızlı akıtıyor. iOS'taki Open Minis uygulaması kullanılarak yapılan yan yana testlerde M5 Ultra, ortalama olarak M3 Ultra'dan yaklaşık yüzde 70 daha hızlı yanıt üretti ve Qwen3.8-Flash-Next modeli saniyede 100 token eşiğini aştı.

Uzun oturumlarda ayakta kalan ajanlar

Bu rakamlardan daha önemlisi, rakamların önünü açtığı iş akışı. İncelemeci, M5 Ultra'yı MLX ile çalışan yerel modeller için önemli bir performans sıçraması olarak nitelendiriyor ve Qwen3.8-Flash-Next'i hem iOS'taki Open Minis hem de Hermes Agent içinde varsayılan modeli haline getirmiş — artık Siri AI'dan daha çok başvurduğu asistanlar olduğunu söylüyor. Ayrıca Mac'indeki Codex uygulamasında da yerel modeller çalıştırıyor; bunlar ya ana iş parçacıkları olarak ya da GPT-6 Astra tarafından yönetilen alt ajanlar olarak kullanılıyor. GPU ve bellek bant genişliği daha yüksek olduğu için ajanlar daha çabuk yanıt vermeye başlıyor, daha büyük bağlam pencerelerinde duyarlı kalıyor ve bir oturum büyüdükçe yavaşlamadan uzun çok turlu döngüleri sürdürüyor — ajan tipi yapay zekayı tanımlayan kullanım deseninin ta kendisi bu.

99 günlük iş yükü, sıfır dolar

İncelemenin arka planında gerçek bir proje var. Yazar, yaz aylarında MacStories'ın iOS ve iPadOS 27 kapsamı için 310 belgeyi — notları, PDF'leri, kaydedilmiş web sayfalarını ve inceleme bölümlerini — düzenlemek amacıyla Desk adında dahili bir uygulama geliştirdi. DeepSeek V4 Flash üzerine kurulu, PDF'leri olmOCR ile işleyen bir ajan ekibi 99 gün boyunca 7/24 çalıştı: WWDC oturumlarını transkribe etti, birden çok kaynaktan özellikler çıkardı, özellikleri bölümlerle çapraz eşleştirdi, ekran görüntülerinden ayrıntıları ve hataları topladı ve her şeyi Notion API üzerinden eşitledi. İncelemeye göre bu sürekli açık iş yükü OpenAI veya Anthropic API'leri üzerinden fiyatlanmış olsaydı son derece maliyetli olurdu; bir Mac Studio'da yerel olarak çalıştığı için hiçbir şeyeye mal olmadı. Yayımlanan inceleme geleneksel yöntemle yazıldı ancak araştırma yığını ajanlar tarafından oluşturuldu.

Uyarılar

Yazı sınırlar hakkında açık sözlü. RTX 5090, daha yüksek bellek bant genişliği sayesinde hâlâ bir avantaja sahip ve buluttaki en gelişmiş modeller hem daha yetenekli hem de çoğu zaman yerel modellerden daha hızlı. Yerel kurulumlar uğraştırıcı ve tamamen deneysel; donanım da öyle pahalı ki bir alıcı aynı parayla yıllarca premium bir yapay zeka aboneliğini finanse edebilir — incelemeci, sadece cilalı bir bulut ürünü isteyen herkese bunu memnuniyetle önereceğini söylüyor. Mac Studio tercihi, ham benchmark sonuçları kadar kompakt ve sessiz şasisine ve macOS uygulama ekosistemine de dayanıyor.

Neden önemli

Apple'ın birleşik bellek mimarisi, sessiz tek bir masaüstü bilgisayarın tüketici GPU'larına sığmayan modelleri barındırmasını sağlıyor ve M5 Ultra'nın bant genişliği kazanımları bu kapasiteyi etkileşimli hıza dönüştürüyor. Sürekli açık kişisel ajanlar yalnızca elektrik maliyetiyle kullanılabilir gecikmelerde çalışabiliyorsa, gizlilik, satıcıya bağımlılık ve token başına fiyatlandırma çevresindeki dengeler farklı görünmeye başlıyor. M5 Ultra en gelişmiş bulut modellerini geçmiyor — ancak MacStories'a göre yerel ajanlar artık bir hobici merakı olmaktan çıkıp pratik bir günlük seçenek haline gelecek kadar boşluğu daraltıyor.

  • #apple-silicon
  • #local-ai
  • #ai-agents
  • #mac-studio
  • #mlx

İlgili yazılar