deniz.in

Piyasalar

Hava durumu

Hava durumu yükleniyor

· kaynak dev.to (home feed)

Hetzner, açık kaynak LLM'ler için ücretsiz ve deneysel OpenAI uyumlu inference API'sini başlattı

Hetzner, deneysel durumda kaldığı sürece ücretsiz, OpenAI uyumlu bir endpoint üzerinden açık kaynak bir Qwen modelini sunuyor; cömiz rate limitleri var ama SLA yok.

Hetzner, açık kaynak LLM'ler için ücretsiz ve deneysel OpenAI uyumlu inference API'sini başlattı

Hetzner neyi başlattı

Alman hosting sağlayıcısı Hetzner, açık kaynak büyük dil modellerini çalıştırmak için ücretsiz ve deneysel bir endpoint açtı. dev.to'daki bir incelemeye göre servis, 24 Temmuz 2026'da Hetzner'in yeni "experiments" platformunun bir parçası olarak duyuruldu ve şirketin Almanya ile Finlandiya'daki kendi altyapısında çalışıyor. Deneysel statüsünü koruduğu sürece ücretsiz ve Hetzner, faturalandırmaya ilişkin herhangi bir değişikliği önceden e-posta ile ayrıntılarıyla bildireceğini söyledi.

Entegrasyon modeli bilinçli olarak hafif tutulmuş. Geliştirici, Hetzner'in experiments portalında bir token oluşturuyor, herhangi bir OpenAI uyumlu SDK'yı base URL'ye yönlendiriyor ve normal chat completion istekleri gönderiyor. Hetzner serving, batching ve ölçeklendirmeyi perde arkasında hallediyor; dolayısıyla kiralanacak GPU, indirilecek model ağırlıkları ya da yapılandırılacak bir inference sunucusu yok.

Sunulan model

Ağustos 2026 ortası itibarıyla endpoint yalnızca tek bir model sunuyor: Alibaba'nın Qwen ekibi tarafından geliştirilen ve Apache 2.0 lisanslı Qwen/Qwen3.6-35B-A3B-FP8. dev.to'nun özetlediği Hetzner belgeleri, modeli toplam 35 milyar parametreli, token başına yaklaşık 3 milyarının aktifleştiği bir Mixture-of-Experts modeli olarak tanımlıyor. Model, 262.144 tokenlık bir context penceresi, bellek kullanımını azaltan FP8 quantization ve aynı istekte metnin yanında görsel de kabul eden multimodal destek sunuyor.

Hetzner, tek modellik yapının bilinçli olduğunu söylüyor: Şirket, talebe ve operasyonel deneyime dayanarak ek modeller eklemeden önce platformu doğrulamak, geri bildirim toplamak ve güvenilirliği teyit etmek istiyor.

Rate limitleri ve ölçülen hız

Servis anahtar başına limitler uyguluyor ve aşıldığında HTTP 429 döndürüyor. Her 60 saniyede her anahtar 3 milyon input token ve 60.000 output token izni veriyor; 24 saatlik dilimde bu tutarlar 500 milyon input ve 5 milyon output tokena çıkıyor. dev.to yazarının hesabına göre yalnızca günlük input kotası, her biri 2.000 input token olan yaklaşık 250.000 isteği karşılıyor; buna karşılık dakika başına output sınırı, sürekli üretim için daha olası bir darboğaz.

Sliplane.io'nun 23 Temmuz 2026'daki bağımsız testi, yedi kısa istekte medyan 153 ms time-to-first-token ve 512 tokenla sınırlı beş uzun üretimde saniyede 224 output token bildirdi. Testi yapan kişi, bunun bir garanti değil, tek istemcili bir anlık görüntü olduğu konusunda uyardı.

Açıkça production sınıfı değil

dev.to'nun aktardığı Hetzner'in deney şartları, servisi performans veya kullanılabilirlik garantisi olmadan "olduğu gibi" sunulan bir hizmet olarak tanımlıyor; özellikle yoğun talep dönemlerinde bu geçerli. Yedekleme yapılmıyor, servis herhangi bir zamanda habersiz şekilde değiştirilebilir veya geri çekilebilir ve şirket kullanıcılarına bunun üzerinde production ortamları çalıştırmamalarını açıkça söylüyor. Gelecekteki token fiyatları henüz yayınlanmadı.

dev.to yazısı ayrıca Hetzner'in deneysel endpoint için bir Veri İşleme Sözleşmesi'ni (DPA) kamuya açık olarak belgelemediğine dikkat çekiyor. Bu, GDPR kapsamındaki kişisel verilerin servise yasal olarak gönderilip gönderilemeyeceğini değerlendirenler için önemli ve SLA eksikliğinden bağımsız olarak endpoint'i çoğu müşteriye dönük iş için eler.

Neden önemli

Köklü bir AB sağlayıcısından ücretsiz, OpenAI uyumlu bir endpoint, açık ağırlıklı modellerle deney yapmanın eşiğini neredeyse sıfıra indiriyor. OpenAI SDK'sına göre yazılmış mevcut kod, tek bir base URL'yi değiştirdikten sonra çalışıyor ve günlük input kotası, kredi kartı veya GPU faturası olmadan ciddi prototipleme için yeterince büyük.

Bu ayrıca Hetzner'in hangi yöne gidebileceğinin bir sinyali. Şirket ününü agresif fiyatlı dedicated server'lara borçlu ve bir inference deneyi, aynı şekilde AI serving alanında rekabet edip edemeyeceğini test ettiğini gösteriyor. Servis ücretli bir ürüne dönüşürse, köklü inference sağlayıcıları üzerindeki fiyat baskısı ciddi olabilir.

Uyarılar da en az potansiyel kadar gerçek. Tek model, SLA yok, habersiz geri çekilme olasılığı ve belgelenmiş bir DPA'nın olmaması, bunun bir altyapı değil bir kum havuzu olduğu anlamına geliyor. Production için AB'de barındırılan inference'a ihtiyaç duyan geliştiriciler hâlâ ticari bir sağlayıcıya ihtiyaç duyacak; ancak değerlendirme, yan projeler ve öğrenme için bu olağanüstü ucuz bir giriş kapısı.

  • #hetzner
  • #inference-api
  • #openai-compatible
  • #llm
  • #qwen

İlgili yazılar