Hissedilen gecikme
Türkiye’den ABD’deki bir çıkarım uç noktasına gidiş-dönüş, daha ilk token üretilmeden 220ms’den fazla ekler. Sohbet ve ajan yüklerinde bu maliyet her turda katlanır.
Özel beta — Türkiye bölgesi
Açık ağırlıklı modelleri Türkiye’deki veri merkezlerimizde, H100 ve H200 GPU’lar üzerinde çalıştırın. Veriniz ülke dışına çıkmaz, faturanız Türk Lirası olur, kodunuzda tek bir satır değişir.
Kredi kartı gerekmez. Erken erişim davetleri gruplar hâlinde gönderilir.
LLMnow, OpenAI API’sini konuşur. Mevcut SDK’nızı bizim adresimize yönlendirin, kodun geri kalanına dokunmayın.
Sohbet tamamlama, akış (streaming), fonksiyon çağırma ve embedding aynı şemayı kullanır.
from openai import OpenAI
client = OpenAI(
base_url="https://api.llmnow.ai/v1",
api_key="llm-...",
)
stream = client.chat.completions.create(
model="llama-3.3-70b-instruct",
messages=[{"role": "user", "content": "Merhaba!"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="")
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.llmnow.ai/v1",
apiKey: process.env.LLMNOW_API_KEY,
});
const stream = await client.chat.completions.create({
model: "llama-3.3-70b-instruct",
messages: [{ role: "user", content: "Merhaba!" }],
stream: true,
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}
curl https://api.llmnow.ai/v1/chat/completions \
-H "Authorization: Bearer $LLMNOW_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "llama-3.3-70b-instruct",
"messages": [{"role": "user", "content": "Merhaba!"}],
"stream": true
}'
Sorun
Türkiye’den ABD’deki bir çıkarım uç noktasına gidiş-dönüş, daha ilk token üretilmeden 220ms’den fazla ekler. Sohbet ve ajan yüklerinde bu maliyet her turda katlanır.
Küresel sağlayıcılar isteklerinizin nerede işlendiğini ve saklandığını garanti edemez. Düzenlemeye tabi veride yurt dışına veri aktarımı, teknik bir ayrıntı değil savunmanız gereken bir uyum kararıdır.
Dolar cinsinden API faturaları, mühendislik giderini döviz pozisyonuna çevirir. Ocak’ta yapılan bütçe Haziran’da anlamını yitirir.
“Yapay zekâya ihtiyacımız var ama müşteri verisini yurt dışına gönderemeyiz.”
— CFO, İstanbul merkezli fintek
Platform
Yönetilen bir çıkarım sağlayıcısından beklediğiniz her şey — üstelik kullanıcılarınızın ve düzenleyicinizin bulunduğu yerde.
H100 ve H200 GPU’lar Türkiye’deki veri merkezlerimizde çalışır. Türkiye, MENA ve Avrupa’daki kullanıcılar için kısa ve öngörülebilir ağ yolları.
İstek ve yanıtlar Türkiye’de işlenir. Ücretli planların tamamında KVKK’ya göre yazılmış veri işleme sözleşmesi bulunur.
Llama, Mistral, DeepSeek, Qwen ve Türkçe ince ayarlı modeller. Kendi ağırlıklarınızı getirin, ayrılmış kapasitede sizin için çalıştıralım.
OpenAI uyumlu REST API. Resmî OpenAI SDK’ları, LangChain, LlamaIndex ve Vercel AI SDK değişiklik gerektirmeden çalışır.
Ani trafik artışları ortak havuzda karşılanır. Garantili taban gerektiğinde ayrılmış kapasite sunulur.
Türk Lirası fiyatlandırma ve e-fatura. Yurt dışı müşteriler için USD fiyatlandırma da mevcuttur.
Kapsama
GPU’larımız Türkiye’deki veri merkezlerimizde çalışır. Buradan Türkiye, MENA ve Avrupa’ya hizmet veriyoruz — veri hiçbir koşulda ülke dışına çıkmaz.
H100 ve H200 kümeleri, KVKK kapsamında veri yerelliği ve TL faturalama. En düşük gecikmeyi burası alır.
Körfez ülkeleri ve Orta Doğu. USD faturalama, İngilizce ve Arapça arayüz. ABD’ye kıyasla belirgin şekilde kısa ağ yolu.
Avrupa’daki ekipler için EUR/USD faturalama. Verisini AB dışında ama denetlenebilir bir yargı alanında tutmak isteyenler için uygun.
Kapsama, hizmet verdiğimiz bölgeleri gösterir; GPU’ların tamamı Türkiye’dedir. Belirli bir ülkede yerel kurulum gerekiyorsa kurumsal planda konuşalım.
Modeller
Aşağıdaki liste lansman setidir. Model bazlı fiyatlar ve bağlam sınırları API açıldığında yayımlanır.
Lansmandaki model listesi lisans koşullarına ve küme kapasitesine bağlıdır. Belirli bir model mi gerekiyor? Bekleme listesi formunda bize yazın.
Fiyatlandırma
Yaygın kullanım için token fiyatlandırması, donanıma doğrudan erişim gerektiğinde GPU-saat, satın alma birimi istediğinde yıllık sözleşme.
$0,05 – $2,191M token başına
Ortak havuzda token başına ödeme. Hız limitleri kullanımla birlikte artar.
$0,79 – $2,50GPU-saat başına
İnce ayar ve özel servis için ayrılmış H100 / H200. Saatlik veya rezerve.
Özelyıllık sözleşme
Ayrılmış altyapı, imzalı SLA ve hukuk ekibinizin dosyalayabileceği KVKK dokümantasyonu.
Fiyatlar karşılaştırma kolaylığı için USD gösterilmiştir. Türkiye’deki müşterilere sözleşmedeki kur üzerinden TL fatura kesilir.
Karşılaştırma
Yayın tarihindeki özellik karşılaştırması. Bu tabloyu dürüst tutuyoruz — rakip bir satırı karşılarsa tabloyu güncelliyoruz.
| Özellik | LLMnow.ai | Together AI | Groq | RunPod |
|---|---|---|---|---|
| Türkiye / MENA bölgesi | Türkiye | Yok | Yok | Avrupa |
| KVKK veri yerelliği | Tam | Hayır | Hayır | Hayır |
| TL faturalama | Evet | Hayır | Hayır | Hayır |
| Türkçe destek | Evet | Yalnız EN | Yalnız EN | Yalnız EN |
| Yönetilen çıkarım | Evet | Evet | Evet | Kendin yönet |
| Açık model seçimi | 50+ | Geniş | Yalnız Groq modelleri | Serbest |
| Çalışma süresi SLA | %99,9 | ~%99 | %99,9 | Yok |
Uyumluluk
Veri yerelliği burada bir pazarlama cümlesi değil — platformun var olma sebebi.
Erken erişim
Ne geliştirdiğinizi anlatın. Davetleri gruplar hâlinde gönderiyor, somut iş yükü olan ekiplere öncelik veriyoruz.
Grubunuz açıldığında e-posta göndereceğiz. Kullanım senaryonuz ayrılmış kapasite gerektiriyorsa sizinle daha erken iletişime geçeriz.
SSS
Türkiye’deki kümemiz ayağa kaldırılıyor ve API özel betada. Bekleme listesindekiler, kapasite geldikçe gruplar hâlinde anahtar alır.
Hayır. API, OpenAI şemasını izler. Adresi ve API anahtarını değiştirin; akış, araç çağrıları ve embedding dâhil geri kalan her şey çalışmaya devam eder.
Türkiye’deki bir veri merkezinde bulunan GPU’larda. Çıkarım trafiğini ülke dışındaki sağlayıcılara iletmiyoruz.
Evet, ayrılmış kapasitede. Ağırlıkları ve servis yapılandırmasını gönderin, sizin için barındıralım.
Türkiye’deki tüzel kişilere, sözleşmede mutabık kalınan kur üzerinden Türk Lirası ve e-fatura ile fatura kesilir. Yurt dışı müşteriler USD’de kalabilir.
GPU altyapısı ve ML servisi geçmişi olan, İstanbul merkezli bir ekip. Ayrıntılar kamuya açık lansmanla birlikte yayımlanacak.