Nemotron 3 Ultra gerçekten ücretsiz ve gerçekten iyi. Ücretsiz kısmı günde 50 istekte bitiyor
Model gerçek ve iyi. NVIDIA 4 Haziran 2026'da yayınladı, 550 milyar parametre taşıyor ama her istekte bunun 55 milyarı çalışıyor, 1 milyon token'lık bağlam alıyor ve lisansı ticari kullanıma açık. OpenRouter'daki ücretsiz uç noktasında giriş de çıkış da sıfır dolar, bunu API'den tek tek doğruladım. Dolaşan anlatımda üç şey tutmuyor. Birincisi "en büyük ücretsiz model": değil, Kimi K3 beş kat büyük ve o da açık. İkincisi "Claude'dan bile daha iyi": NVIDIA böyle bir şey söylemiyor, kendi iddiası hız üzerine, ve bağımsız ölçümlerde gerçek dünya kodlamasında Claude önde. Üçüncüsü "tamamen ücretsiz": ücretsiz katman dakikada 20, günde 50 istek veriyor, kodlama ajanı bunu bir öğleden sonrada bitiriyor. Aşağıda iki ayrı ücretsiz yolun doğrulanmış kurulumu, bu modelin gerçekten önde olduğu yer, OpenCode'un ilk açılışta seni fatura ekranına götüren adımı ve ücretsiz uç noktanın ücretliden daha uzun bağlam vermesi gibi ters bir ayrıntı var.
Ücretsiz APIClaude CodeGeliştirici Araçları
Modelin kendisi
NVIDIA 4 Haziran 2026'da yayınladı. Karma uzman mimarisi kullanıyor: toplam 550 milyar parametre var ama her istekte hepsi değil, 55 milyarı çalışıyor. Bu yüzden boyutuna göre hızlı. Bağlam penceresi 1 milyon token'a kadar çıkıyor. Lisansı OpenMDW 1.1 ve ticari kullanıma açık, bu son kısım önemli çünkü "açık ağırlıklı" denen modellerin çoğunda durum böyle değil.
Aşağıda fazladan olan şey şu: iki ayrı ücretsiz yolun doğrulanmış kurulumu, her birinin tam olarak nerede bittiği, OpenCode'un ilk açılışta seni fatura bilgisi istemeye götüren adımı ve ağırlıkları indirmenin neden neredeyse hiç kimse için bir seçenek olmadığı.
Bu model için dolaşan iki cümle var ve ikisi de ölçülebilir olduğu için kontrol ettim. Birincisi "bugüne kadarki en büyük ücretsiz model". Değil. Hugging Face'in kendi verdiği sayıya göre Nemotron 3 Ultra 560 milyar parametre taşıyor. Aynı yerde duran Kimi K3 ise 2,78 trilyon, yani yaklaşık beş katı, ve o da indirilebilir durumda. DeepSeek ve Thinking Machines tarafında da daha büyükleri var. Nemotron'un rekoru boyut değil.
İkincisi "Claude'dan bile daha iyi". NVIDIA böyle bir iddiada bulunmuyor. Kendi araştırma sayfasında ve teknik raporunun özetinde yazan cümle şu: açık modellere kıyasla 6 kata kadar yüksek işlem hızı, benzer doğrulukla. Karşılaştırdığı modeller de GLM, Kimi ve Qwen; hepsi açık model. Claude ya da GPT ile karşılaştırma yayınlamıyorlar, ve bunu yayınlamamaları başlı başına bir bilgi.
Hangisi nerede önde
Nemotron 3 Ultra
hız, maliyet ve erişim
NVIDIA'nın ölçümünde açık modellere göre 6 kata kadar hızlı
Aynı görevi daha az token harcayarak bitiriyor
Ağırlıkları açık, lisans ticari kullanıma izin veriyor
1 milyon token bağlam ve sıfır dolarlık bir uç nokta
Claude
gerçek dünya kodlaması
Gerçek depolarda hata çözen testlerde bağımsız ölçümler Claude'u önde gösteriyor
Aradaki fark küçük değil, yaklaşık on puan bandında
Uzun ve karışık görevlerde bağlamı daha iyi taşıyor
Buna karşılık kapalı, pahalı ve indirilemiyor
Doğru beklenti şu: açık modeller arasında hız ve verim tarafında en iyilerden birini alıyorsun, üstelik bedavaya. Claude'un yerini alan bir şey almıyorsun. Bu kötü bir haber değil, çünkü bu modelin asıl satış noktası zaten doğruluk değil. Aynı işi daha az token ve daha kısa sürede bitirmek, ücretsiz katmanda günlük hakkın sayılı olduğu bir yerde doğrudan işine yarıyor.
Ücretsiz tam olarak nerede bitiyor
İki ayrı ücretsiz yol var ve ikisi karıştırılıyor. Birincisi OpenRouter'ın ücretsiz uç noktası: model adının sonuna ":free" geliyor, giriş ve çıkış ücreti gerçekten sıfır. İkincisi NVIDIA'nın kendi API'si: hesap açıyorsun, kart istemiyor, anahtarını alıyorsun. Kurulumları farklı, sınırları farklı.
Dört yol, dört sınır
Yol
Ücret
Sınır
OpenRouter ücretsiz uç nokta
0 dolar
dakikada 20, günde 50 istek
OpenRouter ücretsiz, hesapta bir kerelik 10 dolar varsa
0 dolar, o 10 dolar duruyor
dakikada 20, günde 1.000 istek
OpenRouter ücretli uç nokta
1M giriş 0,625 dolar, 1M çıkış 3,125 dolar
kredin bitene kadar
NVIDIA'nın kendi API'si
0 dolar, kart istemiyor
dakikada 40 istek, kredi havuzu
Tablodaki ikinci satır en çok işe yarayan bilgi. OpenRouter'da bir kere 10 dolarlık kredi yüklersen ücretsiz katmanın günlük hakkı 50'den 1.000'e çıkıyor, üstelik o 10 dolar hesabında duruyor çünkü ücretsiz istekler onu harcamıyor. Yani tek seferlik 10 dolar, bu modeli günde yirmi kat daha fazla kullandırıyor.
50 istek sandığından az
Sohbet ederken 50 istek çok gelir. Kodlama ajanında değil. Ajan tek bir görev için dosya okuyor, komut çalıştırıyor, hatayı görüp tekrar deniyor; bunların her biri ayrı bir istek. Orta boy bir görev rahatlıkla 20 ile 40 istek harcıyor. Yani günde 50 istek, pratikte günde bir ya da iki görev demek.
Açık kaynak olması indirebilirsin demek değil
Ağırlıklar gerçekten herkese açık, istersen şu an indirebilirsin. Sorun indirmek değil, çalıştırmak. NVIDIA'nın yayınladığı hâli yaklaşık 1,1 TB tutuyor ve model kartında yazan asgari donanım 8 adet H200 ya da 16 adet H100. Sıkıştırılmış sürümler bunu düşürüyor ama yeterince düşürmüyor.
Sıkıştırsan bile
Sürüm
Gereken bellek
Gerçekte ne demek
Yayınlanan hâli
yaklaşık 1,1 TB
8 adet H200 ya da 16 adet H100
8 bit
yaklaşık 600 GB
sunucu sınıfı makine
4 bit
yaklaşık 300 GB
hâlâ ev bilgisayarı değil
3 bit
yaklaşık 256 GB
boyut ve kalite dengesinin en iyi olduğu nokta
Sonuç şu: bu modeli kullanacaksan bulut üzerinden kullanacaksın. Aşağıdaki iki kurulum da bunu yapıyor. İndirme yolu, elinde sunucu varsa anlamlı.
Birinci yol: OpenCode ve OpenRouter
OpenCode terminalde çalışan açık kaynak bir kodlama ajanı. MIT lisanslı ve modeli sen seçiyorsun, aracın kendisi hangi modeli kullandığına karışmıyor. Kurulumu tek komut.
OpenCode kurulumu
# macOS ve Linux
curl -fsSL https://opencode.ai/install | bash
# Windows
scoop install opencode
# ya da her yerde, Node kuruluysa
npm install -g opencode-ai
Buradan sonrası
1
OpenRouter anahtarını al
Hesap aç, anahtar üret. Anahtar sk-or-v1 ile başlıyor
2
Proje klasöründe opencode yaz
Araç açılıyor, komutları buradan veriyorsun
3
/connect komutunu çalıştır
Listeden OpenRouter'ı seç ve anahtarı yapıştır
4
Modeli seç
/models ile listeden, ya da ayar dosyasına yazarak
Bu adımda ücretsizden çıkman çok kolay
/connect komutunu çalıştırdığında listenin başında OpenCode Zen duruyor ve aracın kendi önerdiği seçenek o. Zen ücretsiz değil, kart bilgisi istiyor ve istek başına ücretlendiriyor. Kullanmak zorunda değilsin, aracın dokümanı da bunun isteğe bağlı olduğunu yazıyor. Ücretsiz kalmak için listede aşağı inip OpenRouter'ı seçeceksin.
Model listesinde Nemotron 3 Ultra'nın ücretsiz sürümünü göremezsen ya da her açılışta seçmekle uğraşmak istemezsen, ayar dosyasına yazıp sabitleyebilirsin. Dosya ya proje klasörünün kökünde opencode.json olur ya da kullanıcı klasöründeki .config/opencode/opencode.json olur; ikincisi bütün projeler için geçerli.
OpenRouter'ı hiç aradan çıkarıp doğrudan NVIDIA'ya bağlanabilirsin. Hesap açmak ücretsiz ve kart istemiyor, anahtarın nvapi ile başlıyor. OpenCode bunu hazır tanımıyor, sağlayıcıyı kendin tanıtman gerekiyor; bunun için OpenAI uyumlu sağlayıcı kalıbı kullanılıyor.
Buradaki "nim" adı serbest, sen koyuyorsun. Sağlayıcıya "nvidia" adını verirsen model adresi nvidia/nvidia/nemotron-3-ultra-550b-a55b gibi iki kere nvidia yazan bir şeye dönüşüyor ve bu karışıklık yaratıyor, o yüzden kısa bir ad daha rahat. Anahtarı dosyaya yazmak yerine ortam değişkeninden okutuyoruz; kullandığın değişken adı neyse süslü parantezin içindeki de o olmalı.
Bu yol yayına çıkmak için değil
NVIDIA ücretsiz erişimin geliştirme, test ve araştırma için olduğunu kendi dokümanında açıkça yazıyor. Dakikada 40 istek sınırı var ve bunu kendi kendine yükseltebileceğin bir düğme yok. Kendi geliştirmende kullan, müşteriye giden bir ürünün arkasına koyma.
✓560 milyar parametre. Kimi K3 2,78 trilyonla beş kat büyük ve o da açık
✗Claude'dan bile daha iyi
✓NVIDIA bunu iddia etmiyor. Kendi iddiası açık modellere göre 6 kata kadar hız, benzer doğrulukla
✗Tamamen ücretsiz, istediğin kadar kullan
✓Ücretsiz uç noktada günde 50 istek var. Bir kerelik 10 dolarla 1.000'e çıkıyor
✗Açık kaynak, indir ve kendi bilgisayarında çalıştır
✓En küçük kullanılabilir sıkıştırması bile 256 GB bellek istiyor
✗OpenCode'u kur, çıkan ekranda ilerle
✓İlk bağlan ekranı seni ücretli servise götürüyor. Listeden OpenRouter'ı seçeceksin
✗Ücretli sürüm her açıdan daha iyidir
✓Ücretsiz uç nokta 1 milyon token bağlam veriyor, ücretli olan 262 bin
✗Bu, Claude Code'un yerine geçer
✓Ücretsiz olan model, ajan değil. OpenCode ayrı bir araç ve alışkanlıkların birebir taşınmıyor
Son madde üstünde biraz durmak gerekiyor, çünkü bu videoların çoğu oradan başlıyor. Ücretsiz hâle gelen şey model. Ajanı, yani terminalde seninle konuşan ve dosyalarına dokunan katmanı değiştiriyorsun. Aynı soruyu Claude Code arayüzünü koruyarak çözen başka bir yol daha var, arşivde 110 numarada duruyor. Hangisini seçeceğin şuna bağlı: arayüzü mü tutmak istiyorsun, yoksa modeli mi.
01
OpenCode
Terminalde çalışan açık kaynak kodlama ajanı. Modeli sen seçiyorsun, araç kabuk olarak duruyor. MIT lisanslı, 206.824 yıldız almış ve bugün güncellenmiş.
Kurulum
npm install -g opencode-ai
# ya da: curl -fsSL https://opencode.ai/install | bash
İlk açılışta /connect ekranı seni ücretli servise yönlendiriyor. Ücretsiz kalmak için listeden OpenRouter'ı seçeceksin.
Dakikada 20, günde 50 istek. Hesabına bir kerelik 10 dolarlık kredi yüklersen günlük hak 1.000'e çıkıyor ve o 10 dolar duruyor, ücretsiz istekler onu harcamıyor.
Aradaki servisi çıkarıp doğrudan NVIDIA'ya bağlanma yolu. Hesap ücretsiz, kart istemiyor, anahtar nvapi ile başlıyor. OpenAI uyumlu olduğu için adres değiştirmek yetiyor.
Dakikada 40 istek sınırı var ve NVIDIA ücretsiz erişimin geliştirme, test ve araştırma için olduğunu açıkça yazıyor. Yayına çıkan bir ürünün arkasına koyma.
İndirip kendi donanımında çalıştırmak istersen ağırlıklar açık ve lisans ticari kullanıma izin veriyor. Sıkıştırılmış sürümler ayrı bir yerde duruyor.
Yayınlanan hâli yaklaşık 1,1 TB, model kartındaki asgari donanım 8 adet H200 ya da 16 adet H100. Sıkıştırılmış sürümlerde bile 3 bit için yaklaşık 256 GB bellek gerekiyor.
Buradaki araçları tek başına kurmak bir şey, onlarla gerçekten üretmeye başlamak başka bir şey. Toplulukta hem bu araçları günlük kullananlar var hem de sıfırdan sistem kuranlar.
DOA: Yapay Zeka ve Otomasyon
İşinde gerçekten çalışan bir sistem kurmak istiyorsan 10 dakika konuşalım; ne yapmaya çalıştığına bakıp sana uygun yolu söyleyeyim. Ücretsiz, satış konuşması değil.