Chcete testovat a zkoumat? Aniž byste platili kupu peněz za slušné cloudové AI modely? NVIDIA má NIM (NVIDIA Inference Microservices). S klasickým API a 80+ modely.
Je tam omezení na to, že to je na testování a vývoj, ne pro produkci. A pochopitelně tam jsou limity, kolik dotazů za minutu můžete poslat (běžně 40 za minutu, ale může to být podle modelu a měnit se). Není tam žádná platební karta, není to časově omezené.

Jak to získat?
- jděte na build.nvidia.com/models a přihlaste se NVIDIA účtem.
- Nechte to vytvořit “NVIDIA Cloud Account”
- Po návratu zpět narazíte na “Please contact support to verify your account.”, řešitelné jedině tak, že prostě opravdu napíšete na předložený e-mail, uveďte, kdo jste, odkud jste, přidejte kontakty.
- Získejte API klíč z Dashboardu.
- A pak už můžete jet, je to OpenAI API kompatibilní.
- Endpoint je https://integrate.api.nvidia.com/v1.
Poté, co vám NVIDIA schválí přístup (bylo to poměrně rychlé), tak si prostě najdete model, co chcete testovat, a otevřete si jeho detail.
Modely jsou tam rozdělené do kategorií: vás zajímají hlavně modely se štítkem „Free Endpoint“ (nespotřebovávají kredity, opravdu zdarma). Mimo to jsou tam partnerské modely, ale i stáhnutelné modely.

Najdete tam možnost Playground, kde ho můžete přímo testovat v klasickém “chatu”. A v BuildI, tam co je vidět Python zdroják ie Generate API key – to vám do zdrojáku hodí API klíč, co můžete začít používat (jeden klíč pro libovolné modely).
TIP: AI přes API zadara? Ale jo, na zkoumání a zkoušení to jde, na produkci ale spíš ne
API klíče jsou jinak v profilu (kolečko vpravo nahoře -> API Keys). Tam si můžete generovat nové klíče, pokud chcete nějak oddělovat využití – navíc tady je možné je i pojmenovat, takže budete vědět “účel”. Je jich možné mít víc.

A pozor, mají expiraci (při zakládání si můžete volit od hodin až po 12 měsíců) a v přehledu už nejsou vidět kompletní hodnoty klíčů – to si ohlídejte při vytváření. Klíč je tam také možné smazat/zneplatnit.
Ten Python, co tam je, se může hodit také pro vyzkoušení, ale najdete tam i nějaké možné parametry, které ten model má. Podrobněji v API Reference (vpravo nahoře). Což může být dost důležité – Reasoning modely na NIM používají nestandardní parametry.
Přímo na té kartě jsou i základní důležité parametry modelu – modality, schopnost volat funkce, atd.

Modely užití
- Srovnání modelů před placením – vyzkoušet si DeepSeek vs. Qwen vs. GLM na svém úkolu a teprve pak se rozhodnout, za co platit.
- Prototyp aplikace proti OpenAI-kompatibilnímu endpointu – prototypování je to zdarma, produkčně jen přepnout providera.
- Zdarma backend pro coding agenty (Cline, Aider, Continue) – routovat přes NIM místo placeného Claude/GPT.
- Překlady a vícejazyčný obsah – vícejazyčné modely zvládají i češtinu.
- Vision / RAG / embedding – v katalogu jsou i VLM a embedding modely, ne jen chat.
Které modely jsou nejlepší (aktuálně, z „Free Endpoint“ nabídky)
Podle aktuálního katalogu a žebříčků z léta 2026, po kategoriích:
- Kódování a agentní úlohy: GLM-4.7 (Z.ai) – vícejazyčný agentní coding partner s tool callingem, a Devstral 2 123B od Mistralu (code model s 256k kontextem). Pozor – u GLM-4.7 se objevila deprecation poznámka, případně Kimi K2.6 (Moonshot) nebo ještě MiniMax M2.x. Okrajově jde zkoušet DeepSeek V3.2
- Reasoning /
univerzál: DeepSeek V3.2 – 685B reasoning model se sparse attention, dlouhým kontextem a agentními nástroji. Silná default volba. - Obecné použití + multimodalita: Mistral Large 3 675B – univerzální MoE VLM pro chat, agentní a instrukční úlohy.
- Dlouhý kontext: Llama 4 Scout (až 10M tokenů).
Obecně platí, že v roce 2026 vedou čínské open-weight modely – v žebříčcích jsou nahoře DeepSeek V4 Pro, Kimi K2.6, GLM-5.1 a Qwen. Katalog NIM se ale mění týden co týden, pozor..
