Martin Gočik

Claude Code zadarmo: spusti ho na vlastnom modeli cez Ollama

Claude Code môžeš používať aj bez predplatného, s AI modelom, ktorý beží priamo u teba v počítači. Návod na päť krokov.

🛠️ Návod krok za krokom💻 Príkazy na skopírovanie
Obsah je zamknutý

Vyplň meno a email a hneď sa ti tu zobrazí celý návod.

Claude Code nemusí bežať len na modeloch od Anthropicu. Cez Ollama ho pripojíš na otvorený model, ktorý beží priamo u teba v počítači. Neplatíš predplatné, nemíňaš limity a tvoje dáta neodchádzajú von.

Ako to funguje

Ollama je bezplatná appka, ktorá spúšťa AI modely lokálne. Od verzie 0.14.0 hovorí rovnakým jazykom ako Claude API, takže Claude Code s ňou funguje bez úprav. Je open source (licencia MIT) a na GitHube má vyše 180 tisíc hviezd.

Návod krok za krokom

  1. Nainštaluj Claude Code, ak ho ešte nemáš. Na Macu a Linuxe v termináli:

    curl -fsSL https://claude.ai/install.sh | bash
    

    Na Windowse v PowerShelli:

    irm https://claude.ai/install.ps1 | iex
    
  2. Stiahni Ollama z ollama.com/download a nainštaluj ju. Verziu si overíš príkazom ollama -v, potrebuješ aspoň 0.14.0.

  3. Stiahni model. Ollama pre Claude Code odporúča napríklad gpt-oss (asi 14 GB):

    ollama pull gpt-oss:20b
    

    alebo Qwen3 Coder (asi 19 GB):

    ollama pull qwen3-coder
    
  4. Zvýš kontext aspoň na 64 tisíc tokenov. Na bežnom počítači má lokálny model predvolene len 4 tisíc a v Claude Code by rýchlo zabúdal. V appke Ollama to nastavíš posuvníkom v nastaveniach. Na Macu a Linuxe môžeš server spustiť aj takto:

    OLLAMA_CONTEXT_LENGTH=64000 ollama serve
    

    Či sa nastavenie chytilo, uvidíš cez ollama ps.

  5. Spusti Claude Code cez Ollama:

    ollama launch claude
    

    Z ponuky si vyberieš model a Claude Code ti beží na ňom. Model môžeš zadať aj rovno: ollama launch claude --model gpt-oss:20b

Na čo si dať pozor

  • Lokálny model nie je Opus. Na menšie úlohy, skúšanie a učenie stačí. Na veľký projekt si nechaj normálny Claude.
  • Potrebuješ slušný počítač. Model sa musí zmestiť do pamäte grafiky a väčší kontext pamäť ešte zvyšuje.
  • V ponuke uvidíš aj modely s koncovkou :cloud. Tie nebežia u teba, ale na serveroch Ollama. Ak chceš všetko lokálne, vyber model bez tejto koncovky.

Prečo to stojí za to

Ollama píše, že keď model beží lokálne, tvoje prompty ani dáta nevidí. A na vlastnom hardvéri je to podľa nich vždy bez limitu. Skúšanie a menšie úlohy tak máš zadarmo a limity predplatného si šetríš na veľkú prácu.

Zdroje: Ollama blog: Claude Code, dokumentácia Ollama pre Claude Code