High-tech server room with dark racks and blue LED indicator
Deployment Guide

Lokálna inštalácia modelov

Úplná kontrola nad infraštruktúrou AI. Eliminujte závislosť od tretích strán a zabezpečte svoje dáta v uzavretom prostredí.

Technické parametre

Dátová suverenita

Pri lokálnom spustení LLM (Large Language Models) žiadne informácie neopúšťajú vašu lokálnu sieť. Toto je kritické pre firmy pracujúce s citlivými údajmi podľa AI Act legislatívy.

Nulová latencia

Odozva modelu závisí výhradne od vášho hardvéru, nie od vyťaženia serverov OpenAI alebo Anthropic. Získavate predvídateľný výkon bez ohľadu na stav internetového pripojenia.

Bez prevádzkových nákladov

Zabudnite na mesačné predplatné za API volania. Po počiatočnej investícii do hardvéru sú náklady na generovanie textu alebo kódu prakticky nulové, obmedzené len spotrebou elektriny.

Hardvérové požiadavky

Spustenie moderných modelov ako Llama 3 alebo Mistral vyžaduje špecifické zdroje. Najdôležitejším komponentom je video pamäť (VRAM). Pre plynulý chod 7B a 8B modelov v 4-bitovej kvantizácii je nevyhnutným minimom 8 GB VRAM.

  • GPU: NVIDIA RTX 3060 a vyššie (kvôli CUDA jadrám) alebo Apple Silicon (M1/M2/M3).
  • RAM: Minimálne 16 GB pre systém, ideálne 32 GB pri zdieľanej pamäti na Macu.
  • Disk: NVMe SSD s kapacitou aspoň 50 GB pre ukladanie modelov a váh.

Viac o správe zdrojov sa dozviete v sekcii AI v podnikovej sieti.

Close up of a powerful PC workstation interior, high-end GPU

Sprievodca inštaláciou: Ollama

1. Stiahnutie a inštalácia binárnych súborov

Navštívte oficiálnu stránku a stiahnite si inštalátor pre váš operačný systém (macOS, Linux alebo Windows Preview). Proces je automatizovaný a nevyžaduje konfiguráciu premenných prostredia.

2. Stiahnutie modelu (Pull)

Otvorte terminál a zadajte príkaz ollama run llama3. Systém automaticky stiahne váhy modelu z registra. Tento krok môže trvať niekoľko minút v závislosti od rýchlosti vášho pripojenia.

3. Konfigurácia lokálneho rozhrania

Pre pohodlnú prácu odporúčame nainštalovať Open WebUI. Toto rozhranie beží v Docker kontajneri a poskytuje prostredie podobné ChatGPT, avšak plne pod vašou správou. Skontrolujte tiež metódy anonymizácie vstupov pred prvým spustením.

Pripravení na prechod?

Lokálna inštalácia je len prvým krokom k bezpečnej umelej inteligencii. Pozrite si náš zoznam odporúčaných nástrojov pre ďalšiu optimalizáciu.

Právne upozornenie

Obsah publikovaný na tejto stránke predstavuje súhrn verejne dostupných informácií, priemyselných výskumov a vzdelávacích materiálov. Tieto texty majú výhradne referenčný charakter a v žiadnom prípade sa nepovažujú za profesionálne finančné alebo investičné odporúčania. Inštalácia softvéru a manipulácia s hardvérom by mali byť vykonávané v súlade s technickou dokumentáciou výrobcov.