Project Nomad: Znalosti, ktoré nikdy nejdú offline

V dobe, keď takmer každý AI nástroj vyžaduje internetové pripojenie a cloudový účet, prichádza Project Nomad s radikálne odlišným prístupom: kompletná znalostná platforma, ktorá funguje úplne offline. Žiadne API kľúče, žiadne predplatné, žiadna závislosť na cloudových službách.

Rok 2026 priniesol paradox: AI je výkonnejšia než kedykoľvek predtým, no zároveň čoraz viac uzamknutá za prihlasovacie brány a mesačné poplatky. Project Nomad stojí oproti tomuto trendu — nie ako protest, ale ako pragmatická alternatíva pre situácie, kde cloud jednoducho nefunguje alebo nie je vhodný.


1. Problém: Závislosť na cloude

Moderné AI nástroje majú spoločný problém — sú závislé na internetovom pripojení a externej infraštruktúre:

  • ChatGPT, Claude, Gemini — bez internetu nefungujú, bez účtu ani nepustia
  • Notion AI, Copilot — vyžadujú cloudovú synchronizáciu a ekosystémovú väzbu
  • Perplexity, SearchGPT — hľadanie bez internetu? Nemožné zo svojej podstaty

To vytvára niekoľko praktických problémov, ktoré sa v roku 2026 stali ešte aktuálnejšími:

  1. Dostupnosť — internet nie je všade spoľahlivý (lietadlá, vzdialené oblasti, krajiny s cenzúrou alebo výpadkami)
  2. Súkromie — každý dotaz putuje na servery tretej strany a prispieva k tréningovým dátam
  3. Náklady — predplatné sa kopia; pre inštitúcie v rozvojových krajinách sú API kredity nedostupné
  4. Závislosť — ak služba zdraží, zmení podmienky alebo jednoducho skrachuje, strácate prístup zo dňa na deň
  5. Regulácia — v mnohých odvetviach (zdravotníctvo, právo, štátna správa) je posielanie citlivých dát cez tretie strany právne problematické

2. Čo je Project Nomad

Project Nomad je open-source platforma, ktorá kombinuje štyri kľúčové komponenty do jedného integrovaného systému:

  • Lokálne AI modely — malé, ale schopné jazykové modely bežiace priamo na vašom zariadení bez GPU
  • Offline znalostná báza — komprimované a indexované encyklopedické údaje z dôveryhodných zdrojov
  • Vektorový search — sémantické vyhľadávanie bez internetu, fungujúce na úrovni porovnateľnej s cloudovými riešeniami
  • Modulárna architektúra — pridávajte znalostné balíčky podľa aktuálnej potreby, bez nutnosti sťahovať všetko naraz

Celý systém beží na bežnom notebooku alebo dokonca na výkonnejšom telefóne. Nepotrebuje GPU — využíva kvantizované modely optimalizované pre CPU inference, pričom v roku 2026 mnohé zariadenia disponujú aj dedikovanými NPU čipmi, ktoré Nomad vie využiť.

Projekt vznikol ako open-source iniciatíva a zostáva ním — zdrojový kód je dostupný na GitHube, komunita prispieva novými balíčkami a opravami.


3. Ako to funguje technicky

Znalostné balíčky

Project Nomad organizuje informácie do „knowledge packs" — komprimovaných balíčkov s predspracovanými dátami a embeddingami. Príklady dostupných balíčkov (veľkosti sú orientačné pri 4-bit kvantizácii embeddingov):

  • Základný balíček (~2 GB) — všeobecné znalosti, definície, fakty zo Wikipedie a Wikidata
  • Medicínsky balíček (~5 GB) — lekárske encyklopédie, liekové databázy, diagnostické postupy, MedlinePlus
  • Právny balíček (~3 GB) — legislatíva viacerých krajín, judikáty, právne pojmy a komentáre
  • Technický balíček (~4 GB) — programátorská dokumentácia, tutoriály, Stack Overflow snapshot, API referencie
  • Vedecký balíček (~6 GB) — open-access vedecké publikácie, abstrakty z PubMedu, fyzikálne a chemické tabuľky

Balíčky sa sťahujú raz a potom fungujú úplne offline. Aktualizácie sú inkrementálne — keď sa zariadenie pripojí k internetu, stiahne len zmenené časti od poslednej synchronizácie.

Lokálny AI model

V roku 2026 je situácia výrazne priaznivejšia než pred tromi rokmi: modely ako Phi-4 Mini, Gemma 3 2B alebo Llama 4 Scout dosahujú pri bežných informačných úlohách kvalitu, ktorá bola pred pár rokmi dostupná len cez API. Nomad podporuje celú rodinu GGUF modelov a automaticky vyberie vhodný variant podľa dostupného hardvéru.

Modely sú optimalizované pre:

  • Otázky a odpovede nad znalostnou bázou — hlavný prípad použitia
  • Sumarizáciu dlhých textov na zariadení
  • Vyhľadávanie pomocou sémantickej podobnosti
  • Preklad základných fráz a termínov

Nie je to cloudový frontier model — ale pre väčšinu informačných potrieb je to plne dostatočné.

Vektorový index a RAG pipeline

Každý znalostný balíček obsahuje predpočítané vektorové embeddingy. Keď položíte otázku, Nomad:

  1. Prevedie otázku na vektor pomocou lokálneho embedding modelu
  2. Prehľadá index a nájde najrelevantnejšie pasáže v znalostnej báze (top-K retrieval)
  3. Poskytne tieto pasáže AI modelu ako kontext (augmented prompt)
  4. Model vygeneruje odpoveď s citáciami na zdrojové dokumenty

Toto je lokálny RAG (Retrieval-Augmented Generation) — rovnaká architektúra, akú používajú cloudové služby ako Perplexity, ale bežiaca kompletne na vašom zariadení. Výhodou je, že model nemusí „vedieť" odpoveď zo tréningovej fázy — stačí ju nájsť v znalostnej báze a parafrázovať.


4. Pre koho je Nomad určený

Humanitárni pracovníci a zdravotníci v teréne

V krízových oblastiach bez spoľahlivého internetu môže offline znalostná báza s medicínskymi informáciami doslova zachraňovať životy. Lekár bez nemocničného zázemia môže konzultovať liečebné postupy, liekové interakcie alebo triage protokoly — bez nutnosti pripojenia. Organizácie ako Lekári bez hraníc aktívne testujú podobné riešenia pre terénne nasadenie.

Novinári a výskumníci v obmedzenom prostredí

V krajinách s internetovou cenzúrou poskytuje Nomad prístup k necenzurovaným informáciám bez rizika sledovania sieťovej prevádzky. Lokálny model negeneruje žiaden odchodzí sieťový tok — všetko sa deje na zariadení.

Vývojári a technickí pracovníci

Programátori pracujúci bez stabilného pripojenia — na vlakoch, v lietadlách, na odľahlých serverovniach — majú okamžitý prístup k dokumentácii, príkladom kódu a technickým referenciám. Technický balíček obsahuje snapshoty dokumentácie pre stovky populárnych knižníc a frameworkov.

Vzdelávacie inštitúcie v oblastiach so slabou konektivitou

V oblastiach s obmedzeným alebo drahým internetom umožňuje Nomad školám nasadiť plnohodnotnú vzdelávaciu platformu za cenu jednorazového stiahnutia a bežného hardvéru. Jeden server v škole môže obsluhovať celú triedu cez lokálnu sieť.

Firemné a inštitucionálne použitie

Pre odvetvia s prísnymi požiadavkami na ochranu dát (zdravotníctvo, právo, financie) je lokálne spracovanie nie len výhodou, ale často aj regulatórnou nutnosťou. Nomad umožňuje nasadiť AI-asistovaný prístup k interným dokumentom bez toho, aby citlivé dáta opustili intranet.


5. Súkromie a bezpečnosť: Čo Nomad nezdieľa

Toto je jeden z najdôležitejších aspektov platformy, ktorý si zaslúži vlastnú sekciu.

Keď používate cloudovú AI službu, vaše dotazy sú typicky:

  • Uložené na serveroch poskytovateľa (aj keď dočasne)
  • Potenciálne použité na ďalší tréning modelov
  • Dostupné správcom systému a podliehajú právnym predpisom krajiny prevádzkovateľa
  • Prepojené s vaším účtom a históriou používania

Project Nomad negeneruje žiadny odchodzí sieťový tok počas inference. Dotaz, kontext a odpoveď zostávajú výlučne na zariadení. Ak zariadenie nie je pripojené k internetu, nie je technicky možné, aby akékoľvek dáta unikli.

Inkrementálne aktualizácie balíčkov síce vyžadujú pripojenie, ale sú jednosmerné sťahovania — server nevie, čo používateľ hľadal, len to, že si stiahol update balíčka X.

Pre paranoidných používateľov existuje aj možnosť úplne air-gapped nasadenia: raz stiahnutý systém funguje indefinitívne bez akéhokoľvek internetového prístupu. Jediná nevýhoda je zastarávanosť znalostnej bázy — čo je pre mnohé použitia (historické fakty, medicínske protokoly, právne definície) akceptovateľné.


6. Porovnanie s alternatívami

Vlastnosť Project Nomad Kiwix (offline Wiki) Ollama (lokálne LLM) Jan / LM Studio
AI odpovede nad KB ❌ bez KB ❌ bez KB
Štruktúrovaná knowledge base
Modulárne balíčky
Sémantický search
Mobilné zariadenia Obmedzene
Lokálny RAG out-of-box Čiastočne
Open-source Čiastočne
Inkrementálne aktualizácie KB
Bez GPU Obmedzene Obmedzene

Nomad je v podstate konvergencia Kiwixu (offline encyklopédia) a Ollamy (lokálne LLM), spojená do jedného integrovaného systému s RAG pipeline. Kiwix to robí lepšie čo do šírky obsahu, Ollama to robí lepšie čo do flexibility modelov — Nomad ich kombinuje pre konkrétny use case: informačný prístup bez internetu.


7. Technické výzvy a ich riešenia

Aktuálnosť dát

Offline znalostná báza je zo svojej podstaty statická. Nomad to rieši systémom inkrementálnych aktualizácií — keď sa zariadenie pripojí k internetu, stiahne len zmeny od poslednej synchronizácie. Kritická otázka je frekvencia: medicínske odporúčania sa menia, legislatíva sa aktualizuje, technická dokumentácia zastarán. Nomad odporúča mesačné aktualizácie pre medicínsky a právny balíček, kvartalné pre ostatné.

Veľkosť modelov a úložisko

Aj malé AI modely zaberajú gigabajty — 3B model pri 4-bit kvantizácii zaberie okolo 2 GB. Na mobilných zariadeniach s obmedzeným úložiskom to môže byť problém. Nomad podporuje rôzne úrovne kvantizácie (2-bit až 8-bit) a umožňuje používať menšie modely (1B a menej) pre zariadenia s extrémnym obmedzením. V praxi stačí na plnohodnotné nasadenie zariadenie so 64 GB interného úložiska — čo je v roku 2026 bežný stredný segment.

Kvalita odpovedí

Lokálny 3B model nedosahuje kvalitu frontier cloudových modelov. Nomad to kompenzuje tým, že model primárne slúži ako rozhranie pre vyhľadávanie a sumarizáciu existujúcich textov, nie ako generátor nového obsahu. Pre väčšinu faktických otázok je rozdiel minimálny — model nemusí „vedieť" odpoveď, stačí ju nájsť v korpuse. Kde Nomad zaostáva je kreatívne písanie, komplexné uvažovanie a úlohy vyžadujúce aktuálne informácie.

Viacjazyčná podpora

Znalostné balíčky sú primárne v angličtine, no projekt aktívne buduje jazykové varianty. Slovenský a česky balíček je v beta fáze — pokrýva Wikipédiu v SK a CZ jazyku, legislatívu oboch krajín a základné vzdelávacie materiály.


8. Edge AI v roku 2026: Kde Nomad zapadá

Project Nomad nie je ojedinelý — zapadá do širšieho trendu „edge AI", kde sa výpočty presúvajú z cloudov bližšie k používateľovi. V roku 2026 je tento trend výrazne zreteľnejší:

  • Apple Intelligence — beží čiastočne na zariadení, čiastočne na Apple Private Cloud Compute; stále viazané na Apple ekosystém a iCloud
  • Google Gemini Nano — integrovaný do Androidu a Chrome, funguje offline pre základné úlohy, ale vyžaduje Google účet pre plnú funkčnosť
  • Microsoft Phi Silica — optimalizovaný pre Copilot+ PC s Qualcomm/Intel NPU; viazaný na Windows a Microsoft ekosystém
  • Samsung Galaxy AI — on-device AI pre vlajkové modely, ale opäť uzamknuté v ekosystéme výrobcu

Komerčné riešenia konvergujú k on-device spracovaniu, no stále vyžadujú ekosystémovú väzbu, účet a typicky odosielajú časť spracovania do cloudu. Nomad je plne nezávislý od akéhokoľvek ekosystému — beží rovnako na Windows, macOS, Linuxe a Androide, bez účtu, bez telemetrie.

Zároveň hardvérový pokrok robí Nomad praktickejším ako kedykoľvek predtým: Qualcomm Snapdragon X Elite, Apple M4, Intel Core Ultra 3 — všetky tieto čipy z rokov 2024–2025 majú dedikované NPU, ktoré Nomad využíva pre rýchlejšiu inference bez GPU.


9. Filozofia: Znalosti ako verejný statok

Za Project Nomad stojí jasná filozofická pozícia: prístup k znalostiam by nemal závisieť od internetového pripojenia, predplatného ani geopolitickej situácie. V dobe, keď sa čoraz viac informácií presúva za paywall a do cloudových služieb, Nomad predstavuje protiváhu — decentralizované, open-source riešenie prístupné každému.

Projekt sa inšpiruje tradíciou projektov ako Wikipedia, Project Gutenberg alebo Internet Archive: presvedčením, že základné ľudské znalosti musia zostať dostupné nezávisle na komerčných záujmoch alebo infraštruktúrnych rozhodnutiach tretích strán.

Toto nie je anti-cloudový postoj. Cloudové AI služby majú obrovské výhody — výkon, aktuálnosť, škálovateľnosť a schopnosť riešiť úlohy, na ktoré lokálny hardvér nestačí. Nomad je doplnok pre situácie, kde cloud nie je dostupný, nie je vhodný, alebo kde závislosť na ňom predstavuje riziko.


10. Ako začať

Nomad je dostupný ako:

  • Desktop aplikácia — pre Windows, macOS, Linux (Flatpak a AppImage)
  • CLI nástroj — pre pokročilých používateľov a serverové nasadenie
  • Android aplikácia — beta, pre zariadenia s min. 6 GB RAM
  • Docker kontajner — pre inštitucionálne nasadenie v lokálnej sieti

Odporúčaný postup pre nového používateľa:

  1. Stiahnuť Nomad z oficiálneho repozitára na GitHube
  2. Nainštalovať základný knowledge pack (~2 GB)
  3. Nechať Nomad automaticky vybrať vhodný model pre vaše zariadenie
  4. Otestovať na bežných dotazoch, potom doinštalovať špecializované balíčky podľa potreby

Prvé spustenie vrátane stiahnutia základného modelu a balíčka trvá 20–40 minút v závislosti od rýchlosti pripojenia. Následné spustenie trvá sekundy a nevyžaduje žiadne pripojenie.


Zhrnutie

Project Nomad v roku 2026 predstavuje zrelú odpoveď na rastúcu závislosť od cloudovej AI infraštruktúry. Kombinácia lokálnych jazykových modelov, modulárnych offline znalostných balíčkov a RAG pipeline vytvára systém, ktorý pre väčšinu informačných potrieb — definície, fakty, dokumentácia, medicínske a právne referencie — poskytuje porovnateľnú hodnotu ako cloudové alternatívy, no bez internetu, bez účtu a bez zdieľania dát.

Pre humanitárnych pracovníkov, novinárov, vývojárov, pedagógov a inštitúcie s regulatórnymi obmedzeniami to nie je len zaujímavý experiment — je to praktický nástroj. A v svete, kde prístup k informáciám zostáva pre mnohých podmienený konektivitou alebo peniazmi, je to nástroj s reálnym dosahom.