Mine põhisisu juurde

AI oma VPS-il: privaatsed mudelid ja agendid

AI ei pea elama kellegi teise pilves. Oma VPS-il jooksutad lokaalseid mudeleid, ehitad RAG-otsingu oma andmetel ja hoiad agendid tööl ööpäev läbi — täieliku root-kontrolliga ja Euroopa andmekeskuses. Vaatame, mida arendaja AI-serveriga päriselt teeb, mis on realistlik CPU-põhisel VPS-il ja kust leiad täpsed seadistusjuhendid.

Avaldatud
Diagramm: AI-töökoormused oma VPS-il — lokaalne LLM (Ollama), RAG-vektorandmebaas ja agentide orkestreerimine Tallinna serveris.

Miks AI oma serveris?

Kolm põhjust: privaatsus, kontroll ja etteennustatav kulu. Oma VPS-il jäävad andmed sinu serverisse Euroopas — dokumendid, vestlused ja embeddingud ei lähe välisele API-le. Sina otsustad, millised mudelid ja raamistikud paigaldad, ning maksad kindlat kuutasu, mitte token-põhist arvet.

Aus piir: väga suured mudelid ja treening vajavad dedikeeritud GPU-d. Meie VPS-id on CPU-põhised, seega sobivad nad väiksematele ja keskmistele kvantiseeritud mudelitele, RAG-torustikele ja API-põhiste agentide orkestreerimisele. See katab suure osa päris kasutusjuhtudest ilma GPU-arveta.

Lokaalsed mudelid: Ollama ja avatud LLM-id

Ollama teeb avatud mudelite jooksutamise lihtsaks: üks käsk laeb mudeli (Llama, Qwen, Gemma, Mistral, Phi) ja avab lokaalse API. Kvantiseeritud 3–8 miljardi parameetriga mudelid jooksevad mõistlikult CPU-l, kui RAM-i jagub — rusikareegel on mahutada mudel mällu ja jätta varu kontekstile.

RAM määrab, mida jõuad jooksutada. C-XS-i 2 GB sobib pigem API-põhistele töövoogudele; lokaalseks mudeliks ja RAG-iks vali suurem pakett (C-M kuni C-XXL, 8–32 GB). Alusta väiksema kvantiseeringuga, mõõda latentsust ja tõsta mudelit alles siis, kui vajadus on tõestatud.

RAG ja vektorandmebaas oma andmetel

RAG (retrieval-augmented generation) laseb mudelil vastata sinu enda dokumentide põhjal, ilma et andmed serverist lahkuksid. Töövoog: tükelda dokumendid, arvuta embeddingud, salvesta vektorandmebaasi (pgvector PostgreSQL-is või ChromaDB) ja otsi päringu ajal kõige lähedasemad lõigud mudelile kontekstiks.

See on VPS-i tugevaim AI-kasutusjuht: mõõdukas RAM, CPU-embeddingud ja privaatne andmebaas su enda kettal. Ettevõtte siseotsing, dokumentide Q&A või tugiteenus töötab nii täielikult sinu kontrolli all — ükski dokument ei jõua välisesse teenusesse.

Autonoomsed agendid ööpäev läbi

Agent, mis jookseb pidevalt, vajab masinat, mis ei maga. VPS hoiab agendi tööl (tmux või systemd), säilitab mälu ketta peal ja on kättesaadav ka siis, kui su sülearvuti on kinni. Agent võib kasutada lokaalset mudelit või API-d — VPS on orkestraator ja püsiv kodu.

Praktilised näited — Claude Code arenduseks, OpenClaw ja Hermes isiklikeks ning õppivateks assistentideks — ja täpsed samm-sammult seadistusjuhendid leiad meie AI-suunaliselt õdesaidilt aiserver.ee. Siin lehel hoiame fookuse serveril endal; aiserver.ee näitab, kuidas agendid VPS-ile püsti panna.

Virtuaal.com KVM VPS AI jaoks

Meie virtuaalserverid annavad AI-töövoole täieliku root-kontrolli, AMD EPYC riistvara ja NVMe SSD RAID salvestuse CITIC Telecomi andmekeskuses Tallinnas, meie AS205930 võrgus — andmed jäävad Eestisse. Vali pakett mudeli suuruse järgi: RAG ja keskmised mudelid tahavad rohkem RAM-i (C-M kuni C-XXL, kuni 32 GB).

Iga pakett sisaldab tasuta best-effort automaatvarundust (pole garanteeritud), täielikku root-ligipääsu ja VirtFusioni paneeli. Fikspaketid algavad C-XS-ist, aastamaksega alates 7,64 €/kuu. AI-agentide inspiratsiooni ja täpsed seadistusjuhendid → aiserver.ee.

Korduma kippuvad küsimused

Valmis oma virtuaalserverit käivitama?

Vaata KVM VPS-pakette — AMD EPYC, NVMe SSD RAID, täielik root-ligipääs ja VirtFusioni paneel. Serverid Tallinnas.

Vaata VPS-pakette