Praktičan primer od A do Š: AI asistent za sopstveni server
Trideset tekstova iza nas pokrilo je delove. Ovaj ih sklapa u jednu postavku koja radi — od prazne mašine do asistenta koji ujutru pošalje izveštaj, a preko dana odgovara na pitanja o tvojoj dokumentaciji. Sve je namerno svedeno na ono što jedan čovek može da održava. Nema Kubernetesa, nema agenata, nema fine-tuninga. Šta gradimo Server: 1 × RTX 3090 (24 GB), Debian 13 ┌─────────────────────────────────────────────┐ │ Nginx :443 — TLS, ključevi, ograničenja │ └──────┬───────────────────────┬──────────────┘ │ │ Open WebUI :3000 API /api/ │ │ └───────┬───────────────┘ │ Ollama :11434 qwen3:27b-q4_K_M │ ┌───────┴────────┐ │ │ Qdrant :6333 Prometheus :9090 dokumentacija + Grafana Alatke: zasto, pitaj, pitaj-doks Cron: noćni izveštaj, osvežavanje RAG-a, kopije Odluka Zašto Ollama, ne vLLM ...