38 lines
1.5 KiB
Markdown
38 lines
1.5 KiB
Markdown
# Imagini Docker — LOT 1
|
|
|
|
Imagini de container pre-construite pentru o parte din modulele LOT 1, salvate cu
|
|
`docker save | gzip`. Se încarcă pe serverul țintă fără rebuild.
|
|
|
|
## Încărcare (pe serverul de inferență)
|
|
```bash
|
|
# pentru fiecare fișier:
|
|
gunzip -c <fisier>.tar.gz | docker load
|
|
# sau:
|
|
docker load < <fisier>.tar.gz
|
|
```
|
|
|
|
## Imagini incluse
|
|
| Fișier | Imagine | Modul |
|
|
|--------|---------|-------|
|
|
| extractors.tar.gz | extractors:0.1.0 | extractors |
|
|
| web.tar.gz | didiai-web-api:latest | web |
|
|
| forensic_features.tar.gz | forensic-features:latest | forensic_features |
|
|
| dashboard.tar.gz | didiai-dashboard:latest | dashboard |
|
|
| didi_brain-api.tar.gz | didibrain-api:latest | didi_brain (API) |
|
|
| didi_brain-scheduler.tar.gz | didibrain-scheduler:latest | didi_brain (scheduler) |
|
|
|
|
## Module care se CONSTRUIESC pe serverul GPU (din Dockerfile)
|
|
Nu sunt incluse ca imagini pre-construite — au baze grele (vLLM/GPU) și se
|
|
construiesc direct pe infrastructura cu accelerator:
|
|
|
|
- **llm-inference** (vLLM/Qwen3.5) — `ai_platform/modules/llm-inference/deploy/Dockerfile`
|
|
- **embeddings / rerank** (bge, backend vLLM/llama.cpp)
|
|
- **audio** (faster-whisper)
|
|
- **video-analysis** (BusterX/vLLM)
|
|
- **catalog-api**, **cloak**, **gateway** (nginx)
|
|
|
|
Construire: `cd ai_platform/modules/<modul>/deploy && ./deploy.sh up` (sau
|
|
`docker compose up -d --build`), cu `.env` completat din `.env.example`.
|
|
|
|
> Notă: imaginile pre-construite reflectă starea curentă a codului din livrabil.
|
|
> La modificări ulterioare, reconstruiește din Dockerfile.
|