Skip to content

Add GPU embedding preflight and tuning - #4

Open
CompleteDotTech wants to merge 2 commits into
feat/local-qwen3-embeddingsfrom
feat/local-qwen3-embeddings-gpu
Open

CompleteDotTech wants to merge 2 commits into
feat/local-qwen3-embeddingsfrom
feat/local-qwen3-embeddings-gpu

Conversation

@CompleteDotTech

@CompleteDotTech CompleteDotTech commented Sep 3, 2026

Copy link
Copy Markdown

Stacked on #3. Moves the GPU Qwen3 services into the dedicated docker-compose-local-embeddings-gpu.yaml include, adds independent QWEN3_GPU_* tuning variables, and adds a host NVIDIA preflight command before GPU startup. Validation: Python compile, Ruff format/check, and fail-closed behavior on a host without nvidia-smi.

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant