brief · wiki/brief-chemical-llama-cpp-runbook.md
Brief — chemical llama.cpp local runbook
호스트 llama-server `:11434/v1` ↔ Docker simulation `CPP_LLAMA_URL` OpenAI 호환 연결.
corpusprojectlayersourcetypebriefdomainbackendsprojectchemicalstatusactiveupdated2026-07-18originowned
raw:
raw/imports/2026-07-18-chemical-llama-cpp-local-runbook.mdBrief — chemical llama.cpp local runbook
한 줄: 호스트 llama-server :11434/v1 ↔ Docker simulation CPP_LLAMA_URL OpenAI 호환 연결.
핵심 takeaway
- LLM을 컨테이너에 넣지 않고 host-native 권장.
- 기본 모델 alias
exaone3.5:7.8b, compose는host.docker.internal:11434. - timeout 자체는 simulation config
llm_request_timeout_seconds가 적용 (runbook은 연결 방법).