ollama-gpu 백엔드의 models 배열에서 gemma4:e4b-it-q8_0 1 항목 제거.
bge-m3 embedding entry 는 보존 (ollama 컨테이너는 bge-m3 embedding owner).
PR #20 (2026-05-14) 이후 chat candidate 는 mlx-mac (priority 1) 단일 라
실제 호출은 이미 Mac mini 26B 로 가고 있었음 (silent drift). 이번 정리는
inventory consistency 목적.
검증:
- gpu-hub-api restart 후 Application startup complete + health 200
- backends.json.pre-llm-reframe-cleanup.20260515 백업 보존
plan: ~/.claude/plans/4-stateless-dongarra.md
OrbStack 라이선스 만료로 Mac mini Docker 서비스를 GPU 서버로 통합.
nginx → Caddy 전환, 12개 서브도메인 자동 HTTPS, fail2ban Caddy JSON 연동.
주요 변경:
- home-caddy: Caddy 리버스 프록시 (Let's Encrypt 자동 HTTPS)
- home-fail2ban: Caddy JSON 로그 기반 보안 모니터링
- home-ddns: Cloudflare DDNS (API 키 .env 분리)
- gpu-hub-api/web: AI 백엔드 라우터 + 웹 UI (gpu-services에서 이전)
- AI 런타임(Ollama) 내부망 전용, 외부는 gpu-hub 인증 게이트웨이 경유
Co-Authored-By: Claude Opus 4.6 (1M context) <noreply@anthropic.com>