Feat/two node endpoints #51

Merged

hyungi merged 3 commits from feat/two-node-endpoints into main

2026-07-02 14:31:28 +09:00

Author	SHA1	Message	Date
hyungi	d53fcc2b36	feat(search): MAX_RERANK_INPUT env 조정 가능화 — 2노드 리랭크 지연 대응 맥미니 llama.cpp 리랭크는 후보 수 선형(실측 50=0.60s/200=1.89s) — NAS 배포에서 MAX_RERANK_INPUT=50 으로 tail 지연 축소. 기본 200 = 현행 무회귀. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>	2026-07-02 13:30:04 +09:00
hyungi	43594620b1	fix(tests): rerank fixture 경로 정정 — captured_responses.*.raw 가 실응답 리스트 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>	2026-07-02 13:11:33 +09:00
hyungi	b73a5cc601	feat(infra): 2노드 이관 P1-4 — rerank 프로토콜 스위치(tei\|llamacpp)·OCR/STT 명시 게이트·413 재홈 - AIModelConfig.protocol 판별자 신설(기본 tei = 무회귀), llamacpp = /v1/rerank 요청·응답 스키마 정규화(ai/rerank_protocol.py 순수함수 + 단위테스트 4) - OCR_ENABLED/STT_ENABLED 명시 게이트 — GPU CUDA 서비스(Surya/faster-whisper) 폐기 대응, silent 아님(경고 로그 + extract_meta 터미널 기록) - DS Caddyfile request_body 100MB — 413 정책을 edge(home-caddy)에서 내부로 재홈 (DSM 리버스 프록시 전환 대비, upload.max_bytes 정합) - SSE X-Accel-Buffering는 기점검 결과 기구현(eid_chat)이라 무변경 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>	2026-07-02 13:11:06 +09:00

Author

SHA1

Message

Date

hyungi

d53fcc2b36

feat(search): MAX_RERANK_INPUT env 조정 가능화 — 2노드 리랭크 지연 대응

맥미니 llama.cpp 리랭크는 후보 수 선형(실측 50=0.60s/200=1.89s) — NAS 배포에서
MAX_RERANK_INPUT=50 으로 tail 지연 축소. 기본 200 = 현행 무회귀.

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>

2026-07-02 13:30:04 +09:00

hyungi

43594620b1

fix(tests): rerank fixture 경로 정정 — captured_responses.*.raw 가 실응답 리스트

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>

2026-07-02 13:11:33 +09:00

hyungi

b73a5cc601

feat(infra): 2노드 이관 P1-4 — rerank 프로토콜 스위치(tei|llamacpp)·OCR/STT 명시 게이트·413 재홈

- AIModelConfig.protocol 판별자 신설(기본 tei = 무회귀), llamacpp = /v1/rerank
  요청·응답 스키마 정규화(ai/rerank_protocol.py 순수함수 + 단위테스트 4)
- OCR_ENABLED/STT_ENABLED 명시 게이트 — GPU CUDA 서비스(Surya/faster-whisper)
  폐기 대응, silent 아님(경고 로그 + extract_meta 터미널 기록)
- DS Caddyfile request_body 100MB — 413 정책을 edge(home-caddy)에서 내부로 재홈
  (DSM 리버스 프록시 전환 대비, upload.max_bytes 정합)
- SSE X-Accel-Buffering는 기점검 결과 기구현(eid_chat)이라 무변경

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>

2026-07-02 13:11:06 +09:00

Feat/two node endpoints #51

3 Commits