Skip to content

feat: 지식 VLM 모델을 gemini-3.5-flash-lite 로 교체

변재혁 requested to merge feature/vlm-model-gemini-3.5-flash-lite into develop

gemini-2.5-flash 가 2026-10-16(Gemini API) / 2026-10-20(Vertex) 은퇴 예정이라 기본 VLM 모델을 gemini-3.5-flash-lite 로 옮긴다.

  • model_resolver 카탈로그에 gemini-3.5-flash-lite 엔트리 추가 (단가는 Google 공시가 $0.30/$2.50 per 1M, 캐시 입력 $0.03)
  • gemini-2.5-flash 엔트리는 은퇴일까지 env 롤백 경로로 유지
  • env_model 기본값, config_{local,dev,stg,prod}.yml, .env.example 갱신
  • 임베딩(gemini-embedding-001)은 은퇴일이 2028년이라 변경 없음

단가는 2.5-flash 와 동일($0.30/$2.50)해서 비용 증가는 없다. Flash-Lite 는 minimal thinking 이 기본이라 출력 토큰·지연이 줄어들 여지가 있다.

model_id 는 ai_model 카탈로그 발급 전 임시값(...551)이며, 현재 런타임에서 소비되지 않아 동작 영향은 없다. 배포 전 실제 값으로 교체 필요.

Co-Authored-By: Claude Opus 5 (1M context) noreply@anthropic.com

Merge request reports