Skip to content

feat: 지식 VLM thinking_level 기본값을 HIGH 로 승격하고 dev 임시설정 원복

변재혁 requested to merge feature/vlm-thinking-level-high into develop

2026-09-09 3자 실측 결과에 따라 전 환경 기본값을 HIGH 로 올린다. 같은 파일(다우오피스4.0 소개자료, VLM 발동 13페이지) 기준:

2.5-flash lite/minimal lite/HIGH
설명 생성 페이지 13 9 12
센티널 오염 1건 0 0
잡 전체 85.8초 15.7초 32.8초
문서 1건 비용 149원 20원 84원
  • minimal 은 텍스트 레이어가 깨진 페이지(7p 브랜드 타임라인)를 센티널로 포기해 커버리지가 9/13 에 그친다. 그 페이지는 연도·라벨이 붙어버려 검색이 불가능하다.
  • HIGH 는 기존 운영(2.5-flash)과 핵심 사실 정확도가 동등하면서 비용 44% 절감, 잡 시간 2.6배 단축이다. 2.5-flash 는 thinking 이 기본 ON 이라 오히려 가장 비쌌다.
  • 2.5-flash 는 주관적 평가를 다수 출력해 프롬프트 금지사항을 어기고, 장문 탓에 7페이지 타임라인이 2청크로 갈려 검색 품질이 떨어졌다.

변경

  • ai_file.agent_knowledge_vlm_thinking_level 코드 기본값 "" → "HIGH"
  • config_{local,dev,stg,prod}.yml 및 .env.example 기본값 HIGH
  • config_dev.yml 의 gemini-2.5-flash 임시 측정 설정을 gemini-3.5-flash-lite 로 원복
  • 기본값 회귀 방지 테스트 추가

되돌리려면 env 로 AI_FILE_AGENT_KNOWLEDGE_VLM_THINKING_LEVEL= (빈 값).

비교 상세: claude_md/ai-file/2026-09-09-지식VLM-모델-3자-품질비교.md

706 tests pass.

Co-Authored-By: Claude Opus 5 (1M context) noreply@anthropic.com

Merge request reports