feat: 지식 VLM thinking_level 기본값을 HIGH 로 승격하고 dev 임시설정 원복
2026-09-09 3자 실측 결과에 따라 전 환경 기본값을 HIGH 로 올린다. 같은 파일(다우오피스4.0 소개자료, VLM 발동 13페이지) 기준:
| 2.5-flash | lite/minimal | lite/HIGH | |
|---|---|---|---|
| 설명 생성 페이지 | 13 | 9 | 12 |
| 센티널 오염 | 1건 | 0 | 0 |
| 잡 전체 | 85.8초 | 15.7초 | 32.8초 |
| 문서 1건 비용 | 149원 | 20원 | 84원 |
- minimal 은 텍스트 레이어가 깨진 페이지(7p 브랜드 타임라인)를 센티널로 포기해 커버리지가 9/13 에 그친다. 그 페이지는 연도·라벨이 붙어버려 검색이 불가능하다.
- HIGH 는 기존 운영(2.5-flash)과 핵심 사실 정확도가 동등하면서 비용 44% 절감, 잡 시간 2.6배 단축이다. 2.5-flash 는 thinking 이 기본 ON 이라 오히려 가장 비쌌다.
- 2.5-flash 는 주관적 평가를 다수 출력해 프롬프트 금지사항을 어기고, 장문 탓에 7페이지 타임라인이 2청크로 갈려 검색 품질이 떨어졌다.
변경
- ai_file.agent_knowledge_vlm_thinking_level 코드 기본값 "" → "HIGH"
- config_{local,dev,stg,prod}.yml 및 .env.example 기본값 HIGH
- config_dev.yml 의 gemini-2.5-flash 임시 측정 설정을 gemini-3.5-flash-lite 로 원복
- 기본값 회귀 방지 테스트 추가
되돌리려면 env 로 AI_FILE_AGENT_KNOWLEDGE_VLM_THINKING_LEVEL= (빈 값).
비교 상세: claude_md/ai-file/2026-09-09-지식VLM-모델-3자-품질비교.md
706 tests pass.
Co-Authored-By: Claude Opus 5 (1M context) noreply@anthropic.com