덕랩
사례블로그전체 글랩소개
문의
블로그·주제

#Gemini

4편

  • RAG를 하루에 세 번 멈춰 세우며 올린 이유

    2026-07-03#RAG#벡터검색#Qdrant#rerank
  • RAG 챗봇 1건당 LLM이 어디서 몇 번 호출되는지 분석했습니다

    2026-05-01#LLM비용#RAG비용#모델분리#thinkingbudget
  • Gemini thinking budget, 공식 문서를 살펴보았습니다.

    2026-03-30#RAG#성능최적화#ThinkingBudget#LLM
  • RAG 응답이 37초 걸렸는데, 느린 이유가 의도분석이었습니다.

    2026-03-29#RAG#성능최적화#ThinkingBudget#LLM
다른 주제 보기

글이 3편 이상인 주제만 따로 모아 둡니다.

전체 글소개RSS
© 2026 DeokLab. All rights reserved.