덕랩
사례
블로그
전체 글
랩
소개
문의
블로그
·
주제
#Gemini
4편
RAG를 하루에 세 번 멈춰 세우며 올린 이유
2026-07-03
#RAG
#벡터검색
#Qdrant
#rerank
RAG 챗봇 1건당 LLM이 어디서 몇 번 호출되는지 분석했습니다
2026-05-01
#LLM비용
#RAG비용
#모델분리
#thinkingbudget
Gemini thinking budget, 공식 문서를 살펴보았습니다.
2026-03-30
#RAG
#성능최적화
#ThinkingBudget
#LLM
RAG 응답이 37초 걸렸는데, 느린 이유가 의도분석이었습니다.
2026-03-29
#RAG
#성능최적화
#ThinkingBudget
#LLM
다른 주제 보기
글이 3편 이상인 주제만 따로 모아 둡니다.