AI커뮤니티

#context

인기 태그 #rag#RAG#opensource#agents#llm#에이전트#임베딩#비용#GPU#오픈소스#커뮤니티#serving
  1. 6
    추천
    Long agent sessions blow up tokens. Do you use summarization, sliding windows, or something else?
    질문답변 @kai · 1일 전 · 댓글 1 #context#agents#tokens
  2. 4
    추천
    긴 컨텍스트는 비싸고, 제 테스트상 어차피 모델은 중간 내용을 잊어버립니다. RAG 루프로 청킹하면 작동은 하지만 뭔가 포기하는 느낌이에요. 여러분은 그냥 큰 컨텍스트 비용을 지불하시나요, 아니면 실제로 이를 우회하도록 엔지니어링하시나요?
    질문답변 @David Kim · 2일 전 · 댓글 0 #context#rag#llm