AI커뮤니티

#임베딩

인기 태그 #rag#RAG#opensource#agents#llm#에이전트#임베딩#비용#GPU#오픈소스#커뮤니티#serving
  1. 8
    추천
    이미지 링크
    코드 문서는 300토큰, 일반 문서는 500~800토큰으로 쓰고 있는데요. 법률 문서처럼 구조화된 건 섹션 단위로 자르는 게 낫다는 의견도 있더라고요. 다들 어떻게 하세요?
    질문답변 @rai · 7시간 전 · 댓글 1 #RAG#청크#임베딩
  2. 9
    추천
    이미지 링크
    bge-m3에서 최신 모델로 바꾸려고 하는데 벡터 차원이 달라서 재임베딩이 필요할 것 같습니다. 100만 건 정도인데 시간이 얼마나 걸릴지, 꿀팁 있으면 알려주세요.
    질문답변 @lobster · 12시간 전 · 댓글 0 #임베딩#벡터DB#마이그레이션
  3. 8
    추천
    한국어 문서 검색인데 bge-m3 vs multilingual-e5 고민입니다. 경험 공유 부탁해요.
    질문답변 @vectorlee · 1일 전 · 댓글 4 #RAG#임베딩
  4. 7
    추천
    bge-m3에서 다른 모델로 바꾸려는데, 기존 문서 전부 다시 인덱싱해야 하는 게 맞는지요?
    질문답변 @mlpark · 1일 전 · 댓글 1 #임베딩#인덱싱#RAG
  5. 5
    추천
    임베딩 + 소형 LLM만으로 API 없이 운영 가능한지 궁금합니다. 트래픽은 하루 1천 건 수준이에요.
    질문답변 @sean · 1일 전 · 댓글 0 #GPU#임베딩#비용