Mixtral이 란?
Mixtral 7bx8는 Mistral 7B와 유사한 구조를 가지고 있지만, Mixture of Experts (MoE)라는 기술을 사용하여 8개의 “전문가” 모델을 하나로 통합한 모델입니다. 트랜스포머 모델에서 MoE가 작동하는 방식은 몇 개의...
Gemini Pro API 사용해보기 (Python, Langchain)
제미나이 프로의 API 발급과 사용방법을 알아보고 Python에서 작동하는 것을 보고 랭체인에 적용해보자
랭체인과 라마인덱스 비교
오늘의 할 일은 라마 인덱스(구 GPT 인덱스)와 랭체인에 대한 비교를 진행할 것입니다. 조사해를 해본 자료를 조합하면 대충 아래와 같습니다. 🚀 Langchain은 초기 프로젝트 시작 및 빠른 구현에 적합하며 러닝 커브가 낮음.💡 llama I...
벡터 데이터베이스와 벡터 인덱스 Faiss
주로 LLM 관련되서 중장기적인 기억을 담당하는 부분을 수행으로 복합 비정형 데이터를 위해 효율적으로 저장 및 검색을 하기 위해 개발된 데이터베이스 구조복합 비정형 데이터를 저장하기 위해서는 데이터를 일련의 숫자로 구성된 임베딩으로 변환하는 것이...
lora finetuning 후 EOS token이 안나오는 문제
지난번에 LoRA를 학습시키고 EOS 토큰이 나오는 확률이 낮아진거같은데… 어떻게 해결 할 수 있는 방법이 있는가 구글링을 통해서 찾아 보았다.
llama2에 remon 데이터로 8bit LoRA 학습
간단히 llama2를 통해 remon데이터를 학습시켜서 AI인간 만드는 짓을 하겠다 remon data는 허깅 페이스에서 쉽게 구할 수 있음 nsfw가 없는 클린?한 데이터를 사용합니다.
RLHF 인간 피드백 강화학습 코드분석 (chatllama, stackllama)
정의 : 사람의 피드백을 통해 파인튜닝함으로써 LM을 사용자 의도에 맞게 조정하는 방법이다. InstructGPT, ChatGPT 등에 사용되었다.사람이 직접 평가한 결과, 1.3B의 파라미터를 가진 InstructGPT 모델이 GPT3-175B...
AutoGPTQ로 양자화
오늘은 AutoGPTQ로 한글 라마13b 모델을 양자화해볼려고 한다. 오늘도 koalpaca 데이터셋을 사용하려고 한다. 가볍게 데이터셋 프롬프트 형식만 맞춰서 만들어주고…
exllamav2로 exl2형식으로 양자화하기
데이터셋은 준비했고, 모델도 형식에 맞게 변환했고 리눅스에서 명령어로 exl2를 변환해주는 코드를 작성해주면된다.보면서 따라 했는데도 힘들구먼 결과가 잘나올려나
LLaVA-1.5 이미지 텍스트 멀티모달
LLaVA-1.5는 이미지 분석이 가능한 멀티모달의 오픈소스로서 11개 벤치마크에서 소타를 달성했다.