[인공지능 기술] 한글 더 잘하는 llama3 찾아서 ollama에 연결하기 (feat. Bllossom ELO)

최근 Bllossom 팀에서 더 많은 Data로 학습한 모델을 올려주셔서 

다시 한번 테스트 해본 내용을 작성하였다. 

(오늘은 2024-07-10 입니다.)

 

https://huggingface.co/MLP-KTLim/llama-3-Korean-Bllossom-8B

4bit 양자화 모델도 따로 올려주셔서 그 모델을 ollama에 연결하고 Flowise까지 연결해 볼 생각이다. 

https://huggingface.co/MLP-KTLim/llama-3-Korean-Bllossom-8B-gguf-Q4_K_M

일단 4기가가 조금 넘는 파일을 다운받았다. 

 

그리고 허깅페이스의 모델카드를 보고 Modelfile을 좀 수정했다. 

FROM llama-3-Korean-Bllossom-8B-Q4_K_M.gguf

SYSTEM """당신은 유용한 AI 어시스턴트입니다. 사용자의 질의에 대해 친절하고 정확하게 답변해야 합니다. You are a helpful AI assistant, you'll need to answer users' queries in a friendly and accurate manner. 모든 대답은 한국어(Korean)으로 대답해주세요."""


TEMPLATE """{{- if .System }}
<s>{{ .System }}</s>
{{- end }}
<s>Human:
{{ .Prompt }}</s>
<s>Assistant:
"""

PARAMETER temperature 0.6
PARAMETER num_predict 3000
PARAMETER num_ctx 4096
PARAMETER stop <s>
PARAMETER stop </s>
PARAMETER stop <|eot_id|>

 

 

 

 

이렇게 파일 두개를 놓고 

 ollama create ollama-ko-0710 -f .\Modelfile

 

모델이 만들어지면 ollama ui 를 실행시켜서 질문해 본다. 

꽤 빠른 속도로 응답함.

 

 

 

그리고 이 ollama 모델을 활용해서 간단한 RAG 를 만들어 보자.

 

빨리 만들어 보기 위해서 Flowise 를 사용했다. 

우선 내가 사용한 기능들은 이렇다. 

 

1. 문서를 자르는 기능은 Text Splitters에서 Recursive Character Text Splitter 를 골랐다. 

2. PDF로 된 DJI 드론 사용자 매뉴얼을 업로드 했다. 

3. Ollama 임베딩 모델 사용법을 준비하지 못해 우선 OpenAI 임베딩 모델을 사용했다. (발급받은 key 만 넣어주면 됨)

4. 다른 Vector DB 쓰기 전에 In-Memory Vector Store를 사용했다. 

5. llm 은 위에서 만들어 둔 ollama 한글 모델을 사용했다. 

6. 답변 생성 Chain 은 Retrival QA Chain을 사용했다. 

 

과연 잘 될 것인가?

경축! 아무것도 안하여 에스천사게임즈가 새로운 모습으로 재오픈 하였습니다.
어린이용이며, 설치가 필요없는 브라우저 게임입니다.
https://s1004games.com

 

 

 

대화 Test 전에 

 

우측 상단에 Upsert Vector Database 버튼을 누르면 업로드 정보가 나오고 

Data를 변환하여 저장하는 로직이 실행된다. 

 

 

 

업로드 되고 난 결과를 보여준다.

 

 

 

자 드디어 질문 Test~!!

짜잔~ 일부러 원문에서 비슷한 곳을 찾아서 같이 캡쳐 했다.

 

언뜻 문서를 훑어 볼때 RTH가 뭔가 싶어서 질문했는데 

llama 8B 모델 기반 4bit 양자화 모델인데도 괜찮게 답변하는 것을 볼 수 있다. 

 

 

 

잘 사용하면 무료로 llm 을 사용할 수 있을 것 같다~

생각보다 응답속도도 빠름

 

Flowise의 장점은

여러가지 모델이나 방식을 끌어다 놓고 

이것 저것 바꿔보며 Test 할 수 있어서 좋다. 

 

 

 

[출처] https://devmeta.tistory.com/96

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
번호 제목 글쓴이 날짜 조회 수
77 [인공지능 기술] 바닥부터 시작하는 인공지능 [수학공부]인공지능을 위한 수학 총정리/ 요약본 다운로드 file 졸리운_곰 2025.03.29 43
76 [인공지능 기술] LlamaIndex: 맞춤형 데이터로 LLM 애플리케이션을 쉽게 강화하세요 file 졸리운_곰 2025.03.12 101
75 [인공지능 기술] 휴머노이드에 "일자리 빼앗을거야?" 묻자...뼈 때리는 답변 돌아왔다 file 졸리운_곰 2025.03.07 57
74 [인공지능 기술] 대형 AI 모델서 데이터 뽑아 학습… 비용 18분의 1로 줄였다 / 딥시크 혁신 이끈 '지식 증류' file 졸리운_곰 2025.02.06 57
73 [인공지능 기술] [인공지능 그림 6] 스테이블 디퓨전 webui 나만의 모델 만들기 - kohya_ss 사용 LoRa 만들기(feat 전투복 소녀 만들기) file 졸리운_곰 2025.02.05 75
72 [인공지능 기술] Transformer²: Self-Adaptive LLMs : Transformer²: 자체 적응형 LLM file 졸리운_곰 2025.01.15 64
71 [인공지능 기술] 효과적인 에이전트 구축 : Building effective agents file 졸리운_곰 2025.01.01 97
70 [인공지능 기술] 골칫거리 AI 환각, 과학 연구에서는 혁신적 아이디어 제공 file 졸리운_곰 2024.12.25 78
69 [인공지능 기술] Replit Agent 사용법 - AI 기반 코딩 도구로 쉽게 개발하기 file 졸리운_곰 2024.12.22 59
» [인공지능 기술] 한글 더 잘하는 llama3 찾아서 ollama에 연결하기 (feat. Bllossom ELO) file 졸리운_곰 2024.12.18 69
67 [인공지능 기술] Llama3를 내 PC에서 무료로 사용하는 방법 (GPT4All & RAG) file 졸리운_곰 2024.12.13 132
66 [인공지능 기술] "LLM 비즈니스 하향평준화돼...누구나 만들며 수익성 떨어져" file 졸리운_곰 2024.12.13 87
65 [인공지능 기술] [Python] Llama3를 파인튜닝을 통해 나만의 데이터로 학습 및 Huggingface에 적재해보자. file 졸리운_곰 2024.12.13 69
64 [인공지능 기술] Ollama + Open WebUI: Windows, Linux 또는 macOS에서 LLM을 로컬로 실행하는 방법 (Docker 없이) file 졸리운_곰 2024.12.12 93
63 [인공지능 기술] Ollama 서버에 외부에서 접속하는 방법: OS별 가이드 졸리운_곰 2024.12.12 120
62 [인공지능 기술] LLama.cpp 설치하고 실행해보기 file 졸리운_곰 2024.12.10 105
61 [인공지능기술] llama.cpp 설치 방법 및 사용방법 with LoRA file 졸리운_곰 2024.12.10 91
60 [인공지능 기술] Ollama란? Ollama 사용법: 내 PC에서 무료로 LLM 실행하기 졸리운_곰 2024.12.10 102
59 [인공지능 기술] ChatGPT와 Replit을 사용하여 게임 만들기 : Build a game using ChatGPT and Replit file 졸리운_곰 2024.12.10 97
58 [인공지능 기술] "GPT 성능 향상 속도 둔화"...오픈AI, '오라이온' 개선 위해 전략 수정 file 졸리운_곰 2024.11.11 99
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED