[인공지능 기술] GPU 추가 없이 메모리 확장, 대규모 AI 활용 성능 2배 '업'

GPU 추가 없이 메모리 확장, 대규모 AI 활용 성능 2배 '업'

입력
KAIST 연구진
컴퓨트 익스프레스 링크(CXL, Compute Express Link) 기술은 GPU를 추가하지 않고도 GPU 메모리를 확장할 수 있는 기술이다. KAIST 제공
컴퓨트 익스프레스 링크(CXL, Compute Express Link) 기술은 GPU를 추가하지 않고도 GPU 메모리를 확장할 수 있는 기술이다. KAIST 제공
국내 연구팀이 인공지능(AI) 기술 구현의 핵심인 그래픽처리장치(GPU)의 메모리 확장 기술을 개선해 성능을 끌어올렸다.

KAIST는 정명수 전기및전자공학부 교수팀이 차세대 인터페이스 기술인 '컴퓨트 익스프레스 링크(CXL, Compute Express Link)'가 활성화된 고용량 GPU의 메모리 읽기·쓰기 성능을 최적화하는 기술을 개발했다고 8일 밝혔다. 연구결과는 7월 미국 유즈닉스(USENIX) 연합 학회와 핫스토리지 연구 발표장에서 선보일 예정이다.

최신 대규모 언어모델(LLM)은 추론·학습에 수십 테라바이트(TB, 1TB는 1024GB)의 메모리가 필요하다. 단일 GPU의 내부 메모리 용량은 수십 기가바이트(GB) 수준이라 단독으로 언어 모델을 활용하는 것은 불가능하다. 일반적으로 GPU 여러 개를 연결하는 방식을 사용하지만 최신 GPU의 높은 가격이 걸림돌이다.

대용량 메모리 장치를 GPU에 연결해 메모리 크기를 확장하는 'CXL-GPU' 구조가 산업계에서 주목받고 있다. 메모리 용량을 늘리기 위해 값비싼 GPU를 추가로 구매할 필요가 없기 때문이다. 하지만 GPU에 연결된 메모리 확장 장치의 읽기·쓰기 속도가 GPU 내부 메모리와 비슷한 수준으로 구현돼야 대규모 AI 서비스에 활용될 수 있다.

연구팀은 CXL-GPU의 메모리 읽기·쓰기 성능이 저하되는 원인을 분석하고 이를 개선했다. 확장된 메모리의 쓰기 작업 완료 여부를 기다리지 않고도 동시에 GPU 내부 메모리에도 쓰기 작업을 할 수 있도록 해 쓰기 성능을 개선한 것이다. 읽기 작업에서도 확장된 메모리 장치에서 필요한 읽기 작업을 미리 수행할 수 있도록 해 읽기 성능을 향상시켰다.

국내 반도체 팹리스 스타트업인 파네시아(Panmnesia)의 CXL-GPU 프로토타입을 활용해 성능을 검증한 결과 기존 GPU 메모리 확장 기술보다 AI 서비스를 2.36배 빠르게 실행할 수 있는 것으로 나타났다.

정명수 교수는 "CXL-GPU 시장 개화 시기를 앞당겨 대규모 AI 서비스를 운영하는 기업의 메모리 확장 비용을 획기적으로 낮추는 데 기여할 것"이라고 밝혔다.
 

 

 

 

본 웹사이트는 광고를 포함하고 있습니다.
광고 클릭에서 발생하는 수익금은 모두 웹사이트 서버의 유지 및 관리, 그리고 기술 콘텐츠 향상을 위해 쓰여집니다.
번호 제목 글쓴이 날짜 조회 수
57 [인공지능 기술] WebLLM 소개와 구조 분석 file 졸리운_곰 2024.11.07 121
56 [인공지능 기술] 이성에게 7번 차이고 인형과 결혼한 日남성…6주년 맞은 근황 file 졸리운_곰 2024.11.06 84
55 [인공지능 기술] 챗GPT, 인간보다 창의적일까? ‘No!’ [달콤한 사이언스] file 졸리운_곰 2024.10.31 99
54 [인공지능 기술] [10월3주] AGI의 핵심으로 떠오른 '월드 모델'이란 file 졸리운_곰 2024.10.25 76
53 [인공지능 기술] 소규모 언어 모델(SLM) 소규모 언어 모델의 부상: AI를 위한 효율성과 맞춤화 : Small Language Models (SLMs) file 졸리운_곰 2024.09.29 75
52 [인공지능 기술] AI "아내보다 날 더 사랑해줘"...남자는 대화 6주만에 목숨 끊었다 file 졸리운_곰 2024.09.20 100
51 [인공지능 기술] 추석 '농로 내비 대란'…"AI 맹신이 몰고 올 위기 보여줬다" file 졸리운_곰 2024.09.19 92
50 [인공지능 기술] 이런 것도 다 되네, 알수록 신박한 AI 앱 [스페셜리포트] file 졸리운_곰 2024.09.10 81
49 [인공지능 기술] RAG(검색 증강 생성)란? – LLM 단점을 보완하는 기술 file 졸리운_곰 2024.09.02 95
48 [인공지능 기술] AI 기반 물리 정보 신경망을 이용한 시뮬레이션 file 졸리운_곰 2024.08.13 85
47 [인공지능 기술] '집컴'으로 실행한 일기예보 AI, 슈퍼컴 이겼다 file 졸리운_곰 2024.07.30 120
46 [인공지능 기술] [표지로 읽는 과학] AI가 생성한 데이터 학습한 AI, 오염된 정보 낳는다 file 졸리운_곰 2024.07.28 99
» [인공지능 기술] GPU 추가 없이 메모리 확장, 대규모 AI 활용 성능 2배 '업' file 졸리운_곰 2024.07.09 106
44 [인공지능 기술] "대학에서 고득점 받은 AI가 쓴 답안, 걸러지지 않았다" file 졸리운_곰 2024.06.27 88
43 [인공지능 기술] 인공지능 ‘블랙박스’ 풀리나 file 졸리운_곰 2024.05.28 95
42 [인공지능 기술] 메타 AI 책임자 “LLM, 인간 추론 능력 도달 못해” file 졸리운_곰 2024.05.24 81
41 [인공지능 기술] AI컴퓨터가 전부 캡처…과거 작업화면 필요할때 불러온다 file 졸리운_곰 2024.05.22 93
40 [인공지능 기술] 인간 배신하고 허세 부리는 '속임수 달인' AI file 졸리운_곰 2024.05.13 110
39 [인공지능 기술] "거짓말 하는 AI, 죽은 척까지 한다"…MIT 섬뜩한 경고 file 졸리운_곰 2024.05.12 107
38 [인공지능 기술] "AI가 거짓말을 한다"…점점 커지는 속임수 능력에 경고등 file 졸리운_곰 2024.05.11 98
대표 김성준 주소 : 경기 용인 분당수지 U타워 등록번호 : 142-07-27414
통신판매업 신고 : 제2012-용인수지-0185호 출판업 신고 : 수지구청 제 123호 개인정보보호최고책임자 : 김성준 sjkim70@stechstar.com
대표전화 : 010-4589-2193 [fax] 02-6280-1294 COPYRIGHT(C) stechstar.com ALL RIGHTS RESERVED