데보션앱 소개페이지 바로가기
로그인 선택

신고하기

CLOSE
신고사유 (대표 사유 1개)
상세내용 (선택)
0/200
  • 신고한 게시글은 더 이상 보이지 않습니다.
  • 이용약관과 운영정책에 따라 신고사유에 해당하는지 검토 후 조치됩니다.
  • 허위 신고인 경우, 신고자의 서비스 이용이 제한될 수 있으니 유의하시어 신중하게 신고해 주세요.
(이 회원이 작성한 모든 댓글과 커뮤니티 게시물이 보이지 않고, 알림도 오지 않습니다.)

미리보기

커뮤니티

      1,234

      badge 23.06.15

      글 등록

      카테고리를 선택해주세요.

      DEVOTEE를 활성화 시키면
      지금 작성한 커뮤니티 글에 대해 1개의 댓글을 달아줍니다.

      버튼을 누르면 글 수정 시 ChatGPT가 작성한 댓글이 수정됩니다.

      임시저장함에 저장되었습니다. 저장일시 : 2022.5.17 14:29:08

      임시저장함

      제목을 선택하시면 이어서 작성이 가능하며,
      최대 20건까지 저장합니다.
      컨텐츠 유형, 제목, 저장일시, 삭제로 이뤄진 임시저장 목록
      컨텐츠 유형 제목 저장일 삭제

      데보션 블로그 게재 요청

      CLOSE
      • *
      • *

      본인인증

      효율적인 데보션 서비스 이용 및
      고객님의 소중한 개인정보보호를 위해
      본인인증을 진행해주세요. 본인인증 미 진행 시 로그인이 제한됩니다.
      본인인증 실패

      본인인증 로그인에 실패하였습니다.
      회원이 아니시거나 본인인증 등록이
      완료되지 않은 사용자입니다.

      회원정보 연결

      AI 시대의 핵심: GPU, 왜 이토록 중요한가?

      lingerlow 24.08.28
      2,469 4 0
      DEVOTEE 요약
      Nvidia의 GPU는 AI 학습에 필수적인 병렬 처리 장치로, 단순 반복 연산에 효율적입니다. 예를 들어, OpenAI의 GPT-3 모델은 175B 파라미터를 학습시키는데, GPU가 CPU보다 훨씬 빠르게 처리합니다. 이는 Nvidia가 AI 학습에 최적화된 Cuda 생태계와 Nvlink 등을 제공하기 때문입니다.
      DEVOTEE 추천 블로그

      안녕하세요.


      오늘은 요즘 핫한 'Nvidia의 GPU' 이야기를 간단히 해보려고 합니다.

      OpenAI 의 ChatGPT가 AI의 실효성을 보여주며, 대 AI 시대의 서막을 열었습니다.

      AI 학습에 "GPU"가 왜 중요한지 알아보겠습니다.

      우선 GPU가 무엇인가? 부터 살펴보면, 양의 데이터를 동시에 처리할 수 있는 병렬 처리 장치입니다.


      Nvidia에서 CPU 와 GPU의 차이를 보여주기 위해 촬영한 영상입니다.

      GPU 대 CPU Youtube Link (14 years ago)

      image.png

      CPU 가 입출력을 한번에 한 발씩 한다고 하면

      image.png

      image.png

      GPU 는 대포처럼 병렬로 된 계산을 한 번에 출력하게 됩니다.


      이는 계산 속도에 엄청난 차이를 발생하게 합니다.


      최근 AI 학습에 기본이 되는 Neural Network(인공 신경망)은 GPU에 최적화 되어있습니다.

      Nvidia GPU 와 AI (Nvidia Korea 공식 블로그)

      (이유는 위 블로그 포스팅에 중간 쯤 자세히 설명 되어있습니다.)

      image.png 왼쪽 CPU 구조 / 오른쪽 GPU 구조


      앞선 영상처럼 CPU는 복잡한 알고리즘을 해결하기 위한 한 개의 연산을 해내고, GPU는 한번에 단순한 병렬연산을 해내게 됩니다.

      AI 학습은 기본적으로 단순 반복학습으로 이뤄지는데, 단순한 y = Wx 연산을 통해 최적의 W(가중치,파라미터)를 찾는 무한 연산입니다.

      GPU 연산의 효율성을 보기위해 예를 들어보겠습니다.


      OpenAI의 GPT3 Model을 만들기 위해 175B의 파라미터(약 45TB)를 갖는 데이터를 학습시켰습니다..

      최신 CPU와 GPU를 기준으로 성능을 비교를 하면 아래와 같습니다.

      image.png


      1 epoch 에 반년이상이 걸리는 CPU로는 빠르게 변화하는 AI Trend를 선도하기는 어려울 것 입니다.

      현재 GPT4 는 1조개 이상 GPT3 대비 6배 이상이며, llama3.1은 40.5B으로 최근 트랜드가 대형 모델을 학습시켜야하기에, GPU가 필수적으로 필요하게 됩니다.


      뿐만 아니라 Nvidia 는 AI 학습에 필수적인, Cuda 생태계를 지니고 있으며, Nvlink, transformer model engine 등을 제공하고 있기에, 현재로써는 필수불가결한 존재로 자리하고 있습니다.

      image.png


      여담으로 Nvidia가 Cuda 생태계를 Nvidia GPU를 사용해야만 활용할 수 있게 하여 다른 빅테크들에게 강매를 하고 있는데요.

      애플의 M Chip / Google 의 TPU 생태계 뿐아니라 다양한 AI Chip을 만들며 대응하고 있습니다.

      image.png

      그렇지만, 아직은 꾸준히 병렬 계산을 연구해온 Nvidia 를 대체할만한 AI Chip은 나오지 않고 있는데요.

      덕분에 HBM이 잘 팔려서 항상 감사하고 있습니다. Nvidia 파이팅 ^_^


      글이 흥하면, HBM 이야기도 해보겠습니다.

      댓글 0

      DEVOTEE를 활성화 시키면
      지금 작성한 댓글에 AI가 댓글을 달아줍니다.

      lingerlow 님의 최신 블로그

      더보기

      DEVOTEE 추천 블로그

      동영상 기고하기