23.06.15
DEVOTEE를 활성화 시키면
지금 작성한 커뮤니티 글에 대해 1개의 댓글을 달아줍니다.
버튼을 누르면 글 수정 시 ChatGPT가 작성한 댓글이 수정됩니다.
| 컨텐츠 유형 | 제목 | 저장일 | 삭제 |
|---|
본인인증 로그인에 실패하였습니다.
회원이 아니시거나 본인인증 등록이
완료되지 않은 사용자입니다.
일시: 25.7.28 12:00~13:00
장소: 우산사옥 8층 공유방
참석자: 최윤석, 최용길, 최홍석, 오영훈, 박철현
주요내용
데보션 모임에 대한 소개
데보션 모임 운용 규칙
데보션 모임 계획
1. 데보션 모임에 대한 소개
https://devocean.sk.com/internal/board/viewArticleForAjax.do?id=167431
2. 대보션 모임 운용 원칙 공유
3. 데보션 모임 향후계획 논의
ㅇ 1~5차 모임
1) AI Weekly Issue 공유 (ex. https://www.deeplearning.ai/the-batch/)
- 최신 생성형 AI 기술, 트렌드, 이슈를 함께 읽고 토론합니다.
2) AI Tool 실습 및 사용기 작성
- ChatGPT, Copilot, Claude, Make, n8n, Canva 등 다양한 생성형 AI 도구를 사용해보고 사용기를 작성해 공유합니다.
>>> confluence에 1), 2)에 대해 자유롭게 작성 후, 공유
4. 스터디 진행내역
1) AI Weekly Issue 공유 (예시)
DeepSeek 모델 및 업계 동향 정리
DeepeSek 모델
- V2(24.1 공개)
- MoE(mixture of experts). 부분활성화. 훈련 중 부하분산 및 라우팅에 대한 새로운 접근 방식 도입.
- MLA(multi-head latent attention). 키-값 저장소를 압축할 수 있게 만들어 추론 중 메모리 사용량을 극적으로 감소.
- V3(24.12 공개)
- 고대역폭의 H100(미국의 제재로 사용불가) 대신 H800을 사용하여 Nvidia GPU의 저수준 명령어 PTX를 사용하여 최적화를 함.
- OpenAI-4o, Anthropic-Sonnet-3.5, Llama와 같은 모델을 증류(교사 모델에 입력을 보내고 출력을 기록한 다음, 학생모델을 학습)하여 V3가 고품질의 토큰을 학습.
- R1(25.1 공개) - R1, R1-zero
- OpenAI-o1에 이은 새로운 추론 모델.
- 오픈모델, 공개가중치(오픈소스라고 하기에는 사용된 데이터를 제공하지 않음)로 설치하여, 서버 or 로컬에서 실행 할 수 있음.
- R1-zero : RL(강화학습)을 통해 학습. (GPT3과 비교하면 RLHF에서 Human Feedback이 제외)
- R1 : 소량의 Cold Start 데이터와 다단계 훈련 pipeline을 포함. V3모델에서 Fine-Tuning, RL 수행. OpenAI-o1과 대등한 성능.
- R1이 경쟁력이 있지만, OpenAI의 o1-Pro, o3 보다는 못함. DeepSeek가 효율성 선두라면, OpenAI는 전반적인 선두
업계 영향
- 추론을 위한 메모리 요구사항이 낮아짐으로써, Microsoft(Cloud), Meta(Cloud), Apple(Device), Meta(AI)에게 이득. Google(Search, TPU)에게는 손해.
- 시장에 충격을 준 이유. 1) 중국이 미국의 선도적인 연구소를 따라 잡았다. 2) 낮은 훈련, 추론 비용. 3) 중국에 칩 수출 제한에도 이루어 냄.
- Nvidia와 DeepSeek
- Nvidia에 도전하는 진입장벽. 1) CUDA는 프로그래밍하는 사람들의 선호 언어이며, Nvidia 칩에서만 작동. 2) 여러 GPU를 하나의 가상GPU로 결합하는 능력에서 우위보유.
- Nvidia의 긍정적 반응.
1) DeepSeek는 H800을 최적화하여 이루어냈으나 H100, GB100에도 동일하게 적용될지는 의문.
2) 더 낮은 추론 비용은 장기적으로 더 많은 사용을 이끌어 낼 것으로 예상.
3) R1, o1 추론모델은 여전히 더 많은 컴퓨팅에서 우한 성능.
- Nvidia의 부정적 반응. GPU대신 추론에 대한 대안적 접근 방식(최적화된 모델 및 인프라, 추론 전용 칩)을 제시함.
정리
DeepSeek의 오픈소스 공개로 장기적으로 제본스의 역설(Jevons Paradox - 기술발전으로 자원의 사용효율성이 증가하면 오히려 전체적인 자원소비량이 증가하는 현상)이 지배할 것으로 보임.
앞으로 미국은 칩 수출, 규제에 대해 어떤 선택을 할 것인지?
2) AI Tool 실습 및 사용기 작성
chatgpt 에이전트 기능을 사용하여 PPT 제작
결과물 : 첨부파일
URL : https://chatgpt.com/share/688b8168-b4e0-8013-ab8c-0cecdf407b33
DEVOTEE를 활성화 시키면
지금 작성한 댓글에 AI가 댓글을 달아줍니다.