23.06.15
DEVOTEE를 활성화 시키면
지금 작성한 커뮤니티 글에 대해 1개의 댓글을 달아줍니다.
버튼을 누르면 글 수정 시 ChatGPT가 작성한 댓글이 수정됩니다.
| 컨텐츠 유형 | 제목 | 저장일 | 삭제 |
|---|
본인인증 로그인에 실패하였습니다.
회원이 아니시거나 본인인증 등록이
완료되지 않은 사용자입니다.
안녕하세요! 6월 10일 Generative AI 스터디의 4번째 모임을 진행하였습니다.
금일은 "DreamPose: Fashion Video Synthesis with Stable Diffusion" 의 내용을 살펴봤습니다.
이 논문은 ICCV2023에 발표된 논문으로 Diffusion 기반 Image-to-video 생성 모델입니다.
입력된 사람의 이미지와 포즈 시퀀스를 기반으로 DreamPose는 입력된 사람이 포즈 시퀀스를 따르는 Photo-realistic 한 비디오를 생성합니다.
모델의 전체 구조는 아래 그림과 같습니다.
그림에 보면 DreamPose 는 입력 이미지와 포즈를 별도 인코더를 사용는데 이는 입력 이미지가 포즈와 공간적으로 Align 되어 있지 않기 때문입니다.
즉 이미지를 CLIP 이미지 인코더를 한번 거쳐 공간적으로 align 시킴과 동시에 추가 VAE 인코더를 사용하여 영상의 디테일을 살리는데 집중하였습니다.
그리고 입력으로 사용된 포즈는 DensePose 를 사용하여 추출하였네요.
마지막으로 학습에는 Univ. British Columbia 에서 공개한 Fashion Video Dataset을 사용하였습니다.
더 자세한 사항이 궁금하신 분은 논문을 참고해주세요!!!
DEVOTEE를 활성화 시키면
지금 작성한 댓글에 AI가 댓글을 달아줍니다.