04 Dec 2021
|
RNN
Paper Review
Video Understanding
이 글에서는 RNN 기반 Video Classification Model을 간략히 소개한다. RNN 기반 모델은 single embedding으로 전체 seq를 인코딩하므로 정보의 손실이 입력이 길어질수록 커진다. 또 처음에 들어온 입력에 대한 정보는 점점 잊혀지는 단점이 있다. 이는 Attention Is All You Need 이후 발표되는 Attention 기반 모델에서 개선된다. LRCN: Long-term Recurrent Convolutional Network 논문...
04 Dec 2021
|
Paper Review
Sequential Recommendation
이번 글에서는 Alibaba에서 발표한 추천시스템 알고리즘인 BST에 대해 다뤄보도록 하겠습니다. 논문 원본은 이 곳에서 확인할 수 있습니다. 본 글에서는 핵심적인 부분에 대해서만 살펴보겠습니다. Behavior Sequence Transformer for E-commerce Recommendation in Alibaba 설명 1. Background Alibaba는 Taobao라고 하는 거대한 쇼핑몰을 갖고 있는데, 본 논문은 이 Taobao에서 발생한 로그의 일부를 효과적으로 활용하여...
04 Dec 2021
|
CNN
Paper Review
3D CNN
Action Recognition
이 글에서는 Video Action Recognition Models(Two-stream, TSN, C3D, R3D, T3D, I3D, S3D, SlowFast, X3D)을 정리한다. Two-stream 계열: 공간 정보(spatial info)와 시간 정보(temporal info)를 별도의 stream으로 학습해서 합치는 모델. 3D CNN 계열: CNN은 3D로 확장하여 (iamge $\rightarrow$ video) 사용한 모델. Facebook이 주도해 왔다. Two-stream Approach 논문 링크: Two-Stream Convolutional Networks for...
28 Nov 2021
|
Paper Review
Cross-Domain Recommendation
이번 글에서는 GNN을 활용하여 CDR(Cross Domain Recommendation) 문제를 풀어본 논문에 대해서 다뤄보도록 하겠습니다. 논문 원본은 이 곳에서 확인할 수 있습니다. 본 글에서는 핵심적인 부분에 대해서만 살펴보겠습니다. Pre-training Graph Neural Network for Cross Domain Recommendation 설명 1. Introduction 추천 시스템을 만든다고 할 때 cold start problem과 data sparsity issue는 흔히 겪는...
26 Nov 2021
|
Paper Review
Multimodal Learning
VQ-VAE
VQ-VAE-2
이 글에서는 2019년 NIPS에 게재된 Generating Diverse High-Fidelity Images with VQ-VAE-2(VQ-VAE2) 논문을 살펴보고자 한다. 중요한 부분만 적을 예정이므로 전체가 궁금하면 원 논문을 찾아 읽어보면 된다. Generating Diverse High-Fidelity Images with VQ-VAE-2 논문 링크: Generating Diverse High-Fidelity Images with VQ-VAE-2 Github: https://github.com/rosinality/vq-vae-2-pytorch 2019년 6월, NIPS 2019 DeepMind Ali Razavi, Aaron van...