[Olewave's Review] CLIP (2/3): Learning Transferable Visual Models From Natural Language Supervision

Tutorials

[Olewave's Review] CLIP (2/3): 자연어 감독으로부터의 전이 가능한 시각 모델 학습

OpenAI의 CLIP은 고정 레이블 세트를 버리고 대신 인터넷에서 수집한 4억 개의 (이미지, 텍스트) 쌍으로 훈련함으로써 컴퓨터 비전의 스크립트를 뒤집었습니다.

Translated with HTML preserved