Tag: openai

News
Meta's Movie Gen vs. OpenAI's Sora: a Detailed Review
Tutorials

Meta์˜ Movie Gen vs. OpenAI์˜ Sora: ์ƒ์„ธ ๋ฆฌ๋ทฐ

Meta๋Š” ๋งˆ์นจ๋‚ด Sora์— ๋Œ€ํ•œ ์ž…์žฅ์„ ๋ณด์˜€๊ณ , Movie Gen์€ ๋‹จ์ˆœํ•œ ๋น„๋””์˜ค ์ƒ์„ฑ๊ธฐ ์ด์ƒ์ž…๋‹ˆ๋‹ค โ€” ๋‹ค์ค‘ aspect ratio๋กœ 1080p HD ๋น„๋””์˜ค๋ฅผ ์ƒ์„ฑํ•˜๊ณ  ๋™๊ธฐํ™”๋œ ์˜ค๋””์˜ค๋ฅผ ์ง€์›ํ•˜๋Š” foundation ๋ชจ๋ธ์˜ ์บ์ŠคํŠธ์ด๋ฉฐ, ์ •๋ฐ€ํ•ฉ๋‹ˆ๋‹ค

10์›” 25, 2024ยท 1 min read
Google Researcher's In-Depth Analysis on End-to-End Speech Recognition, Part 1: Overview & Modeling
Tutorials

Google ์—ฐ๊ตฌ์›์˜ End-to-End ์Œ์„ฑ ์ธ์‹์— ๋Œ€ํ•œ ์‹ฌ์ธต ๋ถ„์„, Part 1: ๊ฐœ์š” & ๋ชจ๋ธ๋ง

๋”ฅ๋Ÿฌ๋‹์˜ 10๋…„์€ ASR ๋‹จ์–ด ์˜ค๋ฅ˜์œจ์„ 50% ์ด์ƒ ์ƒ๋Œ€์ ์œผ๋กœ ๊ฐ์†Œ์‹œ์ผฐ๊ณ , ๊ทธ ๊ณผ์ •์—์„œ ๊ณ ์ „์ ์ธ HMM ํŒŒ์ดํ”„๋ผ์ธ์„ ์œ ๋ฌผ์ฒ˜๋Ÿผ ๋ณด์ด๊ฒŒ ๋งŒ๋“ค์—ˆ์Šต๋‹ˆ๋‹ค.

6์›” 7, 2024ยท 1 min read
Deduct OpenAI GPT-4o's Neural Network Architecture
Tutorials

OpenAI GPT-4o์˜ ์‹ ๊ฒฝ๋ง ์•„ํ‚คํ…์ฒ˜ ์ถ”๋ก ํ•˜๊ธฐ

OpenAI๋Š” GPT-4o์— ๋Œ€ํ•œ ๋…ผ๋ฌธ์„ ๋ฐœํ‘œํ•˜์ง€ ์•Š์•˜์œผ๋ฏ€๋กœ, ์ด ์˜์ƒ์€ ๋‹ค์Œ ์ตœ์„ ์˜ ๋ฐฉ๋ฒ•์„ ์ œ์‹œํ•ฉ๋‹ˆ๋‹ค: OpenAI๊ฐ€ ์‹ค์ œ๋กœ ์‹œ์—ฐํ•œ ๊ธฐ๋Šฅ์„ ๋ฐ”ํƒ•์œผ๋กœ ์‹ ๊ฒฝ๋ง ์•„ํ‚คํ…์ฒ˜๊ฐ€ ๊ฑฐ์˜ ํ™•์‹คํžˆ ์–ด๋–ค ๋ชจ์Šต์ธ์ง€๋ฅผ ์—ญ์—”์ง€๋‹ˆ์–ด๋งํ•ฉ๋‹ˆ๋‹ค

5์›” 17, 2024ยท 1 min read
Google's Universal Speech Model for 100+ languages beats OpenAI's Whisper Model
Tutorials

Google์˜ 100๊ฐœ ์ด์ƒ ์–ธ์–ด๋ฅผ ์ง€์›ํ•˜๋Š” Universal Speech Model์ด OpenAI์˜ Whisper Model์„ ๋Šฅ๊ฐ€ํ•ฉ๋‹ˆ๋‹ค

Google์˜ Universal Speech Model์€ ์กฐ์šฉํžˆ ๋†€๋ผ์šด ์„ฑ๊ณผ๋ฅผ ๋‹ฌ์„ฑํ–ˆ์Šต๋‹ˆ๋‹ค: ๋ ˆ์ด๋ธ”์ด ์ง€์ •๋œ ํ›ˆ๋ จ ๋ฐ์ดํ„ฐ์˜ ์•ฝ 1/7์„ ์‚ฌ์šฉํ•˜๋ฉด์„œ 100๊ฐœ ์ด์ƒ์˜ ์–ธ์–ด์—์„œ OpenAI์˜ Whisper์™€ ๋™๋“ฑํ•˜๊ฑฐ๋‚˜ ๋Šฅ๊ฐ€ํ•˜๋Š” ASR ์„ฑ๋Šฅ์„ ๋‹ฌ์„ฑํ–ˆ์Šต๋‹ˆ๋‹ค.

5์›” 6, 2024ยท 1 min read
Disclosing OpenAI GPT-4's vision+text model, data, and cost to train (speculated)
Tutorials

OpenAI GPT-4์˜ ๋น„์ „+ํ…์ŠคํŠธ ๋ชจ๋ธ, ๋ฐ์ดํ„ฐ ๋ฐ ํ•™์Šต ๋น„์šฉ ๊ณต๊ฐœ (์ถ”์ธก)

OpenAI๋Š” GPT-4์˜ ์•„ํ‚คํ…์ฒ˜, ํŒŒ๋ผ๋ฏธํ„ฐ ์ˆ˜, ํ•™์Šต ๋ฐ์ดํ„ฐ ๋˜๋Š” ์ปดํ“จํŒ… ์˜ˆ์‚ฐ์„ ๊ณต๊ฐœํ•˜์ง€ ์•Š๊ธฐ๋กœ ์•…๋ช…๋†’์œผ๋ฉฐ, ์ด๋Š” ๊ธฐ์ˆ  ๋ณด๊ณ ์„œ๋ฅผ ML ์ปค๋ฎค๋‹ˆํ‹ฐ๋ฅผ ์œ„ํ•œ ๋กœ๋ฅด์ƒคํ ํ…Œ์ŠคํŠธ๋กœ ๋ฐ”๊พธ์—ˆ์Šต๋‹ˆ๋‹ค.

4์›” 1, 2023ยท 1 min read
A Review of GPT-4's Technical Report (GPT-4 in a Nutshell)
Tutorials

GPT-4์˜ ๊ธฐ์ˆ  ๋ณด๊ณ ์„œ ๋ฆฌ๋ทฐ (ํ•œ๋ˆˆ์— ๋ณด๋Š” GPT-4)

GPT-4์˜ ๊ธฐ์ˆ  ๋ณด๊ณ ์„œ๋Š” ์•„ํ‚คํ…์ฒ˜ ์„ธ๋ถ€์‚ฌํ•ญ์ด ๋ถ€์กฑํ•˜๊ณ  ๋Šฅ๋ ฅ ์ฃผ์žฅ์ด ๋งŽ๊ธฐ๋กœ ์•…๋ช…๋†’์œผ๋ฉฐ, ์ด๋Š” ๋ช…ํ™•ํ•œ ๋ฆฌ๋ทฐ๋ฅผ ๊ทธ ์œ„์— ๊ตฌ์ถ•ํ•˜๋Š” ๋ชจ๋“  ์‚ฌ๋žŒ์„ ์œ„ํ•ด ํ•„์ˆ˜ ์ฝ๊ธฐ๋กœ ๋งŒ๋“ญ๋‹ˆ๋‹ค.

3์›” 25, 2023ยท 1 min read
[Olewave's Review] AudioLM: a Language Modeling Approach to Audio Generation
Tutorials

[Olewave์˜ ๋ฆฌ๋ทฐ] AudioLM: ์˜ค๋””์˜ค ์ƒ์„ฑ์„ ์œ„ํ•œ ์–ธ์–ด ๋ชจ๋ธ๋ง ์ ‘๊ทผ

AudioLM์€ ๋งŽ์€ ์‚ฌ๋žŒ๋“ค์—๊ฒŒ ์˜ค๋””์˜ค ์ƒ์„ฑ์ด ์‹ ํ˜ธ ์ฒ˜๋ฆฌ๋ณด๋‹ค๋Š” ์–ธ์–ด ๋ชจ๋ธ๋ง์ฒ˜๋Ÿผ ๋ณด์—ฌ์•ผ ํ•œ๋‹ค๊ณ  ํ™•์‹ ์‹œํ‚จ ๋…ผ๋ฌธ์ž…๋‹ˆ๋‹ค.

3์›” 11, 2023ยท 1 min read
In-depth review of OpenAI's GPT-3 : Language Models are Few-Shot Learners (Part 3/3: Results&Rest)
Tutorials

OpenAI์˜ GPT-3์— ๋Œ€ํ•œ ์‹ฌ์ธต ๋ฆฌ๋ทฐ : ์–ธ์–ด ๋ชจ๋ธ์€ ์†Œ์ˆ˜ ์ƒท ํ•™์Šต์ž์ž…๋‹ˆ๋‹ค (ํŒŒํŠธ 3/3: ๊ฒฐ๊ณผ ๋ฐ ๋‚˜๋จธ์ง€)

์ด 3๋ถ€์ž‘ GPT-3 ์‹ฌ์ธต ๋ถ„์„์˜ ์ตœ์ข… ํšŒ์ฐจ๋Š” ๊ฒฐ๊ณผ์— ๋„๋‹ฌํ•ฉ๋‹ˆ๋‹ค: 1,750์–ต ๊ฐœ์˜ ํŒŒ๋ผ๋ฏธํ„ฐ๋ฅผ ๋ฒค์น˜๋งˆํฌ ์Šค์œ„ํŠธ์— ํˆฌ์ž…ํ•˜๊ณ  ๋ฏธ์„ธ ์กฐ์ •์„ ์™„์ „ํžˆ ๊ฑด๋„ˆ๋›ธ ๋•Œ ์‹ค์ œ๋กœ ์–ด๋–ค ์ผ์ด ๋ฐœ์ƒํ•˜๋Š”์ง€์— ๋Œ€ํ•ด.

3์›” 8, 2023ยท 1 min read
[10 mins] Explain Why OpenAI's Whisper API Isn't As Good As ChatGPT
Tutorials

[10๋ถ„] OpenAI์˜ Whisper API๊ฐ€ ChatGPT๋งŒํผ ์ข‹์ง€ ์•Š์€ ์ด์œ  ์„ค๋ช…

Whisper๋Š” ํฐ ์„ฑ๊ณต์„ ๊ฑฐ๋‘์—ˆ์ง€๋งŒ, GPT-3์ด NLP๋ฅผ ์žฌํŽธํ–ˆ๋˜ ๋ฐฉ์‹์œผ๋กœ ASR์„ ์žฌํŽธํ•˜์ง€๋Š” ๋ชปํ–ˆ์Šต๋‹ˆ๋‹ค. ์ด 10๋ถ„์งœ๋ฆฌ ๋ฆฌ๋ทฐ๋Š” ๊ทธ ์ด์œ ๊ฐ€ ๋…ผ๋ฌธ ์ž์ฒด์— ๋‚ด์žฌ๋˜์–ด ์žˆ๋‹ค๊ณ  ์ฃผ์žฅํ•ฉ๋‹ˆ๋‹ค.

3์›” 4, 2023ยท 1 min read
In-depth review of OpenAI's GPT-3 : Language Models are Few-Shot Learners (Part 2/3: Results)
Tutorials

OpenAI์˜ GPT-3์— ๋Œ€ํ•œ ์‹ฌ์ธต ๊ฒ€ํ† : ์–ธ์–ด ๋ชจ๋ธ์€ Few-Shot ํ•™์Šต์ž์ž…๋‹ˆ๋‹ค (ํŒŒํŠธ 2/3: ๊ฒฐ๊ณผ)

์ด GPT-3 ์‹ฌ์ธต ๋ถ„์„์˜ 2๋ถ€๋Š” ์„ค์ •์„ ๋„˜์–ด ์‹ค์ œ๋กœ ์‚ฌ๋žŒ๋“ค์ด NLP๋ฅผ ์žฌ์ƒ๊ฐํ•˜๊ฒŒ ํ•œ ๊ฒฐ๊ณผ๋กœ ์ด๋™ํ•ฉ๋‹ˆ๋‹ค.

2์›” 25, 2023ยท 1 min read
In-depth review of OpenAI's GPT-3 : Language Models are Few-Shot Learners (Part 1/3: Intro&Approach)
Tutorials

OpenAI์˜ GPT-3์— ๋Œ€ํ•œ ์‹ฌ์ธต ๊ฒ€ํ† : ์–ธ์–ด ๋ชจ๋ธ์€ Few-Shot ํ•™์Šต์ž์ž…๋‹ˆ๋‹ค (ํŒŒํŠธ 1/3: ์†Œ๊ฐœ & ์ ‘๊ทผ)

์ด ์„ธ ๋ถ€๋ถ„ GPT-3 ๊ฒ€ํ† ์˜ ์ฒซ ๋ฒˆ์งธ ๋ถ€๋ถ„์€ ๊ทœ๋ชจ๋ฅผ ์—ฐ๊ตฌ ๋ฒ ํŒ…์—์„œ ์—…๊ณ„ ๋ณต์Œ์œผ๋กœ ๋ฐ”๊พผ ๋…ผ๋ฌธ์„ ์„ค์ •ํ•ฉ๋‹ˆ๋‹ค.

2์›” 11, 2023ยท 1 min read
ChatGPT/ChatGPT Plus/InstructGPT:Training language models to follow instructions with human feedback
Tutorials

ChatGPT/ChatGPT Plus/InstructGPT: ์ธ๊ฐ„ ํ”ผ๋“œ๋ฐฑ์œผ๋กœ ์ง€์‹œ๋ฅผ ๋”ฐ๋ฅด๋„๋ก ์–ธ์–ด ๋ชจ๋ธ ํ›ˆ๋ จ

ChatGPT ์ œํ’ˆ ๋’ค์—๋Š” InstructGPT ๋…ผ๋ฌธ์ด ์žˆ์œผ๋ฉฐ, ์ด ์ƒ์„ธ ๋ฆฌ๋ทฐ๋Š” ์›์‹œ GPT-3์„ ์‚ฌ๋žŒ๋“ค์ด ์‹ค์ œ๋กœ ๋Œ€ํ™”ํ•˜๊ณ  ์‹ถ์–ด ํ•˜๋Š” ๊ฒƒ์œผ๋กœ ๋ณ€ํ™˜ํ•œ ํŒŒ์ดํ”„๋ผ์ธ์„ ์ž์„ธํžˆ ๋ถ„์„ํ•ฉ๋‹ˆ๋‹ค.

1์›” 28, 2023ยท 1 min read
Explain how ChatGPT/ChatGPT Plus works in 3 minutes
Tutorials

3๋ถ„ ์•ˆ์— ChatGPT/ChatGPT Plus๊ฐ€ ์–ด๋–ป๊ฒŒ ์ž‘๋™ํ•˜๋Š”์ง€ ์„ค๋ช…

ChatGPT๋Š” ์™ธ๋ถ€์—์„œ๋Š” ๋งˆ๋ฒ•์ฒ˜๋Ÿผ ๋ณด์ด์ง€๋งŒ, ์–ด๋””๋ฅผ ๋ด์•ผ ํ•˜๋Š”์ง€ ์•Œ๋ฉด ๋ ˆ์‹œํ”ผ๋Š” ์ž˜ ๋ฌธ์„œํ™”๋˜์–ด ์žˆ์œผ๋ฉฐ, ์ด 3๋ถ„ ์„ค๋ช…์€ ํ•ต์‹ฌ ์•„์ด๋””์–ด๋ฅผ ์š”์•ฝํ•ฉ๋‹ˆ๋‹ค.

1์›” 28, 2023ยท 1 min read
[Olewave's Review] CLIP (3/3): Learning Transferable Visual Models From Natural Language Supervision
Tutorials

[Olewave's Review] CLIP (3/3): ์ž์—ฐ์–ด ๊ฐ๋…์œผ๋กœ๋ถ€ํ„ฐ์˜ ์ „์ด ๊ฐ€๋Šฅํ•œ ์‹œ๊ฐ ๋ชจ๋ธ ํ•™์Šต

์ด CLIP ๊ฒ€ํ† ์˜ ๋งˆ์ง€๋ง‰ ๋ถ€๋ถ„์€ ๊ฒฐ๊ณผ ์„น์…˜์— ๋„๋‹ฌํ•˜๋ฉฐ, ์—ฌ๊ธฐ์„œ OpenAI์˜ ๋Œ€์กฐ์  ์ด๋ฏธ์ง€-ํ…์ŠคํŠธ ๋ชจ๋ธ์ด ํฅ๋ฏธ๋กœ์šด ์•„์ด๋””์–ด์—์„œ ์ „์ฒด ๋ฉ€ํ‹ฐ๋ชจ๋‹ฌ ์Šคํƒ์˜ ๊ธฐ์ดˆ ๊ณ„์ธต ๊ธฐ๋ณธ ์š”์†Œ๋กœ ์ „ํ™˜๋˜์—ˆ์Šต๋‹ˆ๋‹ค.

1์›” 14, 2023ยท 1 min read
[Olewave's Review] CLIP (2/3): Learning Transferable Visual Models From Natural Language Supervision
Tutorials

[Olewave's Review] CLIP (2/3): ์ž์—ฐ์–ด ๊ฐ๋…์œผ๋กœ๋ถ€ํ„ฐ์˜ ์ „์ด ๊ฐ€๋Šฅํ•œ ์‹œ๊ฐ ๋ชจ๋ธ ํ•™์Šต

OpenAI์˜ CLIP์€ ๊ณ ์ • ๋ ˆ์ด๋ธ” ์„ธํŠธ๋ฅผ ๋ฒ„๋ฆฌ๊ณ  ๋Œ€์‹  ์ธํ„ฐ๋„ท์—์„œ ์ˆ˜์ง‘ํ•œ 4์–ต ๊ฐœ์˜ (์ด๋ฏธ์ง€, ํ…์ŠคํŠธ) ์Œ์œผ๋กœ ํ›ˆ๋ จํ•จ์œผ๋กœ์จ ์ปดํ“จํ„ฐ ๋น„์ „์˜ ์Šคํฌ๋ฆฝํŠธ๋ฅผ ๋’ค์ง‘์—ˆ์Šต๋‹ˆ๋‹ค.

1์›” 1, 2023ยท 1 min read
[Olewave's Review] CLIP (1/3): Learning Transferable Visual Models From Natural Language Supervision
Tutorials

[Olewave's Review] CLIP (1/3): ์ž์—ฐ์–ด ๊ฐ๋…์œผ๋กœ๋ถ€ํ„ฐ์˜ ์ „์ด ๊ฐ€๋Šฅํ•œ ์‹œ๊ฐ ๋ชจ๋ธ ํ•™์Šต

BLIP, LLaVA, ๋˜๋Š” ๊ฐ€์น˜ ์žˆ๋Š” ์Œ์„ฑ-LLM์ด ์žˆ๊ธฐ ์ „์— CLIP์ด ์žˆ์—ˆ์œผ๋ฉฐ, ์ด๊ฒƒ์ด ์ด์•ผ๊ธฐ๊ฐ€ ์‹œ์ž‘๋˜๋Š” ๊ณณ์ž…๋‹ˆ๋‹ค.

12์›” 17, 2022ยท 1 min read
[Olewave's Review] OpenAI's Whisper ASR: Robust Speech Recognition via Large-Scale Weak Supervision
Tutorials

[Olewave์˜ ๋ฆฌ๋ทฐ] OpenAI์˜ Whisper ASR: ๋Œ€๊ทœ๋ชจ ์•ฝํ•œ ์ง€๋„๋ฅผ ํ†ตํ•œ ๊ฐ•๊ฑดํ•œ ์Œ์„ฑ ์ธ์‹

OpenAI๊ฐ€ Whisper๋ฅผ ์ถœ์‹œํ–ˆ์„ ๋•Œ, ASR ์ปค๋ฎค๋‹ˆํ‹ฐ๋Š” 68๋งŒ ์‹œ๊ฐ„์˜ ๋‹ค๊ตญ์–ด, ๋‹ค์ค‘ ์ž‘์—…, ์›น ํฌ๋กค๋ง ์˜ค๋””์˜ค๋กœ ํ›ˆ๋ จ๋˜์–ด ์‚ฌํˆฌ๋ฆฌ, ๋ฐฐ๊ฒฝ ์†Œ์Œ, ๊ธฐ์ˆ  ์šฉ์–ด ์ „๋ฐ˜์— ๊ฑธ์ณ

10์›” 31, 2022ยท 1 min read
[Long Review] Cascaded Diffusion Models for High Fidelity Image Generation
Tutorials

[์žฅ๋ฌธ ๋ฆฌ๋ทฐ] Cascaded Diffusion Models for High Fidelity Image Generation

Imagen๊ณผ DALL-E 2๊ฐ€ ์ƒ์„ฑ ์ด๋ฏธ์ง€๋ฅผ ์œ„ํ•œ ํ™•์‚ฐ์„ ๊ธฐ๋ณธ๊ฐ’์œผ๋กœ ๋งŒ๋“ค๊ธฐ ์ „์—, ์ด Google Brain ๋…ผ๋ฌธ์€ ์ดํ›„ ๋งŽ์€ ํ…์ŠคํŠธ-์ด๋ฏธ์ง€ ์‹œ์Šคํ…œ์ด ์กฐ์šฉํžˆ ์ฐจ์šฉํ•œ cascaded diffusion ๋ ˆ์‹œํ”ผ๋ฅผ ์ œ์‹œํ–ˆ์Šต๋‹ˆ๋‹ค: ์ž‘์€

6์›” 4, 2022ยท 1 min read
[Short Review] Cascaded Diffusion Models for High Fidelity Image Generation
Tutorials

[๋‹จ๋ฌธ ๋ฆฌ๋ทฐ] Cascaded Diffusion Models for High Fidelity Image Generation

Cascaded diffusion์€ ๋งŽ์€ ์ตœ์‹  ์ƒ์„ฑ ์ž‘์—…์˜ ๊ธฐ์ €๋ฅผ ์ด๋ฃจ๋Š” ๋‹ค๋‹จ๊ณ„ ๋ ˆ์‹œํ”ผ์ž…๋‹ˆ๋‹ค: ํ•œ ๊ฐœ์˜ diffusion ๋ชจ๋ธ๋กœ ์ž‘์€ ์ด๋ฏธ์ง€๋ฅผ ์ƒ์„ฑํ•œ ํ›„, ๊ณ ์ฃผํŒŒ ์„ธ๋ถ€

6์›” 4, 2022ยท 1 min read