Belajar AI #16: Transformer & LLM — Attention Mechanism dan GPT
Ini episode yang paling lama saya tunda, karena Transformer terasa seperti gunung. Padahal begitu naik, pemandangannya sederhana: satu ide besar bernama attention, plus keberanian membuang semua mekanisme lama. Hampir semua LLM (Large Language Model) yang Anda pakai hari ini — GPT, Claude, Gemini — adalah turunan arsitektur ini dari paper “Attention Is All You Need”. Episode ini catatan cara saya akhirnya paham attention tanpa tenggelam di rumus.
Belajar AI #16: Transformer & LLM — Attention Mechanism dan GPT Lanjutkan membaca
Komentar Terbaru