Sebagai developer dan peneliti AI, kita kini hidup di era di mana jumlah dan jenis model bahasa besar (LLM) yang tersedia bagi pengguna biasa semakin berlimpah. Setiap bulan, vendor seperti OpenAI, Anthropic, Google, dan lainnya merilis model baru yang menambah kebingungan pilihan. Tapi tidak semua model sama, ada yang fokus pada reasoning, ada yang multimodal, dan ada yang sekadar inginkan solusi yang cepat dan hemat — tanpa mengorbankan kualitas secara signifikan.
Pada Agustus 2026, kami telah mengumpulkan data terbaru dari dokumentasi resmi masing-masing vendor — termasuk repositori ai-pricing yang di-audit pada 5 Agustus 2026 — untuk memberi Anda gambaran jelas tentang:
Apa perbedaan thinking mode dan non-thinking mode?
Model-model dengan kemampuan vision, audio, dan tool use?
Tabel harga API paling akurat hingga kini — lengkap dengan sistem tarif peak/off-peak dari DeepSeek.
Ikuti selanjutnya!
Apa Itu “Thinking Mode”?
Thinking Mode (juga disebut reasoning atau extended thinking) adalah kemampuan model untuk menghasilkan rantai-poin pikir (chain-of-thought) internal sebelum memberikan jawaban akhir. Ini meniru cara manusia “memikirkan dua kali sebelum bertanya”.
Model dengan thinking mode biasanya:
Menghasilkan kualitas yang jauh lebih baik pada tugas matematis, kode, dan logika kompleks.
Memiliki latensi yang jauh lebih tinggi (sering 10-an detik atau lebih).
Menghitung token “pikiran” sebagai bagian dari output — artinya, Anda membayar untuk proses berpikir internal model.
Non-Thinking Mode adalah model yang menjawab langsung, lebih cepat, dan lebih murah. Cocok untuk tugas rutin, ringan, atau percakapan.
Aspek
Thinking Mode
Non-Thinking Mode
Latensi
Tinggi (detik ke-10-an)
Rendah (detik pertama)
Biaya
Lebih mahal
Lebih murang
Kualitas jawaban
Unggul pada matematika, coding, logika
Baik untuk tugas umum
Token yang dihitung
Input + Output (termasuk “pikiran”)
Hanya Input + Output
Model contoh
o1, o3-mini, DeepSeek R1, Qwen3-Thinking
GPT-4o, GPT-4.5, Claude Sonnet, Grok
Kemampuan Multimodal (Vision, Audio, Tool)
Beberapa model mendukung lebih dari sekadar teks — mereka dapat memproses gambar, audio, file, dan bahkan menggunakan alat eksternal (tool use).
Vision (Gambar → Teks)
Model
Kemampuan
GPT-4o / GPT-4o-mini
✅ Gambar input/output, edisi, analisis
GPT-Image-2
✅ Generasi & pengeditan gambar tingkat lanjut
Gemini 3.1 Pro
✅ Visi multimodal terintegrasi
Qwen3-VL-235B
✅ Visi kuat untuk dokumen & gambar kompleks
Pixtral Large (Mistral)
✅ Model vision open-weight dari Mistral
Audio (Suara → Teks / Teks → Suara)
Model
Kemampuan
GPT-Realtime-2.1 / 2
✅ Input & output audio real-time
GPT-Audio-1.5
✅ Speech-to-text + text-to-speech
GPT-4o-mini-TTS
✅ TTS ringan
Whisper (OpenAI)
✅ Transkripsi audio
ElevenLabs API
✅ TTS realistis
Tool Use / Agentis
Model
Kemampuan
Claude Fable 5
✅ Tool use canggih, retrieval, coding
GPT-5.6 Sol
✅ Tool use + reasoning lanjut
Grok 4.6
✅ Tool use, file input, coding
Qwen3-235B
✅ Mode beralih thinking/non-thinking + tool use
Command A (Cohere)
✅ Fokus enterprise & RAG
Tabel Harga API (per 1M Token USD)
Catatan penting: Harga dapat bervariasi tergantung provider (OpenRouter, Groq, DeepInfra, dll). Angka di bawah ini merupakan harga resmi dari vendor utama atau rata-rata pasar terendah pada Agustus 2026.
OpenAI
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
GPT-5.6 Sol
$5.00
$30.00
✅
Frontier model
GPT-5.6 Terra
$2.50
$15.00
✅
Versi menengah
GPT-5.6 Luna
$1.00
$6.00
✅
Versi hemat
GPT-5.5 Pro
$30.00
$180.00
✅
6x lipat dari non-Pro
GPT-4o
$2.50
$10.00
❌
Umum, cepat
GPT-4o-mini
$0.15
$0.60
❌
Ringan
GPT-Realtime-2.1
$4.00
$24.00
❌
Audio real-time
Anthropic
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
Claude Fable 5
$10.00
$50.00
✅
Termahal, performa tertinggi
Claude Opus 5
$5.00
$25.00
✅
Setengah harga Fable 5
Claude Sonnet 4.6
$2.00
$10.00
⚠️ Opsional
Extended thinking tersedia
Claude Haiku 4.5
$1.00
$5.00
❌
Cepat dan hemat
Google Gemini
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
Gemini 3.1 Pro
$2.00
$12.00
✅
Termasuk Deep Think (bisa lebih mahal)
Gemini 3.6 Flash
$1.50
$7.50
❌
Performa tinggi, biaya rendah
Gemini 3.5 Flash-Lite
$0.30
$2.50
❌
Hemat, cocok untuk skala besar
Gemini 2.5 Pro
$1.25
$10.00
✅
Legacy, masih tersedia
Gemini 2.0 Flash
$0.10
$0.40
❌
Murah, umum
DeepSeek (China)
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
DeepSeek V4 Flash
~$0.28
~$1.32
✅
Naik setelah 16 Agustus
DeepSeek V4 Pro
~$1.74
~$3.96
✅
34x lebih murah dari Claude di input
DeepSeek V3
$0.14
$0.28
❌
Legacy
DeepSeek R1
$0.55
$2.19
✅
Fokus pada reasoning
Qwen (Alibaba)
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
Qwen3-235B-A22B
~$0.20
~$0.60
✅
Mode beralih, MoE 235B
Qwen3-VL-235B-Thinking
$0.45
$3.49
✅
Visi + thinking
Qwen3-235B-Instruct
~$0.20
~$0.60
❌
Non-thinking
Qwen3-32B
~$0.15
~$0.30
⚠️ Opsional
Ringan
Grok (xAI / SpaceXAI)
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
Grok 4.6
$2.00
$6.00
✅
Frontier model, 500K konteks
Grok 4.3
$1.25
$2.50
✅
Versi lebih hemat
Grok 4.20
$1.25
$2.50
✅
Reasoning tinggi
Grok 4.1 Fast
$0.20
$0.50
❌
Ringan
Mistral AI (Prancis)
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
Mistral Large 3
$0.50
$1.50
❌
Open weights, EU residency
Mistral Medium 3.5
$1.50
$7.50
❌
Seimbang kualitas/harga
Codestral 2508
$0.30
$0.90
❌
Fokus kode
Pixtral Large
$2.00
$6.00
❌
Vision
Kimi / Moonshot & Phi (Microsoft)
Model
Input ($/1M)
Output ($/1M)
Thinking Mode
Catatan
Kimi K3
$3.00
$15.00
✅
Flagship, 1M konteks
Kimi K2.6
$0.95
$4.00
❌
Umum
Phi-4
$0.07
$0.14
❌
Ringan, on-device
Catatan Penting: Peak / Off-Peak Pricing dari DeepSeek
DeepSeek adalah produsen pertama yang memperkenalkan sistem tarif bergumuru — tempat biaya bergantung pada waktu permintaan dikirimkan.
Peak hours: 01:00–04:00 UTC & 06:00–10:00 UTC
Off-peak: Semua sisa waktu
Mulai 16 Agustus 2026, tarif naik secara signifikan:
Kumpulan berita coding, web dev & AI paling menarik minggu ini (Kamis, 13 Agustus 2026). Dari rilis Laravel 13.25, TypeScript 7, DeepSeek V4 Pro, sampai peringatan keamanan supply-chain. Berikut 8 yang paling worth-it buat developer.
1. Laravel 13.25: Pause Semua Queue + UI Baru artisan dev
Laravel rilis minor 13.25 dengan tambahan yang menyenangkan buat developer. Kali ini ada perintah queue:pause --all yang bisa menjeda semua queue di semua koneksi sekaligus — berguna saat ada deploy atau maintenance. Selain itu, perintah artisan dev kini berjalan di tabbed terminal UI yang lebih rapi, dan route kini bisa langsung mengembalikan gambar.
Anders Hejlsberg mendemokan TypeScript 7 yang konon punya speedup 10x dibanding versi sebelumnya. Kabar ini jadi topik hangat di JavaScript Weekly. Buat proyek besar yang kompilasinya pelan, ini kabar yang sangat ditunggu-tunggu komunitas JS.
3. DeepSeek V4 Pro 0813 Rilis — Model Open Source Terbaru
DeepSeek merilis V4 Pro 0813, model open source terbaru mereka yang langsung ramai dibahas (951 poin di Hacker News). Seperti rilisan DeepSeek sebelumnya, kehadirannya menarik perhatian karena performa kompetitif dengan biaya yang cenderung lebih rendah, dan kini sudah tersedia lewat API.
4. Grok 4.6 Rilis, Skor 61 di Artificial Analysis Index
xAI meluncurkan Grok 4.6 yang mencatat skor 61 pada Artificial Analysis Intelligence Index. Rilis ini menjadi salah satu perbincangan terbesar minggu ini (569–575 poin HN), termasuk analisis benchmark yang membedah kekuatan dan kelemahannya dibanding model lain.
5. ChatGPT Desktop (Codex Desktop) Kini Tersedia untuk Linux
Kabar baik buat developer Linux: aplikasi desktop ChatGPT/Codex kini tersedia untuk Linux. Banyak developer yang selama ini memakai Codex CLI lewat terminal kini bisa mencoba pengalaman desktop native. Menjadi salah satu topik developer tools paling dibicarakan pekan ini.
6. Watermark Baru Anthropic Bikin Pengguna Claude Geram
Anthropic memperkenalkan sistem watermarking baru pada Claude yang ramai diprotes pengguna. Banyak yang khawatir watermark ini akan “ketahuan” saat mereka pakai Claude untuk keperluan kerja atau tugas kuliah. Ini jadi pengingat penting soal kebijakan AI, privasi, dan pro/kontra pendeteksian konten.
7. Terabyte Kredensial Bocor dalam Serangan Supply-Chain
Ada peringatan keamanan serius pekan ini: terabyte kredensial bocor lewat serangan supply-chain yang menyasar sebuah package AI yang disusupi. Datanya disisir dan dieksfiltrasi dari 2.500 pengguna. Cocok jadi pengingat untuk periksa keamanan dependency dan supply-chain di proyek kamu.
Buat pengguna Laravel, Laracon US 2026 baru saja berlangsung dan menghasilkan banyak pengumuman — mulai dari fitur baru, tooling, sampai arah pengembangan framework ke depan. Kalau sempat, artikel rekap ini wajib dibaca biar nggak ketinggalan.
Kemarin saya bahas cara kerja agentic AI coding dengan OpenCode sebagai studi kasus. Hari ini saya bandingkan tiga tool yang paling populer saat ini: OpenCode, Claude Code, dan Codex CLI. Semua angka repo diambil langsung dari GitHub API tanggal 11 Agustus 2026, dan detail fitur dari README/dokumentasi resmi masing-masing.
Sekilas Perbandingan
Aspek
OpenCode
Claude Code
Codex CLI
Pengembang
Komunitas (Anomaly)
Anthropic
OpenAI
Lisensi
MIT (open source)
Terms komersial Anthropic (repo publik, bukan lisensi OSI)
CLI lokal, desktop app, IDE (VS Code/Cursor/Windsurf), Codex Web (cloud)
OpenCode — Open Source Penuh & Bebas Model
Sudah saya bahas detail kemarin: lisensi MIT, provider-agnostic (bisa pakai model apa saja termasuk model lokal via Ollama), TUI-first, dengan sistem agent yang lengkap (primary: build/plan; subagent: general/explore/scout) dan tool bawaan bash, edit file, grep/glob, skill, todowrite, webfetch, websearch, sampai tool question untuk bertanya balik ke user. Punya dukungan MCP, LSP, dan custom tools.
Kekuatan utamanya: transparan dan tidak terikat vendor — kode terbuka (MIT), dan modelnya bisa diganti-ganti. Cocok kalau kamu mau kontrol penuh atas tooling dan tidak mau terkunci ekosistem satu penyedia AI.
Claude Code — Agentic Tool dari Anthropic
Claude Code (repo anthropics/claude-code) adalah agentic coding tool yang hidup di terminal: memahami codebase, mengeksekusi tugas rutin, menjelaskan kode kompleks, dan menangani workflow git lewat perintah bahasa alami. Bisa dipakai di terminal, IDE, atau mention @claude langsung di GitHub. Repo ini juga memuat beberapa plugin resmi yang menambah custom commands dan agents.
Catatan jujur dari README resmi: repo-nya publik tapi bukan open source OSI — didistribusikan di bawah Commercial Terms of Service Anthropic. Ada juga kebijakan data collection: Anthropic mengumpulkan data penggunaan (feedback, data percakapan), dengan beberapa safeguard privasi. Kalau kamu sensitif soal data, ini penting untuk diperhitungkan. Instalasi via npm sudah deprecated — disarankan curl -fsSL https://claude.ai/install.sh | bash, Homebrew, atau WinGet.
Codex CLI — Coding Agent dari OpenAI
Codex CLI (repo openai/codex, lisensi Apache-2.0) adalah coding agent dari OpenAI yang berjalan lokal di komputer. Uniknya, ia terintegrasi dengan ekosistem OpenAI: bisa sign in dengan akun ChatGPT (plan Plus/Pro/Business/Edu/Enterprise) atau pakai API key. Bentuknya beragam: CLI lokal, desktop app (codex app), ekstensi IDE untuk VS Code/Cursor/Windsurf, plus versi cloud-nya bernama Codex Web (chatgpt.com/codex).
Buat yang sudah berlangganan ChatGPT, ini jalur paling mulus: pakai kuota plan tanpa mikir API key. Source code CLI-nya sendiri open source (Apache-2.0), jadi bisa diaudit dan di-build sendiri.
Sudah di ekosistem Claude / butuh integrasi GitHub (@claude)
Claude Code
Matang dari Anthropic, ada plugin resmi; terima lisensi komersial & data collection
Sudah langganan ChatGPT, mau integrasi IDE + cloud
Codex CLI
Apache-2.0, sign-in ChatGPT plan, ada desktop app & Codex Web
Kesimpulan
Ketiganya sama-sama agentic (loop: panggil tool → lihat hasil → iterasi), bedanya di ekosistem dan lisensi. OpenCode paling terbuka dan fleksibel soal model; Codex paling nyambung buat pengguna ChatGPT; Claude Code paling matang kalau kamu sudah di dunia Claude. Tidak ada yang “paling bagus” mutlak — pilih berdasarkan langganan yang kamu punya dan seberapa penting open source + privasi data buatmu.
Komentar Terbaru