ActiveAPI Model ID: "whisper-1"Sumber: Official Docs
Whisper (Large v2/v3)
Model pengenalan suara otomatis (Automatic Speech Recognition / ASR) multibahasa. Mampu mentranskripsi audio ke teks dan menerjemahkan berbagai bahasa ke bahasa Inggris dengan akurasi sangat tinggi.
Rilis: 1 Maret 2023
Terakhir diverifikasi: 6 Oktober 2026
Ringkasan & Fungsi Model
Model pengenalan suara otomatis (Automatic Speech Recognition / ASR) multibahasa. Mampu mentranskripsi audio ke teks dan menerjemahkan berbagai bahasa ke bahasa Inggris dengan akurasi sangat tinggi.
Spesifikasi Teknis
API Model IDwhisper-1
Jendela Konteks (Context Window)25.000 token
Batas Output Maksimal4.096 token
Knowledge CutoffBukan Model Teks LLM
Kemampuan ReasoningStandar Autoregresif
Tipe Input & OutputInput: Teks + Audio • Output: Teks
Daftar Kemampuan (Capabilities)
Pemrosesan Teks
Image Input (Vision)
Image Generation
Audio Input
Audio Output
Function Calling (Tools)
Structured Outputs (JSON)
Web Search
File Search
Computer Use
Tabel Harga Resmi API
| Jenis Token | Tarif per 1M Token (USD) | Estimasi Kurs Rupiah (IDR) |
|---|---|---|
| Input Tokens (Prompt Baru) | $6.00 per 1M token | ≈ Rp 96.000 / 1M |
| Cached Input Tokens (Diskon 50%) | $6.00 per 1M token | ≈ Rp 96.000 / 1M |
| Output Tokens (Respon Dihasilkan) | Gratis ($0.00) | ≈ Rp 0 / 1M |
*Harga dapat berubah. Periksa dokumentasi resmi OpenAI untuk harga terbaru.
Cocok untuk Penggunaan:
- Transkripsi notulensi rapat dan wawancara rekaman
- Pembuatan subtitle otomatis pada video YouTube / film
- Penerjemahan lisan ke teks Inggris
Tidak Cocok untuk / Keterbatasan:
- Pembuatan suara sintetis (Gunakan model TTS)
Informasi Validitas & Sumber Resmi
Seluruh data spesifikasi di halaman ini dirujuk langsung dari portal dokumentasi resmi pengembang: