ActiveAPI Model ID: "whisper-1"Sumber: Official Docs

Whisper (Large v2/v3)

Model pengenalan suara otomatis (Automatic Speech Recognition / ASR) multibahasa. Mampu mentranskripsi audio ke teks dan menerjemahkan berbagai bahasa ke bahasa Inggris dengan akurasi sangat tinggi.

Rilis: 1 Maret 2023
Terakhir diverifikasi: 6 Oktober 2026

Ringkasan & Fungsi Model

Model pengenalan suara otomatis (Automatic Speech Recognition / ASR) multibahasa. Mampu mentranskripsi audio ke teks dan menerjemahkan berbagai bahasa ke bahasa Inggris dengan akurasi sangat tinggi.

Spesifikasi Teknis

API Model IDwhisper-1
Jendela Konteks (Context Window)25.000 token
Batas Output Maksimal4.096 token
Knowledge CutoffBukan Model Teks LLM
Kemampuan ReasoningStandar Autoregresif
Tipe Input & OutputInput: Teks + Audio • Output: Teks

Daftar Kemampuan (Capabilities)

Pemrosesan Teks
Image Input (Vision)
Image Generation
Audio Input
Audio Output
Function Calling (Tools)
Structured Outputs (JSON)
Web Search
File Search
Computer Use

Tabel Harga Resmi API

Jenis TokenTarif per 1M Token (USD)Estimasi Kurs Rupiah (IDR)
Input Tokens (Prompt Baru)$6.00 per 1M token≈ Rp 96.000 / 1M
Cached Input Tokens (Diskon 50%)$6.00 per 1M token≈ Rp 96.000 / 1M
Output Tokens (Respon Dihasilkan)Gratis ($0.00)≈ Rp 0 / 1M

*Harga dapat berubah. Periksa dokumentasi resmi OpenAI untuk harga terbaru.

Cocok untuk Penggunaan:

  • Transkripsi notulensi rapat dan wawancara rekaman
  • Pembuatan subtitle otomatis pada video YouTube / film
  • Penerjemahan lisan ke teks Inggris

Tidak Cocok untuk / Keterbatasan:

  • Pembuatan suara sintetis (Gunakan model TTS)

Informasi Validitas & Sumber Resmi

Seluruh data spesifikasi di halaman ini dirujuk langsung dari portal dokumentasi resmi pengembang:

https://platform.openai.com/docs/models/whisper•Terakhir diverifikasi: 6 Oktober 2026

Model Terkait Lainnya