Pembuat Subtitle Otomatis — SRT & VTT dengan AI

Unggah video atau audio Anda — dapatkan file subtitle SRT atau VTT dengan timing yang mengikuti ucapan, siap diunggah ke YouTube atau diimpor ke CapCut dan Premiere Pro. Lima menit pertama gratis, tanpa akun.

5 menit gratis · tanpa akun · sampai 200 MBDeteksi bahasa otomatis · BI, Inggris, bilingualSRT + VTT · 42 karakter × 2 baris

Letakkan file audio di sini

atau klik untuk memilih

Audio: MP3 · WAV · M4A · FLAC · OGG · AAC · AIFF · WMA · AMR · OPUS

Video: MP4 · MOV · AVI · MKV · WebM · FLV · WMV

Hingga 200 MB · 5 menit pertama gratis, tanpa akun

Pratinjau 5 menit gratis · tanpa akun · file hingga 200 MB · daftar gratis untuk 30 menit dan file hingga 5 GB

Diverifikasi September 2026

Pembuat subtitle otomatis berarti tool AI yang mengubah audio dalam video menjadi file subtitle (SRT atau VTT) dengan timestamp yang tepat. VexaScribe menggunakan Whisper Large-v3 Turbo dari OpenAI dengan deteksi bahasa otomatis. Untuk rujukan: large-v3 dasar mencatat WER ~6,4% untuk Bahasa Indonesia di FLEURS — Turbo yang kami jalankan lebih cepat dan sedikit di bawah angka itu, jadi perlakukan 6,4% sebagai batas atas, bukan hasil kami. Waktu proses: 5–10 menit per jam video. Format ekspor: SRT (universal, untuk YouTube/CapCut/Premiere) dan VTT (HTML5 web, styling CSS). Auto-format max 42 karakter × 2 baris. Lima menit pertama bisa dicoba langsung di halaman ini tanpa akun; dengan akun gratis Anda mendapat 30 menit, tanpa kartu kredit.

Platform mana menerima file subtitle, mana yang tidak?

File SRT yang sama tidak diterima dengan cara yang sama di semua tempat, dan dua platform yang paling banyak dipakai kreator Indonesia sama sekali tidak menerima file dari Anda. Ini yang paling sering membuat orang bingung: subtitle-nya sudah benar, tapi platformnya tidak punya tempat untuk menaruhnya. Di baris yang dokumentasi resminya tidak menjawab, tabel ini menulis “tidak terdokumentasi” daripada menebak.

PlatformCara kirimCatatan
YouTube (video biasa)File subtitleMenerima SRT dan VTT lewat YouTube Studio → Subtitle → Upload with timing. File harus UTF-8; markup styling diabaikan.
YouTube ShortsTidak terdokumentasiYouTube menyatakan caption otomatis mencakup Shorts, tapi tidak menerbitkan apa pun soal mengunggah file Anda sendiri ke sebuah Short. Siapa pun yang memberi jawaban pasti sedang menebak.
Instagram (unggahan organik)Harus burn-inTidak ada jalur untuk mengunggah file subtitle ke Reels atau unggahan organik — caption hanya tersedia sebagai tombol on/off dan sticker otomatis. Kalau Anda ingin mengontrol kata-katanya, subtitle harus dibakar ke videonya.
TikTokTidak terdokumentasiTikTok punya editor caption di dalam aplikasi. Halaman dukungannya tidak bisa kami baca tanpa JavaScript, jadi kami tidak bisa memastikan apakah unggah file SRT didukung. Cara yang pasti bekerja: burn-in.
LinkedIn (video feed)SRT, wajibFile SRT harus sudah terlampir sebelum video bisa diposting. Hanya dari desktop.
FacebookSRTDua aturan yang paling sering membuat unggahan ditolak: ukuran file di bawah 200 KB, dan nama file harus berpola namafile.locale.srt — misalnya video.id_ID.srt.
VimeoSRT atau VTTKeduanya diterima di semua paket; VTT yang direkomendasikan.
Platform podcastTXTTeks biasa untuk show notes dan transkrip episode.

Videonya sudah tayang di YouTube dan Anda hanya butuh teksnya? Transkrip YouTube menerima tautan video langsung. Kalau yang Anda butuhkan sebenarnya transkrip biasa — bukan file subtitle bertimestamp — transkripsi audio ke teks adalah halaman yang tepat.

Subtitle untuk video vertikal punya bentuk yang berbeda

Hampir semua aturan subtitle yang beredar — termasuk patokan 42 karakter × 2 baris yang sering dikutip — ditulis untuk televisi lanskap. Frame 9:16 mengubah hitungannya, dan kalau konten Anda Reels, TikTok, atau Shorts, aturan lanskap itu akan menyesatkan.

 16:9 lanskap9:16 vertikal
Baris per subtitlemaksimal 2maksimal 3
Karakter per baris~37 di area lebar 75%~25 di area lebar 90%
Tinggi baris7–8% dari tinggi frame4,5% dari tinggi frame
Posisisepertiga bawahsedikit lebih tinggi, masih di sepertiga bawah

Dua baris pertama sebenarnya satu aturan yang dilihat dari dua sisi. Frame vertikal lebarnya 1080 piksel sementara lanskap 1920, jadi meski area teksnya diberi jatah lebih lega, tiap baris tetap memuat sekitar sepertiga lebih sedikit karakter. Baris ketiga itu bukan izin untuk menulis lebih panjang — itu kompensasi karena tiap baris memuat lebih sedikit.

Satu saran khas vertikal yang jarang disebut: taruh subtitle sedikit lebih tinggi daripada kebiasaan di lanskap. Di frame 9:16 wajah biasanya berada di paruh atas, dan posisi bawah yang biasa justru menutupi bagian yang penting.

Angka-angka di tabel ini berasal dari BBC Subtitle Guidelines, yang ditulis sebagai rekomendasi dan bukan batas keras. Catatan kejujuran soal sumber: kami tidak berhasil membuka dokumen BBC-nya langsung, jadi kami tidak mencantumkan nomor versi atau tanggal baca — angka-angka ini kami peroleh dari dua sumber sekunder independen yang mencantumkan nilai yang sama. Perlu diketahui juga bahwa sebagian tulisan di internet menyatakan BBC belum punya panduan vertikal sama sekali; tulisan-tulisan itu tampaknya mendahului revisi yang memuat angka di atas.

Apa itu subtitle otomatis?

Subtitle otomatis adalah file teks — SRT atau VTT — yang dihasilkan dari audio sebuah video, berisi kalimat beserta waktu kapan tiap kalimat muncul dan hilang di layar. File ini terpisah dari videonya, jadi satu file yang sama bisa diunggah ke YouTube, diimpor ke editor video, atau disematkan di website Anda sendiri — dan penonton bisa mematikannya kalau tidak perlu.

Untuk kreator Indonesia alasannya praktis: banyak orang menonton tanpa suara, dan di feed vertikal subtitle sering menjadi satu-satunya cara isi video tersampaikan dalam dua detik pertama. Selain itu subtitle membuat konten bisa diakses penonton dengan gangguan pendengaran dan penonton yang sedang belajar bahasa. Kalau tujuan akhirnya Reels atau TikTok, perhatikan bahwa keduanya menuntut subtitle dibakar ke video — lihat tabel platform di atas — dan bahwa aturan panjang barisnya berbeda dari video lanskap.

Contoh Subtitle (Video YouTube)

Ekspor
TXTDOCXSRT
0:00Kreator:Halo teman-teman, hari ini kita bahas tips membuat konten YouTube yang engaging.
0:08Kreator:Tips pertama: pastikan opening 5 detik pertama menarik perhatian viewer.
0:16Kreator:Kedua: pakai subtitle. Banyak orang menonton tanpa suara, terutama di feed.
0:24Kreator:Ketiga: konsistensi upload. Minimal seminggu sekali di jam yang sama.

Sumber Video yang Sering Diproses

YouTube Video
TikTok / Reels
CapCut Export
Screen Recording

Harga sederhana dan transparan

Video 30 menit=~~$0.15 (Rp 2.400)
Video 1 jam=~~$0.30 (Rp 4.800)
Reels 10 menit=~~$0.05 (Rp 800)

Harga dihitung per menit video. Lima menit pertama bisa dicoba tanpa akun; 30 menit disertakan saat mendaftar gratis.

Lihat semua paket

YouTube Auto-Caption vs VexaScribe Subtitle Generator

YouTube Auto-Caption

  • ✗Gratis, otomatis untuk semua video publik
  • ✗Akurasi Bahasa Indonesia bervariasi (60-85%)
  • ✗Tidak bisa edit sebelum publish
  • ✗Speaker separation terbatas
  • ✗Hanya untuk video yang sudah publish di YouTube

Cocok untuk Video YouTube publik dengan audio jernih

VexaScribe (Whisper Large-v3 Turbo)

  • ✓30 menit gratis, lalu mulai $2/bulan
  • ✓Whisper Large-v3 Turbo (rujukan large-v3: FLEURS ID 6,4% WER)
  • ✓Edit di editor built-in sebelum export
  • ✓Speaker separation hingga 50 orang
  • ✓Untuk video di mana saja (belum upload, private, di editor)

Cocok untuk Semua video (draft, private, editing) + akurasi lebih tinggi

Cara Buat Subtitle dalam 3 Langkah

Upload Video atau Audio

Drag & drop file video (MP4, MOV, AVI, MKV, WebM) atau audio (MP3, WAV, M4A). VexaScribe otomatis extract audio dari video — tidak perlu convert dulu. Semua codec didukung (H.264, H.265, AV1, VP9).

AI Generate Subtitle

Whisper Large-v3 Turbo memproses audio, deteksi bahasa otomatis (BI atau bilingual code-switching), generate subtitle dengan timestamp yang tepat, auto-pecah kalimat panjang menjadi baris-baris yang enak dibaca. Catatan: pemecahan default mengikuti kebiasaan video lanskap — untuk 9:16 lihat tabel aturan vertikal di bawah.

Unduh SRT atau VTT

Unduh SRT (universal — YouTube, Vimeo, CapCut, Premiere) atau VTT (pemutar video HTML5, mendukung styling CSS). Perbaikan teks dan timing dilakukan di editor video Anda, atau di editor SRT kami yang saat ini masih berbahasa Inggris.

SRT vs VTT — Format Mana yang Cocok untuk Anda?

Dua format subtitle utama. VexaScribe export keduanya — pilih sesuai target Anda:

🎬 SRT (SubRip)

Format subtitle paling universal. Didukung semua platform: YouTube, Vimeo, TikTok, Instagram, dan semua video editor (CapCut, Premiere, DaVinci, Final Cut, Kdenlive).

Pilih SRT jika: target YouTube/TikTok/Reels, atau perlu import ke video editor untuk styling.

🌐 VTT (Web Video Text Tracks)

Format modern untuk HTML5 video player di website. Support styling CSS, positioning subtitle di layar, dan multi-track (subtitle + captions + description terpisah).

Pilih VTT jika: embed video di website sendiri dengan HTML5 <video> tag, atau perlu styling advanced.

Bimbang? Pilih SRT. Kalau perlu VTT nanti, konversi SRT → VTT sangat mudah (tool online gratis, atau ffmpeg command). SRT adalah standar de facto untuk 99% use case.

Sebelum Anda mengunggah filenya

Hasil subtitle lebih ditentukan oleh audio yang masuk daripada oleh alat yang memprosesnya. Empat hal di bawah ini berada dalam kendali Anda dan pengaruhnya jauh lebih besar daripada memilih layanan yang berbeda.

Unggah audio aslinya, bukan hasil kompresi ulang

Kalau videonya sudah pernah diekspor untuk media sosial, audionya sudah dikompresi sekali. Ekspor ulang dari proyek aslinya kalau masih ada. File audio terpisah (MP3, WAV, M4A) juga diterima langsung — lihat MP3 ke teks kalau sumbernya memang hanya audio.

Turunkan musik latar kalau Anda yang mengatur mixnya

Musik di bawah suara orang bicara adalah penyebab kesalahan yang paling mudah dihindari. Kalau Anda masih memegang proyeknya, ekspor satu versi khusus untuk transkripsi dengan trek musik dimatikan, lalu pakai SRT-nya di video final yang musiknya tetap ada.

Siapkan daftar nama dan istilah

Nama orang, nama merek, nama tempat, dan istilah teknis adalah yang paling sering salah tulis — model tidak pernah melihat kata-kata itu di data latihnya. Lebih cepat memperbaikinya dengan find-and-replace sekali jalan setelah subtitle jadi daripada membacanya satu per satu.

Coba satu menit dulu sebelum memproses file panjang

Pratinjau lima menit di halaman ini tidak memerlukan akun. Untuk rekaman yang kondisinya meragukan — ruang bergema, beberapa orang bicara bersamaan, rekaman lapangan — memeriksa satu menit lebih dulu memberi tahu Anda lebih banyak daripada tabel benchmark siapa pun.

Soal akurasi — dan kenapa kami tidak menerbitkan satu angka

Beberapa layanan memasang “99% akurat” di judul halamannya. Kami tidak menerbitkan angka akurasi untuk alat ini, dan alasannya bukan kerendahan hati: satu angka yang diukur di audio benchmark yang bersih hampir tidak memberi tahu apa pun tentang rekaman Anda. Rekaman rapat di ruang bergema dan podcast dengan mikrofon lavalier tidak akan pernah menghasilkan angka yang sama, dan angka rata-rata di antara keduanya tidak menggambarkan keduanya.

Angka yang bisa Anda periksa sendiri

Whisper large-v3 mencatat Word Error Rate ~6,4% untuk Bahasa Indonesia di FLEURS, benchmark Google Research untuk 102 bahasa — setara sekitar 94% akurasi kata pada audio jernih yang dibaca dengan tempo alami. Dua catatan penting: angka itu untuk large-v3 dasar, sementara kami menjalankan Large-v3 Turbo yang lebih cepat dengan sedikit pengorbanan akurasi — jadi perlakukan 6,4% sebagai batas atas, bukan sebagai hasil kami. Dan FLEURS mengukur ucapan yang dibacakan, bukan video Anda. Sumber: arXiv:2212.04356.

Yang secara konsisten menurunkan akurasi bisa diprediksi: musik latar di bawah suara bicara, dua orang bicara bersamaan, dan nama serta istilah teknis yang tidak pernah ada di data latih. Yang membantu: satu pembicara, ruang yang tidak bergema, tempo bicara normal. Perbedaan antar kondisi ini jauh lebih besar daripada perbedaan antar layanan.

Catatan bahasa daerah

Whisper dilatih untuk Bahasa Indonesia standar. Video BI standar dengan aksen daerah umumnya tetap tertangani baik. Tetapi dialog yang benar-benar berbahasa Jawa, Sunda, Batak, atau Minang adalah kasus yang berbeda — akurasinya turun jelas, dan kami tidak akan menyebut angka penurunannya karena kami belum mengukurnya. Untuk konten seperti itu, rencanakan penyuntingan manual sejak awal atau gunakan transkripsi manusia.

Cara paling cepat untuk tahu: proses satu menit audio Anda sendiri di alat di atas dan baca hasilnya. Itu memakan waktu lebih sedikit daripada membaca tabel benchmark siapa pun, dan satu-satunya pengukuran yang benar-benar mengukur hal yang Anda pedulikan. Untuk keperluan formal — konten edukasi bersertifikat, materi hukum, rekaman medis, atau wawancara riset yang kutipannya akan dipublikasikan — rencanakan satu putaran review manusia, apa pun alat yang membuat drafnya. Untuk transkrip wawancara riset dan skripsi, halaman transkripsi wawancara membahas kebutuhan itu lebih spesifik.

Praktik Terbaik Subtitle untuk Kreator Indonesia

Lima aturan praktis untuk subtitle yang readable dan professional:

  • 1.
    Max 42 karakter per baris, 2 baris per subtitle — standar Netflix. Baris lebih panjang sulit dibaca dalam 2-3 detik.
  • 2.
    Durasi 1–6 detik per subtitle — kurang dari 1 detik terlalu cepat, lebih dari 6 detik terlalu lama (viewer sudah baca ulang).
  • 3.
    Reading speed max 17 karakter/detik — hitung: total karakter subtitle ÷ durasi tampil. Jika > 17, split menjadi 2 subtitle terpisah.
  • 4.
    Split di natural pause — pecah kalimat panjang di titik/koma/konjungsi ("dan", "tapi", "kemudian") — bukan di tengah frasa.
  • 5.
    Konsistensi punctuation — pilih: pakai titik di akhir semua subtitle, atau tidak sama sekali. Jangan campur.

VexaScribe otomatis apply aturan #1, #2, dan #3. Aturan #4 dan #5 memerlukan review manual di editor built-in (biasanya 2–5 menit untuk video 10 menit).

Fitur Pembuat Subtitle

Semua yang dibutuhkan untuk buat subtitle SRT/VTT professional dengan cepat

Dilatih kuat untuk Bahasa Indonesia

Whisper Large-v3 Turbo, dengan deteksi bahasa otomatis dan penanganan code-switching BI–Inggris. Cocok untuk video YouTube, TikTok Reels, podcast video, dan konten kreator BI standar. Angka akurasi untuk audio Anda sendiri paling baik dilihat dengan mencobanya langsung.

Cepat: 1 Jam Video → 5-10 Menit

Upload, tutup tab, kerja hal lain — subtitle siap saat balik. Cocok untuk kreator yang upload mingguan dengan deadline ketat.

SRT + VTT dengan Timing Tepat

Export SRT (universal, YouTube/Vimeo/video editor) atau VTT (HTML5, styling CSS). Timestamp presisi, auto-format max 42 karakter × 2 baris (industri standar).

99 Bahasa + Auto-Detection

Video BI, English, atau bilingual code-switching (BI + English mixed — umum di tech content Indonesia) di-handle otomatis. Tidak perlu pilih bahasa manual.

Multi-Speaker Support

Untuk video dengan multi-speaker (panel discussion, wawancara video, podcast video), speaker separation otomatis — subtitle include speaker labels jika perlu.

Privasi Terjaga

File dienkripsi TLS saat upload, AES-256 saat disimpan. Bisa hapus kapan saja. Tidak digunakan untuk training AI. Copyright video Anda tetap milik Anda.

Pertanyaan Umum tentang Pembuat Subtitle

Apa bedanya SRT dan VTT? Mana yang harus saya pilih?

SRT (SubRip Text) adalah format subtitle paling universal — didukung oleh YouTube, Vimeo, semua video editor (Premiere, CapCut, DaVinci, Final Cut, Kdenlive), dan hampir semua media player. VTT (Web Video Text Tracks) lebih modern, dirancang untuk HTML5 video player di website dan mendukung styling CSS + posisi subtitle. Pilih SRT jika target Anda YouTube atau editing video. Pilih VTT jika Anda menyematkan video di website sendiri. VexaScribe mengekspor keduanya — formatnya dipilih saat mengunduh.

Berapa panjang maksimal per baris subtitle?

Tergantung bentuk framenya, dan ini yang paling sering salah. Untuk video lanskap 16:9 patokan umumnya 37–42 karakter per baris dan maksimal 2 baris. Untuk video vertikal 9:16 — Reels, TikTok, Shorts — BBC Subtitle Guidelines menyarankan maksimal 3 baris tapi hanya sekitar 25 karakter per baris, karena frame vertikal hanya 1080 piksel lebarnya. Baris ketiga itu bukan izin untuk menulis lebih banyak; itu kompensasi karena tiap baris memuat lebih sedikit. Lihat tabel aturan vertikal di halaman ini untuk angka lengkapnya.

Apakah ini sama dengan "subtitle generator" yang berbahasa Inggris?

Sama. "subtitle generator", "auto subtitle generator", dan "video to subtitle" adalah nama internasional untuk kategori alat yang sama — istilah Inggris memang lazim dipakai di Indonesia karena dokumentasi YouTube Studio, CapCut, dan tutorial editing video menggunakannya. Alatnya satu, dan bahasa keluarannya mengikuti bahasa di audio Anda, bukan bahasa istilah pencarian: video Bahasa Indonesia menghasilkan subtitle Bahasa Indonesia, video Inggris menghasilkan subtitle Inggris, dan video campur kode BI–Inggris ditangani di kedua bahasa.

Apakah subtitle bisa langsung diupload ke YouTube?

Ya, langsung. Setelah export SRT dari VexaScribe: (1) Buka YouTube Studio → pilih video Anda → menu kiri "Subtitle" → pilih bahasa → "Upload with timing", (2) Upload file .srt Anda — YouTube otomatis sync dengan video. Untuk multi-bahasa (misalnya BI + English subtitle), upload dua file terpisah dengan tag bahasa yang berbeda. Keuntungan utamanya dibanding caption otomatis YouTube bukan soal angka akurasi, tapi kontrol: Anda membaca dan memperbaiki teksnya sebelum diunggah, dan bisa menyimpan file yang sama untuk dipakai di platform lain.

Bagaimana cara memasukkan SRT ke CapCut, Premiere Pro, atau DaVinci Resolve?

Semua editor video besar menerima impor SRT, dan letak menunya berbeda-beda: CapCut lewat Import lalu tarik file ke timeline; Premiere Pro lewat Window → Text → Captions; DaVinci Resolve lewat Subtitle Settings di halaman Deliver; Final Cut Pro lewat File → Import → Captions. Setelah masuk, font, warna, dan posisi diatur di editor tersebut — bukan di file SRT-nya, yang hanya menyimpan teks dan waktu. Kalau tujuan akhirnya Reels atau TikTok, atur gaya teks mengikuti aturan vertikal di tabel halaman ini sebelum render.

Bisakah saya buat subtitle burn-in (permanen di video)?

VexaScribe menghasilkan file SRT/VTT (sidecar subtitle) — subtitle terpisah dari video. Untuk burn-in (subtitle jadi bagian video permanen), Anda perlu video editor: import SRT ke CapCut/Premiere/DaVinci → render/export video dengan subtitle enabled. Sidecar SRT lebih fleksibel (viewer bisa on/off, ganti bahasa, style di YouTube), tapi burn-in lebih cocok untuk media sosial (Instagram Reels, TikTok) di mana viewer biasanya scroll dengan silent mode.

Bagaimana akurasi untuk Bahasa Indonesia?

Angka yang bisa diverifikasi: Whisper large-v3 mencapai Word Error Rate ~6,4% untuk Bahasa Indonesia di benchmark FLEURS Google Research (arXiv:2212.04356). Satu hal yang perlu kami sebutkan terus terang — kami menjalankan Whisper Large-v3 Turbo, bukan large-v3 dasar. Turbo jauh lebih cepat dan sebagai gantinya sedikit kurang akurat, jadi angka FLEURS di atas adalah batas atas dari apa yang kami hasilkan, bukan deskripsi hasil kami. Perkiraan arah untuk kondisi lain (video HP, vlog dengan musik latar, rekaman luar ruangan) memang lebih rendah lagi, tapi kami belum mengukurnya terhadap set referensi berlabel dan tidak akan menyajikannya seolah sudah. Cara paling jujur untuk tahu: proses satu file Anda sendiri di alat di halaman ini — lima menit pertama gratis tanpa akun. Catatan dialek: BI standar dengan aksen daerah (Jawa/Sunda/Batak) umumnya tetap baik; video berbahasa daerah aktif (Jawa asli, Sunda asli) turun signifikan karena data latih model adalah BI standar.

Format video/audio apa saja yang didukung?

Video: MP4, MOV, AVI, MKV, WebM, WMV, FLV. Audio: MP3, WAV, M4A, FLAC, OGG, AAC, WMA, OPUS (termasuk WhatsApp voice note). VexaScribe otomatis extract audio dari file video — Anda tidak perlu convert dulu. Video codec (H.264, H.265, AV1, VP9) tidak berpengaruh karena hanya audio track yang diproses. Ukuran maksimum 5 GB per file.

Bisakah saya buat subtitle dalam dua bahasa sekaligus (dual subtitle)?

VexaScribe hasilkan subtitle dalam bahasa audio (deteksi otomatis). Untuk dual subtitle (BI + English di layar bersamaan), workflow-nya: (1) Buat SRT bahasa asli (misalnya BI), (2) Translate ke bahasa kedua manual atau dengan translation tool, (3) Upload dua SRT terpisah ke YouTube dengan tag bahasa berbeda — viewer pilih bahasa mana yang mau ditampilkan. Untuk burn-in dual subtitle di CapCut/Premiere, import dua SRT sebagai text track terpisah dan atur posisi (BI di bawah, English di atas atau sebaliknya).

Berapa biaya buat subtitle?

30 menit pertama gratis — tanpa kartu kredit. Setelah itu: Starter US$2/bulan (~Rp 32.000) untuk 200 menit, Basic US$5/bulan (~Rp 80.000) untuk 1.000 menit (~17 jam), Pro US$10/bulan untuk 2.500 menit, Studio US$20/bulan untuk 6.000 menit. Untuk YouTuber yang upload mingguan (30-60 menit per video), Basic biasanya cukup. Untuk kreator TikTok/Reels dengan volume tinggi, Pro atau Studio.

Catatan: Akurasi subtitle tergantung kualitas audio dalam video (mikrofon, background noise, overlap). Untuk konten publikasi formal, review manual subtitle sebelum export disarankan. Angka WER 6,4% adalah untuk Whisper large-v3 dasar di FLEURS Indonesian (arXiv:2212.04356); layanan ini menjalankan Large-v3 Turbo, yang sedikit di bawah angka tersebut. Diverifikasi September 2026.