VoiceScript: Implementasi Web Transkripsi Audio Berbasis API Groq dan LLaMA 3 untuk Otomatisasi Naskah Berita Radio
Keywords:
Arsitektur Serverless, Jurnalisme Otomatis, Large Language Models, Speech-toText, VoiceScriptAbstract
Kebutuhan penyampaian berita yang cepat menuntut jurnalis untuk mengolah rekaman audio mentah menjadi naskah berita terstruktur secara efisien. Penelitian ini menyajikan VoiceScript, sebuah aplikasi web berbasis serverless yang dirancang untuk Radio Kota Batik guna mengotomatisasi transkripsi audio-ke-teks dan pembuatan naskah berita. Sistem ini memanfaatkan API Groq, secara spesifik menggunakan model Whisper Large V3 untuk pengenalan suara bahasa Indonesia yang akurat serta model LLaMA 3.3 70B untuk meringkas transkrip ke dalam struktur jurnalistik piramida terbalik. Dibangun menggunakan arsitektur Monolithic Single-Page Application (SPA) dan di-deploy melalui Vercel, sistem ini menerapkan unggah terpotong (chunked upload) sebesar 4MB dan mekanisme rotasi 5 kunci API untuk mengatasi batasan payload serverless dan pembatasan permintaan (rate limit). Hasil implementasi menunjukkan bahwa VoiceScript secara signifikan mampu memangkas waktu transkripsi manual sekaligus mempertahankan standar format penulisan berita untuk keperluan siaran radio, dengan memanfaatkan penanda jeda spesifik tanpa tanda baca standar.