Cohere Luncurkan Model Open Source untuk Pengenalan Suara
Cohere, perusahaan AI asal Kanada, baru saja meluncurkan model open source untuk pengenalan suara yang disebut "Transcribe". Model ini diklaim memiliki akurasi yang sangat tinggi, dengan rata-rata word error rate sebesar 5,42 persen, mengungguli kompetitor lain seperti OpenAI's Whisper Large v3, ElevenLabs Scribe v2, dan Qwen3-ASR-1.7B.
Detail Teknis
Transcribe memiliki 2 miliar parameter dan mendukung 14 bahasa, termasuk Inggris, Jerman, Perancis, dan Jepang. Model ini tersedia untuk diunduh di bawah lisensi Apache 2.0 pada Hugging Face dan juga dapat diakses melalui API dan Model Vault platform.
Fitur Utama
- Akurasi tinggi: Transcribe memiliki rata-rata word error rate sebesar 5,42 persen, mengungguli kompetitor lain
- Dukungan bahasa: Mendukung 14 bahasa, termasuk Inggris, Jerman, Perancis, dan Jepang
- Open source: Tersedia untuk diunduh di bawah lisensi Apache 2.0
Pendapat Geek
Model Transcribe ini sangat menarik, terutama karena akurasi yang sangat tinggi dan dukungan bahasa yang luas. Dengan demikian, model ini dapat digunakan dalam berbagai aplikasi, seperti pengenalan suara pada perangkat mobile atau pengenalan suara pada sistem operasi.



