شرح جيد لكن سريع بعض الشيء.
Membangun Aplikasi AI Multimodal: Speech-to-Text dan LLM
Panduan ramah pemula bagi pengembang untuk mengintegrasikan pengenalan suara, analisis gambar, dan LLM multimodal ke dalam aplikasi modern menggunakan API standar dan pola AI saat ini.
-
💬
Instruktur AI
Tanyakan apa pun tentang pelajaran dan dapatkan jawaban jelas seketika, kapan saja. -
🕐
Mulai kapan saja
Tanpa jadwal atau tenggat — belajar dengan kecepatan sendiri, kapan pun Anda mau. -
🌐
Dalam bahasa Indonesia
Pelajaran, tugas, dan sertifikat — semuanya sepenuhnya dalam bahasa Anda.
Tentang kursus ini
Apa yang Anda dapatkan
-
📜
Sertifikat penyelesaian
Tambahkan ke profil LinkedIn Anda -
💬
Tutor AI pribadi
Bingung di tengah pelajaran? Tanya tutor bawaan kamu apa saja, kapan saja. -
♾️
Akses seumur hidup
Kembali kapan saja, tanpa kedaluwarsa -
📱
Ponsel atau komputer
Berfungsi di mana saja, perangkat apa saja -
💸
Pengembalian 14 hari
Tanpa pertanyaan -
⚡
Singkat dan fokus
2 jam 42 mnt konten praktis
Sertifikat penyelesaian
Setiap kursus yang Anda selesaikan di PickAClass menerbitkan kredensial seperti ini — orisinal, dengan kodenya sendiri, dapat diverifikasi via URL, dan rinci tentang yang benar-benar ditunjukkan.
Ulasan (12)
Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.
Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.
Bien explicado, aunque algo denso al final.
Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.
Ses tanıma kısmı gerçekten iyi anlatılmış.
音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。
Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.
Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।
O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.
Clear intro to multimodal AI basics.
Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.
Pelajar lain juga mengambil
Generative AI untuk Seniman Tato: Desain dan Penempatan
AI Voice Cloning: Bangun Suara Digital Pribadi Anda
AI untuk Pengajar ESL: Pelajaran, Teks, dan Tes
Fondasi LLMOps: Mendeploy, Melakukan Versi, dan Memantau LLM
Pertanyaan umum
Apa yang saya butuhkan untuk mengikuti kursus ini? +
Cukup ponsel atau komputer dengan internet. Tidak ada instalasi atau perangkat khusus.
Bagaimana cara membayar? +
Dengan kartu via Stripe. Kami tidak menyimpan detail kartu — Stripe menanganinya dengan aman.
Bisakah saya mendapat refund? +
Ya — refund penuh dalam 14 hari, tanpa pertanyaan.
Berapa lama saya akan punya akses? +
Selamanya. Setelah membeli, kursus jadi milik Anda untuk dikunjungi lagi kapan saja.
Apakah saya akan mendapat sertifikat? +
Ya. Setelah selesai, Anda akan menerima sertifikat yang bisa ditambahkan ke profil LinkedIn.
Dapatkan 10 kursus per bulan
Anggota mendapat 10 kursus pilihan setiap bulan seharga 0 ֏. Tanpa biaya per kursus — kamu hanya membayar langganan.
- ✓ 10 kursus setiap bulan
- ✓ Batalkan kapan saja
Diperpanjang tiap bulan. Kursus yang tidak dipakai hangus di akhir setiap bulan tagihan.