音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。
Membangun Aplikasi AI Multimodal: Speech-to-Text dan LLM
Panduan ramah pemula bagi pengembang untuk mengintegrasikan pengenalan suara, analisis gambar, dan LLM multimodal ke dalam aplikasi modern menggunakan API standar dan pola AI saat ini.
-
💬
Instruktur AI
Tanyakan apa pun tentang pelajaran dan dapatkan jawaban jelas seketika, kapan saja. -
🕐
Mulai kapan saja
Tanpa jadwal atau tenggat — belajar dengan kecepatan sendiri, kapan pun Anda mau. -
🌐
Dalam bahasa Indonesia
Pelajaran, tugas, dan sertifikat — semuanya sepenuhnya dalam bahasa Anda.
Tentang kursus ini
Apa yang Anda dapatkan
-
📜
Sertifikat penyelesaian
Tambahkan ke profil LinkedIn Anda -
💬
Tutor AI pribadi
Bingung di tengah pelajaran? Tanya tutor bawaan kamu apa saja, kapan saja. -
♾️
Akses seumur hidup
Kembali kapan saja, tanpa kedaluwarsa -
📱
Ponsel atau komputer
Berfungsi di mana saja, perangkat apa saja -
💸
Pengembalian 14 hari
Tanpa pertanyaan -
⚡
Singkat dan fokus
2 jam 42 mnt konten praktis
Sertifikat penyelesaian
Setiap kursus yang Anda selesaikan di PickAClass menerbitkan kredensial seperti ini — orisinal, dengan kodenya sendiri, dapat diverifikasi via URL, dan rinci tentang yang benar-benar ditunjukkan.
Ulasan (12)
Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.
Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.
Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.
Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.
Bien explicado, aunque algo denso al final.
Ses tanıma kısmı gerçekten iyi anlatılmış.
O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.
شرح جيد لكن سريع بعض الشيء.
Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.
Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।
Clear intro to multimodal AI basics.
Pelajar lain juga mengambil
AI Swasta dengan LLM Sumber Terbuka: Pemasangan Lokal, RAG, dan Agen
Fine-Tuning OpenAI Models: Customize LLMs with Your Own Data (dalam bahasa Inggris).
Pengembangan Sistem RAG dengan Azure OpenAI dan Azure AI Search
Pengembangan Aplikasi AI dengan LangChain
Pertanyaan umum
Apa yang saya butuhkan untuk mengikuti kursus ini? +
Cukup ponsel atau komputer dengan internet. Tidak ada instalasi atau perangkat khusus.
Bagaimana cara membayar? +
Dengan kartu via Stripe. Kami tidak menyimpan detail kartu — Stripe menanganinya dengan aman.
Bisakah saya mendapat refund? +
Ya — refund penuh dalam 14 hari, tanpa pertanyaan.
Berapa lama saya akan punya akses? +
Selamanya. Setelah membeli, kursus jadi milik Anda untuk dikunjungi lagi kapan saja.
Apakah saya akan mendapat sertifikat? +
Ya. Setelah selesai, Anda akan menerima sertifikat yang bisa ditambahkan ke profil LinkedIn.
Dapatkan 10 kursus per bulan
Anggota mendapat 10 kursus pilihan setiap bulan seharga Rp 0. Tanpa biaya per kursus — kamu hanya membayar langganan.
- ✓ 10 kursus setiap bulan
- ✓ Batalkan kapan saja
Diperpanjang tiap bulan. Kursus yang tidak dipakai hangus di akhir setiap bulan tagihan.