شرح جيد لكن سريع بعض الشيء.
Créer des applications d'IA multimodales : Speech-to-Text et LLMs
Un guide accessible aux débutants pour permettre aux développeurs d'intégrer la reconnaissance vocale, l'analyse d'images et les LLMs multimodaux dans des applications modernes à l'aide d'APIs standards et de modèles d'IA actuels.
-
💬
Instructeur IA
Posez une question sur n'importe quelle leçon et obtenez une réponse claire à tout moment. -
🕐
Commencez quand vous voulez
Sans horaires ni délais : apprenez à votre rythme, quand vous voulez. -
🌐
En français
Leçons, exercices et certificat : tout entièrement dans votre langue.
À propos de ce cours
Ce que vous recevez
-
📜
Certificat de fin
Ajoutez-le à votre profil LinkedIn -
💬
Tuteur AI personnel
Bloqué sur une leçon ? Pose n'importe quelle question à ton tuteur intégré, à tout moment. -
♾️
Accès à vie
Revenez quand vous voulez, sans expiration -
📱
Téléphone ou ordinateur
Fonctionne partout, sur tout appareil -
💸
Remboursement 14 jours
Sans poser de questions -
⚡
Court et ciblé
2 h 42 min de contenu pratique
Certificat de fin
Chaque cours terminé sur PickAClass délivre un diplôme comme celui-ci — original, avec son propre code, vérifiable par URL et détaillé sur ce qui a été réellement démontré.
Avis (12)
Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.
Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.
Bien explicado, aunque algo denso al final.
Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.
Ses tanıma kısmı gerçekten iyi anlatılmış.
音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。
Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.
Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।
O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.
Clear intro to multimodal AI basics.
Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.
Autres apprenants ont aussi suivi
IA privée avec LLMs Open-Source : Déploiement Local, RAG et Agents
Affinage des modèles OpenAI : Personnalisez les LLM avec vos propres données
Développement de systèmes RAG avec Azure OpenAI et Azure AI Search
AI Voice Cloning : Créez votre voix numérique personnelle
Questions fréquentes
De quoi ai-je besoin pour suivre ce cours ? +
Un téléphone ou un ordinateur avec internet, c'est tout. Aucune installation, aucun matériel spécial.
Comment payer ? +
Par carte via Stripe. Nous ne stockons pas les données de carte — Stripe les gère de manière sécurisée.
Puis-je obtenir un remboursement ? +
Oui — remboursement complet sous 14 jours, sans question.
Combien de temps aurai-je accès ? +
À vie. Une fois acheté, le cours est à vous, vous pouvez y revenir quand vous voulez.
Vais-je obtenir un certificat ? +
Oui. À la fin, vous recevez un certificat à ajouter à votre profil LinkedIn.
Recevez 10 cours par mois
Les membres obtiennent 10 cours au choix chaque mois pour ₼0. Aucun paiement par cours — vous ne payez que l'abonnement.
- ✓ 10 cours chaque mois
- ✓ Annulez à tout moment
Renouvellement mensuel. Les cours non utilisés expirent à la fin de chaque mois de facturation.