شرح جيد لكن سريع بعض الشيء.
Créer des applications d'IA multimodales : Speech-to-Text et LLMs
Un guide accessible aux débutants pour permettre aux développeurs d'intégrer la reconnaissance vocale, l'analyse d'images et les LLMs multimodaux dans des applications modernes à l'aide d'APIs standards et de modèles d'IA actuels.
-
💬
Instructeur IA
Posez une question sur n'importe quelle leçon et obtenez une réponse claire à tout moment. -
🕐
Commencez quand vous voulez
Sans horaires ni délais : apprenez à votre rythme, quand vous voulez. -
🌐
En français
Leçons, exercices et certificat : tout entièrement dans votre langue.
À propos de ce cours
Ce que vous recevez
-
📜
Certificat de fin
Ajoutez-le à votre profil LinkedIn -
💬
Tuteur AI personnel
Bloqué sur une leçon ? Pose n'importe quelle question à ton tuteur intégré, à tout moment. -
♾️
Accès à vie
Revenez quand vous voulez, sans expiration -
📱
Téléphone ou ordinateur
Fonctionne partout, sur tout appareil -
💸
Remboursement 14 jours
Sans poser de questions -
⚡
Court et ciblé
2 h 42 min de contenu pratique
Avis (12)
Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.
Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.
Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.
O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.
Bien explicado, aunque algo denso al final.
Ses tanıma kısmı gerçekten iyi anlatılmış.
Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.
Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।
音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。
Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.
Clear intro to multimodal AI basics.
Autres apprenants ont aussi suivi
IA privée avec LLMs Open-Source : Déploiement Local, RAG et Agents
Affinage des modèles OpenAI : Personnalisez les LLM avec vos propres données
Développement de systèmes RAG avec Azure OpenAI et Azure AI Search
AI Voice Cloning : Créez votre voix numérique personnelle
Questions fréquentes
De quoi ai-je besoin pour suivre ce cours ? +
Un téléphone ou un ordinateur avec internet, c'est tout. Aucune installation, aucun matériel spécial.
Comment payer ? +
Par carte via Stripe. Nous ne stockons pas les données de carte — Stripe les gère de manière sécurisée.
Puis-je obtenir un remboursement ? +
Oui — remboursement complet sous 14 jours, sans question.
Combien de temps aurai-je accès ? +
À vie. Une fois acheté, le cours est à vous, vous pouvez y revenir quand vous voulez.
Vais-je obtenir un certificat ? +
Oui. À la fin, vous recevez un certificat à ajouter à votre profil LinkedIn.