شرح جيد لكن سريع بعض الشيء.
Membangun Aplikasi AI Multimodal: Speech-to-Text dan LLM
Panduan ramah pemula bagi pengembang untuk mengintegrasikan pengenalan suara, analisis gambar, dan LLM multimodal ke dalam aplikasi modern menggunakan API standar dan pola AI saat ini.
-
💬
Instruktur AI
Tanyakan apa pun tentang pelajaran dan dapatkan jawaban jelas seketika, kapan saja. -
🕐
Mulai kapan saja
Tanpa jadwal atau tenggat — belajar dengan kecepatan sendiri, kapan pun Anda mau. -
🌐
Dalam bahasa Indonesia
Pelajaran, tugas, dan sertifikat — semuanya sepenuhnya dalam bahasa Anda.
Tentang kursus ini
Apa yang Anda dapatkan
-
📜
Sertifikat penyelesaian
Tambahkan ke profil LinkedIn Anda -
💬
Tutor AI pribadi
Bingung di tengah pelajaran? Tanya tutor bawaan kamu apa saja, kapan saja. -
♾️
Akses seumur hidup
Kembali kapan saja, tanpa kedaluwarsa -
📱
Ponsel atau komputer
Berfungsi di mana saja, perangkat apa saja -
💸
Pengembalian 14 hari
Tanpa pertanyaan -
⚡
Singkat dan fokus
2 jam 42 mnt konten praktis
Ulasan (12)
Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.
Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.
Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.
O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.
Bien explicado, aunque algo denso al final.
Ses tanıma kısmı gerçekten iyi anlatılmış.
Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.
Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।
音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。
Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.
Clear intro to multimodal AI basics.
Pelajar lain juga mengambil
Generative AI untuk Seniman Tato: Desain dan Penempatan
AI Voice Cloning: Bangun Suara Digital Pribadi Anda
AI untuk Pengajar ESL: Pelajaran, Teks, dan Tes
Fondasi LLMOps: Mendeploy, Melakukan Versi, dan Memantau LLM
Pertanyaan umum
Apa yang saya butuhkan untuk mengikuti kursus ini? +
Cukup ponsel atau komputer dengan internet. Tidak ada instalasi atau perangkat khusus.
Bagaimana cara membayar? +
Dengan kartu via Stripe. Kami tidak menyimpan detail kartu — Stripe menanganinya dengan aman.
Bisakah saya mendapat refund? +
Ya — refund penuh dalam 14 hari, tanpa pertanyaan.
Berapa lama saya akan punya akses? +
Selamanya. Setelah membeli, kursus jadi milik Anda untuk dikunjungi lagi kapan saja.
Apakah saya akan mendapat sertifikat? +
Ya. Setelah selesai, Anda akan menerima sertifikat yang bisa ditambahkan ke profil LinkedIn.