شرح جيد لكن سريع بعض الشيء.
Membina Aplikasi AI Multimodal: Speech-to-Text dan LLMs
Panduan mesra pemula untuk pembangun bagi menyepadukan pengecaman pertuturan, analisis imej, dan LLMs multimodal ke dalam aplikasi moden menggunakan API standard dan corak AI semasa.
-
💬
Pengajar AI
Tanya tentang mana-mana pelajaran dan dapatkan jawapan jelas serta-merta, bila-bila masa. -
🕐
Mula bila-bila masa
Tiada jadual atau tarikh akhir — belajar mengikut rentak sendiri, bila-bila masa. -
🌐
Dalam bahasa Melayu
Pelajaran, tugasan dan sijil — semuanya sepenuhnya dalam bahasa anda.
Tentang kursus ini
Apa yang anda dapat
-
📜
Sijil tamat
Tambah ke profil LinkedIn anda -
💬
Tutor AI peribadi
Tersekat dalam pelajaran? Tanya tutor terbina dalam kamu apa sahaja, bila-bila masa. -
♾️
Akses seumur hidup
Kembali bila-bila masa, tiada tamat tempoh -
📱
Telefon atau komputer
Berfungsi di mana-mana, mana-mana peranti -
💸
Pulangan 14 hari
Tanpa soalan -
⚡
Pendek dan fokus
2 jam 42 min kandungan praktikal
Ulasan (12)
Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.
Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.
Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.
O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.
Bien explicado, aunque algo denso al final.
Ses tanıma kısmı gerçekten iyi anlatılmış.
Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.
Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।
音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。
Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.
Clear intro to multimodal AI basics.
Pelajar lain juga mengambil
Generative AI untuk Artis Tatu: Reka Bentuk dan Peletakan
Pengklonan Suara AI: Bina Suara Digital Peribadi Anda
AI untuk Guru ESL: Pelajaran, Teks, dan Ujian
Asas LLMOps: Deploy, Versi, dan Pantau LLM
Soalan lazim
Apa yang saya perlukan untuk mengikuti kursus ini? +
Hanya telefon atau komputer dengan internet. Tiada pemasangan, tiada perkakasan khas.
Bagaimana untuk membayar? +
Dengan kad melalui Stripe. Kami tidak menyimpan butiran kad — Stripe menguruskannya dengan selamat.
Bolehkah saya dapatkan bayaran balik? +
Ya — pulangan penuh dalam 14 hari, tanpa soalan.
Berapa lama saya akan mempunyai akses? +
Selamanya. Setelah membeli, kursus adalah milik anda — boleh lawat semula bila-bila masa.
Adakah saya akan mendapat sijil? +
Ya. Setelah tamat, anda akan menerima sijil yang boleh ditambah ke profil LinkedIn anda.