Multimodal AI Uygulamaları Geliştirme: Speech-to-Text ve LLMs — WalkSelf
4.6 (12) ⏱ 2 sa 42 dk 📚 27 kurs

Multimodal AI Uygulamaları Geliştirme: Speech-to-Text ve LLMs

Geliştiriciler için standart API'leri ve güncel AI modellerini kullanarak konuşma tanıma, görüntü analizi ve multimodal LLMs'i modern uygulamalara entegre etmeye yönelik başlangıç seviyesinde bir rehber.

  • 💬 Yapay zekâ eğitmeni
    Herhangi bir ders hakkında soru sor, istediğin an anında net bir yanıt al.
  • 🕐 İstediğin zaman başla
    Program ya da son tarih yok — kendi hızında, istediğin zaman öğren.
  • 🌐 Türkçe
    Dersler, görevler ve sertifika — hepsi tamamen kendi dilinde.

Bu kurs hakkında

Modern uygulamalar basit metinlerin ötesine geçiyor. Ses, görüntü ve video işleme yeteneklerini entegre ederek geliştiriciler, son derece etkileşimli ve akıllı kullanıcı deneyimleri oluşturabilirler. Bu kurs, multimodal Large Language Models (LLMs) ve speech-to-text teknolojileri hakkında temel bir anlayış sağlar. Sesi yazıya dökmek, görsel verileri analiz etmek ve akıllı yanıtlar üretmek için AI modelleriyle etkileşime giren kodlar yazmayı öğrenecek; standart uygulamaları güçlü AI odaklı araçlara dönüştüreceksiniz. Neler öğreneceksiniz: Multimodal AI'nın temel kavramlarını ve modellerin farklı veri türlerini nasıl işlediğini anlayın; Doğru ses transkripsiyonu için speech-to-text API'lerini entegre edecek kodlar yazın; Modern LLM yeteneklerini kullanarak görüntüleri ve video karelerini işleyin ve analiz edin; Multimodal girdiler için özelleştirilmiş temel prompt engineering tekniklerini uygulayın; Zengin medya için temel Retrieval-Augmented Generation (RAG) modellerini uygulayın; Karmaşık AI iş akışlarını sorunsuz bir şekilde yöneten metin tabanlı script'ler oluşturun. Müfredat, pratik API entegrasyonu ve veri işlemeye geçmeden önce temel AI terminolojisi ve temel kavramlarla başlar. Çeşitli medya türlerini programatik olarak yönetme konusundaki güveninizi artıracak yapılandırılmış yazılı dersler ve kod parçacıkları aracılığıyla ilerleyeceksiniz. Bu kurs, önceden machine learning deneyimi gerektirmeden AI alanına girmek isteyen başlangıç seviyesindeki geliştiriciler ve fullstack mühendisler için tasarlanmıştır. Bir sonraki geliştirme projenizde multimodal AI potansiyelini açığa çıkarmak için bugün okumaya başlayın.

Ne elde edeceksin

  • 📜 Tamamlama sertifikası
    LinkedIn profilinize ekleyin
  • 💬 Kişisel AI öğretmeni
    Bir kursta takıldın mı? Yerleşik öğretmenine istediğin zaman her şeyi sorabilirsin.
  • ♾️ Ömür boyu erişim
    İstediğin zaman dön, son kullanma tarihi yok
  • 📱 Telefon veya bilgisayar
    Her yerde, her cihazda
  • 💸 14 gün iade
    Sorgusuz
  • Kısa ve odaklı
    2 sa 42 dk pratik içerik

Yorumlar (12)

مريم بنت أحمد بن راشد آل ثاني QA Doğrulanmış öğrenci
★ 4 · 24 Temmuz 2026

شرح جيد لكن سريع بعض الشيء.

Henry Walker AU
★ 4 · 24 Temmuz 2026

Nice walkthrough of hooking speech-to-text into an LLM pipeline, though the image portion feels a bit rushed compared to the audio section.

Esi Adu GH Doğrulanmış öğrenci
★ 5 · 15 Temmuz 2026

Really practical intro to combining speech-to-text with an LLM, and the pacing between audio and image sections feels well balanced.

Renata Flores UY
★ 5 · 14 Temmuz 2026

Me sorprendió lo accesible que resulta combinar reconocimiento de voz con un modelo de lenguaje después de este curso. Va construyendo la app multimodal pieza por pieza, primero el audio, luego cómo pasarlo al LLM, y se entiende perfectamente incluso sin experiencia previa en IA.

Fernanda Mendes BR
★ 5 · 7 Temmuz 2026

O curso mostra bem como conectar reconhecimento de fala a um LLM para montar um app multimodal do zero. Gostei especialmente da parte prática, onde você grava um áudio e vê o modelo respondendo em tempo real.

Pablo Ruiz ES Doğrulanmış öğrenci
★ 4 · 2 Temmuz 2026

Bien explicado, aunque algo denso al final.

Hava Akın TR
★ 4 · 29 Haziran 2026

Ses tanıma kısmı gerçekten iyi anlatılmış.

Lina Marlina ID
★ 5 · 28 Haziran 2026

Panduan integrasi speech-to-text dan LLM-nya sangat mudah diikuti untuk pemula, langsung praktik bikin fitur multimodal dari awal.

Isabella Herrera PA
★ 4 · 26 Haziran 2026

Speech recognition को LLM के साथ जोड़ने का तरीका बहुत साफ तरीके से समझाया गया है, बस image वाला हिस्सा थोड़ा और डिटेल में हो सकता था।

吉田 葵 JP Doğrulanmış öğrenci
★ 5 · 2 Haziran 2026

音声認識とLLMを組み合わせてマルチモーダルなアプリを作る流れが、初心者でも迷わないくらい丁寧に説明されています。

Cemile Karaca TR Doğrulanmış öğrenci
★ 5 · 27 Mayıs 2026

Konuşmayı metne çevirip multimodal LLM'e bağladığım ilk uygulamayı kurmak şaşırtıcı derecede kolaydı, başlangıç için harika.

Peter Petersen DK Doğrulanmış öğrenci
★ 5 · 25 Mayıs 2026

Clear intro to multimodal AI basics.

Yorum yaz

Gönderdikten sonra giriş yapmanı isteyeceğiz — taslağın kaydedilir.

Diğer öğrenciler şunları da aldı

Sık sorulanlar

Bu kursu almak için neye ihtiyacım var? +

Sadece internetli bir telefon veya bilgisayar yeterli. Kurulum yok, özel donanım yok.

Nasıl ödeme yapabilirim? +

Stripe üzerinden kartla. Kart bilgilerini saklamıyoruz — Stripe güvenli şekilde işliyor.

Para iadesi alabilir miyim? +

Evet — 14 gün içinde tam iade, sorgusuz.

Erişimim ne kadar sürer? +

Sonsuza dek. Bir kez satın aldığında, kurs senindir — istediğin zaman dönebilirsin.

Sertifika alacak mıyım? +

Evet. Tamamladığında, LinkedIn profiline ekleyebileceğin bir sertifika alırsın.

Şu sektörlerdeki öğrenenler için
Teknoloji Tasarım Finans Pazarlama Sağlık Eğitim Konaklama Üretim