Inferenza e generazione LLM efficiente con SGLang โ€” WalkSelf
โฑ 2 h 36 min ๐Ÿ“š 26 lezioni ๐ŸŽง Versione audio

Inferenza e generazione LLM efficiente con SGLang

Scopri come accelerare la generazione di testo e immagini utilizzando SGLang per implementare caching avanzato, RadixAttention e output strutturati per applicazioni di IA convenienti.

  • ๐Ÿ’ฌ Istruttore IA
    Fai domande su qualsiasi lezione e ricevi una risposta chiara all'istante, quando vuoi.
  • ๐Ÿ• Inizia quando vuoi
    Niente orari nรฉ scadenze: impara al tuo ritmo, quando vuoi.
  • ๐ŸŒ In italiano
    Lezioni, esercizi e certificato: tutto interamente nella tua lingua.

Informazioni sul corso

La distribuzione di modelli di linguaggio di grandi dimensioni puรฒ essere lenta e costosa, rendendo l'ottimizzazione dell'inferenza una competenza fondamentale per gli sviluppatori moderni. Questo corso ti guida attraverso i concetti fondamentali di LLM che servono e ottimizzano utilizzando il framework open source SGLang. Cosa imparerai: - Comprendere i meccanismi di base dell'inferenza LLM, comprese le fasi di generazione dei token e i colli di bottiglia di latenza. - Implementare strategie di caching efficienti utilizzando KV cache e RadixAttention per accelerare i prompt ripetitivi. - Configura SGLang per gestire in modo efficiente le attivitร  di generazione di testo e immagini simultanee. - Applica tecniche di output strutturato per garantire risposte JSON precise dai tuoi modelli. - Ottimizzare l'utilizzo delle risorse hardware per rendere la distribuzione del modello piรน economica e scalabile. Inizierai con la terminologia chiave e i concetti fondamentali del model serving prima di esplorare la configurazione SGLang, i meccanismi di cache e il routing strutturato.Attraverso chiare spiegazioni scritte e snippet di codice dettagliati, costruirai una comprensione pratica dell'ottimizzazione dell'inferenza moderna. Questo corso รจ progettato per sviluppatori di software e appassionati di IA che vogliono imparare le basi di un servizio di modello efficiente, senza alcuna esperienza precedente SGLang richiesta.Inizia a leggere oggi per rendere le tue pipeline di generazione AI piรน veloci e piรน convenienti.

Cosa otterrai

  • ๐Ÿ“œ Certificato di completamento
    Aggiungilo al tuo profilo LinkedIn
  • ๐Ÿ’ฌ Tutor AI personale
    Bloccato su una lezione? Chiedi al tuo tutor integrato qualsiasi cosa, in qualsiasi momento.
  • ๐ŸŽง Versione audio inclusa
    Impara ovunque, senza schermo
  • โ™พ๏ธ Accesso a vita
    Torna quando vuoi, senza scadenza
  • ๐Ÿ“ฑ Telefono o computer
    Funziona ovunque, su qualsiasi dispositivo
  • ๐Ÿ’ธ Rimborso entro 14 giorni
    Senza domande
  • โšก Breve e mirato
    2 h 36 min di contenuto pratico

Recensioni

Ancora nessuna recensione โ€” sii il primo a condividere la tua esperienza.

Scrivi una recensione

โ˜†โ˜†โ˜†โ˜†โ˜†
Ti chiederemo di accedere dopo l'invio โ€” la bozza viene salvata.

Altri hanno seguito anche

Domande frequenti

Cosa serve per seguire questo corso? +

Basta un telefono o un computer con internet. Niente installazioni, nessun hardware speciale.

Come si paga? +

Con carta via Stripe. Non conserviamo i dati della carta โ€” Stripe li gestisce in sicurezza.

Posso ottenere un rimborso? +

Sรฌ โ€” rimborso completo entro 14 giorni, senza domande.

Per quanto tempo avrรฒ accesso? +

Per sempre. Una volta acquistato, il corso รจ tuo e puoi rivederlo quando vuoi.

Riceverรฒ un certificato? +

Sรฌ. Al completamento riceverai un certificato da aggiungere al tuo profilo LinkedIn.

Pensato per chi lavora in
Tech Design Finanza Marketing Sanitร  Istruzione Ospitalitร  Produzione