Contattataci

Struttura del corso

Introduzione all’intelligenza artificiale multimodale e a Ollama

  • Panoramica sull’apprendimento multimodale
  • Principali sfide nell’integrazione tra visione artificiale e linguaggio
  • Capacità e architettura di Ollama

Configurazione dell’ambiente Ollama

  • Installazione e configurazione iniziale di Ollama
  • Distribuzione locale dei modelli
  • Integrazione di Ollama con Python e Jupyter

Lavorare con input multimodali

  • Integrazione di testo e immagini
  • Incorporazione di dati audio e strutturati nei modelli
  • Progettazione di pipeline di preprocessing efficaci

Applicazioni per l’analisi dei documenti

  • Estrazione di informazioni strutturate da PDF e immagini
  • Combinazione di tecniche OCR con modelli linguistici
  • Realizzazione di flussi di lavoro intelligenti per l’analisi documentale

Risposta a domande visive (Visual Question Answering)

  • Utilizzo di dataset e benchmark specifici per il VQA
  • Training ed valutazione dei modelli multimodali
  • Sviluppo di applicazioni interattive basate su domande visive

Progettazione di agenti multimodali

  • Principi fondamentali per la progettazione di agenti in grado di ragionare attraverso più modalità
  • Integrazione tra percezione, linguaggio e azioni compiute dagli agenti
  • Distribuzione degli agenti per scenari applicativi reali

Integrazioni avanzate e ottimizzazione dei modelli

  • Addestramento mirato di modelli multimodali con Ollama
  • Ottimizzazione delle prestazioni di inferenza
  • Considerazioni riguardo a scalabilità e distribuzione in ambienti produttivi

Riepilogo e prossimi passi

Requisiti

  • Conoscenza approfondita dei concetti legati al machine learning
  • Esperienza nell’utilizzo di framework di deep learning come PyTorch o TensorFlow
  • Familiarità con l’elaborazione del linguaggio naturale e la visione artificiale

Destinatari

  • Ingegneri specializzati in machine learning
  • Ricercatori nell’ambito dell’intelligenza artificiale
  • Sviluppatori che integrano flussi di lavoro basati su testo e immagini nei propri prodotti
 21 ore

Numero di Partecipanti


Prezzo per partecipante

Corsi in Arrivo

Categorie relative