Zkuste nás kontaktovat

Návrh Školení

Úvod do multimodálních modelů Mistral

  • Přehled Mistral Medium a multimodálních schopností
  • OCR/dokumentační modely a use-case
  • Integrace s ekosystémy s otevřeným zdrojovým kódem

OCR a vizuální pipeline

  • Základy OCR s modely Mistral
  • Předzpracování obrázků a naskenovaných dokumentů
  • Extrakce strukturovaného textu z obrázků

Porozumění dokumentům

  • Návrh NLP pipeline pro dokumenty
  • Identifikace entit, sumarizace a klasifikace
  • Křížové propojení textových a vizuálních dat

Vyhledávání a znalostní aplikace

  • Systémy pro vyhledávání vizuálně-tekstových dat
  • Stavba sémantického vyhledávání pomocí výstupů OCR
  • Podnikové databáze dokumentů

Pomocné a interaktivní aplikace

  • Návrh UI pro multimodální asistenty
  • Aplikace přístupnosti (např. převod vize na text)
  • Nástroje pro zvyšování produktivity ve skutečném světě

Výkonnost a optimalizace

  • Měkití multimodálních pipeline
  • Ladění výkonu inferencí
  • Hodnocení kompromisů mezi přesností a efektivitou

Kazuistiky a budoucí trendy

  • Použití multimodální AI v průmyslu
  • Výzkumné trendy v OCR a dokumentové AI
  • Etické aspekty AI v úlohách vize a textu

Shrnutí a další kroky

Požadavky

  • Pochopení konceptů zpracování přirozeného jazyka
  • Zkušenosti s Pythonem a ML frameworky
  • Znalost základů počítačového vidění

Cílová skupina

  • Produktové týmy
  • ML výzkumníci
  • Aplikační ML inženýři
 14 Hodiny

Počet účastníků


Cena za účastníka

Nadcházející kurzy

Související kategorie