Свържете се с нас

Съдържание и теми, включени в курса

Въведение в мултимодалните Mistral модели

  • Преглед на Mistral Medium и мултимодалните възможности
  • OCR/документни модели и случаи на употреба
  • Интеграция с екосистеми с отворен код

OCR и визуални потоци

  • Основи на OCR с Mistral модели
  • Предварителна обработка на изображения и сканирани документи
  • Извличане на структуриран текст от изображения

Разбиране на документи

  • Проектиране на NLP потоци за документи
  • Разпознаване на обекти, обобщаване и класификация
  • Кръстосано модално свързване на текстови и визуални данни

Приложения за търсене и знания

  • Системи за търсене по визия-текст
  • Изграждане на семантично търсене с OCR резултати
  • Корпоративни хранилища на документи

Асистиращи и интерактивни приложения

  • UI дизайн за мултимодални асистенти
  • Приложения за достъпност (напр. визия-към-текст)
  • Инструменти за продуктивност в реалния свят

Производителност и оптимизация

  • Мащабиране на мултимодални потоци
  • Настройка на производителността на изводите
  • Оценка на компромисите между точност и ефективност

Казуси и бъдещи насоки

  • Индустриални приложения на мултимодалния AI
  • Изследователски тенденции в OCR и документния AI
  • Съображения за отговорен AI при задачите визия-текст

Обобщение и следващи стъпки

Изисквания

  • Разбиране на концепциите за обработка на естествен език
  • Опит с Python и ML рамки
  • Запознатост с основите на компютърното зрение

Аудитория

  • Продуктови екипи
  • ML изследователи
  • Приложни ML инженери
 14 Часа

Брой участници


Цена за участник

Предстоящи Курсове

Свързани Kатегории