Свържете се с нас

Съдържание и теми, включени в курса

Въведение в мултимодалните Mistral модели

  • Преглед на Mistral Medium и мултимодалните възможности
  • OCR/документни модели и сценарии на употреба
  • Интеграция с open-source екосистеми

OCR и визуални тръбопроводи

  • Основи на OCR с Mistral модели
  • Предварителна обработка на изображения и сканирани документи
  • Извличане на структуриран текст от изображения

Разбиране на документи

  • Проектиране на NLP тръбопроводи за документи
  • Разпознаване на обекти, обобщаване и класификация
  • Кросмодално свързване на текстови и визуални данни

Приложения за търсене и знания

  • Системи за визуално-текстово търсене
  • Изграждане на семантично търсене с OCR резултати
  • Корпоративни хранилища за документи

Помощни и интерактивни приложения

  • UI дизайн за мултимодални асистенти
  • Приложения за достъпност (напр. визуално-към-текст)
  • Реални инструменти за продуктивност

Производителност и оптимизация

  • Мащабиране на мултимодални тръбопроводи
  • Настройка на производителността на инференцията
  • Оценка на компромисите между точност и ефективност

Казуси и бъдещи насоки

  • Индустриални приложения на мултимодалния AI
  • Изследователски тенденции в OCR и документния AI
  • Съображения за отговорен AI при визуално-текстови задачи

Обобщение и следващи стъпки

Изисквания

  • Разбиране на концепциите за обработка на естествен език
  • Опит с Python и ML рамки
  • Запознатост с основите на компютърното зрение

Аудитория

  • Продуктови екипи
  • ML изследователи
  • Приложни ML инженери
 14 Часа

Брой участници


Цена за участник

Предстоящи Курсове

Свързани Kатегории