Мультимодальность
Изучение ИИ, 5–11 класс · раздел «2. Как устроены большие языковые модели»
Главное
Современные модели понимают не только текст, но и изображения, звук, видео, а некоторые умеют генерировать картинки, речь и видео.
Правила
- Текст, фото, звук, видео
- Распознавание и генерация
- Голосовой режим
Разберём пример
Что значит «мультимодальная модель»?
Работает с несколькими типами данных: текстом, изображениями, звуком
Частые ошибки
- Думать, что нейросети понимают только буквы.
Потренироваться
Задания с проверкой и подсказками, схема темы и разбор ошибок с ИИ-репетитором — в уроке на платформе.
Открыть урок