← Все курсы

Multimodal AI (Vision + Audio)

Курс по мультимодальным AI-моделям: GPT-4V, CLIP, Whisper, Stable Diffusion. Научитесь работать с изображениями, аудио и видео через AI, строить мультимодальные RAG-пайплайны и AI-агентов. Изучите Document AI, генерацию контента и оптимизацию затрат.

Это платный курс

Войдите в систему, чтобы получить доступ к курсу и сохранять прогресс.

Войти в систему
Multimodal AI (Vision + Audio) AI