Осталось 4 уроков
В OpenClaw агенты поддерживают мультимодальность: можно отправлять и получать голосовые сообщения, работать с медиафайлами и использовать Canvas для визуализации. Для активации голосовых функций достаточно разрешить соответствующую опцию в настройках канала через Control UI или конфиг openclaw.json.
Голосовые сообщения и медиа-ответы доступны в Telegram, WhatsApp, Discord и других поддерживаемых мессенджерах. Агент умеет распознавать речь, отвечать голосом, отправлять изображения или короткие видеоролики — например, для быстрой диагностики или презентации идей. Функция Canvas позволяет рисовать схемы и делиться ими прямо в чате.
Такие возможности делают взаимодействие с агентом более естественным — теперь не нужно ограничиваться только текстом, а можно использовать голос и визуальные элементы для решения задач.
💡 Аналогия
Мультимодальность в OpenClaw — это как перейти с обычного телефона на смартфон: теперь можно не только звонить, но и отправлять фото, голосовые сообщения и рисовать заметки на экране.
Ключевые моменты
Голосовые и медиа-функции включаются через настройки канала и openclaw.json.
Агент умеет распознавать речь, отвечать голосом и отправлять картинки.
Мультимодальность расширяет сценарии использования и делает чат более живым.
Следующий урок
Работаем с плагинами и навыками из ClawHub
Теория