drm
↗ API сервис, 01 Sep 2026

Текст из картинок и звука — точно и быстро

dreamAPI распознаёт текст на изображениях любого языка и превращает речь в аудио и видео в текст. Модели Whisper и Tesseract LSTM — точность в пару секунд.

Возможности

Инструменты

OCR — текст с картинки

Перетащите изображение или выберите файл

Выбрать или бросить картинку
png · jpg · webp · bmp · до 15 МБ

ASR — текст из аудио

Перетащите аудио или видео-файл

Выбрать или бросить аудио
mp3 · wav · m4a · ogg · webm · до 30 МБ / 20 мин

API

Публичное REST API для разработчиков и интеграций. Любой язык, честные лимиты, API-ключи со снятием ограничений.

POST /api/v1/ocrmultipart/form-data: file (изображение), lang (auto|eng|rus|rus+eng|…), fast (0|1)
POST /api/v1/asrmultipart/form-data: file (аудио), language (auto|ru|en|…), quality (fast|quality)
GET /api/v1/statusстатус сервиса, доступные языки, ваши лимиты
GET /api/v1/logsлоги (только с админ-токеном)
GET /docsинтерактивная документация OpenAPI

Примеры запросов:

curl -s https://api.maiuni.online/api/v1/ocr -F file=@photo.png -F lang=auto
curl -s https://api.maiuni.online/api/v1/ocr -H "X-API-Key: dream_…" -F file=@photo.png
curl -s https://api.maiuni.online/api/v1/asr -F file=@voice.mp3 -F language=auto
Ru / En