Текст из картинок и звука — точно и быстро
dreamAPI распознаёт текст на изображениях любого языка и превращает речь в аудио и видео в текст. Модели Whisper и Tesseract LSTM — точность в пару секунд.
Возможности
Инструменты
OCR — текст с картинки
Перетащите изображение или выберите файл
Выбрать или бросить картинку
png · jpg · webp · bmp · до 15 МБ
ASR — текст из аудио
Перетащите аудио или видео-файл
Выбрать или бросить аудио
mp3 · wav · m4a · ogg · webm · до 30 МБ / 20 мин
API
Публичное REST API для разработчиков и интеграций. Любой язык, честные лимиты, API-ключи со снятием ограничений.
| POST /api/v1/ocr | multipart/form-data: file (изображение), lang (auto|eng|rus|rus+eng|…), fast (0|1) |
| POST /api/v1/asr | multipart/form-data: file (аудио), language (auto|ru|en|…), quality (fast|quality) |
| GET /api/v1/status | статус сервиса, доступные языки, ваши лимиты |
| GET /api/v1/logs | логи (только с админ-токеном) |
| GET /docs | интерактивная документация OpenAPI |
Примеры запросов:
curl -s https://api.maiuni.online/api/v1/ocr -F file=@photo.png -F lang=auto curl -s https://api.maiuni.online/api/v1/ocr -H "X-API-Key: dream_…" -F file=@photo.png curl -s https://api.maiuni.online/api/v1/asr -F file=@voice.mp3 -F language=auto