Перейти к содержимому

Каталог ИИ-инструментов

Все сервисы в каталоге открываются с российского сервера. У карточек видно дату последней проверки.

FunASR FunASR распознаёт речь на нескольких языках и определяет говорящих, помогая разработчикам добавлять аудиофункции в приложения. Open-source T-Bank VoiceKit Распознавание и синтез речи с уклоном в телефонию и контакт-центры. Бесплатно Русский язык MTS Audiogram Речевая платформа МТС: распознавание, синтез и голосовые роботы. Бесплатно Русский язык scikit-image scikit-image — библиотека для обработки изображений в Python, предназначенная разработчикам и специалистам по работе с изображениями. Бесплатно Open-source TTS Audio Suite Расширение для ComfyUI создаёт речь, преобразует и редактирует аудио, распознаёт голос и помогает готовить субтитры для авторов контента и разработчиков. Бесплатно Open-source RealtimeTTS RealtimeTTS превращает текст и потоки языковых моделей в речь; библиотека подходит разработчикам, которым нужен синтез аудио в Python-приложениях. Бесплатно Open-source Loquora Loquora переводит речь во время звонков и показывает или озвучивает перевод для тех, кто общается на разных языках. Бесплатно Русский язык CosmoEdge Среда для локального анализа видео и передачи результатов в рабочие системы, предназначенная разработчикам и инженерам внедрения. Open-source Flutter Edge AI Открытая библиотека для запуска мультимодальных языковых моделей и RAG локально в приложениях на Flutter. Бесплатно Open-source LocalAI Открытая платформа для запуска языковых, голосовых, визуальных и других ИИ-моделей на собственном оборудовании. Open-source Chatbox Инструмент для работы с ИИ, позволяющий взаимодействовать с файлами и интернетом. Бесплатно Русский язык dlib Библиотека C++ с алгоритмами машинного обучения, обработки изображений и другими инструментами для разработки программ. Бесплатно Open-source ACE-Step 1.5 GGUF Локальная модель для создания стереозаписей по текстовому описанию и тексту песни. Open-source yovoice yovoice создаёт речь на компьютере, позволяет клонировать и настраивать голос и подходит авторам текстов и видео. Open-source SaluteSpeech Речевые технологии Сбера: перевод аудио в текст и озвучка текста через API. Бесплатно Русский язык Yandex SpeechKit Распознавание и синтез русской речи через API Yandex Cloud. Бесплатно Русский язык NtechLab Распознавание лиц и силуэтов для видеонаблюдения и безопасности. Русский язык VisionLabs Российское компьютерное зрение: распознавание лиц и аналитика видеопотока. Русский язык