Немската компания DeepL представи нова функция в своя онлайн-преводач DeepL Voice, насочена към използване в разговори на живо и видеоконференции. Сега потребителите могат да превеждат устната реч от един език на друг и да го конвертират в текст в реално време, съобщава TechCrunch. Тази стъпка беше още един отговор на нарастващия интерес към услугите, базирани на изкуствен интелект.
Системата за машинен превод DeepL Voice, която според самата компания произвежда преводи с „безпрецедентно високо качество“, поддържа 13 езика — английски, немски, японски, корейски, шведски, холандски, френски, турски, полски, португалски, руски, испански и италиански. Освен това от платформата се поддържат и текстови субтитри на 33 езика,.
Новият продукт на DeepL може да работи както във формат „огледало“, където преводите се изобразяват на екрана на телефона, така че участниците в срещата да могат да видят преведения текст, така и под формата на субтитри за видеоконференции. Засега DeepL Voice поддържа само интеграция с Microsoft Teams, което, според основателя на компанията Ярек Кутиловски, всъщност покрива по-голямата част от тяхната клиентска база. Все още няма информация за поддръжка на други услуги, като Zoom или Google Meet.
Кутиловски отбеляза, че DeepL Voice е първата стъпка на компанията в областта на гласовите технологии и се планира по-нататъшно развитие на продукта. Той подчерта, че гласовият превод се е превърнал в една от ключовите области, които ще се развиват активно през следващите години, докато DeepL ще продължи да подобрява качеството на своите преводи чрез разработване на собствени AI модели, благодарение на които е възможно да се постигне по-висока точност, особено в реално време.
Ръководителят на компанията говори и за възможните сценарии за използване на новата функция. Например в сектора на услугите, където служителите на ресторанти, кафенета и хотели ще могат да общуват с клиентите, които говорят различни езици. Що се отнася до поверителността на данните, тъй като обработката на гласовете на потребителите се извършва на сървърите на компанията, Катиловски увери, че DeepL не запазва или използва аудио записите, за да обучава своите модели, и също така отговаря на всички изисквания на GDPR и други разпоредби.
Струва си да се отбележи, че DeepL не е единствената компания, която работи върху подобни решения. Google и други стартъп компании като Eleven Labs и Panjaya също разработват услуги за гласов превод, които конвертират аудио в текст.
Нека си припомним, че DeepL по-рано представи и нов AI-модел, който превъзхожда GPT-4 при превода и редактирането. Моделът е обучаван от DeepL цели седем години на събирани преди това данни от съдържание и преводи.
Всичко важно от света на технологиите, директно в пощата ти.
С абонирането приемате нашите Условия и Политика за поверителност. Може да се отпишете с един клик по всяко време.
Коментирайте статията в нашите Форуми. За да научите първи най-важното, харесайте страницата ни във Facebook, и ни последвайте в Google Новини, TikTok, Telegram и Viber или изтеглете приложението на Kaldata.com за Android, iPhone, Huawei, Google Chrome, Microsoft Edge и Opera!