Gradium запустила две передовые модели для перевода речи в реальном времени: stt-translate, которая преобразует речь в текст, и s2s-translate, которая переводит аудио на одном языке непосредственно на другой. Эти модели поддерживают пять языков—английский, французский, немецкий, испанский и португальский—и обеспечивают 20 различных пар перевода, упрощая процесс до одного шага. Gradium утверждает, что их модели превосходят конкурентов, таких как gpt-realtime-translate и gemini-3.5-live-translate, по точности и задержке. Модель stt-translate интегрирует транскрипцию и перевод в одну бесшовную операцию, устраняя необходимость в промежуточной транскрипции. Этот выбор дизайна повышает скорость и эффективность. Модель s2s-translate строится на этом, предоставляя синтезированный аудиовыход вместе с переведенными транскрипциями, все через одно соединение WebSocket. Gradium измеряет качество перевода с помощью метрик BLEU и MetricX, показывая превосходные результаты в обеих категориях. Средняя задержка для s2s-translate составляет примерно 3,0 секунды, что делает ее конкурентоспособной на рынке. Примеры использования этих моделей включают живое дублирование, многоязычную поддержку клиентов и переводы встреч в реальном времени, демонстрируя их универсальность и эффективность в различных приложениях.
Gradium Запускает Модели Реального Времени Перевода Речи
Gradium представила две инновационные модели перевода речи в реальном времени, stt-translate и s2s-translate, утверждая, что они имеют более высокую точность и меньшую задержку по сравнению с существующими решениями.
