Speech dispatcher что это
Перейти к содержимому

Speech dispatcher что это

  • автор:

Метки

Acapela Group — коммерческое предприятие, специализирующееся в области речевых технологий и известное своими синтезаторами речи по тексту.

Переходов: 13 | Записи

Access

Переходов: 2 | Записи

Accessibility ToolKit

Accessibility ToolKit (ATK) — это инструментарий разработки от GNOME, который позволяет программистам использовать общие функции специальных возможностей GNOME, такие как высококонтрастные темы оформления для слабовидящих и изменение поведения клавиатуры (например, залипание клавиш) для людей с нарушениями мелкой моторики, чтобы сделать приложения GNOME доступными.

Переходов: 0 | Записи

Accessible-Coconut

Переходов: 8 | Записи

Acrobat / Reader

Переходов: 27 | Записи

ALT Linux

Переходов: 5 | Записи

Android

Переходов: 208 | Записи

API

Переходов: 47 | Записи

Arch Linux

Переходов: 24 | Записи

AT-SPI

AT-SPI2 — сокращ. от англ. Assistive Technology Service Provider Interface второе поколение. Это фреймворк, разрабатываемый в рамках проекта GNOME и обеспечивающий доступность графических приложений на системах Linux. Он определяет протокол D-Bus для предоставления и доступа к информации, необходимой вспомогательным технологиям. Данный фреймворк также называют AT-SPI2, чтобы подчеркнуть, что это второе поколение, ориентированное на работу через систему межпроцессного взаимодействия D-Bus, а не устаревший стандарт написания распределённых приложений ORBIT / CORBA. AT-SPI также может использоваться для автоматизированного тестирования пользовательских интерфейсов с помощью таких инструментов, как Linux Desktop Testing Project и Dogtail. AT-SPI в настоящее время поддерживается GTK+ 2, Java/Swing, пакетом Mozilla и StarOffice/OpenOffice.org. Разработчики, такие как Trolltech, разрабатывают поддержку AT-SPI, используя доступную библиотеку инструментария Trolltech. Рабочая группа Open Accessibility (A11y) активно изучает и тестирует использование AT-SPI для принятия в качестве стандарта Linux, а также содействует гармонизации усилий и согласованию инструментария независимым от платформы образом.

Переходов: 28 | Записи

Audacity

Свободный звуковой редактор, предоставляющей возможности для редактирования звуковых файлов (Ogg Vorbis, FLAC, MP3 и WAV), записи и оцифровки звука, изменения параметров звукового файла, наложения треков и применения эффектов (например, подавление шума, изменение темпа и тона). Код Audacity распространяется под лицензией GPL.

speech-dispatcher

Chromium стоит, но скорее всего притащил его не он, а указанные выше пакеты kdeaccessibility-jovie и kdeaccessibility-kaccessible из группы kde-applications (ставил всю группу, но раньше такой проблемы не было)

[root@ctgx ~]# pacman -Qi kdeaccessibility-jovie kdeaccessibility-kaccessible Name : kdeaccessibility-jovie Version : 16.12.1-1 Description : A text to speech application Architecture : x86_64 URL : http://kde.org/applications/utilities/jovie/ Licenses : GPL FDL Groups : kde-applications kdeaccessibility Provides : None Depends On : kdebase-runtime speech-dispatcher Optional Deps : None Required By : None Optional For : None Conflicts With : None Replaces : kdeaccessibility-kttsd Installed Size : 1094.00 KiB Packager : Antonio Rojas Build Date : Thu 12 Jan 2017 03:07:04 AM MSK Install Date : Sun 29 Jan 2017 02:27:31 PM MSK Install Reason : Explicitly installed Install Script : No Validated By : Signature Name : kdeaccessibility-kaccessible Version : 16.12.1-1 Description : Provides accessibility services like focus tracking and a screenreader Architecture : x86_64 URL : https://accessibility.kde.org/ Licenses : GPL FDL Groups : kde-applications kdeaccessibility Provides : None Depends On : kdelibs speech-dispatcher Optional Deps : None Required By : None Optional For : None Conflicts With : None Replaces : None Installed Size : 112.00 KiB Packager : Antonio Rojas Build Date : Thu 12 Jan 2017 03:07:14 AM MSK Install Date : Sun 29 Jan 2017 02:27:31 PM MSK Install Reason : Explicitly installed Install Script : No Validated By : Signature [root@ctgx ~]# 

tm4ig ★
( 02.02.17 22:14:03 MSK ) автор топика
Последнее исправление: tm4ig 02.02.17 22:14:26 MSK (всего исправлений: 1)

Ответ на: комментарий от tm4ig 02.02.17 22:14:03 MSK

Судя по всему выше про хром верно сказали.

[root@ArchLinux behem0th]# pacman -Rscvn speech-dispatcher Root : / Conf File : /etc/pacman.conf DB Path : /var/lib/pacman/ Cache Dirs: /var/cache/pacman/pkg/ Hook Dirs : /usr/share/libalpm/hooks/ /etc/pacman.d/hooks/ Lock File : /var/lib/pacman/db.lck Log File : /var/log/pacman.log GPG Dir : /etc/pacman.d/gnupg/ Targets : speech-dispatcher проверка зависимостей. :: qt5-speech опционально требует speech-dispatcher: speech-dispatcher TTS backend Пакет (4) Старая версия Изменение размера dotconf 1.3-4 -0,17 MiB google-chrome 56.0.2924.76-1 -170,76 MiB python-xdg 0.25-4 -0,34 MiB speech-dispatcher 0.8.6-1 -1,38 MiB Будет освобождено: 172,65 MiB 

Метки

Acapela Group — коммерческое предприятие, специализирующееся в области речевых технологий и известное своими синтезаторами речи по тексту.

Переходов: 13 | Записи

Access

Переходов: 2 | Записи

Accessibility ToolKit

Accessibility ToolKit (ATK) — это инструментарий разработки от GNOME, который позволяет программистам использовать общие функции специальных возможностей GNOME, такие как высококонтрастные темы оформления для слабовидящих и изменение поведения клавиатуры (например, залипание клавиш) для людей с нарушениями мелкой моторики, чтобы сделать приложения GNOME доступными.

Переходов: 0 | Записи

Accessible-Coconut

Переходов: 8 | Записи

Acrobat / Reader

Переходов: 27 | Записи

ALT Linux

Переходов: 5 | Записи

Android

Переходов: 208 | Записи

API

Переходов: 47 | Записи

Arch Linux

Переходов: 24 | Записи

AT-SPI

AT-SPI2 — сокращ. от англ. Assistive Technology Service Provider Interface второе поколение. Это фреймворк, разрабатываемый в рамках проекта GNOME и обеспечивающий доступность графических приложений на системах Linux. Он определяет протокол D-Bus для предоставления и доступа к информации, необходимой вспомогательным технологиям. Данный фреймворк также называют AT-SPI2, чтобы подчеркнуть, что это второе поколение, ориентированное на работу через систему межпроцессного взаимодействия D-Bus, а не устаревший стандарт написания распределённых приложений ORBIT / CORBA. AT-SPI также может использоваться для автоматизированного тестирования пользовательских интерфейсов с помощью таких инструментов, как Linux Desktop Testing Project и Dogtail. AT-SPI в настоящее время поддерживается GTK+ 2, Java/Swing, пакетом Mozilla и StarOffice/OpenOffice.org. Разработчики, такие как Trolltech, разрабатывают поддержку AT-SPI, используя доступную библиотеку инструментария Trolltech. Рабочая группа Open Accessibility (A11y) активно изучает и тестирует использование AT-SPI для принятия в качестве стандарта Linux, а также содействует гармонизации усилий и согласованию инструментария независимым от платформы образом.

Переходов: 28 | Записи

Audacity

Свободный звуковой редактор, предоставляющей возможности для редактирования звуковых файлов (Ogg Vorbis, FLAC, MP3 и WAV), записи и оцифровки звука, изменения параметров звукового файла, наложения треков и применения эффектов (например, подавление шума, изменение темпа и тона). Код Audacity распространяется под лицензией GPL.

RHVoice Система синтеза речи

RHVoice — это бесплатный многоязычный синтезатор речи с открытым исходным кодом. Российский рынок WMS-систем: оценки, перспективы и крупнейшие поставщики. Обзор TAdviser

2022: RHVoice 1.8.0

11 апреля 2022 года стало известно, что состоялся выпуск открытой системы синтеза речи RHVoice 1.8.0, изначально развивавшейся для обеспечения поддержки русского языка, но затем адаптированной и для других языков, включая английский, португальский, украинский, киргизский, татарский и грузинский. Код написан на C++ и распространяется под лицензией LGPL 2.1. Поддерживается работа в GNU/Linux, Windows и Android. Программа совместима с типовыми TTS-интерфейсами (text-to-speech) для преобразования текста в речь: SAPI5 (Windows), Speech Dispatcher (GNU/Linux) и Android Text-To-Speech API, но также может использоваться в экранном ридере NVDA. Создателем и основным разработчиком RHVoice является Ольга Яковлева, которая развивает проект несмотря на полную слепоту.

Иллюстрация: selectel.ru

В версии 1.8.0 для платформы Android предложена оптимизированная система управления голосовыми и языковыми данными, позволяющая загружать обновления голосовых данных без обновления мобильного приложения. Проверка появления обновлений данных для добавленных голосов и языков производится автоматически. Кроме того, в представленном выпуске реализована поддержка польского языка и добавлен голос для македонского языка. Обеспечена совместимость со свежими альфа- и бета-выпусками экранного ридера NVDA. Устранены проблемы со сборкой на платформе Linux, возникавшие при отсутствии Speech Dispatcher.

В RHVoice применяются наработки проекта HTS (HMM/DNN-based Speech Synthesis System) и параметрический метод синтеза со статистическими моделями (Statistical Parametric Synthesis на базе HMM — Hidden Markov Model). Плюсом статистической модели являются низкие накладные расходы и нетребовательность к мощности CPU. Все операции выполняются локально на системе пользователя. Поддерживается три уровня качества речи (чем ниже качество — тем выше производительность и меньше время реакции).

Минусом статистической модели является относительно низкое качество произношения, которое не достигает уровня синтезаторов, генерирующих речь на основе комбинации фрагментов естественной речи, но тем не менее результат вполне разборчив и напоминает трансляцию записи с громкоговорителя. Для сравнения, проект Silero, предоставляющий открытый движок для синтеза речи на основе технологий машинного обучения и набор моделей для русского языка, по качеству превосходит RHVoice.

Для русского языка доступно 14 вариантов голосов, для английского — 6. Голоса формируются на основе записей естественной речи. В настройках можно изменять скорость, высоту и громкость. Для изменения темпа может применяться библиотека Sonic. Возможно автоматическое определение и переключение языка на основе анализа входного текста (например, для слов и цитат на другом языке может использоваться родная для данного языка модель синтеза). Поддерживаются голосовые профили, определяющие сочетания голосов для разных языков. [1]

Примечания

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *