Notas de release para Text to Speech para IBM Cloud Pak for Data
IBM Cloud Pak for Data
Se han incluido las siguientes características y cambios para cada release y actualización de las instancias instaladas o locales de IBM Watson® Text to Speech para IBM Cloud Pak for Data. A menos que se indique lo contrario, todos los cambios son compatibles con releases anteriores y están disponibles de forma automática y transparente para todas las aplicaciones nuevas y existentes.
Para obtener información sobre las limitaciones conocidas del servicio, consulte Limitaciones conocidas.
Para obtener información sobre los releases y las actualizaciones del servicio para IBM Cloud, consulte Notas del release para Text to Speech para IBM Cloud.
30 de octubre de 2024 (Versión 4.8.7 )
- Ya está disponible la versión 4.8.7
- Speech to Text para IBM Cloud Pak for Data versión 4.8.7 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
25 de septiembre de 2024 (Versión 5.0.3 )
- Ya está disponible la versión 5.0.3
- Speech to Text para IBM Cloud Pak for Data versión 5.0.3 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
28 de agosto de 2024 (Versión 4.8.6 )
- Ya está disponible la versión 4.8.6
- Speech to Text para IBM Cloud Pak for Data versión 4.8.6 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
28 de agosto de 2024 (Versión 5.0.2 )
- Ya está disponible la versión 5.0.2
- Speech to Text para IBM Cloud Pak for Data versión 5.0.2 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
31 de julio de 2024 (Versión 5.0.1 )
- Ya está disponible la versión 5.0.1
- Speech to Text para IBM Cloud Pak for Data versión 5.0.1 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
19 de junio de 2024 (Versión 5.0.0 )
- Ya está disponible la versión 5.0.0
- Speech to Text para IBM Cloud Pak for Data versión 5.0.0 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
24 de abril de 2024 (Versión 4.8.5 )
- Ya está disponible la versión 4.8.5
- Speech to Text para IBM Cloud Pak for Data versión 4.8.5 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
27 de marzo de 2024 (Versión 4.8.4 )
- Ya está disponible la versión 4.8.4
- Speech to Text para IBM Cloud Pak for Data versión 4.8.4 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
28 de febrero de 2024 (Versión 4.8.3 )
- Ya está disponible la versión 4.8.3
- Speech to Text para IBM Cloud Pak for Data versión 4.8.3 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
31 de enero de 2024 (Versión 4.8.2 )
- Ya está disponible la versión 4.8.2
- Speech to Text para IBM Cloud Pak for Data versión 4.8.2 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
30 de noviembre de 2023 (Versión 4.8.0 )
- Ya está disponible la versión 4.8.0
- Speech to Text para IBM Cloud Pak for Data versión 4.8.0 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
27 de septiembre de 2023 (Versión 4.7.3 )
- Ya está disponible la versión 4.7.3
- Speech to Text para IBM Cloud Pak for Data versión 4.7.3 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
28 de julio de 2023 (Versión 4.7.1 )
- Ya está disponible la versión 4.7.1
- Speech to Text para IBM Cloud Pak for Data versión 4.7.1 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
9 de junio de 2023 (Versión 4.7.0 )
- Ya está disponible la versión 4.7.0
- Speech to Text para IBM Cloud Pak for Data versión 4.7.0 ya está disponible. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
2 de mayo de 2023 (Versión 4.6.5)
- Ya está disponible la versión 4.6.5
-
Text to Speech para IBM Cloud Pak for Data versión 4.6.5 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.6.x y Red Hat OpenShift versiones 4.10 y 4.12. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Nuevas voces neuronales expresivas en inglés de Australia
-
El servicio ahora da soporte a dos nuevas voces neuronales expresivas para el inglés australiano:
en-AU_HeidiExpressiveen-AU_JackExpressive
Las voces neuronales expresivas ofrecen un discurso que suena natural que es excepcionalmente claro, nítido y fluido. Las nuevas voces están generalmente disponibles (GA) para su uso en producción. Dan soporte al uso de los símbolos fonéticos estándar IPA (International Phonetic Alphabet) y IBM SPR (Symbolic Phonetic Representation). Para obtener más información, consulte
- Nueva voz neuronal mejorada en coreano
-
El servicio ahora da soporte a una nueva voz neuronal mejorada para el coreano:
ko-KR_JinV3Voice. La nueva voz está disponible a nivel general (GA) para uso de producción. Da soporte al uso de los símbolos fonéticos estándar IPA (International Phonetic Alphabet) y IBM SPR (Simbólico Phonetic Representation). Para obtener más información, consulte - Nueva beta Países Bajos Países Bajos voz neuronal mejorada
-
El servicio ahora da soporte a una nueva voz femenina neuronal mejorada para Holanda:
nl-NL_MerelV3Voice. Da soporte al uso de los símbolos fonéticos estándar IPA (International Phonetic Alphabet) y IBM SPR (Simbólico Phonetic Representation).La nueva voz es funcionalidad beta pendiente de completar el soporte para SSML. En su release inicial, la voz no admite el uso de la siguiente funcionalidad relacionada con SSML:
- El elemento
<prosody>con cualquier solicitud de síntesis de voz - Los parámetros
rate_percentageypitch_percentagecon cualquier solicitud de síntesis de voz - El elemento
<mark>con una solicitud de síntesis de voz WebSocket - El parámetro
timingsdel mensaje de texto JSON con una solicitud de síntesis de voz WebSocket
Para obtener más información sobre la nueva voz, su soporte para los símbolos IPA y SPR, y migrar a la nueva voz desde las voces neuronales holandesas en desuso, consulte
- El elemento
- Nueva variable de entorno para el recurso personalizado de servicios Speech
-
La documentación ahora incluye instrucciones para crear una variable de entorno denominada
${CUSTOM_RESOURCE_SPEECH}. Añada la nueva variable al scriptcpd_vars.shy cree el origen del script para utilizar la variable en el entorno. Para obtener más información, consulte Información que necesita para completar esta tarea en Instalación de servicios de voz de Watson, o consulte cualquiera de los temas de actualización para los servicios de voz. - Arreglo de defecto: la voz canadiense francesa ahora maneja correctamente los tiempos numéricos
-
Arreglo de defectos: las voces canadienses francesas pronuncian ahora correctamente momentos como
19:41. Anteriormente, las voces estaban omitiendo elementos de la época en el audio sintetizado. - Arreglo de defecto: la voz japonesa ya no inserta audio inesperado
-
Arreglo de defectos: la voz japonesa ya no inserta audio inesperado en los resultados de síntesis de voz. Anteriormente, se insertaba audio adicional en ciertos casos.
- Arreglo de defectos: actualizar símbolos fonéticos coreanos en la documentación
-
Arreglo de defectos: En la documentación de los símbolos SPR en coreano, los símbolos de dos caracteres para consonantes están ahora entre comillas simples, convirtiéndolos en un único símbolo. Anteriormente, se mostraban como dos símbolos separados, sin comillas. Para obtener más información, consulte Consonantes(coreano).
- Actualización de la documentación de los símbolos IBM SPR
-
La documentación de visión general para los símbolos SPR de IBM se ha actualizado para aclarar el uso de los símbolos de varios caracteres. Para obtener más información, consulte Símbolos de sonido de voz).
- Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Python(CVE-2020-10735)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a ataques de phishing en Python(CVE-2021-28861)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Pypa Setuptools(CVE-2022-40897)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una exposición de información confidencial en systemd(CVE-2022-4415)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Python(CVE-2022-45061)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en Libksba(CVE-2022-47629)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en GNU Tar(CVE-2022-48303)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en FasterXML jackson-databind(CVE-2022-42003)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución arbitraria de código en Perl(CVE-2020-10878)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un bypass de restricciones de seguridad en Apache Tomcat(CVE-2022-45143)
- CVE-2020-10543: Está pendiente la publicación del boletín de seguridad.
29 de marzo de 2023 (Versión 4.6.4)
- Ya está disponible la versión 4.6.4
- Text to Speech para IBM Cloud Pak for Data versión 4.6.4 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.6.x y Red Hat OpenShift versiones 4.10 y 4.12. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Importante: realice una copia de seguridad de los datos antes de actualizar a la versión 4.6.3 o 4.6.4
- Importante: Antes de actualizar a Watson Speech Services versión 4.6.3 o 4.6.4, debe realizar una copia de seguridad de los datos. Conserve la copia de seguridad en una ubicación segura. Para obtener más información sobre la copia de seguridad de los datos de servicios de voz de Watson, consulte Copia de seguridad y restauración de datos de servicios de voz de Watson en Administración de servicios de voz de Watson. Este tema también incluye información sobre la restauración de los datos si es necesario.
- Arreglo de defectos: Ahora puede cambiar los modelos y voces instalados con las opciones de instalación avanzadas
- Arreglo de defectos: durante la instalación, ahora puede especificar diferentes modelos o voces con las opciones de instalación avanzadas de la interfaz de línea de mandatos. Anteriormente, el servicio siempre instalaba los modelos y voces predeterminados. La limitación sigue aplicándose para Watson Speech Services versiones 4.6.0, 4.6.2y 4.6.3. Para obtener información sobre la instalación de modelos y voces, consulte Especificación de opciones de instalación adicionales en Instalación de servicios de Watson Speech.
- Establecimiento de tiempos de espera excedidos del equilibrador de carga
- Los servicios de voz de Watson requieren que cambie los valores de tiempo de espera del equilibrador de carga para el servidor y el cliente a 300 segundos. Estos valores garantizan que las solicitudes de reconocimiento de voz de larga ejecución, aquellas con audio largo o difícil, tengan tiempo suficiente para completarse. Para obtener más información, consulte Información que necesita para completar esta tarea en Instalación de servicios de voz de Watson.
- Actualización de la documentación de los símbolos IBM SPR
- La documentación de visión general para los símbolos SPR de IBM se ha actualizado para aclarar el uso de los símbolos de varios caracteres. Para obtener más información, consulte Símbolos de sonido de voz.
- Vulnerabilidades de seguridad abordadas
- Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a los scripts entre sitios en GNOME libxml2(CVE-2016-3709
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en SQlite(CVE-2020-35525)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un bypass de restricciones de seguridad en Amazon AWS S3 Crypto SDK para GoLang(CVE-2020-8912)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a privilegios elevados del sistema en la compilación Red Hat de OpenJDK(CVE-2021-20264)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una ejecución de código arbitrario en e2fsprogs(CVE-2022-1304)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a errores en TrustCor(CVE-2022-23491)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en GnuTLS(CVE-2022-2509)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una ejecución de código arbitrario en systemd(CVE-2022-2526)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la exposición de información confidencial en AWS SDK for Go(CVE-2022-2582)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la denegación de servicio en cURL libcurl(CVE-2022-32206)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un ataque de intermediario en cURL libcurl(CVE-2022-32208)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a ataques de suplantación en GnuPG(CVE-2022-34903)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en SQLite(CVE-2022-35737)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en zlib(CVE-2022-37434)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en systemd(CVE-2022-3821)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una ejecución de código arbitrario en Gnome libxml2(CVE-2022-40303)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una ejecución de código arbitrario en Gnome libxml2(CVE-2022-40304)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Python Charmers Future(CVE-2022-40899)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en Golang Go(CVE-2022-41716)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-41717)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Freedesktop D-Bus(CVE-2022-42010)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Freedesktop D-Bus(CVE-2022-42011)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Freedesktop D-Bus(CVE-2022-42012)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en MIT krb5(CVE-2022-42898)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en libexpat(CVE-2022-43680)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una ejecución de mandatos arbitrarios en Python(CVE-2015-20107)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en SQlite(CVE-2020-35527)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en GNU Libtasn1(CVE-2021-46848)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en Git(CVE-2022-23521)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en GnuPG Libksba(CVE-2022-3515)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una ejecución de código arbitrario en libexpat(CVE-2022-40674)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución arbitraria de código en Git(CVE-2022-41903)
23 de febrero de 2023 (Versión 4.6.3)
- Ya está disponible la versión 4.6.3
-
Text to Speech para IBM Cloud Pak for Data versión 4.6.3 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.6.x y Red Hat OpenShift versión 4.10. Red Hat OpenShift versión 4.8 ya no está soportado. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Problema conocido: No puede cambiar los modelos y voces instalados con las opciones de instalación avanzadas
-
Problema conocido: Actualmente no puede especificar diferentes modelos o voces con las opciones de instalación avanzadas. El servicio siempre instala los modelos y voces predeterminados. Para obtener información sobre cómo cambiar los modelos después de la instalación, consulte Actualización de modelos y voces para los servicios de voz de Watson en el tema Administración de Watson Servicios de voz en IBM Cloud Pak for Data.
- Problema conocido: la actualización a la versión 4.6.3 puede no completarse
-
Problema conocido: Al actualizar a la versión 4.6.3, el trabajo de copia de seguridad MinIO no se puede suprimir al finalizar. Si esto sucede, la solución es suprimir el trabajo, después del cual la actualización continúa normalmente. Realice los siguientes pasos para resolver el problema.
-
Para determinar si el trabajo de copia de seguridad MinIO permanece sin suprimir, emita el mandato siguiente:
oc get job --namespace {${PROJECT_CPD_INSTANCE} | grep speech-cr-ibm-minio-backupEl trabajo MinIO que no se suprime se identifica mediante una entrada con el formato siguiente:
speech-cr-ibm-minio-backup 1/1 3m25s 1d -
Para suprimir el trabajo de copia de seguridad MinIO, emita el mandato siguiente:
oc delete job speech-cr-ibm-minio-backup --namespace ${PROJECT_CPD_INSTANCE}
Una vez suprimido el trabajo de copia de seguridad, la actualización continúa y se completa.
-
- Información adicional sobre cómo trabajar con instancias de servicio
-
La documentación ahora incluye información sobre la creación de una instancia de servicio con la interfaz de línea de mandatos (
cpl-cli) y sobre la gestión de instancias de servicio. Para obtener más información, consulte los temas siguientes de Watson Servicios de voz en IBM Cloud Pak for Data:- Creación de una instancia de servicios de voz de Watson en Configuración posterior a la instalación
- Gestión de las instancias de servicios de voz de Watson en Administración
- Arreglo de defecto: la versión beta de Tune by Example ya está disponible
-
Corrección de defectos: La función beta Tune by example ya está disponible en Text to Speech para IBM Cloud Pak for Data. Anteriormente, no era posible crear modelos de altavoces.
- Arreglo de defecto: la especificación de números cardinales grandes con el elemento
<say-as>ya no provoca errores para las voces en inglés -
Arreglo de defectos: Ahora puede utilizar el elemento
<say-as>para pronunciar números grandes como números cardinales. Anteriormente, la inclusión de un número grande en el elemento<say-as>con el atributointerpret-as="cardinal"podía hacer que la síntesis de voz fallara para las voces en inglés. Por ejemplo,<say-as interpret-as="cardinal">3,200</say-as>podría hacer que el servicio generara un error. Para obtener más información, consulte cardinal en el tema Elementos SSML. - Arreglo de defectos: Los homónimos y otras palabras son ahora pronunciadas correctamente por las voces en inglés
-
Arreglo de defectos: el servicio ahora pronuncia los homónimos y otras palabras correctamente basándose en su contexto en texto en inglés que se va a sintetizar. Anteriormente, las palabras como
advocateywifipodían ser pronunciadas incorrectamente por las voces en inglés. - Vulnerabilidad de seguridad corregida
-
Se ha corregido la siguiente vulnerabilidad de seguridad:
30 de enero de 2023 (Versión 4.6.2)
- Ya está disponible la versión 4.6.2
-
Text to Speech para IBM Cloud Pak for Data versión 4.6.2 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.6.x y Red Hat OpenShift versiones 4.8 y 4.10. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- El recurso personalizado ahora incluye una nueva propiedad
fileStorageClass -
El recurso personalizado para los servicios de voz de Watson ahora incluye una propiedad
fileStorageClassademás de la propiedadblockStorageClassexistente. Las clases de almacenamiento de bloques y de archivos se especifican al instalar o actualizar un servicio. Durante la actualización desde una versión anterior, la nueva propiedad se añade automáticamente al recurso personalizado mediante la opción--file_storage_classen el mandatocli manage apply-cr.Para obtener más información sobre las clases de almacenamiento de bloques y archivos disponibles que utiliza con cada una de las soluciones de almacenamiento soportadas, consulte la tabla de Requisitos de almacenamiento en Información que necesita para completar esta tarea en la página "Instalación de servicios de voz de Watson " en Watson Servicios de voz en IBM Cloud Pak for Data.
- Información adicional sobre el suministro de una instancia de servicio
-
La documentación ahora incluye información sobre la creación de una instancia de servicio mediante programación. También incluye ejemplos de listado de instancias de servicio y supresión de una instancia de servicio. Para obtener más información, consulte Creación de una instancia de servicios de voz de Watson en la documentación de Configuración posterior a la instalación en Watson Servicios de voz en IBM Cloud Pak for Data.
- El cifrado del lado del servidor está habilitado para el almacén de datos MinIO
-
Los servicios de voz ahora han habilitado el cifrado del lado del servidor para el almacenamiento de objetos en el almacén de datos MinIO. No es necesaria ninguna acción por su parte.
- Cambiar a webhooks de auditoría
-
Los servicios de voz han eliminado ahora la dependencia de webhook de auditoría. Los servicios ahora escriben sucesos de auditoría directamente en el servidor. Después de actualizar a la versión 4.6.2, es posible que algunos recursos de webhook permanezcan hasta que todos los servicios puedan eliminar la dependencia. Los recursos restantes se eliminarán en un release futuro. No es necesaria ninguna acción por su parte.
- Nuevas voces neuronales expresivas en inglés de EE.UU.
-
El servicio ofrece cuatro nuevas voces neuronales expresivas para el inglés de Estados Unidos:
en-US_AllisonExpressiveen-US_EmmaExpressiveen-US_LisaExpressiveen-US_MichaelExpressive
Las voces neuronales expresivas ofrecen un discurso que suena natural que es excepcionalmente claro, nítido y fluido. Las nuevas voces están generalmente disponibles (GA) para su uso en producción. Dan soporte al uso de los símbolos fonéticos estándar IPA (International Phonetic Alphabet) y IBM SPR (Symbolic Phonetic Representation). Para obtener más información, consulte
- Nuevos estilos de habla con voces neuronales expresivas
-
Las voces neuronales expresivas determinan el sentimiento del texto a partir del contexto de sus palabras y frases. El discurso que producen, además de tener un estilo muy conversacional, refleja el estado de ánimo del texto. Pero usted puede embellecer las tendencias naturales de las voces indicando que todo o parte del texto es para enfatizar uno de los siguientes estilos de habla:
- Alegre-Expresa felicidad y buenas noticias.
- Empático-Expresa empatía o simpatía.
- Neutral-Expresa objetividad y equidad.
- Incierto: expresa confusión o incertidumbre.
Para obtener más información, consulte Utilización de estilos de habla.
- Nuevo énfasis de interjección con voces neuronales expresivas
-
Con voces neuronales expresivas, el servicio detecta automáticamente un conjunto de interjecciones comunes basadas en el contexto. Cuando sintetiza estas interjecciones, les da el énfasis natural que un humano usaría en la conversación normal. Para algunas de las interjecciones, puede utilizar SSML para habilitar o inhabilitar su énfasis. Para obtener más información, consulte Énfasis en las interjecciones.
- Nueva palabra enfatiis con voces neuronales expresivas
-
Las voces expresivas utilizan un estilo conversacional que aplica naturalmente la entonación correcta desde el contexto. Pero usted puede indicar que una o más palabras deben ser dadas más o menos énfasis. El cambio en la tensión puede ser indicado por un aumento o disminución en el paso, la temporización, el volumen, u otros atributos acústicos. Para obtener más información, consulte Cómo resaltar palabras.
- El servicio ahora aplica una validación SSML más estricta
-
El servicio ahora aplica una validación más estricta del texto de entrada que incluye elementos SSML (Speech Síntesis Markup Language). Los elementos necesarios de los atributos deben especificarse con valores válidos. De lo contrario, la solicitud falla con un código de error 400. Para obtener más información sobre la validación de SSML y los requisitos que debe cumplir el texto marcado, consulte Validación de SSML.
- Arreglo de defecto: el género listado para la voz de
en-US_MichaelExpressiveahora es correcto -
Arreglo de defectos: Cuando lista información sobre las voces disponibles, el
genderde la voz deen-US_MichaelExpressivees ahoramale. Anteriormente, el género de la voz se describía erróneamente comofemale. Para obtener más información, consulte Listado de información sobre voces. - Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a problemas en OpenSSL(CVE-2022-1434, CVE-2022-1343, CVE-2022-1292, CVE-2022-1473)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución arbitraria de mandatos en OpenSSL(CVE-2022-2068)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en protobuf(CVE-2022-1941)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de búfer en GNU glibc(CVE-2021-3999)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de seguridad en GNU gzip(CVE-2022-1271)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-27664)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-2879)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable al contrabando de parámetros de consulta en Golang Go(CVE-2022-2880)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-32189)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-41715)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la exposición de información en OpenSSL(CVE-2022-2097)
30 de noviembre de 2022 (Versión 4.6.0)
- Ya está disponible la versión 4.6.0
-
Text to Speech para IBM Cloud Pak for Data versión 4.6.0 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.6.x y Red Hat OpenShift versiones 4.8 y 4.10. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Amazon Web Services (AWS) ahora está soportado
-
Watson Los servicios de voz para IBM Cloud Pak for Data ahora están soportados en Amazon Web Services™ (AWS™). Los servicios dan soporte a Amazon Elastic Block Store, que se especifica estableciendo la propiedad
blockStorageClassdel recurso personalizado de servicios Speech engp2-csiogp3-csi. - Ahora se da soporte a las nuevas clases de almacenamiento
-
Watson Los servicios de voz para IBM Cloud Pak for Data ahora dan soporte a dos clases de almacenamiento adicionales:
- IBM Cloud Block Storage (
ibmc-block-gold) - NetApp Trident (
ontap-nas)
Especifique la clase de almacenamiento con la propiedad
blockStorageClassdel recurso personalizado de servicios Speech. Para obtener más información sobre todas las clases de almacenamiento soportadas, consulte los temas siguientes en Watson Servicios de voz en IBM Cloud Pak for Data:- Antes de empezar en Instalación de servicios de voz de Watson
- Especificación de una clase de almacenamiento en Utilización del recurso personalizado de Watson Speech Services
- IBM Cloud Block Storage (
- Problema conocido: algunos pods de servicios de voz de Watson no tienen anotaciones que se utilicen para la planificación
-
Problema conocido: A algunos pods de servicios de voz de Watson les falta la anotación
cloudpakInstanceId. Si utiliza el servicio de planificación IBM Cloud Pak for Data, los pods de servicios de voz de Watson sin la anotacióncloudpakInstanceIdse- Planificado por el planificador de Kubernetes predeterminado en lugar del servicio de planificación
- No incluido en la aplicación de la cuota
- La supervisión del almacén de datos PostgreSQL ya está disponible
-
Ahora puede habilitar la supervisión del almacén de datos PostgreSQL para recibir actualizaciones sobre su uso y estado por parte de los servicios de voz de Watson. Los sucesos los puede consumir el software de supervisión Prometheus o cualquier aplicación que utilice para la supervisión. Al activar la supervisión de los proyectos definidos por el usuario, además de la supervisión predeterminada de la plataforma, puede supervisar sus propios proyectos con la pila de supervisión de Red Hat® OpenShift® Container Platform. Esta prestación incluye una propiedad adicional,
spec.global.datastores.postgressql.enablePodMonitor, en el recurso personalizado de servicios de voz.Para obtener más información, consulte el tema Supervisión del almacén de datos de PostgreSQL para servicios de Watson Speech en la sección Administración de Watson Servicios de voz en IBM Cloud Pak for Data.
- Arreglo de defecto: el almacén de datos PostgreSQL ya no está instalado si solo están habilitados los microservicios de tiempo de ejecución
-
Arreglo de defectos: el almacén de datos PostgreSQL ya no se instala si sólo están habilitados los microservicios de tiempo de ejecución. Ahora el almacén de datos sólo se instala si se ha instalado al menos uno de los microservicios
sttAsync,sttCustomizationottsCustomization. PostgreSQL no se desinstala si en una fecha posterior estos microservicios están inhabilitados.Antes de la versión 4.6.0, PostgreSQL siempre se instalaba con los servicios de voz. Si es un cliente existente que solo ha utilizado los microservicios de tiempo de ejecución de los servicios de voz anteriores a la versión 4.6.0, PostgreSQL permanece instalado pero no se utiliza. En este caso, la instalación de PostgreSQL persiste entre actualizaciones.
El almacén de datos MinIO siempre se instala porque los microservicios de tiempo de ejecución dependen de él. El almacén de datos de RabbitMQ sólo se instala si está instalado el microservicio de
sttAsync.Para obtener más información, consulte Propiedades de almacén de datos en Utilización del recurso personalizado de servicios de voz de Watson en Watson Servicios de voz en IBM Cloud Pak for Data.
- Arreglo de defecto: la creación de una política de red ya no es necesaria para que el operador PostgreSQL supervise sus operandos
-
Arreglo de defectos: Para la versión 4.6.0, no es necesario crear una política de red para permitir que el operador PostgreSQL supervise sus operandos, tal como se describe en la actualización del servicio 10 de noviembre de 2022(Versiones 4.0.x y 4.5.x). A partir de la versión 4.6.0, el servicio maneja esta situación automáticamente.
- Nuevo parámetro de consulta beta
rate_percentagepara controlar la velocidad de habla global -
El servicio ofrece un nuevo parámetro de consulta
rate_percentagepara modificar la velocidad de habla para una solicitud de síntesis de voz. La tasa de habla es la velocidad a la que el servicio habla el texto que sintetiza en voz. Una tasa más alta hace que el texto se hable más rápidamente; una tasa más baja hace que el texto se hable más despacio. El parámetro cambia la velocidad predeterminada por voz para una solicitud completa. Para obtener más información, consulte Modificación de la velocidad de habla. - Nuevo parámetro de consulta beta
pitch_percentagepara controlar el tono de conversación global -
El servicio ofrece un nuevo parámetro de consulta
pitch_percentagepara modificar el tono de conversación para una solicitud de síntesis. El tono de voz representa el tono del discurso que el servicio sintetiza. Representa lo alto o bajo que el tono de la voz es percibido por el oyente. Un tono más alto resulta en el habla que se habla en un tono más alto y se percibe como una voz más alta; un tono más bajo resulta en el habla que se habla en un tono más bajo y se percibe como una voz más baja. El parámetro cambia el tono predeterminado por voz para una solicitud completa. Para obtener más información, consulte Modificación del tono de voz. - Arreglo de defectos: las traducciones de palabras personalizadas ahora aceptan comas en todos los casos
-
Arreglo de defectos: las traducciones de palabras añadidas a los modelos personalizados ahora aceptan comas en todos los casos. Anteriormente, una coma en una conversión ocasionalmente podía hacer que la conversión no generara un audio válido cuando se utilizaba para las síntesis de voz. Este problema se ha identificado en modelos personalizados en inglés de EE.UU.
- Arreglo de defectos: la síntesis francesa de fechas es ahora coherente
-
Arreglo de defectos: La síntesis en francés ya no incluye el artículo "le" antes de las fechas con el formato "el ordinal de mes." Anteriormente, el artículo se incluía sólo para el primer día del mes para los franceses (por ejemplo, "el primero de septiembre", "le premier septembre").
- Arreglo de defectos: se ha mejorado la síntesis en japonés para manejar series largas de texto de entrada
-
Arreglo de defectos: ahora el servicio sintetiza correctamente las solicitudes japonesas que incluyen series largas de caracteres. Anteriormente, el servicio no podía sintetizar correctamente series muy largas de texto en japonés.
- Arreglo de defectos: Añadir reglas para la documentación de denominación de modelos personalizados
-
Arreglo de defectos: La documentación ahora proporciona reglas detalladas para denominar modelos personalizados. Para obtener más información, consulte
- Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un ataque de configuración cruzada contra OpenPGP(CVE-2021-40528)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en PCRE2(CVE-2022-1586)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Vim(CVE-2022-1621)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio en Vim(CVE-2022-1629)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en Vim(CVE-2022-1785, CVE-2022-1897, CVE-2022-1927)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en cURL libcurl(CVE-2022-22576)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la exposición de credenciales en cURL libcurl(CVE-2022-27774)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la exposición de información de datos en cURL libcurl(CVE-2022-27776)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en cURL libcurl(CVE-2022-27782)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en GNOME libxml2(CVE-2022-29824)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una inyección de SQL en PostgreSQL(CVE-2022-31197)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en libexpat(CVE-2022-25313)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en libexpat(CVE-2022-25314)
10 de noviembre de 2022 (Versiones 4.0.x y 4.5.x)
- Problema conocido: se ha actualizado la política de red necesaria para el operador PostgreSQL
-
Problema conocido: Para servicios Speech versión 4.0.x (sin incluir la versión 4.0.0) y 4.5.x, si el operador PostgreSQL y los servicios Speech están instalados en distintos espacios de nombres, el operador PostgreSQL no puede supervisar los operandos PostgreSQL para los servicios Speech. El operador no puede supervisar los operandos mediante la política de red que está en vigor para los servicios de voz.
Este problema no impide que el clúster PostgreSQL funcione correctamente. El clúster permanece activo y totalmente funcional. Sin embargo, el operador no puede actualizar los operandos al actualizar a nuevas versiones de los servicios de voz.
La solución para el problema es crear una política de red adicional para el operador PostgreSQL, tal como se muestra en los pasos siguientes. Puede realizar los pasos independientemente de si el operador PostgreSQL está instalado en el mismo espacio de nombres que los servicios Speech o en un espacio de nombres diferente.
-
Inicie sesión como administrador del proyecto Red Hat® OpenShift® donde están instalados los servicios de Speech.
-
Especifique el mandato siguiente para actualizar la política de red para los servicios de voz:
cat << EOF | oc apply -f - apiVersion: networking.k8s.io/v1 kind: NetworkPolicy metadata: labels: app.kubernetes.io/component: stt app.kubernetes.io/instance: {{ <custom-resource-name> }} app.kubernetes.io/name: speech-to-text release: {{ <custom-resource-name> }} name: <custom-resource-name>-postgres-network-policy namespace: {{ <cpd-instance-namespace> }} spec: ingress: - from: - namespaceSelector: {} podSelector: matchLabels: app.kubernetes.io/name: cloud-native-postgresql EOFdonde
<custom-resource-name>es el nombre del recurso personalizado Speech services. El nombre recomendado para la versión 4.0.x esspeech-prod-cr; el nombre recomendado para la versión 4.5.x esspeech-cr.<cpd-instance-name>es el nombre del proyecto (espacio de nombres) en el que están instalados los servicios de voz. La documentación utiliza la variable de entorno${PROJECT_CPD_INSTANCE}para identificar el espacio de nombres.
-
Para verificar que la política de red actualizada permite al operador supervisar los operandos y que el clúster PostgreSQL está en buen estado, especifique el mandato siguiente, donde
<custom-resource-name>y<cpd-instance-name>son los valores que ha utilizado en el paso anterior:oc -get cluster {{ <custom-resource-name> }}-postgres -n {{ <cpd-instance-namespace> }}Si el clúster PostgreSQL funciona correctamente, el mandato genera una salida similar a la siguiente:
NAME AGE INSTANCES READY STATUS PRIMARY speech-cr-postgres 14d 3 3 Cluster in healthy state speech-cr-postgres-1
Estos pasos no hacen que el operador actualice los operandos a las versiones más recientes. Sin embargo, los operandos se actualizan como se esperaba la próxima vez que actualice el software de servicios de Speech.
-
13 de octubre de 2022 (Versión 4.5.3)
- Ya está disponible la versión 4.5.3
-
Text to Speech para IBM Cloud Pak for Data versión 4.5.3 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.5.x y Red Hat OpenShift versiones 4.6, 4.8, y 4.10. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Los sucesos de auditoría están disponibles para los servicios de voz
-
El servicio de registro de auditoría de IBM Cloud Pak for Data genera y reenvía sucesos de auditoría para los servicios Speech to Text y Text to Speech. Los sucesos de auditoría coinciden con los que están disponibles para Activity Tracker con el servicio público. Para obtener más información, consulte Sucesos de auditoría.
- No puede desinstalar componentes de servicio Speech individuales
-
La documentación indica ahora que no puede desinstalar componentes de servicio individuales (microservicios) una vez instalados. Para eliminar cualquiera de los siguientes componentes, debe desinstalar los servicios Watson Speech en su totalidad y reinstalar solo los componentes que necesita: Speech to Text tiempo de ejecución, Speech to Text HTTP asíncrono, Speech to Text personalización, Text to Speech tiempo de ejecución y Text to Speech personalización. Para obtener más información sobre la instalación de los servicios de voz, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Nuevo parámetro beta
spell_out_modepara voces en alemán -
Para indicar cómo deben escribirse los caracteres individuales de una serie, ahora puede incluir el parámetro de consulta beta
spell_out_modecon una solicitud de síntesis para una voz en alemán. De forma predeterminada, el servicio especifica los caracteres individuales a la misma velocidad a la que sintetiza el texto para un idioma. Puede utilizar el parámetro para indicar al servicio que deletree los caracteres individuales más lentamente, en grupos de uno, dos o tres caracteres. Utilice el parámetro con el elemento SSML<say-as>para controlar cómo se sintetizan los caracteres de una serie. Para obtener más información, consulte Especificación de cómo se escriben las series. - Limitación conocida con el uso del formato de audio Ogg con el navegador Safari
-
De forma predeterminada, el servicio devuelve audio en formato de audio Ogg con el códec Opus (
audio/ogg;codecs=opus). Sin embargo, el formato de audio Ogg no está soportado con el navegador Safari. Si utiliza el servicio Text to Speech con el navegador Safari, debe especificar un formato diferente en el que desea que el servicio devuelva el audio.- Para obtener más información sobre los formatos disponibles, consulte Formatos de audio soportados.
- Para obtener más información sobre cómo especificar un formato, consulte Especificación de un formato de audio.
- Resolución de problemas de actualización de la versión 4.0.x a la versión 4.5.x
-
Al actualizar los servicios de voz de la versión 4.0.x a la versión 4.5.x, es posible que se encuentre con un problema en el que los pods PostgreSQL se atascan en el estado
Terminating. Si este problema se produce durante la actualización, realice los pasos siguientes para resolver el problema. La información y los pasos también se documentan en Actualización de servicios de voz de Watson de la versión 4.0 a la versión 4.5 en el tema Actualización de Watson Servicios de voz en IBM Cloud Pak for Data.- Utilice el mandato siguiente para identificar los pods que permanecen en el estado
Terminating:
oc get pods -n ${PROJECT_CPD_INSTANCE} -o wide | awk {'print $1'}- Utilice el mandato siguiente para establecer la variable de entorno
podspara incluir la lista de pods que permanecen en el estadoTerminating:
pods=$(oc get pods -n ${PROJECT_CPD_INSTANCE} -o wide | grep Terminating | awk {'print $1'})- Utilice el mandato siguiente para suprimir los pods atascados para que el proceso de actualización pueda continuar:
oc delete pod $pods -n ${PROJECT_CPD_INSTANCE} --force=true --grace-period=0 - Utilice el mandato siguiente para identificar los pods que permanecen en el estado
- Actualización de la documentación del elemento SSML
<prosody> -
La documentación para el elemento SSML
<prosody>y sus parámetrospitchyratese ha mejorado y aclarado. Ahora también incluye una descripción de las diferencias entre el servicio y la última versión de la especificación SSML. Para obtener más información, consulte Elemento<prosody>. - Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un error de lectura excesiva de almacenamiento intermedio en el kernel de Linux(CVE-2020-28915)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de seguridad en GNU Gzip(CVE-2022-1271)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a privilegios elevados en Apple macOS Monterey y macOS Big Sur(CVE-2022-26691)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a privilegios elevados en Linux Kernel(CVE-2022-27666)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable al cross-site scripting en Apache Tomcat(CVE-2022-34305)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en GNU C Library(CVE-2019-19126)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en GNU C Library(CVE-2020-10029)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en GNU glibc(CVE-2020-1751)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en GNU glibc(CVE-2020-1752)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la divulgación o denegación de servicio de información en GNU glibc(CVE-2021-35942)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable al desbordamiento de almacenamiento intermedio en OpenSSL(CVE-2021-3711)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la divulgación de información o denegación de servicio en OpenSSL(CVE-2021-3712)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una seguridad debilitada en OpenSSL(CVE-2021-4160)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en OpenSSL(CVE-2022-0778)
3 de agosto de 2022 (Versión 4.5.1)
- Ya está disponible la versión 4.5.1
- Text to Speech para IBM Cloud Pak for Data versión 4.5.1 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.5.x y Red Hat OpenShift versiones 4.6, 4.8, y 4.10. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Soporte para clústeres habilitados para FIPS
- Text to Speech para IBM Cloud Pak for Data y Speech to Text para IBM Cloud Pak for Data ahora admiten la ejecución en clústeres habilitados para FIPS (Federal Information Processing Standard). Para obtener más información, consulte Servicios que dan soporte a FIPS.
- Arreglo de defectos: se han corregido los cálculos de almacenamiento efímero para evitar desalojos ocasionales de pod
- Arreglo de defectos: se ha solucionado un defecto y el cálculo de los límites de almacenamiento efímero es ahora más preciso para los tiempos de ejecución de Text to Speech para IBM Cloud Pak for Data y Speech to Text para IBM Cloud Pak for Data. Estos cambios evitan desalojos ocasionales de pods cuando los tiempos de ejecución de los servicios están bajo mucha carga.
- El servicio no da soporte a la síntesis de voz multilingüe
- El servicio no soporta la síntesis de voz multilingüe en este momento. Sin embargo, puede utilizar la personalización para aproximar la pronunciación de las palabras de otros idiomas. Para obtener más información, consulte Síntesis de voz multilingüe.
- Vulnerabilidades de seguridad abordadas
- Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en rsyslog(CVE-2022-24903)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un problema de contrabando de solicitudes HTTP en Twisted(CVE-2022-24801)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio, causada por un desbordamiento de búfer en Twisted(CVE-2022-21716)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio, provocada por una comparación de series incompleta en NumPy(CVE-2021-34141)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio, causada por un desbordamiento de almacenamiento intermedio en NumPy(CVE-2021-41496)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la exposición de la cabecera de cookie y autorización en Twisted(CVE-2022-21712)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Perl(CVE-2018-18311)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Perl(CVE-2018-18312)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Perl(CVE-2018-18313)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Perl(CVE-2018-18314)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Perl(CVE-2018-6913)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la inyección de CRLF en Python(CVE-2019-11236)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en GNU Tar(CVE-2019-9923)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en Perl(CVE-2020-10543)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de enteros en Perl(CVE-2020-10878)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio en Perl(CVE-2020-12723)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en urllib3(CVE-2021-33503)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a ataques de inyección en Ansible(CVE-2021-3583)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-23772)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable al control de acceso incorrecto en Golang Go(CVE-2022-23773)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-23806)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-24675)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-24921)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Golang Go(CVE-2022-28327)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de almacenamiento intermedio basado en almacenamiento dinámico en libssh, provocado por una comprobación de límites incorrecta(CVE-2021-3634)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en Python(CVE-2021-3737)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una posible exposición de información confidencial en Python(CVE-2021-4189)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en lxml(CVE-2021-43818)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en MS Visual Studio(CVE-2021-21300)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una omisión de restricciones de seguridad en Git(CVE-2021-40330)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución de código arbitrario en MS Visual Studio(CVE-2022-24765)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución arbitraria de mandatos en Git(CVE-2018-1000021)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a los scripts entre sitios en jQuery(CVE-2015-9251)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a los scripts entre sitios en jQuery(CVE-2019-11358)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a los scripts entre sitios en jQuery(CVE-2020-11022)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a los scripts entre sitios en jQuery(CVE-2020-11023)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una debilidad de seguridad de reglas de enlace de datos en Spring Framework(CVE-2022-22968)
29 de junio de 2022 (Versión 4.5.0)
- Ya está disponible la versión 4.5.0
- Text to Speech para IBM Cloud Pak for Data versión 4.5.0 ya está disponible. Esta versión es compatible con IBM Cloud Pak for Data versión 4.5.x y Red Hat OpenShift versiones 4.6, 4.8, y 4.10. Para más información, consulte Watson Servicios de voz en IBM Cloud Pak for Data.
- Servicios de voz unificados para la documentación de IBM Cloud Pak for Data
- La documentación de instalación y administración para Speech to Text y Text to Speech ahora se combina en la documentación de IBM Cloud Pak for Data. Para obtener más información sobre cómo instalar y gestionar los servicios de Speech, consulte Watson Servicios de Speech en IBM Cloud Pak for Data.
- Cambios en el recurso personalizado de servicios de voz
- El recurso personalizado se crea ahora al instalar inicialmente los servicios de Speech. El proceso se describe en la documentación de instalación de IBM Cloud Pak for Data. El contenido del recurso personalizado ha cambiado:
- El nombre recomendado del recurso personalizado ha cambiado de
speech-prod-craspeech-cr. - Todas las referencias a la clase de almacenamiento han cambiado de variantes de
storageClassablockStorageClass. - El nombre de la clase de almacenamiento en bloque Portworx ha cambiado de
portworx-shared-gp3aportworx-db-gp3-sc. - La propiedad
createSecretse ha eliminado para los almacenes de datos MinIO y PostgreSQl. La propiedad sólo se utiliza internamente. Los servicios de voz siempre utilizan un objeto de secretos si crea uno, y siempre crean automáticamente el objeto si no se proporciona ninguno.
- El nombre recomendado del recurso personalizado ha cambiado de
- El objeto de secretos proporcionado por el usuario ahora está soportado para el almacén de datos RabbitMQ
- Ahora puede proporcionar credenciales de seguridad para el almacén de datos RabbitMQ, del mismo modo que puede hacerlo para los almacenes de datos MinIO y PostgreSQL. El proceso documentado es similar para los tres almacenes de datos.
- Arreglo de defectos: ahora se analizan correctamente varias etiquetas
<phoneme>de SSML consecutivas - Arreglo de defecto: El servicio ahora sintetiza correctamente el texto que contiene etiquetas
<phoneme>consecutivas. Anteriormente, si el texto contenía dos o más etiquetas<phoneme>consecutivas, el servicio solo sintetizaba la primera etiqueta e ignoraba las demás. - Vulnerabilidades de seguridad abordadas
- No se han corregido vulnerabilidades de seguridad para la versión 4.5.0.
25 de mayo de 2022 (Versión 4.0.9)
- La versión 4.0.9 ya está disponible
- Text to Speech para IBM Cloud Pak for Data versión 4.0.9 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Nuevo soporte para el formato de audio de
audio/alaw - La lista de formatos de audio soportados ahora incluye
audio/alaw;rate={rate}. Al igual queaudio/basicyaudio/mulaw, este formato proporciona audio de un solo canal que se codifica utilizando datos de u-law (o mu-law) de 8 bits que se muestrean a 8 kHz. Para obtener más información, consulte Utilización de formatos de audio. - Los servicios de voz no dan soporte al programa de utilidad de copia de seguridad y restauración de OADP
- Los servicios de voz de Watson no dan soporte al programa de utilidad de copia de seguridad y restauración de IBM Cloud Pak for Data OADP (OpenShift APIs for Data Protection). Si los servicios de voz están instalados en un clúster, es posible que no pueda utilizar el programa de utilidad de copia de seguridad y restauración de IBM Cloud Pak for Data OADP para realizar una copia de seguridad de otros servicios instalados en dicho clúster. Esta limitación se aplica a las versiones 4.0.0 y posteriores de los servicios de voz.
- Vulnerabilidades de seguridad abordadas
- Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio, causada por un desbordamiento de búfer con Twisted(CVE-2022-21716)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio en NumPy. (CVE-2021-33430)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a una denegación de servicio, causada por una validación de entrada incorrecta con Spring Framework(CVE-2022-22950)
1 de mayo de 2022 (Versión 1.2.x)
- Importante: fin del servicio de Text to Speech versión 1.2.x en IBM Cloud Pak for Data versión 3.5
- Importante: Text to Speech versión 1.2.x en IBM Cloud Pak for Data versión 3.5 está fuera de servicio a partir del 1 de mayo de 2022. Text to Speech versión 1.2.x ha dejado de estar soportado, disponible y documentado. Para obtener más información sobre el Fin de servicio de Text to Speech, que forma parte del Kit de API de Watson, consulte Interrupción del soporte de software: Kit de API de IBM Watson para IBM Cloud Pak for Data 1.2.x.
27 de abril de 2022 (Versión 4.0.8)
- La versión 4.0.8 ya está disponible
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.8 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Nuevas variables de entorno utilizadas en la documentación de IBM Cloud Pak for Data
-
La mayoría de los mandatos de la documentación de Text to Speech for IBM Cloud Pak for Data se han actualizado para utilizar un conjunto común de variables de entorno. La documentación proporciona un script para exportar automáticamente las variables de entorno antes de ejecutar mandatos de instalación, actualización y administración. Después de obtener el origen del script, puede copiar la mayoría de los mandatos de la documentación y ejecutarlos sin realizar ningún cambio.
Las variables de entorno que define el script incluyen las siguientes:
${PROJECT_CPD_INSTANCE}identifica el proyecto en el que tiene previsto instalar IBM Cloud Pak for Data y los servicios de voz.${PROJECT_CPD_OPS}identifica el proyecto para el operador de plataforma de IBM Cloud Pak for Data.${PROJECT_CPFS_OPS}identifica el proyecto para los servicios básicos de IBM Cloud Pak for Data.
Para obtener más información sobre cómo utilizar las variables de entorno, consulte Prácticas recomendadas: Configuración de variables de instalación.
- La propiedad
ttsVoiceMarginalCPUya no está documentada -
La propiedad
ttsVoiceMarginalCPUse ha eliminado de la documentación del recurso personalizado de servicios de voz. La propiedad gestiona el equilibrio entre simultaneidad y velocidad de síntesis del habla. El valor predeterminado de400garantiza un equilibrio razonable para la mayoría de clientes y mantiene la síntesis en tiempo real. - Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad:
- Boletín de seguridad: Una vulnerabilidad con Guava afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2020-8908)
- Boletín de seguridad: Una vulnerabilidad de Google Guava afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-10237)
- Boletín de seguridad: Las vulnerabilidades en Apache Tomcat afectan a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2022-23181)
- Boletín de seguridad: Una vulnerabilidad de Cyrus SASL afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2022-24407)
- Boletín de seguridad: Una vulnerabilidad en GNU wget afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2016-4971)
- Boletín de seguridad: Una vulnerabilidad en GNU Wget afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-0494)
- Boletín de seguridad: Una vulnerabilidad en 'GNU Wget' afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-20483)
- Boletín de seguridad: Una vulnerabilidad en ISC BIND afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-5741)
- Boletín de seguridad: Una vulnerabilidad en Python afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2019-20916)
- Boletín de seguridad: Una vulnerabilidad con ISC BIND afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25214)
- Boletín de seguridad: Una vulnerabilidad en ISC BIND afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25215)
- Boletín de seguridad: Una vulnerabilidad en ISC BIND afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25216)
- Boletín de seguridad: Una vulnerabilidad en ISC BIND afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25219)
- Boletín de seguridad: Una vulnerabilidad en PostgreSQL JDBC Driver(PgJDBC)afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2022-21724)
- Boletín de seguridad: Una vulnerabilidad en GNU Tar afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2019-9923)
- Boletín de seguridad: Una vulnerabilidad en logback-classic afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-42550)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de búfer basado en pila en la biblioteca GNU C(CVE-2022-23218)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de búfer basado en pila en la biblioteca GNU C(CVE-2022-23219)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a un desbordamiento de búfer y desbordamiento por defecto en la biblioteca GNU C(CVE-2021-3999)
30 de marzo de 2022 (Versión 4.0.7)
- La versión 4.0.7 ya está disponible
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.7 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Propiedad de recurso personalizado para especificar una voz predeterminada
-
La voz predeterminada para las solicitudes de síntesis de voz y pronunciación es
en-US_MichaelV3Voice. Si no instalaen-US_MichaelV3Voice, debe- Utilizar el parámetro
voicepara pasar la voz que se va a utilizar con cada solicitud. - Especificar una nueva voz predeterminada para la instalación de Text to Speech for IBM Cloud Pak for Data utilizando la propiedad
defaultTTSVoiceen el recurso personalizado de servicios de voz. Para obtener más información, consulte Instalación de Watson Text to Speech y Utilización de la voz predeterminada.
- Utilizar el parámetro
- Cambio en la respuesta de temporización de palabras para la interfaz de WebSocket
-
El objeto de respuesta que envía el servicio cuando se solicitan temporizaciones de palabras con la interfaz de WebSocket ha cambiado. Ahora el servicio envía resultados de temporización de palabras en una única matriz que incluye una serie seguida de dos flotantes:
{ "words": [ ["Hello", 0.0, 0.259], ["world", 0.259, 0.532] ] }Anteriormente, el servicio enviaba los resultados de temporización como una matriz que incluía una serie de caracteres seguidos de una matriz de dos flotantes:
{ "words": [ ["Hello", [0.0629826778195474, 0.2590192737303819]], ["world", [0.2598829173456253, 0.5322130804452672]] ] }Además, el nivel de precisión para las temporizaciones y las marcas de las palabras se reduce ahora a tres posiciones decimales. Para obtener más información sobre las nuevas respuestas, consulte Generación de temporizaciones de palabras.
- Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad:
- Red Hat CVE-2022-24407: Se ha encontrado un fallo en el complemento SQL incluido con Cyrus SASL. La vulnerabilidad se produce porque no se ha podido escapar correctamente de la entrada de SQL y se genera una vulnerabilidad de validación de entrada incorrecta. Este defecto permite a un atacante ejecutar mandatos SQL arbitrarios y cambiar las contraseñas de otras cuentas para permitir el escalado de privilegios.
- Boletín de seguridad: Una vulnerabilidad jwt-go afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2020-26160)
- Boletín de seguridad: Una vulnerabilidad en Golang Go afecta a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-29923)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data está afectado pero no clasificado como vulnerable por una ejecución remota de código en Spring Framework(CVE-2022-22965)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la ejecución arbitraria de código con IBM WebSphere Application Server(CVE-2021-23450)
23 de febrero de 2022 (Versión 4.0.6)
- La versión 4.0.6 ya está disponible
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.6 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Todas las voces neuronales están ahora en desuso para IBM Cloud Pak for Data
-
Las voces neuronales que estaban disponibles con Text to Speech for IBM Cloud Pak for Data ahora están en desuso. Las voces neuronales continúan estando disponibles para los usuarios de Text to Speech for IBM Cloud. Solo las voces neuronales mejoradas continúan estando disponibles para los usuarios de Text to Speech for IBM Cloud Pak for Data.
Todas las voces para los siguientes idiomas están ahora en desuso para IBM Cloud Pak for Data:
- Árabe
- Chino (Mandarín)
- Checo
- Holandés (Belga)
- Holandés (Países Bajos)
- Inglés (Australia)
- Coreano
- Sueco
Los usuarios existentes de estas voces pueden seguir utilizándolos de momento, pero las voces se eliminarán por completo en un release futuro. Estas voces ya no se pueden instalar los nuevos usuarios y se han eliminado de la documentación de instalación de IBM Cloud Pak for Data. La propiedad
voiceTypese ha eliminado del recurso personalizado de servicios de voz.Para obtener más información, consulte
- Actualizaciones para importar/exportar scripts
-
Los scripts
import_export.shytransfer_ownership.shse han actualizado. Estos scripts se utilizan para importar y exportar datos entre clústeres, hacer una copia de seguridad y restaurar datos y migrar datos de la versión 3.5 a la versión 4.0.x. Los scripts se han modificado y mejorado de la siguiente manera:- El script
transfer_ownership.shahora requiere que se incluya una opción-cen la línea de mandatos antes del argumento<custom_resource_name>. - El script
transfer_ownership.shrequiere ahora una opción y un argumento-v <version>para indicar la versión a la que se transfiere la propiedad de los recursos. Especifique35para la versión 3.5 o40para la versión 4.0.x. - El script
transfer_ownership.shahora requiere que se incluya una opción-pen la línea de mandatos antes del argumento<postgres_auth_secret_name>. - El argumento
<postgres_auth_secret_name>proporciona el secreto de Kubernetes que se utiliza para autenticarse en el almacén de datos de PostgreSQL al que va a transferir la propiedad. Puede omitir el secreto de autenticación si es el mismo que el valor predeterminado (<custom-resource-name>-postgres-auth-secretpara la versión 4.0.x,user-provided-postgressqlpara la versión 3.5). Debe proporcionar el secreto si es diferente del valor predeterminado. - Ambos scripts ahora incluyen una opción
-h(--help) para visualizar información sobre el script y su uso.
Para obtener más información, consulte
- Administración de Watson Text to Speech, específicamente Importación y exportación de datos y Copia de seguridad y restauración de datos.
- Actualización de Watson Text to Speech, específicamente Migración de datos desde IBM Cloud Pak for Data Versión 3.5.
- El script
- Recomendación actualizada para OpenShift Container Storage
-
A partir de la versión 4.0.6 de los servicios de voz, la clase de almacenamiento recomendada para OpenShift Container Storage es
ocs-storagecluster-ceph-rbd.- Si está instalando los servicios de voz 4.0.6 o actualizando a los servicios de voz 4.0.6 desde IBM Cloud Pak for Data versión 3.5, especifique la clase de almacenamiento de
ocs-storagecluster-ceph-rbddurante la instalación o actualización. - Si está actualizando a los servicios de voz 4.0.6 desde una renovación anterior de Cloud Pak for Data versión 4.0, continúe utilizando
ocs-storagecluster-cephfs. No puede cambiar el almacenamiento que se utiliza en un despliegue existente.
El valor se especifica con la propiedad
storageClassen el recurso personalizado de servicios de voz:################ # Storage class ################ storageClass: "ocs-storagecluster-ceph-rbd"Los servicios de voz funcionan con cualquiera de las versiones de OpenShift Container Storage. La versión recién recomendada tiene permisos de acceso más restrictivos. Para obtener más información, consulte
- Si está instalando los servicios de voz 4.0.6 o actualizando a los servicios de voz 4.0.6 desde IBM Cloud Pak for Data versión 3.5, especifique la clase de almacenamiento de
31 de enero de 2022 (Versión 4.0.5)
- Se ha actualizado la versión 4.0.5
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.5 se ha actualizado para resolver problemas de instalación. La versión del paquete de casos ahora es 4.0.6. Utilice este paquete en lugar del paquete de la versión 4.0.5. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Importante: ya no son necesarios pasos adicionales para la instalación duplicada
-
Importante: las Notas del release del 26 de enero de 2022 incluían notas importantes para los siguientes pasos:
- Paso adicional para realizar una instalación duplicada del almacén de datos Minio
- Pasos adicionales para realizar una instalación duplicada de nuevos modelos de próxima generación
Estos pasos adicionales ya no son necesarios. El paquete de casos se ha actualizado para corregir los problemas de instalación.
26 de enero de 2022 (Versión 4.0.5)
- Ahora está disponible la versión 4.0.5
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.5 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Importante: paso adicional para realizar una instalación duplicada del almacén de datos Minio
-
Importante: estos pasos ya no son necesarios si instala el paquete de casos 4.0.6. Para más información, véase el 31 de enero de 2022(Versión 4.0.5).
Si está realizando una instalación duplicada (por ejemplo, en un entorno aislado), debe realizar un paso adicional antes de completar cualquiera de los pasos siguientes:
- Paso 7 Duplicación de las imágenes en el registro de contenedor privado de Duplicación de imágenes con un modelo de bastión
- Paso 8 Duplicación de las imágenes en el registro de contenedor intermediario de Duplicación de imágenes con un registro de contenedor intermediario
Este paso es obligatorio para copiar las imágenes necesarias para el almacén de datos Minio:
echo 'cp.icr.io,cp/opencontent-minio-client,1.1.4,sha256:7b4cf5e47a0455cfa7ca9ab246b80916e4dccbc1483b3e0f276fb7b0ab3e5c60,IMAGE,linux,x86_64,"",0,CASE,"",""' \ >> $CASE_PATH/ibm-watson-speech-4.0.5-images.csvSi no se realiza este paso, se producirán errores de instalación tanto para Text to Speech como para Speech to Text.
- Ahora el servidor de licencias se instala automáticamente
-
El operador de servicios de voz ahora instala automáticamente el servidor de licencias necesario cuando instala los servicios de voz. Ya no es necesario instalar el servidor de licencias desde los servicios fundacionales de IBM Cloud Pak for Data y ya no es necesario utilizar contenido adicional del YAML para crear una OperandRequest con los enlaces necesarios.
- Eliminación de pasos específicos del servidor PostgreSQL EnterpriseDB
-
La versión anterior de la documentación incluía pasos para el servidor PostgreSQL EnterpriseDB que eran específicos de los servicios de voz. Estos pasos estaban documentados en los temas Actualización de Watson Text to Speech (Versión 4.0) y Desinstalación de Watson Text to Speech. Estos pasos adicionales ya no son necesarios y se han eliminado de la documentación.
- El almacén de datos de RabbitMQ ahora sólo lo utiliza el componente
sttAysnc -
El almacén de datos de RabbitMQ lo han utilizado anteriormente los componentes de los servicios de voz, Speech to Text y también Text to Speech. Ahora maneja la gestión de colas de mensajes no persistentes para el componente HTTP asíncrono Speech to Text (
sttAsync) únicamente. Sólo se utiliza si el componentesttAsyncestá instalado y habilitado. - Nuevas voces neuronales en neerlandés de Bélgica y en checo
-
Ahora hay dos nuevas voces neuronales disponibles:
- Neerlandés de Bélgica: Una nueva voz masculina en neerlandés de Bélgica (flamenco),
nl-BE_BramVoice. - Checo: Un nuevo idioma, checo, con una nueva voz femenina,
cs-CZ_AlenaVoice.
Puede instalar las nuevas voces junto con todas las voces neuronales estableciendo la propiedad
voiceTypedel recurso personalizado enneuralVoices.- Para obtener más información sobre cómo utilizar el recurso personalizado para instalar voces, consulte Instalación de Watson Text to Speech.
- Para obtener más información sobre todos los idiomas y voces disponibles, consulte Idiomas y voces.
- Neerlandés de Bélgica: Una nueva voz masculina en neerlandés de Bélgica (flamenco),
- Arreglo de defectos: actualizar documentación de SSML
-
Corrección de defectos: Se ha actualizado la documentación de SSML para corregir los siguientes errores:
- Los ejemplos del elemento
<break>ahora son correctos. El elemento es unario, como se muestra ahora en los ejemplos. Los ejemplos anteriores incluían etiquetas de apertura y de cierre con texto incorporado. El servicio no decía el texto incorporado. Para obtener más información, consulte El elemento<break>. - El servicio admite SSML (Speech Synthesis Markup Language) versión 1.1. Todas las referencias y ejemplos utilizan ahora la versión correcta. La documentación antes hacía referencia a la versión 1.0.
- Los ejemplos del elemento
- Vulnerabilidades de seguridad abordadas
-
Se han corregido las siguientes vulnerabilidades de seguridad asociadas con Apache Log4j:
- Boletín de seguridad: Una vulnerabilidad en Apache Log4j puede afectar a IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-4104)
- Boletín de seguridad: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data es vulnerable a la denegación de servicio y ejecución de código arbitrario debido a Apache Log4j(CVE-2021-45105 y CVE-2021-45046)
20 de diciembre de 2021 (Versión 4.0.4)
- La versión 4.0.4 ya está disponible
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.4 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- Importante: cambios en las propiedades para inhabilitar el almacenamiento y el registro de datos de usuario
-
Importante: han cambiado los nombres de las propiedades del recurso personalizado de servicios de voz que especifican si los datos de usuario se almacenan y registran. El recurso personalizado contenía anteriormente las propiedades siguientes:
################# # Anonymize logs ################# sttRuntime: anonymizeLogs: "false" # If true, disables storage and logging of user data sttAMPatcher: anonymizeLogs: "false" # If true, disables storage and logging of user data ttsRuntime: anonymizeLogs: "false" # If true, disables storage and logging of user dataEstas propiedades se denominan ahora de la siguiente manera:
################################### # Storage and logging of user data ################################### sttRuntime: skipAudioAndResultLogging: "false" # If true, disables storage and logging of user data sttAMPatcher: skipAudioAndResultLogging: "false" # If true, disables storage and logging of user data ttsRuntime: skipAudioAndResultLogging: "false" # If true, disables storage and logging of user dataSi ya ha establecido estas propiedades en el recurso personalizado para cambiar el valor predeterminado de
falseatrue, debe editar el recurso personalizado. Debe cambiar manualmente los nombres de las propiedades a los nuevos valores y guardar el recurso personalizado actualizado. Para obtener más información, consulte Instalación de Watson Text to Speech. - Importante: cambios en las propiedades del objeto de secretos de PostgreSQL
-
Importante: al instalar los servicios de voz, se crea de forma predeterminada un objeto que contiene una contraseña generada aleatoriamente para el almacén de datos de PostgreSQL. En su lugar, puede optar por especificar la contraseña manualmente. Si lo hace, las propiedades del archivo YAML para el objeto de secretos han cambiado. Para obtener más información, consulte el tema sobre la gestión de los almacenes de datos en Administración de Watson Text to Speech.
- Importante: los pods PostgreSQL no se inician con el operador EnterpriseDB versión 1.10
-
Importante: con Text to Speech para IBM Cloud Pak for Data versión 4.0.3, los pods PostgreSQL basados en el operador EnterpriseDB versión 1.10 pueden fallar y no iniciarse. Esto impide que se inicien los servicios de voz. Existe un método alternativo para este problema. Si los servicios de voz no se inician, consulte PostgreSQL pods do not start with EnterpriseDB version 1.10 operator para obtener información sobre cómo diagnosticar y resolver el problema.
Este problema se ha corregido en Text to Speech para IBM Cloud Pak for Data versión 4.0.4.
- Nuevo soporte para la clase de almacenamiento nativo del contenedor IBM Spectrum Scale
-
Desde la versión 4.0.3, los servicios de voz dan soporte a la clase de almacenamiento nativo del contenedor de IBM Spectrum® Scale. Para utilizar IBM Spectrum Scale, especifique
"ibm-spectrum-scale-sc"para la propiedadstorageClassdel recurso personalizado de servicios de voz. Para obtener más información, consulte Instalación de Watson Text to Speech. - Interacción de servicios de voz con el almacén de datos MinIO durante la instalación
-
Los componentes de tiempo de ejecución de los servicios de voz,
sttRuntimeyttsRuntime, no pueden iniciarse hasta que los modelos y las voces de los servicios se cargan completamente en el almacén de datos de MinIO. Durante la instalación, es posible que los servicios fallen y se reinicien automáticamente una o más veces hasta que se complete la carga de los modelos y las voces. A continuación, se inician correctamente. No se requiere ninguna acción de usuario. - Corrección de defectos: Mejora de la documentación de actualización
-
Arreglo de defecto: la documentación para actualizar los servicios de voz a las nuevas versiones de IBM Cloud Pak for Data versión 4.0.x incluía referencias incorrectas en algunos mandatos. Estas referencias ahora son correctas:
- Las series
watsonSpeechToTextStatusywatsonTextToSpeechStatushan cambiado aspeechStatusen ambos casos. - Las series
status.watsonSpeechToTextVersionystatus.watsonTextToSpeechVersionhan cambiado a.spec.versionen ambos casos.
Para obtener más información, consulte Actualización de Watson Text to Speech.
- Las series
- Arreglo de defectos: Mejorar SSML y síntesis de voz
-
Corrección de defectos: En esta versión se han corregido los siguientes defectos del lenguaje de marcado de síntesis de voz (SSML) y de la síntesis de voz:
- El atributo
pitchdel elemento<prosody>se aplica ahora a todo el texto especificado. Anteriormente, el cambio de tono no siempre se aplicaba a la primera palabra del texto afectado. Además, la documentación ahora incluye una guía adicional sobre la cómo especificar un valorpitch. Para obtener más información, consulte El atributopitch. - La síntesis de habla del texto japonés ahora dice el audio más lentamente. Anteriormente, el discurso sintetizado era demasiado rápido. Si encuentra que la síntesis del texto japonés todavía es demasiado rápido para su aplicación, utilice
el atributo
ratedel elemento SSML<prosody>para controlar la velocidad del habla. Para obtener más información, consulte El atributorate. - Las voces neuronales ahora analizan correctamente el carácter de apóstrofo (
'). Anteriormente, algunas voces neuronales no interpretaban correctamente este carácter.
- El atributo
- Vulnerabilidad de seguridad corregida
-
Se ha corregido la siguiente vulnerabilidad de seguridad asociada con Apache Log4j:
20 de diciembre de 2021 (Versión 1.2.x)
- Importante: ya no puede instalar Text to Speech versión 1.2.x en IBM Cloud Pak for Data versión 3.5
-
Importante: Ya no puede realizar nuevas instalaciones de Text to Speech versión 1.2.x en IBM Cloud Pak for Data versión 3.5. Solo puede instalar Text to Speech versión 4.0.x en IBM Cloud Pak for Data versión 4.x. Para obtener más información, consulte Instalación de Watson Text to Speech.
Los servicios de voz para IBM Cloud Pak for Data versión 3.5 alcanzan su fecha de finalización de soporte el 30 de abril de 2022. Se le recomienda que actualice a la versión más reciente del release 4.0.x de los servicios a la mayor brevedad posible. Para obtener más información, consulte Actualización de Watson Text to Speech.
30 de noviembre de 2021 (Versión 4.0.3)
- La versión 4.0.3 ya está disponible
-
Text to Speech for IBM Cloud Pak for Data versión 4.0.3 ya está disponible. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versiones 4.6 y 4.8. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de Watson Text to Speech.
- El servidor de licencias ahora es un requisito previo obligatorio
-
Ahora debe instalar el servidor de licencias desde los servicios fundacionales de IBM Cloud Pak for Data. Debe instalar el servidor de licencias utilizando el contenido de YAML que se proporciona para crear un OperandRequest con los enlaces necesarios. También debe instalar el servicio de licencias en el mismo espacio de nombres que el servicio (operando), que también es donde está instalado IBM Cloud Pak for Data. Para obtener más información, consulte Instalación de Watson Text to Speech.
- Nuevo soporte para la actualización in situ
-
El servicio ahora da soporte a la actualización in situ, basada en el operador, de la versión 4.0.0 a la versión 4.0.3. El paso de IBM Cloud Pak for Data versión 3.5 a la versión 4.0.3 sigue requiriendo el uso de programas de utilidad de migración. Para obtener más información, consulte Actualización de Watson Text to Speech.
- Cambios de instalación de operador y licencia de EDB PostgreSQL
-
La instalación, actualización y desinstalación del operador y la licencia de Enterprise DB PostgreSQL han cambiado:
- Las instrucciones para instalar el operador y la licencia de EDB PostgreSQL se incluyen ahora con los servicios fundacionales de IBM Cloud Pak for Data. Las instrucciones para instalar los servicios de voz se han actualizado en consecuencia. Para obtener más información, consulte Instalación de Watson Text to Speech.
- Las instrucciones para actualizar de Text to Speech de la versión 4.0.0 a la 4.0.3 incluyen instrucciones para desinstalar el operador EDB PostgreSQL anterior y la licencia y reinstalarlas con los servicios básicos de IBM Cloud Pak for Data. Para obtener más información, consulte Actualización de Watson Text to Speech.
- Las instrucciones para desinstalar los servicios de voz ahora incluyen pasos para eliminar el operador y la licencia de EDB PostgreSQL que se instalaron previamente con Text to Speech. Para obtener más información, consulte Desinstalación de Watson Text to Speech.
- Nueva guía para ampliar la instalación
-
El servicio ahora proporciona una guía actualizada sobre la ampliación de la instalación. La información incluye especificar el número de pods y el número máximo de sesiones simultáneas para voces neuronales o neuronales mejoradas. Para obtener más información, consulte Administración de Watson Text to Speech.
- Actualizaciones de línea de mandatos para programas de utilidad de importación y exportación
-
Los mandatos que se utilizan con los programas de utilidad de importación y exportación para los servicios de voz incluyen nuevas opciones y argumentos. Los programas de utilidad de importación y exportación también son la base para la copia de seguridad y restauración de los servicios y para la migración de IBM Cloud Pak for Data versión 3.5 a la versión 4.0.3. Para obtener más información sobre el uso de los programas de utilidad, consulte
- Nueva propiedad para gestionar la simultaneidad y la síntesis de voz
-
La nueva propiedad
global.ttsVoiceMarginalCPUgestiona la compensación entre la simultaneidad y la velocidad de síntesis del habla. El valor predeterminado de 400 ofrece un equilibrio razonable para la mayoría de los clientes y mantiene la síntesis en tiempo real. Para obtener información sobre cómo modificar este valor para satisfacer sus necesidades, póngase en contacto con el equipo de soporte de IBM. - Nuevo soporte para voces neuronales
-
Todas las voces neuronales que actualmente están disponibles para Text to Speech for IBM Cloud también están disponibles para su instalación en Text to Speech for IBM Cloud Pak for Data. Ahora hay los siguientes idiomas y voces disponibles:
- Árabe:
ar-MS_OmarVoice - Chino (mandarín):
zh-CN_LiNaVoice,zh-CN_WangWeiVoiceyzh-CN_ZhangJingVoice - Neerlandés (belga):
nl-BE_AdeleVoice - Holandés (Países Bajos):
nl-NL_EmmaVoiceynl-NL_LiamVoice - Inglés (australiano):
en-AU_CraigVoice,en-AU_MadisonVoiceyen-AU_SteveVoice - Coreano:
ko-KR_HyunjunVoice,ko-KR_SiWooVoice,ko-KR_YoungmiVoiceyko-KR_YunaVoice - Sueco:
sv-SE_IngridVoice
Para obtener más información sobre todos los idiomas y voces disponibles, consulte Idiomas y voces.
- Árabe:
- Instalación de voces
-
Puede instalar las voces neuronales mejoradas o las voces neuronales. Solo puede instalar uno de los dos tipos de voces. Al instalar el servicio, utilice la propiedad
voiceTypedel recurso personalizado para indicar las voces que se van a instalar:- Especifique
enhancedNeuralVoicespara instalar las voces neuronales mejoradas. A continuación, debe especificar las voces neuronales mejoradas individuales que se van a instalar. De forma predeterminada, sólo se instalanen-US_AllisonV3Voice,en-US_LisaV3Voiceyen-US_MichaelV3Voice. Puede elegir instalar estas voces predeterminadas, estas y otras voces, o solo otras voces. Sólo estarán disponibles las voces que instale. - Especifique
neuralVoicespara instalar las voces neuronales. Todas las voces neuronales están instaladas y disponibles. No puede refinar la lista de voces instaladas.
Para obtener más información sobre cómo utilizar el recurso personalizado para instalar voces, consulte Instalación de Watson Text to Speech.
- Especifique
- Especificar una voz para la síntesis de voz
-
Tanto los métodos HTTP
POSTcomo los métodosGET /v1/synthesize, así como el método WebSocket/v1/synthesize, aceptan un parámetro de consultavoiceopcional que se utiliza para especificar la voz que se va a utilizar para la síntesis de voz. Si omite el parámetrovoice, el servicio utiliza una voz predeterminada. La voz predeterminada depende de las voces que haya instalado:- Si ha instalado las voces neuronales mejoradas, el servicio utiliza la
en-US_MichaelV3Voiceen inglés de EE.UU. de forma predeterminada. Si esa voz no está instalada, debe especificar una voz. - Si ha instalado las voces neuronales, el servicio siempre utiliza la
en-AU_MadisonVoiceen inglés de Australia de forma predeterminada.
Para obtener más información, consulte Utilización de una voz para la síntesis de voz.
- Si ha instalado las voces neuronales mejoradas, el servicio utiliza la
- Especificar un idioma para un modelo personalizado
-
Utilice el método
POST /v1/customizationspara crear un modelo personalizado. El método incluye un parámetrolanguageque se utiliza para identificar el idioma del nuevo modelo personalizado.- Si ha instalado las voces neuronales mejoradas, el parámetro
languagees opcional. De forma predeterminada, el servicio utiliza el identificadoren-USpara el idioma. - Si ha instalado las voces neuronales, el parámetro
languagees obligatorio. Debe especificar el idioma del modelo personalizado en el formato indicado (por ejemplo,en-AUpara el inglés de Australia).
Para obtener más información sobre cómo especificar un idioma al crear un modelo personalizado, consulte Creación de un modelo personalizado.
- Si ha instalado las voces neuronales mejoradas, el parámetro
- Corrección de defectos: Entonación correcta para las voces neurales mejoradas en español
-
Arreglo de defecto: Para las voces en español de España (
es-ES_EnriqueV3Voiceyes-ES_LauraV3Voice), español de Latinoamérica(es-LA_SofiaV3Voice) y español de América del Norte (es-US_SofiaV3Voice), las preguntas de todos los tipos utilizan ahora la entonación correcta. Anteriormente, las voces no utilizan la entonación correcta para algunas preguntas y las pronunciaban como afirmaciones. - Corrección de defectos: Corrección de la documentación sobre multitenencia
-
Arreglo de defectos: El tema IBM Cloud Pak for Data Soporte de multitenencia ha indicado incorrectamente que los servicios Speech no dan soporte a multitenencia. El tema se ha actualizado para indicar que los servicios de voz dan soporte a las operaciones siguientes:
- Instalar el servicio en proyectos distintos
- Instalar el servicio varias veces en el mismo proyecto
- Instalar el servicio una vez y desplegar varias instancias en el mismo proyecto
La documentación específica de los servicios de voz indicaba correctamente el soporte de multitenencia.
1 de octubre de 2021 (Versión 1.1.x)
- La versión 1.1.x está fuera de servicio
- Text to Speech y Speech to Text para IBM Cloud Pak for Data versión 1.1.x quedaron fuera de servicio el 30 de septiembre de 2021. A partir del 1 de octubre de 2021, la documentación de la versión 1.1.x ya no está disponible. Para obtener más información, consulte Retirada de software y interrupción de soporte.
29 de julio de 2021 (Versión 4.0.0)
- La versión 4.0.0 está disponible
-
IBM Watson® Text to Speech for IBM Cloud Pak® for Data versión 4.0.0 ya está disponible. La instalación y la administración del servicio incluyen muchos cambios. Esta versión da soporte a IBM Cloud Pak for Data versión 4.x y Red Hat OpenShift versión 4.6. Para obtener más información sobre cómo instalar y gestionar el servicio, consulte Instalación de IBM Watson Text to Speech for IBM Cloud Pak for Data.
- Voces neuronales mejoradas
-
Para optimizar la calidad general de la síntesis de voz, todas las voces disponibles son ahora voces neuronales mejoradas. Las voces neuronales mejoradas, que incluyen la cadena
V3en sus nombres, ya están disponibles para portugués de Brasil, inglés del Reino Unido y de Estados Unidos, francés, alemán, italiano, japonés y español (todos los dialectos).Las voces neuronales mejoradas admiten el uso tanto de IPA como de SPR (Symbolic Phonetic Representation) de IBM con el elemento SSML
<phoneme>. Las voces neuronales mejoradas también consiguen que el habla suene mucho más natural. Para obtener más información, consulte Idiomas y voces. - Nueva voz en francés canadiense
-
El servicio ahora admite francés canadiense con la voz neuronal mejorada
fr-CA_LouiseV3Voice. La voz en francés canadiense admite la personalización y está disponible a nivel general (GA) para utilizarla en producción.- Para escuchar una muestra de la nueva voz, consulte Idiomas y voces soportados.
- Para obtener más información sobre los símbolos fonéticos y los valores Unicode que están disponibles para el idioma francés canadiense, consulte Símbolos en francés (canadiense).
- Nueva función Ajustar por ejemplo
-
La nueva característica Ajustar por ejemplo le permite controlar la forma en que el servicio dice el texto especificado. Esta característica es una funcionalidad beta que solo se admite para voces y modelos personalizados en inglés de EE.UU. La característica tiene dos componentes:
- Solicitudes personalizadas incluye el texto escrito que se va a decir y el audio grabado que dice el texto como usted quiere escucharlo. El audio especifica la entonación, la cadencia y la acentuación del texto sintetizado. La solicitud puede enfatizar distintas sílabas o palabras, introducir pausas y, en general, hacer que el sonido de audio sintetizado sea más natural y apropiado a su contexto.
- Modelos de hablante proporcionan audio de inscripción para un usuario que dice una o más solicitudes. Un modelo de hablante proporciona una muestra de audio de la voz de un usuario. El servicio se entrena en esa voz, lo que puede ayudar a producir solicitudes de mayor calidad para ese hablante.
Puede especificar una solicitud personalizada con una solicitud de síntesis de voz para indicar cómo la voz del servicio puede pronunciar el texto. Para especificar una solicitud, utilice la extensión SSML
<ibm:prompt id="{prompt_id}"/>. El audio sintetizado duplica la prosodia de la solicitud.El servicio incluye ocho nuevos métodos para trabajar con la característica Ajustar por ejemplo. Las descripciones de los nuevos métodos siguientes proporcionan enlaces a sus entradas en la referencia de API y SDK.
-
El servicio incluye cuatro métodos para trabajar con solicitudes personalizadas:
- Listar solicitudes personalizadas:
GET /v1/customizations/{customization_id}/prompts - Obtener una solicitud personalizada:
GET /v1/customizations/{customization_id}/prompts/{prompt_id} - Suprimir una solicitud personalizada:
DELETE /v1/customizations/{customization_id}/prompts/{prompt_id}
- Listar solicitudes personalizadas:
-
El servicio incluye cuatro métodos para trabajar con modelos de hablante:
- Listar modelos de altavoz:
GET /v1/speakers - Obtener un modelo de orador:
GET /v1/speakers/{speaker_id} - Suprimir un modelo de altavoz:
DELETE /v1/speakers/{speaker_id}
- Listar modelos de altavoz:
- Documentación de Text to Speech unificada
-
La documentación de IBM Watson Text to Speech para IBM Cloud Pak for Data ahora se combina con la documentación para instancias gestionadas del servicio Text to Speech que están alojadas en IBM Cloud. Esto es cierto tanto en la guía como en la documentación de referencia para las dos formas del servicio. Los enlaces a la versión anteriormente separada de la documentación de IBM Cloud Pak for Data para el servicio redirigen a la documentación unificada.
Para obtener más información sobre cómo identificar información que pertenece a una sola versión del producto, consulte Acerca de Text to Speech.
- La versión 1.1.x está fuera de servicio
-
Speech to Text y Text to Speech para IBM Cloud Pak for Data versión 1.1.x estarán fuera de servicio el 30 de septiembre de 2021. Debe actualizar a una versión posterior de los servicios en IBM Cloud Pak for Data antes de esa fecha. A partir del 1 de octubre de 2021, la documentación de la versión 1.1.4 dejará de estar disponible.
12 de abril de 2021 (Versión 1.2.1)
- Añadir al archivo
speech-override.yaml -
El archivo
speech-override.yamlmínimo incluye una definición adicional,dockerRegistryPrefix:global: dockerRegistryPrefix: "{Registry}" image: pullSecret: "{Registry_pull_secret}"{Registry}es la vía de acceso para el registro interno de Docker. Debe serimage-registry.openshift-image-registry.svc:5000/{namespace}, donde{namespace}es el espacio de nombres en el que está instalado IBM Cloud Pak® for Data, normalmentezen.
9 de abril de 2021 (Versión 1.2.1)
- Soporte para modificar modelos y voces instalados
- Los servicios de voz le permiten añadir o eliminar modelos y voces instalados para la versión 1.2 o 1.2.1 de los servicios.
26 de marzo de 2021 (versión 1.2.1)
- La versión 1.2.1 está disponible
-
Text to Speech for IBM Cloud Pak for Data versión 1.2.1 ya está disponible. Las versiones 1.2 y 1.2.1 utilizan la misma documentación e instrucciones de instalación de la versión 1.2. La versión 1.2.1 soporta la instalación en Red Hat OpenShift versión 4.6 además de las versiones 4.5 y 3.11.
- Nuevas instrucciones de instalación
-
Tanto para los clústeres conectados a Internet como para los clústeres aislados, las instrucciones de instalación incluyen los pasos siguientes:
- Utilice el mandato
oc labelpara configurar las etiquetas necesarias para el espacio de nombres donde está instalado IBM Cloud Pak for Data. - Utilice el mandato
oc projectpara asegurarse de que apunta al proyecto OpenShift correcto. - Utilice el mandato
cpd-cli installpara instalar un servidor Enterprise DB PostgreSQL utilizado por los servicios de voz.
Realice estos pasos antes de instalar los servicios de voz.
- Utilice el mandato
- Nuevas instrucciones de desinstalación
-
Se ha añadido un paso al procedimiento para desinstalar los servicios de voz para limpiar todos los recursos de la instalación.
- Registro autorizado para el almacén de datos PostgreSQL
-
La vía de acceso de registro autorizada desde la que el servicio extrae imágenes para el almacén de datos de PostgreSQL ha cambiado. La ubicación del registro ha cambiado de
cp.icr.io/cp/watson-speechacp.icr.io/cp/cpd. Este cambio es transparente para los usuarios. - Secretos para almacenes de datos Minio y PostgreSQL
-
Los almacenes de datos Minio y PostgreSQL requieren los siguientes valores codificados para sus secretos:
- Para Minio, utilice
minio. - Para PostgreSQL, utilice
user-provided-postgressql.
No puede utilizar sus propios valores para estos secretos. Los secretos deben crearse antes de instalar los servicios de voz.
- Para Minio, utilice
- Supresiones del archivo
speech-override.yaml -
Se han eliminado las entradas siguientes del archivo
speech-override.yaml. Se añadieron para solucionar temporalmente un problema que ahora se ha arreglado.sttRuntime: images: miniomc: tag: 1.0.5 sttAMPatcher: images: miniomc: tag: 1.0.5 ttsRuntime: images: miniomc: tag: 1.0.5El archivo
speech-override.yamlabreviado generalmente se ha reducido aún más ajustando su contenido a los elementos básicos.
9 de diciembre de 2020 (versión 1.2)
- La versión 1.2 está disponible
-
Text to Speech para IBM Cloud Pak for Data versión 1.2 está ahora disponible. La instalación y la administración del servicio incluyen muchos cambios. Esta versión da soporte a IBM Cloud Pak for Data versiones 3.5 y 3.0.1, y Red Hat OpenShift versiones 4.5 y 3.11.
- Nuevas voces
-
El servicio ofrece ahora dos nuevas voces:
- Inglés de Reino Unido:
en-GB_CharlotteV3Voice - Francés:
fr-FR_NicolasV3Voice
El servicio también ofrece una versión mejorada de la voz británica existente,
en-KateV3Voice. Para obtener más información sobre todos los idiomas y voces soportados, consulte Idiomas y voces. - Inglés de Reino Unido:
- Corrección de defectos: Arreglo del elemento
<prosody>para japonés -
Arreglos de defectos: para la voz
ja-JP_EmiV3Voice, el servicio ahora analiza correctamente el texto de entrada SSML que incluye una especificación de velocidad de prosodia. Anteriormente, el siguiente uso del elemento<prosody>funcionaba correctamente:<speak>成功する/繁栄する</speak>Pero el siguiente uso del atributo rate con el elemento
<prosody>provocaba que el servicio leyera y dijera la notación SSML incorporada:<speak> <prosody rate="fast">成功する/繁栄する</prosody> </speak>Ahora, el servicio analiza correctamente y aplica el atributo
ratedel elemento<prosody>a la entrada en japonés.
4 de septiembre de 2020 (versión 1.1.4)
- La interfaz de personalización está disponible a nivel general
- La interfaz de personalización está ahora disponible a nivel general. La personalización ya no es una funcionalidad beta. Puede utilizar la interfaz de personalización para especificar cómo debe pronunciar el servicio las palabras inusuales que aparecen en la entrada creando diccionarios personalizados específicos de idioma. Para obtener más información, consulte Comprender la personalización.
15 de julio de 2020 (Versión 1.1.4)
- Red Hat OpenShift versión 4.3 está fuera de servicio
- IBM Cloud Pak for Data 3.0.1 deja de dar soporte a Red Hat OpenShift 4.3 a partir del 1 de septiembre de 2020. Red Hat OpenShift 4.3 estará fuera de servicio el 22 octubre 2020. IBM Cloud Pak for Data está introduciendo soporte para Red Hat OpenShift 4.5. IBM Cloud Pak for Data recomienda que los clientes actualicen a Red Hat OpenShift 4.5 antes del 22 de octubre de 2020. El equipo de soporte de IBM trabajará con los clientes que ya tengan instalado IBM Cloud Pak for Data 3.0.1 en Red Hat OpenShift 4.3. Los nuevos clientes que quieran instalarse en Red Hat OpenShift 4.x deberán instalar Red Hat OpenShift 4.5.
19 de junio de 2020 (Versión 1.1.4)
- La versión 1.1.4 está disponible
-
Text to Speech para IBM Cloud Pak for Data versión 1.1.4 ya está disponible. La instalación y la administración del servicio incluyen muchos cambios. Esta versión da soporte a las versiones 2.5 y 3.0.1 de IBM Cloud Pak for Data y a las versiones 3.11 y 4.3 de Red Hat OpenShift. Para más información sobre la instalación y gestión del servicio, consulte ' Instalación y gestión de " Text to Speech para " IBM Cloud Pak for Data.
- Nuevas voces neuronales
-
El servicio ahora admite cinco voces neuronales nuevas:
- US English:
en-US_EmilyV3Voice,en-US_HenryV3Voice,en-US_KevinV3Voiceyen-US_OliviaV3Voice - Alemán:
de-DE_ErikaV3Voice
Estas voces nuevas tienen las mismas posibilidades de personalización y SSML que el resto de las voces ya existentes. Para obtener más información, consulte Idiomas y voces soportados.
- US English:
- Soporte para el atributo SSML
digitsdel elemento<say-as>para el japonés -
El servicio ahora admite el atributo
digitsdel elemento SSML<say-as>con su voz en japonés. Para obtener más información, consulte El elemento<say-as>. - Procedimientos de copia de seguridad y restauración simplificados
-
Los procedimientos de copia de seguridad y restauración se han simplificado significativamente. Ahora se hace copia de seguridad desde los almacenes de datos, por lo que ya no tiene que volver a crear las operaciones que ha ejecutado. Para obtener más información, consulte Copia de seguridad y restauración de Watson Datos de servicios de voz.
28 de febrero de 2020 (Versión 1.1.3)
- La versión 1.1.3 está disponible
- Ahora está disponible la versión 1.1.3 de Text to Speech for IBM Cloud Pak for Data.
27 de noviembre de 2019 (Versión 1.1.2)
- La versión 1.1.2 está disponible
- Ahora está disponible la versión 1.1.2 de Text to Speech for IBM Cloud Pak for Data.
30 de agosto de 2019 (Versión 1.0.1)
- La versión 1.0.1 está disponible
- Ahora está disponible la versión 1.0.1 de Text to Speech for IBM Cloud Pak for Data. Ahora el servicio funciona con la versión 2.1.0.1 de IBM Cloud Pak for Data. El servicio ahora da soporte a la instalación de IBM Cloud Pak for Data con Red Hat OpenShift.
- Nueva voz neuronal en japonés
- El servicio ofrece ahora la voz neuronal japonesa,
ja-JP_EmiV3Voice. Para obtener más información, consulte Idiomas y voces soportados. - Soporte de FISMA
- El soporte de Federal Information Security Management Act (FISMA) está disponible ahora para Text to Speech for IBM Cloud Pak for Data. El servicio es FISMA High Ready.
28 de junio de 2019 (Versión 1.0.0)
- La versión 1.0.0 está disponible
-
La versión 1.0.0, el release inicial del servicio, ya está disponible. Text to Speech para IBM Cloud Pak for Data se basa en el servicio IBM Watson® Text to Speech de IBM Cloud público. Text to Speech para IBM Cloud Pak for Data difiere del servicio de Text to Speech público de las siguientes maneras. Es posible que encuentre útil esta información si está familiarizado con el servicio Text to Speech en IBM Cloud público.
- Text to Speech for IBM Cloud Pak for Data utiliza señales de acceso para la autenticación. Para obtener más información, consulte la Referencia de API y SDK.
- Los puntos finales de Text to Speech for IBM Cloud Pak for Data son específicos del clúster de IBM Cloud Pak for Data. Para obtener más información, consulte la Referencia de API y SDK.
- Text to Speech for IBM Cloud Pak for Data solamente admite voces neuronales. No da soporte a voces estándares (concatenativas). Las voces neuronales no admiten los elementos SSML
<express-as>y<voice-transformation>. - Text to Speech for IBM Cloud Pak for Data no efectúa ningún registro de solicitudes. No es necesario que utilice la cabecera de solicitud
X-Watson-Learning-Opt-Out. - Text to Speech for IBM Cloud Pak for Data no da soporte a señales Watson. No puede utilizar la cabecera de solicitud
X-Watson-Authorization-Tokenpara autenticarse con el servicio.