Text to Speech for IBM Cloud Pak for Data 的版本注意事項
IBM Cloud Pak for Data
IBM Watson® Text to Speech for IBM Cloud Pak for Data 已安裝或內部部署的實例的每個版本和更新都包含以下功能和變更。 除非另有說明,否則所有變更都與舊版相容,且會自動且透通地適用於所有新的及現有應用程式。
如需服務已知限制的相關資訊,請參閱 已知限制。
如需 IBM Cloud 的服務發佈與更新資訊,請參閱 IBM Cloud 的 Text to Speech 發佈說明。
2024 年 10 月 30 日(版本 4.8.7
- 4.8.7 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.7 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 9 月 25 日 (版本 5.0.3 )
- 版本 5.0.3 現已推出
- Speech to Text 版本 5.0.3 的 IBM Cloud Pak for Data 現已推出。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 8 月 28 日 (版本 4.8.6 )
- 4.8.6 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.6 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 8 月 28 日 (版本 5.0.2 )
- 版本 5.0.2 現已推出
- Speech to Text 版本 5.0.2 的 IBM Cloud Pak for Data 現已推出。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 7 月 31 日(版本 5.0.1
- 版本 5.0.1 現已推出
- Speech to Text 版本 5.0.1 的 IBM Cloud Pak for Data 現已推出。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 6 月 19 日 (版本 5.0.0 )
- 版本 5.0.0 現已推出
- Speech to Text 版本 5.0.0 的 IBM Cloud Pak for Data 現已推出。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 4 月 24 日(版本 4.8.5
- 4.8.5 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.5 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 3 月 27 日(版本 4.8.4
- 4.8.4 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.4 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 2 月 28 日(版本 4.8.3
- 4.8.3 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.3 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2024 年 1 月 31 日(版本 4.8.2
- 4.8.2 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.2 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2023 年 11 月 30 日(版本 4.8.0
- 4.8.0 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.8.0 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2023 年 9 月 27 日(版本 4.7.3
- 4.7.3 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.7.3 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2023 年 7 月 28 日 (版本 4.7.1 )
- 版本 4.7.1 現已推出
- Speech to Text 適用於 IBM Cloud Pak for Data 4.7.1 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2023 年 6 月 9 日(版本 4.7.0
- 4.7.0 版現已上市
- Speech to Text 適用於 IBM Cloud Pak for Data 4.7.0 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
2023 年 5 月 2 日 ( 4.6.5版)
- 現在提供 4.6.5 版
-
Text to Speech for IBM Cloud Pak for Data 4.6.5 版現在可用。 此版本支援 IBM Cloud Pak for Data 4.6.x 版及 Red Hat OpenShift 4.10 版和 4.12版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 新澳大利亞英語表達神經語音
-
服務現在支援兩種澳洲英文的新表達神經語音:
en-AU_HeidiExpressiveen-AU_JackExpressive
表達神經語音提供自然發音的語音,非常清晰、清晰、流暢。 新的語音可供生產使用 (GA)。 它們支援使用標準國際音標 (IPA) 及 IBM 符號語音表示法 (SPR) 音標。 如需相關資訊,請參閱:
- 新韓文強化神經語音
-
服務現在支援韓文的新加強神經語音:
ko-KR_JinV3Voice。 新語音已正式發行 (GA) 供正式作業使用。 它支援使用標準國際音標 (IPA) 及 IBM 符號語音表示法 (SPR) 音標。 如需相關資訊,請參閱: - 新測試版荷蘭文荷蘭文加強神經語音
-
服務現在支援荷蘭荷蘭語的新的加強型神經女性語音:
nl-NL_MerelV3Voice。 它支援使用標準國際音標 (IPA) 及 IBM 符號語音表示法 (SPR) 音標。新的語音是測試版功能,等待 SSML 的支援完成。 在其起始版本中,語音不支援使用下列 SSML 相關功能:
- 具有任何語音合成要求的
<prosody>元素 - 具有任何語音合成要求的
rate_percentage及pitch_percentage參數 - 具有 WebSocket 語音合成要求的
<mark>元素 - 具有 WebSocket 語音合成要求之 JSON 文字訊息的
timings參數
如需新語音、其對 IPA 和 SPR 符號的支援,以及從已淘汰的荷蘭語神經語音移轉至新語音的相關資訊,請參閱
- 具有任何語音合成要求的
- 語音服務自訂資源的新環境變數
-
文件現在包括建立環境變數
${CUSTOM_RESOURCE_SPEECH}的指示。 您將新變數附加至cpd_vars.shScript,並建立 Script 來源以在環境中使用該變數。 如需相關資訊,請參閱 安裝 Watson 語音服務中的 完成這項作業所需的資訊,或參閱語音服務的任何升級主題。 - 問題修正: 加拿大法文語音現在可適當地處理數值時間
-
問題報告修正: 加拿大法文語音現在的發音與
19:41類似。 先前,語音會省略合成音訊中的時間元素。 - 問題修正: 日文語音不再插入非預期的音訊
-
問題修正: 日文語音不再在語音合成結果中插入非預期的音訊。 先前,在某些情況下會插入其他音訊。
- 問題修正: 更新文件中的韓文音標
-
問題修正: 在韓文 SPR 符號的文件中,子音的兩個字元符號現在以單引號括住,使它們成為單一符號。 先前,它們顯示為兩個個別的符號,但未含括引號。 如需相關資訊,請參閱 並行(韓文)。
- IBM SPR 符號的文件更新
-
已更新 IBM SPR 符號的概觀文件,以釐清使用多字元符號。 如需相關資訊,請參閱 語音符號。
- 已解決安全漏洞
-
已修正下列安全漏洞:
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Python 中容易遭到阻斷服務的攻擊(CVE-2020-10735)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 Python 中的網路釣魚攻擊(CVE-2021-28861)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Pypa Setuptools 中的阻斷服務攻擊(CVE-2022-40897)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 systemd 中容易遭到機密性資訊公開的攻擊(CVE-2022-4415)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Python 中容易遭到阻斷服務的攻擊(CVE-2022-45061)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Libksba 中容易遭到任意程式碼執行的攻擊(CVE-2022-47629)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU Tar 中資料堆型緩衝區溢位的攻擊(CVE-2022-48303)
- Security Bulletins: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 FasterXML jackson-databind(CVE-2022-42003)中的阻斷服務攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Perl 中容易遭到任意程式碼執行的攻擊(CVE-2020-10878)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Apache Tomcat 中存在安全限制繞過的漏洞(CVE-2022-45143)
- CVE-2020-10543: 安全公告的發佈擱置中。
2023 年 3 月 29 日 ( 4.6.4版)
- 現在提供 4.6.4 版
- Text to Speech for IBM Cloud Pak for Data 版本 4.6.4 現在可用。 此版本支援 IBM Cloud Pak for Data 4.6.x 版及 Red Hat OpenShift 4.10 版和 4.12版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 重要事項: 在升級至 4.6.3 或 4.6.4 版之前先備份資料
- 重要事項: 升級至 Watson Speech 服務 4.6.3 版或 4.6.4之前,您必須先備份資料。 將備份保留在安全位置。 如需備份 Watson 語音服務資料的相關資訊,請參閱 管理 Watson 語音服務中的 備份及還原 Watson 語音服務資料。 該主題還包括必要時還原資料的相關資訊。
- 問題報告修正程式: 您現在可以使用進階安裝選項來變更已安裝的模型和語音
- 問題報告修正: 在安裝期間,您現在可以使用指令行介面的進階安裝選項來指定不同的模型或語音。 先前,服務一律會安裝預設模型和語音。 此限制繼續適用於 Watson Speech 服務 4.6.0版、4.6.2及 4.6.3版。 如需安裝模型和語音的相關資訊,請參閱 安裝 Watson 語音服務中的 指定其他安裝選項。
- 設定負載平衡器逾時
- Watson 語音服務要求您將伺服器和用戶端的負載平衡器逾時設定變更為 300 秒。 這些設定可確保長時間執行的語音辨識要求 (那些具有長或困難音訊的要求) 有足夠時間來完成。 如需相關資訊,請參閱 安裝 Watson 語音服務中的 完成此作業所需的資訊。
- IBM SPR 符號的文件更新
- 已更新 IBM SPR 符號的概觀文件,以釐清使用多字元符號。 如需相關資訊,請參閱 語音符號。
- 已解決安全漏洞
- 已修正下列安全漏洞:
- Security Bulletins: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 GNOME 中跨網站 Scripting 的攻擊 libxml2(CVE-2016-3709
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 SQlite 中的阻斷服務攻擊(CVE-2020-35525)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Amazon AWS S3 Crypto SDK for GoLang 中存在安全限制繞過漏洞(CVE-2020-8912)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 Red Hat Build of OpenJDK(CVE-2021-20264)中系統專用權提升的攻擊。
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 e2fsprogs 中容易遭到任意程式碼執行的攻擊(CVE-2022-1304)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 TrustCor 中的錯誤(CVE-2022-23491)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 GnuTLS 中容易遭到阻斷服務的攻擊(CVE-2022-2509)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 systemd 中執行任意程式碼(CVE-2022-2526)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 AWS SDK for Go 中的機密性資訊暴露(CVE-2022-2582)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 cURL libcurl(CVE-2022-32206)中容易遭到阻斷服務的攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 cURL libcurl(CVE-2022-32208)中容易遭到中間人攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 GnuPG 中的盜用攻擊(CVE-2022-34903)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 SQLite 中容易遭到阻斷服務的攻擊(CVE-2022-35737)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 zlib 中資料堆型緩衝區溢位的攻擊(CVE-2022-37434)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 systemd 中容易遭到阻斷服務的攻擊(CVE-2022-3821)
- Security Bulletin: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 Gnome libxml2 中的任意程式碼執行的攻擊(CVE-2022-40303)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Gnome libxml2(CVE-2022-40304)中執行任意程式碼的攻擊
- Security Bulletins: 在 Python Charmers Future(CVE-2022-40899)中,IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到阻斷服務的攻擊
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在安全限制繞過漏洞(CVE-2022-41716)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-41717)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Freedesktop D-Bus 中容易遭到阻斷服務的攻擊(CVE-2022-42010)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Freedesktop D-Bus 中容易遭到阻斷服務的攻擊(CVE-2022-42011)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Freedesktop D-Bus 中容易遭到阻斷服務的攻擊(CVE-2022-42012)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 MIT krb5 的阻斷服務攻擊(CVE-2022-42898)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 libexpat 中的阻斷服務攻擊(CVE-2022-43680)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Python 中執行任意指令的攻擊(CVE-2015-20107)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 SQLite 中容易遭到任意程式碼執行的攻擊(CVE-2020-35527)
- Security Bulletins: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU Libtasn1 中的安全限制略過的攻擊(CVE-2021-46848)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Git 中容易遭到任意程式碼執行的攻擊(CVE-2022-23521)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 GnuPG Libksba 中容易遭到任意程式碼執行的攻擊(CVE-2022-3515)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 libexpat 中執行任意程式碼的攻擊(CVE-2022-40674)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Git 中容易遭到任意程式碼執行的攻擊(CVE-2022-41903)
2023 年 2 月 23 日 ( 4.6.3版)
- 現在提供 4.6.3 版
-
Text to Speech for IBM Cloud Pak for Data 4.6.3 版現在可用。 此版本支援 IBM Cloud Pak for Data 4.6.x 版及 Red Hat OpenShift 4.10版。 不再支援 Red Hat OpenShift 4.8 版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 已知問題: 您無法使用進階安裝選項來變更已安裝的模型和語音
-
已知問題: 您目前無法使用進階安裝選項來指定不同的模型或語音。 服務一律會安裝預設模型和語音。 如需在安裝之後變更模型的相關資訊,請參閱 Watson 上的語音服務 IBM Cloud Pak for Data的 管理 主題中的 更新 Watson 語音服務的模型和語音。
- 已知問題: 升級至 4.6.3 版可能無法完成
-
已知問題: 升級至 4.6.3版時,MinIO 備份工作在完成時可能無法刪除。 如果發生這種情況,解決方案是刪除工作,在此之後,升級會正常進行。 執行下列步驟解決問題。
-
若要判定 MinIO 備份工作是否保持未刪除狀態,請發出下列指令:
oc get job --namespace {${PROJECT_CPD_INSTANCE} | grep speech-cr-ibm-minio-backup未刪除的 MinIO 工作由下列格式的項目識別:
speech-cr-ibm-minio-backup 1/1 3m25s 1d -
若要刪除 MinIO 備份工作,請發出下列指令:
oc delete job speech-cr-ibm-minio-backup --namespace ${PROJECT_CPD_INSTANCE}
刪除備份工作之後,升級會繼續並完成。
-
- 使用服務實例的相關資訊
-
文件現在包括使用指令行介面 (
cpl-cli) 建立服務實例以及管理服務實例的相關資訊。 如需相關資訊,請參閱 Watson 語音服務 on IBM Cloud Pak for Data的下列主題:- 後置安裝設定 下的 建立 Watson 語音服務實例
- 管理 下的 管理 Watson 語音服務實例
- 問題報告修正程式: 現在提供測試版「依範例調整」
-
缺陷修正: beta 版的 Tune by example 功能現在可以用於 Text to Speech for IBM Cloud Pak for Data。 先前無法建立說話者模型。
- 問題修正: 使用
<say-as>元素指定大量基數,不會再導致英文語音錯誤 -
問題報告修正: 現在您可以使用
<say-as>元素,將大量數字發音為基數。 先前,在<say-as>元素中以屬性interpret-as="cardinal"含括大量數字,可能會導致英文語音的語音合成失敗。 例如,<say-as interpret-as="cardinal">3,200</say-as>可能會導致服務產生錯誤。 如需相關資訊,請參閱 SSML 元素主題中的 cardinal。 - 問題修正: 現在英文語音已正確發音 Homonyms 及其他單字
-
問題報告修正: 服務現在會根據要合成的英文文字中的環境定義,正確地對匿名及其他單字進行發音。 先前,
advocate和wifi之類的單字可能因英文語音而發音不正確。 - 已解決安全漏洞
-
已修正下列安全漏洞:
2023 年 1 月 30 日 ( 4.6.2版)
- 現在提供 4.6.2 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.6.2 現在可用。 此版本支援 IBM Cloud Pak for Data 4.6.x 版及 Red Hat OpenShift 4.8 和 4.10版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 自訂資源現在包含新的
fileStorageClass內容 -
除了現有的
blockStorageClass內容之外,Watson Speech 服務的自訂資源現在還包含fileStorageClass內容。 安裝或升級服務時,您可以同時指定區塊及檔案儲存空間類別。 在從舊版升級期間,cli manage apply-cr指令上的--file_storage_class選項會自動將新內容新增至自訂資源。如需與每一個支援的儲存空間解決方案搭配使用之可用區塊及檔案儲存空間類別的相關資訊,請參閱 Watson 上的語音服務 IBM Cloud Pak for Data中「安裝 Watson 語音服務」頁面上 完成此作業所需的資訊 下的 儲存體需求 表格。
- 佈建服務實例的其他相關資訊
-
文件現在包含以程式化方式建立服務實例的相關資訊。 它還包括列出服務實例及刪除服務實例的範例。 如需相關資訊,請參閱 Watson IBM Cloud Pak for Data中 後置安裝設定 說明文件中的 建立 Watson 語音服務實例。
- MinIO 資料儲存庫已啟用伺服器端加密
-
現在,語音服務已在 MinIO 資料儲存庫中啟用物件儲存空間的伺服器端加密。 您不需要採取任何動作。
- 變更為審核 Webhook
-
語音服務現在已移除審核 Webhook 相依關係。 服務現在會將審核事件直接寫入伺服器。 升級至 4.6.2版之後,部分 Webhook 資源可能會保留,直到所有服務都可以移除相依關係為止。 其餘資源將在未來版本中移除。 您不需要採取任何動作。
- 新的美式英文表達神經語音
-
服務為美式英文提供四個新的表達神經語音:
en-US_AllisonExpressiveen-US_EmmaExpressiveen-US_LisaExpressiveen-US_MichaelExpressive
表達神經語音提供自然發音的語音,非常清晰、清晰、流暢。 新的語音可供生產使用 (GA)。 它們支援使用標準國際音標 (IPA) 及 IBM 符號語音表示法 (SPR) 音標。 如需相關資訊,請參閱:
- 具有表達神經語音的新說話樣式
-
表達神經語音會根據其單字及詞組的環境定義來決定文字的觀感。 他們所產生的演講,除了具有非常交談式的風格之外,還反映了文字的情緒。 但您可以透過指出所有或部分文字強調下列其中一種說話樣式,來修飾語音的自然傾向:
- 愉快-表示快樂和好消息。
- 同理心-表達同理心或同情。
- 中立-表示客觀性和均勻性。
- 不確定-表示混淆或不確定。
如需相關資訊,請參閱 使用說話樣式。
- 具有表現性神經語音的新意象強調
-
使用表達神經語音,服務會根據環境定義自動偵測一組一般拒絕。 當它合成這些插詞時,它給予它們自然的強調,人類在正常的交談中使用。 對於部分拒絕,您可以使用 SSML 來啟用或停用其強調。 如需相關資訊,請參閱 強調拒絕。
- 新詞強調有表現力的神經聲音
-
表達語音使用交談式樣式,自然會從環境定義套用正確的語調。 但您可以指出一或多個單字將受到或多或少的強調。 應力的變化可以由音高、計時、音量或其他聲學屬性的增加或減少來表示。 如需相關資訊,請參閱 強調單字。
- 服務現在施行更嚴格的 SSML 驗證
-
服務現在對包含「語音合成標記語言 (SSML)」元素的輸入文字施行更嚴格的驗證。 必須以有效值指定屬性的必要元素。 否則,要求會失敗,並產生 400 錯誤碼。 如需 SSML 驗證及標記文字必須符合之需求的相關資訊,請參閱 SSML 驗證。
- 問題修正程式: 針對
en-US_MichaelExpressive語音列出的性別現在是正確的 -
問題報告修正: 當您列出可用語音的相關資訊時,
en-US_MichaelExpressive語音的gender現在是male。 先前,語音的性別被錯誤地描述為female。 如需相關資訊,請參閱 列出語音的相關資訊。 - 已解決安全漏洞
-
已修正下列安全漏洞:
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 OpenSSL 中的問題(CVE-2022-1434、CVE-2022-1343、CVE-2022-1292、CVE-2022-1473)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 OpenSSL 中容易遭到任意指令執行的攻擊(CVE-2022-2068)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 protobuf 中的阻斷服務攻擊(CVE-2022-1941)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU glibc 中緩衝區溢位的攻擊(CVE-2021-3999)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU gzip 中的安全略過的攻擊(CVE-2022-1271)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-27664)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-2879)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中容易受到查詢參數走私的攻擊(CVE-2022-2880)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-32189)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-41715)
- Security Bulletin: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 OpenSSL 中暴露資訊(CVE-2022-2097)
2022 年 11 月 30 日 ( 4.6.0版)
- 現在提供 4.6.0 版
-
Text to Speech for IBM Cloud Pak for Data 版 4.6.0 現在可用。 此版本支援 IBM Cloud Pak for Data 4.6.x 版及 Red Hat OpenShift 4.8 和 4.10版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 現在支援 Amazon Web Services (AWS)
-
Watson Amazon Web Services™ (AWS™) 現在支援 IBM Cloud Pak for Data 的語音服務。服務支援 Amazon Elastic Block Store,您可以透過將語音服務自訂資源的
blockStorageClass內容設為gp2-csi或gp3-csi來指定。 - 現在支援新的儲存類別
-
Watson IBM Cloud Pak for Data 的語音服務現在支援兩個額外的儲存空間類別:
- IBM Cloud Block Storage (
ibmc-block-gold) - NetApp Trident (
ontap-nas)
您可以使用語音服務自訂資源的
blockStorageClass內容來指定儲存類別。 如需所有受支援儲存類別的相關資訊,請參閱 Watson 上的語音服務 IBM Cloud Pak for Data中的下列主題:- 安裝 Watson 語音服務 中的 開始之前
- 使用 Watson 語音服務自訂資源 中的 指定儲存類別
- IBM Cloud Block Storage (
- 已知問題: 部分 Watson 語音服務 Pod 沒有用於排程的註釋
-
已知問題: 部分 Watson 語音服務 Pod 遺漏
cloudpakInstanceId註釋。 如果您使用 IBM Cloud Pak for Data 排程服務,則任何沒有cloudpakInstanceId註釋的 Watson 語音服務 Pod 都會是- 由預設 Kubernetes 排程器而非排程服務排程
- 未包括在配額強制執行中
- 現在可以監視 PostgreSQL 資料儲存庫
-
您現在可以啟用 PostgreSQL 資料儲存庫的監視,以接收 Watson Speech 服務對其使用情形及狀態的更新。 事件可以由 Prometheus 監視軟體或您用於監視的任何應用程式使用。 除了預設的平台監控外,透過啟用使用者定義專案的監控,您可以使用 Red Hat® OpenShift® Container Platform 監控堆疊來監控自己的專案。 此功能在語音服務自訂資源中包含其他內容
spec.global.datastores.postgressql.enablePodMonitor。如需相關資訊,請參閱 Watson 上的語音服務 IBM Cloud Pak for Data的 管理 一節中的主題 監視 Watson 語音服務的 PostgreSQL 資料儲存庫。
- 問題修正: 如果僅啟用執行時期微服務,則不再安裝 PostgreSQL 資料儲存庫
-
問題報告修正: 如果僅啟用執行時期微服務,則不再安裝 PostgreSQL 資料儲存庫。 現在,只有在至少已安裝其中一個
sttAsync、sttCustomization或ttsCustomization微服務時,才會安裝資料儲存庫。 如果稍後停用這些微服務,則不會解除安裝 PostgreSQL。在 4.6.0版之前,PostgreSQL 一律隨語音服務一起安裝。 如果您是現有的客戶,且只使用 4.6.0版之前的語音服務執行時期微服務,則 PostgreSQL 仍會維持已安裝,但不會使用。 在此情況下,PostgreSQL 的安裝會在升級之間持續保存。
一律會安裝 MinIO 資料儲存庫,因為執行時期微服務相依於它。 只有在已安裝
sttAsync微服務時,才會安裝 RabbitMQ 資料儲存庫。如需相關資訊,請參閱 Watson 上的語音服務 IBM Cloud Pak for Data中 使用 Watson 語音服務自訂資源 中的 資料儲存庫內容。
- 問題修正: PostgreSQL 運算子不再需要建立「網路原則」來監視其運算元
-
問題報告修正程式: 對於 4.6.0,不需要建立「網路原則」來容許 PostgreSQL 運算子監視其運算元,如 2022 年 11 月 10 日(4.0.x 版和 4.5.x版) 服務更新中所述。 從 4.6.0版,服務會自動處理此狀況。
- 用於控制廣域說話速率的新測試版
rate_percentage查詢參數 -
服務提供新的
rate_percentage查詢參數,以修改語音合成要求的說話速率。 說話速率是服務將文字合成為語音的速度。 較高的比率會使文字的說出速度更快; 較低的比率會使文字的說出速度較慢。 此參數會變更整個要求的每個語音預設速率。 如需相關資訊,請參閱 修改說話率。 - 用於控制廣域說話間距的新測試版
pitch_percentage查詢參數 -
服務提供新的
pitch_percentage查詢參數,以修改合成要求的說話間距。 說話音高代表服務合成的語音音調。 它代表接聽器所感知的語音音調高或低。 較高的音調會產生以較高音調說出且被視為較高語音的語音; 較低的音調會產生以較低音調說出且被視為較低語音的語音。 此參數會變更整個要求的每個語音預設音高。 如需相關資訊,請參閱 修改說話間距。 - 問題報告修正程式: 自訂單字轉換現在在所有情況下都接受逗點
-
問題修正: 新增至自訂模型的 Word 轉換現在在所有情況下都接受逗點。 先前,翻譯中的逗點有時會導致翻譯在用於語音合成時無法產生有效的音訊。 此問題已在美式英文自訂模型中識別。
- 問題報告修正: 日期的法文合成現在是一致的
-
問題報告修正: 法文合成不再包含 "the ordinal of month" 形式的日期之前的文章 "le"。 在此之前,這篇文章只在法國每月的第一天刊登 (例如 "九月的第一天","九月的總理")。
- 問題修正: 改良日文合成,以處理輸入文字的長字串
-
問題報告修正: 服務現在正確地合成包含長字串的日文要求。 先前,服務無法適當地合成非常長的日文文字字串。
- 問題報告修正程式: 新增自訂模型命名文件的規則
-
問題報告修正: 文件現在提供命名自訂模型的詳細規則。 如需相關資訊,請參閱:
- 已解決安全漏洞
-
已修正下列安全漏洞:
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 OpenPGP 的交叉配置攻擊(CVE-2021-40528)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 PCRE2 中容易遭到任意程式碼執行的攻擊(CVE-2022-1586)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Vim 中資料堆型緩衝區溢位的攻擊(CVE-2022-1621)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Vim 中緩衝區溢位的攻擊(CVE-2022-1629)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 Vim 中執行任意程式碼(CVE-2022-1785、CVE-2022-1897、CVE-2022-1927)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 cURL libcurl(CVE-2022-22576)中的安全限制略過的攻擊
- Security Bulletins: 在 cURL libcurl(CVE-2022-27774)中,IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到認證公開的攻擊
- Security Bulletins: 在 cURL libcurl(CVE-2022-27776)中,IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到資料資訊暴露的攻擊
- Security Bulletins: 在 cURL libcurl(CVE-2022-27782)中,IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到略過安全限制的攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNOME libxml2(CVE-2022-29824)中的阻斷服務攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 PostgreSQL 中容易遭到 SQL 注入的攻擊(CVE-2022-31197)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 libexpat 中的阻斷服務攻擊(CVE-2022-25313)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 libexpat 中執行任意程式碼(CVE-2022-25314)
2022 年 11 月 10 日 ( 4.0.x 和 4.5.x版)
- 已知問題: 已更新 PostgreSQL 運算子所需的網路原則
-
已知問題: 對於語音服務 4.0.x 版 (不包括 4.0.0版) 和 4.5.x,如果 PostgreSQL 運算子和語音服務安裝在不同的名稱空間中,則 PostgreSQL 運算子無法監視語音服務的 PostgreSQL 運算元。 操作員無法透過針對語音服務而備妥的「網路原則」來監視運算元。
此問題不會阻止 PostgreSQL 叢集正常運作。 叢集會保持作用中且完全運作。 不過,當您升級至新版本的語音服務時,操作器無法更新運算元。
問題的解決方案是建立 PostgreSQL 運算子的其他「網路原則」,如下列步驟中所示。 不論 PostgreSQL 操作器是安裝在與語音服務相同的名稱空間中,還是安裝在不同的名稱空間中,您都可以執行這些步驟。
-
以安裝語音服務之 Red Hat® OpenShift® 專案的管理者身分登入。
-
輸入下列指令,以更新語音服務的網路原則:
cat << EOF | oc apply -f - apiVersion: networking.k8s.io/v1 kind: NetworkPolicy metadata: labels: app.kubernetes.io/component: stt app.kubernetes.io/instance: {{ <custom-resource-name> }} app.kubernetes.io/name: speech-to-text release: {{ <custom-resource-name> }} name: <custom-resource-name>-postgres-network-policy namespace: {{ <cpd-instance-namespace> }} spec: ingress: - from: - namespaceSelector: {} podSelector: matchLabels: app.kubernetes.io/name: cloud-native-postgresql EOF其中
<custom-resource-name>是語音服務自訂資源的名稱。 4.0.x 版的建議名稱是speech-prod-cr; 4.5.x 版的建議名稱是speech-cr。<cpd-instance-name>是在其中安裝語音服務的專案 (名稱空間) 名稱。 文件使用環境變數${PROJECT_CPD_INSTANCE}來識別名稱空間。
-
若要驗證更新的「網路原則」是否容許操作員監視運算元,以及 PostgreSQL 叢集是否處於健全狀態,請輸入下列指令,其中
<custom-resource-name>及<cpd-instance-name>是您在前一個步驟中使用的值:oc -get cluster {{ <custom-resource-name> }}-postgres -n {{ <cpd-instance-namespace> }}如果 PostgreSQL 叢集正常運作,則指令會產生類似下列的輸出:
NAME AGE INSTANCES READY STATUS PRIMARY speech-cr-postgres 14d 3 3 Cluster in healthy state speech-cr-postgres-1
這些步驟不會導致操作員將運算元更新至最新版本。 不過,當您下次升級 Speech 服務軟體時,會依照預期來升級運算元。
-
2022 年 10 月 13 日 ( 4.5.3版)
- 現在提供 4.5.3 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.5.3 現在可用。 此版本支援 IBM Cloud Pak for Data 4.5.x 版及 Red Hat OpenShift 4.6版、4.8版及 4.10版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 審核事件可用於語音服務
-
IBM Cloud Pak for Data 審核記載服務會產生並轉遞 Speech to Text 及 Text to Speech 服務的審核事件。 審核事件符合具有公用服務之 Activity Tracker 可用的那些事件。 如需相關資訊,請參閱 審核事件。
- 您無法解除安裝個別的語音服務元件
-
文件現在指出您無法在安裝個別服務元件 (微服務) 之後將它們解除安裝。 若要移除下列任何元件,您必須完整地解除安裝 Watson Speech 服務,並只重新安裝您需要的元件:Speech to Text runtime、Speech to Text asynchronous HTTP、Speech to Text customization、Text to Speech runtime 和 Text to Speech customization。 如需安裝 Speech 服務的詳細資訊,請參閱 Watson 上的 Speech 服務 IBM Cloud Pak for Data。
- 德文語音的新測試版
spell_out_mode參數 -
若要指出如何拼出字串的個別字元,您現在可以在德文語音的合成要求中包括測試版
spell_out_mode查詢參數。 依預設,服務會以合成語言文字的相同速率來拼出個別字元。 您可以使用此參數來指示服務在一個、兩個或三個字元的群組中更慢地拼出個別字元。 搭配使用參數與 SSML<say-as>元素,以控制如何合成字串字元。 如需相關資訊,請參閱 指定如何拼出字串。 - 在 Safari 瀏覽器中使用 Ogg 音訊格式的已知限制
-
依預設,服務會使用 Opus 轉碼器 (
audio/ogg;codecs=opus) 以 Ogg 音訊格式傳回音訊。不過,Safari 瀏覽器不支援 Ogg 音訊格式。 如果您將 Text to Speech 服務與 Safari 瀏覽器搭配使用,則必須指定要讓服務傳回音訊的不同格式。 - 疑難排解從 4.0.x 版升級至 4.5.x 版的問題
-
當您將語音服務從 4.0.x 版升級至 4.5.x版時,可能會遇到 PostgreSQL Pod 停留在
Terminating狀態的問題。 如果在升級期間發生此問題,請執行下列步驟來解決問題。 在 Watson Speech 服務 on IBM Cloud Pak for Data的 升級 主題中,將 Watson 語音服務從 4.0 版升級至 4.5 也會記載這些資訊和步驟。- 使用下列指令來識別仍處於
Terminating狀態的 Pod:
oc get pods -n ${PROJECT_CPD_INSTANCE} -o wide | awk {'print $1'}- 使用下列指令來設定環境變數
pods,以包括保持Terminating狀態的 Pod 清單:
pods=$(oc get pods -n ${PROJECT_CPD_INSTANCE} -o wide | grep Terminating | awk {'print $1'})- 使用下列指令來刪除停滯的 Pod,以便升級程序可以繼續進行:
oc delete pod $pods -n ${PROJECT_CPD_INSTANCE} --force=true --grace-period=0 - 使用下列指令來識別仍處於
- SSML
<prosody>元素的文件更新 -
已改良並釐清 SSML
<prosody>元素及其pitch和rate參數的文件。 它現在還包括服務與 SSML 規格最新版本之間的差異說明。 如需相關資訊,請參閱<prosody>元素。 - 已解決安全漏洞
-
已修正下列安全漏洞:
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Linux Kernel 中緩衝區過度讀取缺失的攻擊(CVE-2020-28915)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU Gzip 中的安全略過的攻擊(CVE-2022-1271)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Apple macOS Monterey 和 macOS Big Sur(CVE-2022-26691)中容易遭到專用權提升的攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Linux Kernel 中容易遭到提升專用權的攻擊(CVE-2022-27666)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Apache Tomcat(CVE-2022-34305)中存在跨站指令碼漏洞
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU C Library 中的安全限制略過的攻擊(CVE-2019-19126)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU C Library 中的阻斷服務攻擊(CVE-2020-10029)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU glibc 中的阻斷服務攻擊(CVE-2020-1751)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU glibc 中的阻斷服務攻擊(CVE-2020-1752)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 GNU glibc(CVE-2021-35942)中的資訊揭露或阻斷服務的攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 OpenSSL 中容易遭到緩衝區溢位的攻擊(CVE-2021-3711)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 OpenSSL 中容易遭到資訊揭露或阻斷服務的攻擊(CVE-2021-3712)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 OpenSSL(CVE-2021-4160)中容易遭到安全減弱的攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 OpenSSL 中容易遭到阻斷服務的攻擊(CVE-2022-0778)
2022 年 8 月 3 日 ( 4.5.1版)
- 現在提供 4.5.1 版
- Text to Speech for IBM Cloud Pak for Data 版 4.5.1 現在可用。 此版本支援 IBM Cloud Pak for Data 4.5.x 版及 Red Hat OpenShift 4.6版、4.8版及 4.10版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- 支援啟用 FIPS 的叢集
- Text to Speech for IBM Cloud Pak for Data 和 Speech to Text for IBM Cloud Pak for Data 現在支援在啟用「美國聯邦資訊處理標準 (FIPS)」的叢集上執行。 如需相關資訊,請參閱 支援 FIPS 的服務。
- 問題修正: 已修正暫時儲存體計算,以防止偶爾發生 Pod 收回
- 問題報告修正程式: 已修正問題,現在對於 Text to Speech for IBM Cloud Pak for Data 和 Speech to Text for IBM Cloud Pak for Data 執行時期,暫時儲存體限制的計算更為精確。 這些變更會在服務的執行時期負載過重時,防止偶爾發生 Pod 收回。
- 服務不支援多語言語音合成
- 服務目前不支援多語言語音合成。 不過,您可以使用自訂作業來近似其他語言的字組發音。 如需相關資訊,請參閱 多語言語音合成。
- 已解決安全漏洞
- 已修正下列安全漏洞:
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 rsyslog 中資料堆型緩衝區溢位的攻擊(CVE-2022-24903)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易受到 Twisted 中 HTTP 請求走私問題的影響(CVE-2022-24801)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到阻斷服務的攻擊,這是由 Twisted 中的緩衝區溢位所造成(CVE-2022-21716)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到阻斷服務的攻擊,因為 NumPy 中的字串比較不完整(CVE-2021-34141)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到阻斷服務的攻擊,因為 NumPy 中發生緩衝區溢位(CVE-2021-41496)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Twisted 中容易遭到 Cookie 和授權標頭曝光的攻擊(CVE-2022-21712)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中資料堆型緩衝區溢位的攻擊(CVE-2018-18311)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中資料堆型緩衝區溢位的攻擊(CVE-2018-18312)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中資料堆型緩衝區溢位的攻擊(CVE-2018-18313)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中資料堆型緩衝區溢位的攻擊(CVE-2018-18314)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中的資料堆型緩衝區溢位的攻擊(CVE-2018-6913)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 Python 中的 CRLF 注入(CVE-2019-11236)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU Tar 中的阻斷服務攻擊(CVE-2019-9923)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中資料堆型緩衝區溢位的攻擊(CVE-2020-10543)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中整數溢位的攻擊(CVE-2020-10878)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Perl 中緩衝區溢位的攻擊(CVE-2020-12723)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 urllib3 中容易遭到阻斷服務的攻擊(CVE-2021-33503)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 Ansible 中遭到注入攻擊(CVE-2021-3583)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-23772)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在存取控制不正確的漏洞(CVE-2022-23773)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-23806)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-24675)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-24921)
- 安全公告:IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Golang Go 中存在阻斷服務的漏洞(CVE-2022-28327)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 libssh 中資料堆型緩衝區溢位的攻擊,這是由於不適當的範圍檢查所造成(CVE-2021-3634)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Python 中容易遭到阻斷服務的攻擊(CVE-2021-3737)
- Security Bulletin: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到 Python(CVE-2021-4189)中可能的機密性資訊暴露的攻擊
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 lxml 中略過安全限制的攻擊(CVE-2021-43818)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 MS Visual Studio 中執行任意程式碼(CVE-2021-21300)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Git 中容易遭到略過安全限制的攻擊(CVE-2021-40330)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易在 MS Visual Studio 中執行任意程式碼(CVE-2022-24765)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 Git 中容易遭到任意指令執行的攻擊(CVE-2018-1000021)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 jQuery 中容易遭到跨網站 Scripting 的攻擊(CVE-2015-9251)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 jQuery 中容易遭到跨網站 Scripting 的攻擊(CVE-2019-11358)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 jQuery 中容易遭到跨網站 Scripting 的攻擊(CVE-2020-11022)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 在 jQuery 中容易遭到跨網站 Scripting 的攻擊(CVE-2020-11023)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 Spring Framework 中資料連結規則安全弱點的攻擊(CVE-2022-22968)
2022 年 6 月 29 日 ( 4.5.0版)
- 現在提供 4.5.0 版
- Text to Speech for IBM Cloud Pak for Data 版本 4.5.0 現在可用。 此版本支援 IBM Cloud Pak for Data 4.5.x 版及 Red Hat OpenShift 4.6版、4.8版及 4.10版。 如需詳細資訊,請參閱 Watson 上的發言服務 IBM Cloud Pak for Data。
- IBM Cloud Pak for Data 文件的統一語音服務
- Speech to Text 和 Text to Speech 的安裝與管理文件現在結合在 IBM Cloud Pak for Data 文件中。 如需安裝及管理語音服務的相關資訊,請參閱 Watson 上的語音服務 IBM Cloud Pak for Data。
- 變更為語音服務自訂資源
- 現在,當您起始安裝語音服務時,即會建立自訂資源。 IBM Cloud Pak for Data 安裝說明文件中說明了此程序。 自訂資源的內容已變更:
- 自訂資源的建議名稱已從
speech-prod-cr變更為speech-cr。 - 儲存類別的所有參照都已從
storageClass的變式變更為blockStorageClass。 - Portworx 區塊儲存空間類別的名稱已從
portworx-shared-gp3變更為portworx-db-gp3-sc。 - 已移除 MinIO 及 PostgreSQl 資料儲存庫的
createSecret內容。 內容僅在內部使用。 如果您建立密鑰物件,則語音服務一律會使用密鑰物件,如果未提供任何密鑰物件,則它們一律會自動建立該物件。
- 自訂資源的建議名稱已從
- 現在 RabbitMQ 資料儲存庫支援使用者提供的密碼物件
- 您現在可以提供 RabbitMQ 資料儲存庫的安全認證,就像您可以提供 MinIO 及 PostgreSQL 資料儲存庫的安全認證一樣。 所有三個資料儲存庫所記載的處理程序都類似。
- 問題修正程式: 現在已正確剖析多個連續 SSML
<phoneme>標籤 - 問題報告修正: 服務現在正確地合成包含連續
<phoneme>標籤的文字。 先前,如果文字包含兩個以上連續<phoneme>標籤,則服務只會合成第一個標籤,而忽略其他標籤。 - 已解決安全漏洞
- 4.5.0版未修正任何安全漏洞。
2022 年 5 月 25 日 ( 4.0.9版)
- 現在提供 4.0.9 版
- Text to Speech for IBM Cloud Pak for Data 版本 4.0.9 現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
audio/alaw音訊格式的新支援- 支援的音訊格式清單現在包括
audio/alaw;rate={rate}。 如同audio/basic和audio/mulaw,此格式提供單聲道音訊,使用 8 位元 u-law(或 mu-law)資料編碼,以 8 kHz 取樣。 如需相關資訊,請參閱 使用音訊格式。 - 語音服務不支援 OADP 備份及還原公用程式
- Watson 語音服務不支援 IBM Cloud Pak for Data OpenShift API for Data Protection (OADP) 備份及還原公用程式。 如果語音服務安裝在叢集上,您可能無法使用 IBM Cloud Pak for Data OADP 備份及還原公用程式來備份該叢集上安裝的其他服務。 這項限制適用於 4.0.0 版及更新版本的語音服務。
- 已解決安全漏洞
- 已修正下列安全漏洞:
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 有漏洞的阻斷服務,這是由 Twisted 的緩衝區溢位所造成(CVE-2022-21716)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 NumPy中的阻斷服務攻擊。 (CVE-2021-33430)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到阻斷服務的攻擊,這是由於使用 Spring Framework 進行不當輸入驗證所造成(CVE-2022-22950)
2022 年 5 月 1 日 ( 1.2.x版)
- 重要事項: IBM Cloud Pak for Data 3.5 版 3.5 上 Text to Speech 1.2.x 版的服務結束
- 重要事項: 從 2022 年 5 月 1 日起,IBM Cloud Pak for Data 版本 3.5 上的 Text to Speech 1.2.x 版已無法運作。Text to Speech 1.2.x 版已不再受支援、可用或已記載。 有關Text to Speech (屬於Watson API Kit 的一部分)的服務終止的更多信息,請參閱 軟體支援終止:IBM Watson API Kit for IBM Cloud Pak for Data 1.2.x
2022 年 4 月 27 日 ( 4.0.8版)
- 現在提供 4.0.8 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.0.8 現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- IBM Cloud Pak for Data 文件中使用的新環境變數
-
IBM Cloud Pak for Data 文件的 Text to Speech 中的大部分指令已更新為使用一組一般環境變數。 文件提供 Script,可在您執行安裝、升級及管理指令之前自動匯出環境變數。 在取得 Script 之後,您可以從文件複製大部分指令並執行它們,而無需進行任何變更。
Script 定義的環境變數包括下列各項:
${PROJECT_CPD_INSTANCE}識別您計劃在其中安裝 IBM Cloud Pak for Data 及語音服務的專案。${PROJECT_CPD_OPS}識別 IBM Cloud Pak for Data 平台操作器的專案。${PROJECT_CPFS_OPS}識別 IBM Cloud Pak for Data 基礎服務的專案。
如需使用環境變數的相關資訊,請參閱 最佳作法: 設定安裝變數。
- 已不再記載
ttsVoiceMarginalCPU內容 -
已從語音服務自訂資源的說明文件中移除
ttsVoiceMarginalCPU內容。 此內容會管理並行與語音合成速度之間的權衡。 預設值400可確保大部分客戶的合理平衡,並維護即時合成。 - 已解決安全漏洞
-
已修正下列安全漏洞:
- 安全公告: Guava 的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2020-8908)
- 安全公告: Google Guava 漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-10237)
- 安全公告:Apache Tomcat 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2022-23181)
- 安全公告: Cyrus SASL 漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2022-24407)
- Security Bulletin: 含有 GNU wget 的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2016-4971)
- Security Bulletin: GNU Wget 的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-0494)
- 安全公告: 'GNU Wget ' 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-20483)
- 安全公告: ISC BIND 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2018-5741)
- 安全公告: Python 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2019-20916)
- Security Bulletin: 具有 ISC BIND 的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25214)
- Security Bulletin: ISC BIND 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25215)
- 安全公告: ISC BIND 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25216)
- Security Bulletin: ISC BIND 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-25219)
- Security Bulletin: PostgreSQL JDBC Driver(PgJDBC)中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2022-21724)
- 安全公告: GNU Tar 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2019-9923)
- 安全公告: logback-classic 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-42550)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU C 程式庫中的堆疊型緩衝區溢位的攻擊(CVE-2022-23218)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU C Library 中的堆疊型緩衝區溢位的攻擊(CVE-2022-23219)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 容易遭到 GNU C 程式庫中緩衝區溢位和下溢的攻擊(CVE-2021-3999)
2022 年 3 月 30 日 ( 4.0.7版)
- 現在提供 4.0.7 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.0.7 現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- 用於指定預設語音的自訂資源內容
-
語音合成及發音要求的預設語音為
en-US_MichaelV3Voice。 如果您未安裝en-US_MichaelV3Voice,則必須執行下列動作:- 使用
voice參數來傳遞要與每一個要求搭配使用的語音。 - 使用 Speech 服務自訂資源中的
defaultTTSVoice內容,為 IBM Cloud Pak for Data 的 Text to Speech 安裝指定新的預設語音。 如需相關資訊,請參閱 安裝 Watson Text to Speech 及 使用預設語音。
- 使用
- WebSocket 介面的字組計時回應變更
-
當您使用 WebSocket 介面要求字組計時時,服務傳送的回應物件已變更。 服務現在會在單一陣列中傳送單字計時結果,其中包含後面接著兩個浮點數的字串:
{ "words": [ ["Hello", 0.0, 0.259], ["world", 0.259, 0.532] ] }服務先前以陣列形式傳送計時結果,其中包含兩個浮點數陣列後面的字串:
{ "words": [ ["Hello", [0.0629826778195474, 0.2590192737303819]], ["world", [0.2598829173456253, 0.5322130804452672]] ] }此外,字組計時及標記的精準度層次現在已減少至三位小數位數。 如需新回應的相關資訊,請參閱 產生字組計時。
- 已解決安全漏洞
-
已修正下列安全漏洞:
- Red Hat CVE-2022-24407: 在 Cyrus SASL 隨附的 SQL 外掛程式中發現缺失。 由於無法適當地跳出 SQL 輸入,而導致輸入驗證漏洞不適當。 這個缺失可讓攻擊者執行任意 SQL 指令,並且能夠變更其他帳戶的密碼,以便提升專用權。
- 安全公告: jwt-go 漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2020-26160)
- 安全公告:Golang Go 中的漏洞會影響 IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data(CVE-2021-29923)
- 安全公告: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 受到 Spring Framework 中的遠端程式碼執行影響,但未分類為有漏洞(CVE-2022-22965)
- Security Bulletin: IBM Watson Speech Services Cartridge for IBM Cloud Pak for Data 很容易遭到使用 IBM WebSphere Application Server(CVE-2021-23450)執行任意程式碼的攻擊
2022 年 2 月 23 日 ( 4.0.6版)
- 現在提供 4.0.6 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.0.6 現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- IBM Cloud Pak for Data 現在已淘汰所有神經語音
-
IBM Cloud Pak for Data 的 Text to Speech 隨附的神經語音現在已淘汰。 神經語音仍可供 Text to Speech for IBM Cloud的使用者使用。 只有加強型神經語音仍可供 Text to Speech for IBM Cloud Pak for Data的使用者使用。
IBM Cloud Pak for Data現在已淘汰下列語言的所有語音:
- 阿拉伯文
- 中文(普通話)
- 捷克文
- 荷蘭文 (比利時)
- 荷蘭文(荷蘭)
- 英文(澳洲)
- 韓文
- 瑞典文
這些語音的現有使用者現在可以繼續使用它們,但在未來版本中將完全移除這些語音。 這些語音無法再由新使用者安裝,且已從 IBM Cloud Pak for Data的安裝文件中移除。
voiceType內容已從語音服務自訂資源移除。如需相關資訊,請參閱:
- 匯入/匯出 Script 的更新
-
import_export.sh和transfer_ownership.shScript 已更新。 這些 Script 用來在叢集之間匯入及匯出資料、備份及還原資料,以及將資料從 3.5 版移轉至 4.0.x版。 已修改及改良 Script,如下所示:- 現在,
transfer_ownership.shScript 需要在指令行的<custom_resource_name>引數之前包含-c選項。 transfer_ownership.shScript 現在需要-v <version>選項及引數,以指出要將資源所有權傳送至其中的版本。 指定35(若為 3.5 版) 或40(若為 4.0.x版)。- 現在,
transfer_ownership.shScript 需要在指令行的<postgres_auth_secret_name>引數之前包含-p選項。 <postgres_auth_secret_name>引數提供 Kubernetes 密鑰,用於向您要向其傳送所有權的 PostgreSQL 資料儲存庫進行鑑別。 如果與預設值相同 (<custom-resource-name>-postgres-auth-secret代表 4.0.x版,user-provided-postgressql代表 3.5版),則可以省略鑑別密碼。 如果密鑰與預設值不同,則必須提供該密鑰。- 這兩個 Script 現在都包含
-h(--help) 選項,可顯示 Script 及其用法的相關資訊。
如需相關資訊,請參閱:
- 管理 Watson Text to Speech,特別是 匯入及匯出資料 及 備份及還原資料。
- 升級 Watson Text to Speech,特別是 Migrating data from IBM Cloud Pak for Data Version 3.5。
- 現在,
- 已更新 OpenShift Container Storage 的建議
-
從語音服務 4.0.6版開始,OpenShift Container Storage 的建議儲存空間類別是
ocs-storagecluster-ceph-rbd。- 如果您要安裝 Speech services 4.0.6或從IBM Cloud Pak for Data version 3.5升級到 Speech services 4.0.6,請在安裝或升級期間指定
ocs-storagecluster-ceph-rbd儲存類別。 - 如果您要從先前更新的 Cloud Pak for Data 4.0版升級至語音服務 4.0.6,請繼續使用
ocs-storagecluster-cephfs。 您無法變更現有部署中使用的儲存體。
此值是使用語音服務自訂資源中的
storageClass內容來指定:################ # Storage class ################ storageClass: "ocs-storagecluster-ceph-rbd"語音服務可與任一 OpenShift Container Storage 版本搭配使用。 新建議版本具有更嚴格的存取權。 如需相關資訊,請參閱:
- 如果您要安裝 Speech services 4.0.6或從IBM Cloud Pak for Data version 3.5升級到 Speech services 4.0.6,請在安裝或升級期間指定
2022 年 1 月 31 日 ( 4.0.5版)
- 已更新 4.0.5 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.0.5 已更新以解決安裝問題。 案例套件版本現在是 4.0.6。 請使用此套件,而非 4.0.5 版套件。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- 重要事項: 不再需要鏡映安裝的額外步驟
-
重要事項: 2022 年 1 月 26 日版本注意事項 包含下列步驟的重要注意事項:
- 執行 Minio 資料儲存庫鏡映安裝的其他步驟
- 執行新一代機型鏡映安裝的其他步驟
不再需要這些額外步驟。 已更新案例套件以更正安裝問題。
2022 年 1 月 26 日 ( 4.0.5版)
- 現在提供 4.0.5 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.0.5 現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- 重要事項: 執行 Minio 資料儲存庫鏡映安裝的其他步驟
-
重要事項: 如果您安裝案例套件 4.0.6,則不再需要這些步驟。 有關更多信息,請參閱 2022 年 1 月 31 日(版本4.0.5 )。
如果您是執行鏡映安裝 (例如,在氣隙環境中),則需要在完成下列任一步驟 之前 執行其他步驟:
- 使用防禦模型鏡映映像檔 的步驟 7 將映像檔鏡映至專用容器登錄
- 步驟 8 將映像檔鏡映至中間儲存器登錄 中的 使用中間儲存器登錄鏡映映像檔
若要複製 Minio 資料儲存庫的必要影像,此步驟是必要的:
echo 'cp.icr.io,cp/opencontent-minio-client,1.1.4,sha256:7b4cf5e47a0455cfa7ca9ab246b80916e4dccbc1483b3e0f276fb7b0ab3e5c60,IMAGE,linux,x86_64,"",0,CASE,"",""' \ >> $CASE_PATH/ibm-watson-speech-4.0.5-images.csv未執行此步驟將導致 Text to Speech 及 Speech to Text的安裝錯誤。
- 現在已自動安裝授權伺服器
-
現在,Speech 服務操作員在安裝 Speech 服務時,會自動安裝必要的 License Server。 您不再需要從 IBM Cloud Pak for Data 基礎服務安裝授權伺服器,也不再需要使用其他 YAML 內容來建立具有必要連結的 OperandRequest。
- 移除特定於 PostgreSQL EnterpriseDB 伺服器的步驟
-
舊版說明文件包含特定於語音服務的 PostgreSQL EnterpriseDB 伺服器的步驟。 升級 Watson Text to Speech ( 4.0版) 及 解除安裝 Watson Text to Speech主題中記錄了這些步驟。 這些額外步驟已不再需要,且已從文件中移除。
- RabbitMQ 資料儲存庫現在僅由
sttAysnc元件使用 -
RabbitMQ 資料儲存庫先前已由語音服務 Speech to Text 及 Text to Speech的元件使用。 它現在只處理 Speech to Text 異步 HTTP 元件 (
sttAsync) 的非持久性訊息佇列。 只有在已安裝並啟用sttAsync元件時,才會使用它。 - 新的比利時荷蘭和捷克神經語音
-
現在有兩個新的神經語音可用:
- 比利時荷蘭語: 一個新的男性比利時荷蘭語 (佛蘭德語) 語音,
nl-BE_BramVoice。 - 捷克文: 一種新的語言,捷克文,具有新的女性語音,
cs-CZ_AlenaVoice。
您可以將自訂資源的
voiceType內容設為neuralVoices,以安裝新語音及所有神經語音。- 如需使用自訂資源來安裝語音的相關資訊,請參閱 安裝 Watson Text to Speech。
- 如需所有可用語言和聲音的詳細資訊,請參閱 語言和聲音。
- 比利時荷蘭語: 一個新的男性比利時荷蘭語 (佛蘭德語) 語音,
- 問題報告修正程式: 更新 SSML 文件
-
問題報告修正程式: SSML 文件已更新,以更正下列錯誤:
<break>元素的範例現在是正確的。 元素是一元的,如範例中所示。 上述範例包括含內嵌文字的開啟及關閉標籤。 服務未說出內嵌的文字。 如需相關資訊,請參閱<break>元素。- 服務支援「語音合成標記語言 (SSML)」1.1版。 所有參照和範例現在都使用正確的版本。 先前的文件參照 1.0版。
- 已解決安全漏洞
-
已修正下列與 Apache Log4j 相關聯的安全漏洞:
2021 年 12 月 20 日 ( 4.0.4版)
- 現在提供 4.0.4 版
-
Text to Speech for IBM Cloud Pak for Data 4.0.4 版現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- 重要事項: 變更用於停用儲存及記載使用者資料的內容
-
重要事項: 語音服務自訂資源的內容名稱,指定是否儲存及記載使用者資料已變更。 先前自訂資源包含下列內容:
################# # Anonymize logs ################# sttRuntime: anonymizeLogs: "false" # If true, disables storage and logging of user data sttAMPatcher: anonymizeLogs: "false" # If true, disables storage and logging of user data ttsRuntime: anonymizeLogs: "false" # If true, disables storage and logging of user data這些內容現在命名如下:
################################### # Storage and logging of user data ################################### sttRuntime: skipAudioAndResultLogging: "false" # If true, disables storage and logging of user data sttAMPatcher: skipAudioAndResultLogging: "false" # If true, disables storage and logging of user data ttsRuntime: skipAudioAndResultLogging: "false" # If true, disables storage and logging of user data如果您已在自訂資源中設定這些內容,以將
false的預設值變更為true,則需要編輯自訂資源。 您必須手動將內容名稱變更為新值,並儲存已更新的自訂資源。 如需相關資訊,請參閱 安裝 Watson Text to Speech。 - 重要事項: 變更 PostgreSQL 密碼物件的內容
-
重要事項: 當您安裝語音服務時,依預設會建立一個物件,其中包含隨機產生的 PostgreSQL 資料儲存庫密碼。 您可以改為選擇手動指定密碼。 如果您這麼做,則密碼物件的 YAML 檔案內容已變更。 如需相關資訊,請參閱 管理 Watson Text to Speech中有關管理資料儲存庫的主題。
- 重要事項: PostgreSQL Pod 不會以 EnterpriseDB 1.10 版運算子開頭
-
重要事項: 使用 IBM Cloud Pak for Data version 4.0.3的 Text to Speech,基於 EnterpriseDB 1.10 版運算子的 PostgreSQL Pod 可能無法啟動。 這會阻止語音服務啟動。 此問題已有暫行解決方法。 如果您的語音服務無法啟動,請參閱 PostgreSQL pod not start with EnterpriseDB 1.10 operator,以取得診斷及解決問題的相關資訊。
此問題已在 Text to Speech for IBM Cloud Pak for Data 4.0.4版中修正。
- IBM Spectrum Scale Container Native 儲存類別的新支援
-
從 4.0.3版開始,語音服務支援 IBM Spectrum® Scale Container Native 儲存類別。 如果要使用 IBM Spectrum Scale,請針對語音服務自訂資源的
storageClass內容指定"ibm-spectrum-scale-sc"。 如需相關資訊,請參閱 安裝 Watson Text to Speech。 - 在安裝期間與 MinIO 資料儲存庫互動語音服務
-
在服務的模型和語音完全上傳至 MinIO 資料儲存庫之前,無法啟動語音服務執行時期元件
sttRuntime和ttsRuntime。 在安裝期間,服務可能會失敗並自動自行重新啟動一或多次,直到模型和語音上傳完成為止。 然後,它們會適當地開始。 使用者不需有任何動作。 - 問題報告修正程式: 改善升級說明文件
-
缺陷修復: 將語音服務升級到新版本的IBM Cloud Pak for Data版本4.0.x文件在某些指令中包含不正確的參考。 這些參照現在是正確的:
- 在這兩種情況下,字串
watsonSpeechToTextStatus和watsonTextToSpeechStatus都已變更為speechStatus。 - 在這兩種情況下,字串
status.watsonSpeechToTextVersion和status.watsonTextToSpeechVersion都已變更為.spec.version。
如需相關資訊,請參閱 升級 Watson Text to Speech。
- 在這兩種情況下,字串
- 問題報告修正程式: 改善 SSML 和語音合成
-
問題報告修正: 此版本已修正「語音合成標記語言 (SSML)」及語音合成的下列問題報告:
- 已解決安全漏洞
-
已修正下列與 Apache Log4j 相關聯的安全漏洞:
2021 年 12 月 20 日 ( 1.2.x版)
- 重要事項: 您無法再於 IBM Cloud Pak for Data 版本 3.5 上安裝 Text to Speech 1.2.x 版
-
重要事項: 您無法在 IBM Cloud Pak for Data 3.5版上執行 Text to Speech 版本 1.2.x 的新安裝。 您只能在 IBM Cloud Pak for Data 版本 4.x上安裝 Text to Speech 版本 4.0.x。 如需相關資訊,請參閱 安裝 Watson Text to Speech。
IBM Cloud Pak for Data 3.5 版的語音服務達到 2022 年 4 月 30 日的支援結束日期。 建議您盡早升級至最新版本 4.0.x 服務版本。 如需相關資訊,請參閱 升級 Watson Text to Speech。
2021 年 11 月 30 日 ( 4.0.3版)
- 現在提供 4.0.3 版
-
Text to Speech for IBM Cloud Pak for Data 版本 4.0.3 現在可用。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6 版和 4.8版。 如需安裝及管理服務的相關資訊,請參閱 安裝 Watson Text to Speech。
- 授權伺服器現在是必要的必備項目
-
您現在必須從 IBM Cloud Pak for Data 基礎服務安裝「授權伺服器」。 您必須使用所提供的 YAML 內容來安裝授權伺服器,以建立具有必要連結的 OperandRequest。 您還必須在與服務 (運算元) 相同的名稱空間中安裝 License Service,這也是安裝 IBM Cloud Pak for Data 的位置。 如需相關資訊,請參閱 安裝 Watson Text to Speech。
- 就地升級的新支援
-
服務現在支援就地、操作器型從 4.0.0 版升級至 4.0.3版。 從 IBM Cloud Pak for Data 3.5 版移至 4.0.3 版繼續需要使用移轉公用程式。 如需相關資訊,請參閱 升級 Watson Text to Speech。
- EDB PostgreSQL 操作器及授權安裝變更
-
Enterprise DB PostgreSQL 操作器及授權的安裝、升級及解除安裝已變更:
- IBM Cloud Pak for Data 基礎服務現在隨附安裝 EDB PostgreSQL 運算子及授權的指示。 已相應地更新安裝語音服務的指示。 如需相關資訊,請參閱 安裝 Watson Text to Speech。
- 從 Text to Speech 版本 4.0.0 升級至 4.0.3 的指示包括解除安裝先前的 EDB PostgreSQL 操作器及授權,並使用 IBM Cloud Pak for Data 基礎服務重新安裝它們的指示。 如需相關資訊,請參閱 升級 Watson Text to Speech。
- 現在,解除安裝語音服務的指示包括移除先前隨 Text to Speech一起安裝的 EDB PostgreSQL 操作員及授權的步驟。 如需相關資訊,請參閱 解除安裝 Watson Text to Speech。
- 擴增安裝架構的新指引
-
服務現在提供關於擴增安裝的更新指引。 此資訊包括指定加強神經或神經語音的 Pod 數目及並行階段作業數目上限。 如需相關資訊,請參閱 管理 Watson Text to Speech。
- 匯入及匯出公用程式的指令行更新
-
與語音服務的匯入及匯出公用程式搭配使用的指令包括新的選項及引數。 匯入及匯出公用程式也是備份及還原服務以及從 IBM Cloud Pak for Data 3.5 版移轉至 4.0.3版的基礎。 如需使用公用程式的詳細資訊,請參閱
- 用於管理併發和語音合成的新內容
-
新的
global.ttsVoiceMarginalCPU內容會管理並行與語音合成速度之間的權衡。 預設值 400 可為大部分客戶提供合理的平衡,並維護即時合成。 如需修改此值以符合您需求的相關資訊,請聯絡 IBM 支援中心。 - 神經語音的新支援
-
目前可用於 Text to Speech for IBM Cloud 的所有神經語音現在也可用於在 Text to Speech for IBM Cloud Pak for Data上安裝。 現在提供下列語言和語音:
- 阿拉伯文:
ar-MS_OmarVoice - 中文(普通話):
zh-CN_LiNaVoice、zh-CN_WangWeiVoice及zh-CN_ZhangJingVoice - 荷蘭文 (比利時):
nl-BE_AdeleVoice - 荷蘭語 (荷蘭):
nl-NL_EmmaVoiceandnl-NL_LiamVoice - 英文 (澳洲):
en-AU_CraigVoice、en-AU_MadisonVoice及en-AU_SteveVoice - 韓文:
ko-KR_HyunjunVoice、ko-KR_SiWooVoice、ko-KR_YoungmiVoice及ko-KR_YunaVoice - 瑞典文:
sv-SE_IngridVoice
如需所有可用語言和聲音的詳細資訊,請參閱 語言和聲音。
- 阿拉伯文:
- 安裝語音
-
您可以安裝加強的神經語音或神經語音。 您只能安裝兩種類型的語音之一。 安裝服務時,您可以使用自訂資源的
voiceType內容來指出要安裝的語音:- 指定
enhancedNeuralVoices以安裝加強型神經語音。 然後,您必須指定要安裝的個別加強型神經語音。 依預設,只會安裝en-US_AllisonV3Voice、en-US_LisaV3Voice和en-US_MichaelV3Voice。 您可以選擇安裝這些預設語音、這些及其他語音,或只安裝其他語音。 只有您安裝的語音可用。 - 指定
neuralVoices以安裝神經語音。 所有神經語音都已安裝且可用。 您無法精簡已安裝的語音清單。
如需使用自訂資源來安裝語音的相關資訊,請參閱 安裝 Watson Text to Speech。
- 指定
- 指定語音合成的語音
-
HTTP
POST和GET /v1/synthesize方法以及 WebSocket/v1/synthesize方法都接受一個可選的voice查詢參數,用來指定語音合成要使用的語音。 如果您省略voice參數,則服務會使用預設語音。 預設語音視您安裝的語音而定:- 如果您已安裝加強型神經語音,依預設 服務會使用美式英文
en-US_MichaelV3Voice。 如果未安裝該語音,則必須指定語音。 - 如果您已安裝神經語音,依預設 服務一律使用澳洲英文
en-AU_MadisonVoice。
如需相關資訊,請參閱 使用語音進行語音合成。
- 如果您已安裝加強型神經語音,依預設 服務會使用美式英文
- 指定自訂模型的語言
-
您使用
POST /v1/customizations方法來建立自訂模型。 此方法包括language參數,可用來識別新自訂模型的語言。- 如果您已安裝加強型神經語音, 則
language參數是選用的。 依預設,服務會使用語言的en-USID。 - 如果您已安裝神經語音, 則需要
language參數。 您必須以指出的格式指定自訂模型的語言 (例如,en-AU代表澳洲英文)。
如需在建立自訂模型時指定語言的相關資訊,請參閱 建立自訂模型。
- 如果您已安裝加強型神經語音, 則
- 問題修正: 西班牙文加強型神經語音的正確語調
-
問題報告修正: 對於卡斯提亞西班牙文 (
es-ES_EnriqueV3Voice和es-ES_LauraV3Voice)、拉丁美洲西班牙文 (es-LA_SofiaV3Voice) 和北美西班牙文 (es-US_SofiaV3Voice) 語音,所有類型的問題現在都使用正確的語調。 之前的聲音沒有對一些問題使用正確的語調,而是像陳述式那樣發音。 - 問題報告修正程式: 更正多方承租戶文件
-
問題報告修正: IBM Cloud Pak for Data 主題 多租戶支援 錯誤地指出語音服務不支援多租戶。 主題已更新,指出語音服務支援下列作業:
- 在個別專案中安裝服務
- 在相同的專案中多次安裝服務
- 安裝服務一次,並在相同專案中部署多個實例
語音服務特定的說明文件正確指出多方承租戶支援。
2021 年 10 月 1 日 ( 1.1.x版)
- 1.1.x 版已失去服務
- Text to Speech 和 Speech to Text for IBM Cloud Pak for Data 版本 1.1.x 在 2021 年 9 月 30 日已無法運作。 從 2021 年 10 月 1 日,1.1.x 版的說明文件不再可用。 如需相關資訊,請參閱 軟體撤銷及支援停止。
2021 年 7 月 29 日 ( 4.0.0版)
- 版本 4.0.0 可用
-
IBM Watson® Text to Speech for IBM Cloud Pak® for Data version 4.0.0 現在可用。 服務的安裝及管理包含了許多變更。 此版本支援 IBM Cloud Pak for Data 4.x 版及 Red Hat OpenShift 4.6版。 如需安裝及管理服務的相關資訊,請參閱 Installing IBM Watson Text to Speech for IBM Cloud Pak for Data。
- 加強神經語音
-
為了最佳化語音合成的整體品質,現在所有可用的語音都是 加強的神經語音。 加強型神經語音 (其名稱中包含字串
V3) 現在適用於巴西葡萄牙文、英國及美國英文、法文、德文、義大利文、日文及西班牙文 (所有用語)。加強型神經語音支援同時使用 IPA 和 IBM 符號語音表示法 (SPR) 搭配 SSML
<phoneme>元素。 增強的神經語音也能達到稍高的自然發音語音。 如需相關資訊,請參閱語言和語音。 - 加拿大法語新聲
-
服務現在支援具有加強神經語音
fr-CA_LouiseV3Voice的加拿大法文。 加拿大法文語音支援自訂作業,並正式發行 (GA) 以供正式作業使用。 - 依範例特性新建調整
-
新的「依範例調整」特性可讓您控制服務如何說出指定的文字。 此特性是測試版功能,僅支援美式英文自訂模型和語音。 特性有兩個元件:
- 自訂提示 包括要說出的書面文字,以及您想要聽到的說出文字的已錄製音訊。 音訊會指定合成文字的語調、節奏及重音。 提示可以強調不同的音節或單字,引入暫停,並通常使合成的音訊聲音更自然且適合其上下文。
- 說話者模型 為會說一或多個提示的使用者提供登記音訊。 說話者模型提供使用者語音的音訊樣本。 服務會以語音來訓練自己,這可協助它產生更高品質的提示給該說話者。
您可以使用語音合成要求來指定自訂提示,以指出服務語音如何對文字進行發音。 若要指定提示,請使用 SSML 副檔名
<ibm:prompt id="{prompt_id}"/>。 合成音訊會複製提示的韻律。此服務包括八個新方法,用於使用「依範例調整」特性。 接下來的新方法說明提供連結至 API & SDK 參考資料中的項目。
-
服務包括四種使用自訂提示的方法:
-
服務包括四種使用說話者模型的方法:
- 統一 Text to Speech 文件
-
IBM Watson Text to Speech for IBM Cloud Pak for Data 的文件現在已與在 IBM Cloud上管理之 Text to Speech 服務的受管理實例的文件結合。 兩種服務形式的指南和參考文件都是如此。 鏈結至先前個別版本的 IBM Cloud Pak for Data 文件,以將服務重新導向至統一文件。
如需識別僅與一個產品版本相關之資訊的相關資訊,請參閱 關於 Text to Speech。
- 1.1.x 版已失去服務
-
Speech to Text 及 Text to Speech for IBM Cloud Pak for Data 版本 1.1.x 在 2021 年 9 月 30 日無法運作。 您必須在該日期之前升級至 IBM Cloud Pak for Data 上服務的較新版本。 從 2021 年 10 月 1 日起,將不再提供 1.1.4 版的說明文件。
2021 年 4 月 12 日 ( 1.2.1版)
- 新增至
speech-override.yaml檔案 -
最小
speech-override.yaml檔案包含額外定義dockerRegistryPrefix:global: dockerRegistryPrefix: "{Registry}" image: pullSecret: "{Registry_pull_secret}"{Registry}是 Docker 內部註冊表的路徑。 它必須是image-registry.openshift-image-registry.svc:5000/{namespace},其中{namespace}是 IBM Cloud Pak® for Data 安裝所在的名稱空間,通常是zen。
2021 年 4 月 9 日 ( 1.2.1版)
- 支援修改已安裝的模型和語音
- 語音服務可讓您新增或移除 1.2 版或 1.2.1 版服務的已安裝模型和語音。
2021 年 3 月 26 日 ( 1.2.1版)
- 版本 1.2.1 可用
-
Text to Speech for IBM Cloud Pak for Data 版本 1.2.1 現在可用。 1.2 和 1.2.1 版使用相同的 1.2 版說明文件和安裝指示。 除了 4.5 和 3.11版之外,1.2.1 版還支援在 Red Hat OpenShift 4.6 版上安裝。
- 新的安裝指示
-
對於連接至網際網路及氣隙叢集的兩個叢集,安裝指示包括下列步驟:
- 使用
oc label指令,為已安裝 IBM Cloud Pak for Data 的名稱空間設定必要標籤。 - 使用
oc project指令來確保您指向正確的 OpenShift 專案。 - 使用
cpd-cli install指令來安裝語音服務使用的企業資料庫 PostgreSQL 伺服器。
在安裝語音服務之前,請先執行下列步驟。
- 使用
- 新的解除安裝指示
-
在解除安裝 Speech 服務的程序中新增了一個步驟,以清除安裝中的所有資源。
- PostgreSQL 資料儲存庫的授權登錄
-
服務從中取回 PostgreSQL 資料儲存庫映像檔的授權登錄路徑已變更。 登錄位置已從
cp.icr.io/cp/watson-speech變更為cp.icr.io/cp/cpd。 這項變更對使用者是透通的。 - Minio 和 PostgreSQL 資料儲存庫的密鑰
-
Minio 和 PostgreSQL 資料儲存庫需要其密鑰的下列寫在程式中的值:
- 若為 Minio,請使用
minio。 - 對於PostgreSQL,請使用
user-provided-postgressql。
您無法對這些密鑰使用自己的值。 在安裝 Speech 服務之前,必須先建立密碼。
- 若為 Minio,請使用
- 從
speech-override.yaml檔案刪除 -
下列項目已從
speech-override.yaml檔案中移除。 已新增它們來解決現在已修正的問題。sttRuntime: images: miniomc: tag: 1.0.5 sttAMPatcher: images: miniomc: tag: 1.0.5 ttsRuntime: images: miniomc: tag: 1.0.5通常已透過細部調整其內容至基本元素,進一步減少縮寫的
speech-override.yaml檔案。
2020 年 12 月 9 日 ( 1.2版)
- 版本 1.2 可用
-
Text to Speech for IBM Cloud Pak for Data 1.2 版現在可供使用。 服務的安裝及管理包含了許多變更。 此版本支援 IBM Cloud Pak for Data 3.5 版和 3.0.1 版,以及 Red Hat OpenShift 4.5 版和 3.11 版。
- 新語音
-
該服務現在提供兩種新的聲音:
- 英國英語:
en-GB_CharlotteV3Voice - 法文:
fr-FR_NicolasV3Voice
服務也提供改良版的英國語音,即
en-KateV3Voice。 如需所有支援的語言和語音的相關資訊,請參閱語言和語音。 - 英國英語:
- 問題報告修正程式: 日文的 Fix
<prosody>元素 -
**問題修正:**對於
ja-JP_EmiV3Voice語音,服務現在會正確地剖析包括 prosody rate 規格的 SSML 輸入文字。 在此之前,以下使用<prosody>元素的方式可以正常運作:<speak>成功する/繁栄する</speak>但以下使用
<prosody>元素的 rate 屬性會導致服務讀取並說出內嵌的 SSML 符號:<speak> <prosody rate="fast">成功する/繁栄する</prosody> </speak>服務現在能正確解析日文輸入,並套用
<prosody>元素的rate屬性。
2020 年 9 月 4 日 ( 1.1.4版)
- 自訂作業介面已正式發行
- 自訂作業介面現在已正式發行。 自訂作業不再是測試版功能。 您可以使用自訂作業介面,藉由建立語言特有的自訂字典來指定服務對於輸入文字中出現的不尋常字組要如何發音。 如需相關資訊,請參閱瞭解自訂作業。
2020 年 7 月 15 日 ( 1.1.4版)
- Red Hat OpenShift 4.3 版即將失去服務
- IBM Cloud Pak for Data 3.0.1 將在 2020 年 9 月 1 日淘汰對 Red Hat OpenShift 4.3 的支援。 Red Hat OpenShift 4.3 在 2020 年 10 月 22 日即將無法運作。IBM Cloud Pak for Data 引進 Red Hat OpenShift 4.5的支援。IBM Cloud Pak for Data 建議用戶端在 2020 年 10 月 22 日之前升級至 Red Hat OpenShift 4.5。 IBM 支援中心將與已經在 Red Hat OpenShift 4.3 上安裝 IBM Cloud Pak for Data 3.0.1 的任何客戶合作。 想要在 Red Hat OpenShift 4.x 上安裝的新客戶,會被指示安裝 Red Hat OpenShift 4.5。
2020 年 6 月 19 日 ( 1.1.4版)
- 版本 1.1.4 可用
-
Text to Speech for IBM Cloud Pak for Data 1.1.4 版現在可供使用。 服務的安裝及管理包含了許多變更。 此版本支援 IBM Cloud Pak for Data 2.5 版和 3.0.1 版,以及 Red Hat OpenShift 3.11 版和 4.3 版。 有關安裝和管理服務的更多信息,請參閱 安裝和管理Text to Speech的IBM Cloud Pak for Data。
- 新的神經語音
-
服務現在支援五個新的神經語音:
- 美式英文:
en-US_EmilyV3Voice、en-US_HenryV3Voice、en-US_KevinV3Voice及en-US_OliviaV3Voice - 德文:
de-DE_ErikaV3Voice
這些新語音具有與所有現有語音相同的自訂作業及 SSML 功能。 如需相關資訊,請參閱支援的語言和語音。
- 美式英文:
- 日文
<say-as>元素的 SSMLdigits屬性支援 -
該服務現在支援 SSML
<say-as>元素的digits屬性與日語語音。 如需相關資訊,請參閱<say-as>元素。 - 簡化備份及還原程序
-
備份及還原程序已大幅簡化。 它們現在會從資料儲存庫備份資料,因此您不再需要重建已執行過的作業。 有關更多信息,請 參閱備份和恢復Watson語音服務資料。
2020 年 2 月 28 日 ( 1.1.3版)
- 版本 1.1.3 可用
- Text to Speech for IBM Cloud Pak for Data 1.1.3 版現在可供使用。
2019 年 11 月 27 日 ( 1.1.2版)
- 版本 1.1.2 可用
- Text to Speech for IBM Cloud Pak for Data 1.1.2 版現在可供使用。
2019 年 8 月 30 日 ( 1.0.1版)
- 版本 1.0.1 可用
- Text to Speech for IBM Cloud Pak for Data 1.0.1 版現在可供使用。 服務現在適用於 IBM Cloud Pak for Data 2.1.0.1。 服務現在支援搭配 Red Hat OpenShift 來安裝 IBM Cloud Pak for Data。
- 新日文神經語音
- 服務現在提供神經日文語音
ja-JP_EmiV3Voice。 如需相關資訊,請參閱支援的語言和語音。 - FISMA 支援
- 「聯邦資訊安全管理法 (FISMA)」支援現在適用於 Text to Speech for IBM Cloud Pak for Data。 服務為 FISMA High Ready。
2019 年 6 月 28 日 ( 1.0.0版)
- 版本 1.0.0 可用
-
1.0.0版 (服務的起始版本) 現在可供使用。Text to Speech for IBM Cloud Pak for Data 基於公用 IBM Cloud上的 IBM Watson® Text to Speech 服務。Text to Speech for IBM Cloud Pak for Data 與公用 Text to Speech 服務在下列方面不同。 如果您已熟悉公用 Text to Speech 上的 IBM Cloud 服務,您可能會發現此資訊很有用。
- Text to Speech for IBM Cloud Pak for Data 使用存取記號進行鑑別。 如需相關資訊,請參閱 API 和 SDK 參照。
- Text to Speech for IBM Cloud Pak for Data 的端點是 IBM Cloud Pak for Data 叢集特定。 如需相關資訊,請參閱 API 和 SDK 參照。
- Text to Speech for IBM Cloud Pak for Data 僅支援神經語音。 不支援標準(合成)語音。 神經語音不支援 SSML
<express-as>和<voice-transformation>元素。 - Text to Speech for IBM Cloud Pak for Data 不執行任何要求記載。 您不需要使用
X-Watson-Learning-Opt-Out要求標頭。 - Text to Speech for IBM Cloud Pak for Data 不支援 Watson 記號。 您不可以使用
X-Watson-Authorization-Token要求標頭來向服務進行鑑別。