15.ai
15.ai是一个免费的非商业化网络应用程序,利用人工智能生成热门媒体中虚构角色的文本转语音。由一位在麻省理工学院期间名为15的人工智能研究员开发,该应用允许用户让电子游戏、电视节目和电影中的角色以定制文本进行情感化语音表达,其生成速度比实时还快。该平台因其使用极少的训练数据就能生成逼真的语音而闻名——"15.ai"这一名称即源于开发者声称只需15秒的音频即可克隆出语音。 15.ai于2020年3月推出,在2021年初因在YouTube和…
共 9 篇文章
15.ai是一个免费的非商业化网络应用程序,利用人工智能生成热门媒体中虚构角色的文本转语音。由一位在麻省理工学院期间名为15的人工智能研究员开发,该应用允许用户让电子游戏、电视节目和电影中的角色以定制文本进行情感化语音表达,其生成速度比实时还快。该平台因其使用极少的训练数据就能生成逼真的语音而闻名——"15.ai"这一名称即源于开发者声称只需15秒的音频即可克隆出语音。 15.ai于2020年3月推出,在2021年初因在YouTube和…
語音合成是將人類語音用人工的方式所產生。若是將電腦系統用在語音合成上,則稱為語音合成器,而語音合成器可以用軟/硬體所實現。文字轉語音(Text-To-Speech,TTS)系統則是將一般語言的文字轉換為語音,其他的系統可以描繪語言符號的表示方式,就像音標轉換至語音一樣。 而合成後的語音則是利用在資料庫內的許多已錄好的語音連接起來。系統則因為儲存的語音單元大小不同而有所差異,若是要儲存phone以及diphone的話,系統必須提供大量的儲…
ATEN AI Voice 優聲學是宏正自動科技於2021年推出的人工智慧語音技術品牌,專注於開發多語系的文字轉語音(Text-to-Speech, TTS)解決方案,支援包括中文與台語等語言,並提供適用於雲端與地端環境的一站式語音合成系統。 發展歷程 宏正自動科技自2016年起關注AI相關技術的應用,並於2017年啟動語音技術研發。2021年正式推出品牌「ATEN AI Voice優聲學」,並對外發表語音合成技術。自2022年起,該技…
語音可延伸標記語言(,簡稱VoiceXML 或 VXML)是於互動式語音回應應用程式建立音訊對話的標準,用於開發音頻及聲音回應應用程式,例如銀行系統及自動客戶服務。來自網頁伺服器的超文本標記語言(HTML)被网页浏览器接收後,網頁瀏覽器能對其進行解析並視覺呈現出來,VoiceXML應用程式的開發及部署也類似這方式。VoiceXML文檔由解析。於一般的部署架構之下,用戶通常經由公共交换电话网(PSTN)跟語音瀏覽器互動。VoiceXML文…
VocaListener(簡稱*')是一個自動測定用戶歌聲的語音合成參數的系統,可以簡單地把輸入的歌聲轉換成另一種風格或聲質的技術。技術分為三部分:一是合成歌聲模仿目標歌聲的核心技術「VocaListener-core」,二是編輯目標歌聲的技術「VocaListener-plus」,三是分析歌聲的技術「VocaListener-front-end」。主要由中野倫靖和後藤真孝參與研究,先後以VOCALOID 2的初音未來、鏡音鈴、連、GA…
,物理學家和SGD用戶]] 語音生成設備(,縮寫:SGDs),也被稱為聲音輸出通信輔助設備 ,是一種電子輔助和替代通信 (AAC)系統。為有語言障礙的人補充、代替言語或書寫,使他們能夠口頭傳達他們的需求。 對於那些有語言溝通障礙的人來說,SGDs是很重要的。因為這個系統讓每個人在溝通互動上成為積極的參與者。語音生成設備對於肌萎縮性側索硬化症(ALS)的患者特別有幫助,但最近已被用於協助預測性語音不足的兒童。 SGDs有多個輸入和顯示方法…
語音合成標記語言(,缩写作 SSML)是以XML為基礎的標記語言,主要是用來支援語音合成應用程式。SSML經常內嵌於VoiceXML語言內以操控互動語音系統,但它也經常被單獨使用,如製作有聲書的時候。 在桌面應用程式方面,其他標記語言就較為受歡迎,像是蘋果電腦內嵌的語音命令以及微軟的,也同樣是XML標記語言。 SSML是以(JSML)為基礎,由昇陽電腦所開發。SSML比起C語言和HTML,並不算是一個嚴格的標記語言。 範例 以下是SSM…
WaveNet(波網)是一個用於直接生成聲音訊號的人工神經網路。由倫敦人工智慧公司Google DeepMind的研究人員於2016年9月的一篇論文中提出。 WaveNet通過使用用真實語音記錄訓練的神經網絡方法直接模擬波形,能夠生成聽起來相對真實的人類聲音。除了語音合成外,WaveNet也能應用在音樂生成以及語音辨識等領域。 2018年,Google在其雲端語音合成服務Google Cloud Text-to-Speech中提供了基於…
萨尔布吕肯萨尔州大学语音学系。]] 沃尔夫冈·冯·肯佩伦的说话机器是手工操作的语音合成器,由奥匈帝国作家及发明家沃尔夫冈·冯·肯佩伦于1796年开始开发。正是在同一年,他完成了土耳其行棋傀儡的開發,不過土耳其行棋傀儡的開發在六个月内便完成,说话机器却花費了二十多年開發。经历了第一个五年的研究中的两个概念上的“死胡同”之后, 肯佩伦的第三个方向最终引导他到了他认为可行的“最终”方案——人类声道的功能替代模型。 第一个实验方案 肯佩伦的第一…