Day11:一次只讀一句的讀稿工具 既然昨天提到的問題主要是簡體、字太小、沒辦法一次專注一句 這些都是所謂廣義上的 UI/UX 問題 那就和華安借個 還我漂漂...
Day10:反人類的格式 前情提要,我可愛的老婆是個聲優(炫耀現在剛好很多科技公司要搞 AI 語音,都需要收實際真人的語音資料 因此很多都會去找她來錄製資料集順...
繼續下一個組件:聽話,講話,創造聲音。 前面那台 amd 雙 GPU,載入 LLM 之後,記憶體就滿了。 所以配置另外一臺 Proxmox,新增個 ubunt...
最近在研究TTS的過程中發現了SAM TTS這個古老的TTS,所以我試著復刻一個相似的服務。 以下是我簡單的紀錄 為什麼選 SAM TTS? 雖然現在 TTS...
現在AI已經流行了好一陣子,有在關注AI Vtuber的各位一定都知道Vedal(計算機程序員和人工智慧開發者,利用大型語言模型生成了Neuro-sama的回應...
簡介 最近 Meta 釋出了多語多模 AI 翻譯模型 SeamlessM4T,宣稱支援近 100 種語言,而且有開源模型權重,於是筆者就來體驗了一下這個模型,看...
用鍵盤輸入訊息,對年輕人或許稀鬆平常,但對長者而言,使用語音的方式或許更輕鬆。所以除了畫面字體放大外,我們也使用語音識別與輸出技術,提供長者更友善的工具。 上次...