Episode Details

Back to Episodes
從念稿到演出:AI 聲音的新紀元

從念稿到演出:AI 聲音的新紀元

Episode 111 Published 6 months, 3 weeks ago
Description


想讓 AI 語音嘆氣、耳語、甚至唱歌?xAI 的 TTS API 支援 Speech Tags,在文字裡插入情緒標記就能控制語音表演。5 種聲音人格,20 種語言自動偵測,Beta 現在就能試用。

⭐ 文章深度讀:整理了 Speech Tags 兩類語法標記,以及 Safari 播放整合的兩個實際陷阱
→ https://heymaibao.com/xai-tts-api/

📝 懶人包
∙ xAI 推出 TTS API (Beta),支援 5 種聲音人格:eve (活潑)、ara (溫暖)、rex (專業)、sal (平衡)、leo (權威),各有設計定位
∙ Speech Tags 可在文字裡插入情緒標記,如 [laugh]、[sigh]、[breath],或用包裹標記讓某段話以耳語、唱歌方式念出,是業界少見的設計
∙ 20 種語言自動偵測,不需指定語言參數,輸出格式從電話系統 (8kHz μ-law) 到錄音棚 (48kHz WAV) 全覆蓋
∙ 我的觀察:Speech Tags 是這個 API 真正讓人眼睛一亮的地方。它讓語音生成從「念稿」變成「演出」,我很好奇開發者拿這個功能會做出什麼有趣的應用

📚 參考資料
Text to Speech (Beta) — xAI Docs
→ https://docs.x.ai/developers/model-capabilities/audio/text-to-speech

Listen Now

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us