Audio Tags 行內導演
在文稿寫 [whispers]、[excited]、[laughs]、[sighs]、[sarcastically]。旁白/廣告口播要具體情緒時,少靠「再生成碰運氣」。
ElevenLabs 正式版最具表現力 TTS:行內 Audio Tags、多說話人對話、70+ 語言;錯誤率 4.9%。旁白、對戲、口播要情緒時預設用它。

正式版相對 Alpha:使用者偏好 72%;數字、符號、專業記號錯誤率從 15.3% 降到 4.9%——配音讀錯金額、日期時少一輪返工。

行內 Audio Tags 控情緒、多說話人對戲、70+ 語言同一條工作流——旁白平、角色搶戲、多語串列埠音時,優先改標籤與說話人,而不是整段盲抽。
在文稿寫 [whispers]、[excited]、[laughs]、[sighs]、[sarcastically]。旁白/廣告口播要具體情緒時,少靠「再生成碰運氣」。
Text to Dialogue 管多角色輪替、打斷與情緒銜接。播客對談、遊戲過場、劇情 demo:換人時少出現「同一條嗓子硬演兩人」。
全球內容不必為語種換模型。本地化配音、多語廣告:規格對齊後直接改文稿與標籤,而不是重開一條產線。
從旁白到對戲到口播——交付物不同,失敗代價都是重錄與檔期。
要呼吸感與情緒起伏時用標籤控節奏。平讀像機器、高潮沒有力度 → 聽眾跳出;ElevenLabs v3 預設給敘事向表現力。
多說話人共享上下文。角色搶話、情緒錯位會直接廢過場;對話模式比單條 TTS 硬拼更穩。
興奮、剋制、調侃用標籤點名。口播語氣不對等於整條廣告重配;先定標籤再聽,少靠盲抽。
進入 Audio,選擇 ElevenLabs v3。
正文 + 小寫英文方括號標籤,例如 [whispers] Something’s coming… [sighs]。多角色用對話流程分說話人。
先聽情緒與咬字;不對就改標籤/措辭再出,別整段重寫碰運氣。
開幹前先對齊:免費額度、型號名、標籤寫法、預設何時選它。
Audio Tags · 多說話人 · 70+ 語言——與影像/影片模型同屏,開啟即可用。
免費使用 ElevenLabs v3無需 ElevenLabs API Key。