SKILL.md
只读
名称
sag
描述
拥有类似 macOS say 命令交互体验的 ElevenLabs 文本转语音(TTS)工具。
sag
使用 sag 进行 ElevenLabs TTS 语音合成与本地播放。
API 密钥(必填)
ELEVENLABS_API_KEY(首选)- CLI 同样支持
SAG_API_KEY
快速上手
sag "Hello there"sag speak -v "Roger" "Hello"sag voicessag prompting(特定模型的提示词技巧)
模型说明
- 默认模型:
eleven_v3(富有表现力) - 稳定模型:
eleven_multilingual_v2 - 高速模型:
eleven_flash_v2_5
发音与语调规则
- 首选修正方案:改写拼写(如 "key-note")、添加连字符或调整大小写。
- 数字/单位/网址:使用
--normalize auto(若影响专有名词可设为off)。 - 语言偏向:使用
--lang en|de|fr|...指导文本标准化。 - v3 模型:不支持 SSML
<break>标签;请改用[pause]、[short pause]、[long pause]。 - v2/v2.5 模型:支持 SSML
<break time="1.5s" />;但在sag中未开放<phoneme>。
v3 音频标签(需置于句首/行首)
[whispers]、[shouts]、[sings][laughs]、[starts laughing]、[sighs]、[exhales][sarcastic]、[curious]、[excited]、[crying]、[mischievously]- 示例:
sag "[whispers] keep this quiet. [short pause] ok?"
默认语音设置
ELEVENLABS_VOICE_ID或SAG_VOICE_ID
在生成长段语音前,请先确认语音与说话人设置。
聊天语音回复
当用户要求“语音”回复时(例如“用疯狂科学家的声音”、“用语音解释”),生成音频并发送:
# 生成音频文件
sag -v Clawd -o /tmp/voice-reply.mp3 "这里填写消息内容"
# 然后在回复中附加:
# MEDIA:/tmp/voice-reply.mp3
语音角色设定技巧:
- 疯狂科学家:使用
[excited]标签、戏剧性停顿[short pause],并交替变化语气强弱 - 沉稳冷静:使用
[whispers]或放慢语速 - 戏剧效果:克制地使用
[sings]或[shouts]
Clawd 的默认语音:lj2rcrvANS3gaWWnczSX(或直接指定 -v Clawd)






