用类 macOS say 的方式快速将文本转换为高质量语音输出
整体风险偏低:材料显示其核心用途是调用 ElevenLabs 做文本转语音,且来源为可审计的 GitHub 开源项目、社区采用度很高。需注意的是,声明“无密钥/无远程端点”与 README 明确要求 ElevenLabs API key 并隐含访问第三方服务不一致,使用前应核实实际配置与数据流向。
README 明确要求 `ELEVENLABS_API_KEY`,并兼容 `SAG_API_KEY`;这与上方“无密钥”声明不一致。该类 API key 属于敏感凭证,若在环境变量、日志或 shell 历史中暴露,可能导致 ElevenLabs 账户被滥用。
尽管元数据写明“无远程端点”,但功能描述为“ElevenLabs text-to-speech”,可合理判断会向 ElevenLabs 服务发送待合成文本并接收音频结果。材料未列出具体域名、数据保留策略或是否包含遥测,因此应视为存在到声明相关第三方服务的常规数据外发。
系统检查项标记为 `prompt-only`,材料本身主要是使用说明与提示模板,没有显示其会自行获取额外系统权限或执行任意代码。README 中的 `sag ...` 命令属于用户显式调用示例,而非可证明的隐式执行能力。
材料显示可进行本地播放并可通过 `-o /tmp/voice-reply.mp3` 写出音频文件,说明至少涉及有限的本地文件输出;同时待合成文本会被提交给第三方 TTS 服务。未见其声明可广泛读取本地文件、访问凭证库或请求超出 TTS 目的的数据权限,因此目前更符合常规留意级别而非过度授权。
正面因素是:来源为 GitHub 开源仓库,且社区采用度极高(约 37.7 万 star),这些都显著降低供应链风险。需留意的是,许可证未声明、维护状态未知,且所给仓库名 `openclaw/openclaw` 与工具名 `sag` 的对应关系仅凭材料无法核实,因此建议在安装前进一步确认仓库归属、发布物与源码一致性。
复制安装指令,让 AI 自动完成配置 · 推荐新手
请帮我安装 askskill 上的 "sag" 技能: 1. 下载 https://raw.githubusercontent.com/openclaw/openclaw/main/skills/sag/SKILL.md 2. 保存为 ~/.claude/skills/sag/SKILL.md 3. 装好后重载技能,告诉我可以用了
请用自然、清晰的中文女声朗读以下文章,并输出适合发布的语音文件:{文章内容}一段自然流畅的文章配音音频,可用于内容发布或预览。
把这段产品介绍文案转成英文男声旁白,语气专业简洁,适合演示视频使用:{产品文案}一段专业的英文产品介绍旁白,可直接用于演示视频或宣传材料。
将以下提醒文本转换成简短清楚的语音播报,语速稍快:{提醒内容}一段简洁明了的语音提醒,适合通知、播报或辅助无障碍使用。
Use sag for ElevenLabs TTS with local playback.
API key (required)
ELEVENLABS_API_KEY (preferred)SAG_API_KEY also supported by the CLIQuick start
sag "Hello there"sag speak -v "Roger" "Hello"sag voicessag prompting (model-specific tips)Model notes
eleven_v3 (expressive)eleven_multilingual_v2eleven_flash_v2_5Pronunciation + delivery rules
--normalize auto (or off if it harms names).--lang en|de|fr|... to guide normalization.<break> not supported; use [pause], [short pause], [long pause].<break time="1.5s" /> supported; <phoneme> not exposed in sag.v3 audio tags (put at the entrance of a line)
[whispers], [shouts], [sings][laughs], [starts laughing], [sighs], [exhales][sarcastic], [curious], [excited], [crying], [mischievously]sag "[whispers] keep this quiet. [short pause] ok?"Voice defaults
ELEVENLABS_VOICE_ID or SAG_VOICE_IDConfirm voice + speaker before long output.
When the user asks for a "voice" reply (e.g., "crazy scientist voice", "explain in voice"), generate audio and send it:
# Generate audio file
sag -v Clawd -o /tmp/voice-reply.mp3 "Your message here"
# Then include in reply:
# MEDIA:/tmp/voice-reply.mp3
Voice character tips:
[excited] tags, dramatic pauses [short pause], vary intensity[whispers] or slower pacing[sings] or [shouts] sparinglyDefault voice for Clawd: lj2rcrvANS3gaWWnczSX (or just -v Clawd)
通过 OpenAI 音频转写接口,将语音录音快速转成文本或说话人分段结果。
帮助你用 node inspect 与性能分析工具定位 Node.js 调试与性能问题。
使用 sherpa-onnx 在本地离线将文本快速转换为语音,无需云服务。
帮助你自动控制网页流程,处理多步骤操作、登录检查与标签页管理。
快速生成概念、架构、流程与白板图,支持 SVG、HTML 或 Excalidraw 格式
帮助开发与运维团队运行、排查并总结 OpenClaw 发布 CI 与发布前检查流程
让 AI 调用 ElevenLabs 将文本转为语音并管理可用音色。
将文本快速转换为语音,并支持查看可用声音与模型列表。
通过自然语言生成语音、克隆声音、转写音频并制作音效。
自动化执行 ElevenLabs 文本转语音、语音管理与音频历史查询等流程
在 Windows 环境中调用 ElevenLabs 语音合成与音频处理并集成 Cursor。
将文本快速转换为自然语音,支持多角色对话、长文分段与播放