媒体与创意

Voice

录一段语音、转录语音、听你的 AI 开口说话。

用语音和 MoClaw 对话,并得到语音回复。在任意聊天界面录一段消息,MoClaw 会转录它、生成回应,并(如果你愿意)用你选定的声音把回应读出来。可在网页应用、iOS 和 Android 的 Telegram bot,以及任意 Slack DM 中使用。

工作方式

3 步接入 Voice,无需工程配置。

  1. 1

    在任意对话里点麦克风

    网页端按住空格键。Telegram 上发一条语音消息。Slack 上附一个音频文件。

  2. 2

    MoClaw 转录并回复

    Whisper 级别的转录,支持多语言。回复默认以文本形式返回。

  3. 3

    或者让它读给你听

    在 Settings 中开启“voice reply”,即可用你挑选的声音(ElevenLabs、OpenAI TTS 或系统语音)获得音频回复。

可以这样说

可以直接复制到 Voice 的真实 prompts。

  • 语音备忘:“提醒我周三下班前就新首页的事跟进设计团队。”
  • 开车时:“给我读 Hacker News 的头条,前 5 条。”
  • 每天早上给我发一条 90 秒的语音简报,而不是文本。

分步演示

发送 prompt 后实际会发生什么。

Prompt 01 4 步

“车里的语音备忘:“给 Sarah 发邮件说我们对 Q2 合作答应了,并请她把合同发过来。””

MoClaw 会做什么

  1. 1 用 Whisper 转录这条语音消息。
  2. 2 在你的 Gmail 联系人里查找 Sarah(最近的一条往来邮件)。
  3. 3 以你的口吻起草邮件——简短、果断,索要合同。
  4. 4 在对话里请你确认(因为这是一封真正要外发的邮件)。
结果

回复弹出:“已起草给 sarah@partner.co。主题:Q2 partnership — yes from us。正文:Sarah,我们对 Q2 合作答应了。你这周能把合同发过来吗?Best,[你]。发送吗?”你边开车边点了发送。

FAQ

关于价格、隐私和限制的快速回答。

转录支持哪些语言?
通过 Whisper 支持 100 多种。按每段录音自动检测。同一段录音里混用多种语言也行。
我能挑哪些声音?
免费版提供 OpenAI TTS 声音(Alloy、Echo、Fable、Onyx、Nova、Shimmer)。付费版提供完整的 ElevenLabs 目录,外加从 30 秒样本进行声音克隆。
它能完全免手操作吗?
在 iOS 的 Telegram 客户端上可以——语音进、语音出,无需点按。在网页端,由于浏览器安全限制,每一轮都需要用空格键开始。
我的音频去了哪里?
传输中加密,在托管的 Whisper 实例上转录,音频在 60 秒内删除。转录文本保留在你的对话历史里(加密,可从 Settings 删除)。

免费试用 MoClaw。

每月 1,000 credits,或者 自带 API Key 获得无限用量。

随时取消