S2.1 Pro
Fish Audio · 可用于文本转语音
支持的模型
新语音模型启用后会自动出现在这里,方便你为不同项目选择合适的声音技术。
Fish Audio · 可用于文本转语音
面向真实制作流程
无需录音设备或复杂剪辑流程,即可把完成的文稿变成可用音频。
先进的语音模型能保留语句节奏、停顿和情绪,让长篇旁白依然清晰耐听。
上传清晰的声音样本和对应文字,无需训练即可复现已获授权的声音。
调整说话速度,并根据响应速度或稳定性选择合适的生成模式。
导出 MP3、WAV、PCM 或 Opus,适用于剪辑、流媒体、应用和电话系统。
只需三个步骤
输入文字,选择合适的声音,然后生成可直接使用的音频。
使用标点和分段自然控制停顿、节奏与重点。
选择已有音色 ID,或上传已获授权的 10 至 30 秒参考音频及其文字稿。
选择支持的模型、语速和格式,然后试听或下载结果。
声音克隆
一段简短清晰的录音即可成为可复用的声音,用于旁白、产品演示、课程和品牌内容。准确的文字稿有助于保持发音与一致性。
参考声音样本
声音已就绪
使用已获授权的声音生成新语音
为受众已经在使用的渠道持续生成一致的语音。
为视频、解说、播客、课程和有声书制作旁白。
为助手和产品体验赋予更自然、更有辨识度的声音。
把书面信息转换为清晰语音,让更多人方便获取。
制作电话菜单、提醒、更新和可复用的产品消息。
FAQ
了解支持的模型、音频格式、声音克隆和制作使用方式。
AI 文本转语音可以把书面文字转换为语音。HeyMarmot 使用先进的语音模型,为旁白和产品体验生成自然的语句节奏、停顿与表达。
HeyMarmot 当前可用的语音模型包括: S2.1 Pro.
可以。上传一段清晰的 10 至 30 秒录音和准确文字稿即可。你必须拥有该声音,或获得声音所有者的明确授权。
支持生成 MP3、WAV、PCM 和 Opus。MP3 适合日常发布,WAV 适合高质量剪辑,PCM 和 Opus 适合实时处理流程。
使用清晰的标点、合理分段和自然文稿。克隆声音时,还可以调整语速,并提供清晰的参考录音与准确文字稿。