Cartesia 发布了一个拥有极快推理速度和超低延迟的语音生成模型。

- 模型延迟仅135毫秒
- 能够展现出人类的情感和表达能力
- 10秒录音,即可模仿说话者的韵律、语调和声音特征
- 可以调节音调、速度、情感、发音和速度

X

关注频道 @ZaiHuaPd
频道爆料 @ZaiHuabot
来自频道: @zaihuapd
Loading comments...