工具介绍
工具介绍
Sonic-3是美国生成式AI公司Cartesia推出的第三代实时文本转语音(Real-time TTS)模型。它基于自研的State-Space序列架构,在保持极低保真延迟最低90ms的同时,首次在公开API中实现了情绪标签驱动的笑声、呼吸、停顿与多情感强度控制,被业内称为会笑会喊的大语言模型。
使用提示
适合需要“Sonic-3是美国生成式AI公司Cartesia推出的第三代实时文本转语音(Real-time TTS)…”相关能力的个人或团队。具体功能、价格、可用地区与数据政策可能变化,使用前请以官方网站说明为准。




