Telnyx将超过700个Ultra的声音跨越了36种语言,具有分100ms的时间到第一字节.
声音不是问题 听到他们的声音 文档列出3个。
Voice API在每个提供者中返回4,000+.
取声者每发声播放固定样本句.
这些都无法告诉你一个声音是如何在真实的场景中 处理情感、节奏或角色的。
所以我做了一个小应用程序, 让你这样做。
你用几个角色写出一出简短的场景,给每个角色分配出不同的Telnyx Ultra语音和SSML情感,把整件事变成一个MP3.
每个声音在性格,上下文,在一个连续的音频文件中说话.
特尔尼克斯代码的例子有: https://github.com/team-telnyx/telnyx-code-examples/tree/main/mult-character-Corps-python 互联网档案馆的存檔,存档日期2013-12-21.
使用 Case Voice 选择器 。
他们每个声音播放一个固定的样本句.
他们不做的是让你听到一个真实场景中的声音—— 一个紧张的争论,一个平静的旁白,一个惊慌的人物,一个令人放心的向导—— 因为一个单一的样本句子并不能告诉你一个声音是如何处理情绪,节奏或人物的.
这个例子解决了这个问题。
你写了一个短的场景 有几个角色。
每个角色都得到不同的Telnyx Ultra语音.
每个角色都得到SSML的情感.
你触地得分 应用程序的粉丝们发出平行的TTS呼叫,按照脚本顺序将每行音频缝合,并播放一个连续的MP3,每个声音都用个性说话.
默认的场景是出自朱利叶斯·凯撒的"三月之地". 5个人物,10行,5个不同的声音,5个不同的情感: Cassius——下定决心,策划暗杀凯撒——惊讶地,意识到被背叛的布鲁图斯——令人叹为观止,为这个行为辩护 Mark Antony——愤怒地,哀悼倒下的领导人"叙述者"——冷静地,设定了场景"一出渲染","一出MP3","上下文的每一个声音".
这是演示。 "八道咒语" 预装了8个Telnyx Ultra语音的应用船,用于最常使用的病例.
每个都是真正的Telnyx语音,带有UUID语音ID,在REST端点上工作.
Asher Male en Voice Asher Male en Voice Assolute Association & Media Claire asmote system Callie asing and Onboarding High Energy, 鼓舞人心, 友好语调 Clara Foman en-US General Clear, 标准美国口音, 多功能性平缓的Howard Male en-US 对话代理, 令人安心, 高度信任的 Allie Foman en-US Cassual & Interactive AI Conversation, 自然暂停 Jasper Male en-GB en-CFinancy and Heal Care cal, 权威, 准确的交付 Skyler 中立en Modern Brand Voice Casual, tech-forward, 友好的氛围 Arvin Male Naving and Directions Stables Stependences, istry 为任何字符的八名选取出详细指导。
点击预览以听到带有所选情感的声音后,才能渲染出整个场景. 20 Ultra SSML 情感超支持在文本前放入了 SSML 情感标记: 该应用程序将所有20个"超超"SSML情绪曝光为每个角色的倒下.
主要情感:愤怒,兴奋,内容,悲伤,害怕.
附加:快乐,热情,好奇,冷静,感激,亲切,讽刺,出乎意料,自信,犹豫,厌倦,厌倦,失望.
默认的"尤利乌斯·凯撒"(Julius Caesar)场景中的每个角色都会自动分配出一种适合角色的情感.
卡修斯决定了 凯撒很惊讶 布鲁特斯是古老的。
马克安东尼很生气 叙事者平平.
相同的声音,不同的情感,不同的交付——都来自每行一个内置的SSML标记.
它是如何制造出来的 该应用是单 Flask 文件,内含浏览器UI.
没有电话号码,没有Webhook,没有云存储,没有数据库.
一个小洞:.
管道"Why REST",不是"WebSocket Ultra",只在公共"WebSocket"上进行. 403号是故意的 应用程序使用时可以测量每行真实的时间到第一字节.
Base64模式会隐藏真正的耐久性.
为什么UUID, 不显示名称 Ultra 语音ID 是格式中的UUID, 不短