阶跃推出全新StepAudio 2.5 TTS语音生成模型

4个月前更新 zmtzn
10 0 0

于4月16日发布了新一代语音生成模型StepAudio 2.5 TTS。该模型在全局语境控制、文中语境控制、零样本复刻及全音色控制等方面进行了显著升级,旨在满足角色配音、有声内容创作和智能语音交互等应用场景。StepAudio 2.5 TTS现已支持通过自然语言进行合成控制,并已全面上线“阶跃星辰开放平台”和Step Plan。

阶跃推出全新StepAudio 2.5 TTS语音生成模型的封面图

相关快讯

千问发布语音合成大模型 Qwen-Audio-3.0-TTS

千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。

阿里巴巴发布语音合成大模型 Qwen-Audio-3.0-TTS

阿里巴巴于7月20日发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度控制、自由指令、多语种方言和复杂声学鲁棒性上全面提升,并推出实时交互的Flash版和高质量生成的Plus版,使语音合成从“能说话”迈向“会表达”。目前Plus版已登顶Artificial Analysis榜单,预览版也曾夺冠。

Hugging Face据悉寻求出售,估值或超130亿美元

据报道,AI初创公司Hugging Face正在寻求出售,并已与银行合作评估潜在买家意向。公司当前估值目标至少为130亿美元,远高于2023年融资时的45亿美元。当时,Salesforce、Alphabet、谷歌和英伟达等科技巨头参与投资。

人形机器人“手”“脑”并进,赛场“淬炼”推动应用落地

8月22日至26日,第二届世界人形机器人运动会在北京举行。赛场上,人形机器人接连刷新跳高、短跑等多项对标人类的 […]

小米玄戒芯片迎来新进展,国产自研芯片再进一步

小米于8月23日正式宣布,将于8月24日14点举行玄戒芯片技术沟通会。本次活动采用图文直播形式,方便外界及时了解相关技术动态与最新进展。届时,小米芯片负责人朱丹将出席并进行分享,介绍玄戒芯片目前取得的最新成果,为关注小米芯片研发和技术布局的用户提供更多信息。

联影携手天津大学发布全球首个磁共振脑机接口全栈解决方案「uMR神观」

全国首届磁共振脑机接口大会在天津召开。联影医疗与天津大学发布全球首个磁共振脑机接口全栈式解决方案“uMR神观”,打通“成像—仿真—调控—评估—算法迭代”闭环,推动磁共振由影像工具升级为脑机交互核心中枢。双方还联合发起创新联盟,旨在贯通采集、解码、调控、评估全链条,提升我国在该前沿领域的国际竞争力。

暂无评论

暂无评论...