• 首页
  • AI圈子HOT
  • AI快讯
  • 问答
  • AI工具导航
文章
文章快讯AI圈子AI工具大全

{{userData.name}}已认证

文章

评论

关注

粉丝

¥{{role.user_data.money}}
{{role.user_data.credit}}
您已完成今天任务的
  • 私信列表所有往来私信

  • 财富管理星球币、积分管理

  • 任务中心每日任务

    NEW
  • 认证服务申请认证

    NEW
  • 我的设置编辑个人资料

  • 进入后台管理

  • 行业动态
  • 实战分享
  • 开源项目
  • AI工具
  • AI日报
  • AI百科
  • AI情报
  • AI测评
  • skills资源
  • 活动讲座
投稿
全部标签

TTS

  • VoxCPM2 :这个 2B 模型的野心不只是”又一个 TTS”

    VoxCPM2 :这个 2B 模型的野心不只是”又一个 TTS”

    正常人都觉得,语音合成这件事的终点就是把模型做得更大、数据喂得更多。XTTS、CosyVoice、F5-TTS,大家都是这条路:文本进去,切成离散 token,语言模型预测 token 序列,声码器还原波形。这套流程跑了三四年,大家忙着比谁的 MOS 分高零点几,比谁少了几毫秒延迟。VoxCPM2 没这么做,它直接把 Tokenizer 从流水线里删了。 这不是学术噱头。扔掉 Tokenizer …
    开源项目
    • 1.2k
    • 0
    半岛铁箱半岛铁箱4小时前
  • OpenAI Speech Skill:把语音生成从“一次性调用”变成“可复现工程”

    OpenAI Speech Skill:把语音生成从“一次性调用”变成“可复现工程”

    你可能已经习惯了 TTS 的套路:调一个 API,传一段文本,选一个声音,拿回一个 MP3。这件事本身没什么新鲜的,ElevenLabs 两年前就做到了。但 OpenAI 这个 Speech Skill 做的事情不太一样,它不是在“生成声音”,而是在“把声音生成变成一个可复现的工程任务”。 我第一次翻它的 SKILL.md 时,印象最深的是这句话:“Prefer the bundled CLI f…
    skills资源
    • 1k
    • 0
    jollyjolly7月12日
  • VoxCPM2:把 TTS 领域最基础的一个假设推翻了,然后发现效果更好

    VoxCPM2:把 TTS 领域最基础的一个假设推翻了,然后发现效果更好

    过去五年里,如果你问任何一个做 TTS 的人"语音合成的基本流程是什么",答案出奇一致:文本→分词器→语言模型→声码器→波形。分词器是整条链路的起点,是所有人默认的"基础设施"。没有 tokenizer,你怎么让模型学习语音? VoxCPM2 的回答是:为什么一定要有? 它把 TTS 领域赖以运转了五年以上的 tokenizer 直接拿掉了。模型在 Audi…
    开源项目
    • 1.1k
    • 0
    半岛铁箱半岛铁箱6月23日
  • Voice-Pro:1万Star的开源语音AI工作站,功能越全,坑越多?

    Voice-Pro:1万Star的开源语音AI工作站,功能越全,坑越多?

    看到10.7k Stars的时候,我的第一反应很直接:又一个靠"对标ElevenLabs"上位的开源项目。GitHub上这类项目太多了,README写得天花乱坠,装完第一步就报错。 光看Star数我被骗了 但Voice-Pro不太一样。它把Whisper语音识别、多种TTS引擎、零样本语音克隆、Demucs人声分离、YouTube下载和实时翻译塞进了一个Gradio WebUI…
    开源项目
    • 49
    • 0
    AI观察者AI观察者6月9日

关于我们

欢迎来到 AI星球,每一个AI探索者的引力中心。
在人工智能浪潮席卷全球的今天,我们不希望你只是旁观者。AI星球是一个专为AI学习者、从业者和爱好者打造的一站式深度服务平台。在这里,我们打破信息差,连接同行者,共同探索智慧科技的无限边界。在这里,读资讯、学教程、下资料、交朋友,与AI探索者一同定义未来。

Copyright © 2026 AI星球-AIXQ.CC
・粤ICP备14037330号-23
查询 7 次,耗时 0.0755 秒
首页圈子快讯
搜索菜单我的