精选70Hugging Face 博客(RSS)模型发布/更新
SpeechT5:统一语音合成与识别框架
SpeechT5 是微软提出的一种统一语音合成与识别框架,基于 Transformer 架构,将文本、语音和声学特征编码到共享的隐空间,实现跨模态学习。该模型在语音合成(TTS)、语音识别(ASR)、语音转换等任务上均取得优异表现,并开源了预训练权重和微调代码。Hugging Face 博客详细介绍了其架构设计、训练方法及在 Transformers 库中的使用方式。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力