微软近日发布旗下首个流式语音转写模型 MAI-Transcribe-2-Streaming,并同步推出 MAI-Voice-2.1 与 MAI-Voice-2.1-Flash 语音生成模型。新模型在 Artificial Analysis 基准中登顶,展示出高准确率、低延迟和低成本优...
Read MoreOpenAI近日在API中正式推出了一系列全新的实时音频模型,标志着语音交互技术迈入了一个全新阶段。该系列包括三款核心模型:GPT-Realtime-2,专注于增强对话式推理能力,能够实现更自然、更具逻辑性的实时语音对话;G...
Read More