字节跳动近日正式公开了其最新的原生音视频实时交互模型SeedRealtime,该模型突破了传统语音助手仅依赖音频或文本的限制,能够同时处理连续的视频、音频和文本流,并以人类对话般的自然速度进行实时语音回应。这一技...
Read More根据PitchBook的最新数据,全球AI语音初创公司在2026年第一季度共获得70亿美元融资,而该数字在2025年同期仅为10亿美元,同比增幅高达600%。这一爆发式增长反映出资本对语音赛道的强烈信心,背后推手是人工智能行业...
Read MoreOpenAI近期公开了其最新的实时语音交互系统GPT-Live,标志着语音AI从“交替发言”正式迈入“自然共时”的新阶段。该系统以连续语音处理为核心,实现了全双工通信,彻底抛弃了传统语音助手依赖的轮流对话检测机制。在架构...
Read MoreOpenAI 近期公开了其低延迟实时语音系统 GPT-Live 的技术细节,展示了一套仅用六个月构建的全新架构。区别于传统的轮流发言模式,GPT-Live 采用了全双工语音模型,能够实现一边聆听一边发言的连续对话,大幅减少了交...
Read More微软首个原生实时语音模型“MAI Realtime”日前在MAI Playground中以隐藏早期访问条目浮出水面。该模型采用双向全双工架构,能够同时监听与说话,彻底打破传统语音助手“你一句我一句”的轮流对话模式。目前提供Victoria...
Read More微软正式推出两款全新自研AI模型——MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进一步强化其在多模态生成领域的布局。MAI-Image-2.5-Pro专注于高保真图像生成与编辑,能够根据复杂文本描述生成细节丰富、构图精准的高质...
Read MoreOpenAI正式推出新一代语音模型GPT-Live,并已作为核心引擎驱动ChatGPT Voice。该模型首次实现了真正的全双工交互能力,能够同时进行聆听与讲话,彻底告别传统语音助手“轮流发言”的机械感。GPT-Live不仅可以捕捉和处...
Read More据《南华早报》记者Iris Deng报道,华为正式发布了HarmonyOS 7操作系统。该版本最大的亮点在于引入了一种被称为“智能体友好”(agent-friendly)的全新架构,旨在构建一个开放的AI生态系统。通过这一架构,HarmonyOS...
Read More