阿里巴巴通义千问团队正式公布Qwen3.8,这是一款参数规模高达2.4万亿的超大规模语言模型,并明确表示将以开放权重(Open-Weight)的方式面向全球发布。这不仅是Qwen系列模型参数的又一次飞跃,也反映出阿里巴巴在开...
Read More据TechCrunch报道,国内大语言模型开发商DeepSeek正在与投资者洽谈约15亿美元的新一轮融资,投前估值已高达710亿美元。与此同时,该公司被曝正为2027年首次公开募股(IPO)做准备。这一动作标志着DeepSeek在经历模型...
Read More据The Information援引知情人士消息,中国开源AI明星企业DeepSeek的年度经常性收入近期已达到4亿至5亿美元区间,展现出强劲的商业化增长势头。在这一业绩支撑下,公司正积极推进第二轮融资,计划筹集约74亿美元资金...
Read MoreDeepSeek近日正式开源了一款名为DSpark的创新框架,旨在显著加速大型语言模型(LLM)的推理过程,据称最高能将解码速度提升85%。这一突破性进展直接针对当前AI大模型在实际应用中普遍存在的响应延迟痛点。与传统模型...
Read More在人工智能领域,开源模型的性能与顶尖闭源模型之间的差距一直是业界关注的焦点。最近一篇来自LessWrong平台的深入分析指出,尽管开源模型在整体能力上仍不及GPT-4、Claude等最先进的闭源模型,但实际差距并没有想象...
Read More在AI大模型应用领域,成本与性能的平衡一直是开发者关注的焦点。近日,一款名为DeepClaude的开源工具在开发者社区引发热议。该项目巧妙地将DeepSeek V4 Pro模型与Claude Code的代理循环(Agent Loop)进行结合,旨在...
Read More由英伟达支持的美国人工智能初创公司Reflection正引领一项重要行动,旨在构建可自由获取的美国本土AI系统。作为少数几家与英伟达关联、致力于构建开源AI模型网络的初创企业之一,Reflection目前正进行融资谈判,计划...
Read More人工智能安全与研究公司Anthropic近日公开披露,其检测到并成功阻止了针对其旗舰AI模型Claude的大规模“知识蒸馏”攻击。Anthropic指控中国AI公司深度求索(DeepSeek)、月之暗面(Moonshot AI)以及MiniMax创建了超过...
Read More