阿里巴巴通义千问团队正式公布Qwen3.8,这是一款参数规模高达2.4万亿的超大规模语言模型,并明确表示将以开放权重(Open-Weight)的方式面向全球发布。这不仅是Qwen系列模型参数的又一次飞跃,也反映出阿里巴巴在开...
Read MoreOpenAI 最新推出的 GPT-5.6 在 Codex 开发环境中首次引入了一套精细化的多模型任务分配机制,将工作负载自动分流至 Sol、Terra 和 Luna 三个特性鲜明的执行单元。其中,Sol 专门应对目标模糊但价值极高的复杂问题,...
Read MoreMeta正式推出了新一代AI模型Muse Spark 1.1,在工具调用、代码生成、计算机交互和多模态推理等关键维度上实现了显著升级。该版本通过深度的模型架构优化与训练数据配比调整,让模型在理解复杂指令并自主操控外部工具...
Read More据《华盛顿邮报》报道,OpenAI宣布其最新AI模型GPT-5.6的使用权将由美国政府审查决定。这意味着该模型将不再向所有用户开放,而是需要经过联邦政府的批准,尤其是针对高风险或敏感领域的使用场景。此举旨在防止技术...
Read More人工智能初创公司 Anthropic 近日遭遇了一场波及全球的技术出口管制风波。据路透社报道,美国政府已下令 Anthropic 暂停所有外国公民对其最新旗舰大语言模型 Mythos 5 和 Fable 5 的访问权限。Anthropic 在周五迅速...
Read More微软近日发布了其最新的高效编程模型MAI-Code-1-Flash,并已深度集成至Visual Studio Code中的GitHub Copilot。该模型专为加速软件开发流程设计,具备智能体(Agentic)辅助能力与自适应推理特性,能够根据开发者的...
Read More在生成式AI的激烈竞争中,视频生成与世界模型正成为下一个前沿战场。Ethan He,这位曾领导NVIDIA Cosmos世界模型项目的核心人物,在加入xAI后仅用三个月便主导构建了Grok Imagine图像生成系统。在一篇长达98分钟的深...
Read More大型语言模型的部署成本一直是其广泛应用的主要障碍之一。一篇来自AlphaXiv的最新研究提出了一种创新解决方案:通过强化学习微调递归语言模型(RLMs)。该方法的核心在于训练一个共享的策略,同时驱动父模型和子模型...
Read More