微软宣布其最新文本到图像模型MAI-Image-2.6在Arena文本到图像排行榜上首次亮相即升至第二位,排名超过Google、Meta和xAI等竞争对手。Arena排行榜基于用户盲测与偏好投票,是评估生成模型综合表现的重要公开基准之一...
Read More微软正式发布 MAI-Thinking-1,这是一款面向企业工作负载的中等规模推理模型,重点提升编码、数学和知识类任务中的成本效率。该模型强调在推理能力与部署成本之间取得平衡,适合需要大规模调用又对响应速度和预算敏...
Read MoreSpecula 是一个智能体式系统,目标是自动化软件缺陷发现流程。它能够从代码中自动推导 TLA+ 规范,通过轨迹验证检查代码与规范之间的一致性,并对规范进行模型检查以发现并发缺陷;随后,它还会编写具有精确时序的集...
Read MoreQwen团队在Hugging Face发布Qwen3.8-2.4T-A95B模型。该模型基于Qwen3.5架构演进而来,重点提升编码与长时程任务处理能力,并通过改进的智能体执行机制提高任务完成可靠性。它支持SGLang、vLLM等主流部署框架,可较顺...
Read More在软件开发日益复杂、代码库规模持续膨胀的今天,如何高效理解跨多个仓库的代码逻辑成为开发者与AI编程助手共同面临的挑战。近日,一款名为Sourcebot的自托管工具在GitHub上引起了关注,它致力于通过复杂问答、代码...
Read MoreNVIDIA研究团队近日推出了一项名为WorldTrace的训练无关框架,直指视频世界模型在长时序自回归生成中的关键短板——记忆遗忘与生成质量退化。该工作通过为压缩的键值记忆赋予稳定、分布内位置偏移的方式,确保记忆在远...
Read More当人工智能能够自动化AI研发本身,世界会发生怎样的剧变?近期,红杉研究(Redwood Research)首席科学家瑞安·格林布拉特在一次深度访谈中探讨了递归式自我改进(RSI)这一当前AI领域最具争议的话题。他认为,一旦AI...
Read More英伟达推出了全新的Nemotron 3.5 Lightning模型和NeMo Switchyard开源库,旨在大幅降低AI代理的推理成本并提升效率。Nemotron 3.5 Lightning是一个拥有300亿参数的混合专家模型(MoE),专为高吞吐量的专用代理任务...
Read More