阿里巴巴通义千问团队近日正式推出第三代基础图像生成模型Qwen-Image-3.0,在内容丰富度、细节真实感和世界知识融合方面实现全面升级。该模型支持最高4.5k token的文本输入,能够精准理解复杂长文本的语义,并生成富...
Read MoreMeta正式推出了新一代AI模型Muse Spark 1.1,在工具调用、代码生成、计算机交互和多模态推理等关键维度上实现了显著升级。该版本通过深度的模型架构优化与训练数据配比调整,让模型在理解复杂指令并自主操控外部工具...
Read MoreNVIDIA近期通过一篇官方博客深入探讨了数据在构建强大AI智能体中的核心地位,明确指出开放数据和合成数据是推动下一代AI发展的关键要素。随着AI系统日益复杂,特别是需要具备推理、规划和工具调用等高级能力的智能体...
Read More近日,StepFun正式发布了其前沿开源基础模型Step 3.5 Flash。该模型定位为高效、高速推理与具备智能体(Agent)能力的先进模型,其核心特性在于集成了工具使用、长上下文处理以及支持本地部署等关键能力。Step 3.5 F...
Read More专注于开发AI智能体(AI Agents)的初创公司Outset近日宣布,已完成由Radical Ventures领投的3000万美元B轮融资。该公司联合创始人兼首席执行官Aaron Cannon向Axios Pro透露了此轮融资细节。Outset的核心产品是一个“...
Read More谷歌AI工作室最新推出的Nano Banana Pro标志着AI图像生成技术进入新阶段。该工具集成了多模态推理、实时网络搜索和4K超高清渲染三大核心能力,能够根据复杂指令自动获取知识并生成高质量视觉内容。与传统图像生成模...
Read More艾伦人工智能研究所(AI2)近日开源了MolmoAct模型,这是首个基于Molmo框架构建的、专注于三维空间推理的动作理解系统。该模型通过创新的三维空间表征学习方法,实现了对复杂指令的精准环境交互能力,在SpatialQA等...
Read More《纽约时报》科技专栏作者Kevin Roose对亚马逊最新推出的智能语音助手Alexa+进行了深度体验。这款被寄予厚望的升级版展现出两大技术特性:采用更先进的自然语言处理架构,实现了接近人类对话的交互流畅度;在多步骤...
Read More