漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-17 talkingdev

GPT-5.6 引入 Codex 多模型分工体系:Sol、Terra、Luna 各司其职,Sol Ultra 解锁深度推理与多智能体协同

OpenAI 最新推出的 GPT-5.6 在 Codex 开发环境中首次引入了一套精细化的多模型任务分配机制,将工作负载自动分流至 Sol、Terra 和 Luna 三个特性鲜明的执行单元。其中,Sol 专门应对目标模糊但价值极高的复杂问题,...

Read More
2026-06-23 talkingdev

开源模型 GLM-5.2 硬刚 Claude Opus:3D 游戏开发实测,成本与性能的终极博弈

在 AI 大模型竞争白热化的当下,开源模型与闭源旗舰的性能差距一直是业界关注的焦点。知名科技评测媒体 Tech Stackups 发布了一项引人注目的对比测试:将智谱开源的大型语言模型 GLM-5.2 与 Anthropic 的顶级闭源模...

Read More
2026-06-23 talkingdev

GLM-5.2登顶开源模型性能王座:强大基准测试背后的成本与局限

最新发布的开源大语言模型GLM-5.2在多项基准测试中展现出令人瞩目的性能,一举超越当前所有同级别开源模型,成为开源社区的新标杆。该模型在逻辑推理、代码生成以及多语言理解等关键领域表现尤为突出,其评测分数甚...

Read More
2026-06-14 talkingdev

GLM 5.2 正式发布并完全开源:前沿智能属于每一个人

智谱AI(Zhipu AI)联合创始人兼CEO张鹏(jietang)在社交媒体X上正式宣布,GLM系列最新大语言模型GLM 5.2现已完全开源。这一举动在AI社区引发广泛关注。张鹏在声明中强调,当前某些前沿模型突然因非技术原因被限制...

Read More
2026-05-03 talkingdev

中国开源模型Kimi K2.5在编程挑战中击败Claude、GPT-5.5和Gemini,引发业界震动

近日,一款名为Kimi K2.5的开源权重模型在编程挑战中击败了包括Claude、GPT-5.5和Gemini在内的多个顶级闭源模型。这一事件迅速在科技圈引发广泛关注,尤其在Hacker News上引发了激烈讨论。Kimi K2.5由中国团队开发,...

Read More
2026-04-30 talkingdev

Mistral Medium 3.5发布:128B密集模型驱动云端异步编程,性能登顶SWE-Bench

Mistral AI最新发布了Mistral Medium 3.5模型,这是一款拥有1280亿参数的密集模型(128B dense model),专为驱动远程Vibe代理而设计,能够在云端执行长时间、异步的编码任务,用户可直接从命令行界面(CLI)或Le Ch...

Read More
2026-04-14 talkingdev

Cognee框架革新:构建具备结构化记忆的智能体,终结LLM“健忘症”

当前,大型语言模型(LLM)驱动的智能体在执行复杂任务时面临根本性挑战:由于缺乏结构化记忆,其无状态的调用方式会导致上下文丢失、多步骤任务中断以及错误重复发生。传统解决方案如向量搜索,虽能处理简单查询,...

Read More
2026-04-13 talkingdev

AI网络安全新格局:神话之后,迎来“锯齿状前沿”

近期一项针对2026年重大漏洞的测试揭示,人工智能在网络安全领域的应用能力正呈现一种“锯齿状前沿”现象。测试结果表明,小型开源权重模型在漏洞发现与逻辑推理方面的表现,常常能与Anthropic的Mythos等大型专有模型...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page