漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-14 talkingdev

空货架还是丢钥匙?谷歌研究:GPT-5与Gemini 3事实性错误的瓶颈在“回忆”

大模型事实性错误常被简单归因为训练知识不足,但谷歌研究团队通过知识画像框架对Gemini 3、GPT-5等先进模型进行分析后发现,模型对事实知识的编码已接近饱和,真正的瓶颈出现在参数化回忆阶段。也就是说,模型并非...

Read More
2026-08-14 talkingdev

子代理套子代理:递归智能体系统究竟能叠多少层?

在大型语言模型驱动的智能体系统中,子代理(Subagent)递归调用已成为提升任务分解与执行能力的重要方式,但“多少层嵌套才算合理”正成为新的工程难题。相关观点指出,递归代理系统不应被简单视为层级堆叠,而应按照...

Read More
2026-08-14 talkingdev

消息称苹果联手阿里训练中国版大模型,或成首家在华提供自研AI模型的外国公司

据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...

Read More
2026-08-12 talkingdev

研究人员称疑似中国黑客利用开源AI智能体构建自主攻击工具,于七月入侵台湾政府网站

据英国《金融时报》报道,网络安全研究人员披露一起新型网络攻击事件:疑似来自中国的黑客组织利用开源AI智能体,成功搭建出一套能够完全自主执行侦察与入侵的自动化攻击工具。该工具在今年七月被用于入侵多个台湾政...

Read More
2026-08-10 talkingdev

LaunchDarkly CodeControl:让AI生成的代码在生产环境中更可控

随着大语言模型越来越多地参与代码生成,软件开发生命周期正面临前所未有的挑战:代码上线速度快了,但失控风险也随之增加。LaunchDarkly 推出的 CodeControl 平台正是为了解决这一矛盾,帮助团队对AI生成代码的执行...

Read More
2026-08-10 talkingdev

模型基因组:给大模型做个“DNA鉴定”,一眼看穿是否从零训练

在开源大语言模型百花齐放的今天,一个模型究竟是真正从零开始预训练,还是基于现有开源权重衍生微调,常让外界难以分辨。Hugging Face社区发布的“Model Genome”项目,首次提出用类似生物基因指纹的方式为模型“验明...

Read More
2026-08-10 talkingdev

中国AI视频模型横扫全球榜单:前十独占九席,或将在构建世界模型上建立优势

根据人工智能分析机构Artificial Analysis的最新排名,全球排名前十的文生视频模型中,中国AI实验室占据了其中九席,展现出在视频生成领域压倒性的技术集群优势。彭博社评论指出,过去一段时间,外界对中国人工智能...

Read More
2026-08-07 talkingdev

ChatGPT升级GPT-5.6 Sol模型,免费用户畅享无限对话与“思考”功能

OpenAI近日宣布对ChatGPT进行重要更新,核心围绕GPT-5.6 Sol与GPT-5.6 Luna两大模型展开。此次升级显著提升了GPT-5.6 Sol的响应准确性和一致性,使其在事实核查、逻辑推理和专业内容生成等任务上表现更为可靠,背后...

Read More
  1. Prev Page
  2. 3
  3. 4
  4. 5
  5. Next Page