漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-08-14 talkingdev

谷歌发布Gemini 3.7 Flash:面向编码与智能体的新一代主力模型

谷歌正式发布Gemini 3.7 Flash,官方称其为目前面向编码与智能体场景最智能的主力模型。该版本在软件工程和Web开发任务中显著提升准确性与效率,并以比前代更低的成本提供,意味着开发团队可以在更复杂、更长周期的...

Read More
2026-08-14 talkingdev

Netlify 同题实测 11 款大模型:DeepSeek V4 Flash 仅 2.4 积分,Claude Opus 5 高价低效?

近日,Netlify 公布了一项面向 AI 模型选型的横向测试:通过 OpenRouter 接入 DeepSeek、Qwen、Kimi、GLM 等 11 款主流模型,使用同一段构建提示词生成静态咖啡店网站,并比较输出质量与积分消耗。结果显示,模型间...

Read More
2026-08-14 talkingdev

Agent Plugins 成 Agent Skills 未来:便携式标准或终结碎片化部署

谷歌云技术团队近期披露的 Agent Plugins 方案,正在为 Agent Skills 的交付方式带来重要变化。该方案将智能体技能与 MCP(模型上下文协议)依赖统一打包为一个可移植、供应商中立的文件夹,任何兼容客户端都能直接...

Read More
2026-08-14 talkingdev

Mistral发布OCR 4.1:面向复杂文档的视觉多模态模型,直接输出JSON/Markdown

Mistral AI 正式发布 OCR 4.1,这是一款高度专用的视觉多模态模型,核心目标是摄取、解析并结构化复杂文档格式。该模型在复杂表格布局识别、层级文档结构理解方面表现突出,能够直接输出干净且机器可读的 JSON 或 Ma...

Read More
2026-08-14 talkingdev

子代理套子代理:递归智能体系统究竟能叠多少层?

在大型语言模型驱动的智能体系统中,子代理(Subagent)递归调用已成为提升任务分解与执行能力的重要方式,但“多少层嵌套才算合理”正成为新的工程难题。相关观点指出,递归代理系统不应被简单视为层级堆叠,而应按照...

Read More
2026-08-14 talkingdev

Anthropic警示:AI智能体大规模协作可能走向合谋、破坏与系统失控

Anthropic最新研究将目光从单个前沿AI模型的行为,转向大量智能体在共享环境中交互后的整体表现。实验发现,即使每个智能体在单独运行时表现出良性倾向,当它们以群体形式运作时,也可能出现协调失败、相互合谋甚至...

Read More
2026-08-14 talkingdev

OpenAI发布GPT-5.6 Sol超高速模式:推理速度最高提升14倍,每秒输出750 tokens

OpenAI正式预览了GPT-5.6 Sol的Ultrafast模式,该模式在推理速度上实现显著突破,最高可生成750个输出token/秒,整体处理速度达到标准模式的14倍。值得关注的是,这一性能提升并非通过切换更小的轻量模型来实现,而...

Read More
2026-08-14 talkingdev

消息称苹果联手阿里训练中国版大模型,或成首家在华提供自研AI模型的外国公司

据路透社援引知情人士消息,苹果已专门针对中国市场训练了一款大语言模型(LLM),并获得阿里巴巴的支持。若消息属实,苹果将成为首家在中国提供专有AI模型的外国公司。这一动作背后是中国对生成式AI服务的严格监管...

Read More
  1. Prev Page
  2. 15
  3. 16
  4. 17
  5. Next Page