漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2026-07-16 talkingdev

GPT-Red:OpenAI 用自我博弈实现自动化红队,GPT-5.6 Sol 提示注入漏洞暴降六倍

OpenAI 正式发布了其新一代自动化安全测试系统 GPT-Red。该系统不再依赖传统人工红队测试,而是通过大规模的自我博弈机制,让模型在对抗中持续进化。具体而言,GPT-Red 被训练成能够迭代式生成对抗性提示,系统性地...

Read More
2026-07-14 talkingdev

Sakana AI 推出智能细胞砖:去中心化物理硬件实现自组织3D形状重建

Sakana AI 将其在集体智能领域的探索从软件推向了物理世界,发布了“智能细胞砖”(Smart Cellular Bricks)项目。这种模块化硬件砖块摒弃了传统集中式控制架构,每一块砖都内嵌局部通信模块和小型神经网络,能够通过...

Read More
2026-07-12 talkingdev

Meta发布Muse Spark 1.1:多模态推理与工具交互能力大幅增强,同步开放API预览

Meta正式推出了新一代AI模型Muse Spark 1.1,在工具调用、代码生成、计算机交互和多模态推理等关键维度上实现了显著升级。该版本通过深度的模型架构优化与训练数据配比调整,让模型在理解复杂指令并自主操控外部工具...

Read More
2026-06-27 talkingdev

OpenAI 预览 GPT-5.6 Sol:下一代模型在编程、科学和网络安全领域能力大幅跃升

OpenAI 正式对外预览了其下一代旗舰模型——GPT-5.6 Sol。这一模型不仅在编程、科学研究和网络安全等关键领域展现出显著增强的能力,更引人关注的是,它首次搭载了OpenAI迄今最先进的安全栈。从技术层面看,GPT-5.6 So...

Read More
2026-06-23 talkingdev

GLM-5.2登顶开源模型性能王座:强大基准测试背后的成本与局限

最新发布的开源大语言模型GLM-5.2在多项基准测试中展现出令人瞩目的性能,一举超越当前所有同级别开源模型,成为开源社区的新标杆。该模型在逻辑推理、代码生成以及多语言理解等关键领域表现尤为突出,其评测分数甚...

Read More
2026-06-18 talkingdev

大模型输出不稳定?WorkOS用评估系统(evals)解决AI代码生成不一致难题

在AI辅助编程日益普及的今天,一个令人头疼的问题浮出水面:相同的输入和提示词,却总能得到不同的输出结果。这种不确定性严重阻碍了AI代理(Agent)在代码编写中的可靠性。知名身份认证平台WorkOS的工程师Nick Nisi...

Read More
2026-05-21 talkingdev

谷歌发布Agent Executor:分布式AI代理运行的开源新标准

谷歌云近日正式推出Agent Executor,这是一个面向AI代理(Agent)的分布式运行时开源标准,旨在解决长时间运行的代理工作流在可靠性、效率和扩展性上的核心挑战。Agent Executor通过引入持久化执行机制,确保代理任...

Read More
2026-05-20 talkingdev

OpenAI推内容溯源技术矩阵:C2PA元数据+SynthID水印,打造更安全的AI生成内容生态

随着生成式AI内容的爆发式增长,如何区分AI生成内容与人类创作,并确保其可信度成为行业焦点。OpenAI近日宣布了一项多层次的AI内容溯源策略,旨在提升AI生成媒体的透明度和安全性。该方案首先采用C2PA(内容来源与真...

Read More
  1. 1
  2. 2
  3. 3
  4. Next Page